KEN’S CAT LOG

Tägliche LLM-News — 2026-09-25

Nur 89 Minuten nachdem Anthropic am 22. September Claude Opus 5.5 angekündigt hatte, brachte OpenAI GPT-6 Sol/Luna heraus und halbierte die Preise. Dieser Schlagabtausch zwischen Closed-Source-Modellen ist das heutige Topthema und wurde unabhängig auf X, YouTube, Bluesky und Lemmy bestätigt. Beim Momentum der Open-Weight-Modelle gehen die Einschätzungen je nach Plattform allerdings auseinander.

Die heute meistdiskutierten LLM-News — 2026-09-25

Das größte Ereignis dieser Woche ist ein „Kampf um das Ankündigungs-Timing“ zwischen Closed-Source-Modellen: Nur 89 Minuten nachdem Anthropic am 22. September „Claude Opus 5.5“ vorgestellt hatte, veröffentlichte OpenAI „GPT-6 Sol/Luna“ und halbierte die Preise. Der Vorfall wurde unabhängig auf X, YouTube, Bluesky und Lemmy aufgegriffen und ist damit klar das heute meistdiskutierte Thema. Auf Reddit tauchte das Thema dagegen kaum auf; dort dominierten andere Diskussionen wie die stark steigenden Preise lokaler GPUs und die Untersuchung von DeepSeek/Kimi durch Pekinger Behörden. Beim Momentum der Open-Weight-Modelle sind die Plattformen deutlich gespalten. Es lässt sich nicht einfach sagen, dass offene Modelle gewinnen oder verlieren.

Plattformübergreifend

Plattform für Plattform

Reddit: Die wichtigsten Schauplätze sind r/LocalLLaMA (lokale Ausführung und Hardware) sowie r/singularity (Eilmeldungen zu neuen Modellen). Den höchsten Score des Tages erzielte ein Beitrag über die schmerzhaft steigenden Preise lokaler GPUs und Spezialhardware (647 Punkte, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), gefolgt von einem Thread über die Untersuchung von DeepSeek/Kimi durch Pekinger Behörden wegen eines mutmaßlichen „Datenabflusses an Anthropic“ (311 Punkte, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Auffällig ist, dass gesellschaftliche und kulturelle Debatten – etwa über die offene Nutzung von LLMs beim wissenschaftlichen Schreiben (r/PhD, 493 Punkte) – mehr Resonanz erhielten als Produktneuigkeiten. Dass die Reddit-Sammlung keinerlei Hinweise auf Opus 5.5 oder GPT-6 Sol/Luna enthielt, obwohl diese auf anderen Plattformen das größte Thema waren, ist eine relevante plattformübergreifende Lücke.

X: Explore (die Trends) war mit LLM-fremden Themen wie Taylor, Serbia und Cardano gefüllt. Die einzigen Suchbegriffe mit relevanten Treffern waren „Opus 5.5“ und „Claude“. Alle acht gefundenen Beiträge waren Praxisberichte japanischsprachiger Einzel-Creator nach dem Muster „Ich habe Opus 5.5 ein Tool bedienen lassen“. Primäre Nachrichteninformationen zu Modellankündigungen, Preisänderungen oder Benchmarks gab es nicht. Der Zielwert von zehn Beiträgen wurde nicht erreicht; die Sammlung wurde bei acht beendet.

YouTube: Am schnellsten entwickelte sich die Meldung über das „erste Ergebnis“ von Anthropics neuem Biolabor: Claude soll ein CRISPR-ähnliches Enzymsystem (ART) entdeckt haben. Mehrere Kanäle griffen es gleichzeitig 18 bis 19 Stunden nach Veröffentlichung auf (Dr. Samuel Allen Alexander https://www.youtube.com/watch?v=_m_216JykA0, Wes Roth https://www.youtube.com/watch?v=H7KruLVX2Rk). Zudem gab es mehrere Videos zu Preis- und Benchmarkvergleichen von Opus 5.5 und GPT-6 Sol/Luna. Zwar konnten Abruf- und Abonnentenzahlen nicht erhoben werden (siehe Limits), doch inhaltlich war die Berichterstattung hier heute am umfangreichsten.

Bluesky: TestingCatalog und Simon Willison bilden die wichtigsten Informationsachsen. Viele Beiträge betreffen neue Modelle in der Vorankündigungs- oder Leak-Phase: den bevorstehenden Start von GPT-6 Sol/Luna, Leaks zu Gemini 4 Pro und Tests von Fable 5.2/Opus 5.5. Besonders bemerkenswert sind quantitative Daten von Epoch AI: KI-Kosten sinken pro Quartal um etwa 47 %, und das von o3 auf FrontierMath erreichte Niveau soll mit Kosten von einem 377stel reproduzierbar sein (👍123, https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h ). Diese Präzision findet sich auf anderen Plattformen nicht. Die offizielle Such-API lieferte allerdings 403, weshalb die Sammlung auf einzelne Accounts beschränkt blieb.

Lemmy: Im Mittelpunkt stehen !technology, !LocalLLaMA und !ai_reddit (Reddit-Spiegelungen). Neben einem Artikel über den angeblichen drastischen Rückgang des Marktanteils geschlossener Modelle gibt es viele technische Open-Weight-Nachrichten: die bestätigte Veröffentlichung von Qwen4-27B, llama.cpp v0.5.0 und das medizinische Open-Weight-Modell HuatuoGPT-3-27B. Die Definitionsdebatte, ob K2 Horizons wirklich das erste Open-Source-LLM sei (👍48/👎10, https://lemmy.world/post/52135351 ), läuft weiter. Um zehn Beiträge zusammenzubekommen, wurden auch Posts von vor drei beziehungsweise fünf Tagen einbezogen.

Worauf achten

  • Konzept einer Frontier AI Standards Agency (SAFA): Dabei geht es um eine freiwillige Organisation für Sicherheitsstandards durch OpenAI, Google und Anthropic. Auf YouTube gibt es noch kein eigenes Video dazu; Print- und Onlinemedien wie AI Weekly sind derzeit voraus. Es lohnt sich, den Zeitpunkt zu beobachten, an dem das Thema in Videos auftaucht.
  • Untersuchung von DeepSeek/Kimi durch Pekinger Behörden: Der Verdacht betrifft Datenübertragungen über Anthropic (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Je nach Reaktion der Regulierungsbehörden könnte daraus eine geopolitische Nachricht werden.
  • Debatte über K2 Horizons als „erstes Open-Source-LLM“: Der Vergleich mit früheren Beispielen wie GPT-Neo, OPT und BLOOM geht weiter (Lemmy, https://lemmy.world/post/52135351 ). Die Debatte über die Definition von Open Weight selbst sollte weiter verfolgt werden.
  • Vercel-Daten zum Marktanteil geschlossener Modelle von 70 % → 21,6 %: Die Behauptung erscheint nur in einem über Lemmy gefundenen Sekundärartikel (https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/ ). Eine Überprüfung anhand primärer Vercel-Daten ist nötig.
  • Anthropics neues Biolabor: Die Claude-Entdeckung eines CRISPR-ähnlichen Enzymsystems (YouTube, https://www.youtube.com/watch?v=_m_216JykA0 ) ist als Beispiel dafür interessant, dass KI reale wissenschaftliche Forschung anführt. Weitere Meldungen dazu sind es wert, verfolgt zu werden.
  • Steigende Preise lokaler GPUs und Spezialhardware: Unzufriedenheit über Preissteigerungen etwa bei NVIDIA „Spark“ erzielte den höchsten Score in r/LocalLLaMA (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ). Da dies direkt die Kostenstruktur des Betriebs von Open-Weight-Modellen betrifft, bleibt es relevant.

Empfehlungen

  1. Bei der nächsten Reddit-Recherche konkrete Modellnamen wie „Opus 5.5“, „GPT-6 Sol“ und „GPT-6 Luna“ als Suchbegriffe ergänzen. Mit dem einzigen Suchbegriff „Daily LLM News“ wurde die größte Nachricht der Woche verpasst.
  2. Die Vercel-Zahl zum Marktanteil geschlossener Modelle von 70 % → 21,6 % erst nach Prüfung der Primärdaten zitieren. Aktuell stützt sie sich lediglich auf einen weiterzitierten Artikel.
  3. Die Entwicklung der Frontier AI Standards Agency (SAFA) fortlaufend in Textmedien wie AI Weekly und The Information verfolgen, um die verzögerte Sichtbarkeit in sozialen Netzwerken auszugleichen.
  4. Wissenschaftliche Ergebnisse aus Anthropics Biolabor künftig in einer eigenen Beobachtungskategorie verfolgen, da sie über LLM-News hinaus auch wissenschaftliche Relevanz haben.
  5. Bei X-Recherchen zusätzliche Suchbegriffe für englischsprachige Primärquellen – offizielle Ankündigungen und Pressemitteilungen – verwenden, da die Ergebnisse leicht zu Praxisberichten japanischer Creators verzerrt werden.
  6. Zu Beginn der nächsten Recherche prüfen, ob der 403-Fehler der offiziellen Bluesky-Such-API behoben ist. Falls ja, kann wieder eine umfassendere Stichwortsuche statt einer accountbasierten Sammlung genutzt werden.

Datenqualität

Reddit (12 gesammelte Beiträge, Zielwert erreicht) und Lemmy (12 Beiträge, teils mit Themen von vor drei bis fünf Tagen ergänzt) erfüllten die geforderte Menge. X blieb bei acht Beiträgen, weil fast alle Suchbegriffe LLM-fremd waren. Bei Bluesky war die offizielle Such-API wegen 403 nicht nutzbar; die Ersatzsammlung nach Accounts fand keinen einzigen Beitrag vom selben Tag, sondern überwiegend Posts vom 20. bis 23. September. YouTube lieferte genügend Videos, aber aufgrund von JavaScript-Rendering konnten genaue Abruf- und Abonnentenzahlen nicht erhoben werden; auch Daten beruhen nur auf Schätzungen aus relativen Zeitangaben. Insgesamt erfüllten nur Reddit und Lemmy die quantitativen Zielwerte vollständig; bei X, Bluesky und YouTube war die Datentiefe aufgrund methodischer Einschränkungen begrenzt.

Zusammenfassung nach Plattform

Reddit

Reddit — Tägliche LLM-News

Wo

Mit dem Suchbegriff „Daily LLM News“ wurden insgesamt 12 Threads aus 11 Subreddits gesammelt.

Subreddit Mitgliederzahl Anzahl gesammelter Threads
r/LocalLLaMA 833.592 2
r/PhD 286.410 1
r/NoStupidQuestions 7.515.698 1
r/QuebecTI 16.177 1
r/LocalLLM 230.819 1
r/singularity 3.995.842 1
r/BetterOffline 56.810 1
r/LSM 1.097 1
r/accelerate 90.603 1
r/slatestarcodex 83.704 1
r/ArtificialInteligence 1.940.857 1

Die wichtigsten Schauplätze für LLM-News sind r/LocalLLaMA (stärker auf lokale Ausführung und Hardware fokussiert) und r/singularity (stärker auf Eilmeldungen zu neuen Modellen fokussiert). r/PhD, r/BetterOffline und r/slatestarcodex tragen die begleitende Debatte darüber, wie LLMs Gesellschaft und Wissenschaft beeinflussen. Der eine Beitrag in r/LSM (#8) hatte keinen Bezug zu LLMs und wurde als Suchrauschen eingestuft (siehe Limits).

Was die Leute sagen
  • Gerüchte über eine Welle neuer Modelle: Im r/singularity-Thread #5 „Quite a few new model releases expected this week“ (501 Punkte, 153 Kommentare, 2026-09-21, https://www.reddit.com/r/singularity/comments/1wme7xj/ ) ging es um Gerüchte zu Astra 6.1 am 29. September und die bereits erfolgte Veröffentlichung von Grok 4.7. u/Immediate_Simple_217 (69 Punkte) kommentierte: „Gemini 4 pro kommt nicht diese Woche, sondern im Oktober. Alle Gerüchte und ETAs zielen auf Oktober. Auch dass Kimi und ein neues Meta-Modell nicht erwähnt werden, ist bemerkenswert.“
  • Untersuchung von DeepSeek/Kimi durch Pekinger Behörden: Der r/LocalLLaMA-Thread #6 „DeepSeek and Moonshot AI face Beijing's probe over potential data leaks to Anthropic“ (311 Punkte, 92 Kommentare, 2026-09-23, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ) erhielt große Aufmerksamkeit. u/TraditionalWait9150 (115 Punkte) fasste zusammen, dass Peking befürchte, militärische, polizeiliche und geschäftliche Geheimnisse könnten in die USA gelangt sein, weil beide KI-Unternehmen Daten über Anthropic weitergeleitet hätten. u/mrdevlar (34 Punkte) korrigierte: Der Titel sei ungenau; es gehe nicht um ein Datenleck, sondern um die Umleitung von Traffic zu Anthropic.
  • Frust über steigende Preise für lokale GPUs und Hardware: Der r/LocalLLaMA-Thread #10 „How it feels watching prices go up“ (647 Punkte, 110 Kommentare, 2026-09-21, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ) erzielte den Tageshöchstwert. u/swiebertjee (106 Punkte) schrieb, er habe vor einem Monat zwei Spark-Geräte gekauft und sei dafür als verrückt bezeichnet worden; inzwischen sei der Preis pro Gerät um 600 Dollar gestiegen. Das sei die beste Investition, aber die schlechteste Nachricht.
  • Kaufberichte zu lokalen Systemen: Im r/LocalLLM-Thread #4 „Finally got it“ (188 Punkte, 38 Kommentare, 2026-09-22, https://www.reddit.com/r/LocalLLM/comments/1wnmm8n/ ) sorgte ein Bericht über neue Hardware für typische Kaufspiralen-Witze. u/Abducted_Llama (64 Punkte) warnte: „Du wirst ein zweites wollen.“
  • Offenerer Einsatz von LLMs beim wissenschaftlichen Schreiben: Im r/PhD-Thread #1 „Seems academia is actually encouraging LLM usage in research papers“ (493 Punkte, 265 Kommentare, 2026-09-20, https://www.reddit.com/r/PhD/comments/1wlrhda/ ) war der Auslöser, dass bekannte Professoren von MIT und Stanford in Papers angaben, sie überwiegend mit ChatGPT 5.6 geschrieben zu haben. u/o12341 (89 Punkte) argumentierte, die Kultur „publish or perish“ sei das Kernproblem: Wenn die Wahl zwischen KI-Slop produzieren und verschwinden liege, wählten viele Ersteres.
  • MITs These einer Skalierungsgrenze für LLMs – Reaktion aus dem französischsprachigen Raum: Im r/QuebecTI-Thread #3 „MIT Just Found a Hard Limit in LLM Scaling, and Money Won't Fix It“ (54 Punkte, 50 Kommentare, 2026-09-20, https://www.reddit.com/r/QuebecTI/comments/1wlr6vq/ ) schrieb u/zx440 (23 Punkte), die Meldung bestätige die Intuition, dass KI nicht nur aus LLMs bestehe; Reasoning, agentische Systeme und Deep Thought seien letztlich nur LLMs, die in Schleifen miteinander redeten.
  • Streit über die Behauptung „LLMs sind nur ein Trend“: Der r/NoStupidQuestions-Thread #2 „When is the LLM fad finally going to die out?“ (0 Punkte, 31 Kommentare, 2026-09-23, https://www.reddit.com/r/NoStupidQuestions/comments/1wo0heg/ ) verglich LLMs mit dem NFT-Hype. u/737Max-Impact (25 Punkte) hielt dagegen: Der Aktienmarkt könne sich korrigieren, aber LLMs und die umgebenden Technologien würden nicht verschwinden – sie seien zu nützlich.
  • Widerspruch gegen Berichte über einen „Doom Loop“: Der r/ArtificialInteligence-Thread #12 „'Doom Loop': OpenAI and Microsoft Admits LLMs Are Destroying the Web and Built on Theft“ (127 Punkte, 36 Kommentare, 2026-09-19, https://www.reddit.com/r/ArtificialInteligence/comments/1wkmo3u/ ) zitierte einen Artikel über die Verwendung des Begriffs „theft“ in Microsoft-internen Dokumenten. Der Top-Kommentar von u/KamikazeArchon (20 Punkte) kritisierte jedoch, der Artikel reiße Zitate aus ihrem Kontext und verdrehe ihre Bedeutung.
  • Erwartungen an ein Paper zu LLMs mit unendlichen Parametern: Im r/accelerate-Thread #9 „Infinite-Parameter LLMs: Generating and Adapting Weights from Live Data“ (205 Punkte, 20 Kommentare, 2026-09-18, https://www.reddit.com/r/accelerate/comments/1wjgw2y/ ) reagierte u/armentho (65 Punkte) begeistert: Gewichte in Echtzeit umschreiben? Rekursive Selbstverbesserung komme endlich. u/arjuna66671 (14 Punkte) erklärte nüchterner, es sei eher wie ein Aktenschrank; das Kernmodell verändere sich während einer Unterhaltung nicht.
  • Verbindung zwischen LLM-Szene und EA-/Rationalismus-Community: Im r/BetterOffline-Thread #7 „Are people really this weirded out by the connection of the LLM scene to EA/rationalism?“ (270 Punkte, 117 Kommentare, 2026-09-19, https://www.reddit.com/r/BetterOffline/comments/1wkj0mh/ ) schrieb u/Icy-Recognition-7453 (106 Punkte), wie tief EA ins Silicon Valley eingedrungen sei. Für einige Menschen fänden Leben, Arbeit, Dating und Ehe vollständig innerhalb eines „Kults“ statt.
  • N=1-Experiment: persönliche Daten an ein LLM geben: Der r/slatestarcodex-Thread #11 „What it feels like to let an LLM read my journals, sleep, finances and analyze me for 15 minutes a week“ (9 Punkte, 14 Kommentare, 2026-09-24, https://www.reddit.com/r/slatestarcodex/comments/1wozi2w/ ) beschreibt ein Experiment, bei dem der Autor Claude Tagebücher, Schlaf- und Finanzdaten lesen und wöchentlich eine Selbstanalyse durchführen lässt. Der Autor äußert die Sorge, nicht zu wissen, wie LLMs langfristig die eigene Identität verändern und ob vorab ausreichend informiert eingewilligt werden könne.
Signale
  • Steigend: Unzufriedenheit und Überraschung über steigende Preise lokaler GPUs und Spezialhardware wie NVIDIA „Spark“ oder 5090 (#10, #4) waren das erfolgreichste Thema des Tages im LocalLLaMA-Umfeld. Auffällig sind rückblickende Kommentare wie „gut, dass ich vor der Preiserhöhung gekauft habe“.
  • Steigend: Die geopolitischen Vorwürfe rund um DeepSeek/Kimi, Pekinger Behörden und Anthropic (#6) erzeugten außerordentlich hohe Scores und viel Diskussion. Das Thema geht über Techniknachrichten hinaus und berührt Sicherheitsinteressen: Könnten Daten aus China über Anthropic geflossen sein?
  • Zunehmend zurückgewiesene Behauptung: Der Artikel (#12), dem zufolge Microsoft und OpenAI eingeräumt hätten, LLMs beruhten auf Diebstahl und zerstörten das Web in einem „doom loop“, wurde im Top-Kommentar wegen kontextverzerrender Zitate kritisiert und nicht breit unterstützt.
  • Gegensätzliche Perspektiven: Selbst beim Thema „Grenzen von LLMs“ herrschen entgegengesetzte Stimmungen: r/QuebecTI (#3) stellt MITs Skalierungsgrenze wohlwollend vor, während r/accelerate (#9) mit Hoffnung auf rekursive Selbstverbesserung durch eine neue Architektur reagiert. In derselben Woche laufen zugleich die Positionen „LLMs sind am Ende“ und „mit neuen Architekturen gibt es kein Limit“.
  • Überraschung: Soziologische Diskussionen darüber, mit welchen Kulturen und Ideologien LLMs verbunden sind – EA/Rationalismus, Wissenschaft und Identität (#1, #7, #11) – zogen hohe Scores und lange Kommentare an. Das Interesse scheint nachhaltiger zu sein als die Reaktion auf reine Produktnachrichten.
  • Erschöpfung in der breiten Öffentlichkeit: Der Thread in r/NoStupidQuestions (#2) hat zwar einen Score von 0, doch zahlreiche Kommentare widersprechen der naiven Frage, ob KI nur ein kurzfristiger Hype wie NFTs sei, mit praktischen Nutzungserfahrungen. Auch bei allgemeinen Nutzern gehen die Ansichten auseinander.
Limits
  • Es wurde nur der Suchbegriff „Daily LLM News“ verwendet; die Sammlung beschränkt sich auf ein einzelnes Suchergebnis mit 12 Threads aus 11 Subreddits. Das im Briefing verlangte Lesen von zehn Beiträgen wurde erfüllt, aber es gab keine übergreifende Recherche mit mehreren Suchbegriffen.
  • Thread #8 (r/LSM „Breaking News:“, 75 Punkte, 2026-09-19, https://www.reddit.com/r/LSM/comments/1wkiow2/ ) handelt von Colin Moriartys Teilnahme an einer Ed-Sheeran-Tour und hat keinen Bezug zu LLMs. Er wurde als Fehlfund behandelt und aus der inhaltlichen Auswertung unter „What people say“ und „Where“ ausgeschlossen.
  • In den Sammeldaten gibt es keine Einträge zu nicht erreichbaren Seiten oder Suchanfragen ohne Treffer; für alle 12 Threads liegen Score, Datum und Link vor. Es gab daher keine nicht geöffneten Threads.
  • Der Datumsbereich reicht ungefähr eine Woche vom 18. bis 24. September 2026. Ältere Diskussionen und Reaktionen vom eigentlichen Datum des Briefings, dem 25. September, wurden nicht erfasst.

X

X — Tägliche LLM-News (2026-09-25)

Accounts

Auf X diskutierten tatsächlich LLM-bezogene Themen vor allem individuelle Creator aus Video- und Gamesproduktion. Sie veröffentlichten jeweils ein bis zwei einzelne Posts; es gab keine großen Accounts mit vielen aufeinanderfolgenden Beiträgen.

Account Name Posts Likes Inhalt
@kevin_t_ngo Kevin Ngo 1 3.470 (~235.000 Views) Erstellte mit Claude Opus 5.5 eine GIF-Animation für Blender; dankte @claudeai
@KanaWorks_AI KANA|Tokyo AI Video 2 438 Erstellte 3D-/ARPG-Projekte mit Opus 5.5 × Godot und Opus 5.5 × Unreal
@akiy_8 AKI 1 467 Erstellte mit Opus 5.5 eine Pixelanimation in einer einzelnen HTML-Datei mit 470 Zeilen
@aicreataro aicreataro 1 444 Ließ Opus 5.5 After Effects zur Videobearbeitung steuern
@shinshin86 shinshin86|AITuber-OnAir-Entwickler 1 308 Ließ Opus 5.5 ein Tool zur Erzeugung von Live2D-Bewegungen bedienen
@ponzponz15 ponzu 1 198 3D-Kamera- und 3D-Textbearbeitung mit Claude Opus / Codex + Hyperframes
@seiiiiiiiiiiru Video-Creator, der SEIIIRUAI nutzt 1 78 KI-Werbevideo mit Opus 5.5 + Gemini 3.8 Flash TTS

Dabei handelt es sich weniger um Accounts, die mit einem einzelnen Post stark gewachsen sind, sondern um eine Welle japanischsprachiger KI-Video-Creator, die Opus 5.5 gleichzeitig ausprobieren. Nur der Beitrag von @kevin_t_ngo fällt im englischsprachigen Raum deutlich auf (3.470 Likes, etwa 235.000 Views).

Posts
  1. @kevin_t_ngo (3.470 Likes, 165 Reposts, 81 Antworten, ~235.000 Views, 2026-09-23)
    https://x.com/kevin_t_ngo/status/2102761406315839798

    Thank you @claudeai ! GIF animated in Python and rendered in Blender by Claude Opus 5.5
    Gefunden über die Suche nach „Claude“. Der am stärksten verbreitete englischsprachige Post mit Bezug zu Opus 5.5.

  2. @KanaWorks_AI (316 Likes, 38 Reposts, 15 Antworten, ~16.000 Views, 2026-09-24)
    https://x.com/KanaWorks_AI/status/2102955708321062975

    Claude Opus 5.5 × Godotで3Dゲーム開発。Godotでゲームを作るのは、Unityより少し手軽に感じる。動作も軽くて、仕上がりもかなりいい感じ
    Gefunden über die Suche nach „Opus 5.5“.

  3. @KanaWorks_AI (122 Likes, 14 Reposts, 9 Antworten, ~6.700 Views, 2026-09-24)
    https://x.com/KanaWorks_AI/status/2103138051165933661

    Claude Opus 5.5 × Unreal まさか、自分でこんなARPGを作れる日が来るなんて思ってもいませんでした。
    Gefunden über die Suche nach „Claude“. Dieselbe Person lässt Opus 5.5 Spiele sowohl mit Godot als auch mit Unreal entwickeln.

  4. @akiy_8 (467 Likes, 43 Reposts, 6 Antworten, ~21.000 Views, 2026-09-22)
    https://x.com/akiy_8/status/2102545213218803769

    Opus 5.5でピクセルアニメーション生成してみた ・単一HTML 470行 ・スプライトはすべてコード内のドット配列 ・ボイドと状態遷移で54匹の群れ+約15種が自律動作 ・30色パレット、320×180
    Gefunden über die Suche nach „Opus 5.5“. Der technisch konkreteste Praxisbeitrag mit den meisten Zahlen.

  5. @aicreataro (444 Likes, 66 Reposts, 7 Antworten, ~45.000 Views, 2026-09-23)
    https://x.com/aicreataro/status/2102656273112326609

    Opus 5.5にAfter Effectsを操作させて、AI動画を加工するテスト。■ベース MiniMax H3 で15秒を1本 ■AEでやらせたこと ・カットの切れ目を拍に合わせて速さを調整 ・区間ごとにエフェクトを1つずつ
    Gefunden über die Suche nach „Opus 5.5“. Der meistgesehene Opus-5.5-bezogene Post in dieser Sammlung.

  6. @shinshin86 (308 Likes, 36 Reposts, 6 Antworten, ~31.000 Views, 2026-09-24)
    https://x.com/shinshin86/status/2103037974242046335

    Opus 5.5、かなりモーション生成能力高そうなので、Live2Dモーションもお願いしてみたら良い感じ...Claude Code (Opus
    Gefunden über die Suche nach „Claude“. Beschreibt sogar konkrete Schritte zur Tool-Integration: Zusatztool für Live2D klonen und über Claude Code bedienen.

  7. @ponzponz15 (198 Likes, 17 Reposts, 7 Antworten, ~31.000 Views, 2026-09-24)
    https://x.com/ponzponz15/status/2102931824918106499

    3Dカメラ×立体テキスト演出② After Effectsで作るような編集がClaude OpusやCodexでも可能に。上 Seedance 2.5 prev 下 Codex + Hyperframes skill #dreaminacpp
    Gefunden über die Suche nach „Claude“. Erwähnt Claude Opus und Codex im Kontext eines Vergleichs und kombinierten Einsatzes.

  8. @seiiiiiiiiiiru (78 Likes, 13 Reposts, 3 Antworten, ~3.300 Views, 2026-09-24)
    https://x.com/seiiiiiiiiiiru/status/2103227982592831846

    AI広告動画 → AI音声 × AI編集 もうここがゴール地点ってことでいいでしょ。笑 Cluad Opus 5.5にGemini 3.8 Flash TTSでナレーション生成させて、その音声に合わせた動画をそのままClaudeでAEやその他ツールを操作して作りました。
    Gefunden über die Suche nach „Opus 5.5“. Ein praktisches Beispiel für eine Pipeline aus Claude und Gemini.

Signale
  • Was zunimmt: Die auf X tatsächlich diskutierten LLM-Themen sind nicht Modellankündigungen oder Benchmarks, sondern Praxisberichte darüber, Claude Opus 5.5 Tools bedienen zu lassen. Mehrere unabhängige japanischsprachige Creator zeigen, wie Opus 5.5 Werkzeuge für Video- und Spieleproduktion – After Effects, Blender, Godot, Unreal oder Live2D – steuert und Ergebnisse erzeugt.
  • Was übersehen wird: Neuankündigungen, Open-Weight-Releases, API-Preisänderungen, Benchmarkvergleiche und Unternehmensbewegungen – die Themen, die das Briefing eigentlich sucht – wurden in der Sammlung kein einziges Mal gefunden. Erwähnungen von „Claude“ und „Opus 5.5“ auf X sind auf Praxisberichte statt auf Nachrichten konzentriert.
  • Überraschend: X Explore war mit LLM-fremden Themen wie „$song“, „Taylor“, „Serbia“, „Cardano“, „Croats“, „Croatia“, „NFTs“ und „Israel“ gefüllt. Von den auf Basis von Explore verwendeten Suchbegriffen lieferten nur „Opus 5.5“ und „Claude“ relevante Ergebnisse. In den allgemeinen X-Trends des Tages spielten LLM-News keine Rolle.
Limits
  • Die Sammlung ging von Explore aus, das auf dem Serverzugriff beruhte; bei vielen führenden Einträgen stand ausdrücklich „Trending in Croatia“. Die Explore-Liste dieser Recherche repräsentiert also eine kroatische Perspektive und kann nicht als weltweiter Trend verstanden werden.
  • Die tatsächlich gesuchten Begriffe waren „$song“, „Opus 5.5“, „Taylor“, „Serbia“, „Cardano“, „Croats“, „Croatia“, „NFTs“, „Claude“ und „Israel“ – direkt die ersten zehn Explore-Themen. Nur „Opus 5.5“ und „Claude“ waren für das LLM-Briefing relevant. Die anderen acht Begriffe lieferten ausschließlich LLM-fremde Resultate.
  • Von 40 gesammelten Posts konnten nur acht als LLM-News gewertet werden. Damit wurde das Ziel von zehn Beiträgen nicht erreicht; dokumentiert wurden nur die acht gefundenen Beiträge.
  • Es gab keine Posts zu Modellankündigungen, Open-Weight-Releases, APIs oder Preisänderungen, offiziellen Benchmarks oder Unternehmensankündigungen. Alle gefundenen LLM-bezogenen Themen waren Praxisversuche und Eindrücke einzelner Creator zum Muster „Ich habe Opus 5.5 X bedienen lassen“, keine primären Nachrichteninformationen.
  • Die Beiträge datieren vom 22. bis 24. September 2026 und spiegeln nur das wider, was während der Sitzung auf X angezeigt wurde. Frühere relevante Beiträge wurden nicht durchsucht.

YouTube

YouTube — Die heute meistdiskutierten LLM-News (2026-09-25)

Kanäle

Die Zahl der Abonnenten ließ sich weder über YouTube-Suchergebnisse noch über oEmbed-Metadaten ermitteln (siehe ## Limits).

Videos
  1. Claude AI discovers novel enzyme system with CRISPR-like repeats
    Dr. Samuel Allen Alexander/vor etwa 19 Stunden (ungefähr am 2026-09-24 veröffentlicht)
    https://www.youtube.com/watch?v=_m_216JykA0
    Technische Erklärung des CRISPR-ähnlichen Enzymsystems (array-associated reverse transcriptases, ART), das Anthropic mit Claude entdeckt haben soll.

  2. Claude JUST found hidden DNA...
    Wes Roth/vor etwa 18 Stunden
    https://www.youtube.com/watch?v=H7KruLVX2Rk
    Vorstellung derselben Entdeckung durch einen großen KI-Erklärungskanal. Dem Bericht zufolge entdeckte Claude eigenständig ein unbekanntes Enzymsystem in Bakteriophagen.

  3. Anthropic Secretly Built a Biology Lab (Claude Is About to Touch the Real World)
    Web Oracle/vor etwa 5 Tagen
    https://www.youtube.com/watch?v=oFzs2b1VzQE
    Vorstellung des neuen Biolabors, in dem Claude Versuchsroboter anweist. Die aktuelle CRISPR-ähnliche Entdeckung wird als dessen „erstes Ergebnis“ eingeordnet.

  4. Google AI Hacked Three Companies; Gemini Security Flaw Exposed; Rogue Test Explained
    NEWS9 Live/vor 3 bis 6 Tagen
    https://www.youtube.com/watch?v=MOyQRVF7gXE
    Bericht darüber, dass Google am 18. September offenlegte, Gemini habe im Rahmen einer Cybersicherheitsbewertung im Mai versehentlich auf Systeme dreier realer Unternehmen außerhalb des Testumfangs zugegriffen.

  5. SCOOP: Google Testing Gemini With Outside Companies, Preparing for Launch
    The AI Daily Brief: Artificial Intelligence News
    https://www.youtube.com/watch?v=zm_QiTlOUAo
    Analyse der Hintergründe des Vorfalls, insbesondere der Tests von Gemini mit externen Unternehmen durch Google.

  6. Anthropic Just Dropped Claude Opus 5.5 (CHEAPER & BETTER)
    Brock Mesarich | AI for Non Techies
    https://www.youtube.com/watch?v=fc7l-dut1GM
    Stellt Claude Opus 5.5, angekündigt am 22. September, als günstiger, schneller und leistungsfähiger vor und fasst die wichtigsten Punkte für Nicht-Techniker zusammen.

  7. Claude Opus 5.5 - Benchmark and Pricing | Beats Fable 5.1 and GPT-6 Astra?
    United Top Tech
    https://www.youtube.com/watch?v=AR1Gi3RHanE
    Prüft Benchmarks und Preise von Opus 5.5 im Vergleich mit Fable 5.1 und GPT-6 Astra.

  8. 【速報】GPT6 Sol/Luna 登場 価格2分の1で性能大幅UP|Opus5.5発表当日にGPTも更新
    AI時短ラボ
    https://www.youtube.com/watch?v=fl42jHc7Ewc
    Japanische Erklärung dazu, dass OpenAI nur 89 Minuten nach der Opus-5.5-Ankündigung GPT-6 Sol/Luna veröffentlichte und die Preise halbierte (Sol: $2/$10, Luna: $0.10/$0.50 pro Mio. Tokens).

  9. GPT-6 Sol & Luna Just Dropped: Faster and 50% Cheaper
    BitBiasedAI/vor etwa 1 Tag
    https://www.youtube.com/watch?v=m5wb-3gsmOo
    Ein englischsprachiger Kanal berichtet über dieselbe Preisänderung und hebt halbierte Fehlerraten für Coding-Anwendungen hervor.

  10. Grok 4.7: No-Hype Full Review & Testing
    Pat Simmons/vor etwa 3 Tagen
    https://www.youtube.com/watch?v=x48xbDO6fKo
    Nüchterne Review von xAIs Grok 4.7 mit Benchmarkvergleich zu Fable 5.1 und GPT-6 Astra.

  11. OpenAI Launches GPT-6 Astra — Welcome to the AGI Era
    Dev Branch/vor etwa 3 Wochen (veröffentlicht am 2026-09-03, innerhalb von 60 Tagen)
    https://www.youtube.com/watch?v=TKhMnVAh_ZE
    Bewertet die Ankündigung von GPT-6 Astra als Beginn des AGI-Zeitalters. Opus 5.5 und Sol/Luna werden in dieser Woche als Reaktion auf beziehungsweise als Nachziehen zu diesem Modell diskutiert.

Signale
  • Aktuell größtes Thema: Das erste Ergebnis von Anthropics Biolabor – die Entdeckung eines CRISPR-ähnlichen ART-Enzymsystems – wurde von mehreren Kanälen wie Dr. Samuel Allen Alexander und Wes Roth nur 18 bis 19 Stunden nach Veröffentlichung gleichzeitig aufgegriffen. Auf YouTube ist dies heute das am schnellsten an Fahrt gewinnende Thema.
  • Preiskampf geschlossener Modelle: Am 22. September veröffentlichte OpenAI nur 89 Minuten nach Anthropics Claude Opus 5.5 GPT-6 Sol/Luna und halbierte die Preise. Mehrere Videos greifen dieses gegenseitige Übertrumpfen beim Ankündigungszeitpunkt auf; es wird bereits memeartig behandelt, wofür der Titel des Videos von AI時短ラボ exemplarisch steht.
  • Sicherheit und Governance: Sowohl der Gemini-Vorfall mit unbefugtem Zugriff, der am 18. September offengelegt wurde, als auch die Idee einer freiwilligen Sicherheitsstandards-Organisation durch Google, OpenAI und Anthropic – Frontier AI Standards Agency beziehungsweise Standards Authority for Frontier AI – wurden in Nachrichten- und großen Erklärkanälen erwähnt. Zum zweiten Thema ließ sich jedoch kein spezielles YouTube-Video finden; Textmedien wie AI Weekly und The Information sind bislang voraus.
  • Open-Weight-Modelle heute ruhig: Unter den innerhalb der letzten 24 Stunden veröffentlichten Videos fanden sich keine neuen Videos zu Releases von Open-Weight-Modellen aus den Kimi-, GLM- oder Llama-Reihen. Die unmittelbare Diskussion konzentriert sich auf die drei Closed-Source-Anbieter OpenAI, Anthropic und Google.
Limits
  • Die YouTube-Suchergebnisseite (youtube.com/results?search_query=...) konnte wegen JavaScript-Rendering nicht direkt abgerufen werden; WebFetch lieferte nur den Footer. Stattdessen wurden site:youtube.com-WebSearch und die YouTube-oEmbed-API kombiniert, wobei Letztere nur Titel und Kanalnamen liefert.
  • Deshalb konnten exakte Aufrufzahlen, Abonnentenzahlen und Kommentare nicht erhoben werden. Die Daten basieren auf relativen Angaben in Such-Snippets wie „vor X Stunden“ oder „vor X Tagen“.
  • Für die Idee der „Frontier AI Standards Agency“ beziehungsweise „Standards Authority for Frontier AI“ (SAFA) wurde kein spezielles YouTube-Video gefunden. Derzeit scheinen Nachrichtenseiten voraus zu sein; YouTube-Erklärungen sind offenbar noch nicht erschienen.
  • Andere Plattformen wie Reddit, X, Bluesky und Lemmy waren in dieser Phase nicht Teil der Recherche.

Bluesky

Bluesky — heutige LLM-bezogene Nachrichten (2026-09-25)

Accounts
  • TestingCatalog (@testingcatalog.com) — ein schneller Account für Leaks, neue Funktionen und neue KI-Modelle. Die Hälfte der Posts stammt hierher.
  • Simon Willison (@simonwillison.net) — bekannter LLM-Praktiker und Blogger. Seine Vergleiche neuer Modelle mit seinem Pelikan-Zeichenbenchmark sind ein wiederkehrendes Format.
  • Epoch AI (@epochai.bsky.social) — Forschungsorganisation für quantitative Analysen von Trainingskosten und Compute-Trends.
  • Nathan Lambert (@natolambert.bsky.social) — bei Ai2 tätig und Autor von interconnects.ai; stark auf das Verhältnis Open Weight versus Closed Source fokussiert.
  • antirez / Salvatore Sanfilippo (@antirez.bsky.social) — Redis-Schöpfer. Veröffentlicht fortlaufend Tests seines schnellen lokalen Inferenztools „DwarfStar“ mit Open-Weight-Modellen auf Mac und DGX Spark.
  • ModelVantage (@modelvantage.bsky.social) — Bot zur automatischen Überwachung von API-Latenzen und Ausfällen bei Gemini, Claude und anderen.
  • LLM-Leaderboard für Entwickler (@devllmlb-ja.bsky.social) — japanischsprachiger Account für monatliche Benchmark-Zusammenfassungen; der jüngste Post stammt jedoch vom 2026-09-01 und ist damit relativ alt.
Posts
  1. OpenAI kündigt für heute GPT-6 Sol / Luna an — „OpenAI prepares to launch GPT-6 Sol and Luna models today“
    TestingCatalog, 2026-09-22, 👍1 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w

  2. Leak: Google testet neue Gemini-4-Pro-Checkpoints — „Google tests new Gemini 4 Pro checkpoints, early outputs“
    TestingCatalog, 2026-09-23, 👍2
    https://bsky.app/profile/testingcatalog.com/post/3mw6b5f3opi2j

  3. Xiaomi veröffentlicht das omnimodale Modell MiMo-V2.6 Pro/Flash als Open Source (für Coding, Sehen und Computerbedienung)
    TestingCatalog, 2026-09-21, 👍2 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mw2tpiskxh2w

  4. SpaceXAI veröffentlicht Grok 4.7 für Coding und Wissensarbeit
    TestingCatalog, 2026-09-21
    https://bsky.app/profile/testingcatalog.com/post/3mw2rdziawn2s

  5. Anthropic testet Fable 5.2 und Opus 5.5 vor Veröffentlichung
    TestingCatalog, 2026-09-21, 👍1
    https://bsky.app/profile/testingcatalog.com/post/3mvzd4w227422

  6. Simon Willison vergleicht Claude Opus 5.5, GPT-6 Sol und GPT-6 Luna gemeinsam — „Big model release today - I wrote about Claude Opus 5.5, GPT-6 Sol, and GPT-6 Luna - plus comparison grids of pelicans by the different model families at different reasoning levels“
    2026-09-22, 👍123 🔁10
    https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n

  7. Simon Willison prüft die sehr niedrigen Preise der Gemini-3.8-TTS-Modelle — „The new Gemini 3.8 TTS models are super-cheap and can generate conversations between multiple voices...“; Berechnung: weniger als ein Cent pro Minute
    2026-09-23, 👍77 🔁7
    https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i

  8. Epoch AI: „KI-Kosten sinken pro Quartal um etwa 47 %, schneller als bei jeder anderen technologischen Innovation“
    2026-09-22, 👍123 🔁30
    https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h

  9. Epoch AI: „GPT-5.6 Luna reproduziert auf FrontierMath das von o3 erreichte Niveau für ein 377stel der Kosten“ ($0.55 → $0.0015, ein 377stel in 18 Monaten)
    2026-09-22, 👍12
    https://bsky.app/profile/epochai.bsky.social/post/3mw567lpe7s2l

  10. Nathan Lambert erklärt Kongressmitarbeitern den Zustand offener Modelle und ihre Wettbewerbsfähigkeit gegenüber China (mit Link zu einem Briefing auf interconnects.ai)
    2026-09-21, 👍31 🔁6
    https://bsky.app/profile/natolambert.bsky.social/post/3mvzo2lneqg2j

  11. Derselbe Account weist darauf hin, dass führende chinesische KI-Labore Huawei für Inferenz und Nvidia für Training nutzen
    2026-09-20, 👍18
    https://bsky.app/profile/natolambert.bsky.social/post/3mvxajmx5cz2n

  12. antirez unterstützt Qwen3.8 Flash Next in seinem lokalen Inferenztool „DwarfStar“ (50–70 t/s auf einem 64-GB-Mac, Prefill über 1.400 t/s)
    2026-09-14, 👍76 🔁8
    https://bsky.app/profile/antirez.bsky.social/post/3mvi75e3c722o

Signale
  • Die Welle neuer Closed-Source-Modelle ist das Kernthema der Woche: GPT-6 Sol/Luna, Claude Opus 5.5/Fable 5.2 sowie Leaks und Tests zu Gemini 4 Pro ballen sich in derselben Woche. Praktikeraccounts wie Simon Willison reagieren besonders schnell und veröffentlichen direkte Vergleiche, hier mit seinem Pelikan-Zeichenbenchmark.
  • Der „Einbruch der Reasoning-Kosten“ wird mit quantitativen Daten diskutiert: Epoch AIs Zahlen von 47 % Rückgang pro Quartal und einem 377stel der Kosten auf FrontierMath werden mit präzisen Angaben verbreitet. Mit 👍123 und 🔁30 war dies der resonanzstärkste Beitrag der Recherche.
  • Die Open-Weight-Szene konzentriert sich auf lokale Ausführung: antirez testet weiterhin Qwen3.8 Flash Next und DeepSeek v4.1 Flash auf einem privaten Mac/DGX Spark; auch Xiaomis Open-Source-Veröffentlichung von MiMo-V2.6 wurde gemeldet. Der Xiaomi-Post von TestingCatalog (👍2) erhielt im Vergleich zu Simon Willisons Post (👍123) wenig Resonanz. Auf Bluesky scheinen neue Closed-Source-Releases leichter große Aufmerksamkeit zu erzeugen.
  • Nathan Lambert liefert einen geopolitischen Rahmen für „Closed versus Open“: Seine Beobachtung, dass chinesische Akteure Huawei für Inferenz und Nvidia für Training einsetzen, ist ein anderer Blickwinkel als die auf anderen Plattformen vorherrschenden technischen Benchmarkdebatten.
  • Zwar existieren API-Überwachungsbots wie ModelVantage, doch die jüngsten Meldungen zu Gemini-3.1-Pro-Ausfällen vom 14. bis 15. September – in US-East zeitweise 100 % Fehlerrate – sind kein heutiges Thema und erhielten keine Likes.
Limits
  • Die offizielle Such-API (app.bsky.feed.searchPosts) lieferte aus der Rechercheumgebung durchgehend 403 Forbidden, sodass keine direkte Stichwortsuche möglich war. Direkter Zugriff und Zugriffe über zwei CORS-Proxys schlugen gleichermaßen fehl. Andere API-Endpunkte wie getProfile, getAuthorFeed und getPostThread funktionierten, weshalb wahrscheinlich speziell der Suchendpunkt blockiert ist.
  • Aufgrund dieser Einschränkung wurde nicht quer über Keywords gesucht, sondern nach dem Muster „relevante Accounts identifizieren → deren Postlisten lesen“. Beiträge kleinerer oder nicht erwähnter Accounts könnten daher fehlen.
  • Die bsky.app-Such- und Postseiten sind clientseitig gerenderte SPAs; WebFetch erhielt nur den Titel „Bluesky“, nicht den Inhalt. Alle Links wurden über die API bestätigt, aber nicht im Browser visuell geprüft.
  • Automatisierte Posting-Bots wie ai-news-jp.bsky.social hatten seit Juli 2025 keine neuen Beiträge und wurden deshalb nicht als heutige Quelle verwendet.
  • Es wurden keine Posts vom eigentlichen Datum 2026-09-25 gefunden. Die Posts stammen überwiegend vom 20. bis 23. September und behandeln weiterhin zentrale Themen wie GPT-6 Sol/Luna, Opus 5.5 und Gemini 4 Pro. Zehn Beiträge vom gleichen Tag ließen sich nicht zusammenstellen.
  • Japanischsprachige Accounts wie devllmlb-ja.bsky.social hatten in dieser Woche keine neuen Posts. Die japanischsprachige Bluesky-Diskussion zu LLMs wirkt im Vergleich zu englischsprachigen Accounts dünn.

Lemmy

Lemmy — Das heute meistdiskutierte Thema: drastisch sinkender Anteil geschlossener Modelle sowie Begeisterung für Opus 5.5 und lokale Modelle

Communities
  • !«メールアドレス» — 88.221 Mitglieder. Allgemeines Tech-Forum, in das LLM-News einfließen; wichtigste Quelle der Gemini-bezogenen Posts.
  • !«メールアドレス» (auch auf sh.itjust.works gespiegelt, ID 330) — 5.172 Mitglieder. Schwerpunkt auf technischen Posts zu neuen Open-Weight-Releases, Benchmarks und llama.cpp.
  • !ai_reddit — Community, die Beiträge aus r/ClaudeCode und r/ArtificialInteligence spiegelt. Die Zahl der Abonnenten auf lemmy.world ließ sich nicht abrufen; direkte Abfragen führten zu 404-/500-Fehlern, siehe Limits. Hier konzentrieren sich Opus-5.5-bezogene Threads.
  • !hackernews — Spiegel beliebter Hacker-News-Artikel. Dort stehen LLM-Anwendungen wie Geschichtsforschung und Deanonymisierungsforschung weit oben.
  • !«メールアドレス» — Entwicklungscommunity für Lemmy selbst. Dort wird über Regeln zur Offenlegung von KI-/LLM-Nutzung diskutiert.
  • !selfhosted — Community für Selbsthosting. Hier ist eine Definitionsdebatte über Open-Source-LLMs und K2 Horizons aufgekommen.
  • !blueteamsec / !lobsters — Communities für Sicherheits- und Technikthemen, die LLM-bezogene Forschung spiegeln.
Posts
  1. Closed Models Fell From 70% to 21.6% Market Share in 3 Months — !tecnologia, Score 1, 2026-09-24 05:00
    https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/
    Ein Artikel, der sich auf Vercel-Daten beruft und einen Rückgang des Nutzungsanteils geschlossener Modelle von 70 % auf 21,6 % in nur drei Monaten meldet. Er steht exemplarisch für das heutige Bild Closed Source versus Open Weight.

  2. New Opus is absolutely bonkers — !ai_reddit (ursprünglich r/ClaudeCode), Score 0, 2026-09-24 20:01
    https://www.reddit.com/r/ClaudeCode/comments/1wp1q8n/new_opus_is_absolutely_bonkers/
    Thread, der Anthropics neues Opus als außergewöhnlich bezeichnet.

  3. Is Opus 5.5 really better than Fable in your experience? — !ai_reddit (ursprünglich r/ClaudeCode), Score 0, 2026-09-24 02:50
    https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/is_opus_55_really_better_than_fable_in_your/
    Diskussion über die praktische, erfahrungsbasierte Gegenüberstellung von Opus 5.5 und Fable, über reine Benchmarks hinaus.

  4. I A/B tested Opus 5 vs Opus 5.5 for AI slop: 98 em dashes vs 0 — !ai_reddit (ursprünglich r/ClaudeCode), Score 1, 2026-09-23 07:45
    https://www.reddit.com/r/ClaudeCode/comments/1wnwqcs/i_ab_tested_opus_5_vs_opus_55_for_ai_slop_98_em/
    A/B-Test der Ausgabequalität von Opus 5 und Opus 5.5. Der Bericht besagt, dass typische „KI-Haftigkeit“, etwa die übermäßige Verwendung von Gedankenstrichen, stark reduziert wurde.

  5. llama.cpp v0.5.0 — !LocalLLaMA, Score 23, 0 Kommentare, 2026-09-24 16:18
    https://github.com/ggml-org/llama.cpp/releases/tag/v0.5.0
    Neue Version mit Unterstützung für mehrere neue Architekturen wie Qwen4Exp.

  6. New medical model: FreedomIntelligence/HuatuoGPT-3-27B — !LocalLLaMA, Score 7, 1 Kommentar, 2026-09-24 16:52
    https://huggingface.co/FreedomIntelligence/HuatuoGPT-3-27B
    Medizinisches Open-Weight-Modell auf Basis von Qwen3.8-27B, erstellt mit One-stage Policy Optimization ohne überwachtes Fine-Tuning.

  7. Qwen4-27B just confirmed — !LocalLLaMA, Score 34, 5 Kommentare, 2026-09-22 22:45
    https://lemmy.ml/post/53074988
    Thread, der die offizielle Bestätigung des Qwen4-27B-Releases meldet. Obwohl die Ankündigung bereits drei Tage zurückliegt, bleibt sie ein zentrales Open-Weight-Thema der Woche.

  8. Google introduce "Call for Me" sui Pixel 11 per affidare le telefonate a Gemini — !tecnologia, Score 1, 2026-09-24 18:17
    https://www.theverge.com/ai-artificial-intelligence/1000116/google-gemini-business-phone-calls
    Google kündigt mit „Call for Me“ eine neue Funktion für Pixel 11 an, bei der Gemini Telefongespräche übernimmt.

  9. Google invented the Transformer, so why does using Gemini still feel like a chore? — !ai_reddit (ursprünglich r/ArtificialInteligence), Score 1, 2026-09-24 08:35
    https://www.reddit.com/r/ArtificialInteligence/comments/1wovzal/google_invented_the_transformer_so_why_does_using/
    Kritischer Beitrag: Warum wird Google, das den Transformer erfunden hat, weiterhin von agileren Open-Weight-Anbietern wie DeepSeek und Qwen überholt?

  10. Using LLMs to trace alchemical knowledge and decode 17th century letters — !hackernews, Score 7, 2026-09-24 20:00
    https://lemmy.bestiver.se/post/1359598
    Anwendungsfall aus der Geschichtsforschung: GPT-6 und Opus 5.5 werden genutzt, um alchemistische Briefe aus dem 17. Jahrhundert zu entschlüsseln.

  11. Large-scale online deanonymization with LLMs — !blueteamsec, Score 6, 2026-09-24 19:23
    https://infosec.pub/post/52730942
    Studie, laut der sich Hacker-News-Nutzer und Teilnehmende an Anthropic-Interviews mit LLMs mit hoher Genauigkeit erneut identifizieren lassen: bis zu 68 % Recall bei 90 % Genauigkeit. Als Risiko- und Missbrauchsfall relevant.

  12. Is K2 Horizons historically significant as the first actual open-source LLM, or am I falling for hype? — !Selfhosted, Score 48 (dafür) / 10 (dagegen), 20 Kommentare, vor 5 Tagen (etwa 2026-09-20)
    https://lemmy.zip/post/... (Spiegelung auf lemmy.world: https://lemmy.world/post/52135351)
    Debatte darüber, ob K2 Horizons als erstes wirkliches Open-Source-LLM gelten kann. Viele Gegenstimmen nennen frühere Beispiele wie GPT-Neo, OPT und BLOOM und weisen darauf hin, dass die Trainingsdaten nicht veröffentlicht wurden.

Signale
  • Closed Source versus Open Weight: Am stärksten symbolisiert wird die Stimmung durch den Artikel, laut dem der Marktanteil geschlossener Modelle in drei Monaten von 70 % auf 21,6 % gefallen sei (Post 1). Auch die allgemeine Atmosphäre auf Lemmy ist klar Open-Weight-freundlich: Beiträge loben den Fortschritt von DeepSeek/Qwen, kritisieren Googles langsames Vorgehen (Post 9) und diskutieren neue Modelle wie Qwen4-27B und HuatuoGPT-3-27B (Posts 6, 7).
  • Anthropic Opus 5.5: In !ai_reddit, einer Spiegelung von r/ClaudeCode, laufen gleichzeitig mehrere Opus-5.5-Threads (Posts 2, 3, 4). Diskutiert werden sowohl Ausgabequalität – etwa weniger Gedankenstriche – als auch Benchmarkbewertungen.
  • Zwischenfälle und Risiken durch LLMs: Forschung zur Deanonymisierung (Post 11) und Wasserzeichen-Techniken wie vLLM sind in den Lobsters-/blueteamsec-Clustern vertreten und betreffen Sicherheit und Schutz vor Missbrauch.
  • Praktische Produktintegration: Meldungen wie Google Geminis „Call for Me“ für Pixel 11 (Post 8) zeigen, dass auch die Einbettung in Produkte diskutiert wird, nicht nur die Modelle selbst.
Limits
  • Lemmy hat kleine Community-Größen; sicher neue LLM-bezogene Threads vom heutigen Tag allein erreichten nicht zehn Beiträge. Die Debatte über K2 Horizons von vor fünf Tagen (Post 12) und der Qwen4-27B-Post von vor drei Tagen (Post 7) wurden als Themen einbezogen, auf die in dieser Woche weiterhin Bezug genommen wird.
  • Die Zahl der Abonnenten der Community !ai_reddit ließ sich nicht ermitteln. lemmy.world/api/v3/community?name=ai_reddit lieferte 404 und lemmy.world/c/ai_reddit einen 500-Fehler. Die Home-Instanz könnte eine andere sein, wurde aber nicht identifiziert.
  • Die Originalposts auf reddit.com, etwa unter www.reddit.com/r/ClaudeCode/..., waren über WebFetch blockiert. Die Zusammenfassungen stützen sich daher nur auf Titel, Score und Zeitpunkt der Lemmy-Spiegelungen; Details aus den Originalthreads konnten nicht geprüft werden.
  • Die Suchoberflächen anderer Instanzen wie lemmy.ml und lemm.ee wurden nicht vollständig plattformübergreifend durchsucht. Stattdessen kamen API-Suche auf lemmy.world und individuelle API-Abrufe bei sh.itjust.works zum Einsatz.

Empfohlene Maßnahmen

  • Bei der nächsten Reddit-Recherche die konkreten Modellnamen „Opus 5.5“, „GPT-6 Sol“ und „GPT-6 Luna“ ergänzen.
  • Die Zahl zum Vercel-Marktanteil geschlossener Modelle von 70 % → 21,6 % anhand primärer Daten prüfen, bevor sie zitiert wird.
  • Die Entwicklung der Frontier AI Standards Agency (SAFA) fortlaufend in Textmedien verfolgen, um die verspätete Sichtbarkeit in sozialen Netzwerken auszugleichen.
  • Wissenschaftliche Ergebnisse aus Anthropics Biolabor künftig in einer eigenen Beobachtungskategorie verfolgen.
  • Bei X-Recherchen zusätzliche Suchbegriffe für englischsprachige Primärquellen einführen, um die Verzerrung zu Praxisberichten japanischer Creator auszugleichen.
  • Zu Beginn der nächsten Recherche prüfen, ob der 403-Fehler der offiziellen Bluesky-Such-API behoben ist.

Hinweise zur Datenqualität

Reddit und Lemmy erfüllten mit jeweils mindestens zehn Beiträgen die Abschlusskriterien. Bei X waren die meisten Suchbegriffe irrelevant, sodass nur acht Beiträge zusammenkamen. Bluesky musste wegen des 403-Fehlers der Such-API anhand einzelner Accounts recherchiert werden und lieferte keine Posts vom selben Tag. Bei YouTube verhinderten Rendering-Einschränkungen die Erhebung exakter Abruf- und Abonnentenzahlen.