KI-News zur Bild- und Videogenerierung — 2026-09-12
Open-Source-Modelle, insbesondere die chinesischen Z-Image, Qwen-Image und MiniMax-H3, rücken in Blindtests dicht an Closed-Source-Angebote heran. Während Google mit Nano Banana, Veo und Gemini Omni umfassend angreift, zeigt OpenAIs Sora durch die Entfernung von Modellen von der Preisseite und den Abgang der verantwortlichen Leitung Anzeichen einer Abschwächung.
KI-News zur Bild- und Videogenerierung — 2026-09-12
Hallo! Dieses Mal habe ich die Welt der KI-Bild- und Videogenerierung auf sechs Plattformen gründlich untersucht: Reddit, X, YouTube, Bluesky, Lemmy und Pinterest 🔥 Kurz gesagt: Auf der Closed-Source-Seite greift Google bei Bildern und Videos mit voller Kraft an, während OpenAIs Sora etwas an Schwung zu verlieren scheint 😳. Im Open-Source-Bereich kommen chinesische Anbieter (Qwen, Z-Image, MiniMax, Wan) in Blindbewertungen erstaunlich nah heran – eine extrem spannende Entwicklung 🔥🔥 Die Untersuchung auf X war allerdings ein vollständiger Fehlschlag: Es wurde kein einziger Beitrag zur KI-Bild- oder Videogenerierung gefunden. Das halte ich offen als echte Lücke fest 💦 Plattformübergreifend war zudem die Frage „Ist das KI?“ beziehungsweise die Sorge um Echtheit und Vertrauenswürdigkeit enorm präsent – überraschenderweise mit mehr Reichweite als Meldungen zur Modellleistung 👀
Plattformübergreifend
- Die chinesischen Anbieter dominieren Open Source vollständig 🇨🇳: Unabhängig voneinander werden auf YouTube, Bluesky und Lemmy Qwen-Image, Z-Image (Turbo), MiniMax (H3/Hailuo 3.0) und Alibaba Wan als „neue Champions“ gefeiert. Laut einem Blindtest-Ranking auf Bluesky liegt Qwen-Image-3.0-Pro nur 92 Elo-Punkte hinter GPT Image 2 (high) – das ist wirklich bemerkenswert (https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t).
- Google greift bei Bildern und Videos gleichzeitig an: Mit einem YouTube-Review zu Veo 3.1 (https://www.youtube.com/watch?v=sTOFXi2eY_k), Teacher's Techs Vorstellung von Nano Banana 2 (https://www.youtube.com/watch?v=nikIxHM_AQY) und Berichten auf Bluesky über eine Windows-Desktop-App mit „Gemini Omni“ (https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n) wirkt Googles Angriff auf allen Fronten äußerst stark 💪
- Inhalte zum Erkennen von KI sind wirklich beliebt: Bewertungs-Threads auf Reddit (r/isthisAI, https://www.reddit.com/r/isthisAI/comments/1wbspxo/) und Pinterest-Infografiken zur Erkennung von Deepfakes beziehungsweise KI-Stimmen sind unabhängig voneinander erfolgreich. Die Unsicherheit über Echtheit ist zu einem plattformübergreifenden Thema geworden – und verbreitet sich auffällig stärker als Nachrichten über Modellleistung.
- Werbeaussagen wie „unbegrenzt“ und Affiliate-Angebote werden überall skeptisch gesehen: Ein Reddit-Kommentar bezeichnet Seiten mit „unlimited“-Versprechen überwiegend als betrugsähnlich (#4, r/generativeAI), während circuitai.bsky.social auf Bluesky denselben Affiliate-Text zu WAN 3.0 mehr als 15-mal täglich postet. Nutzer bleiben bei solchen Versprechen zu Recht skeptisch 😤
- Normale Nutzer unterscheiden kaum zwischen Open und Closed Source: In Reddit-Threads zur Tool-Suche werden Qwen, Flux, Seedream, Veo und GPT Image schlicht gemeinsam als verfügbare Modelle genannt. Kommentare, die bewusst zwischen offenen und geschlossenen Modellen unterscheiden, sind kaum zu sehen. Zwischen der vom Briefing verlangten Zweiteilung und der tatsächlichen Nutzerwahrnehmung besteht eine deutliche Lücke.
Nach Plattform
Reddit — 12 Threads gesammelt (das Ziel von etwa 20 wurde nicht erreicht). Der erfolgreichste Beitrag handelte nicht von einem neuen Modell, sondern von GPT-6 mit Maussteuerung, das gefälschte handgezeichnete Zeitraffer erstellt (r/antiai, 7.146 Punkte, https://www.reddit.com/r/antiai/comments/1w81kdd/) – ein wütender Beitrag über KI-„Täuschung“. Mehrere Threads erwähnten außerdem unabhängig voneinander integrierte, unzensierte beziehungsweise NSFW-fähige Plattformen wie WildOwl.ai, cyberbara und Tensor.art, was auf Nachfrage hindeutet.
X — Ein kompletter Fehlschlag 😭 Die 40 gesammelten Beiträge drehten sich um die Lage im Jemen, die Meme-Coin $SONG oder Chelsea FC; Beiträge zur KI-Bild- und Videogenerierung gab es keine. Die verwendeten Suchbegriffe, nämlich Trendthemen, passten schlicht nicht zum Thema. Beim nächsten Mal sollte gezielt nach Eigennamen wie Midjourney, Sora und Runway gesucht werden.
YouTube — Hier gab es diesmal die größte Informationsdichte ✨ Auf der Closed-Source-Seite lagen GPT Image 2/2.5 laut Artificial Analysis Image Arena vorn (Elo-Wert 1.339, der größte Abstand zwischen Platz eins und zwei in der Geschichte, https://www.youtube.com/watch?v=DY6TkI8XtkQ); hinzu kamen verbesserte Lippen-Synchronität bei Veo 3.1 sowie ByteDances Seedream 5.0 Pro, das bestehende Modelle klar übertreffen soll (https://www.youtube.com/watch?v=WpcxwSNT3X4). Bei Open Source wurde Black Forest Labs FLUX.2 als möglicher neuer Champion diskutiert (https://www.youtube.com/watch?v=YQuTkPVkCS8), Alibaba Z-Image Turbo zum KING der lokalen Modelle erklärt (https://www.youtube.com/watch?v=K0FgDU-9uik) und Lightricks LTX-2 sogar als „heiliger Gral für Open-Source-Video“ bezeichnet.
Bluesky — Sora scheint möglicherweise deutlich an Fahrt zu verlieren 👀 Neben einem Beitrag, der die stille Entfernung von sora-2 und sora-2-pro von der Preisseite feststellte (https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23), gab es einen Scoop: Der frühere Sora-Verantwortliche Bill Peebles gründet mit Hollywood-Größen ein unabhängiges Startup (https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n). Auf der Open-Source-Seite dominieren Qwen, Z-Image, MiniMax, WAN 3.0 und SenseNova-U1.5 die Diskussion.
Lemmy — Kleinere Plattform, praktisch abhängig von der Kuratierung einer einzelnen Person, Even_Adder 😅 Die größte Closed-Source-Nachricht ist dennoch bemerkenswert: Midjourney soll sich von der Bildgenerierung in Richtung eines medizinischen Spa-Geschäfts mit Ultraschall-CT-Scans verlagert haben (https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429). Das wird ironisch als „Theranos 2.0“ bezeichnet. Im Open-Source-Bereich explodiert rund um MiniMax-H3 das Ökosystem: In einer Woche erschienen mehr als sieben ComfyUI- und Quantisierungswerkzeuge.
Pinterest — Alle 50 Pins wurden visuell geprüft 👀 Kommerzielle Closed-Source-Tools wie Runway, Pika, Kling AI, Luma, Canva, Hailuo und Synthesia erscheinen fast in jeder Ranking-Infografik, während Open-Source-Pins kaum auffindbar waren. Neben offiziellen Werbematerialien zu Google Veo 2/3 und Nachrichten über eine Urheberrechtsvereinbarung zwischen ByteDance und Hollywood (MPA) (#31) besteht der Großteil aus SEO- und Affiliate-Thumbnails. Ein Pin behauptet zudem konkret, dass mehr als 20 % von YouTube KI-generiert seien (#44).
Beobachten
- Ob Soras Abschwächung real ist — Bluesky, Erkennung der Modell-Entfernung von der Preisseite (https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23)
- Wie weit Qwen-Image-3.0-Pro den Abstand zu GPT Image 2 verringern kann — Bluesky, Blindtest-Rangliste (https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t)
- Das Wachstumstempo des MiniMax-H3-Ökosystems — Lemmy, ComfyUI-nahe Werkzeuge (https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA)
- Weitere Entwicklungen beim medizinischen Spa-Geschäft von Midjourney — Lemmy, TheRegister-Artikel (https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429)
- Die Entscheidung im Kampf um die „lokale Krone“ zwischen FLUX.2 und Z-Image Turbo — YouTube(https://www.youtube.com/watch?v=YQuTkPVkCS8, https://www.youtube.com/watch?v=K0FgDU-9uik)
- Die Auslese bei integrierten unzensierten/NSFW-Plattformen wie WildOwl.ai — Reddit(https://www.reddit.com/r/AItips101/comments/1w9yftp/)
Empfehlungen
- Die X-Recherche sollte beim nächsten Mal nicht Trendbegriffe nutzen, sondern nach Eigennamen wie Midjourney, Sora, Runway, Kling, Flux und ComfyUI suchen.
- Soras Entwicklung sollte durch fortlaufende Beobachtung von Bluesky-Accounts zur Preisseitenüberwachung verifiziert werden.
- Der Verlauf der Elo-Differenz zwischen Qwen-Image-3.0Pro und GPT Image 2 ist der verständlichste Indikator, um die Leistungsdifferenz zwischen offenen und geschlossenen Modellen zu verfolgen.
- Midjourneys Wechsel in das Gesundheitsgeschäft sollte weniger als Techniknachricht, sondern als Unternehmensstrategie verfolgt werden.
- Bei Reddit sollten beim nächsten Mal mehr Suchbegriffe verwendet werden, damit statt 12 etwa 20 Beiträge erreicht werden.
- Pinterest-Ranking-Infografiken und wiederholte Affiliate-Posts auf Bluesky sollten nicht einzeln als verlässlich gelten, sondern nur bei Bestätigung durch andere Plattformen berücksichtigt werden.
Datenqualität
Für X gibt es aufgrund einer Fehlwahl der Suchbegriffe keine Beiträge zur KI-Bild- und Videogenerierung und damit praktisch keine Daten zum Thema. Reddit blieb mit 12 Threads hinter dem Ziel von etwa 20 zurück; die Inhalte waren zudem eher Tool-Empfehlungen als Nachrichten. Pinterest hatte in den Rohdaten keine Einteilung nach Open/Closed Source und erforderte eine manuelle Neuzuordnung. Lemmy ist eine kleine Plattform, deren Kuratierung praktisch von einem Account (Even_Adder) abhängt. Da YouTube-Seiten per JavaScript gerendert werden, konnte WebFetch keine Videoinhalte abrufen; Aufrufe und Abonnentenzahlen waren auch über oEmbed nicht verfügbar. Bei Bluesky führten einige Keywords wie Runway, Kling und Black Forest Labs wiederholt zu 403-Fehlern; die Sammlung wurde dort abgebrochen. WAN-3.0-Inhalte waren außerdem von Spam-Posts überlagert.
Zusammenfassung nach Plattform
Reddit — KI-News zur Bild- und Videogenerierung
Wo
Die 12 gesammelten Threads verteilen sich auf die folgenden neun Subreddits.
| Subreddit | Mitglieder | Gesammelte Threads |
|---|---|---|
| r/isthisAI | 408.823 | 1 |
| r/antiai | 322.973 | 1 |
| r/GetNoted | 298.488 | 1 |
| r/generativeAI | 152.415 | 3 |
| r/aiwars | 167.809 | 1 |
| r/hatethissmug | 134.660 | 1 |
| r/aivideomaking | 6.823 | 2 |
| r/GoogleFlow | 1.884 | 1 |
| r/AItips101 | 1.299 | 1 |
Während große Subreddits, die über die grundsätzliche Bewertung generativer KI diskutieren (r/antiai, r/aiwars, r/isthisAI, r/GetNoted), auffällig beteiligt sind, vermitteln mittelgroße Tool- und Empfehlungs-Subreddits (r/generativeAI, r/aivideomaking) die tatsächlichen Tool-Trends.
Was Menschen sagen
- 【#6, r/antiai, 7.146 Punkte / 1.025 Kommentare, 2026-09-05】Ein Beitrag berichtet, dass einem LLM (als GPT-6 bezeichnet) Maus- und Tastatursteuerung gegeben wurde, damit es auf einer digitalen Zeichenfläche „von Hand“ zeichnet und sogar Zeitraffer fälscht. Der Top-Kommentar (2.511 Punkte, u/Nayutantantan) schreibt verärgert, man habe nicht einmal mehr Lust, Zeitraffer der eigenen Werke aufzunehmen, weil gefälschte Zeitraffer inzwischen alltäglich seien. Dieser einzelne Thread hatte mit Abstand die stärkste Reaktion aller gesammelten Beiträge. https://www.reddit.com/r/antiai/comments/1w81kdd/
- 【#11, r/GetNoted, 4.470 Punkte / 325 Kommentare, 2026-09-10】Ein X-Post mit einem KI-generierten Bild – einer Zeitplantafel mit fehlerhaftem Text wie „Handloags“ – wurde zum Gegenstand eines Shitstorms. Die Top-Kommentare machen sich über die mangelhafte KI-Generierung selbst lustig. https://www.reddit.com/r/GetNoted/comments/1wcw3n9/
- 【#1, r/AItips101, 145 Punkte / 83 Kommentare, 2026-09-07】„Ranking unzensierter KI-Bildgeneratoren 2026“. Auf Platz eins steht WildOwl.ai; vorgestellt wird der Dienst mit nutzungsabhängigem Zugriff auf mehr als 35 Modelle wie Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo und GPT Image – ohne Monatsgebühr und ohne Ablaufdatum für Credits. Ein Kommentar (u/reliablemicrophone84, 4 Punkte) stimmt zu, weil Filter auf anderen Plattformen Credits verschwendet hätten. u/Pretend_Program_3696 (3 Punkte) empfiehlt dagegen Perchance/Uncensored.ai; die Meinungen gehen auseinander. https://www.reddit.com/r/AItips101/comments/1w9yftp/
- 【#8, r/aivideomaking, 4 Punkte / 21 Kommentare, 2026-09-09】Auf die Frage nach kostenlosen beziehungsweise kreditbasierten fotorealistischen Bild- und Videogeneratoren werden OpenartAI, fal, dzine, pixverse, Higgsfield und RunningHub genannt; über ComfyUI können dort sowohl OSS- als auch Closed-Source-Modelle verwendet werden. u/zeroludesigner kommentiert, cyberbaras Seedance 2.5 sei unzensiert und unterstütze echte Gesichter. https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/
- 【#3, r/generativeAI, 0 Punkte / 7 Kommentare, 2026-09-11】Ein Thread sucht browserbasierte NSFW-fähige Bild- und Videogeneratoren. u/MisterZan25 stellt RunDiffusion/Tensor.art für Bilder und Charakterkonsistenz, PornGen/PornJourney sowie Pika-Labs-Mirror-Angebote für Videos vor. u/frighten (1 Punkt) empfiehlt die iPhone-exklusive App „PixelForge“ als On-Device- und unzensierte Lösung. https://www.reddit.com/r/generativeAI/comments/1wdkbxv/
- 【#4, r/generativeAI, 1 Punkt / 11 Kommentare, 2026-09-07】Auf die Frage nach dem günstigsten unbegrenzten 1080p-Bild-zu-Video-Dienst wird Artlist.io (€550/Jahr) genannt. Mehrere Kommentare kritisieren jedoch die Bezeichnung „unbegrenzt“: u/ai_art_is_art (3 Punkte) sagt, Seiten mit diesem Versprechen seien meist betrugsähnlich; nach $550 erhalte man nur Leistungen im Wert von $200 und müsse 24 Stunden warten. https://www.reddit.com/r/generativeAI/comments/1wa4k88/
- 【#5, r/aivideomaking, 16 Punkte / 38 Kommentare, 2026-09-07】Die Frage „Ich möchte kostenlos nur mit Smartphone/iPad ein 45-Sekunden-Video erstellen“ wird von u/NewLifeWares (2 Punkte) nüchtern verneint: 45 Sekunden seien faktisch eine Rechenzentrums-Anforderung. Kostenlos gebe es höchstens ein- oder zweimal fünf Sekunden mit Wasserzeichen, die man zusammensetzen müsse. u/GuessingEngineer (2 Punkte) ergänzt ironisch, wer das auf einmal könne, würde die Welt beherrschen. Sichtbar wird die Nachfrage nach kostenlos, hochwertig und lang – und wie unrealistisch diese Kombination ist. https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/
- 【#7, r/GoogleFlow, 6 Punkte / 2 Kommentare, 2026-09-10】Die Chrome-Erweiterung „AutoFlow“ für Google Flow (Veo) wurde veröffentlicht. Sie bietet Batch-Generierung, Fortsetzung vom letzten Frame eines vorherigen Clips und automatische Bearbeitung von Sprecher-Videos mit Audio und Untertiteln; Geschäftsmodell: kostenlose Version plus Pro-/Ultra-Abos. https://www.reddit.com/r/GoogleFlow/comments/1wccmrg/
- 【#12, r/aiwars, 0 Punkte / 14 Kommentare, 2026-09-08】Diskussion über Persönlichkeitsrechte und Werberisiken, wenn eine KI-generierte Person zufällig einer realen Person ähnelt. u/Upstairs-Mammoth-509 (3 Punkte) weist darauf hin, dass die zufällige Übereinstimmung mit dem Gesicht einer unbekannten Privatperson besonders schwierig sei; Unternehmen könnten nur per umgekehrter Bildsuche prüfen und hoffen. Das zeige den Rückstand der Gesetzgebung. https://www.reddit.com/r/aiwars/comments/1wafe86/
- 【#10, r/hatethissmug, 59 Punkte / 20 Kommentare, 2026-09-12】Unterschiedliche Haltungen innerhalb der Anti-KI-Seite zu einem Video, das generative KI kritisiert und zugleich verwendet. u/AprilsStuff (22 Punkte) schreibt: „Ich bin gegen KI, aber die Debatte über Umweltbelastung ist zu übertrieben; auch die Vorstellung, KI werde einfach verschwinden, ist unrealistisch.“ Selbst in Anti-KI-Kreisen gibt es somit Widerspruch.
- 【#2, r/isthisAI, 0 Punkte / 31 Kommentare, 2026-09-09】Ein Thread beurteilt, ob ein Video KI-generiert oder real gefilmt wurde. Das Verschwinden und Wiederauftauchen einer Halskette (u/smalltiddygothb, 16 Punkte / u/EmergencyWaffleBox, 14 Punkte) gilt als entscheidender Hinweis. u/BouncingSphinx (5 Punkte) merkt an, dass die exakte Länge von 15 Sekunden ebenfalls nach dem aktuellen Limit von KI-Videos aussehe. Technische Grenzen wie Länge und Inkonsistenzen etablieren sich bei normalen Nutzern als Prüfkriterien. https://www.reddit.com/r/isthisAI/comments/1wbspxo/
Signale
- Wachsend: In mehreren unabhängigen Threads erscheinen integrierte unzensierte/NSFW-fähige Plattformen wie WildOwl.ai, cyberbara, RunDiffusion, Tensor.art und PixelForge. Die Nachfrage nach gleichzeitigem Zugang zu aktuellen Modellen und lockerer Moderation ist stark.
- Wachsend: Das Auftauchen ergänzender Ökosysteme wie des Drittanbieter-Automatisierungstools AutoFlow für Google Flow (#7).
- Skeptisch gesehen: Abos, die „unbegrenzt“ versprechen, etwa Artlist.io (#4), stoßen in der Community durchgehend auf Misstrauen.
- Skeptisch gesehen: Selbst innerhalb der Anti-KI-Seite gibt es Einwände gegen überzogene Argumente zur Umweltbelastung (#10); Anti-KI-Narrative sind nicht einheitlich.
- Überraschend: Der engagierteste der zwölf Threads war keine Modellveröffentlichung, sondern die Anti-KI-Anklage über gefälschte handgezeichnete Zeitraffer (#6, 7.146 Punkte) sowie ein KI-Bild-bedingter Shitstorm (#11, 4.470 Punkte). Auf Reddit verbreiten sich Themen zu KI-Täuschung und Vertrauenswürdigkeit deutlich stärker als Produktnews.
- Überraschend: Die Unterscheidung Closed Source/Open Source steht nicht im Zentrum der Nutzerinteressen. In vielen Threads werden Modelle beider Kategorien – Qwen, Flux, Seedream, Wan, Kling, Seedance, Veo, GPT Image und weitere – einfach als verfügbare Optionen nebeneinander genannt.
Grenzen
- Der Suchbegriff war ausschließlich „Image and Video Generation AI News“; es wurden nur 12 Threads gesammelt, statt der vorgesehenen etwa 20.
- Die Sammlung bestand aus zuvor von einem Worker in einem Headless-Browser erhobenen Daten. Eine eigene zusätzliche Reddit-Suche war diesmal nicht möglich, da Reddit Seiten über WebFetch und Suche ablehnt.
- Viele Beiträge sind Frage-und-Antwort-Threads zu Tool-Empfehlungen und spiegeln eher die praktische Tool-Nutzung in der Community als Nachrichten wider. Fachliche News-Threads, die Closed Source und Open Source klar gegenüberstellen, wurden nicht gefunden.
- r/AItips101 (1.299 Mitglieder) und r/GoogleFlow (1.884 Mitglieder) sind sehr kleine Subreddits; daraus gewonnene Erkenntnisse sind eher Einzelstimmen als repräsentativ für die Gesamtcommunity.
X
X — Trends bei KI-News zur Bild- und Videogenerierung
Accounts
Die 40 gesammelten Beiträge stammen von 40 unterschiedlichen Accounts, jeweils mit nur einem Beitrag; kein Account taucht wiederholt auf. Zudem spezialisiert sich keiner dieser Accounts auf KI-Bild- oder Videogenerierung wie Midjourney, Stable Diffusion, Sora, Runway, Kling, Veo, ComfyUI oder Flux. Die Cluster folgen den jeweiligen Suchbegriffen.
- Yemen/Saudi (Nahostlage und OSINT): @tleilax___, @Ahmed175143, @IranTimes72, @citrinowicz, @Osinttechnical, @c14english, @Rusia_HD, @MerruX — OSINT- und Nachrichtenaccounts zu Angriffen auf saudi-arabische Ölinfrastruktur und zum Jemen-Konflikt.
- $SONG (Cardano-Meme-Coin): @LagyADA, @EAjdarovic, @JureKaramarko, @SintoAndrej — kleine spekulative und werbliche Accounts.
- Charlie Kirk (erster Todestag): @tivent_1, @TruthNetwork24, @mscaradapawjob, @rokkstarrrrrrr — politische Kommentare und Meme-Reaktionen.
- Britain (britische Politik): @brigantia__、@Steven41849941、@SirJBritain、@BROKENBRITAIN0 — nationalistische Beiträge über Migration und Sicherheit.
- Anthropic (KI-Ökonomie und Sicherheit): @restitutorII, @BrianRoemmele, @walterkirn, @claudecode84 — wirtschaftliche Szenarien von Anthropic, Open Sourcing von Claude Code und KI-Kritik; es geht um LLM-Agenten und gesellschaftliche KI-Debatten, nicht um Bild- oder Videogenerierung.
- Apple/Samsung (Smartphone-Streit): @FlossyCarter, @cagriozturkish, @appleinteligen, @BrandonKHill — gegenseitige Provokationen zwischen Fans faltbarer Geräte.
- Sony (Spielebranche): @JayDubcity16, @Cris_Uther, @treeblazah, @ScreenCraveHQ — Klatsch über Hideo Kojima und Spider-Man-Filme.
- „one ai os“ (Eigenwerbung von KI-Startups): @de1lymoon, @neda_sefati, @harvey_control, @Iamanusbutt — Networking-Beiträge von Startups für KI-Agenten und Business-OS, ohne Bezug zur Bild- oder Videogenerierung.
- Chelsea (Fußball): @declanstar1, @TheHateCentra, @Lea_EFC, @chelcatastr0phe — Themen rund um Spiele des Chelsea FC.
Es gibt keine wiederkehrenden Poster, anhand derer sich sinnvoll zwischen einem einzelnen viralen Beitrag und vielen kleineren Beiträgen unterscheiden ließe. Allenfalls @rokkstarrrrrrr (9.404 Likes), @TheHateCentra (19.654 Likes) und @Cris_Uther (17.095 Likes) erzielten mit Einzelbeiträgen die größte Reichweite, allerdings sämtlich außerhalb des Themas.
Beiträge
Es gibt null Beiträge, die direkt KI-Bild- oder Videogenerierung erwähnen. Der Vollständigkeit halber folgen die thematisch nächstliegenden, aber weiterhin unpassenden Beiträge.
-
#21 @restitutorII — 458 Likes · 69 Reposts · 41 Antworten · ~57.000 Aufrufe · 2026-09-10
https://x.com/restitutorII/status/2097918742571139093"Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI..."
→ Wirtschaftsprognosen von Anthropic. Es geht um generative KI allgemein, nicht um KI-Bild- oder Videogenerierung. -
#24 @claudecode84 — 2.585 Likes · 268 Reposts · 24 Antworten · ~741.000 Aufrufe · 2026-09-10
https://x.com/claudecode84/status/2097959830942367747„Der höchste Anthropic-Verantwortliche selbst veröffentlicht seine gesamte ‚Claude-Code-Umgebung‘ als Open Source.“
→ Open Sourcing von Claude Code, einer Coding-KI, nicht von Bild- oder Videomodellen. -
#33 @de1lymoon — 49 Likes · 6 Reposts · 9 Antworten · ~3.500 Aufrufe · 2026-09-11
https://x.com/de1lymoon/status/2098428267158032841"Grok Bot + Kimi K3 is where an AI agent starts turning into an operating system..."
→ Überlegungen zur Orchestrierung von KI-Agenten, ohne Bezug zur Bild- oder Videogenerierung. -
#22 @BrianRoemmele — 792 Likes · 187 Reposts · 105 Antworten · ~100.000 Aufrufe · 2026-09-10
https://x.com/BrianRoemmele/status/2098024115231924568
→ Meme-artiger Beitrag über Anthropic-Kritik und KI-Bedrohungen, ohne Bild- oder Videogenerierung. -
#23 @walterkirn — 723 Likes · 91 Reposts · 39 Antworten · ~28.000 Aufrufe · 2026-09-10
https://x.com/walterkirn/status/2098059171325427949
→ Ebenfalls Kritik an Anthropic und Medien, ohne Bezug zur KI-Bild- oder Videogenerierung.
Diese fünf sind alles, was über das Keyword „AI“ gefunden werden konnte; für Nachrichten zu offenen oder geschlossenen Bild-/Video-KI-Modellen ist keiner davon verwendbar.
Signale
- Die Top-10-Trends von X Explore – nach der Anzeige „Trending in Croatia“ vermutlich regionsbezogen auf Kroatien – waren „Yemen“, „Saudi“, „$SONG“, „Charlie Kirk“, „Britain“, „Anthropic“, „Apple“, „Sony“, „one ai os“ und „Chelsea“. Begriffe zur KI-Bild- und Videogenerierung wie Midjourney, Sora, Stable Diffusion, Runway, Kling oder Veo waren nicht vertreten.
- Dass „Anthropic“ und „one ai os“ trenden, zeigt eine lebhafte Debatte über KI-Agenten, LLMs und deren wirtschaftliche Wirkung. Das ist jedoch eine andere Themenwelt als diese Analyse.
- Unter den 40 Beiträgen fand sich kein einziger mit Tool-Namen, Veröffentlichungen, Demos oder Vergleichen zur KI-Bild- oder Videogenerierung.
Grenzen
- Die verwendeten Suchbegriffe („Yemen“, „Saudi“, „$SONG“, „Charlie Kirk“, „Britain“, „Anthropic“, „Apple“, „Sony“, „one ai os“, „Chelsea“) waren an diesem Tag Trends aus X Explore und bezogen sich nicht auf KI-Bild- und Videogenerierung. Daher enthielten die 40 gesammelten Beiträge keinen einzigen relevanten Beitrag – weder zu Closed Source noch zu Open Source.
- Entsprechend konnten aus X-Daten keine vom Briefing erwarteten Erkenntnisse zu jeweils zehn Open-Source- und Closed-Source-Themen gewonnen werden. Das Problem ist nicht, dass X zum Thema nichts sagte, sondern dass nicht themengerecht gesucht wurde.
- Beim nächsten Durchlauf ist eine erneute Sammlung mit Tool- und Firmennamen wie Midjourney, Stability AI, Runway, Pika, Luma, Kling, Sora, Google Veo, Flux und ComfyUI nötig.
YouTube
YouTube — KI-News zur Bild- und Videogenerierung (Closed Source/Open Source)
Kanäle
- There's An AI For That — Kanal zu KI-Tools mit einem FLUX.2-Review.
- AI Search — Kanal für neue Modelle und Eilmeldungen, mit Videos zu Sora 2 und HunyuanVideo 1.5.
- Theoretically Media — Fachkanal mit Schwerpunkt auf KI-Videogenerierung, mit ausführlichem Veo-3.1-Review.
- Teacher's Tech — Praxisorientierter Tool-Kanal mit Review zu Nano Banana 2.
- Codebreakers — Reviews und Erklärungen zu Open-Source-KI-Modellen, mit MiniMax-H3-Spezial.
- Bijan Bowen — Kanal für lokale KI-Bildgenerierung, testet Z-Image Turbo.
- Benji's AI Playground — Tutorials zu ComfyUI und lokaler Generierung, erklärt Ideogram 4.0.
- Curious Refuge — Etablierter Bildungskanal für KI-Filmproduktion, mit Midjourney-V8-Review.
- RandomAI — Kanal für Modellnews und Vergleiche, erklärt GPT Image 2.5.
- Standarity / The AI Filmmaking Advantage — Kanäle für News und Vergleichstests zu Seedream 5.0 Pro.
- MattVidPro AI — Erwähnt Runway Gen-4 in einem First-Impression-Video.
Videos
- „Is FLUX 2.0 The New Open Source King?“ — There's An AI For That — https://www.youtube.com/watch?v=YQuTkPVkCS8 — Prüft, ob Black Forest Labs’ FLUX.2 zum neuen Open-Source-Champion der Bildgenerierung werden könnte.
- „We have a new #1 open-source AI video generator!“(2025-11-25)— AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — Review und Installationsanleitung für HunyuanVideo 1.5 in ComfyUI; soll auch mit wenig VRAM laufen.
- „Sora 2… wtf“ — AI Search — https://www.youtube.com/watch?v=El-G4cO4x4I — Vergleicht OpenAI Sora 2 mit Veo 3, Kling 2.5 und Hailuo 02; betont Fortschritte bei Audiosynchronisation und physikalischer Darstellung.
- „Veo 3.1 Is More Powerful Than You Realize!“(2025-10-16)— Theoretically Media — https://www.youtube.com/watch?v=sTOFXi2eY_k — Erklärt Verbesserungen bei Lippen-Synchronität, Charakterkonsistenz und 1080p-Upscaling in Google Veo 3.1.
- „The New Gemini Image Generator is Insane (Nano Banana 2)“— Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Berichtet, dass Nano Banana 2 zum Standardmodell der Gemini-App wurde.
- „MiniMax H3: The New Open-Source Video Champ?“(2026-08-03)— Codebreakers — https://www.youtube.com/watch?v=3R5GROj8Tcg — Stellt das Open-Weight-omnimodale Videomodell MiniMax H3 (Hailuo 3.0) vor, das Videos mit nativem Stereo-Audio in einem Durchlauf erzeugen kann.
- „Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models“— Bijan Bowen — https://www.youtube.com/watch?v=K0FgDU-9uik — Testet das unter Apache-2.0 lizenzierte Z-Image Turbo lokal und erklärt es zum KING.
- „Ideogram 4.0 Released! The New Open Model That FINALLY Gets Text Right“(2026-06-04)— Benji's AI Playground — https://www.youtube.com/watch?v=HY_e5CZfJfQ — Berichtet, dass Ideograms erstes Open-Weight-Modell in der Design Arena Platz eins erreicht habe und Text endlich präzise darstelle.
- „I Tried Midjourney 8… Here's the Truth“(2026-03-19)— Curious Refuge — https://www.youtube.com/watch?v=i9qV9-2tzEA — Ehrliches Leistungsreview zu Midjourney V8.
- „GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model“— RandomAI — https://www.youtube.com/watch?v=DY6TkI8XtkQ — Erklärt OpenAIs GPT-Image-2/2.5-Familie sowie Fortschritte bei Textrendering und Mehrsprachigkeit.
- „ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted“— Standarity — https://www.youtube.com/watch?v=g05iPef37Qs — Fasst die Ankündigung zu Seedream 5.0 Pro zusammen, das Bearbeitung auf Ebenen ermöglicht.
- „🚨BREAKING: Seedream 5.0 Pro Just SMOKED Every Image Model (Fully Tested)“(2026-07-16)— The AI Filmmaking Advantage — https://www.youtube.com/watch?v=WpcxwSNT3X4 — Vergleicht Seedream 5.0 Pro ausführlich mit anderen Modellen und bewertet es als klar überlegen.
Signale
Bewegungen auf der Closed-Source-Seite
- OpenAI GPT Image 2 / 2.5 liegt laut Berichten in der Artificial Analysis Image Arena mit einem Elo-Wert von 1.339 vorn und weist im September 2026 den größten Abstand zwischen Platz eins und zwei in der Geschichte der Arena auf.
- Google Veo 3.1 und Nano Banana Pro (Gemini 3 Pro Image) werden bei Video und Bild zugleich ausgebaut; Lippen-Synchronität, 1080p-Upscaling und Ebenenbearbeitung zeigen eine deutliche Ausrichtung auf professionelle Anwendungen.
- ByteDance Seedance 2.0 (2026-02) und Seedream 5.0 Pro (um Juli 2026) gewinnen schnell an Bedeutung, gestützt auf Multimodalität mit Text-, Bild-, Video- und Audio-Referenzen.
- Mehrere Videos behaupten, xAI Grok Imagine 1.5 übertreffe Veo und Sora in Benchmarks; dies wurde etwa im Juni 2026 zum Diskussionsthema.
- Bestehende Anbieter wie Runway Gen-4/4.5 und Midjourney V8 (V8.1, V8.2) liefern weiter Updates. Viele Reviews sind entsprechend als Verteidigung der jeweiligen Spitzenposition angelegt.
Bewegungen auf der Open-Source-Seite
- Black Forest Labs FLUX.2 wird in mehreren Reviews als hochwertiges, lokal ausführbares Bildmodell und möglicher neuer Champion bezeichnet.
- Tencent HunyuanVideo 1.5 unterstützt ComfyUI nativ und etabliert sich als neue Open-Source-Referenz für Videogenerierung auch auf Systemen mit wenig VRAM.
- Alibaba/Tongyi-MAIs Z-Image und Z-Image Turbo werden unter Apache-2.0 veröffentlicht und von vielen Kanälen als neue Champions lokaler Modelle bewertet.
- Ideogram 4.0 erschien als erstes Open-Weight-Modell des Unternehmens, erreichte Platz eins in der Design Arena und wird besonders für präzises Textrendering hervorgehoben.
- MiniMax H3 (Hailuo 3.0) wurde im August 2026 als Open-Weight-omnimodales Videomodell für persönliche GPUs wie die RTX 3090 bekannt; zahlreiche ComfyUI-Videos folgten.
- Lightricks LTX-2 erzeugt als Open-Source-Modell 4K-, 50-fps- und audiosynchronisierte Videos und wird als „heiliger Gral für Open-Source-Video“ bezeichnet.
- Alibaba Wan 2.5/2.6 wird fortlaufend als Open-Source-Videomodell mit Eingaben für Text, Bild, Audio und Video behandelt.
Grenzen
- Die YouTube-Suchergebnisseiten (
youtube.com/results?...) werden per JavaScript gerendert. WebFetch erhielt nur den Footer und keine Inhalte wie Titel, Aufrufe oder Kanaldaten. Auch einzelne Videoseiten (watch?v=) waren nicht direkt lesbar; Titel und Kanalnamen wurden deshalb über die YouTube-oEmbed-API geprüft. - Die oEmbed-API liefert weder Aufrufe, Veröffentlichungsdatum, Abonnentenzahl noch Kommentare. Aufrufe und Abonnenten konnten daher nicht erhoben werden. Daten wurden nur genannt, wenn sie in WebSearch-Snippets enthalten waren.
- Für „LTX-2: Open Source AI Video, Released to the Community“ (zSvCnVi181A) lieferte oEmbed einen 403-Fehler.
- Aufgrund dieser Einschränkungen konnten Kommentarbereiche der Videos nicht geprüft werden; die Zusammenfassungen beruhen nur auf Titeln und Beschreibungen.
- Zur Ergänzung wurden Informationen aus WebSearch-Snippets und verwandten Blogs verwendet. Die verlinkten YouTube-URLs wurden sämtlich auf ihre Existenz geprüft.
Bluesky
Bluesky — KI-News zur Bild- und Videogenerierung (Closed Source/Open Source)
Accounts
- theinformation.com / techmeme.com / mediagazer.com / lefiltech.fr — RSS-gekoppelte Nachrichtenbots, die Scoops zu OpenAI und Sora mehrsprachig verbreiten.
- ctxwindow.kynth.studio(#TechBluesky) — Beobachter, der Änderungen auf OpenAIs Preisseite verfolgt und postet.
- gen-ai.news — Persönlicher News-Account für Midjourney-Updates.
- oludai.bsky.social — Betreibt mit olud.ai ein eigenes Blindtest-Ranking menschlicher Bewertungen und aktualisiert offene und geschlossene Bildmodelle stündlich.
- aichina.news — Bot-artiger Account, der fast täglich Apache-2.0-FLUX-LoRAs auf Huaweis Modelers.cn meldet.
- circuitai.bsky.social — Spam-/Werbeaccount, der täglich mehr als ein Dutzend fast identische Affiliate-Posts zu Alibaba WAN 3.0 mit vidhapi.app veröffentlicht.
- arxiv-cs-cv.bsky.social — Postet automatisiert neue arXiv-Arbeiten zu Bild- und Videogenerierung.
- un1v3rse.bsky.social / carlbetheav.bsky.social / stumblegirl.bsky.social / ttaships.airminded.org — Individuelle Künstler, die täglich Midjourney-Werke posten (#midjourney #QP #FoxyFriday).
- rin-yamami.bsky.social / satomin6.alimika.jp — Japanischsprachige KI-Illustratoren, die Qwen-Image-Edit und ComfyUI verwenden.
Beiträge
- theinformation.com(2026-09-10, 👍1 🔁0)— Scoop: Der frühere OpenAI-Sora-Leiter Bill Peebles gründet mit dem Hollywood-Schwergewicht Jeffrey Katzenberg, früher DreamWorks, und einem ehemaligen Dropbox-CFO ein eigenes Startup für KI-Videogenerierung.
https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n - ctxwindow.kynth.studio(2026-09-08, 👍0/1 🔁0)— Erkennt, dass OpenAI sora-2 und sora-2-pro still von der Preisseite entfernt hat (frühere Preise: 720p $0.05–$0.30). Dies wird als Hinweis auf einen Rückzug von Sora interpretiert.
https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23 - somewhattolerable.com(2026-09-06, 👍2)— Vermutung: OpenAI habe Sora eingestellt, weil interne Ingenieure den Ressourcenverbrauch kritisiert hätten.
https://bsky.app/profile/somewhattolerable.com/post/3muuuazkaf223 - itmatterss.bsky.social(2026-09-11, 👍1)— Gemini von Google wird zur Windows-Desktop-App (Start per Alt+Space). Als Bildgenerierung wird Nano Banana und als Videogenerierung „Gemini Omni“ genannt.
https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n - dimnews.bsky.social(2026-09-11, Russisch)— SenseTime stellt das multimodale Acht-Milliarden-Parameter-Modell „SenseNova-U1.5“ vor und behauptet, Nano-Banana-Pro beim visuellen Schlussfolgern zu übertreffen.
https://bsky.app/profile/dimnews.bsky.social/post/3mv7u7crnzz25 - gen-ai.news(2026-08-30, 👍1)— Meldet, dass Midjourneys V8.2-Bearbeitungsmodell nach Beschwerden über Qualitätsverlust still gepatcht wurde.
https://bsky.app/profile/gen-ai.news/post/3mudbgowbnz2s - futureautomationai.bsky.social(2026-09-03, 👍2)— Übersicht „Midjourney in 2026“: V8.2, Personalisierung, Moodboards, Bearbeitungsmodell und Referenzfunktionen.
https://bsky.app/profile/futureautomationai.bsky.social/post/3mumtnbxuv22d - oludai.bsky.social(2026-09-10/11, 👍1-2)— Im Blindtest-Ranking ist Qwen-Image-3.0-Pro (#12) das beste herunterladbare Modell und liegt nur 92 Elo-Punkte hinter GPT Image 2 (high).
https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t - ddigitalmedia.bsky.social(2026-09-10, 👍1)— Bewertet Qwen, Z-Image und MiniMax als die einzigen Anbieter, die westlichen LLM-/Bildprodukten Konkurrenz machen können.
https://bsky.app/profile/ddigitalmedia.bsky.social/post/3mv6lyejx3223 - circuitai.bsky.social(2026-09-11–12, Wiederholungen)— Bewirbt Alibabas Videomodell „WAN 3.0“ als günstige, nutzungsabhängig abgerechnete Alternative zu ByteDance Seedance 2.5; maximal 30 Sekunden pro Clip. Hinweis: Derselbe Affiliate-Text wurde mehr als 15-mal pro Tag gepostet.
https://bsky.app/profile/circuitai.bsky.social/post/3mvbvqsdvr22p - minaxlab.bsky.social(2026-09-11)— Kündigt ComfyUI v0.35.1 an; die lokale Open-Source-Generierungsumgebung wird weiterentwickelt.
https://bsky.app/profile/minaxlab.bsky.social/post/3mvasr3l72x2i - aichina.news(2026-09-08–09, mehrere Posts)— Auf Huaweis Modelers.cn erscheinen fortlaufend FLUX-LoRAs unter Apache-2.0. Bei vielen fehlen Trigger-Wörter und Benchmarks; der Account urteilt wiederholt, die Belege reichten nicht aus, um Qwen-Image zu übertreffen.
https://bsky.app/profile/aichina.news/post/3mv3vq3zdui24 - arxiv-cs-cv.bsky.social(2026-09-11)— Neue Arbeit zur Bewertung und Verbesserung von „Think-with-Video“-Schlussfolgern in Videogenerierungsmodellen veröffentlicht (From Evaluation to Enhancement).
https://bsky.app/profile/arxiv-cs-cv.bsky.social/post/3mvbfk6tunc2j
Signale
- Sora verliert offenbar faktisch an Fahrt: Die Entfernung von Modellen von der Preisseite, der Weggang des früheren Leiters zu einem konkurrierenden Startup und die Vermutung einer Einstellung wegen zu hohen Ressourcenverbrauchs fallen zeitlich zusammen. OpenAIs Videogenerierung wirkt defensiv.
- Google verfolgt dagegen eine breite Offensive: Nano Banana, Nano Banana Pro, Veo und Gemini Omni werden bis in eine Windows-App integriert – eine Strategie, generative KI an allen Berührungspunkten einzubauen.
- Chinesische Anbieter sind die Hauptakteure im Open-Source-Bereich: Qwen-Image-3.0-Pro, Z-Image (Turbo), MiniMax, Alibaba WAN 3.0 und SenseTime SenseNova-U1.5 stehen im Mittelpunkt. Mehrere Accounts vertreten die Ansicht, nur chinesische Open-Modelle könnten westlichen Bild- und Video-KI-Produkten Konkurrenz machen.
- Der Abstand zu Closed Source schrumpft: In kontinuierlichen Blindtests von oludai.bsky.social liegt Qwen-Image-3.0-Pro nur 92 Elo-Punkte hinter GPT Image 2 (high).
- Auf Rauschen und Werbung achten: Viele WAN-3.0-Beiträge sind wiederholte Affiliate-Posts von circuitai.bsky.social und kein organisches Interesse.
- ComfyUI- und LoRA-Ökosysteme entwickeln sich weiter: Neben Updates für ComfyUI werden etwa FLUX-LoRAs für Huaweis Ascend-NPUs portiert; damit schreitet auch die Unterstützung von Hardware außerhalb von CUDA voran.
Grenzen
- Die öffentlichen Bluesky-APIs (
public.api.bsky.appundapi.bsky.appmitapp.bsky.feed.searchPosts) lieferten intermittierend 403-Fehler, vermutlich wegen Rate Limits. Viele Abfragen funktionierten erst nach Pausen und Wiederholungen. - Für
Runway Gen,Kling AI,Black Forest Labsund verschiedene Schreibweisen vonWan 2.5traten fortlaufend 403-Fehler auf; sie wurden aufgegeben und durch Alternativabfragen wieWan videoersetzt. Direkte Beiträge zu Runway und Kling sind daher nicht enthalten. - Die Weboberfläche
bsky.app/searchist eine JavaScript-SPA und ließ sich nicht inhaltlich abrufen; die Analyse beruht vollständig auf API-JSON. - Begriffe wie „Flux“ und „Z-Image“ lieferten viele irrelevante Treffer, etwa Aeon Flux, Sonnenfluss, Pokémon Z-A oder Erwachsenen-Websites; die Bereinigung war aufwendig.
- Bei The Information zu Katzenberg und bei arXiv-Arbeiten wurden nur Überschrift und Kurzfassung geprüft, nicht die vollständigen Inhalte.
Lemmy
Lemmy — KI-News zur Bild- und Videogenerierung
Communities
- !«メールアドレス» — Insgesamt 5.709 Abonnenten, davon 893 lokal. Der größte Lemmy-Hub für Tools und Modellveröffentlichungen in diesem Bereich. Fast alle jüngsten Beiträge stammen von
Even_Adder, der täglich neue GitHub- und Hugging-Face-Releases postet. - !«メールアドレス» / lemmy.world — Community für KI-generierte Werke; eher Galerie als Nachrichtenquelle (Scores von -14 bis 16).
- !«メールアドレス» — Spezialcommunity für abstrakte Kunst mit SDXL und benutzerdefinierten LoRAs. Allein im September mehr als zehn Beiträge, also aktiv.
- !ai_reddit@[verschiedene Instanzen] — Ansammlung von Crossposts aus Reddit r/ArtificialInteligence, mit wenig originärer Diskussion.
- !«メールアドレス» — Allgemeine Technik-News, in denen Midjourney-Artikel Scores von über 70 erreichen.
- !hackernews@[verschiedene Instanzen] — Hacker-News-Crossposts, die mehrere Beiträge über Midjourneys Kontroverse aufgreifen.
- !techtakes@[verschiedene Instanzen] — KI-kritische Community, in der „Midjourney pivots to Theranos“ 40 Punkte erhielt.
- !llm@[verschiedene Instanzen] — LLM-Community; die Veröffentlichung von GPT-6 Astra wurde mit -3 Punkten kühl aufgenommen.
- !«メールアドレス» — Kleine Community zu Perchance, einem Tool für Text- und Bildgenerierung.
Da die API je nach Instanz für Abonnentenzahlen 404 zurückgab, konnten außer für !«メールアドレス» keine exakten Werte bestätigt werden.
Beiträge
Eher Closed Source
- „Midjourney pivots from AI image generation to body scanning medical spa“ — !«メールアドレス», 58 Punkte, 2026-06-18. https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429 — Aufsehenerregende Nachricht, dass Midjourney von Bildgenerierung auf ein medizinisches Spa-Geschäft mit Ultraschall-CT (Midjourney Medical) umschwenkt.
- „Midjourney AI pivots to Theranos: Ultrasonic CT“ — !techtakes, 40 Punkte, 2026-06-19. https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/ — Polemischer Kommentar, der dies als Rückkehr von Theranos bezeichnet.
- Offizielle Seite „Midjourney Medical“ — !hackernews, 3 Punkte, 2026-06-18. https://www.midjourney.com/medical
- „Midjourney wants Hollywood studios to reveal the details of their AI usage“ — !«メールアドレス», 73 Punkte, 2026-07-05. https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/ — Midjourney fordert Hollywood-Studios auf, Details über ihren KI-Einsatz offenzulegen.
- „Behind the scenes with the Midjourney scanner“(Video)— !hackernews, 1 Punkt, 2026-07-06. https://www.youtube.com/watch?v=4nzzpUKhj1M
- „Amnesty International's May 2026 briefing calls leading generative AI systems 'unlawful by design'“ — !ai_reddit, 1 Punkt, 2026-06-24. https://www.reddit.com/r/ArtificialInteligence/comments/1ue64s2/ — Menschenrechtsorganisation kritisiert die Datensammlung führender Closed-Source-Systeme für generative KI, einschließlich Bildgenerierung, als rechtswidrig.
- Veröffentlichung von GPT-6 Astra — !llm, -3 Punkte, 2026-09-04. https://openai.com/index/gpt-6-astra/ — Das LLM generiert Bilder und Videos nicht direkt, sondern ruft Werkzeuge über die Responses API auf. Die Community-Reaktion ist schwach und negativ.
Eher Open Source(alle !«メールアドレス», gepostet von Even_Adder)
- Werkzeuge rund um das Videomodell MiniMax-H3 — Zwischen 9/4 und 9/10 erschienen mehr als sieben Beiträge (
ComfyUI-MiniMax-H3-W4A4-VSA,MiniMax-H3-Semantic-Bridge,ComfyUI-Ref2VA-VSA,Minimax-h3_Singularity,minimax-h3_fl2v_8Step_motion_enhancer,ComfyUI-VDN-H3,vdn-minimax-h3,FastH3-Ref2V-Stream-Controller). Das Ökosystem rund um das Open-Source-Videomodell MiniMax-H3 wächst explosionsartig, mit Quantisierung, Beschleunigung und semantischen Brücken. Beispiel: https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA - „LLaDA-Image: Building Strong Image Generators“ — 3 Punkte, 2026-09-04. https://arxiv.org/abs/2609.03796 — Paper zu einem Open-Source-Diffusion-Transformer mit sechs Milliarden Parametern.
- Zwei LoRAs für Krea 2 Turbo —
F16/krea2-turbo-sda(2 Punkte, 9/10, https://huggingface.co/F16/krea2-turbo-sda)undlvladikov/Krea2-Turbo-Distill-4step-LoRA(2 Punkte, 9/8, behauptet 45 % Qualitätssteigerung durch Vier-Schritt-Destillation). - „Viggle/Viggle-Animate“ — 10 Punkte, 2026-09-05. https://huggingface.co/Viggle/Viggle-Animate — Technik, die anhand eines einzelnen neu gerenderten Frames eine Figur in einem Video ersetzt.
- „How a 20-year-old independent builder from Bihar created an open omni AI model“ — !ai_reddit, 0 Punkte, 2026-09-11. https://www.reddit.com/gallery/1wdii5s — Ein offenes Omnimodell mit 5,84 Milliarden Parametern soll im Benchmark MATH-500 Apples AFM-3B-Modell übertroffen haben.
Signale
- Bei Open Source ist weniger das Basismodell als das umgebende Ökosystem das Schlachtfeld. Rund um MiniMax-H3 erschienen in einer Woche mehr als zehn Werkzeuge für Quantisierung, Beschleunigung, ComfyUI-Nodes und LoRAs. Hier konzentriert sich die Energie der Community.
- Die Berichterstattung zu diesem Thema auf Lemmy hängt praktisch von einer einzelnen Person, Even_Adder, ab. Es ähnelt mehr einer Linkliste als Diskussionen; die meisten Threads haben fast keine Kommentare.
- Die größte Closed-Source-Geschichte ist keine neue Leistungsbestmarke, sondern Midjourneys Wechsel zu einem medizinischen Spa-Geschäft. Der Ton ist eher Unternehmens- und Gesellschaftskritik als Techniknews.
- Menschenrechtskritik an der Legalität generativer KI und der Datenerhebung, etwa von Amnesty International, taucht als weiteres Closed-Source-Thema auf.
- GPT-6 Astra erschien im September 2026, generiert Bilder/Videos aber nicht direkt und ist deshalb für dieses Thema wenig relevant; auf Lemmy wurde es zudem negativ bewertet.
Grenzen
- Lemmys Such-API basiert auf Keyword-Übereinstimmungen. Suchen nach
Sora,Veo,Runway,Kling,Grok ImagineundNano Bananaergaben keine relevanten Treffer. Diese Themen werden auf Lemmy praktisch nicht diskutiert. !«メールアドレス», die Instanzvariante der Community, war wegen HTTP 503 nicht abrufbar; stattdessen wurde die dbzer0-Instanz genutzt.- APIs für Abonnentenzahlen mehrerer Communities (
/api/v3/community?name=...) lieferten 404, sodass viele Werte nicht bestätigt werden konnten. - Zwar wurden 20 thematisch relevante Beiträge gesammelt, Lemmy ist aber für dieses Thema eine sehr kleine Plattform mit wenigen Communities und Accounts als tatsächlichen Quellen. Originaldiskussionen sind selten; der Großteil sind Links oder Reposts.
Pinterest — KI-News zur Bild- und Videogenerierung
Die 50 in output/pinterest.pins.md enthaltenen Pins – ohne Kategorisierung und mit der einzigen Suchanfrage „Image and Video Generation AI News“ erhoben – wurden alle visuell geöffnet und geprüft.
Visuelle Themen
- Neonblaue/-violette futuristische UI-Hintergründe dominieren. Schwarze Flächen mit Leiterbahnmustern, leuchtende KI-Logos und holografische menschliche Silhouetten prägen sowohl Infografiken als auch Video-Thumbnails
[1, 3, 4, 5, 34, 37, 39, 41, 48]. - Bärtiges Gesicht eines männlichen YouTubers + große Schrift „AI NEWS“ + Logos vieler Firmen ist ein wiederkehrendes Thumbnail-Muster. Überraschte oder skeptische Gesichtsausdrücke sollen Aufmerksamkeit erzeugen, während Google-, OpenAI-, Microsoft-, Meta- und Anthropic-Logos nebeneinanderstehen
[4, 20, 21, 45]. - Ranking-Infografiken zu „best AI video tool“ sind sehr häufig und verwenden fast dieselbe Vorlage: nummerierte Karten, Logos, Checklisten mit Eigenschaften und „best for“. Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo und Synthesia tauchen in fast allen Listen als Standardtools auf
[7, 8, 13, 24, 40]. - Formate zum Raten, was echt und was KI ist, fallen auf: Vergleichsquizze mit Landschaftsfotos, Erklärungen zu Deepfake-Trends und Anzeigen zur Erkennung von KI-Stimmen
[16, 17, 20, 37]. - Humanoide Roboter als generisches Symbol für KI werden oft wiederverwendet: Nachrichtenmoderator-Roboter, Roboter mit Weltkugel, halb-cyborgisierte Gesichter – meist ohne Bezug zu tatsächlichen technischen Details
[2, 34, 37, 39, 48]. - Ein Rasterbild mit Materialtransformations-Demos zeigt dieselben Videos von Person, Hund und Auto als Holzklötze, Origami, Lego und Blumen. Es ist eine konkrete Demonstration der Ausdrucksfähigkeit eines Videomodells
[6]. - Werbe-Pins für Freelancer und Auftragsarbeiten sind beigemischt: Angebote wie „Ich erstelle KI-Videos“, teils mit WhatsApp-Kontakt oder Fiverr-Angeboten mit einem generierten Jeff-Bezos-Bild
[15, 32, 42]. - Echte Produktnews in Form offizieller Ankündigungs-Screenshots machen nur einen Teil aus. Der Großteil sind massenproduzierte SEO-/Affiliate-Infografiken und YouTube-Thumbnails. Reale News betreffen unter anderem Google Veo 2/3, Microsoft VASA-1, ShengShus Vidu S1, Adobes Upscaling-Modell, AMD Amuse 3.0 und eine Urheberrechtsvereinbarung zwischen ByteDance und MPA
[3, 5, 12, 29, 46, 10, 47, 31].
Bemerkenswerte Pins
- #3/#5 — Google announces ultra-high quality video / Veo 2 promo — Offizielle Google-Werbematerialien mit Veo-2-Ausgabeproben wie einem unter Wasser schwimmenden Hund, Flamingos und einer animierten Küchen-Szene.
- #12 — Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Konkretes Funktionsupdate zu Bild-zu-Video und nativem Audio in Veo 3 über die Gemini API.
- #6 — Materialtransformations-Demo-Raster (Luma-artig) — Vergleichsraster, das dasselbe Ausgangsvideo in Holzklötze, Origami, Lego und Blumen umwandelt; der konkrete Pin mit der aussagekräftigsten Leistungsdemonstration.
- #16 — „Why Is Trump Obama AI Video Trending?“ — Detaillierte Infografik zu einem viralen KI-Video-Trend. Namentlich genannt werden Runway ML, Pika Labs, Kaiber, HeyGen, CapCut AI und DeepBrain AI.
- #29 — ShengShu Technology unveils Vidu S1 — Ankündigungs-Pin zu einem chinesischen Modell, das „Echtzeit- und interaktive Generierung“ verspricht.
- #31 — ByteDance and Hollywood reach global deal on AI copyright — Reale Rechts- und IP-Nachricht über eine Einigung von ByteDance und MPA zum Urheberrecht bei KI-Bild- und Videogenerierung.
- #44 — „More than 20% of YouTube is now AI-generated“ — Einer der wenigen Pins mit einer konkreten Statistik.
- #46 — Microsoft VASA-1 — Forschungsdemo, die aus einem Foto und einem Audio-Clip ein sprechendes Video erzeugt.
- #47 — „Amuse 3.0“ (AMD) — Ankündigung einer neuen Version des KI-Bildgenerierungstools.
- **#37 — Infografik zur Erkennung von KI-Stimmen („97% likely AI generated“) ** — Aufklärungs-Pin zu Echtheit, Erkennung und KI-Ethik.
Signale
- Im Mittelpunkt stehen weiterhin kommerzielle Closed-Source-Tools wie Runway, Pika, Kling AI, Luma, Canva, Hailuo, Synthesia und D-ID. Ihre Logos sind in Ranking-Infografiken fast immer vorhanden. Pins, die Open Source oder selbst gehostete Lösungen wie Stable Video Diffusion, ComfyUI-Workflows oder Open-Sora in den Vordergrund stellen, wurden kaum gefunden.
- Google Veo 2/3 ist die sichtbarste offizielle Produktnachricht; besonders betont werden Bild-zu-Video und natives Audio über die Gemini API.
- Unter den chinesischen Anbietern tritt ShengShus Vidu S1 mit dem Thema Echtzeit- und interaktive Generierung hervor.
- Deepfakes und Unsicherheit über Echtheit – Trump-Obama-Videotrends, Erkennung von KI-Stimmen und „Welches Bild ist KI?“-Quizze – bilden ein durchgängiges Nebenthema auf Pinterest.
- Branchen- und Rechtsnachrichten wie der KI-Anteil von über 20 % auf YouTube sowie die ByteDance-MPA-Vereinbarung sind ebenfalls vorhanden.
- Technische Tiefe zu Modellarchitekturen, Trainingsmethoden oder Benchmarks fehlt nahezu vollständig. Entsprechend der Natur von Pinterest dominieren Tool-Empfehlungen, Anleitungen und Erklärungen viraler Phänomene.
Grenzen
- Die Worker-Suche verwendete nur die einzelne Anfrage
"Image and Video Generation AI News"und sortierte nicht nach Kategorien wie Open Source/Closed Source. Diese Analyse betrachtet die 50 Beiträge daher durchgängig; die Kategorisierung wurde erst in der Integrationsphase vorgenommen. - Einige Pins waren thematisch nur locker passend oder generische Stockbilder, etwa
#35mit einer Weltkarte,#43mit einer cello spielenden Statue oder#22mit einem Adobe-Stock-Icon. Das deutet auf lockeres Such-Matching und Rauschen hin. - Pinterest zeigt keine Veröffentlichungsdaten; das Alter einzelner Pins kann daher nicht bestimmt werden. Hinweise liefern nur Jahreszahlen wie „2025“ oder „2026“ in Titeln.
- Pin-Titel sind von Pinterest zwischengespeicherte Texte und können vom tatsächlichen Datum oder den Details des verlinkten Artikels abweichen. Geprüft wurden nur Bild und Titel auf Pinterest.
Empfohlene Maßnahmen
- Die X-Recherche sollte mit Eigennamen wie Midjourney, Sora, Runway, Kling, Flux und ComfyUI statt mit Trendbegriffen wiederholt werden.
- Die Elo-Differenz zwischen Qwen-Image-3.0-Pro und GPT Image 2 sollte kontinuierlich beobachtet werden, um den Abstand zwischen Open und Closed Source zu verfolgen.
- Bluesky-Accounts, die Preis- und Produktseiten überwachen, sollten weiter verfolgt werden, um die These einer Sora-Abschwächung zu prüfen.
- Für Reddit sollten zusätzliche Suchbegriffe eingesetzt werden, um das Ziel von etwa 20 Beiträgen zu erreichen.
- Pinterest-Ranking-Infografiken und wiederholte Bluesky-Affiliate-Posts sollten erst bei Bestätigung durch andere Plattformen als verlässlich gelten.
Gesammelte Bilder


















































Hinweis zur Datenqualität
Auf X gab es wegen ungeeigneter Suchbegriffe keine Beiträge zur KI-Bild- und Videogenerierung. Reddit erreichte mit 12 Beiträgen nicht das Ziel von etwa 20, YouTube konnte wegen JavaScript-Rendering keine Aufrufe oder Abonnentenzahlen erfassen, und bei Bluesky musste die Sammlung wegen anhaltender 403-Fehler für einige Keywords abgebrochen werden.



