Aktuelle Nachrichten zu KI für Bild- und Videogenerierung — 07.09.2026
Closed-Source-Anbieter läuten mit dem Ende der Sora-2-API (24.09.2026) und der Entwicklung von GPT-6 Astra zum universellen Agenten einen Wachwechsel ein. Gleichzeitig wächst das Open-Source-Ökosystem rund um ComfyUI, MiniMax-H3 und Qwen-Image-Edit täglich weiter und erreicht selbst auf Consumer-GPUs ein praxistaugliches Niveau.
Aktuelle Nachrichten zu KI für Bild- und Videogenerierung — 7. September 2026
Was für eine irre Woche 🔥🔥 Bei den Closed-Source-Anbietern steigt die Bewertung von OpenAIs „GPT-6 Astra“ rasant, weil es nicht einfach nur Bilder und Videos erzeugt, sondern als „Agent, der andere Tools steuert“ wahrgenommen wird. Der frühere Platzhirsch „Sora 2“ steuert dagegen überraschend auf die Einstellung zu: Web/App endeten am 26.04.2026, die API soll diesen Monat, am 24.09.2026, vollständig abgeschaltet werden 😱 Die Open-Source-Seite ist zwar weniger laut, aber extrem spannend: Rund um ComfyUI entstehen für „MiniMax-H3“ und „Qwen-Image-Edit“ beinahe täglich neue Komponenten. Wir sind an einem Punkt angekommen, an dem sich auf Consumer-GPUs – auch von AMD – ernsthaft Videos erzeugen lassen 🛠️✨ Plattformübergreifend fällt außerdem auf: Sobald KI-generierte Inhalte erkannt werden, droht Gegenwind. Forderungen nach Kennzeichnung und Anti-KI-Beiträge dominieren bei den Likes – ziemlich überraschend.
Plattformübergreifend 🌐
- GPT-6 Astra wird nicht als „generative KI“, sondern als „steuernde KI“ bewertet: Sowohl auf X (@Yokohara_h, 2.156 Likes, https://x.com/Yokohara_h/status/2096622171011666003) als auch auf YouTube (まさおAI じっくり解説ch, https://www.youtube.com/watch?v=_pAAaBv_G7A) wird intensiv darüber gesprochen, wie ComputerUse andere Anwendungen wie Blender bedienen und 3D-CG-Pipelines automatisieren kann. Dass die Tonlage auf beiden Plattformen vollständig übereinstimmt, ist wirklich bemerkenswert 🔥
- Der Anfang vom Ende für Sora 2: Auf YouTube (https://www.youtube.com/watch?v=DSfAZdE5rWA) wird das API-Ende am 24.09.2026 erklärt – also in drei Wochen. Auf Bluesky (https://bsky.app/profile/coah80.com/post/3muulvyomz72c) fand sich zudem ein vernichtender Beitrag: „SORA 2 WAS GENUINELY SO BAD“. Verteidigende Stimmen waren praktisch nirgends zu finden 😢
- Das ComfyUI-/MiniMax-H3-Ökosystem ist das wichtigste Open-Source-Schlachtfeld: In Lemmys !«メールアドレス» (u. a. https://lemmy.dbzer0.com/post/75036488) erscheinen täglich drei bis neun neue Nodes und LoRAs. Reddit (VPIPE auf Apple Silicon M5 Pro: 1024 px, 8 Schritte in etwa 45 Sekunden, https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/) und Bluesky („local software like ComfyUI has more features“, https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t) bestätigen denselben Trend.
- Die Stimmung „KI-generiert = wird kritisiert“ erzeugt das meiste Engagement: Der Reddit-Thread in r/antiai über gefälschte Zeitraffer (6.792 Punkte, 994 Kommentare, https://www.reddit.com/r/antiai/comments/1w81kdd/) und die beiden Bluesky-Beiträge mit den meisten Likes (KI-Kritik mit 121 bzw. 100 Likes, https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b) zeigen deutlich: Kritische Beiträge nach dem Muster „Ist das nicht problematisch?“ gehen wesentlich häufiger viral als Tool-Vorstellungen.
Plattform für Plattform 📱
Reddit: Lokale Benchmark-Beiträge aus r/StableDiffusion und kostenlose Tool-Listen in r/freetoolsAI (Deepany, Aifun, Perchance usw.) liefern starke, Open-Source-nahe Praxisinformationen. Gleichzeitig wurde in r/aiwars die Qualität kommerzieller Closed-Source-KI-Bilder für Lebensmittelwerbung kritisiert (177 Kommentare, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Da nur ein Suchbegriff verwendet wurde, kamen lediglich 12 Threads statt der angestrebten 20 zusammen.
X: Es wurden 40 Beiträge gesammelt, aber nur vier bezogen sich tatsächlich auf das Thema 😅 Der Rest bestand aus Fußball-, Politik- und Kroatien-Trend-Rauschen. Alle vier relevanten Beiträge lobten GPT-6 Astra ausdrücklich; Open Source wurde kein einziges Mal erwähnt. Closed Source dominierte vollständig.
YouTube: Die informationsreichste Plattform. Auf Closed-Source-Seite dominierten das Ende von Sora2, GPT-6 Astra, das Midjourney-V7-Update mit japanischer Spracheingabe (https://www.youtube.com/watch?v=wFHlG7wcRUQ) und Google Nano Banana 2 (https://www.youtube.com/watch?v=nikIxHM_AQY). Bei Open Source standen Flux.2 (Dev/Klein unter Apache 2.0, https://www.youtube.com/watch?v=ISRy5Skd04U) sowie Qwen-Image-Edit-2511 mit zahlreichen ComfyUI-Tutorials (https://www.youtube.com/watch?v=ScoIZYsoRwo) im Mittelpunkt. Außerdem gab es Tests mit Wan2.2 und Hunyuan1.5 auf AMD-Consumer-GPUs (https://www.youtube.com/watch?v=a_xzC7ckwno).
Bluesky: Zweipolig zwischen individuellen Tool-Nutzern und Anti-KI-Stimmen. Bei Closed Source war ein Workflow aus Nano Banana (Gemini 3.1) und Kling 3.0 beliebt (https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k), während die Ankündigung eines neuen Grok-Imagine-Modells von xAI bei null Likes landete. Open Source erhielt positive Stimmen zu ComfyUI und Stable Diffusion WebUI reForge auf AMD ROCm. Wegen API-Limits mit wiederholten 403-Fehlern konnten statt 20 nur effektiv 11 Beiträge ausgewertet werden.
Lemmy: Die Open-Source-Seite hatte mit Abstand die stärkste Dynamik. Allein in !«メールアドレス» erschienen 11 Tool-Beiträge, etwa zu Viggle-Animate oder nativen ComfyUI-Integrationen für Trellis.2 und Pixal3D. Bei Closed Source war die einzige zusammenhängende Nachricht, dass Midjourney vom Bildgenerierungsgeschäft auf medizinische Ultraschallscans umschwenkt (maximaler Score 73, https://techcrunch.com/2026/07/04/midjourney-wants-hollywood); sie wurde in mehreren Instanzen weiterverbreitet. Dass sich auf Lemmy kein einziger Beitrag zu Sora oder Veo selbst fand, war eine aufschlussreiche Beobachtung.
Pinterest: Alle 50 vorab gesammelten Pins wurden geprüft. Fast vollständig dominierten Ranking-Infografiken zu kommerziellen Closed-Source-Tools wie Veo, Sora, Runway, Kling, Pika und Adobe Firefly. Hinweise auf Open Source waren praktisch nicht vorhanden; „Amuse 3.0“, das lokale Ausführung bewirbt, war die seltene Ausnahme. Auffällig war auch, dass Deepfake-Sorgen und Erkennungsinhalte zu einem eigenen Genre geworden sind.
Worauf man achten sollte 👀
- Ende der Sora-2-API am 24.09.2026 — Entscheidend wird sein, wohin Sora-2-Nutzer migrieren. YouTube „AI収益化ラボ“ https://www.youtube.com/watch?v=YHPmaUb_X6c
- ComputerUse und Automatisierung von 3D-CG-Pipelines mit GPT-6 Astra — Die Entwicklung zum Produktionshub statt zu einer bloßen generativen KI. X https://x.com/Yokohara_h/status/2096622171011666003
- Das Wachstumstempo des MiniMax-H3-Ökosystems — Mit Viggle-Animate, H3-World und weiteren Komponenten erscheint täglich Neues. Lemmy https://lemmy.dbzer0.com/post/75036488
- Die Debatte über Authentizitätskennzeichnungen für KI-Inhalte — Ob Vorwürfe gefälschter Zeitraffer zu regulatorischem Druck führen. Reddit https://www.reddit.com/r/antiai/comments/1w81kdd/
- Midjourneys geschäftliche Neuausrichtung von Bildgenerierung zu Medizintechnik — Möglicherweise ein Vorzeichen veränderter Geschäftsmodelle bei Closed-Source-Anbietern. Lemmy https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
- Die Verbreitung von Qwen-Image-Edit in Kombination mit ComfyUI — Wie sich die Einschätzung verbreitet, es könne mit Closed-Source-Bildbearbeitung mithalten. YouTube https://www.youtube.com/watch?v=WOcxMUwKWIk
Empfehlungen 💡
- Wenn ein Workflow von Sora2 abhängt, sollte vor dem API-Ende am 24.09.2026 unverzüglich ein Migrationsplan zu Kling 3.0 oder Veo 3.1 erstellt werden.
- Die ComputerUse-Funktionen von GPT-6 Astra sollten nicht nur als einzelne generative KI, sondern als Werkzeug zur Automatisierung der Produktionspipeline verfolgt werden.
- Wer Kosten senken möchte, sollte erst lokale Bildbearbeitung mit Qwen-Image-Edit + ComfyUI ausprobieren und danach über kostenpflichtige Closed-Source-Angebote entscheiden.
- Um Risiken durch gefälschte Zeitraffer oder KI-Bearbeitungen vorzubeugen, sollten interne Regeln zur Offenlegung von KI-Nutzung in veröffentlichten Inhalten vorab festgelegt werden.
- Der aufgabenteilige Workflow Nano Banana für Standbilder + Kling 3.0 für die Videoerstellung wurde von mehreren unabhängigen Kreativen positiv bewertet und ist einen Test wert.
- Die Nachricht über Midjourneys Kurswechsel sollte weiter beobachtet werden, um zu erkennen, ob andere Closed-Source-Unternehmen ähnliche Diversifizierungen vornehmen.
Datenqualität 📊
Keine der Plattformen erreichte ganz die Abschlusskriterien aus brief.md – ungefähr 20 analysierte Beiträge pro sozialem Netzwerk 😅 Besonders bei X waren von 40 gesammelten Beiträgen nur vier relevant, weil die Suchbegriffe aus regionalen kroatischen Trends stammten und voller Fußball- und Politikrauschen waren. Auf Bluesky führte die 403-Rate-Limitierung der öffentlichen API dazu, dass fast die Hälfte der getesteten Suchbegriffe keine Resultate brachte; effektiv blieben 11 Beiträge. Reddit blieb wegen nur eines Suchbegriffs bei 12 Threads. Lemmy kam mit 11 Open-Source- und vier Closed-Source-Beiträgen auf 15, weil es dort gar keine spezialisierte News-Community gibt. YouTube wurde mit 11 Videos gemäß dem Playbook-Maßstab von fünf bis zwölf Videos als abgeschlossen gewertet, allerdings konnten Metadaten wie Aufrufzahlen wegen JavaScript-Rendering nicht abgerufen werden. Nur bei Pinterest ließen sich alle 50 vorab gesammelten Pins prüfen; durch die einzelne Suchanfrage fanden sich dort aber fast keine Open-Source-Pins. Insgesamt stützen sechs Plattformen unabhängig dieselbe Richtung – GPT-6 Astra, das Ende von Sora2 und das wachsende ComfyUI-Ökosystem. Für das Erfassen der großen Entwicklung ist das daher ausreichend belastbar 🙆
Zusammenfassung nach Plattform
Reddit — Nachrichten zu KI für Bild- und Videogenerierung
Wo
12 Threads aus 11 Subreddits, gesammelt mit dem Suchbegriff „Image and Video Generation AI News“.
| Subreddit | Mitglieder | Anzahl gesammelter Threads |
|---|---|---|
| r/antiai | 316,504 | 1 |
| r/generativeAI | 151,065 | 2 |
| r/freetoolsAI | 7,817 | 1 |
| r/StableDiffusion | 1,001,556 | 1 |
| r/teenagers | 3,675,063 | 1 |
| r/aiwars | 166,920 | 1 |
| r/RemoteWorkers | 74,882 | 1 |
| r/aislop | 82,721 | 1 |
| r/TopAITools4U | 2,396 | 1 |
| r/GoogleFlow | 1,750 | 1 |
| r/EyesWideShut | 15,320 | 1 |
Die Auswahl der Subreddits zeigt ein nahezu ausgeglichenes Verhältnis zwischen spezialisierten Communities für KI-Generierung (r/StableDiffusion, r/generativeAI, r/GoogleFlow, r/TopAITools4U, r/freetoolsAI) und Communities, die KI-Bilder ablehnen oder kritisieren (r/antiai, r/aiwars, r/aislop, r/EyesWideShut, r/teenagers). r/RemoteWorkers erwähnt das Thema im Zusammenhang mit einer Stellenausschreibung.
Stimmen der Menschen
-
Thread #1 r/antiai · 6.792 Punkte · 994 Kommentare · 05.09.2026 — „Warning: There is a new form of ai generated image“. Der Beitrag beschreibt, wie sich mit einem LLM – als GPT-6 bezeichnet – Maus und Tastatur bedienen lassen, um inklusive eines handgezeichnet wirkenden Zeitraffers „echte Illustrationen“ vorzutäuschen. Mit 994 Kommentaren entwickelte sich daraus eine große Diskussion. Top-Kommentar (2.483 Punkte, u/Nayutantantan): „Even though i stopped using social media, stopped being an artist online... now the trends of creating fake timelapses are getting common.“ Die Forderung nach einer sofortigen Kennzeichnungspflicht (u/Soggy_Supermarket100, 170 Punkte) erhielt ebenfalls viel Unterstützung.
-
Thread #5 r/teenagers · 7 Punkte · 41 Kommentare · 31.08.2026 — „To all AI image/video generator users“. Die Kernaussage: „KI setzt nur deine Idee um; tatsächlich zeichnet die KI selbst.“ u/LiterallyGarbage_0 (5 Punkte): „if you want to make art, pick up a pencil and start drawing“. Dem hielt u/TheDarkmoore (2 Punkte) entgegen, dass KI-Kunst für sein Kartenspiel nötig gewesen sei, weil er nicht gut zeichnen könne. Auch innerhalb derselben Generation sind die Ansichten gespalten.
-
Thread #6 r/aiwars · 4 Punkte · 177 Kommentare · 03.09.2026 — „Even a lot of Pros here will admit that current AI models suck at generating appetizing images of food“. Die Diskussion wuchs mit 177 Kommentaren ungewöhnlich stark. u/Your-local-enjoyer (9 Punkte): Echte Fotos lieferten Kunden realistischere Erwartungen. Als Gegenargument präsentierte u/Bassed_Hummble (5 Punkte) einen konkreten Prompt, mit dem lokal in 40 Sekunden mit Krea 2 ein „appetitlicher Frühstücksburrito“ erzeugt worden sei. Damit entstand auch die Sicht, es handle sich eher um ein Prompt- als um ein Modellproblem.
-
Thread #4 r/StableDiffusion · 31 Punkte · 10 Kommentare · 03.09.2026 — „VPIPE: Not Just Video — Local Image Generation Is Fast Too“. Lokaler Test auf Apple Silicon (M5 Pro, 24 GB) mit krea/Krea-2-Turbo-M87 (16 Bit) plus M87 LoRA: 1024 × 1024 in acht Schritten in etwa 45 Sekunden pro Bild; in 8-Bit-Echtzeit etwa 35 Sekunden. u/Glittering-Call8746 (1 Punkt) erwog Vergleiche zwischen M5 Max, M5 Pro und der RTX-5000-Serie.
-
Thread #11 r/GoogleFlow · 12 Punkte · 6 Kommentare · 01.09.2026 — „AutoFlow just got continuous AI video generation“. Die inoffizielle Chrome-Erweiterung „AutoFlow“ für Google Flow/Veo erhielt „Continue from Last Frame“. Das Endbild eines Clips wird automatisch als Startbild des nächsten verwendet, wodurch sich längere Videos leichter erstellen lassen. Als Nächstes ist das nahtlose Rendern mehrerer Clips zu einem Video geplant.
-
Thread #10 r/TopAITools4U · 1 Punkt · 10 Kommentare · 01.09.2026 — „Tested 4 best AI video generators in 2026 for beginners“. Verglichen wurden Sora 2 (filmisch, aber teuer und schwer zugänglich), Kling AI (realistische B-Roll), DomoAI (Animation und Stiltransfer) und Google Veo 3.1 (erzeugt Bild und Ton gleichzeitig, mit kostenlosem Kontingent). In den Kommentaren nannte u/brarkaddy (2 Punkte) auch Qwens kostenlose Videogenerierung als Kandidaten.
-
Thread #3 r/freetoolsAI · 38 Punkte · 45 Kommentare · 04.09.2026 — „Free AI Image Generator“. Als Alternative zu aifreeforever.com, das kostenlos, unbegrenzt und ohne Anmeldung sein soll, listete u/Odd-Lingonberry1516 (3 Punkte) Deepany (z-image turbo/illustrious), Aifun (wai illustrious, auch zwei kostenlose Videos täglich) und Perchance (Stable-Diffusion-/Flux-basiert). u/Relevant_Syllabub895 (2 Punkte) kritisierte NSFW-Beschränkungen.
-
Thread #2 r/generativeAI · 43 Punkte · 29 Kommentare · 31.08.2026 — „List of daily AI video generative websites“. u/Jenna_AI (4 Punkte, KI-Bot) nannte für Kling AI ein konkretes Gratis-Kontingent: alle 24 Stunden 66 Credits, entsprechend zwei bis sechs fünfsekündigen Videos pro Tag. u/Julia_Leeds94 (2 Punkte) führte YalleryLabs mit 0,18 US-Dollar für ein fünfsekündiges 720p-Video bei einem Budget von drei US-Dollar an.
-
Thread #12 r/EyesWideShut · 35 Punkte · 9 Kommentare · 06.09.2026 — „AI generated images shouldn't be allowed here“. Anlass war ein KI-bearbeiteter Screenshot aus einem Kubrick-Film. Der Beitrag bezeichnete dies als Verbreitung von Fehlinformationen. Die Person hinter der Bearbeitung, u/ffcc01 (2 Punkte), entgegnete, sie habe nur zwei Fotos überlagert und den Inhalt nicht verändert. Die Community war sich über die Grenzen zulässiger KI-Bearbeitung uneinig.
-
Thread #8 r/RemoteWorkers · 130 Punkte · 623 Kommentare · 04.09.2026 — „Get Paid $30/Hour Reviewing AI-Generated Images“. Stellenausschreibung für die Faktenprüfung KI-generierter Beschriftungen, etwa das Erkennen falsch identifizierter Objekte, Farben oder Texte, für 30 US-Dollar pro Stunde. Zwar waren 623 Kommentare außergewöhnlich viel, doch bestanden die meisten aus wiederholten Ein-Wort-Kommentaren wie „images“, um an den Bewerbungslink zu gelangen. Eine inhaltliche Diskussion entstand kaum.
-
Thread #9 r/aislop · 37 Punkte · 4 Kommentare · 06.09.2026 — „Saw this on a news article, an AI slop image explaining what is AI slop“. Ein KI-Bild in einem Nachrichtenartikel, das erklärte, was „AI Slop“ sei, wurde als selbstreferenzieller Witz aufgegriffen. Bei nur vier Kommentaren blieb es ohne tiefere Diskussion.
Signale
- Aufwärtstrend: Praxisberichte zu lokaler Open-Source-Generierung – insbesondere VPIPE/Krea 2 aus Thread #4 – werden positiv aufgenommen, wenn sie konkrete Benchmarks wie Zeit, Schritte und Hardware enthalten. In r/StableDiffusion zählen Geschwindigkeit und Qualität gleichermaßen.
- Aufwärtstrend: Forderungen nach Authentizitätskennzeichnung für KI-Inhalte (Thread #1) erhielten mit 994 Kommentaren starke Unterstützung. Das Vortäuschen von Zeitraffern wurde als neue, konkrete Sorge benannt.
- Wird geringgeschätzt oder verspottet: Kommerzielle Closed-Source-KI-Bilder, besonders für Lebensmittelwerbung, gelten selbst in r/aiwars als schwer verteidigbar (Thread #6). Die Diskussion mit 177 Kommentaren war fast durchgehend kritisch.
- Überraschend: In vielen Threads kamen die praktisch verwertbaren Informationen vor allem von KI-Bots – u/Jenna_AI erscheint in Thread #2 und #7. Statt tiefer menschlicher Diskussionen stehen Übersichten kostenloser Kontingente im Vordergrund.
- Konflikt: In Thread #12 (EyesWideShut) standen sich die Positionen „KI-Bearbeitung = Veränderung und Fehlinformation“ und „bloße Komposition ohne inhaltliche Veränderung“ direkt gegenüber. Einen klaren Konsens über die Grenze zulässiger KI-Bearbeitung gibt es nicht.
- Überraschend: Thread #8 hatte mit 623 Kommentaren das größte Engagement der Erhebung, doch bestand der Großteil aus Ein-Wort-Posts für den Bewerbungslink. Viele Kommentare bedeuten nicht automatisch eine tiefgehende Diskussion.
Grenzen
- Es wurde nur mit dem Suchbegriff „Image and Video Generation AI News“ gearbeitet. Zusätzliche Suchanfragen wie „open source image generation“, „closed source video AI“ oder nach einzelnen Diensten wie Midjourney, Sora und Kling wurden nicht durchgeführt. Die Daten sind deshalb auf Themen verzerrt, die mit einem sehr allgemeinen Suchbegriff gefunden wurden.
- Gegenüber dem Abschlusskriterium in brief.md von etwa 20 analysierten Threads je Social Network wurden nur 12 Threads gesammelt.
- Thread #7 und #9 hatten mit einem bzw. vier Kommentaren extrem wenig Resonanz; teilweise gab es nur Bot-Antworten von u/Jenna_AI. Material für eine tiefergehende Analyse war daher knapp.
- Der Erhebungszeitraum umfasst nur ungefähr eine Woche, vom 31.08.2026 bis 06.09.2026. Ein Vergleich mit früheren Trends ist nicht möglich.
- Nur wenige Threads lassen sich klar als Closed- oder Open-Source-orientiert einordnen (eher Closed Source: #6, #10, #11; eher Open Source: #3, #4). Für die im Abschlussbericht vorgesehenen jeweils zehn Erkenntnisse wären Daten anderer Plattformen erforderlich.
X
X — Nachrichten zu KI für Bild- und Videogenerierung
Accounts
Von 40 gesammelten Beiträgen aus 37 Accounts bezogen sich nur die folgenden vier tatsächlich auf das Thema Bild- und Videogenerierung durch KI. Alle stammen von individuellen Accounts mit jeweils einem Beitrag – nicht von reichweitenstarken Viral-Accounts, sondern von Menschen, die eigene Erfahrungen mit Tools teilen.
| Account | Name | Beiträge | Likes | Profil |
|---|---|---|---|---|
| @aigeboku | AI様の下僕 | 1 | 1,281 | Individuelle Person, die GPT-6 Astra mit ComputerUse ausprobiert |
| @MiraMusic_AI | MiraMusic | 1 | 525 | Account zu KI-Animeproduktion |
| @manaimovie | Mankyu | 1 | 562 | Individueller Kreativer für 3D-Modelle × KI-Video |
| @Yokohara_h | Hirokazu Yokohara | 1 | 2,156 | Technisch orientierte Einzelperson mit stärkster Reaktion der vier Accounts |
Die übrigen 33 Accounts – angeführt von @kaihavertz29 mit 96.184 Likes sowie persönlichen Accounts zu Fußball, F1, deutscher Politik, Bitcoin und Bosnien – waren thematisch irrelevant. Details siehe „Grenzen“.
Beiträge
-
#29 @aigeboku (05.09.2026 · 1.281 Likes · 135 Reposts · 14 Antworten · etwa 94.000 Views) https://x.com/aigeboku/status/2096187322924687799 — „GPT-6 Astra ist tatsächlich sehr gut darin, andere Dinge zu steuern; mit ComputerUse eröffnet sich enorm viel 😎🙌“. Bewertung von GPT-6 Astra weniger als Bild-/Videomodell denn als Grundlage zur Bedienung anderer Anwendungen.
-
#30 @MiraMusic_AI (06.09.2026 · 525 Likes · 50 Reposts · 6 Antworten · etwa 26.000 Views) https://x.com/MiraMusic_AI/status/2096441679847006358 — „【AIアニメ制作共有①】GPT-6 Astraとblenderで街を作ってみた!15分で作った動画なので分かりにくいですが…“. Ein konkretes Beispiel für die Erstellung von Hintergrundgrafik mit GPT-6 Astra und Blender.
-
#31 @manaimovie (05.09.2026 · 562 Likes · 61 Reposts · 19 Antworten · etwa 35.000 Views) https://x.com/manaimovie/status/2096176821377380677 — „Astra先生にTripoで作ったモデルを渡して、動くようにして言ったらできたものです。まだ気になる点は多いけど、FableやSolのときよりかなりいい!“. Der Account übergab Astra ein mit Tripo erzeugtes Modell und bat darum, es zu animieren. Im Vergleich zu „Fable“ und „Sol“ wurde Astra klar positiv bewertet.
-
#32 @Yokohara_h (06.09.2026 · 2.156 Likes · 299 Reposts · 19 Antworten · etwa 178.000 Views; stärkste Reaktion dieser vier Beiträge) https://x.com/Yokohara_h/status/2096622171011666003 — „Bild übergeben, Stadtlandschaft in Blender automatisch modellieren lassen und das Breakdown automatisch schneiden. Die Qualität ist noch längst nicht gut genug, aber anders als bisher spürt man den Beginn einer Zeit, in der 3D-CG nicht mehr von Hand erstellt wird.“ Trotz noch unzureichender Qualität wird ein möglicher Umbruch hin zu 3D-CG-Produktion ohne direkte Handarbeit gesehen.
Unter den übrigen 36 der insgesamt 40 gesammelten Beiträge gab es keinen weiteren Beitrag zu Bild- oder Videogenerierung durch KI – weder zu Closed noch zu Open Source.
Signale
- Aufwärtstrend: GPT-6 Astra (Closed Source) wird als System wahrgenommen, das „andere Tools steuert“ – etwa mit ComputerUse und Blender-Integration. Kennzeichnend ist die Darstellung als Hub, der ganze 3D-CG-Pipelines automatisiert, nicht als isoliertes Bild- oder Videomodell (#29, #30, #32).
- Überraschend: Alle vier Beiträge bewerten Astra positiv, versehen dies aber zugleich mit Vorbehalten wie „noch roh“ oder „viele Punkte sind noch problematisch“. Überzogene Erwartungen und nüchterne Qualitätsbewertung existieren nebeneinander (#31, #32).
- Wird nicht erwähnt: Open-Source-Tools für Bild- und Videogenerierung wie Stable-Diffusion-Familie, Krea, Kling oder Veo wurden in dieser Sammlung nicht ein einziges Mal angesprochen. Thematisch relevante X-Stimmen konzentrieren sich vollständig auf GPT-6 Astra als Closed-Source-Angebot.
- Als Vergleich genannte Tools: „Fable“ und „Sol“ (#31). Der Beitrag erläutert sie nicht weiter; weitere Recherche wäre nötig.
- Verglichen mit themenfremden Trends wie Fußball (bis zu 96.184 Likes) oder Politik (10.062 Likes) ist das Engagement gering, selbst beim Maximum von 2.156 Likes. Auf X scheint das Thema derzeit nicht breit viral zu sein.
Grenzen
- Der Suchbegriff verfehlte das Thema: Die verwendeten Begriffe (Arsenal, Kimi, Charles, Chelsea, Harvey, Germany, $SONG, Astra, Bitcoin, Bosnia) wurden direkt aus der X-Explore-Trendliste übernommen. Abgesehen von „Astra“ beziehen sie sich auf Fußball, F1, Personen- oder Geburtstagsthemen, deutsche Politik, Kryptowährungen oder Bosnien – nicht auf KI für Bild- und Videogenerierung. Von 40 Beiträgen waren 36 themenfremdes Rauschen; nur vier Beiträge zu „Astra“ lieferten verwertbare Hinweise.
- Abschlusskriterium nicht erreicht: Gegenüber dem Ziel aus brief.md von rund 20 analysierten Beiträgen pro Netzwerk wurden nur vier relevante Beiträge gesammelt.
- Regionale Verzerrung von Explore: In der Spalte „Where“ waren bei „$SONG“ und „Bosnia“ jeweils „Trending in Croatia“ angegeben. Die Explore-Liste war demnach für Kroatien bzw. die Balkanregion lokalisiert und bildet keine weltweiten Trends ab. Auch die Spalte „Posts on X“ blieb vollständig leer, daher lagen keine Zahlen zum Beitragsvolumen vor.
- Keine Open-Source-Bewegung auf X gefunden: Diese Erhebung fand keinen einzigen Beitrag zu Open-Source-KI für Bild- und Videogenerierung. Andere Plattformen wie Reddit müssen diese Lücke schließen.
- Alle vier relevanten Beiträge stammen aus japanischsprachigen Accounts. Reaktionen aus englisch-, chinesisch- oder anderssprachigen Communities wurden nicht erfasst.
YouTube
YouTube — Nachrichten zu KI für Bild- und Videogenerierung
Kanäle
| Kanal | Ausrichtung | Behandelte Inhalte |
|---|---|---|
| AI大学【AI&ChatGPT最新情報】 | Japanisch, Erklärformat | Erläuterungen zu aktuellen KI-Modellen, darunter GPT-6 Astra |
| まさおAI じっくり解説ch | Japanisch, Erklärformat | Praxistests und Reviews von KI-Modellen |
| RKJ VIDEO【イケている動画を作りたいなら】 | Japanisch, spezialisiert auf KI-Video | Vergleiche von Sora, Veo, Kling und ähnlichen Angeboten |
| AI収益化ラボ | Japanisch, Monetarisierung | KI-Tools, Monetarisierung und Auswirkungen von Diensteinstellungen |
| StableDiffusion等 チュートリアル&自作アニメ | Japanisch, ursprünglich Open Source | Eigentlich Stable-Diffusion-Tutorials, inzwischen auch Closed-Source-News wie das Ende von Sora2 |
| AIたろう | Japanisch, Erklärformat | Funktionsbeschreibungen zu Bild-KI wie Midjourney |
| Teacher's Tech | Englisch, Erklärformat | Reviews zu Googles Tools und KI-Funktionen, mittelgroßer Tech-Kanal |
| OpenArt | Englisch, eher offiziell | Vorstellung von Modellen wie Flux.2 als bereitstellende Oberfläche |
| Donato Capitella | Englisch, technisch | Tests von Open-Source-Bild- und Videogenerierung auf lokaler GPU, auch AMD |
| ErrorFixer | Englisch, Tutorial | Tutorials zum Betrieb von Open-Source-Modellen in ComfyUI |
| AI Search | Englisch, Reviews | Kurzreviews neuer KI-Tools für Bild- und Videogenerierung |
Die Abonnentenzahlen liegen in JavaScript-gerenderten Teilen der Videoseiten und konnten weder über youtube.com/watch noch über youtube.com/results mit WebFetch abgerufen werden. Hier sind daher nur Informationen enthalten, die sich über Such-Snippets und oEmbed – eine schlanke API, die nur Titel und Kanalnamen liefert – bestätigen ließen.
Videos
-
„OpenAIの最新AIモデル『GPT-6 Astra』徹底解説!ほぼ全てのベンチマークでClaude Fable 5.1超え、史上最も賢く安全“ — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=jtavLwXCZeQ — Behauptet, GPT-6 Astra (veröffentlicht am 03.09.2026) übertreffe Claude Fable 5.1 in fast allen Benchmarks und sei das bislang intelligenteste und sicherste Modell. Betont eher universelle Agentenfähigkeiten wie Browsersteuerung und Codeerstellung als Bild- und Videogenerierung.
-
„【現環境最強】『GPT-6 Astra』を実際に使ってきた結果、最もAGIに近いモデルと感じたので解説“ — まさおAI じっくり解説ch — https://www.youtube.com/watch?v=_pAAaBv_G7A — Nach praktischem Einsatz als aktuell AGI-nächstes Modell bewertet. Der Schwerpunkt liegt auf der Fähigkeit von ComputerUse, andere Anwendungen zu bedienen. Die Tonlage entspricht der GPT-6-Astra-Bewertung auf X.
-
„VEO 3.1とSORA2どっちがすごい?最新比較!“ — RKJ VIDEO【イケている動画を作りたいなら】 — https://www.youtube.com/watch?v=JuGPYl0V9UA — Vergleich von Veo 3.1 (veröffentlicht am 15.10.2025) und Sora 2 hinsichtlich Funktionen und Bildqualität. Das Video stammt wahrscheinlich aus der Zeit direkt nach dem Sora-2-Launch und liegt damit außerhalb des 60-Tage-Fensters, wurde aber als Kontext für die späteren Berichte zur Einstellung von Sora2 aufgenommen.
-
„Sora2完全終了…なぜ突然消えたのか?公式情報で徹底解説“ — StableDiffusion等 チュートリアル&自作アニメ — https://www.youtube.com/watch?v=DSfAZdE5rWA — Erklärt anhand offizieller Informationen, dass Sora 2 im Web und in der App am 26.04.2026 endete und die API am 24.09.2026 – drei Wochen nach Erstellungsdatum dieses Berichts – folgen soll. Als mögliche Erklärung wird die Freigabe von Rechenressourcen für AGI-Entwicklung vorgestellt.
-
„【サービス終了】世界一の動画生成AI『Sora2』が使えなくなったので解説します“ — AI収益化ラボ — https://www.youtube.com/watch?v=YHPmaUb_X6c — Erläutert die Folgen des Sora2-Endes für Kreative, die ihre Inhalte monetarisiert haben. Erwähnt Datenexport über sora.chatgpt.com/sunset und die Notwendigkeit, auf APIs wie Kling oder Runway umzusteigen.
-
„Midjourney がV7にアップデート!使い方から新機能まで完全解説します!日本語音声入力も可能に。“ — AIたろう — https://www.youtube.com/watch?v=wFHlG7wcRUQ — Erklärt neue Funktionen von Midjourney V7, darunter Videogenerierung, Konversationsmodus und japanische Spracheingabe. Zeigt, wie ein etablierter Bildgenerator Text-zu-Video-Funktionen integriert.
-
„The New Gemini Image Generator is Insane (Nano Banana 2)“ — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Testet Googles Gemini-Bildgenerator „Nano Banana 2“ und bewertet ihn als großen Fortschritt gegenüber der vorherigen Generation. Das verdeutlicht, dass sich der Closed-Source-Wettbewerb von Midjourney/Ideogram auch auf Google Gemini ausweitet.
-
„FLUX.2 Has Landed On OpenArt!“ — OpenArt — https://www.youtube.com/watch?v=ISRy5Skd04U — Stellt vor, dass die Flux.2-Familie von Black Forest Labs (Pro/Flex/Dev/Klein, angekündigt am 25.11.2025) auf OpenArt verfügbar ist. Betont, dass Dev/Klein als Open Weights unter Apache 2.0 stehen und zehn Referenzbilder sowie 4-MP-Bearbeitung unterstützen.
-
„Video and Image Generation on AMD R9700 AI PRO (Qwen Image, Wan 2.2, Hunyuan 1.5)“ — Donato Capitella — https://www.youtube.com/watch?v=a_xzC7ckwno — Testet drei Open-Source-Modelle – Qwen Image, Wan 2.2 und Hunyuan 1.5 – gemeinsam auf einer AMD-Consumer-GPU, der R9700 AI PRO. Das zeigt, dass Open-Source-Bild- und Videogenerierung zunehmend nicht mehr nur von High-End-NVIDIA-Hardware abhängt.
-
„Edit Any Image with Text in ComfyUI — Qwen Image Edit 2511 (Free Local Tutorial 2026)“ — ErrorFixer — https://www.youtube.com/watch?v=ScoIZYsoRwo — Tutorial zum lokalen Betrieb des Open-Weight-Bildbearbeitungsmodells Qwen-Image-Edit-2511 von Alibaba (veröffentlicht am 26.12.2025) in ComfyUI. Demonstriert Bildbearbeitung und Multi-Angle-Erzeugung allein anhand von Textanweisungen.
-
„This new AI image editor is a BEAST. Qwen Image Edit tutorial“ — AI Search — https://www.youtube.com/watch?v=WOcxMUwKWIk — Testet ebenfalls Qwen-Image-Edit mit 20 Milliarden Parametern und nativer ControlNet-Unterstützung und bewertet die Leistung als konkurrenzfähig zu Closed-Source-Bildbearbeitungstools.
Signale
- Das größte Closed-Source-Thema ist GPT-6 Astra (Veröffentlichung 03.09.2026): Es wird nicht als eigenständiges Bild- oder Videomodell vorgestellt, sondern als universeller Agent, der Browser und Anwendungen bedienen und Aufgaben der Videobearbeitung ausführen kann. Das deckt sich mit der auf X beobachteten Wahrnehmung von GPT-6 Astra als Produktionshub mit Blender-Integration – dieselbe Erzählung erscheint plattformübergreifend.
- Das Ende von Sora 2 ist die größte Nachricht der Closed-Source-Videogenerierung: Web/App endeten am 26.04.2026, die API soll am 24.09.2026 – in drei Wochen – enden. Mehrere Kanäle behandeln vor allem die Fragen, warum Sora2 verschwand und wohin Nutzer wechseln sollen. Auf YouTube steht nicht mehr die Funktionserweiterung von Sora2, sondern die Zeit danach im Mittelpunkt.
- Kling konkurriert um Sora2s Nachfolgeposition: Kling 2.6 (03.12.2025, mit Audiosynchronisierung) entwickelte sich rasch zu Kling 3.0 (04.02.2026, 4K60fps und Multi-Shot) weiter und wird nach dem Ende von Sora2 ausdrücklich als Wechseloption genannt.
- Bei der Open-Source-Bildbearbeitung ist Qwen-Image-Edit derzeit der Hauptakteur: ComfyUI-Tutorials erscheinen häufig, mehrere Kanäle machen daraus Serien. Gegenüber neuen Tutorials nur zu Stable Diffusion ist die Präsenz deutlich größer. Treffer zu Stable Diffusion beschränken sich meist auf Standardanleitungen wie Installation und Modelllisten; der Neuigkeitswert neuer Modelle ist geringer.
- Open-Source-Videogenerierung ordnet sich zunehmend in drei Linien: Wan 2.2 (Alibaba, Apache 2.0), HunyuanVideo 1.5 (Tencent) und LTX-2 (Lightricks, 06.01.2026; erstes offenes Modell mit gleichzeitiger Audio- und Videogenerierung, 4K/50fps). Während der Recherche wurden mehrere Seiten gefunden, die angebliche Open Weights von „Wan 2.7“ bewarben; da sie weder im offiziellen HuggingFace noch im GitHub von Wan-AI vorhanden sind, wurden sie als SEO-getriebene Falschinformationen eingestuft. Die neuesten offiziellen Open Weights sind Wan 2.2.
- Kanäle überschreiten ihre bisherigen Grenzen: Der ursprünglich auf Stable Diffusion fokussierte Kanal „StableDiffusion等 チュートリアル&自作アニメ“ behandelt inzwischen auch Closed-Source-Nachrichten zum Ende von Sora2. Das deutet darauf hin, dass die Zuschauerschaft sich zunehmend für beide Seiten interessiert.
Grenzen
youtube.com/resultsundyoutube.com/watchwerden clientseitig per JavaScript gerendert. WebFetch lieferte nur Footer-Navigation, nicht direkt Titel, Kanalnamen, Aufrufzahlen oder Veröffentlichungsdaten. Die Videoentdeckung stützt sich deshalb auf WebSearch-Snippets und die YouTube-oEmbed-API, die nur Titel und Kanalnamen zurückgibt.- Aufgrund dieser Beschränkung konnten genaue Aufrufzahlen und Veröffentlichungsdaten der einzelnen Videos überwiegend nicht abgerufen werden. Um Erfindungen zu vermeiden, enthält der Bericht keine Aufrufzahlen. Veröffentlichungsdaten sind nur dort genannt, wo sie aus Such-Snippets oder öffentlichen Modell-Releasetagen abgeleitet werden konnten.
- Die Playbook-Vorgabe, Uploads der letzten 60 Tage zu bevorzugen, ließ sich nicht strikt anwenden. Das VEO-3.1-vs.-SORA2-Video dürfte beispielsweise aus der Zeit direkt nach dem Sora-2-Launch im Oktober 2025 stammen und damit außerhalb des Fensters liegen; es wurde nur als Kontext für die Sora2-Einstellung aufgenommen.
- Das Abschlusskriterium aus brief.md von ungefähr 20 Beiträgen je Social Network unterscheidet sich formal von YouTubes Playbook-Maßstab von fünf bis zwölf Videos. Diese Plattform wurde nach dem Playbook-Kriterium mit 11 Videos als abgeschlossen gewertet.
- Die Kommentarbereiche konnten nur im Umfang von WebSearch-Snippets geprüft werden. Eine detaillierte Lektüre der Top-Kommentare oder Stimmungsanalyse war nicht möglich.
- Chinesischsprachige Kanäle wurden nicht durchsucht. Qwen (Alibaba) und Kling (Kuaishou) stammen beide aus China; Reaktionen chinesischsprachiger Communities fehlen daher.
Bluesky
Bluesky — Nachrichten zu KI für Bild- und Videogenerierung
Accounts
Über die Bluesky-API (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts) wurde nach „Stable Diffusion“, „Sora 2“, „Midjourney“, „Grok Imagine“, „ComfyUI“, „Veo 3“ und „Nano Banana“ gesucht. Aus den Treffern wurden Accounts ausgewählt, die tatsächlich über KI für Bild- und Videogenerierung sprachen.
| Account | Profil | Bezug zum Thema |
|---|---|---|
| @xai-bot.bsky.social | Offizieller xAI-Bot | Meldet Informationen zu Grok Imagine, Closed Source |
| @codename.cc | Bot zur App-Update-Verfolgung | Meldet Updates der Imagine-Funktion in der Grok-iOS-App |
| @drewkav.bsky.social | Individueller Künstler | Teilt Produktionen mit Gemini 3.1 Nano Banana 2 und Kling 3.0 |
| @triflingtree.bsky.social | Individueller Künstler | Veröffentlicht Werke mit Nano Banana Pro |
| @gentile-of-hope.bsky.social(希望の異邦人) | Einzelperson, KI-kritisch | Ethische und ökologische Kritik an Bild-KI wie Stable Diffusion, ChatGPT und Gemini |
| @samperson.bsky.social | Einzelperson aus der Künstlerseite | Verbreitet Unterstützung für Procreates Anti-GenAI-Haltung |
| @ecutruin.bsky.social | Lokaler KI-Anwender | Spricht über funktionale Vorteile lokaler Tools wie ComfyUI |
| @digitalhowl.bsky.social(Fenris) | Individueller Videoproduzent | Teilt professionelle Videoproduktion mit ComfyUI + Minimax H3 |
| @kerzefasta.bsky.social | Fanart-Illustrator | Veröffentlicht fortlaufend Kantai-Collection-Illustrationen mit Stable Diffusion WebUI reForge und ROCm auf AMD |
| @aichina.news | Automatischer Posting-Bot | Postet massenhaft einzelne FLUX-basierte LoRAs unter Apache-2.0, praktisch ohne Engagement |
Insgesamt stammen die Beiträge auf Bluesky nicht von Nachrichtenanbietern, sondern von zwei Polen: individuellen Tool-Nutzern und KI-kritischen Stimmen. Spezialisierte News-Accounts oder Subcommunities wie auf X oder Reddit waren nicht erkennbar.
Beiträge
-
@xai-bot.bsky.social (05.09.2026 · 0 Likes) https://bsky.app/profile/xai-bot.bsky.social/post/3mus2woiczo2w — „Grok Imagine Video 1.5 agent is now available. Powered by our newest Image 2.0 model...“. Ankündigung eines neuen Grok-Imagine-Videoagenten durch einen offiziellen xAI-Account, jedoch ohne sichtbare Likes oder Reposts.
-
@codename.cc (06.09.2026 · 0 Likes) https://bsky.app/profile/codename.cc/post/3muspbmaiq22n — „SHIPPED: Grok iOS updated to 1.4.33 with improvements to Chat, Voice and Imagine features.“ Änderungsprotokoll eines individuellen App-Tracking-Accounts.
-
@drewkav.bsky.social (06.09.2026 · 9 Likes) https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k — In einem Werk mit dem Titel „Persistent Dream“ wird ausdrücklich angegeben, dass das Standbild mit Gemini 3.1 Nano Banana 2 und die Videoerstellung mit Kling 3.0 erfolgte. Ein konkretes Beispiel für einen Closed-Source-Workflow aus Google und Kling.
-
@triflingtree.bsky.social (06.09.2026 · 15 Likes · 1 Repost) https://bsky.app/profile/triflingtree.bsky.social/post/3mutz2tm3bc2m — Beitrag zu einer byzantinisch wirkenden „Mutter-und-Kind-Ikone eines Außerirdischen“, erstellt mit Nano Banana Pro. Von den Nano-Banana-Beiträgen dieser Sammlung erhielt er die meisten Likes.
-
coah80.com (06.09.2026 · 0 Likes) https://bsky.app/profile/coah80.com/post/3muulvyomz72c — „SORA 2 WAS GENUINELY SO BAD HOWD WE CALL THIS GOOD“. Vernichtende Kritik an Sora 2; sie passt zu den auf YouTube festgestellten Informationen über das Ende von Web/App am 26.04.2026 und der API am 24.09.2026.
-
@gentile-of-hope.bsky.social (05.09.2026 · 100 Likes · 42 Reposts) https://bsky.app/profile/gentile-of-hope.bsky.social/post/3murgar5zys2j — „Nicht nur Stable Diffusion: Bildgenerierungsfunktionen von ChatGPT und Gemini beruhen auf unethischer, großangelegter Datenaneignung. (…) Die Bildgenerierung verbraucht enorme Mengen Strom und Wasser und zerstört die Umwelt.“ Der Beitrag erzielte die meisten Likes innerhalb der Suchergebnisse und zeigt, dass Kritik an generativer KI – unabhängig von Open oder Closed Source – das stärkste Engagement auslöst.
-
@samperson.bsky.social (05.09.2026 · 121 Likes · 11 Reposts) https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b — Verbreitet Unterstützung für die Anti-GenAI-Position der Illustrations-App Procreate. Höchste Like-Zahl der gesamten Sammlung.
-
@ecutruin.bsky.social (06.09.2026 · 1 Like) https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t — „local software like ComfyUI has more features than the majority of hosted solutions“. Positive Bewertung lokaler Open-Source-Umgebungen gegenüber gehosteten Angeboten.
-
@digitalhowl.bsky.social (06.09.2026 · 0 Likes) https://bsky.app/profile/digitalhowl.bsky.social/post/3muuu24tqf22g — Berichtet, ComfyUI zusammen mit Minimax H3 für „professional grade video work“ einzusetzen. Beispiel für einen hybriden Ansatz aus Open-Source-Grundlage und kommerziellem Modell.
-
@kerzefasta.bsky.social (05.–06.09.2026 · mehrere Beiträge, maximal 29 Likes · 10 Reposts) https://bsky.app/profile/kerzefasta.bsky.social/post/3muroxdlm4k2j — Kontinuierliche Kantai-Collection-Illustrationen mit Stable Diffusion WebUI reForge und ROCm auf AMD-GPUs. Kein Nachrichtenbeitrag, aber der Account mit dem kontinuierlich höchsten Engagement bei der Suche nach „Stable Diffusion“.
-
@aichina.news (06.09.2026 · 0 Likes, mehr als 20 ähnliche Beiträge pro Stunde) https://bsky.app/profile/aichina.news/post/3muup3wwiad2i — „Apache-2.0 LoRA for Flux, small enough to drop into ComfyUI or Diffusers“. Ein Bot, der FLUX-LoRAs für Huawei Ascend/Modelers.cn in hoher Frequenz automatisiert veröffentlicht, ohne Trigger-Wörter oder Beispiele. Er erhöht zwar die Menge an Open-Source-Suchergebnissen, erzeugt aber keine echte Diskussion.
Signale
- Closed Source: Nano Banana (Gemini 3.1 bzw. Nano Banana Pro) wird von individuellen Kreativen besonders häufig genannt. Mehrere Beiträge zeigen einen geteilten Workflow: Nano Banana für Standbilder, Kling 3.0 für die Videoerstellung.
- Closed Source: Das neue Grok-Imagine-Modell (Video 1.5 / Image 2.0) wurde über einen offiziellen Account angekündigt, erhielt im untersuchten Bereich aber weder Likes noch Reposts. Pressemitteilungsartige Ankündigungen gehen auf Bluesky unter.
- Closed Source: Sora 2 wurde ausschließlich negativ erwähnt – „SORA 2 WAS GENUINELY SO BAD“. Verteidigende Beiträge wurden nicht gefunden. Das entspricht dem auf YouTube beobachteten Muster der Diensteinstellung.
- Open Source: Nutzer, die ComfyUI tatsächlich einsetzen, bewerten lokale Systeme positiv und sagen konkret, sie böten mehr Funktionen als gehostete Lösungen.
- Open Source / Rauschen: Der Großteil der Suchtreffer zu „Stable Diffusion“, „Flux“ und ähnlichen Open-Source-Begriffen bestand aus (1) Fanart etwa zu Kantai Collection, (2) Posts mit externen NSFW-Links und (3) Bot-Ankündigungen reaktionsloser LoRAs wie von @aichina.news. Nachrichtenrelevante Diskussionen waren selten.
- Die stärkste Engagement-Achse ist KI-Kritik: Die beiden Beiträge mit den meisten Likes (121 und 100) waren beide Kritik oder Ablehnung generativer KI, unabhängig davon, ob Bild oder Video. Tool-Nutzungsbeiträge erreichten höchstens 15 Likes. Die Bluesky-Nutzerschaft scheint Anti-KI-Stimmen stärker hervorzubringen als X oder Reddit.
Grenzen
- API-Beschränkungen: Der Endpunkt von
public.api.bsky.appantwortete auf alle Anfragen mit 403 und war nicht nutzbar. Die Alternativeapi.bsky.appfunktionierte, gab bei mehreren neuen Abfragen in kurzer Zeit aber häufig 403 wegen Rate-Limits zurück. Für fast die Hälfte der ausprobierten Suchbegriffe – etwa „Kling AI“, „Wan2.2“, „HunyuanVideo“, „Qwen Image“, „Krea“ und „Sora shutdown“ – konnten nie Daten abgerufen werden. - Weboberfläche nicht abrufbar:
bsky.app/searchist eine JavaScript-gerenderte SPA. WebFetch lieferte nur Metatitel, keine Beitragstexte. Die Informationen stammen daher praktisch ausschließlich aus API-Suchergebnissen. - Zu wenige Beiträge: Statt der Zielgröße von etwa 20 Beiträgen konnten nur ungefähr 11 inhaltlich geprüft werden. API-Treffer enthielten viel irrelevantes Rauschen, etwa den Kingdom-Hearts-Charakternamen Sora oder Trend-Hashtag-Aggregatorbots; die Zahl tatsächlich thematischer Beiträge war noch geringer.
- Einschränkung der Engagement-Werte: Die öffentliche Bluesky-API liefert Likes, Reposts und Antworten, aber – anders als die X-Erhebung – keine Views bzw. Impressionen. Die tatsächliche Reichweite bleibt unbekannt.
- Abruf einzelner Beitragsdetails fehlgeschlagen: Beim Versuch, den vollständigen Text des Beitrags von samperson.bsky.social über
app.bsky.feed.getPostThreadabzurufen, trat ein 400-Fehler auf. Es konnte daher nur das Such-Snippet geprüft werden. - Verzerrung durch einzelne Accounts: Treffer konzentrieren sich auf wenige Accounts, insbesondere @kerzefasta.bsky.social für Kantai-Collection-Fanart und @aichina.news für automatisierte LoRA-Ankündigungen. Sie repräsentieren keine breite Nutzerschaft.
Lemmy
Lemmy — Aktuelle Entwicklungen bei KI für Bild- und Videogenerierung
Communities
- !«メールアドレス» — 5,708 Abonnenten, 1,386 Beiträge. Die faktische Hauptanlaufstelle für Open-Source-Bild- und Videogenerierung, inklusive Modellen, ComfyUI-Nodes und LoRAs. Fast täglich erscheinen neue Tools und Modelle. https://lemmy.dbzer0.com/c/stable_diffusion
- !«メールアドレス» — 2,361 Abonnenten, 3,500 Beiträge. Ort für Werke, die mit Stable Diffusion oder Open-Weight-Modellen erstellt wurden; eher Galerie als Nachrichtenquelle. https://lemmy.dbzer0.com/c/stable_diffusion_art
- !«メールアドレス» — 4.82K Abonnenten (lokal auf lemmy.world etwa 1.8K). Behandelt freie/Open-Source-KI allgemein; Beiträge speziell zu Bild- und Videogenerierung sind selten. https://lemmy.world/c/fosai
- !«メールアドレス», !«メールアドレス», !«メールアドレス» — Hier erscheinen Nachrichten zu Closed-Source-KI-Unternehmen wie Midjourney. Es sind keine spezialisierten Communities für Bildgenerierungs-KI, sondern allgemeine Tech- bzw. News-Communities.
Beiträge
Open-Source-nah (vor allem !«メールアドレス»)
- MiniMax-H3_Singularity — Fine-Tune-Fusionsmodell für das Videogenerierungsmodell MiniMax-H3. Score 3, 06.09.2026. https://lemmy.dbzer0.com/post/75088455 (Original: https://huggingface.co/WarmBloodAban/Minimax-h3_Singularity)
- Qwen3.8-Flash-Next-NVFP4 — NVFP4-quantisierte Qwen-Version von NVIDIA. Score 3, 06.09.2026. https://lemmy.dbzer0.com/post/75088454 (https://huggingface.co/nvidia/Qwen3.8-Flash-Next-NVFP4)
- ComfyUI-AetherScale — Neue Erweiterung für ComfyUI. Score 5, 05.09.2026. https://lemmy.dbzer0.com/post/75036491 (https://github.com/vizart-vj/ComfyUI-AetherScale)
- Viggle-Animate — Modell für Videobearbeitung, das Figuren anhand eines neu gemalten Einzelbilds im Video ersetzt. Score 9, höchster Score dieses Threads, 05.09.2026. https://lemmy.dbzer0.com/post/75036488 (https://huggingface.co/Viggle/Viggle-Animate)
- FastH3-Ref2V-Stream-Controller — ComfyUI-Controller für kontinuierliche Videogenerierung. Score 2, 04.09.2026. https://lemmy.dbzer0.com/post/74988027 (https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller)
- ComfyUI-Majoor-OmniCam — Werkzeug für Kameralayouts und Animation in ComfyUI. Score 4, 04.09.2026. https://lemmy.dbzer0.com/post/74988020 (https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam)
- H3-World — Vorgestellt als „erstes interaktives Weltmodell auf Basis von MiniMax-H3“. Score 3, 02.09.2026. https://lemmy.dbzer0.com/post/74893520 (https://huggingface.co/DANNY621/H3-World)
- ComfyUI-MiniMaxH3-CLSS — Node, der Videogenerierung beliebiger Länge mit Ton auf 16 GB VRAM ermöglichen soll. Score 0, 01.09.2026. https://lemmy.dbzer0.com/post/74843957 (https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS)
- Trellis.2 and Pixal3D Now Native in ComfyUI — Die 3D-Generierungsmodelle Trellis.2 und Pixal3D sind nativ in ComfyUI integriert. Score 4, 01.09.2026. https://lemmy.dbzer0.com/post/74843948 (https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native)
- ComfyUI-DLSS5-NR — Experimenteller ComfyUI-Support für neuronales Rendering mit NVIDIA DLSS 5. Score 2, 01.09.2026. https://lemmy.dbzer0.com/post/74843949 (https://github.com/lisitskyaa/ComfyUI-DLSS5-NR)
- LLaDA-Image — Forschungsarbeit zur Bildgenerierung mit Diffusionsmodellen auf arXiv. Score 3, 04.09.2026. https://lemmy.dbzer0.com/post/74988021 (https://arxiv.org/abs/2609.03796)
Closed-Source-nah
- Midjourney pivots from AI image generation to body scanning medical spa — Berichtet, dass Midjourney vom KI-Bildgenerierungsgeschäft zu medizinischen Körperscans per Ultraschall unter „Midjourney Medical“ wechselt. Score 58, 18.06.2026, !«メールアドレス». https://lemmy.zip/post/66397234 (Originalartikel: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/)
- Midjourney AI pivots to Theranos: Ultrasonic CT — Kritischer Kommentar zur selben Nachricht. Score 40, 19.06.2026, !«メールアドレス». https://awful.systems/post/8731127 (https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
- Midjourney Medical / Midjourney Ultrasonic CT Scanner — Zwei Direktlink-Beiträge zu Midjourneys offizieller Seite. Score 3 bzw. 2, 18.06.2026, !«メールアドレス». https://lemmy.bestiver.se/post/1175129 / https://lemmy.bestiver.se/post/1175130
- Midjourney wants Hollywood studios to reveal AI usage details — Artikel dazu, dass Midjourney Hollywoodstudios zur Offenlegung ihrer KI-Nutzung auffordert. Score 73, 05.07.2026, !«メールアドレス». https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
Signale
- Die Aktivität rund um KI für Bild- und Videogenerierung auf Lemmy konzentriert sich fast vollständig auf Open Source. Im Zentrum steht
!«メールアドレス»; dort erscheinen nahezu täglich drei bis neun Tool-Beiträge rund um das MiniMax-H3-Ökosystem – LoRAs, ComfyUI-Nodes, VAE-Beschleunigung, Motion Caching und mehr. Auch quantisierte Qwen-Versionen und Arbeiten wie LLaDA-Image werden dort geteilt. - Auf Closed-Source-Seite bildet fast ausschließlich die Nachricht von Midjourneys Wechsel von Bildgenerierung zu medizinischen Ultraschallscans im Juni 2026 einen zusammenhängenden Block. Sie wurde in mehreren Instanzen weiterverbreitet und diskutiert; Scores zwischen 40 und 73 sind für dieses Thema vergleichsweise hoch. Umgekehrt finden sich auf Lemmy kaum Nachrichten zu den großen Releases von Sora, Veo, Kling, Runway, Nano Banana oder Flux.2 selbst.
- Die Lemmy-Suche nach „Veo 3“ und „Kling AI“ ergab keine passenden Beiträge; auch kombinierte Suchen nach „Runway/Kling/Veo/Gemini image“ blieben ohne Treffer. Lemmy-Nutzer scheinen stärker auf Tools zu reagieren, die tatsächlich in ComfyUI nutzbar sind – Nodes, LoRAs und Optimierungen – als auf reine Modellankündigungen.
Grenzen
- Lemmy hat eine kleine Nutzer- und Beitragsbasis und keine spezialisierte News-Community für KI-Bild- und Videogenerierung. Die Daten stammen praktisch aus einer Community,
!«メールアドレス», und aus vereinzelten Artikeln zu Closed-Source-Unternehmen in allgemeinen Tech-Communities. - Statt der angestrebten etwa 20 analysierten Beiträge konnten nur 15 erreicht werden: 11 Open-Source-Tool-Beiträge und vier Midjourney-bezogene Closed-Source-Beiträge. Beiträge zu den wichtigsten Releases von 2026 – Sora, Veo, Kling, Runway, Nano Banana und Flux.2 – wurden weder über die Lemmy-Suche noch über Websuche gefunden. Dieses Nichtauffinden ist selbst ein Ergebnis.
- Die Community-Seite
/c/stablediffusionauf lemmy.world gab direkt einen HTTP-500-Fehler zurück; über die Such-API konnte dies teilweise umgangen werden.
Pinterest — Nachrichten zu KI für Bild- und Videogenerierung
Alle 50 Pins (output/pinterest.pins.md / images/pinterest/manifest.json) wurden geprüft. Sie stammen aus einer einzigen Suchanfrage „Image and Video Generation AI News“ und waren nicht nach Genres aufgeteilt.
Visuelle Themen
- Navyblau × Neon (Blau, Violett, Pink) als standardisierte Cyber-Ästhetik: Schaltkreise, leuchtende Partikel und neuronale Kugeln bzw. Knoten füllen bei der Mehrheit die Hintergründe und erzeugen einen stereotypen KI-Look. [1, 2, 5, 7, 11, 13, 14, 17, 18, 20, 26, 30, 38, 40]
- Wiederkehrendes Bild von „KI-Nachrichtensprechern“: Weiße Androiden oder halb menschlich, halb maschinell wirkende Gesichter sitzen im Anzug am Nachrichtentisch. Der Eindruck einer Massenproduktion mit ausgetauschten Markennamen ist stark. [4, 32, 34, 37, 42]
- Tool-Vergleichs- und Ranking-Infografiken als häufigstes Format: Listen à la „Best AI Video Generators“ führen wiederholt fast dieselben Namen: Runway, Pika, Kling AI, Luma (Dream Machine), Canva AI, Hailuo AI, Synthesia, InVideo AI, HeyGen, Vidu AI, PixVerse, Google Veo, OpenAI Sora und Adobe Firefly. [9, 19, 28, 33, 36, 46]
- Demogitter, die ein Bild oder Video in viele Stile verwandeln: Dieselbe Person, ein Panda-Kostüm oder ein Tesla-Auto erscheinen als Holzklotz-, Origami-, Lego- oder Blumen-Version. Die Vorher-Nachher-Struktur bewirbt Konsistenz. [8, 25, 44]
- Deepfake-Sorgen und Erkennungsinhalte: Katzenbilder mit „FAKE“-Stempel, „Which is AI?“-Quizze, Tools zur Erkennung KI-generierter Bilder und Texte sowie Infografiken mit Warnungen, dass Sehen nicht mehr Glauben bedeute. [4, 12, 18, 26, 47]
- Datierte News-Karten im Stil von „AI News Roundup“: Überschrift und Stichpunkte bündeln mehrere Eilmeldungen, etwa Google I/O 2026, KI-gestützte 911-Anrufe oder Nordkoreas KI-Stack. [21, 29, 31, 35]
- Generische KI-Kunst als Schaufenster, abseits des Themas: Fotorealistische Marmorfiguren, die Cello spielen, oder Porträts alter Fischer erscheinen als Werbe-Pins ohne Nachrichtenwert. [49, 50]
- Dunkle Hintergründe mit Neon-Schrift dominieren; nur wenige Unternehmensinfografiken setzen auf Weiß, Corporate Blue und flaches Design. [3, 10, 27, 33]
Bemerkenswerte Pins
- [11] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Produktvorstellung für Veo-3-Bild-zu-Video mit nativem Audio über die Gemini API.
- [16] Google Unveils Veo 2 — Promotion-Gitter im offiziellen Google-Stil für Veo 2, mit zahlreichen generierten Beispielen wie Wissenschaftlerin am Mikroskop, Schwimmen und Anime-Mädchen.
- [25] Google announces Veo 3 — Demo eines violetten Monster-Charakters, der konsistent in mehreren Umgebungen erscheint. Aus einem Quellbild werden drei unterschiedliche Videos; der Fokus liegt auf Charakterkonsistenz.
- [29] Today's AI News: MAY 20, 2026 — Schwerpunkt Google I/O 2026. Genannt werden Gemini 3.5 Flash, Gemini Omni, Gemini Spark, Apples Accessibility-KI und der Wettbewerb um Android-XR-Smartglasses.
- [35] The Latest AI Developments — Drei Eilmeldungen: KI beantwortet 911-Anrufe in New Orleans; Meta veröffentlicht das Offline-Agentenmodell Muse Glimmer; die nordkoreanische Kimsuky-Gruppe automatisiert Phishing mit einem eigenen KI-Stack.
- [44] Microsoft Unveils VASA-1 — Vorstellung eines Modells, das aus einem einzelnen Foto, einem Audio-Clip und optionalen Steuersignalen ein sprechendes Gesichtsvideo erzeugt; dargestellt mit einem Gitter verschiedenster Gesichter.
- [48] ShengShu Technology Unveils Vidu S1 — Vorstellung von Vidu S1 als Modell für „Echtzeit-KI-Interaktion“ mit Cyberpunk-Charakteren in Mehrfachansicht.
- [8] Demo für konsistente Stiltransformation (Luma-artig) — Vergleichsgitter, das dieselbe Person, Tiere und Autos in fünf Stilvarianten aus Holzklötzen, Origami, Lego und Blumen zeigt. Als technische Demo besonders überzeugend.
- [46] Future of Video Creation: Best AI Video Generators of 2026 — Aktuelles Ranking mit konkreten Versionsnummern: Pika 2.5, HeyGen, Google Veo 3.1, Runway Gen 4.5, Kling 3.0, Adobe Firefly und Seedance 1.5 Pro.
- [20] More than 20% of YouTube is now AI-generated — Ein schlichter Pin, dessen Überschrift eine konkrete Statistik nennt und damit die Verbreitung KI-generierter Inhalte symbolisiert.
Signale
- Der Wettbewerb zwischen Modellgenerationen ist sichtbar: Veo 2 → 3 → 3.1, Kling AI → 3.0, Runway Gen-3 → Gen 4.5, Pika 2.5 und Seedance 1.5 Pro erscheinen wiederholt. Das deutet auf sehr schnelle Iterationszyklen in der KI-Videogenerierung hin. [16, 25, 11, 46]
- „Agentisierung“, Echtzeit und Offline-Betrieb werden zum nächsten Fokus: Pipeline-Tools, die von der Recherche über das Skript und die Generierung bis zur Bearbeitung alles mit einem Klick automatisieren ([24]), Vidu S1 für Echtzeitinteraktion ([48]) und Metas offline verfügbares Muse Glimmer ([35]) verschieben die Aufmerksamkeit von bloßer Generierung zu Agenten, Echtzeit und On-Device-Nutzung.
- Reale Nutzung und Missbrauch durch KI werden zunehmend diskutiert: KI in Notrufsystemen ([35]) und der Missbrauch durch staatliche Akteure wie Nordkorea ([35]) erweitern die Diskussion über reine Generierung hinaus auf gesellschaftlichen Einsatz und Sicherheit.
- Kommerzielle Closed-Source-Tools dominieren die Sichtbarkeit: In den Ranking-Pins tauchen wiederholt Google Veo, OpenAI Sora, Runway, Kling AI, Adobe Firefly, Pika, Luma, HeyGen und Synthesia auf. Open-Source-Modelle wie Stable Diffusion, AnimateDiff, Open-Sora oder ComfyUI-Workflows sind nahezu nicht vertreten. „Amuse 3.0“ ([50]), das lokale Ausführung auf AMD Ryzen AI bewirbt, ist eine der wenigen Ausnahmen.
- Die Verbindung zu Primärquellen ist schwach: Nur wenige der 50 Pins verweisen erkennbar auf offizielle Unternehmensblogs oder Facharbeiten, etwa die Veo-Pins [16] und [25] oder Microsoft VASA-1 [44]. Der Großteil besteht aus Affiliate-Blogs, SEO-Artikeln und Fiverr-Vertriebsgrafiken wie [45]. Pinterest funktioniert eher als Ort zum Vermarkten von Tools denn als Ort, Nachrichten zu verfolgen.
- Deepfake-Sorgen sind zu einem festen Content-Genre geworden: Erkennungstools und „Kannst du es unterscheiden?“-Quizze bilden eine eigene Kategorie. Nicht nur technischer Fortschritt, sondern die Frage „Kann man dem vertrauen?“ wird konsumiert. [4, 12, 18, 26, 47]
Grenzen
- In dieser Phase wurden ausschließlich von einem Worker vorab mit Headless-Browser gesammelte Bilder geprüft; es wurden keine weiteren Pinterest-Suchen oder Scrollvorgänge durchgeführt, entsprechend dem vorgegebenen Playbook.
- Die Sammlung basiert auf einer einzigen, nicht segmentierten Anfrage. Es wurden keine gezielten Suchen nach Closed- oder Open-Source-Inhalten ausgeführt. Dass sich kaum Open-Source-Pins fanden, kann echte Pinterest-Tendenz sein, es bleibt aber möglich, dass eine gezielte Suche andere Ergebnisse geliefert hätte.
- Zwei Pins hatten den Titel
(untitled); bei [12] ließ sich inhaltlich „Which is AI?“ erkennen, andere blieben schwer einzuordnen. - Die eigentlichen Pin-URLs (
pinterest.com/pin/...) wurden nicht geöffnet. Die Auswertung beruht nur auf Bild und Titel; Linkziel, Kommentare und Engagement-Werte wie Saves wurden nicht geprüft. - [49], die Marmor-Cellistin, ist ein generischer KI-Kunst-Pin mit nur schwachem Themenbezug und wird nicht als Nachrichtenbefund gewertet.
Empfohlene Maßnahmen
- Für Sora2-abhängige Workflows vor dem API-Ende am 24.09.2026 einen Migrationsplan zu Kling 3.0 oder Veo 3.1 aufstellen.
- Die ComputerUse-Funktionen von GPT-6 Astra als Werkzeug zur Automatisierung ganzer Produktionspipelines verfolgen, nicht nur als einzelne generative KI.
- Für Kostensenkungen erst lokale Bearbeitung mit Qwen-Image-Edit + ComfyUI ausprobieren, bevor für Closed-Source-Angebote bezahlt wird.
- Regeln zur Offenlegung von KI-Nutzung für veröffentlichte Inhalte etablieren, um Risiken durch Authentizitätskennzeichnung, gefälschte Zeitraffer und öffentliche Kritik zu reduzieren.
- Den geteilten Workflow Nano Banana (Standbild) + Kling 3.0 (Videoerstellung) evaluieren.
- Midjourneys Wechsel vom Bildgenerierungs- zum Medizintechnikgeschäft weiter beobachten, als möglichen Frühindikator für Diversifizierung bei anderen Closed-Source-Unternehmen.
Gesammelte Bilder


















































Hinweis zur Datenqualität
Auf keiner der sechs Plattformen wurde das Abschlusskriterium aus brief.md von ungefähr 20 Beiträgen pro sozialem Netzwerk erreicht. Besonders bei X waren nur vier von 40 Beiträgen relevant; auf Bluesky blieben wegen 403-Rate-Limits effektiv 11 Beiträge, und Lemmy kam wegen fehlender spezialisierter News-Community nur auf insgesamt 15. Die zentralen Trends – GPT-6 Astra, das Ende von Sora2 und das Wachstum des ComfyUI-Ökosystems – werden jedoch von mehreren Plattformen unabhängig bestätigt.



