KI-News zur Bild- und Videogenerierung — 2026-09-08
Auf der Closed-Source-Seite wurde ein neues Genre unabhängig auf Reddit, X und Bluesky diskutiert: LLM-Agenten (GPT-6 Astra) erstellen Bilder und 3D-Videos nicht mit Diffusionsmodellen, sondern indem sie GUI-Tools und Blender bedienen. Open-Source-Aktivität konzentrierte sich dagegen auf die ComfyUI-Community auf Lemmy und YouTube-Kanäle mit Vergleichstests; auf Bluesky, Pinterest, Reddit und X war sie kaum sichtbar.
KI-News zur Bild- und Videogenerierung — 2026-09-08
Die auffälligste Erkenntnis der plattformübergreifenden Untersuchung über sechs Plattformen hinweg: Auf der Closed-Source-Seite wurde unabhängig auf drei Plattformen ein neues Genre diskutiert, bei dem LLM-Agenten wie GPT-6 Astra statt Diffusionsmodellen bestehende GUI-Werkzeuge und Blender direkt bedienen, um Bilder und 3D-Videos zu erstellen. Die Open-Source-Seite war insgesamt weniger präsent, auf Entwicklerebene jedoch aktiv: In Lemmys !stable_diffusion-Community erschienen innerhalb derselben Woche fünf bis sechs ComfyUI-Beschleunigungs-Nodes für MiniMax-H3-Videomodelle, während YouTube fortlaufend den Wettbewerb zwischen Flux.2/Flux 2 Klein und Qwen-Image untersucht. Pinterest sowie viele Beiträge auf Reddit und X konzentrierten sich auf Closed-Source-Produktnamen wie Midjourney, Sora, Veo, Runway, Kling, Nano Banana und Seedream; spezifische Open-Source-Namen tauchten fast nie auf. Plattformübergreifend fiel zudem auf, dass Debatten über die Echtheit von Inhalten und die sozialen Folgen von KI-Agenten, die menschliche Rollen und Aufgaben übernehmen, auf Reddit und Pinterest stärker sichtbar waren als reine Techniktrends.
Plattformübergreifend
- Agentische visuelle Generierung mit GPT-6 Astra wurde unabhängig auf drei Plattformen diskutiert: Dass Astra Blender bediente und renderte, wurde separat auf Reddit (r/DefendingAIArt) und Bluesky (@simonwillison.net) aufgegriffen. Eine Demo, die mit Astra eine 3D-Stadt erstellt, löste auf X eine Kette von Nachahmungen aus (@synabreu, @GulatiYajat). Nicht die Weiterentwicklung von Diffusionsmodellen, sondern die Idee, dass LLM-Agenten vorhandene Tools übernehmen und damit Bilder sowie 3D-Inhalte erzeugen, war das größte plattformübergreifende Thema der Untersuchung.
- Bei Charakter- und Szenenkonsistenz in der Videogenerierung bleibt die Einschätzung gespalten: Auf Reddit (r/generativeAI, r/aivideomaking) und X standen sich zeitgleich Lob für Seedance 2.5 (@atlas_remake) und Kritik an Fehlern in komplexen Szenen (@Aiden_Tech_Ai) gegenüber.
- Die Sichtbarkeit von Open Source ist je nach Plattform stark unausgewogen: Lemmys
!stable_diffusionwar so aktiv, dass parallel ComfyUI-Nodes für MiniMax H3 wie ComfyUI-Ref2VA-VSA erschienen. Auch YouTube veröffentlichte fortlaufend Vergleichs- und Testvideos zu Qwen-Image, FLUX und Wan 2.2. Auf Bluesky, Pinterest, Reddit und X fanden sich dagegen kaum Beiträge mit konkreten Open-Source-Modellnamen wie Stable-Diffusion-Neuauflagen, FLUX, Wan oder HunyuanVideo. Mehrere Plattform-Limitierungen weisen auf dieselbe strukturelle Schwäche hin: Unklar bleibt, ob Open Source tatsächlich nicht diskutiert wurde oder ob Closed-Source-lastige Suchbegriffe entsprechende Beiträge übersehen haben. - Echtheitsdebatten und gesellschaftliche Auswirkungen liefen parallel zu Techniktrends: Beiträge mit umstrittener Authentizität – etwa Reddit-Posts in r/isthisAI sowie die Thor-Aufnahmen in r/pj_explained und r/NewRockstars –, Blueskys automatischer KI-Bild-Labeler aimod.social, ein Fakevideo zum Gouverneurswahlkampf in New York (Bluesky/404media) und Pinterest-Thumbnails mit „FAKE“-Stempeln zeigen: Auf mehreren Plattformen wurde unabhängig eher über Erkennen und Misstrauen als über das Erstellen selbst gesprochen.
Nach Plattform
Reddit hatte unter zwölf Threads in Subreddits zu KI-Bild- und Videogenerierung (r/generativeAI, r/aivideomaking, r/GoogleFlow, r/freetoolsAI) geringere Interaktion als Diskussionen über KI allgemein oder die Echtheit von Inhalten (r/antiai, r/aiwars, r/DefendingAIArt, r/isthisAI, r/pj_explained, r/NewRockstars). Wegen eines einzelnen Suchbegriffs war ein sinnvoller Closed-Source-/Open-Source-Vergleich kaum möglich.
X wurde von NVIDIAs Ankündigung zu Sol-H3 – Videoinferenz schneller als Echtzeitwiedergabe –, deren lokaler Reproduktion durch Einzelpersonen und der Nachahmungswelle für 3D-Stadtgenerierung mit GPT-6 Astra geprägt. Nur ein begrenzter Teil der 40 Beiträge betraf unmittelbar Bild- und Videogenerierungs-KI; regionale Explore-Trends rund um Kroatien sorgten für viele themenfremde Treffer.
YouTube erlaubte wegen JavaScript-Rendering keine Erfassung von Aufrufzahlen oder Abonnentenzahlen. Dennoch bestätigten sich Vergleichs- und Erklärungskanäle, die sowohl Closed-Source-Angebote wie Midjourney V8.2, Grok Imagine und Google Gemini „Omni“ als auch Open-Source-Modelle wie Qwen-Image-2.0, FLUX und Wan 2.2 behandeln. Damit war YouTube unter den sechs Plattformen die am besten geeignete Quelle für den Vergleich beider Lager.
Bluesky lieferte über die Such-API (app.bsky.feed.searchPosts) dauerhaft 403-Fehler. Daher musste die Untersuchung auf einzelne Feeds bekannter Accounts wie @simonwillison.net und @404media.co ausweichen und erreichte nicht das Ziel von 20 analysierten Beiträgen. Ein konkreter Open-Source-Beitrag betraf lediglich die lokale Ausführung von Qwen 3.7 27B.
Lemmy verzeichnete als größtes Einzelthema die Kontroverse um Midjourneys angeblichen Wechsel zu medizinischen Ultraschallscannern (!techtakes). Auf der Open-Source-Seite bot Lemmy als einzige der sechs Plattformen umfangreiche Primärinformationen: parallele Releases von ComfyUI-Nodes für MiniMax H3 und Benchmark-Wettbewerb bei Qwen-Image-Bench mit LLaDA-Image und Boogu-Image-0.1.
Pinterest prüfte 30 von 50 vorab gesammelten Pins. Aufgrund einer nicht kategorisierten Einzelabfrage dominierten Infografiken zum Vergleich von Closed-Source-Produkten und Anleitungen; kein einziger konkreter Open-Source-Modell- oder Projektname wurde gefunden. Da das Manifest weder Veröffentlichungszeitpunkte noch Interaktionszahlen enthält, lässt sich die Aktualität nicht bewerten.
Beobachten
- Videoinferenz schneller als Echtzeit mit MiniMax H3 / Sol-H3 und die Flut an ComfyUI-Optimierungs-Nodes — X (@xieenze_jr) / Lemmy (ComfyUI-Ref2VA-VSA u. a.). Entscheidend ist, wie weit Open Weights und lokale Reproduktionen zu Cloud-Ankündigungen aufschließen.
- Die Ausbreitung agentischer visueller Generierung mit GPT-6 Astra — Reddit (r/DefendingAIArt) / Bluesky (@simonwillison.net) / X (@synabreu). Zu beobachten ist, wie weit sich die Nachahmungsdynamik ausweitet.
- Der Open-Source-Führungswettbewerb zwischen FLUX.2/Flux 2 Klein und Qwen-Image — YouTube (SECourses, Urban Decoders). Relevant ist, wie Ergebnisse aus über 700 Tests künftige Akzeptanz beeinflussen.
- Weitere Entwicklungen zur Kontroverse um Midjourney Medical — Lemmy (über pivot-to-ai.com). Offen bleibt, ob der angebliche Strategiewechsel eines Bildgenerierungsunternehmens ein Witz bleibt oder umgesetzt wird.
- Folgen des Missbrauchs von KI-Videos in politischer Werbung beim Gouverneurswahlkampf in New York — Bluesky (404media.co). Möglich sind regulatorische oder plattformseitige Reaktionen.
- Fortschritte bei Charakter- und Szenenkonsistenz in der Videogenerierung — Reddit (r/generativeAI) / X (@Aiden_Tech_Ai). Zu beobachten ist, ob All-in-one-Tools dem Problem tatsächlich näherkommen.
Empfehlungen
- Die agentische visuelle Generierung mit GPT-6 Astra, einschließlich Blender-Bedienung und 3D-Stadtgenerierung, auch künftig als eigenes Beobachtungsthema verfolgen.
- Bei der nächsten plattformübergreifenden Untersuchung spezifische Suchbegriffe wie „FLUX“, „Stable Diffusion“, „Qwen-Image“, „Wan“ und „ComfyUI“ ergänzen, um Open-Source-Ankündigungen nicht zu übersehen.
- Für Bluesky unter der Annahme fortdauernder 403-Fehler der Such-API vorab eine umfangreichere Liste zu überwachender Accounts erstellen.
- Pinterest wegen fehlender Zeit- und Interaktionsdaten nicht für zeitkritische Nachrichtenvergleiche verwenden, sondern auf die langfristige Beobachtung von Tool-Bekanntheit beschränken.
- Die Kontroverse um Midjourneys angeblichen Wechsel zu medizinischen Geräten nicht definitiv zitieren, bis eine Primärquelle wie eine offizielle Midjourney-Ankündigung vorliegt.
- Lemmys
!stable_diffusionund YouTube-Testkanäle als bevorzugte Kernquellen für die Beobachtung von Open-Source-Entwicklungen behandeln.
Datenqualität
Bluesky war wegen der dauerhaft 403 liefernden Such-API und des verfehlten Ziels von 20 Beiträgen, Pinterest wegen fehlender Zeit- und Interaktionsdaten sowie unklarer Aktualität am informationsärmsten. Reddit und X nutzten nur einen einzelnen Suchbegriff, sodass Beiträge für einen gezielten Closed-Source-/Open-Source-Vergleich nicht systematisch gesammelt wurden. Dadurch konzentrierten sich Open-Source-Themen auf Lemmy und YouTube. YouTube erlaubte aufgrund von JavaScript-Rendering keine Erfassung von Aufruf- oder Abonnentenzahlen.
Zusammenfassung nach Plattform
Reddit — Nachrichten zur KI-Bild- und Videogenerierung
Wichtigste Diskussionsorte (Subreddits)
Die zwölf erfassten Threads stammen jeweils aus unterschiedlichen Subreddits. Spezialisierte Communities zu KI-Bild- und Videogenerierung waren in der Minderheit; auffälliger waren Subreddits zu Film-/Fake-Prüfung und KI-Kulturdebatten.
| Subreddit | Mitglieder | Erfasste Threads |
|---|---|---|
| r/whenthe | 813.975 | 1 |
| r/isthisAI | 406.607 | 1 |
| r/antiai | 317.903 | 1 |
| r/aiwars | 167.158 | 1 |
| r/generativeAI | 151.385 | 1 |
| r/RemoteWorkers | 75.332 | 1 |
| r/DefendingAIArt | 72.770 | 1 |
| r/pj_explained | 96.256 | 1 |
| r/NewRockstars | 15.523 | 1 |
| r/freetoolsAI | 7.887 | 1 |
| r/aivideomaking | 6.517 | 1 |
| r/GoogleFlow | 1.789 | 1 |
Der einzige Suchbegriff war „Image and Video Generation AI News“. Die Ergebnisse konzentrierten sich weniger auf spezialisierte Subreddits wie r/generativeAI, r/aivideomaking, r/GoogleFlow und r/freetoolsAI als auf KI-Grundsatzdebatten wie r/antiai, r/aiwars und r/DefendingAIArt sowie auf „Ist das KI?“-Prüfungen in r/isthisAI, r/pj_explained, r/NewRockstars und r/whenthe.
Reaktionen der Community
- GPT-6 zeichnet per Maussteuerung „von Hand“ – und kann auch Zeitraffer fälschen (Thread 2, r/antiai, 7.013 Punkte / 1.009 Kommentare, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). Statt eines Diffusionsmodells wird einem LLM (GPT-6) Maus- und Tastatursteuerung gegeben, damit es in einer digitalen Zeichenanwendung malt und sogar einen glaubwürdig wirkenden Zeitraffer produziert. Der Top-Kommentar von u/Nayutantantan (2.507 Punkte) äußert resigniert: Man habe nun nicht einmal mehr Energie, Zeitraffer zur Dokumentation aufzunehmen.
- GPT-6 „Astra“ erstellt in Blender fotorealistische Renderings (Thread 9, r/DefendingAIArt, 143 Punkte / 13 Kommentare, 2026-09-06, https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/). Diskutiert wurde vor allem, dass die KI nicht das Video selbst generierte, sondern als Agent Blender bediente und renderte. u/TheMaliciousSquid vermutet, GPT-6 könne bei visuellen Aufgaben besonders stark werden, und fragt sich, ob es Claude beim Programmieren übertreffen könnte.
- Erweiterung „AutoFlow“ für Google Flow unterstützt fortlaufende Videogenerierung (Thread 12, r/GoogleFlow, 12 Punkte / 6 Kommentare, 2026-09-01, https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/). Die Funktion „Continue from Last Frame“ übernimmt automatisch das letzte Bild eines Clips als erstes Bild des nächsten. Zusätzlich sind Warteschlangen- und Referenzbildverwaltung möglich; als Nächstes wurde das nahtlose Zusammenfügen von Clips angekündigt.
- Großes Interesse an Werbepost für ein kostenloses KI-Bildtool (Thread 3, r/freetoolsAI, 39 Punkte / 48 Kommentare, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). Ein Dienst, der kostenlos, unbegrenzt und ohne Anmeldung sein soll, erhielt viele Kommentare. u/Puzzleheaded_Lab4757 schrieb, dadurch Hunderte Dollar und viele Stunden gespart zu haben; u/thecragmire stellte die Nachhaltigkeit wegen der Betriebskosten infrage.
- Lange Videos und Charakterkonsistenz bleiben die größte Hürde (Thread 10, r/generativeAI, 4 Punkte / 15 Kommentare, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1w9klb7/). Auf den Wunsch nach einem zwei- bis vierminütigen Science-Fiction-Cinematic antwortete u/Missy_Desu, ein Workflow mit Frames aus GPT Image 2 und Videoerzeugung mit Seedance 2.5 sei realistisch, koste aber etwa 100 US-Dollar pro fertiger Minute. u/KissinglyPolished betonte, dass der Sprung von Standbild zu Video besonders bei konsistenten Charakteren schwierig sei und All-in-one-Tools das noch nicht gelöst hätten.
- Kostenlose Videogenerierung auf schwacher Hardware bleibt unrealistisch (Thread 8, r/aivideomaking, 6 Punkte / 15 Kommentare, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/). Auf die Frage, wie sich mit Smartphone und iPad kostenlos ein 45-Sekunden-KI-Video erstellen lasse, antwortete u/NewLifeWares: 45 Sekunden verlangten Rechenzentrumskapazitäten; kostenlos seien allenfalls fünf Sekunden mit Wasserzeichen möglich, die man zusammensetzen müsse.
- KI-Bilder für Lebensmittelwerbung werden weiterhin als unappetitlich kritisiert (Thread 4, r/aiwars, 4 Punkte / 177 Kommentare, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Der Einsatz KI-generierter Lebensmittelbilder in Werbung stieß auf Zweifel. u/LCI_Jake meinte, das sehe wie absichtlich generiertes Gore aus und erinnere an ein Insektennest. u/Bassed_Hummble hielt mit einem lokal erzeugten 40-Sekunden-Ergebnis aus Krea 2 dagegen und argumentierte, bessere Prompts könnten die Qualität steigern.
- Starke Reaktionen auf Heimarbeitsjob zur Bewertung von KI-Bildunterschriften (Thread 5, r/RemoteWorkers, 152 Punkte / 739 Kommentare, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/). Gesucht wurden Personen, die Fehler in KI-generierten Captions – falsch erkannte Objekte, Farben und Text – für 30 US-Dollar pro Stunde prüfen. Die meisten Kommentare fragten formelhaft nach dem Bewerbungslink, während die Aufgabe selbst kaum diskutiert wurde.
- Zwei Debatten über die Echtheit eines „zu echten“ KI-Videos (Threads 1/6, r/NewRockstars und r/pj_explained, doppelte Verbreitung desselben Posts, 2026-09-02). Ein Post über angeblich geleakte Thor-Aufnahmen, der diese als CGI statt KI bezeichnete, wurde im Kommentarbereich von r/pj_explained scharf angegriffen: u/ceaserisnothome erklärte die perfekt kreisförmige Explosion zum KI-Indiz. Dieselbe Aufnahme führte somit zu gegensätzlichen Urteilen.
- Ist eine Welle im Fenster KI oder Echtaufnahme? Die Kommentare sind gespalten (Thread 7, r/isthisAI, 0 Punkte / 79 Kommentare, 2026-09-07, https://www.reddit.com/r/isthisAI/comments/1w9cyub/). Der Verfasser verwies darauf, dass Wasser im Raum auftauche, ohne das Fenster zu zerbrechen. u/RioReiser85 hielt dies für eine Perspektivtäuschung in einer echten Aufnahme, u/bulbousEd sah in der physikalisch unplausiblen Bewegung des Schaums am Bug einen KI-Beweis.
Signale
- Wachsende Tendenz: Skepsis gegenüber KI, die nicht mehr wie KI aussieht. Die große Resonanz auf Thread 2 – 7.013 Punkte und 1.009 Kommentare – deutet auf starke Sorge hin, dass LLMs über direkte GUI-Bedienung sogar scheinbare Belege für handgezeichnete Arbeiten fälschen können.
- Abgewertet oder zurückgewiesen: Der Wunsch nach kostenlosen, langen und hochwertigen KI-Videos wird von der Community wiederholt verworfen (Threads 8 und 10). Reddit teilt weitgehend die Einschätzung, dass Hardware- und Kostenbeschränkungen weiterhin erheblich sind.
- Überraschend: Subreddits für Authentizitätsprüfung und KI-Grundsatzdebatten wie r/isthisAI, r/antiai, r/aiwars, r/pj_explained, r/NewRockstars und r/whenthe erzeugten deutlich mehr Aufmerksamkeit und Interaktion als spezialisierte Communities. KI-Bild- und Videonachrichten werden auf Reddit derzeit stärker als gesellschaftliche Reibung über die Frage „Ist das KI?“ erzählt als als Modellfortschritt.
- Widersprüchliche Signale: Bei derselben angeblichen Thor-Leakaufnahme kamen die Kommentare in r/NewRockstars und r/pj_explained zu gegenteiligen Schlussfolgerungen: „nicht KI“ gegenüber „KI“ (Threads 1/6). Auch Thread 7 zeigt ein Patt zwischen Echtaufnahme- und KI-Lager. Visuelle Beurteilungen durch allgemeine Nutzer sind damit kaum noch verlässlich.
Einschränkungen
- Es wurde nur nach „Image and Video Generation AI News“ gesucht. Alternative Begriffe wie „Stable Diffusion“, „Midjourney“, „Sora“, „Kling“ oder „Open-Source-Bildgenerierung“ wurden nicht verwendet. Deshalb wurden kaum Beiträge erfasst, die Closed Source wie Midjourney, DALL-E, Sora, Veo und Runway klar Open Source wie Stable Diffusion, Flux oder dem ComfyUI-Ökosystem gegenüberstellen.
- Die zwölf Threads stammten jeweils aus zwölf verschiedenen Subreddits; ein tiefer Vergleich mehrerer Threads innerhalb derselben Community war nicht möglich.
- Die Threads 9 und 11 enthalten keinen Textkörper, sondern nur Titel und Kommentare; Primärinformationen zur Absicht des Posts fehlen.
- Die Threads 1 und 6 sind faktisch Crossposts desselben Beitrags. Als zwei unabhängige Fälle gezählt entspräche die effektive Stichprobe lediglich etwa elf Beiträgen.
- Wegen der Art der Browsererhebung erfolgten in diesem Durchlauf keine zusätzlichen Reddit-Abfragen, etwa mit weiteren Suchbegriffen oder durch das vollständige Aufklappen von Kommentaren.
X
X — Nachrichten zur KI-Bild- und Videogenerierung
Accounts
Die 40 gesammelten Beiträge stammen von 37 Accounts. Die meisten waren Einzelbeiträge, die entweder viral gingen oder untergingen. Nur @yu_ichi_suzuki (鈴木憂一) veröffentlichte mehrere zusammenhängende technische Beiträge zur lokalen Ausführung von MiniMax H3.
| Account | Beiträge | Tendenz |
|---|---|---|
| @yu_ichi_suzuki (鈴木憂一) | 2 | Technischer Thread zur Ausführung von MiniMax H3 auf einer lokalen RTX 5090 (zusammen 309 Likes); schrittweise Anleitung statt Einzelviralität |
| @xieenze_jr (Enze Xie) | 1 | Ankündigung eines neuen Modells durch einen MiniMax-Forscher (349 Likes, etwa 85.000 Aufrufe) |
| @voxelphotonics | 1 | Demo von Duke Nukem 3D auf einem volumetrischen Display; 6.097 Likes und etwa 297.000 Aufrufe |
| @synabreu | 1 | Mit GPT-6 Astra erstelltes 3D-Stadtmodell von Seoul; 2.700 Likes und etwa 235.000 Aufrufe |
| @GulatiYajat (Yajat Gulati) | 1 | Erstellung einer 3D-Stadt von Gurgaon mit GPT-6 Astra; 574 Likes |
| @luccacerf | 1 | Demo aus Blender MCP, Astra und Tripo; 445 Likes |
| @He1s_Sammy | 1 | Langer Thread über gesichtslose KI-Kindervideos als Geschäft; 388 Likes |
| @SD_Tutorial (Stable Diffusion Tutorials) | 1 | Technische Erklärung zu Sol-H3, jedoch mit geringer Resonanz von 22 Likes |
| @Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox | je 1 | Kleinere Accounts, die über Qualität und Grenzen von Seedance 2.5 bzw. KI-Videos schreiben |
Mit Ausnahme von @xieenze_jr handelte es sich nicht um Entwickler selbst, sondern um Nutzer, die ihre Experimente und Ergebnisse teilen. Die Debatte hat eine zweistufige Struktur: Wenige große virale Posts von @voxelphotonics und @synabreu treffen auf technische Workflow-Erklärungen einzelner Personen wie @yu_ichi_suzuki und @SD_Tutorial.
Beiträge
- MiniMax stellt mit „Sol-H3“ Videogenerierung schneller als Echtzeitwiedergabe vor (#2 @xieenze_jr, 349 Likes / 62 Reposts / 23 Antworten / etwa 85.000 Aufrufe, 2026-09-07, https://x.com/xieenze_jr/status/2097000082927399012). Unter dem Motto „Five seconds of world. 1.653 seconds to infer.“ wurde angekündigt, dass acht NVIDIA B300 Blackwell fünf Sekunden Video bei 1344×768 in 1,653 Sekunden erzeugen können. Der Post war Ausgangspunkt des Explore-Trends „NVIDIA Speeds Up AI Video Generation Past Real-Time Playback“.
- Die technische Erklärung dazu verbreitet sich (#3 @SD_Tutorial, 22 Likes / etwa 2.100 Aufrufe, 2026-09-07, https://x.com/SD_Tutorial/status/2097061880175141224). Der Beitrag beschreibt Sol-H3 als „a high-performance video inference stack developed by NVIDIA Research that runs the MiniMax-H3 video generation model faster than real-time playback“ und verlinkt die Sol-Engine-/Sol-H3-Seite von nvlabs.github.io. Technische Accounts griffen die Ankündigung schnell auf.
- Anleitung zur lokalen Ausführung von MiniMax H3 auf einer RTX 5090 (#4–5 @yu_ichi_suzuki, 295 + 14 Likes / etwa 18.000 + 1.100 Aufrufe, 2026-09-07, https://x.com/yu_ichi_suzuki/status/2096819288997065192). Der Autor beschreibt, wie sich lokal mit MiniMax H3 in etwa neun Minuten ein mehr als 15 Sekunden langes 2K-Video erzeugen lässt: zunächst ein 480p-Treffer mit einer destillierten Alibaba-LoRA, dann Hochskalierung auf 2688×1536 mittels RTX Video Super Resolution. Der Workflow mit GitHub-Notizen bildet das Gegenstück zur Cloud-Ankündigung: Open Weights werden durch Einzelpersonen praktisch ausgereizt.
- Modevideo mit Seedance 2.5 generiert (#1 @Strength04_X, 68 Likes / 2 Reposts / 35 Antworten / etwa 7.700 Aufrufe, 2026-09-06, https://x.com/Strength04_X/status/2096441159887274302). Unter „Seedance 2.5 on Dreamina_ai“ veröffentlichte der Account ein „30-second photoreal cinematic fashion-travel music video“ samt vollständigem Prompt.
- Seedance 2.5 erzeugt eine Toy-Story-artige Welt (#14 @atlas_remake, 3 Likes / etwa 133 Aufrufe, 2026-09-07, https://x.com/atlas_remake/status/2096847522602139995). Der Beitrag lobt, wie Seedance 2.5 mehrere animierte Charaktere und Objekte behandelt, und bewertet die Charakterkonsistenz positiv.
- „KI-Video ist noch immer ein Spielautomat“ (#12 @Aiden_Tech_Ai, 1 Like / 2 Reposts / 4 Antworten / etwa 494 Aufrufe, 2026-09-07, https://x.com/Aiden_Tech_Ai/status/2097020441470836791). Der Beitrag schildert das wiederholte Generieren, bis etwas stimmt, und verweist auf die Probleme bei mehreren Räumen, Kamerabewegung, Character Blocking und Kontinuität. Die Resonanz war klein, die Kritik steht jedoch dem Optimismus aus #5 gegenüber.
- Duke Nukem 3D auf volumetrischem 3D-Display nachgebildet (#10 @voxelphotonics, 6.097 Likes / 921 Reposts / 130 Antworten / etwa 297.000 Aufrufe, 2026-09-07, https://x.com/voxelphotonics/status/2096833425043005562). Der Beitrag erzielte in diesem Zeitraum die höchste Interaktion. Es handelt sich nicht unmittelbar um Bild- oder Videogenerierungs-KI, sondern um eine Demo für Rendering und Darstellung, war aber ein wesentlicher Grund für den Explore-Trend „Duke Nukem 3D Brought to Life in True 3D Display“.
- Ganz Seoul mit GPT-6 „Astra“ als 3D-Stadt erstellt (#20 @synabreu, 2.700 Likes / 451 Reposts / 81 Antworten / etwa 235.000 Aufrufe, 2026-09-06, https://x.com/synabreu/status/2096557555086725159). Der Autor schrieb: „for my first project created with GPT-6 Astra, I built the entire city of Seoul in 3D—a small revolution in digital geography!“ und erzielte damit große Reichweite für eine Anwendung interaktiver 3D-Generierung.
- Gurgaon ebenfalls als 3D-Stadt mit GPT-6 Astra nachgebildet (#22 @GulatiYajat, 574 Likes / 28 Reposts / 53 Antworten / etwa 46.000 Aufrufe, 2026-09-06, https://x.com/GulatiYajat/status/2096659142534676684). Mit „I saw everyone building all sorts of cool demos with Astra, so I decided to give it a shot“ dokumentiert der Post konkret, dass die Welle aus #8 Nachahmer hervorbrachte. Auch eine eigene Website unter gurgaon-3d-atlas.cratorlabs-2435.chatgpt.site wurde veröffentlicht.
- Demo aus Blender MCP, Astra und Tripo (#21 @luccacerf, 445 Likes / 20 Reposts / 11 Antworten / etwa 31.000 Aufrufe, 2026-09-07, https://x.com/luccacerf/status/2097047098281672782). Der Post „First time building a gUI with Blender MCP + Astra + Tripo This is insane. Html preview for AI is dead.“ ist ein Beispiel für die Verknüpfung mehrerer KI-Tools via MCP.
- Gesichtslose KI-Kindervideos werden zum Content-Geschäft (#23 @He1s_Sammy, 388 Likes / 96 Reposts / 17 Antworten / etwa 19.000 Aufrufe, 2026-09-06, https://x.com/He1s_Sammy/status/2096492880017736056). Ein Post zu Nebenverdienst und Monetarisierung durch generierte Kindervideos argumentiert: „FACELESS AI KIDS VIDEOS ARE BECOMING A SERIOUS CONTENT BUSINESS...a phone, laptop, or iPad is enough to start experimenting“.
Signale
- Wachsende Tendenz: Dialogorientierte Agenten, die 3D-Welten erstellen – 3D-Städte mit GPT-6 Astra und Blender-MCP-Integrationen – lösten in diesem Zeitraum die stärkste Nachahmungsdynamik aus. @GulatiYajat erklärt ausdrücklich, nach Beobachtung anderer Astra-Demos selbst eine erstellt zu haben.
- Wachsende Tendenz, Teil zwei: Videoinferenz schneller als Echtzeit mit Sol-H3 (#2/#3) und die fast zeitgleiche lokale Reproduktion mit Open Weights auf einer GPU durch @yu_ichi_suzuki zeigen, dass Closed-Source-Ankündigungen und Open-Weight-Nutzung auf X nahezu ohne Zeitversatz nebeneinanderlaufen.
- Abgewertet oder umstritten: Die Konsistenz mehrerer Charaktere und Räume in KI-Videos bleibt offen. Lob wie „handles multiple animated characters well“ (#5) und Frust über ein „slot machine problem“ (#6) erschienen im selben Zeitraum.
- Überraschend: Von neun Explore-Trends, die den 40 gesammelten Posts zugrunde lagen, betrafen nur drei direkt Bild- oder Videogenerierungs-KI: NVIDIA/Sol-H3, die Anime-Rückkehr von VTuber Veibae und Duke Nukem 3D auf einem volumetrischen Display. Die übrigen sechs – Croatian, Building, $song, Harvey, Ukrainian und Democrats – waren regionale oder themenfremde Trends. Die Suche nach „Building“ führte allerdings zufällig zu den hochwertigen Astra-3D-Stadt-Demos (#8–#10).
- Zum Fall VTuber Veibae: Die Suche nach dem Explore-Trend „VTuber Veibae Teases Return with Sunflower Farm Animation“ lieferte nur irrelevante, mehrfach kopierte Beiträge von nordamerikanischen Box-Office-Accounts wie @mediamanint. Weder Veibae selbst noch Beiträge zur Herstellung der Animation wurden erfasst.
Einschränkungen
- Zum Explore-Trend „VTuber Veibae Teases Return with Sunflower Farm Animation“, der möglicherweise Bild- und Videogenerierungs-KI betrifft, konnten keine relevanten Beiträge gesammelt werden. Ob bei der Animation KI verwendet wurde, lässt sich aus der Erhebung nicht ableiten.
- Die sechs übrigen Explore-Trends waren fast vollständig regionale Trends oder aktuelle Themen ohne Bezug zur Bild- und Videogenerierung. 29 der 40 erfassten Beiträge (#6–#9, #13, #15–#19, #24–#40) wurden deshalb aus dem Bericht ausgeschlossen.
- Es wurde nur nach Trendtiteln gesucht, nicht nach Kernbegriffen wie „Stable Diffusion“, „Midjourney“, „Sora“, „Kling“ oder „ComfyUI“. Ein klarer Vergleich von Closed Source wie Midjourney, Sora, Runway und Veo mit Open Source wie Stable Diffusion, Flux oder ComfyUI ist daher kaum möglich.
- Explore war offenbar geografisch an den Serverstandort der Sitzung im Raum Kroatien gebunden und repräsentiert nicht die weltweiten X-Trends.
- Die Sammlung wurde bei 40 Beiträgen beendet; keine weitergehende Analyse zusätzlicher Beiträge desselben Accounts, von Antworten oder von Hashtag-Suchen erfolgte.
YouTube
YouTube — Aktuelle Entwicklungen bei KI-Bild- und Videogenerierung
Kanäle
- 動画編集の中の人 (Kanal) — veröffentlicht zahlreiche praxisnahe Vergleiche von KI-Bildgenerierung.
- AI大学【AI&ChatGPT最新情報】 (Kanal) — konzentriert sich auf monatliche Übersichten zu generativen KI-Tools.
- 【さき】のAIでええやん。 (Kanal) — erklärt Updates rund um Google I/O und Gemini.
- Qwen (offiziell) (Kanal) — veröffentlicht offizielle Ankündigungsvideos zur Qwen-Image-Reihe.
- AIOnTrend (Kanal) — vergleicht Open-Source-Bildmodelle direkt miteinander.
- Urban Decoders (Kanal) — erklärt Architektur und Entwicklung von Flux-Modellen.
- SECourses (Kanal) — führt groß angelegte Tests lokaler Bildgenerierung durch, etwa mit mehr als 700 Tests.
- Woollyfern (Kanal) — beobachtet Midjourney-Updates monatlich.
- 寺田部チャンネル (Kanal) — veröffentlicht Praxisreviews zur lokalen Videogenerierung mit ComfyUI.
- 東京大学 吉田幸 研究室 (Kanal) — regelmäßige technische Erklärungen zu generativer KI aus einem universitären Umfeld.
Abonnentenzahlen konnten nicht erhoben werden, da YouTubes Such- und Videoseiten clientseitig per JavaScript gerendert werden (siehe Limits unten).
Videos
Closed-Source-orientiert
- 【Nach intensiven Ausgaben herausgefunden】Das sind die empfehlenswerten KI-Bildgeneratoren 2026! NanoBananaPro, Seedream4.0, Midjourney und AdobeFirefly im umfassenden Vergleich! — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — Vergleich von Nano Banana Pro, Seedream 4.0, Midjourney und Adobe Firefly auf Basis kostenpflichtiger Praxistests mit einer Empfehlung für 2026.
- 【Neu im Winter 2026】Sechs beliebte kostenlose KI-Videotools, die sich in den letzten Monaten so stark wie nie verbessert haben – darunter Sora 2, Veo 3.1 und Kling 2.6 — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — stellt sechs kostenlos nutzbare KI-Videotools vor, darunter Sora 2, Veo 3.1 und Kling 2.6, und hebt deren schnelle Fortschritte hervor.
- 【Weltranglistenplatz eins bei der Leistung】xAIs KI-Videogenerator „Grok Imagine“ umfassend erklärt! So erstellt man kostenlos Videos auf Sora-/Veo-Niveau! — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — behauptet eine Spitzenplatzierung von Grok Imagine und erklärt die kostenlose Erstellung von Sora-/Veo-ähnlichen Videos.
- 【Neu】Googles KI-Modell Gemini erhält ein großes Update! Erklärung zu Google I/O 2026 und dem neuen Videogenerierungsmodell „Omni“ — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — erläutert die bei Google I/O 2026 vorgestellten Gemini-Updates und das neue Videomodell „Omni“.
- Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More! — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — berichtet über Midjourney V8.2 mit Personalisierungsfunktionen und NIJI Style Creator; der aktuelle Teil einer monatlichen Reihe von V8 Alpha im März 2026 über V8.1 im April und V8.2 Preview im Juni bis zur finalen V8.2-Version im Juli.
Open-Source-orientiert
- 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — offizieller Qwen-Kanal — https://www.youtube.com/watch?v=1tM7Wd0lEeI — offizielle Vorstellung von Qwen-Image-2.0 durch das Alibaba-Qwen-Team als Bildgenerierungsmodell der nächsten Open-Source-Generation.
- Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX - Presets Published — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — untersucht anhand von mehr als 700 Tests, in welchen Punkten Qwen Image FLUX übertrifft, und veröffentlicht Presets.
- Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro - Which AI Image Wins? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — vergleicht die Open-Source-Modelle Flux 2 Klein, Qwen und Z Image Turbo mit Nano Banana Pro anhand desselben Prompts.
- Flux.2 New Open Source King? Architecture FULL guide + Nano Banana Pro comparisons — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — erklärt die Architektur von Flux.2 von Black Forest Labs und prüft im Vergleich mit Nano Banana Pro, ob es der neue Open-Source-Spitzenreiter ist.
- Flux 2 Klein Just Dropped—This Image Editing Model Isn't Just About Speed! — https://www.youtube.com/watch?v=JXgBe3twxbc — aktuelle Vorstellung von Flux 2 Klein, einem leichten lokal ausführbaren Bildbearbeitungsmodell von Black Forest Labs.
- Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — Tutorial zu Upgrades von Wan 2.2, FLUX, Qwen Image und weiteren führenden Open-Source-Modellen für Bild- und Videogenerierung.
- 【Kostenlos mit ComfyUI】Ist es einfach, mit lokaler KI-Videogenerierung Langformvideos zu produzieren? Nein, es ist extrem aufwendig — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — Praxisbericht über die Produktion längerer Videos mit ComfyUI und lokaler Videogenerierung, einschließlich offen geschilderter Schwierigkeiten.
Signale
- Der Closed-Source-Wettbewerb dreht sich um Preis und Geschwindigkeit gegenüber Qualität: Mehrere Vergleichsvideos behaupten, Nano Banana Pro gewinne 63 % der Fotorealismus-Tests (Videos 1 und 9), während kostenlose oder günstige Angebote wie Grok Imagine (Video 3) provokativ „Sora/Veo-Niveau kostenlos“ versprechen.
- Midjourney verbessert die V8-Reihe in monatlichem Rhythmus: Von der V8-Ankündigung im Februar 2026 über Alpha im März, V8.1 im April, V8.2 Preview im Juni bis V8.2 final im Juli dokumentiert der Woollyfern-Kanal ein besonders schnelles Update-Tempo (Video 5).
- Die Ankündigung von Gemini-Videogenerierung „Omni“ auf Google I/O 2026 wurde als große Einzelnachricht behandelt und schnell auch von japanischsprachigen Kanälen erklärt (Video 4).
- In Open Source konkurrieren Qwen Image und FLUX um die Führung: Vertiefende Kanäle veröffentlichen fortlaufend Videos dazu, welches Modell besser ist, etwa den Test mit mehr als 700 Fällen von SECourses (Video 7) und die Architekturanalyse von Urban Decoders (Video 9).
- Flux 2 Klein von Black Forest Labs erhält als auf leichte lokale Ausführung ausgerichtete Variante eigenständige Aufmerksamkeit (Video 10), getrennt vom vollständigen Flux.2-Modell.
- Alibaba-Modelle wie Wan und Qwen Image werden als gemeinsame Open-Source-Säulen für Video- und Bildgenerierung behandelt, sodass sie zusammen in einem Tutorial erscheinen (Video 11).
- Lokale Videogenerierung bleibt aufwendig: Der Praxisbericht zur Langformproduktion mit ComfyUI nennt sie „extrem aufwendig“ (Video 12). Neben Qualität bleibt der betriebliche Aufwand eine zentrale Open-Source-Hürde.
Limits
- YouTubes Suchergebnisseiten (
/results?search_query=...) und Watch-Seiten werden per JavaScript gerendert. WebFetch lieferte nur statisches HTML wie Footer-Links zu Bedingungen und Urheberrecht, sodass Videolisten, Aufrufe, Veröffentlichungsdaten, Beschreibungen und Kommentare nicht auslesbar waren. Das widerspricht der Annahme des Playbooks, wonach das Seiten-HTML Titel, Kanal, Aufrufe und Veröffentlichungsdatum enthalten sollte. - Als Ersatz wurden Websuchen mit
site:youtube.com, die Titel, URLs, Suchmaschinenzusammenfassungen und teilweise Daten liefern, mit YouTubesoembed-Endpunkt kombiniert, der offizielle Titel, Kanalnamen und Kanal-URLs als JSON bereitstellt. Aufrufe, Abonnentenzahlen, vollständige Videobeschreibungen und Kommentare konnten damit jedoch nicht erfasst werden und sind oben nicht enthalten. - Japanische Nachrichtensuchen mit den Vorgaben „August 2026“ und „September 2026“ ergaben keine spezifischen aktuellen KI-Bild- oder Videonachrichten. Stattdessen erschienen allgemeine tägliche KI-Nachrichtenkanäle und irrelevante Wetterberichte. Exklusive Schnellmeldungen für die Woche vom 1. bis 8. September wurden nicht gefunden.
- Reddit, X, Bluesky, Lemmy und Pinterest lagen außerhalb des Umfangs dieser Teilphase und wurden daher nicht untersucht, wie in brief.md beschrieben.
Bluesky
Bluesky — Nachrichten zur KI-Bild- und Videogenerierung
Accounts
| Handle | Typ | Follower usw. | Hinweis |
|---|---|---|---|
| @simonwillison.net | Einzelperson, bekannter KI-Technikblogger und Erfinder von Datasette | — | Vergleicht bei neuen Modellen deren Bildgenerierung anhand eines eigenen Benchmarks: ein Pelikan auf einem Fahrrad. In dieser Erhebung die inhaltlich reichhaltigste Quelle. |
| @404media.co | Medium, Redaktion und Reporter von 404 Media | — | Schwerpunkt auf Überwachungsthemen, veröffentlicht aber gelegentlich Recherchen zu KI-generierten Medien. |
| @aimod.social | Community-Betrieb, Labeler für mutmaßliche KI-Bilder | 2.555 Follower / 94 Beiträge | Bluesky-Labelingdienst, der Bilder mit KI-Verdacht automatisch markiert; eher Infrastruktur als Nachrichtenquelle. |
| @stablediffusion.bsky.social | Einzelperson, teilt SDXL-/Stable-Diffusion-Prompts | — | Seit Januar 2025 keine Beiträge mehr. |
| @bm63ai.bsky.social | Einzelperson, KI-Kunst mit ComfyUI/Flux/Midjourney | — | Postete bis April 2025 viel KI-Kunst; der letzte Beitrag im Juni 2026 drehte sich um Vibe Coding einer App mit Codex. KI-Kunstbeiträge wurden faktisch eingestellt. |
| @petapixel.bsky.social | Medium für Fotografie | — | Behandelte generative Adobe-Funktionen wie Firefly und Lightroom kritisch, aber der letzte relevante Beitrag stammt aus Februar 2025. |
Beiträge
- GPT-6 Astra erneut im Pelikan-auf-Fahrrad-Benchmark (@simonwillison.net, 2026-09-04, 202 Likes / 9 Reposts / 18 Antworten, https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c). Unter „Got access to GPT-6 Astra. Want to see some pelicans?“ veröffentlichte Simon Willison ein Raster mit SVG-Illustrationen eines Fahrrad fahrenden Pelikans: vier Modelle – GPT-6 Astra, GPT-5.6 Sol, Terra und Luna – bei jeweils drei Reasoning-Stufen. Laut Alt-Text liefert Astra elegante und konsistente Ergebnisse, Sol wechselhafte Proportionen, Terra unnatürliche Anatomie und Luna einfachere, steifere Posen. In den Antworten hieß es, Astra sei das erste Modell, das verstanden habe, dass ein fiktives vierbeiniges Tier ein Tandemrad brauche.
- GPT-6 Astra steuert Blender und erzeugt eine 3D-Pelikanszene (@simonwillison.net, 2026-09-05, 400 Likes / 30 Reposts, https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s). Über die dreistufigen Anweisungen „Use the already install /Applications/Blender to render a scene of a pelican riding a bicycle“, „add a background and a lot of flair“ und „make it a whole lot better“ ließ Willison über einen Coding-Agenten Blender bedienen und veröffentlichte das Ergebnis. Dieselbe Geschichte – GPT-6 Astra erzeugt über Blender ein fotorealistisches Rendering – wurde unabhängig auch in Reddits r/DefendingAIArt aufgegriffen.
- Open-Source-Qwen 3.7 27B zeichnet lokal einen Pelikan (@simonwillison.net, 2026-08-14, 183 Likes / 14 Reposts, https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z). Der Beitrag lautet: „The new Qwen 3.7 27B, running as a 17GB GGUF in LM Studio on my M5 Max MacBook Pro, just drew me the best pelican riding a bicycle I've seen from any model that runs on my laptop“. Es ist einer der wenigen konkreten Hinweise auf Fortschritte bei lokal ausführbarer Open-Source-Bildgenerierung.
- Kandidat für New Yorks Gouverneursamt greift Gegner mit KI-generiertem Fakevideo an (@404media.co, 2026-09-02, 124 Likes / 22 Reposts / 7 Antworten, https://bsky.app/profile/404media.co/post/3muka24vu4v2q). Der Beitrag verlinkt „The Republican Nominee for New York Governor Made a Creepy, AI-Generated Video of Mamdani and Hochul“. Ein zitierter Post eines 404-Media-Mitglieds kommentierte sarkastisch, man lebe nun in einer Zeit, in der Fake-Werbespots für Viagra erzeugt werden, um politische Gegner herabzusetzen (194 Likes / 36 Reposts, https://bsky.app/profile/404media.co/post/3muk7u6iepk2h). Dies ist ein Beispiel für den Missbrauch von KI-Videogenerierung in politischer Werbung.
- Cocomelon-Produzent fordert Künstler zu KI-Experimenten auf (@404media.co, 2026-09-06, 84 Likes / 23 Reposts / 21 Antworten, https://bsky.app/profile/404media.co/post/3musx3wgdvc2n). Moonbug Entertainment, Produzent von Cocomelon, Blippi und weiteren Kinderformaten, kündigte an, KI einzusetzen, aber stets „human in the loop“ zu behalten. Es ist ein Signal für die Einführung von Bild- und Videogenerierung in einem wichtigen Produktionsfeld für Kinderinhalte.
- Der Labeler für mutmaßliche KI-Bilder aimod.social hat mehr als 2.500 Follower (Profilanalyse, https://bsky.app/profile/aimod.social). Der Dienst bezeichnet sich als „Labeler for flagging suspected AI imagery“ und bietet neben Kriterienhandbuch auch Einspruchsmöglichkeiten. Zwar keine Nachricht im engeren Sinn, aber ein Hinweis darauf, dass auf Bluesky Nachfrage nach automatischer Kennzeichnung mutmaßlich KI-generierter Bilder als Community-Infrastruktur entstanden ist.
- Frühere KI-Kunstaccounts schweigen weitgehend (Feed-Analyse von @stablediffusion.bsky.social und @bm63ai.bsky.social). stablediffusion.bsky.social veröffentlichte zuletzt am 22. Januar 2025 einen Prompt zur Freiheitsstatue, die elektrische Gitarre spielt. bm63ai.bsky.social stellte KI-Kunst nach einem Post vom 25. April 2025 zu „Star Trek: The Muppet Generation“ ein; der letzte Beitrag vom 8. Juni 2026 handelte von einer mit einem Coding-Agenten erstellten Musik-App.
- Kritik an generativen Adobe-Funktionen als Referenz aus einem älteren Zyklus (@petapixel.bsky.social, 2025-02-12 und 2025-01-09, jeweils 7 bzw. 33 Likes). Beiträge kritisierten Adobes angekündigtes Text-zu-Video-Tool als noch nicht bereit für ein Preisschild und berichteten von einem Lightroom-Generative-Remove-Fehler, der beim Entfernen eines Objekts stattdessen ein Bitcoin-Logo erzeugte. Diese Posts liegen vor dem aktuellen Nachrichtenzyklus vom September 2026, dokumentieren aber eine fortbestehende kritische Haltung zu kommerziellen Closed-Source-Tools.
Signale
- Wachsende Tendenz: Bild- und videoähnliche Aufgaben mit GPT-6 Astra – Pelikan-SVGs und 3D-Rendering durch Blender-Steuerung – wurden unabhängig auf Reddit und Bluesky diskutiert und bildeten das größte plattformübergreifende Thema. Genau genommen geht es nicht um Diffusions-Bildgenerierung, sondern um ein neues Genre, in dem LLM-Agenten über Code und 3D-Tools Visuals erzeugen.
- Abgewertet oder kaum sichtbar: Open-Source-Themen waren extrem selten. Der einzige konkrete Fund war Qwen 3.7 27B bei lokaler Ausführung. Beiträge über FLUX, neue Stable-Diffusion-Versionen, Wan oder HunyuanVideo wurden auf Bluesky nicht gefunden.
- Überraschend: Während spezialisierte KI-Kunstaccounts, die bis Anfang 2025 aktiv waren, weitgehend verstummt sind, besteht und wächst mit aimod.social eine Infrastruktur zum automatischen Kennzeichnen verdächtiger KI-Bilder. Der Schwerpunkt der Bluesky-Debatte könnte sich vom Erstellen zum Erkennen und Moderieren verschoben haben.
- Widersprüchliche Signale: Konkrete Nachrichten über Videogenerierung handelten weniger vom Leistungswettbewerb der Modelle als vom Missbrauch in politischer Werbung beim Gouverneurswahlkampf in New York. KI-Video ist auf Bluesky eher als gesellschaftliches Problem sichtbar als als Techniktrend.
Limits
- Blueskys öffentliche Such-API (
app.bsky.feed.searchPosts) lieferte bei allen englischen und japanischen Suchanfragen – darunter „image generation AI“, „Stable Diffusion“, „Midjourney“, „Sora“, „Veo“ und „Kling“ – konsistent HTTP 403. Andere Endpunkte wieapp.bsky.actor.getProfileundapp.bsky.feed.getAuthorFeedfunktionierten in derselben Sitzung, was auf eine Authentifizierungspflicht oder Blockierung speziell des Suchendpunkts hindeutet. - Die Weboberfläche
bsky.app/searchist eine clientseitig gerenderte SPA. Posttexte sind nicht im HTML enthalten und ließen sich mit dem Webabrufwerkzeug nicht auslesen. - Deshalb konnte der vorgesehene Ablauf „Keyword-Suche → Beiträge lesen“ nicht durchgeführt werden. Stattdessen wurden die Feed-Verläufe bekannter Accounts wie simonwillison.net, 404media.co, petapixel.bsky.social, aimod.social, stablediffusion.bsky.social und bm63ai.bsky.social einzeln analysiert. Diese Stichprobe ersetzt keine umfassende Keyword-Suche.
- Erwartete Handles von OpenAI, Google DeepMind, Midjourney, Runway, Stability AI, Black Forest Labs, Krea, TechCrunch, The Verge, Ars Technica und Engadget existierten entweder nicht auf Bluesky oder enthielten keine passenden Bild-/Videogenerierungsbeiträge.
- Das Ziel von etwa 20 analysierten Posts pro Plattform wurde wegen der nicht verfügbaren Suche nicht erreicht. Tatsächlich konnten nur die acht oben beschriebenen Beiträge plus ein Referenzfall analysiert werden; in weiteren abgerufenen Feeds fanden sich keine passenden Posts.
- Konkrete Beiträge zu Open-Source-Modellen wie FLUX, neuen Stable-Diffusion-Versionen, Wan oder HunyuanVideo wurden nicht gefunden. Mit der verwendeten Methode lässt sich nicht unterscheiden, ob sie nicht diskutiert wurden oder wegen fehlender Suche übersehen wurden.
Lemmy
Lemmy — Nachrichten zur KI-Bild- und Videogenerierung
Lemmy ist ein föderiertes soziales Netzwerk und im Vergleich zu Reddit deutlich kleiner. Ein „viraler“ Beitrag erreicht hier nicht Hunderte Upvotes, sondern oft nur einige Dutzend. Dennoch ließen sich überraschend gehaltvolle Informationen finden. Besonders relevant waren !«メールアドレス» für ComfyUI- und Modell-Releases, !ai_reddit als Bot-Weiterveröffentlichung von r/ArtificialIntelligence sowie !technology und !techtakes mit stärker satirischem Ton. Die Suche erfolgte über lemmy.world/api/v3/search mit wechselnden Keywords.
Communities
!«メールアドレス»— 5.709 Abonnenten, davon 893 lokal. Zentrum für ComfyUI-Custom-Nodes und Modell-Releases, mit fast täglichen Beiträgen.!«メールアドレス»— 2.362 Abonnenten. Galerie für Arbeiten aus Stable Diffusion, Flux und Krea2.!«メールアドレス»— spezialisiert auf KI-Animekunst; Abonnentenzahl nicht veröffentlicht, Aktivität aber ähnlich hoch.!«メールアドレス»— 87.904 Abonnenten. Reposts großer Techartikel; auch die Midjourney-Kontroverse wurde dort diskutiert.!«メールアドレス»— 2.690 Abonnenten. Sarkastische Community zur KI-Branche, die Midjourneys mögliche Fehlentwicklung scharf kritisierte.!«メールアドレス»— RSS-Repost-Account von r/ArtificialIntelligence. Die Abonnentenzahl war über die API nicht verfügbar, aber die Community hatte die höchste Nachrichtendichte.!«メールアドレス»— 8.154 Abonnenten. KI-kritische Community, in der auch Artikel über Lieferketten generativer KI geteilt wurden.
Beiträge
Closed-Source-orientiert
- Midjourney wechselt angeblich zu medizinischem Ultraschallscanner „Midjourney Medical“ — 2026-06-18 bis 19, großes Thema in
!techtakesund!hackernews. The Register spottete über ein „golden-light cosmetic-medical spa“, pivot-to-ai.com verglich es mit einem Wechsel zu Theranos. Score 40–58.
https://lemmy.world/post/48384985 (Originalartikel: pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/) - Midjourney fordert von Hollywood-Studios Offenlegung ihres KI-Einsatzes — TechCrunch-Artikel, Score 73 in
!technology. Fortsetzung der Entwicklung rund um Urheberrechtsklagen.
https://lemmy.world/post/49069400 - Google veröffentlicht Nano Banana 2 Lite — leichtgewichtiges Bildgenerierungsmodell von DeepMind; Beiträge über
!hackernewsund das Schweizer Techmedium itmagazine.ch, 2026-06-30 bis 07-02.
https://lemmy.world/post/48857780 (deepmind.google/models/gemini-image/flash-lite/) - Microsofts MAI-Image-2.5 zieht in Benchmarks mit Nano Banana 2 gleich — über the-decoder.com,
!ai_reddit, 2026-05-28.
https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/ - Detaillierter Vergleich von ByteDance Seedream 5.0 Pro — hebt Bildbearbeitung und iterative Generierung hervor,
!ai_reddit, 2026-07-10.
https://www.reddit.com/gallery/1usc03q - Googles Earth-AI-Funktion einen Tag nach dem Start eingestellt — Nutzer überlagerten reale Orte mit gefälschten Bildern, worauf Fortune berichtete;
!ai_reddit, 2026-08-07.
https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/ - Runways Enterprise-Geschäft verdoppelt sich bei mehr als 300 % NRR — Bericht über das Wachstum des Videogenerierungsunternehmens im Unternehmenskundensegment,
!ai_reddit, 2026-08-30.
https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says-enterprise-business-doubled-nrr-over/ - Amnesty International kritisiert wichtige KI-Systeme als von Grund auf rechtswidrig — Kontext zunehmenden Regulierungsdrucks auf generative KI,
!ai_reddit, 2026-06-24.
https://reddit.com/r/ArtificialInteligence/comments/1ue64s2 - Pax Silica: Die Bewaffnung von KI-Lieferketten — Analyse des Wirtschaftskonflikts um KI-Chips und Rechenkapazität zwischen den USA und China, als geopolitisches Risiko großer Closed-Source-Techunternehmen; Score 14 in
!fuck_ai, 2026-09-06.
https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare - „Astra 6 max“ soll Kunst schaffen, die den Nutzer bewegt — philosophisch selbstreferenzielle Kunstgenerierung mit einem kommerziellen Closed-Source-Modell,
!ai_reddit, 2026-09-05.
https://i.redd.it/3h241pocalnh1.png
Open-Source-orientiert
- LLaDA-Image veröffentlicht — neues Modell aus einem 6B-Diffusion-Transformer und einem eingefrorenen Modul für visuell-sprachliches Verständnis, basierend auf LLaDA2.0-Mini. Bei Qwen-Image-Bench erreicht es SOTA-Werte von 53,53 auf Englisch und 53,38 auf Chinesisch. Die schnelle Variante „LLaDA-Image-Turbo“ generiert in zwei bis vier Schritten; Gewichte, Trainingscode und Rezepte sind vollständig offen.
!stable_diffusion, 2026-09-04.
https://lemmy.dbzer0.com/post/74988021 (Paper: arxiv.org/abs/2609.03796, Code: github.com/inclusionAI/LLaDA-Image) - Boogu-Image-0.1 veröffentlicht — Open-Model-Familie mit Varianten Base, Turbo und Edit, unter Apache-2.0 auch kommerziell frei nutzbar. Mit zehn Milliarden Parametern erzielte sie den höchsten Qwen-Image-Bench-Score unter Open-Source-Modellen: 53,58.
!stable_diffusion, 2026-06-17.
https://boogu.org/ (Paper: arxiv.org/abs/2607.13125) - ComfyUI-Ref2VA-VSA: Node zur schnelleren Inferenz für MiniMax H3 — beschleunigt Videogenerierung deutlich,
!stable_diffusion, 2026-09-08.
https://github.com/Kablex/ComfyUI-Ref2VA-VSA - ComfyUI-AetherScale: nativer Video-Upscaler für NVIDIA-GPUs —
!stable_diffusion, 2026-09-05.
https://github.com/vizart-vj/ComfyUI-AetherScale - ComfyUI-VDN-H3: hybride Video-Delta-Net-Attention — Node zur effizienteren Ausführung von Videogenerierungsmodellen,
!stable_diffusion, 2026-09-05.
https://github.com/Saganaki22/ComfyUI-VDN-H3 - ComfyUI-Majoor-OmniCam: Tool für Kameralayout und Animation — Node zur Steuerung von Kamerabewegungen in Bild- und Videogenerierung,
!stable_diffusion, 2026-09-04.
https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam - FastH3-Ref2V-Stream-Controller — Streaming-Steuerung für Videogenerierung der MiniMax-H3-Familie,
!stable_diffusion, 2026-09-04.
https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller - ComfyUI-InpaintCanvas: Inpainting-Oberfläche im Krita-Stil —
!stable_diffusion, 2026-09-08.
https://github.com/DenRakEiw/ComfyUI-InpaintCanvas - ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — drei unmittelbar nacheinander veröffentlichte Nodes zur Beschleunigung und Verschlankung von MiniMax-H3-Videomodellen, 2026-09-01 bis 02. Ein klares Zeichen für ein sehr aktives Open-Source-Ökosystem zur Videogenerierung.
https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE - InterleaveThinker: Reinforcement-Learning-Forschung für agentische, verschachtelte Generierung — ergänzt bestehenden Bildgenerierungsmodellen durch Multi-Agenten-Ansätze die Fähigkeit, Text und Bild schrittweise abwechselnd zu erzeugen.
!stable_diffusion, 2026-06-12.
https://arxiv.org/abs/2606.13679 - Viele Werke mit Flux/Krea2 turbo — in
!stable_diffusion_artund!share_anime_arterscheinen täglich mehrere KI-generierte Flux- und Krea2-Kunstwerke. Dies ist keine einzelne Nachricht, sondern ein anhaltendes Signal dafür, dass Open-Weight-Modelle im Alltag eingesetzt werden.
https://lemmy.dbzer0.com/post/75150630 u. a.
Signale
- Das größte Thema ist Midjourneys mögliche Fehlentwicklung. Die angebliche Hinwendung zu medizinischen Ultraschallscannern wurde in
!techtakesund!technologyintensiv diskutiert, allerdings überwiegend kritisch bis spöttisch. Unter den Closed-Source-Themen waren die Scores mit 40 bis 73 klar am höchsten. - Auf der Open-Source-Seite erschienen in derselben Woche fünf bis sechs ComfyUI-Nodes für MiniMax-H3-Videomodelle. Das entspricht einem typischen Muster, bei dem eine Entwicklergemeinschaft ein bestimmtes Videobasismodell gleichzeitig mit Optimierungen überzieht. Viele Entwicklernamen wirken ostasiatisch, was auf eine international verteilte Aktivität hindeutet.
- Qwen-Image-Bench fungiert als gemeinsamer Benchmark. LLaDA-Image mit 53,53 und Boogu-Image-0.1 mit 53,58 messen sich am selben Maßstab; der Leistungswettbewerb in Open Source wird dadurch direkt vergleichbar.
- Auch in KI-kritischen Communities wie
!fuck_aierscheinen Artikel zu geopolitischen Risiken von Closed-Source-Unternehmen. Das zeigt, dass generative KI über technische Communities hinaus diskutiert wird. - Lemmy hat eine kleine absolute Reichweite, weshalb ein Score in den 70ern bereits als große Nachricht gilt. Entscheidend ist die relative Resonanz, nicht der direkte Vergleich mit Reddit oder X.
Limits
- Lemmy ist föderiert und die Suche unterscheidet sich je Instanz. Über die API von
lemmy.worldwaren primär lokale Beiträge oder föderierte Beiträge anderer Instanzen sichtbar.lemm.eeundlemmy.mlwurden zwar punktuell über die Suchoberfläche geprüft, für die Erhebung aber nicht vollständig durchsucht. - Suchanfragen nach „Kling AI“, „Stability AI“, „Wan 2.2“ und „Runway Gen“ ergaben entweder keine oder irrelevante Treffer. Chinesische Videomodelle wie Kling und Wan sowie Stability AI waren auf Lemmy fast nicht sichtbar; Video-Themen erschienen überwiegend nur über MiniMax H3 in der ComfyUI-Entwicklercommunity.
!ai_redditist ein automatischer Repost-Bot für r/ArtificialIntelligence. Diese Inhalte sind keine originären Lemmy-Primärinformationen.- Das Ziel von rund 20 analysierten Beiträgen wurde zwar erreicht, die Gesamtmenge an Lemmy-Beiträgen ist jedoch im Vergleich zu Reddit und X erheblich geringer. Auch bei inhaltlich hochwertigen Primärinformationen ist die Plattform dünner besetzt.
Pinterest — Nachrichten zur KI-Bild- und Videogenerierung
Von 50 vorab gesammelten Pins (output/pinterest.pins.md / images/pinterest/manifest.json, ohne Genre-Kategorisierung und aus einer einzelnen Suche nach „Image and Video Generation AI News“) wurden 30 Bilder direkt geprüft. Die folgenden Erkenntnisse basieren auf diesen Inhalten.
Visuelle Themen
- Clickbait-artige „KI-News“-Thumbnails: Bilder überraschter bärtiger Männer neben neonfarbenen Tool-Logos ([11]), ein lächelnder Sam-Altman-ähnlicher Mann vor Explosionshintergrund ([19]) oder halb-robotische männliche Nachrichtensprecher mit „B“-Mikrofon ([44]) treten häufig auf. Meist führen die Pins zu YouTube-Videos statt zu eigentlichen Artikeln.
- Infografiken mit Ranglisten der besten Closed-Source-Produkte: Wiederholt erscheinen Neon-Listen mit Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo AI, HeyGen, Synthesia, InVideo, Sora und Google Veo [9, 27, 33]. Ein ähnliches Format für Bildgenerierung listet ChatGPT, Nano Banana, Ideogram, GenTube und Z-Image [36].
- KI-Roboter und Nachrichtensprecher als Personifikationen: Roboter am Nachrichtentisch ([32]), synthetische weibliche Moderatorinnen ([38, 49]) und medizinische Szenen mit Robotern neben Pflegepersonal oder Menschen ([50]) zeigen eher die Metapher „KI übernimmt menschliche Rollen“ als tatsächliche Tool-Oberflächen.
- Bilder, die Ängste vor Deepfakes und fehlender Echtheit auslösen: Ein Katzenfoto mit „FAKE“-Stempel und Like-Zahl ([3]), ein „Which is AI?“-Vergleich zweier Bergbilder ([10]) sowie KI-Detektoransichten mit „97% likely AI generated“ ([25, 35]) behandeln Erkennung und Zweifel statt Generierung.
- Unpersönliche Stock-Visuals zu KI: Generische Bilder in Violett und Blau mit Gehirnkonturen, Leiterplatten und Partikeleffekten hinter Überschriften ([2, 4, 5, 15, 20, 30]) dienen als dekorative „KI-Optik“, meist ohne konkrete Produktnamen oder Screenshots.
- Vorher-Nachher-Demos für Image-to-Video: Vergleichsraster verwandeln ein Foto oder Video in LEGO-, Origami-, Blumen- oder Spielzeugauto-Stile ([7]); andere zeigen, wie aus einem Foto eine fünfteilige Video-Timeline entsteht ([1, 6]).
- Reale Produktnamen sind präsent, aber fast ausschließlich Closed Source: Veo 2/3 ([13, 24]), VASA-1 von Microsoft Research ([41]), Grok ([32]), Sora, ChatGPT und Nano Banana ([36]) werden genannt. Unter den 30 geprüften Pins erschien kein nachweislicher Name eines Open-Source-Modells oder Repositorys.
- Infografiken für automatisierte KI-Pipelines: Ein Ablaufbild zeigt, wie ein viraler Videolink über vier Agenten – „Scout → Script → Generate → Animate“ – automatisch zu einem Vlog wird ([47]). Es deutet auf den Übergang von einzelnen Videotools zu automatisierten Workflows hin.
Auffällige Pins
- [1] Image to Video AI: How It Works and Why It Matters — technisch konkretster Pin: Er erklärt, wie aus einem einzelnen Standbild über Regler für Bewegungsstärke, zeitliche Konsistenz und visuelle Kontrolle eine Video-Timeline entsteht.
- [7] (ohne Titel, LEGO-/Origami-/Blumen-Transformationsraster) — ein 3×5-Vorher-Nachher-Raster, das Ausgangsvideos mit Personen, einem Panda-Stofftier und Tesla in Holzblock-, Origami-, LEGO- und Blumenstile verwandelt. Eine der wenigen Demos mit sichtbaren Generierungsergebnissen.
- [9] 10 FREE AI VIDEO TOOLS IN 2026 — listet Pictory, Runway ML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canva und Hyperwrite als zehn kostenlose KI-Videotools und bietet einen Überblick über ihre Gratisangebote.
- [24] (ohne Titel, Image-to-Video mit lila Monsterfigur) — stellt drei Outputvideos gegenüber, die dasselbe Eingabebild in völlig verschiedene Hintergründe wie Serverraum, Unterwasserruinen und Bonbonstadt setzen. Der Titel bezieht sich auf Veo 3.
- [27] 5+ Best AI Video Generation Websites — vergleicht Runway, Pika, Kling AI, Luma, Canva und Hailuo. Der Pin nennt ausdrücklich YouTube Shorts, TikTok, Pinterest-Video-Pins und Produktvideos als Einsatzbereiche und zeigt damit Pinterest selbst als vorgesehenen Distributionsort.
- [36] Top AI Image Generation Tools — listet ChatGPT, Nano Banana, GenTube, Ideogram und Z-Image. Neuere Namen wie Nano Banana und Z-Image sind damit auch in Pinterest-SEO-Inhalten angekommen.
- [39] The Latest AI Developments (dreiteilige Eilmeldungsoptik) — der einzige Pin, der drei konkrete Nachrichten mit spezifischen Fällen und Organisationen bündelt: eine KI als erste Antwort bei Notrufen in New Orleans, Metas kostenlose Veröffentlichung des Offline-Agentenmodells Muse Glimmer und die automatisierte Erstellung von Phishing-Dokumenten durch Nordkoreas Kimsuky mit eigenem KI-Stack.
- [41] Microsoft Unveils VASA-1 — Diagramm einer Microsoft-Research-Demo, die aus einem Bild und einem Audioclip, optional ergänzt durch Signale zur Mimiksteuerung, Echtzeit-Gesichtsanimation für Gespräche mehrerer Personen erzeugt.
- [16] AI Image Video: Best Quality vs Best Free — Entscheidungshilfe, die ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber und Synthesia mit Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape und CapCut als kostenfreie Alternativen kontrastiert. Sie behandelt Kriterien wie Textlesbarkeit, GPU-Verfügbarkeit und Bedarf an SVG-Bearbeitung.
- [47] AI video creation just got crazy — beschreibt eine automatisierte Pipeline mit „Scout → Script → Generate → Animate“, die aus einem viralen Videolink einen fertigen Vlog macht und damit über Einzelfunktionen hinausgeht.
Signale
- Das Pinterest-Thema „Image and Video Generation AI“ besteht überwiegend aus SEO- und Affiliate-orientierten Toolvergleichen sowie How-to-Infografiken, nicht aus aktuellen Nachrichten. Direkte Links zu Primärquellen wie offiziellen Ankündigungen, Papers oder Social-Media-Posts fehlen fast vollständig; die meisten Pins leiten zu Blogs oder YouTube weiter.
- Als konkrete Nachrichtenfälle erschienen lediglich die drei Meldungen in [39] – KI für 911-Notrufe, Meta Muse Glimmer und Nordkoreas Kimsuky – sowie Pins zu Produktankündigungen rund um Veo 2/3, VASA-1 und Grok. Primärinformationen im Umfang von etwa 20 aktuellen Nachrichten waren begrenzt.
- Closed Source dominiert deutlich: Runway, Pika, Kling AI, Luma, Canva, Hailuo, HeyGen, Synthesia, Sora, Veo, ChatGPT, Nano Banana und Ideogram tauchen wiederholt auf. Open-Source-Modell- oder Projektnamen fehlen in den geprüften Inhalten vollständig, etwa Stable Diffusion, ComfyUI und Open-Sora. Pinterest ist daher als Quelle für Open-Source-Entwicklungen schwach.
- Darstellungen von KI als Ersatz für menschliche Rollen – Nachrichtensprecher, Pflegepersonal und 911-Operatoren – stehen neben Bildern, die die Echtheit generierter Inhalte anzweifeln – FAKE-Stempel, „Which is AI?“-Fragen und Detektoren. Soziale Auswirkungen und Vertrauensprobleme stehen mindestens ebenso stark im Mittelpunkt wie die Technik.
- Als Videogenerierungsanwendung fallen besonders Transformationen auf: Fotos animieren oder bestehende Videos in LEGO- oder Origami-Stile übertragen. Gegenüber vollständigem Text-to-Video werden Bild-/Video-zu-Video-Anwendungen stärker vermarktet.
Limits
- Die 50 vorab gesammelten Pins waren nicht nach Genres getrennt; das Feld
genrewar überall leer. Alle stammten aus einer einzigen Suchanfrage, nicht aus gezielt getrennten Closed-Source- und Open-Source-Suchen. - Aus Zeitgründen wurden nur 30 der 50 Bilder direkt geöffnet. Nicht geprüft wurden unter anderem die Indizes 14, 15, 18, 21, 22, 26, 28, 29, 31, 37, 40, 42, 43, 45 und 48. Ihre Titel überschneiden sich jedoch meist mit bereits beobachteten Themen wie Lip-Sync- und Videobearbeitungstools oder KI-Inhaltserkennung; ein gegenteiliger Trend war nicht sichtbar.
- Pinterest wurde nicht direkt durchstöbert. Die Bewertung basiert ausschließlich auf den vorab gesammelten Bildern und Titeln. Veröffentlichungsdaten und Interaktionszahlen wie Likes oder Saves fehlen in Manifest und Pin-Tabelle, sodass weder Aktualität noch Reichweite beurteilt werden können.
- Da auf Pinterest keine aussagekräftigen Open-Source-Hinweise gefunden wurden, darf die Plattform nicht als Grundlage für Aussagen zu Open-Source-Entwicklungen im späteren Gesamtbericht dienen.
Empfohlene Maßnahmen
- Agentische visuelle Generierung mit GPT-6 Astra, einschließlich Blender-Steuerung und 3D-Stadtgenerierung, als eigenes Beobachtungsthema fortlaufend verfolgen.
- Bei künftigen plattformübergreifenden Recherchen zusätzlich nach konkreten Namen wie „FLUX“, „Stable Diffusion“, „Qwen-Image“, „Wan“ und „ComfyUI“ suchen, um Open-Source-Ankündigungen nicht zu verpassen.
- Für Bluesky eine größere Liste überwachsamer Accounts vorbereiten, da 403-Fehler der Such-API voraussichtlich fortbestehen.
- Pinterest wegen fehlender Veröffentlichungs- und Interaktionsdaten nicht für zeitkritische Eilmeldungsvergleiche einsetzen, sondern auf die langfristige Beobachtung der Tool-Bekanntheit beschränken.
- Die Kontroverse um Midjourneys angeblichen Wechsel zu medizinischen Geräten bis zu einer Primärquelle, etwa einer offiziellen Midjourney-Ankündigung, nicht definitiv zitieren.
- Lemmys
!stable_diffusionund YouTube-Testkanäle bei der Beobachtung von Open Source prioritär prüfen.
Gesammelte Bilder


















































Hinweise zur Datenqualität
Bluesky erreichte wegen der dauerhaft 403 liefernden Such-API nicht das Ziel von 20 Beiträgen. Bei Pinterest fehlten Veröffentlichungsdaten und Interaktionszahlen, sodass die Aktualität nicht beurteilt werden konnte. Reddit und X nutzten nur einen einzelnen Suchbegriff und ermöglichten damit keinen absichtlichen Closed-Source-/Open-Source-Vergleich. Open-Source-Themen konzentrierten sich deshalb auf Lemmy und YouTube.



