Aktuelle Nachrichten zu Bild- und Video-KI — 2026-09-13
Während OpenAI Sora seine API Ende dieses Monats einstellt und sich zurückzieht, werden Googles Nano Banana Pro/Veo 3.1 sowie die chinesischen Modelle Seedance 2.5/Kling 3.0 zu den geschlossenen Hauptakteuren. Open Source ist mit Wan2.2, FLUX.2 und Qwen Image in eine Produktionsphase eingetreten, in der diese Modelle als praxistauglicher Stand der Technik etabliert sind.
Aktuelle Nachrichten zu Bild- und Video-KI — 2026-09-13
Alles klar: Ich habe alle sechs sozialen Netzwerke (Reddit, X, YouTube, Bluesky, Lemmy und Pinterest) durchforstet 🔥 Unterm Strich findet bei den Closed-Source-Anbietern gerade ein kompletter Führungswechsel statt. OpenAIs Sora wird mitsamt API am 24. September eingestellt; stattdessen werden Googles Veo 3.1 und Nano Banana Pro (Gemini 3 Pro Image) sowie ByteDances Seedance 2.5 und Alibabas Kling 3.0 ernsthaft als die aktuell wichtigsten Tools gefeiert 😳 Gleichzeitig sind Wan2.2, FLUX.2, Qwen Image und LTX im Open-Source-Bereich zu festen Größen geworden. Sie gelten nicht mehr als Spielzeug, sondern werden als echte SOTA-Modelle direkt mit den geschlossenen Angeboten verglichen 💪 Die Datenerhebung für X und Bluesky lief allerdings nicht gut, daher ist die Informationslage dort dünn.
Plattformübergreifend
- Sora-Ende → Google und China übernehmen: Reddit, YouTube, Lemmy und Pinterest erzählen übereinstimmend dieselbe Geschichte: „OpenAI Sora wird zurückgefahren bzw. eingestellt, Wechsel zu Veo/Nano Banana Pro/Seedance/Kling.“ Laut YouTube behandelt 2026 kein Video Sora mehr als ein Tool, das man im Auge behalten sollte (YouTube #1). Auf Lemmy fand sich zudem die Meldung „OpenAI fährt Sora zurück, ein 30-Millionen-Dollar-KI-Filmprojekt ist gescheitert“ (Lemmy #9).
- Nano Banana Pro (Gemini 3 Pro Image) dominiert die Diskussion als absolute Spitzenklasse: Mehrere YouTube-Kanäle reagierten gleichzeitig mit Titeln wie „INSANE“ oder „TERRIFYING“ (YouTube #2); auf Bluesky wird die Wasserzeichenerkennung diskutiert (Bluesky #1); und auf Reddit tauchte das Modell mit dem konkreten Preis von 0,039 US-Dollar pro Bild auf. Dass drei Plattformen unabhängig voneinander auf dasselbe Modell anspringen, ist ein sehr starkes Signal 💥
- Open Source ist in die Produktionsphase eingetreten: Lemmy verfolgt beinahe täglich neue Modelle und Adapter für FLUX, MiniMax H3, LTX-2.5 und Boogu-Image-0.1 (Lemmy #4); YouTube bezeichnet Wan2.2, FLUX und Qwen Image klar als lokalen SOTA (YouTube #10). VRAM-Optimierungen für private GPUs, etwa 24-GB-Versionen, stoßen auf sehr großes Interesse.
- Chinesische Videomodelle sind überall im Aufwind: Seedance 2.5 (ByteDance) und Kling 3.0 (Alibaba) werden auf Reddit, YouTube, Lemmy und Pinterest genannt. Auf Pinterest erscheinen sie sogar in reißerischen Beiträgen mit Titeln wie „China Just Took AI Video Too Far“ und filmplakatartigen Visuals (Pinterest #42 entsprechender Eintrag; Original ist ein Pinterest-Bild).
- Die Sorge „echt oder gefälscht?“ wächst langsam: Reddits r/isthisAI mit 410.000 Mitgliedern ist als Spezial-Community zum Erkennen generierter Inhalte präsent. Auch Pinterest zeigt mehrere Bilder mit „FAKE“-Stempel und „Which is AI?“-Quizzen. Zudem wird diskutiert, dass Apples neues iPhone Aufnahmezeitpunkt-Daten zur Prüfung von KI-Manipulationen speichern soll. Überraschend ist, dass neben der Generierung selbst auch das Erkennen von KI-Inhalten zunehmend Aufmerksamkeit bekommt.
Nach Plattformen
Reddit: Analysiert wurden zwölf Threads aus acht Subreddits. Auffällig waren organische Erwähnungen von „uncensored“-Aggregatoren, die etwa Seedream, Kling, Veo und GPT Image bündeln und weiterverkaufen (WildOwl u. a.), sowie starkes Misstrauen gegenüber Video-Abos, die mit „unbegrenzt“ werben. Der höchste Wert beim Engagement (4.841 Punkte) entfiel nicht auf eine Tool-Meldung, sondern auf einen Fall, in dem ein auf KI-generiertem Bildmaterial beruhender Ragebait durch Community Notes entlarvt wurde – sehr typisch Reddit 😂 Threads, die Open-Source-Entwicklungen direkt behandeln, gab es dagegen fast keine; das ist unter den sechs Plattformen eine klare Lücke.
X: Ehrlich gesagt war diese Erhebung fast ein Totalausfall 😇 Die 40 eingesammelten Beiträge waren tatsächlich Ergebnisse zu kroatischen X-Explore-Trendbegriffen wie Slack, Chelsea oder Houthis und hatten nichts mit Bild- oder Video-KI zu tun. Gerade noch thematisch angrenzend waren ein Post über den Coding-Agenten Cursor und ein Post über eine in China modifizierte RTX 5090 mit 96 GB für lokale KI. Von den im Brief geforderten ungefähr 20 analysierten Beiträgen ist das weit entfernt; zu X gibt es diesmal fast keine belastbaren Erkenntnisse.
YouTube: Es wurden zwölf Videos geprüft; unter den sechs Plattformen war die Informationsdichte hier am höchsten. Konkret auffindbar waren das Sora-Ende, die enthusiastischen Reaktionen auf Nano Banana Pro, direkte Vergleiche Kling 3.0 vs. Veo 3.1 vs. Runway Gen-4.5 sowie die komplexe Lizenzstaffel von FLUX.2 – von Apache-2.0-Schnell/Klein über nicht kommerziell nutzbares Dev bis zu kostenpflichtigem Pro/Flex. Da die YouTube-Seiten per JavaScript gerendert werden, ließen sich Live-Zahlen für Aufrufe und Abonnenten jedoch nicht direkt abrufen und mussten aus Sekundärquellen stammen.
Bluesky: Die offizielle Such-API war mit 403 gesperrt; über Link-Vorschauen ließen sich nur fünf Beiträge wiederherstellen. Trotzdem fanden sich sowohl Closed-Source-Themen wie Google Veo 3, Nano Banana Pro und SynthID-Wasserzeichenerkennung als auch ein Open-Source-Post eines Creators mit Stable Diffusion (RealisticVision). Interessant ist außerdem, dass Blueskys Grundsatz, Nutzerinhalte nicht zum KI-Training zu verwenden, die Haltung gegenüber KI-generierten Inhalten vorsichtiger erscheinen lässt als auf Reddit oder X.
Lemmy: Im Zentrum stand !«メールアドレス»; es wurden 16 Beiträge gesammelt und damit das Ziel von 20 nicht ganz erreicht. Open Source wirkt hier wie eine Produktionslinie: FLUX 3, MiniMax H3, LTX-2.5 und Boogu-Image-0.1 erscheinen nahezu täglich. Bei Closed Source stechen hingegen eher problematische Meldungen hervor: Soras Rückbau, Googles nach einem Tag gestopptes Earth AI und spöttische Artikel über Midjourneys Wechsel in den Bereich Medizintechnik. Lemmy insgesamt hat einen deutlich skeptischen Ton gegenüber dem KI-Hype.
Pinterest: Analysiert wurden 50 Pins. Der Großteil bestand aus affiliate-artigen Infografiken im Stil von „Best 5 AI Video Tools“ und nicht aus Galerien von KI-Werken. Chinesische Modelle wie Seedance und Vidu S1 werden mit glänzenden, filmplakatartigen Visuals inszeniert – ein Kontrast zu den flachen Vergleichstabellen westlicher Tools. Open-Source-Präsentationen, etwa ComfyUI-Oberflächen, fehlten völlig; Stable Video Diffusion wurde nur ein einziges Mal genannt. Auch Kennzahlen wie Likes oder Saves waren nicht verfügbar.
Beobachten
- Sora-API-Ende (24.09.2026) — OpenAIs Sora API wird Ende dieses Monats vollständig abgeschaltet. Entscheidend wird sein, ob die Migration vor allem zu Veo, Seedance oder Kling geht (YouTube).
- Die Lizenzstaffel von FLUX.2 — Schnell/Klein sind kostenlos, Dev ist nicht kommerziell, Pro/Flex kostenpflichtig. Diese Unterscheidung etabliert sich als wichtiger Hinweis für Menschen mit kommerziellen Anwendungsfällen (YouTube).
- Ob Wan 3.0 (Alibaba) Open Weights erhält — Das neue Modell unterstützt native 30-Sekunden-Videos, gilt derzeit aber als nicht offen gewichtet. Bestätigte Informationen stehen noch aus (YouTube #Limits).
- Kennzeichnungspflicht nach Artikel 50 des EU AI Act (seit 02.08.2026) — Die Pflicht zur maschinenlesbaren Kennzeichnung von für die EU veröffentlichten KI-Videos wird in der Creator-Szene zunehmend als neue Einschränkung diskutiert.
- Entwicklung von „uncensored“-Aggregatoren (WildOwl u. a.) — Dienste, die Seedream, Kling, Veo und GPT Image bündeln und weiterverkaufen, gewinnen auf Reddit organisch Unterstützung (Reddit).
- Verbreitung von Echtheitsprüfungen — Zu beobachten bleibt, wie weit sich Technologien zur KI-Erkennung wie die Aufnahmezeitpunkt-Daten des iPhone 18 Pro und SynthID-Erkennung durchsetzen.
Empfehlungen
- Bei der nächsten X-Phase die Logik so ändern, dass direkt nach Schlüsselbegriffen zu Bild-/Video-KI gesucht wird statt nach regionalen Trendbegriffen.
- Für Bluesky einen Erhebungsweg über eine authentifizierte Sitzung vorbereiten, da die offizielle Such-API mit 403 blockiert ist.
- Lemmy instanzübergreifend durchsuchen, etwa
lemmy.mlundlemm.ee, um sich einer vollständigen Analyse von 20 Beiträgen zu nähern. - Nach dem Sora-API-Ende am 24. September die tatsächlichen Migrationsziele in den nächsten Reddit- und YouTube-Phasen verfolgen.
- Für Pinterest eine Erhebungsmethode prüfen, die Engagement-Kennzahlen wie Likes und Saves liefert, damit Popularität belegbar wird.
- Informationen zur kommerziellen Nutzbarkeit, etwa die FLUX-Lizenzstaffel, als festen Beobachtungspunkt für Open-Source-Reports etablieren.
Datenqualität
X war nahezu ein kompletter Fehlschlag: Alle 40 gesammelten Beiträge waren themenfremd, sodass nur zwei praktisch verwendbar waren. Auch Bluesky war wegen der mit 403 blockierten offiziellen API auf fünf verifizierbare Beiträge ohne Engagement-Kennzahlen beschränkt. Lemmy erreichte wegen eingestreuten Stördaten nur 16 statt der angestrebten 20 Beiträge. Reddit, YouTube und Pinterest lieferten ausreichend Daten, doch Reddit erfasste Open-Source-Entwicklungen kaum, Pinterest keinerlei Popularitätskennzahlen wie Likes oder Saves, und YouTube keine Live-Werte für Aufrufe und Abonnements.
Zusammenfassung nach Plattformen
Reddit — Nachrichten zu Bild- und Video-KI
Wo darüber gesprochen wird
Für die Suchanfrage „Image and Video Generation AI News“ wurden zwölf Threads aus acht Subreddits gesammelt.
| Subreddit | Mitglieder | Gesammelte Threads |
|---|---|---|
| r/AItips101 | 1.350 | 1 |
| r/aivideomaking | 6.871 | 3 |
| r/generativeAI | 152.676 | 3 |
| r/Seedance_AI | 20.826 | 1 |
| r/AIdaily_news | 2.002 | 1 |
| r/isthisAI | 410.165 | 1 |
| r/AIVideos_SFW | 25.950 | 1 |
| r/GetNoted | 298.687 | 1 |
Die beiden größten Communities, r/isthisAI (410.000) und r/GetNoted (298.700), sind keine Spezialforen für KI-generierte Inhalte selbst. Sie dienen vielmehr dazu, festzustellen, ob etwas KI-generiert ist, oder mit KI erzeugte Desinformation offenzulegen. Die stärker spezialisierten Subreddits r/aivideomaking und r/generativeAI liegen bei 10.000 bis 150.000 Mitgliedern und drehen sich hauptsächlich um die Suche nach praktischen Tools – kostenlosen Kontingenten, Preisen und fehlender Zensur.
Reaktionen und Meinungen
- Thread #1 (r/AItips101, 161 Punkte, 103 Kommentare, 07.09.2026) https://www.reddit.com/r/AItips101/comments/1w9yftp/ — In einem „Ranking unzensierter KI-Bildgeneratoren 2026“ landet WildOwl.ai auf Platz eins. Die Plattform bündelt mehr als 35 Closed-Source-Modelle wie Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo und GPT Image und hebt lockere Filter als Stärke hervor. Der Top-Kommentar von u/randmar (14 Punkte) bemängelte sofort das Fehlen von Seedream 5.0 Pro.
- Thread #5 (r/generativeAI, 1 Punkt, 12 Kommentare, 07.09.2026) https://www.reddit.com/r/generativeAI/comments/1wa4k88/ — Auf die Frage nach dem günstigsten unbegrenzten 1080p-Bild-zu-Video-Dienst antwortete u/ai_art_is_art (3 Punkte): „Unbegrenzt ist eine Lüge. Man zahlt 550 Dollar, bekommt 200 Dollar heraus und muss zwischen den Generierungen 24 Stunden warten.“ Auch für High-Tier-Pläne wie Runway wurden konkrete Preise von 76 bis 95 US-Dollar monatlich genannt.
- Thread #6 (r/Seedance_AI, 0 Punkte, 22 Kommentare, 07.09.2026) https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/ — Zur rechtlichen Verantwortung bei Videos mit Prominenten schrieb u/Jean_velvet (7 Punkte): „Jüngere Gerichtsentscheidungen sehen die Verantwortung beim Nutzer ... Die potenzielle Straftat ist die Verbreitung und Weitergabe.“
- Thread #7 (r/AIdaily_news, 42 Punkte, 76 Kommentare, 11.09.2026) https://www.reddit.com/r/AIdaily_news/comments/1wdkanm/ — Berichtet wurde, dass das iPhone 18 Pro Aufnahmezeitpunkt-Daten speichern soll, mit denen KI-Manipulationen geprüft werden können. Der Top-Kommentar von u/Not_my_Name464 (7 Punkte) spottete, das sei ein Vorwand, Cloud-Speicher aufzublähen und Zusatzgebühren zu verlangen. u/pianoboy777 (2 Punkte) äußerte Skepsis, Apple wolle am Ende nur Bilder als Trainingsdaten einsammeln.
- Thread #8 (r/isthisAI, 0 Punkte, 31 Kommentare, 09.09.2026) https://www.reddit.com/r/isthisAI/comments/1wbspxo/ — Auf die Frage „Ist dieses Video KI oder echt?“ bemerkte u/smalltiddygothb (16 Punkte): „Bin ich verrückt, oder verschwindet die Halskette und taucht wieder auf?“ u/EmergencyWaffleBox (14 Punkte) wertete dieselbe Inkonsistenz als Beleg für KI.
- Thread #10 (r/AIVideos_SFW, 2 Punkte, 1 Kommentar, 13.09.2026) https://www.reddit.com/r/AIVideos_SFW/comments/1wet79p/ — Ein nachrichtensendungsähnliches Video wurde in Google Flow über 16 Clips hinweg mit demselben KI-Moderator, Set und Kostüm konsistent erzeugt. Der Autor u/presentofai erläuterte detailliert seine „reuse-prompt pipeline“: Figur per wiederverwendetem Prompt fixieren, nicht zum Skript passende Takes automatisch neu generieren sowie Untertitel, Chyron, Publikumslachen und Musik-Ducking aus wortgenauen Zeitstempeln mit ffmpeg zusammensetzen.
- Thread #11 (r/generativeAI, 0 Punkte, 31 Kommentare, 10.09.2026) https://www.reddit.com/r/generativeAI/comments/1wced4g/ — Zur Frage „Wie wird das gemacht?!“ erklärte u/lagbit_original (3 Punkte), mit Seedance 2.5, einem einzelnen Prompt, passenden Referenzbildern sowie einigen Schnitten in Musik- und Bearbeitungssoftware lasse sich dasselbe Ergebnis erzielen.
- Thread #12 (r/GetNoted, 4.841 Punkte, 348 Kommentare, 10.09.2026) https://www.reddit.com/r/GetNoted/comments/1wcw3n9/ — Mit weitem Abstand der höchste Wert im Datensatz. Ein X-Beitrag wollte mit einem KI-generierten Stundenplanbild Empörung schüren; Community Notes wiesen darauf hin. Darin waren Wörter wie „Handloags“ und „BCDDs“ verstümmelt. u/Competitive-Bee-3250 (193 Punkte) spottete: „Wie bitte, verstümmelter Text? Das ist doch ganz offensichtlich das sehr reale Alphabet.“ Die fehlerhaften Schriftzeichen wurden damit unmittelbar als Beleg für KI-Generierung entlarvt.
- Thread #2 bis #4 (r/aivideomaking, 10/16/4 Punkte, 06.–09.09.2026) https://www.reddit.com/r/aivideomaking/comments/1w953eo/ 、https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/ 、https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/ — Drei Beiträge hintereinander fragten nach „kostenloser, unbegrenzter Video-KI“. u/balltongueee (1 Punkt, Thread #2) schrieb: „Nicht ein einziger Dienst ist kostenlos, und ich kann mir nicht vorstellen, dass das in absehbarer Zukunft einer sein wird.“ u/NewLifeWares (2 Punkte, Thread #3) erklärte zu der Anforderung eines 45-Sekunden-Videos, dafür sei Rechenzentrum-Hardware nötig; realistisch könne man nur Fünf-Sekunden-Clips verbinden. Vorgeschlagen wurde auch ein Workflow allein mit kostenlosen Kontingenten: ElevenLabs für Audio, Suno für Musik, Flux1 für Charakterreferenzen, Veo/Kling für Bildmaterial und DaVinci Resolve für den Schnitt (u/haz__man, Thread #2).
- Thread #9 (r/generativeAI, 0 Punkte, 6 Kommentare, 07.09.2026) https://www.reddit.com/r/generativeAI/comments/1w9fomb/ — Auf die Frage nach einem SFW-Bildbearbeitungstool nannte u/magicdoorai (1 Punkt) konkrete Stückpreise: Google Nano Banana 2 (0,039 US-Dollar/Bild), Flux.1 Kontext Pro (0,04 US-Dollar/Bild) und ChatGPT Image 2 (0,15 US-Dollar/Bild).
Signale
- Im Aufstieg: In mehreren Threads werden Aggregator-Dienste wie WildOwl, cyberbara und Venice organisch erwähnt. Sie bündeln und verkaufen Closed-Source-Modelle wie Seedream, Kling, Veo, GPT Image und Seedance mit „unzensiert“ bzw. lockeren Filtern als Verkaufsargument weiter. Die faktische Closed-Source-Dynamik auf Reddit spielt sich dadurch im Wettbewerb dieser Wiederverkäufer-Schicht ab.
- Im Aufstieg: Bild- und Videoauthentizität – Aufnahmezeitpunkt-Daten von Apple und schon die Existenz des Subreddits r/isthisAI – entwickelt sich zu einem eigenständigen Thema. Das Interesse gilt weniger der Generierung als der Erkennung und Prüfung, was sich auch in der Community-Größe von 410.000 Mitgliedern zeigt.
- Wird verworfen: Video-Generator-Abos mit dem Versprechen „unbegrenzt“ werden in Thread #5 und #2–#4 durchgehend als Lüge oder unrealistisch abgetan. Das Misstrauen gegenüber preisgetriebenem Marketing ist groß.
- Überraschend: Das höchste Engagement im Datensatz (4.841 Punkte / 348 Kommentare, Thread #12) betraf keine Nachricht zu einem generativen KI-Tool, sondern einen durch Community Notes aufgeklärten Fall von KI-basiertem Ragebait. Auf Reddit wird Bild- und Video-KI offenbar besonders dann groß, wenn generierte Inhalte missbraucht und anschließend entlarvt werden.
- Konflikt: Bei der Erstellung von Prominenten-Videos und rechtlicher Verantwortung vertritt u/Jean_velvet in Thread #6 die Position, verantwortlich sei die Person, die Inhalte teile bzw. verbreite. u/Alchemist42 deutet dagegen an, Seedance werde dafür gar nicht verwendet, weil Prominentengenerierung offiziell nicht möglich sei. Die Fragen „Mit welchem Tool ist es technisch möglich?“ und „Wer ist rechtlich verantwortlich?“ laufen dabei getrennt nebeneinander her.
- Unterversorgter Bereich: Threads, die Open-Source-Entwicklungen ausdrücklich behandeln, fehlen fast vollständig. ComfyUI, Flux1 und lokale Generierung kommen zwar vor (Thread #2 und #4), aber nur als Ausweichmöglichkeit nach verbrauchten kostenlosen Kontingenten; aktuelle Nachrichten zu den Open-Source-Modellen selbst waren nicht Teil der Sammlung.
Einschränkungen
- Als Suchbegriff wurde ausschließlich „Image and Video Generation AI News“ verwendet. Der Worker sammelte Threads aus dessen Suchergebnissen. Es erfolgte keine gezielte Suche nach Open-Source-Modellen wie Stable Diffusion, Flux selbst, Wan oder HunyuanVideo und auch nicht nach Spezial-Subreddits wie r/StableDiffusion. Der Bericht ist daher zu Closed-Source-Trends verzerrt.
- Pro Thread wurden nur bis zu sechs Kommentare extrahiert. Bei den tatsächlichen Kommentarzahlen – etwa 348 in Thread #12 oder 76 in Thread #7 – ist also nur ein kleiner oberer Ausschnitt sichtbar.
- In den gesammelten Dateien fehlen bei einigen Threads die Beitragstexte der Subreddits (#2, #6, #9, #11). Dort stützt sich die Bewertung nur auf Kommentare.
- Alle Beiträge stammen aus ungefähr der letzten Woche, dem Zeitraum 06.09.–13.09.2026. Frühere Trends liegen außerhalb des Erhebungsbereichs.
X
X — Nachrichten zu Bild- und Video-KI
Die Trend-Liste im Kopf von output/x.posts.md ist auf Kroatien lokalisiert (Serverstandort der Sitzung). Sie zeigt die Trends eines Landes, nicht globale Trends. Keiner der zehn Begriffe („Slack“, „$SONG“, „Saudi“, „Chelsea“, „China“, „Yemen“, „The OS“, „London“, „Correct“, „Houthis“) bezieht sich auf Bild- oder Video-KI. Der Worker suchte genau nach diesen zehn Begriffen und sammelte daraufhin 40 Beiträge von 37 Accounts. Damit wurde X nie tatsächlich nach dem Forschungsthema durchsucht – siehe ## Einschränkungen für die Folgen.
Accounts
Keiner der 37 Accounts im gesammelten Satz ist ein spezialisierter KI-Account. Zwei sind erwähnenswert, weil ihre Beiträge das Thema streifen:
- @akira_papa_IT (あきらパパ【生成AI活用エンジニア&3児のパパ】) — bezeichnet sich selbst als „Generative-AI-Ingenieur und Vater von drei Kindern“, ein Beitrag, 6 Likes. Schreibt über KI-Coding-Tools wie Cursor, nicht über Bild-/Videogenerierung.
- @C_of_Creativity (PIYO) — ein Beitrag, 1.421 Likes, ca. 200.000 Aufrufe, über eine in China modifizierte Nvidia-GPU. Japanischsprachige Beiträge über Hardware zum lokalen Ausführen generativer Modelle.
Alle übrigen Accounts in der Liste (@Osinttechnical, @IranTimes72/01, @MOSSADil, @the_Lawrenz, @_kobbyphocus, @Rusia_HD, @PrakazVijay_Of, @ActorVijayTeam usw.) posten über Angriffe auf saudische Pipelines, den Konflikt im Jemen bzw. mit den Houthis, Chelsea FC, BBNaija oder den London-Auftritt eines tamilischen Schauspielers – keine davon sind Creators, Unternehmen oder Kommentatoren mit Bezug zu Closed- oder Open-Source-Bild-/Video-KI.
Beiträge
Nur zwei der 40 gesammelten Beiträge berühren das Thema überhaupt; keiner davon handelt unmittelbar von Bild- oder Video-KI:
-
@akira_papa_IT, 11.09.2026, 6 Likes · ca. 1.100 Aufrufe —
https://x.com/akira_papa_IT/status/2098270955219132842„Auch wenn man den PC schließt, läuft lange Entwicklung weiter. Cursor Projects ist da“ ... Der Koordinator schreibt selbst keinen Code, sondern delegiert Arbeit an Tausende Sub-Agenten.
Es geht um Cursors neue Coding-Agent-Funktion „Projects“ und die Delegierung an Sub-Agenten. Das ist Coding-KI, keine Bild- oder Videogenerierung; aufgeführt wird der Beitrag nur, weil er der einzige Post zu generativer KI im Datensatz ist. -
@C_of_Creativity, 11.09.2026, 1.421 Likes · 359 Reposts · ca. 200.000 Aufrufe —
https://x.com/C_of_Creativity/status/2098498590134182035Eine in China modifizierte Nvidia RTX 5090 mit 96 GB großem Speicher ist auf Alibaba für unter 4.000 Dollar erschienen. Sie kostet 65 % des Originalpreises und bietet die dreifache VRAM-Menge.
Eine in China modifizierte RTX 5090 mit 96 GB VRAM, auf Alibaba für unter 4.000 US-Dollar gelistet (65 % des Originalpreises, dreifacher VRAM). Der Autor berichtet, eine ähnlich modifizierte 48-GB-4090 problemlos zu nutzen. Das ist angrenzend zu Open-Source-Bild-/Videogenerierung – mehr lokaler VRAM erlaubt Hobbyisten den Betrieb größerer offen gewichteter Modelle –, aber der Beitrag selbst behandelt Hardware und keine konkrete Modellveröffentlichung.
Keiner der anderen 38 Beiträge erwähnt Midjourney, Sora, Runway, Veo, Stable Diffusion, Flux, Kling, ComfyUI oder sonstige Closed- bzw. Open-Source-Modelle, Labore oder Releases zur Bild-/Videogenerierung.
Signale
- Zu steigenden oder verworfenen Themen lassen sich keine Aussagen treffen: Die gesammelten Beiträge handeln schlicht nicht vom Thema. Die zwei oben genannten Randtreffer sind das gesamte Signal – einer zu Coding-Agenten, einer zu günstiger Hardware mit viel VRAM für lokale große Modelle.
- Überraschend ist kein inhaltlicher Trend, sondern ein Prozessfehler: Gesucht wurde nach den kroatienlokalisierten Explore-Trends von X. Dieser X-Durchlauf war effektiv eine Suche nach „Slack / Chelsea / Houthis“, nicht nach Bild- oder Video-KI.
Einschränkungen
- Die Suchbegriffe entsprachen nicht dem Forschungsbrief. Alle zehn Begriffe („Slack“, „$SONG“, „Saudi“, „Chelsea“, „China“, „Yemen“, „The OS“, „London“, „Correct“, „Houthis“) stammten aus der kroatienlokalisierten Explore-Trendliste von X und nicht aus dem Thema Bild-/Video-KI bzw. Closed Source vs. Open Source. Deshalb sind mit Ausnahme der zwei genannten Beiträge keine der 40 Meldungen für diesen Brief nutzbar. Der Bericht kann weder 5–12 thematische Erkenntnisse liefern noch das in
brief.mdgesetzte Ziel erfüllen, ungefähr 20 Beiträge zu analysieren – im Datensatz gibt es keine 20 thematisch passenden Beiträge. - Ich habe keine eigenen Suchen ausgeführt: Gemäß Playbook ist X anonym nicht lesbar, und diese Phase wertet ausschließlich die bereits vom angemeldeten Worker gesammelten Daten in
output/x.posts.mdbzw..jsonaus. - Die Datei enthielt keine Meldung über abgelaufene Sitzungen oder leere Ergebnisse. Die Lücke beruht daher auf einer falschen Abfrage, nicht auf einer defekten oder abgelaufenen Sitzung.
- Da Explore auf den Serverstandort Kroatien lokalisiert ist, würde selbst eine korrekte Auswertung nur den kroatischen Feed und keine globale Lage beschreiben. Das sollte bei einer künftigen Wiederholung berücksichtigt werden.
YouTube
YouTube — Bild- und Video-KI (Closed Source vs. Open Source)
Kanäle
- Matt Wolfe / Future Tools (@mreflow) — ca. 965.000 Abonnenten. Allgemeine KI-News-Zusammenfassungen, die regelmäßig sowohl Closed-Source-Themen (Sora, Veo, Nano Banana) als auch Open-Source-Releases behandeln. https://www.youtube.com/@mreflow
- MattVidPro AI (@MattVidPro) — mittelgroßer KI-Tool-Kanal mit langjähriger Serie zu Midjourney-, Veo- und Kling-Updates („Midjourney Update | March 2026: V8 Alpha…“). https://www.youtube.com/@MattVidPro
- All About AI (Kristian Fagerlie) — ca. 222.000 Abonnenten. Praxisnahe Build- und Tutorial-Videos, etwa „5 Nano Banana Pro 'Million Dollar' Apps I Built In ONE Day.“ https://www.youtube.com/watch?v=VRNEr8_cTj8
- Theoretically Media (geführt vom Filmemacher „Tim“) — Reviews von KI-Videotools aus der Perspektive eines arbeitenden Filmemachers; häufige Hands-on-Tests zu Kling, Runway, Wan und Seedance. https://theoreticallymedia.com/videos/
- Zahlreiche mittelgroße Tutorial- und Vergleichskanäle treiben die Open-Source-Seite, besonders ComfyUI-orientierte Creators mit Tutorials für Wan2.2, FLUX und Qwen Image; sie erschienen wiederholt in den Suchergebnissen, ohne dass ein einzelner dominanter Abonnentenwert sichtbar war.
Videos
- „The Ultimate Guide to AI Video Generation (Sora 2, Runway 4.5, Veo 3.1, Nano Banana Pro)“ — Vergleichs-/Tutorialkanal, 2026. Stellt Sora 2 bereits als auslaufend dar und behandelt Veo 3.1 sowie Runway Gen-4.5 als die Tools, auf die sich Creators nach Soras Rückzug konzentrieren. https://www.youtube.com/watch?v=Kib8UcDiNJA
- „NANO Banana Pro is FINALLY Here! (And it is INSANE!)“ — 21. November 2025. Reaktion auf Googles Gemini 3 Pro Image („Nano Banana Pro“) mit Fokus auf Textdarstellung und Infografik-Fähigkeiten als Neuheit unter KI-Bildmodellen. https://www.youtube.com/watch?v=4EowH7eif3U
- „Gemini 3 Is Cool… But Nano Banana Pro Is TERRIFYING“ — 21. November 2025. Argumentiert, dass Photorealismus und Präzision beim Bearbeiten von Nano Banana Pro ein größerer Sprung seien als der Launch von Gemini 3 selbst. https://www.youtube.com/watch?v=DTYD-ddOwAY
- „5 Nano Banana Pro 'Million Dollar' Apps I Built In ONE Day“ — All About AI, 21. November 2025. Erstellt in einem Tag fünf vermarktbare Mini-Produkte rund um das Modell, um dessen kommerzielles Potenzial zu zeigen. https://www.youtube.com/watch?v=VRNEr8_cTj8
- „Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison“ — 10. März 2026. Direktvergleich der vier führenden geschlossenen Videogeneratoren; Kling gewinnt bei Umfang und Audio, Veo bei filmischer Qualität, Runway bei Kamerakontrolle. https://www.youtube.com/watch?v=x5fMQvhKP60
- „Runway Gen-3 vs Kling AI 2026 — I Tested Both for 30 Days“ — 17. Mai 2026. Ein 30-Tage-Paralleleinsatz kommt zu dem Schluss, dass Kling den Großteil der Qualitätslücke zu westlichen Tools zu einem Bruchteil des Preises geschlossen hat. https://www.youtube.com/watch?v=fAX7eOQ1j-k
- Midjourney-Update-Serie — „Midjourney Update | January 2026: NEW NIJI 7!… V8, Edit Model“ / „…February 2026: V8 Incoming!“ / „…March 2026: V8 Alpha, BIG Changes Coming.“ Eine monatliche Serie, die Midjourneys langsamen Übergang von V7 zu V8/V8.1/V8.2 sowie neue In-App-Video- und Bearbeitungstools verfolgt. https://www.youtube.com/watch?v=n8Iv3ZPh8yY
- „Seedance 2.5 AI Video Generator Full Review: I Tested EVERY New Feature“ — ca. Ende August 2026. Ausführlicher Hands-on-Test von ByteDances Seedance 2.5 mit 30-Sekunden-Clips in einem Durchlauf und bis zu 50 multimodalen Referenzeingaben. https://www.youtube.com/watch?v=132JGS2Rz3I
- „Seedance 2.5 Made a $1,000,000 Infomercial. Still Think It's a Joke?“ — August 2026. Ein Showpiece-Video kombiniert Seedance 2.5 mit Higgsfield, um einen aufwendig produzierten Fake-Infomercial zu erstellen, und argumentiert damit, dass Closed-Source-Video-KI Broadcast-Qualität erreicht hat. https://www.youtube.com/watch?v=QOG1iNp_zz8
- „Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models“ — 18. August 2025. Ein ausführliches Tutorial, das Wan2.2 für Video sowie FLUX und Qwen Image als aktuellen Open-Source-Stand der Technik behandelt und lokal über ComfyUI ausführt. https://www.youtube.com/watch?v=3BFDcO2Ysu4
- „FLUX.2 DEV First Look – The Best LOCAL Image Model Yet?“ — 26. November 2025. Erster Praxistest von Black Forest Labs’ FLUX.2 [dev] mit Multi-Referenz-Conditioning und 4-Megapixel-Bearbeitung auf lokaler Hardware. https://www.youtube.com/watch?v=9LyfKYPuY8w
- „Is FLUX 2.0 The New Open Source King?“ — 27. November 2025. Testet die gesamte FLUX.2-Reihe (pro/flex/dev/klein) gegen Nano Banana Pro und Midjourney und kommt zu dem Schluss, dass die offenen [dev]-/[klein]-Gewichte den Abstand zu proprietären Spitzenmodellen weitgehend schließen. https://www.youtube.com/watch?v=YQuTkPVkCS8
Signale
- Die Closed-Source-Dynamik ist von OpenAI zu Google/ByteDance/Alibaba gewechselt. Soras App und Web-UI wurden im April 2026 eingestellt, die API folgt am 24. September 2026 – also noch diesen Monat. Die in den Videos behandelten Creators sind bereits zu Veo 3.1, Seedance 2.0/2.5 und Kling 3.0 gewechselt. Kein Video aus 2026 behandelt Sora noch als das Tool, das man verfolgen sollte; mehrere machen seine Einstellung selbst zur Story.
- „Nano Banana Pro“ (Gemini 3 Pro Image) ist das am stärksten diskutierte geschlossene Bildmodell des Zeitraums. Das zeigt sich an der Häufung superlativer Titel („INSANE“, „TERRIFYING“, „MIND BLOWING“) unabhängiger Kanäle innerhalb weniger Tage nach dem Start im November 2025. Die Reaktionsspitze war stärker und konzentrierter als bei Midjourneys inkrementellen V8.x-Updates.
- Open-Source-Video hat 2026 den Großteil der Qualitätslücke geschlossen, laut Tutorial- und Vergleichsvideos: Wan2.2 mit Apache-2.0-Lizenz und MoE-Architektur, HunyuanVideo 1.5 sowie Lightricks’ LTX-2.3/2.5 – das einzige offene Modell mit nativem Audio und Video in einem Durchlauf – werden nun direkt mit Sora und Veo verglichen statt als Spielzeug abgetan.
- Lizenzen sind der wiederkehrende Konfliktpunkt bei Open Source: Die gestaffelte Veröffentlichung von FLUX.2 – Apache 2.0 für Schnell/Klein/VAE, nicht kommerziell für Dev, proprietär für Pro/Flex – wird von Reviewern als entscheidendes Wissen für kommerzielle Nutzung gegenüber lokalem Experimentieren hervorgehoben.
- Ein Meta-Trend steht über beiden Lagern: KI-generierte Kanäle mit Hailuo, Suno usw. dominierten bereits Mitte 2025 die Charts mit dem größten YouTube-Abonnentenwachstum. Ein Kanal, „Masters of Prophecy“, wuchs in vier Monaten von einigen Hundert auf mehr als 30 Millionen Abonnenten. Publikum für KI-Video-Inhalte und die Inhalte selbst werden damit zunehmend zu demselben Phänomen.
- Die Durchsetzung von Artikel 50 des EU AI Act ab 02.08.2026, der eine maschinenlesbare Kennzeichnung von KI-Inhalten verlangt, wird in Creator-Videos über die Veröffentlichung von KI-Videos für EU-Zielgruppen zunehmend zum Thema. Das ist eine regulatorische Einschränkung, mit der weder Closed- noch Open-Source-Creators ein Jahr zuvor zu tun hatten.
Einschränkungen
- YouTubes Suchergebnis- und Watch-Seiten werden stark per JavaScript gerendert. Direkte
WebFetch-Abfragen füryoutube.com/watch?v=...und/results?search_query=...lieferten nur statische Footer- und Navigationsinhalte, nicht die geforderten Werte für Aufrufe, Abonnenten oder Kommentare. Exakte Zahlen ließen sich in diesem Durchlauf nicht direkt von YouTube abrufen. - Werte zu Aufrufen oder Abonnenten oben, etwa Matt Wolfe mit ca. 965.000, All About AI mit ca. 222.000 oder Masters of Prophecy mit 30 Millionen, stammen aus Sekundärquellen wie Such-Snippets, vidiq und Sherwood News statt aus einer Live-Abfrage der YouTube-Seiten. Einige Zahlen zum Wachstum der KI-Kanäle stammen zudem aus der Mitte von 2025 und dienen als Hintergrund, nicht als frische Erkenntnis.
- Top-Kommentare einzelner Videos wurden nicht geprüft, da sich Kommentartexte über dieselbe Einschränkung nicht abrufen ließen.
- Es ließ sich nicht verifizieren, ob Wan 3.0 von Alibaba – am 06.08.2026 angekündigt und mit nativen 30-Sekunden-Clips – offene Gewichte erhält. Quellen kennzeichnen es ausdrücklich als nicht offen gewichtet; deshalb erscheint es nur als Closed-Source-Signal aus Websuche und nicht auf Basis eines eigens geöffneten YouTube-Videos.
- Reddit, X, Bluesky, Lemmy und Pinterest wurden nicht eigenständig untersucht; das sind getrennte Phasen des Briefs.
Bluesky
Bluesky — Aktuelle Entwicklungen bei Closed-/Open-Source-Bild- und Video-KI
Accounts
- @todaystopainews.bsky.social — Account, der KI-News zusammenfasst und unter anderem über lokal ausführbare Bildgenerierungsmodelle postet.
https://bsky.app/profile/did:plc:rrpul7rxm2s4opncn6pwr475 - @stablediffusion.bsky.social — Account, der Online-Bildgenerierungstools aus dem Stable-Diffusion-Umfeld vorstellt.
https://bsky.app/profile/stablediffusion.bsky.social - @dfl.bsky.social — Creator, der fortlaufend mit Stable Diffusion und RealisticVision erzeugte Bilder veröffentlicht.
https://bsky.app/profile/dfl.bsky.social - @google-ai.bsky.social — offizieller Spiegel-Account von Google AI, über den Ankündigungen zu Nano Banana Pro (Gemini 3 Pro Image) laufen.
https://bsky.app/profile/google-ai.bsky.social - @simonwillison.net — bekannter Entwickler und KI-Beobachter, der technische Eigenschaften neuer Modelle wie die SynthID-Wasserzeichenerkennung erklärt.
https://bsky.app/profile/simonwillison.net - @ostonox.com — Creator, der mit Google Veo 3 erzeugte Videos teilt.
https://bsky.app/profile/ostonox.com - @artsekai.com — Ersteller des Starter Packs „JP AI Artists“ für japanischsprachige KI-Künstler; ein Hub der japanischen KI-Kunstszene auf Bluesky.
https://bsky.app/profile/artsekai.com - @furyonai.bsky.social — Ersteller eines Starter Packs für KI-Kunst („Yaoi AI Art“) und Teil der KI-befürwortenden Community.
https://bsky.app/profile/furyonai.bsky.social - @yunexa.bsky.social / @backyardvampire.bsky.social — Ersteller von Kunst-Starter-Packs wie „oc artists“ und „World of Warcraft Artists“, die ausdrücklich „No AI“ sagen. Sie repräsentieren KI-ablehnende Communities.
https://bsky.app/profile/yunexa.bsky.social - @bsky.app (offiziell) — betont wiederholt die Regel, Inhalte von Nutzern nicht zum Training generativer KI zu verwenden. Diese Plattformhaltung prägt die Stimmung der Nutzerschaft.
https://bsky.app/profile/bsky.app
Beiträge
-
@simonwillison.net (Datum unbekannt, 2026; Beitrag zu Gemini 3 Pro Image)
Sinngemäß: Die scheinbar unscheinbare neue Funktion, mit der Nano Banana Pros unsichtbares SynthID-Wasserzeichen erkannt wird, indem man ein Bild einfach in die Gemini-App hochlädt, sei bemerkenswert. Ein repräsentativer Post zu Entwicklungen im Closed-Source-Lager von Google.
https://bsky.app/profile/simonwillison.net/post/3m637bxy5yc2c
Likes/Reposts nicht erhoben (siehe Einschränkungen) -
@ostonox.com (Datum unbekannt, 2026)
„Hier ist die Version mit Ton. Dieses Video wurde vollständig mit Googles KI Veo 3 erzeugt.“ Ein typischer Beitrag, der Closed-Source-Video-KI direkt demonstriert.
https://bsky.app/profile/ostonox.com/post/3lppvqrj2pk2v
Likes/Reposts nicht erhoben -
@dfl.bsky.social (Datum unbekannt)
„KI-Bildgenerierung #StableDiffusion #realisticVisionV51 #fantasy #landscape #moonlight #bamboo“. Ein mit dem Open-Source-Modell Stable Diffusion plus RealisticVision erzeugtes Bild einer mondbeschienenen Bambuslandschaft. Die explizite Benennung der Modelle per Hashtag ist typisch für Bluesky.
https://bsky.app/profile/dfl.bsky.social/post/3kcmft6l5eg2e
Likes/Reposts nicht erhoben -
@bsky.app (offiziell) (älterer Beitrag, mehrfach erwähnt)
Offizielle Erklärung im Sinn von: Künstler und Creators, die zu Bluesky wechseln, sorgten sich darüber, dass ihre Inhalte auf anderen Plattformen für KI-Training eingesetzt würden. Bluesky nutze Nutzerinhalte nie für das Training generativer KI. Keine unmittelbare Nachricht über generative KI, aber eine wichtige Grundlage dafür, wie KI-generierte Inhalte auf Bluesky aufgenommen werden.
https://bsky.app/profile/bsky.app/post/3layuzbto2c2x
Likes/Reposts nicht erhoben -
@todaystopainews.bsky.social (um den 30. Juni 2026)
Beitrag über ein neues, lokal ausführbares KI-Bildtool, das von Anfang an unzensiert sei. Einer der wenigen gefundenen Hinweise auf Nachrichten aus der Open-Source- bzw. lokalen Modell-Community.
https://bsky.app/profile/did:plc:rrpul7rxm2s4opncn6pwr475/post/3mpj2zr7nrb2l
Likes/Reposts nicht erhoben
Signale
- Befürwortung und Ablehnung sind über Starter Packs sichtbar: Es gibt mehr als 40 Listen wie „AI Art“, „JP AI Artists“ oder „Yaoi AI Art“, aber zugleich Kunstlisten wie „oc artists ♡“ mit dem ausdrücklichen Hinweis „AI und NFT absolut nicht erwünscht“ und „World of Warcraft Artists“ mit „No AI, no bigots“. Beide Lager existieren sichtbar nebeneinander auf derselben Plattform.
- Blueskys Entstehung erzeugt Gegenwind: Bluesky hat ausdrücklich erklärt, Beiträge nicht für generatives KI-Training zu verwenden. Die Plattform wurde zum Ziel für Illustratoren und Creators, die X wegen dessen Plänen zur Nutzung von Posts für Grok-Training verließen. Deshalb werden werbliche KI-Posts weniger willkommen geheißen als auf Reddit oder X und häufiger mit Vorsicht oder Ablehnung kontextualisiert.
- Bei Closed Source fallen Google-Themen besonders auf: Konkret gefundene Posts drehten sich vor allem um Veo 3, Nano Banana Pro (Gemini 3 Pro Image) und SynthID-Wasserzeichenerkennung. Erwähnungen von Sora 2 oder Midjourney fanden sich über Suchmaschinen dagegen fast gar nicht (siehe Einschränkungen).
- Open Source wird hauptsächlich von Einzelpersonen behandelt: Es finden sich Bildposts mit Stable-Diffusion-Modellen wie RealisticVision. Beiträge, die aktuelle Open-Source-Modellnamen wie ComfyUI, Flux, Wan oder HunyuanVideo direkt behandeln, wurden in dieser Untersuchung jedoch nicht gefunden. Technische Open-Source-Diskussionen könnten stärker auf andere Plattformen wie Reddit konzentriert sein.
Einschränkungen
- Die öffentliche Bluesky-API (
public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) gab sowohl bei direktem Zugriff als auch über einen Proxy konstant HTTP 403 Forbidden zurück. Eine Stichwortsuche nach aktuellen Beiträgen inklusive Likes, Reposts und Zeitstempeln war daher nicht möglich. bsky.appist eine clientseitig gerenderte JavaScript-App. Selbst beim Abrufen von Suchseiten (/search?q=...) und Hashtag-Seiten (/hashtag/...) erschienen keine lesbaren Beitragstexte.- Stattdessen wurden einzelne, über Google/Bing gefundene Post-URLs und Blueskys Link-Vorschau-API (
cardyb.bsky.app) genutzt, um Titel und Textausschnitte wiederherzustellen. Das erfasst nur Beiträge, die zufällig extern erwähnt oder zitiert wurden, und erfüllt nicht das im Brief geforderte Ziel einer umfassenden Analyse von ungefähr 20 Posts. Tatsächlich konnten nur fünf Texte verifiziert werden. - Aufgrund dieser Einschränkungen ließen sich für keinen Beitrag Likes, Reposts oder Antwortzahlen erfassen.
- Auch Suchen nach Sora 2, Midjourney V7/V8, Flux, Wan, HunyuanVideo und ComfyUI ergaben kaum einzelne Bluesky-Posts, da Suchmaschinen sie fast nicht indexieren.
Lemmy
Lemmy — Nachrichten zu Bild- und Video-KI
Lemmy ist ein kleines föderiertes soziales Netzwerk, doch rund um !«メールアドレス» ist eine aktive Open-Source-Community für Bild- und Video-KI entstanden. Nachrichten zu Closed Source tauchen eher vereinzelt in allgemeinen Technik-Communities wie !technology, !ai_reddit, !hackernews und !«メールアドレス» auf.
Communities
!«メールアドレス»— 5.710 Abonnenten, davon 893 lokal; 25 wöchentlich aktive Nutzer; 1,4K Beiträge und 1,93K Kommentare. Hub für Nachrichten und Tool-Sharing zu Open-Source-Bild-/Videomodellen.!«メールアドレス»— Community für Beispielwerke mit Anime-KI-Generierung; Abonnentenzahl nicht abrufbar (siehe Einschränkungen).!«メールアドレス»— Beispielwerke und Modellvorstellungen rund um Civitai; Detailzugriff wegen Serverfehler nicht möglich (siehe Einschränkungen).!«メールアドレス»— 88.000 Abonnenten, davon 41.000 lokal. Große Nachrichten zu generativer KI tauchen hier innerhalb allgemeiner Technikmeldungen auf.!ai_reddit— Community mit Crossposts von KI-bezogenen Reddit-Threads, darunter häufig auch Bild-/Video-KI.!«メールアドレス»(gespiegelt etwa vonsh.itjust.works) — teilt KI-Hype gegenüber skeptische Technikmeldungen und spöttische Kritikartikel von Seiten wie pivot-to-ai.com.!openai— Spezial-Community für OpenAI-Nachrichten.!«メールアドレス»— kleine Community für europäische KI-/LLM-Entwicklungen.
Beiträge
- Black Forest Labs kündigt FLUX 3 an – Bild- plus Videoerzeugung mit bis zu 20 Sekunden Audio (begrenzter Release) —
!technology, Score 1, 24.07.2026. https://bfl.ai/blog/flux-3 — Der bekannte Anbieter offener Gewichte BFL steigt ernsthaft in die Videogenerierung ein. - Black Forest Labs öffnet das FLUX Creator Program —
!«メールアドレス», Score 3, 06.05.2026. https://xcancel.com/bfl_ml/status/2051723708046233688 - black-forest-labs/FLUX.2-klein-9b-kv-fp8 auf Hugging Face veröffentlicht —
!«メールアドレス», Score 8, 14.03.2026. https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8 — Die leichte fp8-Version galt als für private GPUs geeignet. - ComfyUI-Optimierung für MiniMax-H3: „ComfyUI-VDN-H3-24GB“ —
!«メールアドレス», Score 4, 12.09.2026. https://github.com/Speach1sdef178/ComfyUI-VDN-H3-24GB — Optimiert für Betrieb mit 24 GB VRAM. - MiniMax-H3-Image-Training-Adapter veröffentlicht; LoRA-Training für MiniMax H3 möglich —
!«メールアドレス», Score 4, 12.09.2026; Beitrag am selben Tag von Even_Adder. https://huggingface.co/circlestone-labs/MiniMax-H3-Image-Training-Adapter - LTX-2.5-22b-IC-LoRA-Ingredients – LoRA für referenzbildkonditionierte Videogenerierung —
!«メールアドレス», Score 3, 12.09.2026. https://huggingface.co/Lightricks/LTX-2.5-22b-IC-LoRA-Ingredients - Boogu-Image-0.1 – effizienzorientiertes offenes Basismodell für Bildgenerierung —
!«メールアドレス», Score 5, 17.06.2026. https://boogu.org/ - SCoPE: auf Wan2.2 basierendes Video-Diffusionsmodell mit Kamerasteuerung —
!«メールアドレス», Score 2, 16.08.2026. https://visual-ai.github.io/scope/ — Nachweis mit Wan2.2 in den Varianten 5B/14B. - OpenAI fährt Sora zurück; ein 30-Millionen-Dollar-KI-Film scheitert —
!ai_reddit, 27.05.2026. https://www.reddit.com/r/ArtificialInteligence/comments/1tovuid/openai_shutting_down_sora_just_killed_a_30m_ai/ - Die Probleme hinter dem Rückbau der Sora-Video-App von OpenAI —
!openai, Score 2, 13.04.2026. Verweis auf einen Artikel der Times of India. - Google stoppt Bild-KI „Earth AI“ einen Tag nach Veröffentlichung wegen unangemessener Bildgenerierung —
!ai_reddit, 07.08.2026. https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/ - Google veröffentlicht neues Bildgenerierungsmodell „Nano Banana 2 Lite“ —
!hackernews/ schweizerisches!swisstechnews, 30.06.–02.07.2026. https://deepmind.google/models/gemini-image/flash-lite/ - Hands-on-Vergleichstest von Seedream 5.0 Pro —
!ai_reddit, 10.07.2026. https://www.reddit.com/r/ArtificialInteligence/comments/1usc03q/ - Midjourney fordert von Hollywood-Studios Offenlegung ihrer tatsächlichen KI-Nutzung —
!technology, Score 73, 05.07.2026. https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-reveal-ai-usage/ - Midjourney „wechselt“ zu medizinischen Ultraschallscannern und erntet Kritik; spöttischer Artikel mit Theranos-Vergleich —
!«メールアドレス», Score 40, 19.06.2026. https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/ — Skeptischer Blick auf Midjourneys Diversifizierungsstrategie. - Elon Musk kündigt an, mit Grok eine vollständige KI-Verfilmung der „Odyssee“ zu produzieren —
!films(lemy.nl), 22.07.2026. https://lemy.nl/post/4342454 (niederländischer Artikel)
Signale
- Das Open-Source-Lager befindet sich in einer Phase serienmäßiger Releases: Neue Modelle, Adapter und ComfyUI-Erweiterungen für FLUX, MiniMax H3, LTX-2.5 und Boogu-Image-0.1 erscheinen fast täglich auf Hugging Face und GitHub. VRAM-Optimierungen wie 24-GB-Versionen erhalten viel Aufmerksamkeit; lokaler Betrieb bleibt der zentrale Anwendungsfall.
- Wan2.2 und LTX Video haben sich als faktischer Open-Source-Standard für Videogenerierung etabliert. Darauf bauen Anwendungen wie Kamerasteuerung und LoRA-Conditioning auf.
- Im Closed-Source-Lager dominieren Nachrichten über Rückbau und Kontroversen: Soras Schrumpfung, Googles nach einem Tag eingestelltes Earth AI und die Kritik an Midjourneys Wechsel in Medizintechnik wurden häufiger gefunden als spektakuläre neue Funktionen.
- Lemmy insgesamt zeigt eine KI-kritische Grundhaltung: Communities wie
!techtakesfallen auf, weil sie die Bewegungen von Closed-Source-Unternehmen verspotten. Auch in Reddit-Crosspost-Communities ist Skepsis gegenüber KI-Hype deutlich. - Black Forest Labs mit FLUX wird wiederholt als Zwischenform behandelt: offen, aber kommerziell orientiert und damit zwischen Closed Source und Open Source angesiedelt.
Einschränkungen
- Lemmy ist insgesamt klein; als spezialisierte Community für Bild-/Video-KI gibt es praktisch nur das Umfeld von
!«メールアドレス». Beitragsvolumen und Diskussionsdichte sind deutlich geringer als auf Reddit oder X. !«メールアドレス»war wegen eines Serverfehlers (HTTP 500) nicht zugänglich.- Die Abonnentenzahl von
!«メールアドレス»ließ sich ebenfalls wegen eines HTTP-500-Fehlers nicht abrufen. - Die Community
!imageaiauflemmy.cawar wegen „Access Denied“ nicht einsehbar, vermutlich aufgrund von Bot-Schutz. - Such-API-Ergebnisse enthielten viele irrelevante Artikel zu Politik, Spiele-Reviews usw.; die Keyword-Suche war stark verrauscht. Die vollständige Zielmenge von 20 Beiträgen wurde nicht erreicht, und die über mehrere Keywords gefundene tatsächlich relevante Menge liegt bei etwa 16 Beiträgen.
- Zusätzliche Suchen auf
lemmy.mlundlemm.eefanden wegen des hohen Rauschens und der Zeitplanung nicht statt; die Suchen auflemmy.worldundlemmy.dbzer0.comlieferten genügend Beiträge für die Erhebung.
Pinterest — Nachrichten zu Bild- und Video-KI
Visuelle Themen
- Neon-Logo-„AI News“-Reaction-Thumbnails — ein wiederkehrendes YouTuber-Template: das Gesicht eines bärtigen Creators mit weit aufgerissenen Augen neben einem Ring leuchtender 3D-Markenlogos von OpenAI, Google, Microsoft, Meta, Nvidia und Gemini. Dieselbe Bildsprache wird für unabhängige Schlagzeilen wie Anthropic, Grok und GPT-5.2 wiederverwendet.
[2, 16, 19, 39] - Dunkelblaue, cyan-violette „Cyberpunk-KI“-Verläufe dominieren generische Pins zu „KI-generierten Inhalten“ und „KI ist überall“: leuchtende Leiterbahnen, chromartige Roboterköpfe und holografische Bildraster im Raum.
[1, 4, 46, 50] - Nummerierte Tool-Ranking-Infografiken — „Best 5/6/10 AI Video Generation Websites/Tools“, jeweils mit einem Logo pro Eintrag, Funktions-Checkliste und Beispielthumbnail für Runway, Pika, Kling AI, Luma/Dream Machine, Canva, Hailuo, Veed, Synthesia und Pictory. Dies ist das häufigste Pin-Format und wirkt eher wie Affiliate-Blogmarketing als wie präsentierte KI-Kunst.
[7, 10, 21, 26] - Vorher-/Nachher-Transformationsraster — ein Ausgangsvideo wird nebeneinander als Lego, Origami, Holzbausteine und Blumen neu gestaltet, in einem Google-„Lumiere“-ähnlichen Demo-Stil; daneben stehen Werbungen zum Animieren statischer Fotos.
[6, 13] - Motive für Vertrauen und Erkennungsangst — ein Roboter, der ein Katzenfoto mit „FAKE“ stempelt; ein Gesicht, das sich in eine grün-schwarze Code-Matrix auflöst; ein „Which is AI?“-Vergleich von Bergfotos; sowie Prozentwerte zur Sicherheit von Stimmenerkennung.
[3, 4, 50] - Offizielle Pressebilder zu Modellstarts — Googles Veo-2-Reel mit schwimmendem Hund, Flamingos und einem animierten Mädchen in einer Küche; Microsofts VASA-1-Raster mit aus Einzelbildern erzeugten sprechenden Köpfen; und ShengShus Anime-Avatar-Promo für Vidu S1. Sie wirken wie Studio-Press-Kits, nicht wie Nutzerbeiträge.
[5, 30, 40] - China-vs.-Westen-Inszenierung bei Videomodellen — ByteDances Seedance 2.5 mit „One Laptop = One Film“ und ShengShus Vidu S1 setzen auf einen glänzenden, fast Science-Fiction-artigen Filmplakat-Look. Das unterscheidet sich sichtbar von den flacheren westlichen Tool-Infografiken für Runway, Pika und Kling.
[30, 42] - Ein einzelnes Politikbild — ein Stadtbild, geteilt zwischen Kapitol-/Freiheitsstatuen-Silhouette und Bildschirmen mit „AI-GENERATED NEWS“, beschriftet mit „Human Journalism vs Machine-Generated Media“.
[12]
Auffällige Pins
- [1] AI Image and Video Creation — Titelbild-ähnliches Motiv des Datensatzes mit vollständig blauem holografischem Inhaltsraster; dieser Look taucht in vielen unabhängigen Pins als generisches KI-Bühnenbild erneut auf.
- [21] 5+ Best AI Video Generation Websites 2026 — nennt Runway, Pika, Kling AI, Luma, Canva und Hailuo und führt Pinterest ausdrücklich als Vertriebskanal für die Ergebnisse auf.
- [26] AI Tools for Video Editing — What Creators Actually Use — eine Taxonomie mit 20 Tools, von Generierung über Bearbeitung und Voiceover bis Stock und Veröffentlichung. Die vollständigste Tool-Übersicht des Datensatzes; der einzige Pin, der „Stable Video Diffusion“ als Open Source nennt.
- [42] China Just Took AI Video Too Far — ByteDance Seedance 2.5 — mit der Zeile „One laptop = one film“ und offen zugespitztem, nationalistisch gefärbtem Hype für ein chinesisches Videomodell.
- [30] ShengShu Technology Unveils Vidu S1 — „Echtzeit-interaktive Generierung“, präsentiert wie ein Anime-Key-Visual statt wie eine Technikankündigung.
- [40] Microsoft Unveils VASA-1 — einzelnes Foto plus Audioclip wird zum sprechenden Kopf; gezeigt als tatsächliches Forschungsfiguren-Raster aus ausdrucksstarken Gesichtern.
- [6] Google-Video-Reskin-Demo (mit Lumiere-Tag) — derselbe Ausgangsclip wird in Lego-, Origami-, Holzbaustein- und Blumenvarianten verwandelt; das stärkste Wow-Visual der gesamten Sammlung.
- [12] New York's Bold Gambit: Inside the Legislative... — der einzige Pin unter 50 mit einem Politik-/Regulierungswinkel, begleitet von einer Illustration „menschlicher Journalismus vs. KI-Medien“.
- [9] Adobe udvikler AI-model til opskalering af videoer — dänischsprachiger Pin über Adobes Modell, das unscharfes Material zu HD hochskaliert; zeigt, dass das Thema auch nichtenglischsprachige Zielgruppen erreicht.
- [4] AI content and social media concerns — ein Roboter prüft auf einem Smartphone ein Katzenfoto/-video mit „FAKE“-Stempel; das klarste Deepfake-skeptische Bild im Datensatz.
Signale
- Der Pinterest-Datensatz ist stark von Listicle- und Affiliate-Marketinggrafiken geprägt („Best N AI video tools“) und nicht von KI-generierter Kunst. Die meisten Pins verkaufen einen Blogbeitrag oder ein YouTube-Video, kein fertiges KI-Werk.
- Chinesische Videomodelle erhalten eine glänzendere, filmischere Behandlung – Seedance 2.5 und Vidu S1 – als die flachen westlichen Tool-Ranking-Infografiken. Das deutet darauf hin, dass Chinas Video-KI-Schub als eigene Hype-Erzählung neben der Frage „Welches SaaS-Abo soll ich abschließen?“ wahrgenommen wird.
- Skepsis gegenüber Deepfakes und Vertrauensverlust ist ein realer, aber kleiner Strang: „FAKE“-Stempel, „Which is AI?“-Quizze und Prozentwerte zur Stimmenerkennung sind vorhanden, aber nicht dominant.
- Fehlend: keine Präsentationen aus der Open-Source-Community – keine ComfyUI-Workflow-Screenshots, keine Stable-Diffusion-/LoRA-Prompt-und-Output-Galerien, keine GitHub-Screenshots. Abgesehen von der einzelnen Nennung von „Stable Video Diffusion“ in einer geschlossenen Tool-Übersicht
[26]dreht sich keiner der 50 Pins um Open-Source-Modelle in derselben Weise wie um geschlossene kommerzielle Produkte wie Runway, Pika, Kling, Veo, Sora und Grok. - Fehlend: keine Preis- oder Vergleichstabellen und keine Bilder von Protest oder Gegenreaktionen. Titel wie „Everyone's Mad At Anthropic Now“ oder „AI content and social media concerns“ werden mit generischen Reaktionsgesichtern oder Stockfotos illustriert, nicht mit Belegen für eine konkrete Kontroverse.
- Im gesammelten Material sind keine Engagement-Kennzahlen, Save-Zahlen oder Zeitstempel verfügbar. Aktualität und Popularität lassen sich aus Pinterest allein nicht bestätigen.
Einschränkungen
- Dem Playbook folgend wurden die Bilder vom Worker vorab gesammelt. Diese Phase hat Pinterest nicht direkt durchsucht, sondern nur
output/pinterest.pins.mdund die Bilddateien gelesen. - Alle 50 Pins lagen in einer einzigen unbeschrifteten Kategorie (
g01-*); die Tabelle enthält keine Abschnitte pro Genre, die verglichen werden könnten. - 30 der 50 Bilder wurden direkt visuell geprüft (Indizes 1–13, 15, 16, 18–21, 24, 26, 30, 31, 34, 39, 40, 42, 43, 46, 50). Die übrigen etwa 20 wurden nur anhand ihrer Titel bewertet, da die oben genannten visuellen Themen schon deutlich vor diesem Punkt gesättigt waren.
- Mehrere Pin-Titel passen nicht zum Thumbnail. Pinterest verwendet häufig allgemeine „AI News“-Reaction-Templates oder unpassende Stockbilder für verschiedene Schlagzeilen erneut; etwa nutzen Pins zu einem Anthropic-Leak und zu Grok-Video beide generische Vorlagen ohne Bezug zum behaupteten Thema. Titelbasierte Aussagen zu diesen Pins konnten deshalb über die wiederverwendete Vorlage hinaus nicht visuell verifiziert werden.
Empfohlene Maßnahmen
- Bei der nächsten X-Phase die Logik korrigieren: direkt nach Bild-/Video-KI-Schlüsselbegriffen suchen statt nach regionalen Trendbegriffen.
- Für Bluesky einen authentifizierten Erhebungsweg einrichten, da die offizielle Such-API mit 403 blockiert ist.
- Lemmy über weitere Instanzen wie
lemmy.mlundlemm.eedurchsuchen, um sich dem Ziel von 20 analysierten Beiträgen anzunähern. - Nach dem Ende der Sora-API am 24.09.2026 die tatsächlichen Migrationsziele in den folgenden Reddit- und YouTube-Phasen nachverfolgen.
- Für Pinterest eine Erhebungsmethode untersuchen, die Engagement-Kennzahlen wie Likes und Saves liefern kann.
Gesammelte Bilder


















































Hinweis zur Datenqualität
Von den 40 gesammelten X-Beiträgen waren praktisch nur zwei nutzbar, da alle übrigen nicht zum Thema gehörten. Bei Bluesky konnten wegen der mit 403 blockierten offiziellen API nur fünf Beiträge geprüft werden; Engagement-Kennzahlen fehlten vollständig. Lemmy blieb mit 16 Beiträgen unter dem Ziel von 20. Reddit, YouTube und Pinterest lieferten zwar angemessene Datenmengen, behalten jedoch jeweils eigene Lücken: zu wenig Open-Source-Informationen auf Reddit, keine Live-Abrufe von Aufrufzahlen usw. auf YouTube und fehlende Engagement-Kennzahlen auf Pinterest.



