KI-News zur Bild- und Videogenerierung — 2026-10-02
Chinesische Open-Source-Modelle (Qwen-Image-2.1, Z-Image Turbo) holen zu den Closed-Source-Marktführern auf, während das Vertrauen in Closed Source wegen Schutzvorkehrungen, Missbrauch und Soras Wirtschaftlichkeit schwindet.
KI-News zur Bild- und Videogenerierung — 2026-10-02
Ganz ehrlich: In der Welt der KI-Bild- und Videogenerierung geht es gerade richtig rund 😤 Die Closed-Source-Anbieter (OpenAIs GPT Image 2.5, Googles Veo 3.1/Nano Banana 2.0, Kling 2.5, Seedance 2.5 usw.) liefern sich weiterhin ein rasantes Rennen um neue Funktionen. Gleichzeitig häufen sich jedoch vertrauensschädigende Themen wie strengere Schutzvorkehrungen, Deepfakes und Soras enorme Verluste 💸. Auf der Open-Source-Seite gewinnen chinesische Anbieter wie Alibaba (Qwen-Image-2.1, Z-Image Turbo) deutlich an Fahrt, und eine Kultur des intensiven lokalen Experimentierens rund um ComfyUI ist auf Reddit, Lemmy und Bluesky klar sichtbar 🔥. Für diese Ausgabe wurden sechs Plattformen untersucht: Reddit, X, YouTube, Bluesky, Lemmy und Pinterest. Bei X gab es allerdings einen kompletten Fehlgriff – das wird unten offen dokumentiert 👇.
Plattformübergreifend
- Chinesische Open-Source-Modelle steigen auf – und werden zunehmend als „Alternative zu Closed Source“ diskutiert 🇨🇳 Auf YouTube heißt es, Z-Image Turbo (6 Milliarden Parameter, läuft mit 6 GB VRAM) übertreffe Flux 2 (https://www.youtube.com/watch?v=JF4Q5hXh-_Q), während Qwen-Image-Edit mit Nano Banana gleichziehe oder es übertreffe (https://www.youtube.com/watch?v=AIgYj5RG-FQ). Auf Lemmy erschienen in derselben Woche WebUIs und LoRAs rund um Qwen-Image-2.1 (https://github.com/ogoun/fooocus-qwen-image-2.1), und Simon Willison testete Qwen-Image auf Bluesky praktisch (https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223). Weil sich das zeitgleich auf mehreren Plattformen zeigt, wirkt es wie ein echter Trend.
- Strengere Schutzvorkehrungen treiben Nutzende zu anderen Angeboten 🚪 Auf Reddit wechseln Menschen wegen ChatGPT-Ablehnungen zu Midjourney, Grok und Venice AI (https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/). Verschärfte Filter bei DreamFort.ai führen zu Seedream Unfiltered und MiniMax H3 (https://www.reddit.com/r/generativeAI/comments/1wtzefv/). Auf Bluesky warnen Fachleute zudem, dass Open-Weight-Modelle wie GLM-5.3 fast keine Schutzvorkehrungen hätten (https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o). Die Polarisierung zwischen mehr Regulierung und einem weitgehend unregulierten Raum zeigt sich somit plattformübergreifend.
- Das Vertrauen in Closed-Source-Tools gerät aus mehreren Richtungen gleichzeitig ins Wanken ⚠️ Eine von TIME untersuchte Möglichkeit, mit Veo 3 gefälschte Videos brennender Hindu-Tempel zu erzeugen, wurde auf Bluesky verbreitet (https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h). Auf Reddit gibt es Berichte, dass Photoshop und Apple Photos selbst gewöhnliche Zuschnitte als „KI-Bearbeitung“ kennzeichnen und Copyright-Informationen entfernen (https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/). Missbrauch und falsche Kennzeichnung sind unterschiedliche Probleme, nähren aber beide das Gefühl, Closed-Source-Tools seien nicht vertrauenswürdig.
- ComfyUI ist zum Standard-Arbeitsplatz der Open-Source-Szene geworden 🛠️ Der Name taucht überall auf: Reddit (Knoten für MiniMax-H3, https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/), Lemmy (LanPaint-Inpainting, https://github.com/scraed/LanPaint/), Bluesky (tägliche Illustrationen mit Krea2, https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t) und YouTube, wo zu jedem neuen Modell sofort Einrichtungs-Tutorials erscheinen.
- Direkte Vergleiche werden zum Standardformat 📊 YouTube-Titel wie „WAN 2.5 is Open Source Veo3“, Lemmys Vergleich derselben Berserk-Doppelseite mit vier Modellen (https://www.reddit.com/gallery/1wfyqdy) und Pinterest-Grafiken nach dem Muster „das kostenpflichtige / das kostenlose Tool“ zeigen: Menschen interessiert weniger die Einzelnachricht als die Frage, welches Modell am stärksten ist.
- Die These, dass KI-Video für Endkundschaft nicht profitabel ist, wird von mehreren Quellen gestützt 💰 Auf Bluesky steht die Behauptung, Sora2 koste jährlich rund 5 Milliarden US-Dollar, habe aber nur etwa 1,4 Millionen US-Dollar Umsatz erzielt (https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o). Auf Lemmy wird analysiert, dass OpenAI die Sora-API am 24. September einstellen werde, während unternehmensorientierte Anbieter wie Kling Kapital einsammeln (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/).
Nach Plattform
Reddit 🟠 12 Threads aus 9 Subreddits wurden analysiert. Auf der Closed-Source-Seite erhielt besonders ein Beitrag Aufmerksamkeit, laut dem Seedance 2.5 (über Higgsfield) inzwischen einer einzelnen Person ermögliche, einen zehnminütigen Kurzfilm mit konsistenten Figuren zu erstellen (784 Punkte, https://www.reddit.com/r/accelerate/comments/1wqqr4p/). Auf der Open-Source-Seite wurde ein ComfyUI-Knoten für MiniMax-H3 als „der beste Knoten, den ich je genutzt habe“ gefeiert (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/). Auch die konkretesten Beschwerden über Schutzvorkehrungen finden sich hier.
X ⚫️ Hier gab es wirklich einen kompletten Fehlgriff 😅 Die 40 gesammelten Beiträge von 33 Accounts handelten ausschließlich von Fußball, K-Pop, britischer Politik und Reality-TV; Bild- oder Video-KI kam kein einziges Mal vor. Die verwendeten Suchbegriffe entsprachen offenbar direkt den X-Trends, etwa „Halloween“, „Ronaldo“ und „#bb28“, statt KI-bezogenen Suchbegriffen. Daher liefert X für diesen Bericht keine verwertbaren Informationen.
YouTube 🔴 Auf der Closed-Source-Seite erschienen zeitgleich Videos zu GPT Image 2.5s Funktion „Sketch“ (https://www.youtube.com/watch?v=LYUr4BY33h4), zur kostenlosen Freigabe von Veo 3.1 (https://www.youtube.com/watch?v=uj6eD31OxkA) und zu Nano Banana 2.0 als angeblichem „Photoshop-Killer“ (https://www.youtube.com/watch?v=u22-XoQvI4I). Das Funktionsrennen ist eindeutig schnell. Auf der Open-Source-Seite werden Tutorials für FLUX.2, Z-Image und Qwen-Image-Edit im Stil „So läuft es in ComfyUI“ massenhaft produziert. Beachte jedoch, dass Aufrufe, Abonnentenzahlen und Kommentare wegen JavaScript-Rendering nicht erfasst werden konnten; die Analyse basiert nur auf Titeln und oEmbed-Daten.
Bluesky 🔵 Über die AT-Protocol-API wurden mehr als 100 echte Beiträge erhoben und ausgewählt. Bei Closed Source dominierten deutlich Veo-3-Probleme mit rassistischen Inhalten (❤️842, https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y) sowie Diskussionen über Soras wirtschaftlichen Zusammenbruch (❤️1.375). Auf der Open-Source-Seite behandeln forschungsnahe Accounts wie Simon Willison und Ethan Mollick Qwen-Image und GLM-5.3 anhand tatsächlicher Tests. Außerdem finden sich zahlreiche Alltagsbeiträge mit ComfyUI und Krea2.
Lemmy 🟢 !«メールアドレス» ist das Zentrum, allerdings mit kleinen Reichweiten: Die meisten Beiträge erzielen nur einstellige bis niedrige zweistellige Scores. Dennoch wurden in derselben Woche mehrere Qwen-Image-2.1-Werkzeuge veröffentlicht – WebUI, LoRA und ControlNet –, was eine dynamische Entwicklung erkennen lässt. Closed-Source-News wie das Ende der Sora-API oder die nach einem Tag zurückgezogene Google-Earth-Funktion von Nano Banana 2 (https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/) stammen meist aus !ai_reddit, einem Reddit-Spiegelbot; eigenständige Lemmy-Diskussionen sind selten.
Pinterest 🟣 Von 50 Einträgen wurden 18 direkt geöffnet und geprüft. Deutlich überwiegend sind Closed-Source-Nachrichtenbilder mit Logos von OpenAI, Google, Meta oder Grok sowie überraschten Gesichtern. Auf der Open-Source- beziehungsweise lokalen Seite taucht fast nur AMD Amuse 3.0 mit konkretem Namen auf. Fotorealistische Personen-Demos – Gesichter mit Falten und detaillierten Oberflächen – dienen bei vielen Anbietern als Benchmark-Visualisierung. Engagement-Zahlen wie Speicherungen und Likes waren allerdings nicht verfügbar; die Pins beschränkten sich auf bereits vom Worker erhobenes Material.
Beobachten
- Die rasante Ausweitung des Qwen-Image-2.1-Tool-Ökosystems — Auf Lemmy erschienen WebUI, LoRA und ControlNet in derselben Woche (https://github.com/ogoun/fooocus-qwen-image-2.1). Es lohnt sich, die nächsten Veröffentlichungen zu verfolgen.
- Wie Soras wirtschaftliche Probleme die Strategie von OpenAI beeinflussen — Das Thema wird sowohl auf Bluesky (https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o) als auch auf Lemmy diskutiert (Einstellung der Sora-API, https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/).
- Die durch Schutzvorkehrungen getriebene Spaltung zwischen Regulierung und unreguliertem Raum — Reddit (https://www.reddit.com/r/generativeAI/comments/1wtzefv/) und Bluesky (https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o) beleuchten dieselbe Struktur aus unterschiedlichen Richtungen.
- FLUX 3 von Black Forest Labs — Das Modell wird geschlossen und nur begrenzt angeboten, erzeugt aber Bilder sowie 20-sekündige Videos mit Ton; parallel erscheinen Open-Weight-Versionen von FLUX.2 (https://bfl.ai/blog/flux-3). Ein interessantes Beispiel für verschwimmende Grenzen zwischen Open und Closed Source.
- Die Low-VRAM-Ausrichtung von Z-Image und Qwen-Image — Auf YouTube wird Z-Image als besser als Flux2 beschrieben (https://www.youtube.com/watch?v=JF4Q5hXh-_Q), was die lokale Nutzung erheblich verbreitern könnte.
- Eine erneute X-Untersuchung — Diese Runde scheiterte an irreführenden Trend-Suchen. Eine neue Erhebung mit direkten Begriffen wie „Midjourney“, „Sora“ und „Nano Banana“ könnte interessante Ergebnisse liefern.
Empfehlungen
- X (Twitter) sollte beim nächsten Mal mit direkten KI-Suchbegriffen wie „Midjourney“, „Sora“, „Nano Banana“, „ComfyUI“ und „Flux“ erneut untersucht werden.
- Das schnelle Wachstum des Qwen-Image-2.1-Ökosystems sollte als fester Beobachtungspunkt für Open-Source-Entwicklungen weiterverfolgt werden.
- Das Verhältnis von Betriebskosten zu Umsatz bei Sora2 sollte als Kennzahl für die Profitabilität von Closed-Source-Videogenerierung beobachtet werden.
- Nutzerabwanderungen wegen Schutzvorkehrungen sollten fortlaufend kartiert werden: von welchem Tool zu welchem Tool wechseln Menschen?
- Pinterest sollte entweder auf alle 50 Bilder ausgeweitet werden, oder es sollte eine andere Methode zur Erhebung von Engagement-Zahlen gesucht werden.
- Wegen der Abhängigkeit von !ai_reddit als faktischem Reddit-Repost sollte man sich bei spezifischen Lemmy-Signalen auf Communities wie !stable_diffusion konzentrieren.
Datenqualität
Die X-Daten waren vollständig themenfremd, weil stattdessen Trends aus dem Explore-Tab gesammelt wurden; sie konnten in dieser Ausgabe nichts beitragen. Bei YouTube verhinderten JavaScript-Rendering und bei Pinterest Stichprobenbeschränkungen die Erhebung von Aufrufen, Veröffentlichungsdaten, Abonnentenzahlen, Kommentaren beziehungsweise Speicherungen und Likes. Reddit und Bluesky basieren dagegen auf echten erhobenen Daten beziehungsweise API-Daten und sind relativ die zuverlässigsten Quellen.
Zusammenfassung nach Plattform
Reddit — KI-News zur Bild- und Videogenerierung
Wo
9 Subreddits trugen dieses Thema im gesammelten Material (12 Threads insgesamt, alle über den einzigen Suchbegriff „Image and Video Generation AI News“ gefunden):
- r/generativeAI — 159.938 Mitglieder — 3 Threads (#1, #2, #7)
- r/TopologyAI — 24.052 Mitglieder — 1 Thread (#3)
- r/StableDiffusion — 1.027.672 Mitglieder — 1 Thread (#4)
- r/LocalLLaMA — 838.632 Mitglieder — 1 Thread (#5)
- r/AI_Agents — 452.911 Mitglieder — 1 Thread (#6)
- r/accelerate — 93.680 Mitglieder — 2 Threads (#8, #12)
- r/aifails — 39.194 Mitglieder — 1 Thread (#9)
- r/VideoEditors — 81.700 Mitglieder — 1 Thread (#10)
- r/mildlyinfuriating — 12.610.232 Mitglieder — 1 Thread (#11)
Was Menschen sagen
- Kostenlose Closed-Source-Videogenerierung ist ein Mythos – darin besteht Community-Konsens — Thread #1, r/generativeAI, 71 Punkte, 46 Kommentare, 2026-09-30 (https://www.reddit.com/r/generativeAI/comments/1wty6zj/). Das Originalposter argumentiert, dass Cloud-GPU-Kosten unbegrenzte, wirklich kostenlose Videogenerierung ausschließen; u/opengradient bestätigt: „Videos sind nicht wie billige LLMs, niemand kann sie kostenlos verschenken“ (5 Punkte).
- Closed-Source-Filter für NSFW-Inhalte werden strenger und treiben Nutzende zu offenen oder ungefilterten Alternativen — Thread #2, r/generativeAI, 7 Punkte, 14 Kommentare, 2026-09-30 (https://www.reddit.com/r/generativeAI/comments/1wtzefv/). DreamFort.ai verschärfte seine auf WAN 3.0 basierenden Filter. u/opengradient weist darauf hin, dass „viele Closed-Source-Modellanbieter kürzlich strengere Kontrollen eingeführt haben, einschließlich Alibaba, dem Eigentümer von Wan 3.0“, und nennt Seedream 2.0 Unfiltered sowie MiniMax H3 als Alternativen.
- Open Source plus Blender-3D-Workflow wird als Lösung für die Steuerbarkeit der Videogenerierung angepriesen, doch die Community ist unsicher, ob es echt ist — Thread #3, r/TopologyAI, 437 Punkte, 19 Kommentare, 2026-09-28 (https://www.reddit.com/r/TopologyAI/comments/1wsmvvm/). Trotz des hohen Scores bestehen die Top-Kommentare überwiegend aus verwirrten Fragen („Welche ‚3D-KI‘ ist das?“ — u/stevester911, 5 Punkte) und einer schlichten Zurückweisung von u/amon_de_no: „Das ist Fake-Real-AI“ (5 Punkte).
- Open-Source-Werkzeuge für Referenzkonsistenz bei MiniMax-H3 kommen extrem gut an — Thread #4, r/StableDiffusion, 690 Punkte, 51 Kommentare, 2026-09-30 (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/). Ein kostenloser ComfyUI-Knoten (Fantastic-MiniMaxH3-PromptBuilder) behebt das Überlaufen der Identität bei Video-Bearbeitungen mit Referenzbildern. u/ClassicUse2579: „Dieses H3-Media-Loader-Ding ist einer der besten Comfy-Knoten, die ich je benutzt habe. Es ist verdammt gut!“ (3 Punkte).
- Lokale Open-Source-Bild- und Chat-Stacks sind reif genug für einen Neuheiten-Einsatz — Thread #5, r/LocalLLaMA, 194 Punkte, 96 Kommentare, 2026-10-01 (https://www.reddit.com/r/LocalLLaMA/comments/1wuxzdg/). Ein Tandy 1000 aus den 1990ern wird über WLAN durch lokal ausgeführtes Qwen3.8-27B plus Krea 2 (ComfyUI) für Chat und Bildgenerierung angesteuert. Der Top-Kommentar widerspricht allerdings der Darstellung: u/Aggravating-Push-207 (113 Punkte): „Das läuft nicht auf dem Tandy; der stellt nur Anfragen innerhalb deines Heimnetzwerks.“
- Closed-Source-Schutzvorkehrungen frustrieren Gelegenheitspublikum so stark, dass es zu Alternativen wechselt — Thread #6, r/AI_Agents, 0 Punkte, 22 Kommentare, 2026-09-29 (https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/). Eine Person kann ChatGPT wegen Ablehnungen durch Schutzvorkehrungen nicht dazu bringen, einen Superhelden zu zeichnen; Kommentierende verweisen auf Midjourney, Grok, VeniceAI und offene „uncensored sdxl“-Modelle.
- Bei kostenlosen oder günstigen Angeboten dominieren Closed-Source-Tools mit täglichen Credits weiterhin die Empfehlungen für Gelegenheitsnutzende — Thread #7, r/generativeAI, 4 Punkte, 59 Kommentare, 2026-09-26 (https://www.reddit.com/r/generativeAI/comments/1wqfleb/). Die Empfehlungen teilen sich auf: u/Scuzzy_Womack empfiehlt Offline-ComfyUI (3 Punkte, offen), andere nennen Yodayo/MoescapeAI und Leonardo wegen ihrer täglichen kostenlosen Credits (geschlossen).
- Closed-Source-Video mit Seedance 2.5 über Higgsfield ist inzwischen gut genug für einen zehnminütigen narrativen Kurzfilm einer Einzelperson — Thread #8, r/accelerate, 784 Punkte, 196 Kommentare, 2026-09-26 (https://www.reddit.com/r/accelerate/comments/1wqqr4p/). Figurenblatt-Referenzen werden in jede Szene eingespeist, um Captain Walker über Szenen hinweg konsistent zu halten. u/JoseLunaArts (95 Punkte) meint, die Formulierung „ohne Budget“ verharmlose die Tokenkosten; u/Nabugu (7 Punkte) kritisiert die wiederkehrende Gleichförmigkeit attraktiver KI-Gesichter.
- Bildgenerierung scheitert weiterhin auf dumme, meme-taugliche Weise – als Unterhaltung abgetan, nicht als Trend — Thread #9, r/aifails, 526 Punkte, 76 Kommentare, 2026-09-28 (https://www.reddit.com/r/aifails/comments/1ws6jzs/). Ein Prompt zur Anatomie eines Huhns erzeugte anatomischen Unsinn; der Top-Kommentar von u/kasimirvendom lautet: „Alles hat ein Ende, nur ein Huhn hat zwei“ (52 Punkte).
- Video-Editoren wird ausdrücklich geraten, sich noch nicht auf KI-Tools zu verlassen — Thread #10, r/VideoEditors, 4 Punkte, 39 Kommentare, 2026-09-26 (https://www.reddit.com/r/VideoEditors/comments/1wqkx27/). Der Top-Kommentar von u/VisibleExplanation (33 Punkte): „Vergiss alle KI-Tools. Lade Davinci Resolve herunter und lerne es zu benutzen ... Kein KI-Tool wird gute Ergebnisse liefern, wenn dir grundlegendes Wissen fehlt.“
- Dass Closed-Source-Bearbeitungstools kleinere Bearbeitungen stillschweigend als „Generative AI“ umetikettieren, löst Vertrauensreaktionen aus — Thread #11, r/mildlyinfuriating, 1.268 Punkte, 136 Kommentare, 2026-09-28 (https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/). Photoshop und Apple Photos sollen einfache Zuschnitte als KI-bearbeitet markieren und Copyright-Zuordnungen entfernen. u/Kagevjijon (41 Punkte): „So wie es ist, kann das unmöglich Bestand haben. Das ist tatsächlicher Diebstahl.“ Ein Einwand von u/teh_maxh (135 Punkte): „Ich habe gerade versucht, ein Bild mit Photoshop zuzuschneiden, und es hat keine Metadaten hinzugefügt, die behaupten, ich hätte GAI verwendet.“
- KI-generierte Game-Mods, offen und gemeinschaftsgetrieben, erleben einen Moment — Thread #12, r/accelerate, 193 Punkte, 35 Kommentare, 2026-09-30 (https://www.reddit.com/r/accelerate/comments/1wuhyiw/). u/Chopstik0-0 (38 Punkte) beschreibt, wie ein VR-Modding-Subreddit von Widerstand zu Begeisterung umschwenkte, als klar wurde, dass „sonst niemand wirklich neue VR-Spiele macht“.
Signale
- Im Aufstieg: Open-Source-Werkzeuge für Referenzkonsistenz – ComfyUI-Knoten aus Thread #4 und der lokale Qwen-plus-Krea2-Stack aus Thread #5 – erhalten das eindeutigste Lob: hohe Scores zusammen mit wirklich positiven technischen Top-Kommentaren, nicht nur Hype.
- Im Aufstieg: Closed-Source-Videogenerierung hat den Bereich längerer Erzählungen erreicht. Der zehnminütige Kurzfilm mit wiederkehrenden konsistenten Figuren aus Thread #8 ist der engagierteste gesammelte Thread (784 Punkte, 196 Kommentare); die Kritik richtet sich gegen Drehbuch und Sprechleistung, nicht gegen die Bilder.
- Abgetan: Die Idee eines „wirklich kostenlosen“ Closed-Source-Videogenerators gilt als geklärt und etwas ermüdend (Thread #1). Die Debatte hat sich von „Welche kostenlose Website?“ zu „Welches lokale Open-Source-Setup?“ verschoben.
- Uneinigkeit: Thread #3 zeigt eine Spaltung zwischen oberflächlicher Begeisterung (437 Punkte) und Skepsis beziehungsweise Verwirrung in den Kommentaren darüber, was tatsächlich gezeigt wird. Vage Beiträge über „3D-KI“-Workflows können für diesen Suchbegriff viele Punkte erhalten, ohne dass Einigkeit über das Werkzeug besteht.
- Überraschung – Schutzvorkehrungen treiben inzwischen wiederkehrend Plattformwechsel an und sind nicht bloß ein Ärgernis: Sowohl Thread #2 mit verschärften NSFW-Filtern als auch Thread #6 mit ChatGPT-Schutzvorkehrungen bei einem nicht expliziten Superheldenbild zeigen, dass Nutzende Closed-Source-Tools gerade wegen Moderation verlassen und entweder bei einem anderen geschlossenen Tool (Grok, VeniceAI) oder einem offenen landen (Seedream Unfiltered, uncensored SDXL).
- Überraschung – die Vertrauensreaktion gegen Closed-Source-Tools dreht sich in Thread #11 gar nicht um Inhaltsfilter: Es geht um Zuordnung und Metadaten – gewöhnliche Bearbeitungen werden automatisch als „Generative AI“ markiert und Copyright-Informationen entfernt. Das ist eine andere Beschwerde als die Frustration über Schutzvorkehrungen im Rest des Materials.
Einschränkungen
- Der Sammler verwendete nur einen Suchbegriff („Image and Video Generation AI News“) und fand 12 Threads in 9 Subreddits – weniger als das im Briefing definierte Ziel von ungefähr 20 Beiträgen je Netzwerk. Gemäß Playbook wurde nur das bereits vom Worker gesammelte Material (
output/reddit.threads.md) gelesen und Reddit nicht selbst durchsucht, da Reddit WebFetch blockiert und Suchergebnisse auf entsprechende Seiten führen. - Für die Threads #9, #11 und #12 wurde kein Eröffnungstext erfasst, sondern nur der Titel. Die entsprechenden Erkenntnisse stützen sich daher ausschließlich auf Kommentare und Scores.
- Es wurden keine Threads zu wichtigen Ankündigungen namentlich genannter Closed-Source-Labore wie OpenAI, Google oder Midjourney gefunden. Das Material ist eher von Nutzungserfahrung, Werkzeugen und Reibung mit Schutzvorkehrungen geprägt als von Produktlaunches.
X
X — KI-News zur Bild- und Videogenerierung
Accounts
Keiner der erfassten Accounts diskutiert Closed-Source- oder Open-Source-KI für Bild- oder Videogenerierung. Die 33 erfassten Accounts (@Davesonude, @rcostadoazeite, @ChrisExcel102, @Louissaikyoo, @DlugoszMarcin, @khtaeverse und 27 weitere) sind Accounts für Sport-Memes, K-Pop-Fans, Big-Brother-Fans (#BB28), britische Politik (Restore Britain) sowie allgemeine Meme- und Shitpost-Accounts. Keiner veröffentlicht Bild- oder Video-KI als Kernthema. Es gibt daher kein „Wer treibt das auf X?“ für das eigentliche Forschungsthema – siehe ## Einschränkungen.
Beiträge
Kein Beitrag in output/x.posts.md (40 Beiträge, 33 Accounts) erwähnt Bildgenerierungs-KI, Videogenerierungs-KI oder ein verwandtes Produkt, Unternehmen oder Open-Source-Projekt – keine Nennungen von Midjourney, Sora, Stable Diffusion, Flux, Runway, Veo, Nano Banana, ComfyUI oder Ähnlichem. Stichproben der Beiträge mit höchstem Engagement bestätigen dies:
- Beitrag #7, @Davesonude, ca. 291.000 Aufrufe, 22.958 Likes (2026-09-30), https://x.com/Davesonude/status/2105273235965370529 — ein Ronaldo-Fußball-Meme. Gefunden über die Suche nach „Ronaldo“.
- Beitrag #19, @ChrisExcel102, ca. 343.000 Aufrufe, 7.886 Likes (2026-09-29), https://x.com/ChrisExcel102/status/2104913863200096350 — ein Meme über eine Promi-Beziehung. Gefunden über die Suche nach „JubJub“.
- Beitrag #26, @Louissaikyoo, ca. 185.000 Aufrufe, 10.292 Likes (2026-09-30), https://x.com/Louissaikyoo/status/2105090778766696620 — ein Disney-Channel-Trivia-Witz. Gefunden über die Suche nach „China“.
- Beitrag #36, @DlugoszMarcin, ca. 189.000 Aufrufe, 2.937 Likes (2026-09-30), https://x.com/DlugoszMarcin/status/2105363575145394223 — Fußballkommentar zu Messi, Lewandowski, Ronaldo und Modrić. Gefunden über die Suche nach „Messi“.
Keiner dieser oder der übrigen 36 Beiträge berührt das Forschungsthema. Hier werden keine 5–12 „Erkenntnisse“ über KI-Bild- oder Videogenerierung aufgeführt, weil das bedeuten würde, sie zu erfinden – was das Playbook für diesen Durchlauf ausdrücklich verbietet.
Signale
Aus diesem Datensatz lässt sich kein Signal zu Open-Source- oder Closed-Source-KI für Bild- oder Videogenerierung ableiten. Was die Daten tatsächlich zeigen: Die zehn Suchbegriffe („Halloween“, „Ronaldo“, „Britain“, „Yess“, „JubJub“, „Gold“, „China“, „#bb28“, „Messi“, „Balkans“) waren die eigenen Explore-Trends von X für den Standort dieser Sitzung und keine Themen zur KI-Mediengenerierung. Die Explore-Tabelle in output/x.posts.md bestätigt dies: 6 der 10 Trends sind ausdrücklich als „Trending in Croatia“ markiert; die übrigen („Ronaldo“, „Britain“, „China“, „Messi“) sind globale Sport- oder Politiktrends. Das weist auf einen Fehler bei der Erhebung hin: Der Worker sammelte, was X als Trend auswies, statt nach Begriffen zur KI-Bild- und Videogenerierung zu suchen. Die daraus entstandenen 40 Beiträge behandeln Fußball, eine britische politische Partei (Restore Britain), einen K-Pop-Fandom-Streit, eine Reality-TV-Staffel (#BB28) und unverbundene Memes.
Einschränkungen
- Das gesammelte Material beantwortet das Forschungsbriefing nicht. Das Briefing verlangt Closed-Source- und Open-Source-Nachrichten zu Bild- und Videogenerierung; die zehn Suchbegriffe des Workers waren allgemeine X-Trends dieser Sitzung, überwiegend nach Kroatien geolokalisiert, und keine KI-Anfragen. Alle 40 Beiträge wurden manuell auf Themenbezug geprüft, und keiner qualifiziert sich.
- Gemäß Playbook wurde X nicht selbst durchsucht – ein anonymer Reader sieht dort nichts – und ausschließlich auf
output/x.posts.md/output/x.posts.jsonals gesammelte Daten vertraut. - Das Abschlusskriterium von ungefähr 20 analysierten Beiträgen je sozialem Netzwerk wurde zwar mengenmäßig erreicht (40 Beiträge), aber nicht inhaltlich. Die X-Phase sollte mit Begriffen wie „Midjourney“, „Sora“, „Stable Diffusion“, „Flux“, „Runway“, „Veo“, „Nano Banana“, „ComfyUI“ oder Ähnlichem statt der allgemeinen Trends erneut durchgeführt werden.
YouTube
YouTube — KI-News zur Bild- und Videogenerierung (Closed Source / Open Source)
Kanäle
- AI WITH Rithesh (Rithesh Sreenivasan) — persönlicher Kanal, der ChatGPT- und OpenAI-Veröffentlichungen am selben Tag testet.
- Bart Slodyczka — fasst direkt nach der Veröffentlichung neuer Modelle zusammen, was sich verändert hat.
- Learn with LEESI — auf Google Gemini, Veo und Flow spezialisierter Tutorial-Kanal.
- WorldofAI(@intheworldofai) — bespricht wöchentlich Closed-Source-KI-News.
- MattVidPro — großer KI-Kanal, bekannt für Vergleiche und Eilmeldungen zu KI-Videomodellen.
- There's An AI For That(@theresanaiforit) — Eilmeldungen und Modellvergleiche.
- Promptus AI(@promptusai) — spezialisiert auf lokale Einrichtungs-Tutorials für Open-Source-Bild- und Videomodelle.
- AI Late to Class(@ailatetoclass) — Reviews von Open-Source-Modellen zur Bildbearbeitung.
- MaxonShire — spezialisiert auf Vergleiche lokaler Videogenerierungsmodelle wie HunyuanVideo, Wan und LTX.
- smallzero(@webdot3) — Nutzung von Open-Source-Modellen wie Z-Image mit ComfyUI.
- FlyMyAI — veröffentlicht tägliche beziehungsweise wöchentliche KI-News-Briefings.
- Lev Selector(@lev-selector) — Kanal mit wöchentlichen KI-Update-Zusammenfassungen.
Die Abonnentenzahlen konnten nicht direkt bestätigt werden, da das HTML der YouTube-Suchergebnisse per JavaScript gerendert wird (siehe Einschränkungen).
Videos
Closed Source
- „ChatGPT Images 2.5 Is INSANE… 48 Hours Later, I'm Still Shocked!“ — AI WITH Rithesh / Anfang September 2026 — Test von GPT Image 2.5, das OpenAI am 8. September 2026 eingeführt hat, einschließlich der neuen Funktion „Sketch“ zur Bildgenerierung aus Skizzen und bis zu 50 % höherer Generierungsgeschwindigkeit. https://www.youtube.com/watch?v=LYUr4BY33h4
- „ChatGPT Image 2.5 Just Dropped — Here's Everything That's New“ — Bart Slodyczka / September 2026 — Überblick über die neuen Funktionen von GPT Image 2.5. https://www.youtube.com/watch?v=dvpQHWwuaIo
- „Google Just Made VEO 3.1 FREE for Everyone with Unlimited AI Video Generation“ — Learn with LEESI — stellt vor, dass Veo 3.1 über Google Flow/Vids kostenlos verfügbar wurde, einschließlich Bild-zu-Video und Unterstützung für drei Referenzbilder. https://www.youtube.com/watch?v=uj6eD31OxkA
- „Google's Nano Banana 2.0: Best Text-To-Image Generation Model EVER! The Photoshop killer!“ — WorldofAI — testet Google DeepMinds Nano Banana 2.0, Bildgenerierung aus der Gemini-Familie, und bewertet es als besser als Photoshop. https://www.youtube.com/watch?v=u22-XoQvI4I
- „Kling 2.5 goes BEAST MODE for AI Video!“ — MattVidPro — berichtet, dass Kling 2.5 bei der Dynamik von Bewegungen große Fortschritte gemacht habe. https://www.youtube.com/watch?v=SGUxHC1cI1c
- „AI Video Models Are Getting Out of Control! (WAN 2.5, Kling 2.5, Wanimate)“ — MattVidPro — vergleicht Closed Source (Kling) und Open Source (Wan) direkt und argumentiert, dass der Wettbewerb eskaliert. https://www.youtube.com/watch?v=vFXe3uXb75k
- „Your AI news brief for September 3, 2026.“ — FlyMyAI — allgemeines KI-News-Briefing zum Stand vom 3. September 2026, einschließlich Themen zur Bild- und Videogenerierung. https://www.youtube.com/watch?v=JK6w9tA2jH8
- „Exciting AI Updates Weekly - September 25, 2026“ — Lev Selector — Zusammenfassung der KI-Updates der vergangenen Woche, einschließlich Bild- und Videogenerierungsmodellen. https://www.youtube.com/watch?v=iyZHPCNd8jI
Open Source
- „Is FLUX 2.0 The New Open Source King?“ — There's An AI For That — bewertet FLUX.2 von Black Forest Labs als möglichen Spitzenkandidaten unter Open-Weight-Modellen für Bildgenerierung und Bearbeitung. https://www.youtube.com/watch?v=YQuTkPVkCS8
- „New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial“ (oEmbed-Titel: „Z-Image Open-Source Image Generator: Free Online and Local Setup“) — Promptus AI — stellt Z-Image Turbo von Alibaba Tongyi-MAI vor, ein Modell mit 6 Milliarden Parametern, das mit 6 GB VRAM läuft und Flux 2 übertreffen soll. https://www.youtube.com/watch?v=JF4Q5hXh-_Q
- „Z-Image Full Release: The New King of AI Influencers in ComfyUI?“ — smallzero — testet die vollständige, nicht destillierte Base-Veröffentlichung von Z-Image in ComfyUI. https://www.youtube.com/watch?v=ClVY5ll1sDU
- „Qwen Image 2.1 best open source Image Editor. Better than Nano Banana“ — AI Late to Class — bewertet die aktuelle Version von Alibaba Qwen-Image-Edit mit zehn Referenzbildern, transparentem Hintergrund und höherer Geschwindigkeit als Nano Banana ebenbürtig oder überlegen. https://www.youtube.com/watch?v=AIgYj5RG-FQ
- „HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?“ — MaxonShire — vergleicht Tencents HunyuanVideo 1.5 und Alibabas Wan 2.7 als lokale Videogenerierungsmodelle. https://www.youtube.com/watch?v=4GNT4-QYekg
Signale
- Closed Source konkurriert über die Geschwindigkeit neuer Funktionen: OpenAI mit GPT Image 2.5 und „Sketch“ am 8. September 2026, Google mit kostenloser Freigabe von Veo 3.1 und Integration in Google Vids/Flow sowie Kling 2.5 aktualisierten sich fast zeitgleich. Der Funktionswettlauf setzt sich im Monatsrhythmus fort.
- Die chinesische Open-Source-Seite mit Alibaba Tongyi-MAI und Qwen gewinnt an Dynamik: Z-Image Turbo und Qwen-Image-Edit werden wiederholt unter den Gesichtspunkten „läuft mit 6 GB / niedrigem VRAM“ und „Qualität auf Nano-Banana-Niveau“ behandelt und direkt mit FLUX.2 von Black Forest Labs verglichen.
- Vergleichsvideos „Open Source gegen Closed Source“ sind zu einem eigenen Genre geworden: Titel wie „WAN 2.5 is Open Source Veo3“ oder „Z-Image vs Flux 2“ behandeln Open-Source-Modelle auffällig oft als Alternative zu Closed Source.
- Tutorials zur lokalen Ausführung mit ComfyUI von Promptus AI, MaxonShire und smallzero sind das zentrale Content-Format der Open-Source-Seite. Sobald ein neues Modell erscheint, folgen sofort Videos zur Einrichtung in ComfyUI.
- Wöchentliche und tägliche KI-News-Briefings von Kanälen wie FlyMyAI und Lev Selector behandeln Bild- und Videogenerierung kontinuierlich. Neuigkeiten zu einzelnen Modellen verbreiten sich somit auch über diese regelmäßigen Update-Kanäle.
Einschränkungen
- YouTube-Suchergebnisseiten (
youtube.com/results?search_query=...) und Videoseiten (youtube.com/watch?v=...) werden per JavaScript gerendert. Deshalb konnten WebFetch weder die Videoübersichten noch Seiteninhalte wie Aufrufe, Veröffentlichungsdatum, Abonnentenzahl oder Kommentare direkt abrufen. Titel und Kanalnamen wurden für jedes Video über den JSON-oEmbed-Endpunkt vonyoutube.com/oembedbestätigt; Zeitpunkt und Kontext wurden durch Such-Snippets und verwandte Artikel ergänzt. - Daher konnten die genauen Aufrufzahlen, Veröffentlichungsdaten und Abonnentenzahlen der einzelnen Videos nicht bestätigt werden. Einige Suchergebnisse zeigten relative Angaben wie „vor X Tagen“, aber viele Videos waren älter als 60 Tage. Für diesen Bericht wurden eindeutig aktuelle Themen priorisiert, etwa GPT Image 2.5 vom 8. September 2026 und datierte Wochen-News-Videos.
- Zu Runway Gen-4.5, Grok Imagine, Seedream 4.0 und Midjourney V8 wurden verwandte YouTube-Videos gefunden, aber es lagen nicht genug Informationen vor, um Veröffentlichungszeitraum oder Kanaldetails zuverlässig zu bestätigen. Daher wurden sie nicht in die Video-Liste aufgenommen.
- Kommentare konnten nicht analysiert werden, weil der Seiteninhalt der Videos nicht abrufbar war.
Bluesky
Bluesky — KI-News zur Bild- und Videogenerierung (Closed Source / Open Source)
Zur Methode: Die offizielle Bluesky-Seite (bsky.app) rendert Suchergebnisse als JavaScript-SPA. Deshalb wurde die öffentliche AT-Protocol-API (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts, ohne Authentifizierung) direkt abgefragt, um reale Beitragsdaten wie Text, Autor, Likes und Veröffentlichungszeit zu erhalten. Mit Suchbegriffen wie „Nano Banana“, „Sora 2“, „Flux“, „ComfyUI“, „Z-Image“, „Qwen Image“, „open weights“ und „Veo 3“ wurden mehr als 100 echte Beiträge geprüft und daraus thematisch passende ausgewählt.
Accounts
- Eliot Higgins (
eliothiggins.bsky.social, Gründer von Bellingcat, auf Bluesky verifiziert) — berichtet kontinuierlich über Risiken von Desinformation und Deepfakes durch Veo 3. - Simon Willison (
simonwillison.net, unabhängiger KI-Forscher, auf Bluesky verifiziert) — führt Open-Weight-Modelle wie Qwen-Image und Qwen-Image-Edit lokal aus und veröffentlicht technische Notizen dazu. - Ethan Mollick (
emollick.bsky.social, Professor an der Wharton School, auf Bluesky verifiziert) — kommentiert regelmäßig Risiken und Fähigkeiten von Open-Weight-Modellen. - 404-Media-Reporter (Jason Koebler
jasonkoebler.bsky.social, Sam Colesamleecole.bsky.social) — recherchieren zu Copyright- und Inhaltsmoderationsproblemen bei Sora 2. - obeca (
obeca.bsky.social, türkischsprachig) — persönlicher Account, der fast täglich mit Nano Banana 2 erzeugte Bilder veröffentlicht. - Ria_Tatibana (
ria-tatibana.bsky.social, japanischsprachig) — veröffentlicht täglich Illustrationen mit ComfyUI plus Krea2, einem Open-Source-Modell. - cubby.jpg (
cubby-ai.bsky.social) — produziert KI-Kunst mit Open-Source-Bildmodellen wie Z-Image und Qwen-Image. - AlternativeTo (
alternativeto.net) — automatisierter Account für Software-News, der Modellveröffentlichungen wie Qwen-Image-2.1 zeitnah meldet.
Beiträge
Closed Source
- Problem: Google Veo 3 kann rassistische Inhalte generieren — Eliot Higgins, 2025-06-22, ❤️842. „Google Veo 3 eröffnet neue und aufregende Möglichkeiten für Rassismus.“ https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y
- TIME-Reporter erzeugten mit Veo 3 erfolgreich gefälschte Videos von Muslimen bei Brandstiftung und von brennenden Hindu-Tempeln; Google fügte nach Nachfragen sichtbare Wasserzeichen hinzu — Aman Batheja, TIME-Reporter, 2025-06-03, ❤️431 · 🔁192 · 107 Zitate. https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h
- Sora 2 soll jährlich rund 5 Milliarden US-Dollar Betriebskosten verursachen, aber bislang nur etwa 1,4 Millionen US-Dollar Umsatz eingebracht haben — Peter Labuza, 2026-02-10, ❤️1.375 · 🔁368 · 192 Zitate. https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o
- Sora symbolisiere den Zusammenbruch der Behauptung von KI-Unternehmen, nicht mit urheberrechtlich geschütztem Material trainiert zu haben — Jason Koebler, 404 Media, 2025-10-01, ❤️1.508 · 44 Zitate. https://bsky.app/profile/jasonkoebler.bsky.social/post/3m25uzxbcak23
- Bericht: Nutzende reagieren heftig, nachdem Sora 2 die Generierung urheberrechtlich geschützter Figuren verboten hat — Sam Cole, 404 Media, 2025-10-08, ❤️435 · 37 Zitate. https://bsky.app/profile/samleecole.bsky.social/post/3m2ovizmqks2t
- Erlebnisbericht, durch ein Bild aus der Nano-Banana-2-Familie getäuscht worden zu sein — furuakasaber.bsky.social, 2026-07-03, ❤️333. https://bsky.app/profile/furuakasaber.bsky.social/post/3mpr6djkzsk2e
- Müdigkeit gegenüber Nano-Banana-Infografiken, die wie offensichtlich KI-generierte Diagramme wirken — garrison.corporate.fm, 2026-03-15, ❤️73 · 🔁9. https://bsky.app/profile/garrison.corporate.fm/post/3mh4g5avqp22p
Open Source
- Alibaba Qwen veröffentlicht sein erstes Bildgenerierungsmodell Qwen-Image unter Apache-2.0-Lizenz — Simon Willison, 2025-08-04, ❤️46. https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223
- Praxistest von Qwen-Image-Edit: Auf einem Mac wird fast der gesamte 64-GB-RAM belegt, außerdem werden 54 GB Speicherplatz benötigt — Simon Willison, 2025-08-19, ❤️77. https://bsky.app/profile/simonwillison.net/post/3lws3xfzhv22u
- Alibaba veröffentlicht das 7-Milliarden-Parameter-Modell Qwen-Image-2.1 als Open Weight und ändert dabei die Lizenz — AlternativeTo, 2026-09-24, ❤️6. https://bsky.app/profile/alternativeto.net/post/3mwaq75byhn2a
- Apple veröffentlicht Open Weights für STARFlow und STARFlow-V, Transformer-autoregressive Flow-Modelle für hochwertige Bild- und Videogenerierung — Sung Kim, 2025-12-02, ❤️13. https://bsky.app/profile/sungkim.bsky.social/post/3m6xsab2zj22w
- Warnung: Das leistungsfähige Open-Weight-Modell GLM-5.3 verfügt fast über keine Schutzvorkehrungen und kann offensive Cyberfähigkeiten besitzen — Ethan Mollick, 2026-08-28, ❤️88. https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o
- Tägliche Illustrationen mit ComfyUI plus Krea2, meist mit ❤️50–80 je Beitrag — Ria_Tatibana, mehrere Beiträge vom 2026-09-28 bis 2026-10-01, zum Beispiel https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t, ❤️53. Die meisten Treffer für ComfyUI bestehen aus alltäglichen Werkteilungsbeiträgen von KI-Illustratorinnen und -Illustratoren.
- Erwartung und Ironie rund um die Veröffentlichung von Z-Image, einem leichten Open-Source-Bildmodell von Alibaba Tongyi — theophite.bsky.social, 2025-11-27, ❤️30. https://bsky.app/profile/theophite.bsky.social/post/3m6ldsilaz22f
Signale
- Veo 3 hat den Ruf eines Werkzeugs für Desinformation verfestigt: Eliot Higgins, Gründer von Bellingcat, behandelt das Thema wiederholt; die TIME-Recherche wurde ebenfalls stark verbreitet (❤️431, 107 Zitate). Bei Closed-Source-Videogenerierung liegt der zentrale Streitpunkt zunehmend nicht bei Qualität, sondern bei Missbrauch.
- Sora 2 kämpft wirtschaftlich und bleibt umstritten: Die Zahl von jährlich 5 Milliarden US-Dollar Betriebskosten gegenüber 1,4 Millionen US-Dollar Umsatz (❤️1.375) wurde breit geteilt. Verschärfte Einschränkungen bei urheberrechtlich geschützten Figuren lösten zudem Nutzerunmut aus (❤️435). Das Muster „Closed-Source-Regeländerung → Nutzerreaktion“ tritt wiederholt auf.
- Nano Banana von Google ist offenbar ein Standardwerkzeug für allgemeine Bildgenerierung geworden: Privatpersonen wie obeca.bsky.social posten täglich erzeugte Bilder, auch in nicht englischsprachigen Räumen wie der türkisch- und japanischsprachigen Community. Gleichzeitig bleibt das Gefühl verbreitet, die Ergebnisse seien beunruhigend schwer zu erkennen (❤️333).
- Qwen-Image ist der zentrale technische Gesprächsstoff der Open-Source-Bildgenerierung: Forschende wie Simon Willison führen echte Tests durch, bis hin zu VRAM- und Speicherverbrauch. Die Apache-2.0-Lizenz wurde positiv aufgenommen. Bei Qwen-Image-2.1 kam es jedoch zu einer Lizenzänderung, wodurch auch auf der Open-Source-Seite die Frage entsteht, wie offen ein Modell tatsächlich ist.
- ComfyUI bleibt der De-facto-Standardworkflow für Open-Source-Bildgenerierung: Die Mehrheit der Suchtreffer sind Alltagsbeiträge mit ComfyUI und bestimmten Modellen wie Krea2 oder SDXL. Das zeigt weniger technische Neuigkeit als die Etablierung eines Werkzeugs im täglichen kreativen Gebrauch.
- Open Weights bedeuten hohe Leistung, aber fehlende Schutzvorkehrungen – davor warnen Fachleute: Bekannte Forschende wie Ethan Mollick sprechen über offensive Fähigkeiten und minimale Risikoprüfung bei Modellen wie GLM-5.3. Mit Apple und STARFlow tritt auch ein großer Anbieter in den Open-Weight-Bereich ein; die Basis der Open-Source-Seite wird breiter.
Einschränkungen
- Die Bluesky-Webseite bsky.app ist eine SPA, weshalb sich Beiträge nicht direkt per WebFetch abrufen ließen; auch der Suchendpunkt von
public.api.bsky.appgab 403 zurück. Die identische API unterapi.bsky.appohne „public.“ antwortete schließlich ohne Authentifizierung und wurde für die Erhebung echter Daten verwendet. - Allgemeine Begriffe wie „Flux“, „Kling“ oder „Wan“ kollidieren oft mit anderen Themen wie Spielen, Wetter oder Namen und erzeugten viel Suchrauschen. Für FLUX wurden 15 Treffer gefunden, von denen praktisch keiner Bild-KI betraf. Zu FLUX.2 von Black Forest Labs konnte auf Bluesky keine ausreichende Beitragsmenge bestätigt werden.
- Für einzelne Video-Modelle wie Kling 2.5, Wan 2.5, HunyuanVideo und Seedance lieferte die verwendete Suche nicht genügend Treffer. Eine nennenswerte Bluesky-Diskussion zu diesen Namen konnte nicht bestätigt werden; andere Plattformen wie YouTube könnten aktiver sein.
- Auch mit
sort=topist die API nicht unbedingt strikt nach Popularität sortiert; bei cursorbasierter Paginierung waren gemischte Daten sichtbar. Die ausgewählten repräsentativen Beiträge sind daher keine exakte Popularitätsrangliste, sondern thematisch passende, real bestätigte Beispiele.
Lemmy
Lemmy — Entwicklungen bei KI für Bild- und Videogenerierung (Closed Source / Open Source)
Communities
- !«メールアドレス» — zentrale Community für Veröffentlichungen neuer Open-Source-Modelle und -Tools. Die Beitragsfrequenz ist hoch, aber die einzelnen Scores liegen meist zwischen 1 und 10.
- !«メールアドレス» / !«メールアドレス» — Civitai-verbundene automatische Posts mit täglich erzeugten Bildern aus Modellen wie Krea und SDXL. Geringer Nachrichtenwert, aber ein Nachweis für die alltägliche Nutzung von Open-Source-Modellen.
- !«メールアドレス» / !«メールアドレス» — Communities für abstrakte Kunstbeispiele, in denen häufig dasselbe Bild quergepostet wird.
- !«メールアドレス» — botbetriebene Community, die KI-Subreddits wie r/ArtificialIntelligence spiegelt. Sie ist der Hauptzufluss für Closed-Source-News zu Sora, Nano Banana und Seedream, doch Scores liegen meist bei 0 oder 1 und Diskussionen fehlen fast völlig.
- !«メールアドレス» / !«メールアドレス» / !tech — hier erscheinen einzelne FLUX-bezogene Nachrichten von Black Forest Labs.
- !«メールアドレス» / !casual_perchance — Communitys von Nutzenden des kostenlosen browserbasierten Bildgenerierungsdienstes Perchance.org.
- Abonnentenzahlen ließen sich nicht feststellen, da die Lemmy.world-Communityseiten (
/c/<name>) wiederholt 500- oder 400-Fehler ausgaben und auch die API (/api/v3/community) wegen unklarer Parameter nicht abrufbar war (siehe Einschränkungen).
Beiträge
Eher Open Source
- scraed/LanPaint — trainingsfreies, hochwertiges Inpainting für beliebige Stable-Diffusion-Modelle mit ComfyUI-Unterstützung / !«メールアドレス» / Score 8 / 2026-09-29 / https://github.com/scraed/LanPaint/
- DenRakEiw/scumble — Desktop-Editor speziell für KI-Inpainting mit Ebenen, Textauswahl und anpassbaren Pinseln. Generiert über eigenes ComfyUI oder API-Anbieter und unterstützt MCP / !«メールアドレス» / Score 3 / 2026-09-29 / https://github.com/DenRakEiw/scumble
- ogoun/fooocus-qwen-image-2.1 — WebUI für Qwen-Image-2.1 / !«メールアドレス» / Score 2 / 2026-09-27 / https://github.com/ogoun/fooocus-qwen-image-2.1
- PrunaAI/Pruna-Qwen-Image-2.1 — LoRA-Adapter mit wenigen Schritten für Qwen-Image-2.1. Er erschien zeitgleich mit Kijais
QwenImage_experimentalControlNet-union-Ableitung und zeigt den schnellen Zuwachs an Werkzeugen um Qwen-Image-2.1 / !«メールアドレス» / Score 0 / 2026-09-26 / https://huggingface.co/PrunaAI/Pruna-Qwen-Image-2.1 - black-forest-labs/FLUX.2-klein-9b-kv-fp8 — FP8-quantisierte Version eines Open-Weight-9B-Modells von Black Forest Labs / !«メールアドレス» / Score 8 / 2026-03-14 / https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8
- Alice v1: Distillation-Enhanced Video Generation Surpassing Closed-Source Models — Open-Source-Modell zur Videogenerierung, das behauptet, durch verbesserte Destillation Closed-Source-Modelle zu übertreffen / !«メールアドレス» / Score 5 / 2026-05-13 / (webm-Anhang, lemmy.dbzer0.com pictrs)
Eher Closed Source
- Black Forest Labs kündigt „FLUX 3“ an — kann neben Bildgenerierung auch 20-sekündige Videos mit Ton generieren und wird zunächst nur begrenzt angeboten / !«メールアドレス» / Score 1 / 2026-07-24 / https://bfl.ai/blog/flux-3
- OpenAI stellt Soras API in der folgenden Woche am 24. September ein, während chinesische Konkurrenz 3 Milliarden US-Dollar einwirbt — Analyse: KI-Video für Endkundschaft ist nicht profitabel, während unternehmensorientierte Anbieter wie Kling Kapital anziehen / !«メールアドレス» / Score 1 / 2026-09-20 / https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
- Google zieht die Google-Earth-KI-Funktion Nano Banana 2 nach einem Tag zurück — Funktion wegen Missbrauchs eingestellt / !«メールアドレス» / Score 1 / 2026-08-07 / https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/
- Ehrlicher Vergleich und technische Erklärung zu Seedream 5.0 Pro gegen Nano Banana Pro / !«メールアドレス» / Score 1 / 2026-07-10 / https://www.reddit.com/gallery/1usc03q
- Vergleich: dieselbe Berserk-Doppelseite mit vier KIs koloriert — ChatGPT Images 2.5, Wan 2.7 Pro, Nano Banana Pro und Seedream 5.0 Pro; Stimmen sehen GPT vorn / !«メールアドレス» / Score 1 / 2026-09-14 / https://www.reddit.com/gallery/1wfyqdy
- Sechs KI-Videomodelle erhalten denselben Prompt und werden von rund 40 Personen blind bewertet — Google Veo auf Platz eins, die drei führenden Modelle liegen knapp zusammen / !«メールアドレス» / Score 1 / 2026-09-17 / https://www.reddit.com/r/ArtificialInteligence/comments/1wipgwa/
- ByteDance kündigt Seedance 2.5 an — ergänzt One-Take-Erstellung und flexible Referenzfunktionen / !«メールアドレス» / Score 3 / 2026-08-01 / https://seed.bytedance.com/en/blog/one-take-creation-flexible-referencing-introducing-seedance-2-5
- Runway meldet eine Verdopplung des Unternehmensgeschäfts und einen NRR von über 300 % / !«メールアドレス» / Score 0 / 2026-08-30 / https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/
Signale
- Qwen-Image-2.1 steht im Zentrum der Open-Source-Seite auf Lemmy: WebUI als Fooocus-Ableitung, ControlNet von Kijai und eine Few-Step-LoRA von PrunaAI wurden in derselben Woche vom 26. bis 27. September veröffentlicht. Qwen-Image ist damit das aktuelle Kernfeld der ComfyUI- und Stable-Diffusion-Community.
- Closed Source verwischt die eigene Grenze: Black Forest Labs, bislang auf Open Weights ausgerichtet, brachte FLUX 3 als begrenzte Closed-Source-Veröffentlichung mit Video und Audio heraus, stellt aber parallel Open-Weight-Modelle wie FLUX.2-klein-9b bereit. Die Trennlinie zwischen Open und Closed Source wird dadurch unscharf.
- Nano Banana 2 ist zugleich Thema und Konfliktherd: Die Integration in Google Earth und der Rückzug einen Tag später wegen Missbrauchs ist die ereignisreichste Geschichte und erhielt den höchsten Score (6; die übrigen liegen überwiegend deutlich niedriger).
- Bei KI-Video dominiert die These, dass Endkundenangebote nicht profitabel sind: Während OpenAI die Sora-API einstellt, konzentrieren sich Kling, Seedance und Runway auf Unternehmen und schneiden bei Finanzierung sowie Umsatz besser ab. Dieser Kontrast erscheint über mehrere Reddit-Spiegelposts.
- Direkte Vergleichsinhalte sind häufig: Beiträge vergleichen Nano Banana Pro, Seedream 5.0 Pro, Wan 2.7 Pro und ChatGPT Images 2.5 unter denselben Bedingungen. Nutzerinnen und Nutzer interessieren sich stärker dafür, welches Modell gewinnt, als für isolierte Nachrichten.
- Eigenständige Lemmy-Diskussionen fehlen fast vollständig: Die meisten gefundenen Beiträge stammen aus dem Spiegelbot !ai_reddit, haben Scores von 0–1 und kaum Kommentare. Originäre Analyse auf Lemmy beschränkt sich im Wesentlichen auf Tool-Beiträge in !«メールアドレス».
Einschränkungen
- Lemmy hat keine große, dedizierte Community für KI-Bild- und Videogenerierung. Das Thema verteilt sich auf die kleine Community !«メールアドレス» mit Tool- und Modellbeiträgen sowie auf !ai_reddit als Reddit-Spiegelbot mit Scores von 0–1. Letzteres ist faktisch eine Reddit-Wiederveröffentlichung und keine eigenständige Lemmy-Stimme.
- Abonnentenzahlen der Communities konnten nicht abgerufen werden.
https://lemmy.world/c/<community>gab wiederholt HTTP 500 zurück, währendhttps://lemmy.world/api/v3/community?name=...mit HTTP 400 antwortete. Möglich sind abweichende Parameter oder Instanzbeschränkungen. - Für Begriffe wie „Grok Imagine“, „Kling AI“, „Runway Gen“, „HunyuanVideo“ und „Flux“ einzeln gab es fast keine relevanten Beiträge, sondern vor allem Rauschen. Auf Lemmy werden diese Namen offenbar wenig verwendet.
- Die Such-API von lemmy.world beansprucht instanzübergreifende föderierte Suche, gab praktisch aber hauptsächlich Beiträge von lemmy.world, lemmy.ml, lemmy.dbzer0.com, lemmy.today und lemmy.zip zurück. Für eine separate Suche auf lemmy.ml oder lemm.ee war keine Zeit verfügbar.
- Die Scores sind generell niedrig, meist 0–10; die Gesprächsintensität liegt klar unter der anderer Plattformen. Dies dürfte sowohl mit Lemmys geringer Größe als auch mit dem Fehlen spezialisierter Communitys für KI-Bild- und Videogenerierung zusammenhängen.
Pinterest — KI-News zur Bild- und Videogenerierung
50 Pins wurden gesammelt, ohne Genre-Aufteilung, als ein einzelnes Set. Titel und Vorschaubilder wurden direkt geöffnet und geprüft.
Visuelle Themen
- Thumbnails mit „überraschtem YouTuber-Gesicht plus Logo-Sammlung“ — Leuchtende Logos von OpenAI, Google, Meta, Microsoft und Anthropic neben einem überraschten Mann prägen mehrere typische „AI NEWS“-Thumbnails. Neuigkeiten zu Closed Source erscheinen fast immer in diesem wiederkehrenden Format
[2, 7, 23, 41]. - Roboter als Nachrichtensprecher — weiße Androiden im Anzug sitzen vor „BREAKING NEWS“-Panels, oder KI-Moderatoren übernehmen eine Nachrichtenstudio-Zukunft
[23, 45]. - Fotorealistische Porträts als Demonstrationsbilder — hochdetaillierte Gesichter älterer Männer mit Falten, Bart und Texturen dienen wiederholt als Blickfang für neue Modelle, etwa AMD Amuse 3.0 oder Nahaufnahmen von Luma Dream Machine. Realismus fungiert als heutiger Benchmark
[43, 47]. - Rastervergleiche, die dasselbe Quellvideo in mehrere Stile übertragen — dieselbe Person oder dasselbe Auto wird als Holzschnitzerei, Origami, Lego oder Blumendekor neu erzeugt. Das demonstriert Stil-Konsistenz
[4]. - Neonartige Zukunfts-UI-Mock-ups — leuchtende Symbole, Kopf-Silhouetten mit Leiterplattenmustern und holografische Dashboards vermarkten abstrakt Bild-, Video-, Musik- und Textgenerierung
[5, 9, 22, 50]. - Infografiken und Schnellvergleichstabellen für Tools — Logos von ChatGPT, Midjourney, Gemini, Runway, Pika und Krea werden in Neon-Cyber-Grafiken danach sortiert, welches Tool sich bei kostenpflichtiger oder kostenloser Nutzung eignet
[40]. - Warnvisualisierungen zu Fake-Erkennung und KI-Ethik — Roboter prüfen Katzenbilder mit „FAKE“-Stempel; Vorher-Nachher-Grafiken von Augen warnen davor, dem bloßen Aussehen zu vertrauen. Das Thema Misstrauen gegenüber generierten Inhalten ist sichtbar
[1, 20, 32, 37]. - Pins, bei denen Titel und Bild nicht zusammenpassen, kommen mehrfach vor — etwa ein Titel über Stability AIs Einstieg in Videogenerierung mit einem tatsächlich fantasylastigen Moodboard. Wiederverwendete Thumbnails für Klicks scheinen häufig
[29].
Auffällige Pins
- [2] AI News: Anthropic Leak Shows Us The Future of AI... — typisches „AI NEWS“-Thumbnail mit leuchtenden OpenAI-, Google-, Microsoft- und Anthropic-Logos. Zusammenfassung der Entwicklungen bei Closed-Source-Anbietern.
- [4] Google announces ultra-high quality video... — Rasterbild, das dieselbe Person und dasselbe Auto als Holz, Origami, Lego und Blumen neu erzeugt. Anschauliche Demonstration von Stil-Konsistenz.
- [5] Meta Unveils Muse Image and Muse Video Generative... — Science-Fiction-artiges Banner zu „Meta Muse Spark AI Model 2026“, das die Richtung eines persönlichen KI-Assistenten betont.
- [23] Discover how Grok is revolutionizing video... — ein weißer Android-Nachrichtensprecher sitzt vor einem „BREAKING NEWS“-Panel. Visualisierung einer Zukunft, in der KI Nachrichten produziert.
- [26] Google's Gemini Omni Turns Anything Into Video — das „Omni“-Logo steht im Zentrum; Symbole für Bild, Video, Audio und Text bündeln den Anspruch auf multimodale Integration.
- [38] Google Unveils Veo 2: Advanced AI Video Generation... — offiziell wirkendes Veo2-Banner mit dem Slogan „state-of-the-art video generation model“ und nebeneinander angeordneten realistischen sowie animierten Beispielen.
- [43] Introducing Luma Dream Machine - Next Generation AI Video — Nahaufnahme eines Auges mit „Dream Machine“-Typografie. Ein symbolisches Bild für fotorealistische Generierungsleistung.
- [47] 'Amuse 3.0', an AI art creation tool that includes... — lokales KI-Kunst-Tool von AMD. Ein fotorealistisches Bild eines alten Fischers dient als Demo und bewirbt hochwertige Generierung auf der GPU. Eines der wenigen konkreten Open-Source- oder lokal ausgerichteten Tools.
- [40] Top AI Video Generators of 2025 — Neon-Vergleichstabelle, die ChatGPT Plus, Midjourney, Runway, Pika, Kaiber und andere nach „beste Qualität“ sowie „beste kostenlose Option“ sortiert. Praktische Entscheidungshilfe.
- [20] 'AI is getting scary good.' — warnende Infografik zu KI-Videogenerierung, Spracherkennung und Prompt Engineering. Verkörpert die Haltung „Vertraue nicht nur dem, was du siehst“.
Signale
- Pinterest-Inhalte zu Bild- und Videogenerierungs-KI bestehen überwiegend aus nachrichtenartigen Thumbnails zu Closed-Source-Anbietern wie OpenAI, Google Veo/Gemini Omni, Meta Muse, Grok, Midjourney, Runway und Pika. Das Format „überraschtes Gesicht plus Logo-Sammlung“ wirkt oft wie ein zu Pins umgewandeltes YouTube-Thumbnail; Klickwirkung ist wichtiger als Informationstiefe.
- Open Source und lokale Generierung sind kaum präsent. Konkrete Namen fanden sich im Wesentlichen nur bei Stability AI – allerdings nur im Titel bei einem unpassenden Moodboard – und AMD Amuse 3.0, einem lokalen GPU-Tool. ComfyUI, Hugging Face, technische Architekturdiagramme oder Community-Visualisierungen zu Diffusionsmodellen waren nicht zu sehen.
- Fotorealistische Personengenerierung mit Gesichtern, Falten und Oberflächenstrukturen dient bei den Anbietern wiederholt als visuelles Benchmark-Signal: So wird technische Reife kommuniziert.
- Eine nennenswerte Zahl von Infografiken behandelt Misstrauen und Prüfung KI-generierter Inhalte, etwa Erkennung von Fakes, Stimmerkennung und Ethik. Neben der Generierung selbst besteht sichtbares Interesse an Erkennung und verantwortungsvollem Umgang.
- Auffällig abwesend sind Pins, die bestimmte Open-Source-Modelle wie Stable Diffusion, FLUX, Wan oder HunyuanVideo direkt behandeln, ebenso Screenshots von GitHub oder Technikblogs sowie Forschungspapiere und Benchmarkzahlen. Pinterest ist offensichtlich stärker von sekundären News-Zusammenfassungen, Vergleichstabellen und werblichen Bannern geprägt als von Primärquellen technischer Communitys.
Einschränkungen
output/pinterest.pins.mdenthält keine Genre-Aufteilung; das Feldgenreist leer. Deshalb war die vom Playbook vorgesehene Zusammenfassung nach Genres nicht möglich, und alle 50 Einträge wurden als ein Gesamtkorpus ausgewertet.- Von 50 Pins wurden 18 Bilder direkt geöffnet. Die Auswahl berücksichtigte konkrete Titel und Themenstreuung. Die restlichen 32 wurden nicht geprüft; bei den geöffneten Bildern war die Wiederholung der Formate aber so stark, dass die Muster klar erkennbar sind.
- Mehrere Pins haben nicht zusammenpassende Titel und Bilder, beispielsweise ein Stability-AI-Titel mit einem nicht dazugehörigen Moodboard. Solche Pins werden nach Titelkontext erwähnt, nicht nach Bildinhalt.
- Pinterest wurde nicht direkt im Browser besucht; genutzt wurden nur vorab vom Worker gesammelte Bilder und Titel. Daher konnten weder die tatsächlichen Engagement-Zahlen wie Speicherungen und Likes noch die Artikel hinter den Links geprüft werden.
Empfohlene Maßnahmen
- Die X-Phase mit direkten KI-Begriffen wie Midjourney, Sora, Nano Banana, ComfyUI und Flux erneut durchführen, statt allgemeine Trendthemen zu verwenden.
- Das Qwen-Image-2.1-Ökosystem mit WebUI, LoRA und ControlNet als Frühindikator für Open-Source-Dynamik weiter beobachten.
- Die Differenz zwischen Kosten und Umsatz von Sora 2 als Kennzahl für die Rentabilität von Closed-Source-Videogenerierung verfolgen.
- Kartieren, zu welchen Werkzeugen Menschen wechseln, wenn ein Closed-Source-Tool seine Schutzvorkehrungen verschärft.
- Die Pinterest-Stichprobe über 18 von 50 Pins hinaus erweitern oder einen Weg zur Erhebung von Engagement-Zahlen finden.
- Lemmys Community !ai_reddit bei der Gewichtung der Ergebnisse als Reddit-Spiegel behandeln, nicht als unabhängiges Signal.
Gesammelte Bilder


















































Hinweis zur Datenqualität
Die X-Phase sammelte Beiträge zu allgemeinen Trendthemen statt KI-bezogener Suchen und lieferte daher nichts zum Thema. YouTube und Pinterest konnten wegen JavaScript-Rendering und Stichprobenbeschränkungen keine Engagement-Metriken wie Aufrufe, Abonnements, Speicherungen oder Likes bestätigen. Reddit und Bluesky stützten sich auf echte gesammelte beziehungsweise API-Daten und sind hier die zuverlässigsten Quellen.



