KEN’S CAT LOG

News zu KI-Bild- und Videogenerierung — 2026-09-20

Open Source (vor allem chinesische Modelle wie Qwen, Wan und MiniMax-H3) gewinnt rasch an Bedeutung als Alternative, sobald die Gratis-Kontingente geschlossener Modelle aufgebraucht sind. Die X-Phase lieferte wegen irrelevanter Suchbegriffe jedoch keine verwertbaren Daten, sodass sich diese Ausgabe faktisch nur auf fünf Plattformen stützt.

Nachrichtenüberblick zu KI-Bild- und Videogenerierung – Closed Source vs. Open Source — 2026-09-20

Hey! Diesmal habe ich Reddit, X, YouTube, Bluesky, Lemmy und Pinterest im Eiltempo gecheckt 🔥🔥 Fazit: Die Closed-Source-Fraktion (Google Veo/Nano Banana, Sora 2, Midjourney, Kling, Seedance und andere) steht weiterhin im Zentrum der Nachrichten, und synchronisiertes Audio entwickelt sich gerade ernsthaft zur Standardfunktion. Gleichzeitig holt die Open-Source-Seite – insbesondere Qwen, Wan und MiniMax-H3 aus China – mit enormem Tempo auf und wird zur klaren Zuflucht für Nutzerinnen und Nutzer, deren Gratis-Kontingente ausgelaufen sind 🚀. Außerdem wichtig: Der Backlash gegen KI-generierte Inhalte ist außerhalb von KI-Nerd-Communities, also dort, wo sich ein breiteres Publikum trifft, deutlich stärker 😤. Ehrlich gesagt war die X-Phase aber ein kompletter Fehlschlag; deshalb ruht dieses Reporting effektiv auf Daten von fünf Plattformen 🙏

Plattformübergreifend

  • Der Schwung der Open-Source-Seite ist kaum zu bremsen: Reddit (Wan, MiniMax-H3 und Krea2 werden in mehreren Threads als Ausweichoption nach erschöpften Gratis-Kontingenten geschlossener Dienste genannt), Lemmy (in der Community !stable_diffusion wurden allein im September mehr als 15 ComfyUI-Tools für MiniMax-H3 gepostet) und YouTube (Qwen-Image → Qwen-Image-2512 → Z-Image sowie Wan 2.5 → 2.6 → 2.7 werden fast monatlich aktualisiert) erzählen dieselbe Geschichte. „Open Source = kostenlos und hochwertig“ wird offenbar zum De-facto-Standard 💪
  • Geschlossene Videogeneratoren setzen Audio voraus: Auf Bluesky (von Replicate angekündigtes synchrones Audio für Kling 3.0, Audio-Video-Integration bei Seedance 2.0) und YouTube (Grok Imagine 1.5 wird mit simultaner Generierung von Dialog und Umgebungsgeräuschen vorgestellt) zeigt sich derselbe Trend 🎬🔊
  • Googles Veo/Nano-Banana-Familie wird zum Gesicht der Closed-Source-Seite: Pinterest (warme, Pixar-artige Veo-Bilder werden wiederholt als virale Visuals genutzt), YouTube (Theo - t3.gg erklärt schlicht: „Google won image generation“) und Reddit (erweiterte Gratis-Kontingente für Google Flow) bestätigen das gleich dreifach 👀
  • Der Widerstand gegen KI-Inhalte explodiert außerhalb der KI-Blase: Reddit (354 Punkte Empörung über ArtPrize, das KI-Werke zulässt; 63 Punkte Verzweiflung über KI-Bild-Produktionsquoten im Job), Lemmy (die Anti-KI-Community !fuck_ai mit 9.179 monatlich aktiven Nutzern zählt zu den größten auf Lemmy) und Pinterest (Quizformate „Echt oder KI?“ sind als eigenes Genre etabliert) vermitteln dieselbe Stimmung 😨
  • Primärinformationen kommen eher über Einzelpersonen als über Unternehmen: Auf Bluesky sind Unternehmensaccounts fast still; Quellen sind individuelle Forschende wie Simon Willison und Hoster wie Replicate. Auf YouTube dienen Wochenrückblicke persönlicher Kanäle wie AIPOD-CAST und Lev Selector als Nachrichtenquelle. Dass es nur wenige Kanäle mit primärer Unternehmenskommunikation gibt, scheint ein plattformübergreifendes Muster zu sein 📢

Plattform für Plattform

Reddit: Aus neun Subreddits wurden zwölf Threads gesammelt (das Ziel von 20 wurde nicht erreicht). Open-Source-Modelle wie Wan, MiniMax H3 und Krea2 werden in mehreren Threads als Ausweg nach aufgebrauchten Gratis-Kontingenten geschlossener Dienste genannt. Die Einschätzung von GPT Image 2.5 Flare spaltet sich dagegen zwischen „incredible“ und „sieht aus wie Krea2“ 😂. Überraschend: Die stärksten Reaktionen kamen nicht aus KI-Technik-Subreddits, sondern aus allgemeinen Communities (ArtPrize-Backlash mit 354 Punkten) und Berufscommunities (Verzweiflung von Designerinnen und Designern mit 63 Punkten).

X: Ehrlich gesagt war das ein kompletter Unfall 🙈 Die 40 gesammelten Posts suchten lediglich nach allgemeinen Trendbegriffen aus dem Umfeld des Verbindungsorts (Kroatien), etwa „Greenland“, „#Bitcoin“ und „Chelsea“. Es gab null Posts zu KI-Bild- oder Videogenerierung. Von X ließ sich deshalb diesmal keine einzige Erkenntnis zu Closed oder Open Source ableiten. Das ist eine klare Lücke auf einer im Briefing ausdrücklich genannten Plattform 🕳️

YouTube: Es wurden zwölf Videos geprüft. Die Closed-Source-Seite (Theo, Astrovah, Woollyfern als Spezialkanal für monatliche Midjourney-Updates, FixNode) und die Open-Source-Seite (Bijan Bowen, HitPaw, MaxonShire, Promptus AI) sind sauber getrennt. Open Source bewirbt „ComfyUI“, lokale Ausführung und „kostenlos“, während Closed Source Qualität und Funktionen betont. Ärgerlich: Die Suchergebnisseiten sind so stark JavaScript-abhängig, dass Aufrufzahlen und Abonnentenzahlen fast nicht zu bekommen waren 😅

Bluesky: Da die offizielle Such-API durchgehend mit 403 blockierte, wurde auf Posts individueller Forschender (Simon Willison, Max Woolf, Ethan Mollick) und von Replicate ausgewichen. Fast alle gefundenen Posts drehten sich um geschlossene Modelle (GPT Image 2, Runway Gen-4.5, Kling 3.0, Seedance 2.0, Vidu Q3); aktive Open-Source-Community-Accounts waren nicht auffindbar. Einziger ähnlicher Account stellte seine Aktivität bereits im Februar 2025 ein. Unterhaltsam: Ein Pelikan auf einem Fahrrad ist zu einem wiederkehrenden Meme für Modellvergleiche geworden 🐦🚲

Lemmy: Hier war die Trennung zwischen Open und Closed Source am deutlichsten und insgesamt am ausgewogensten. Auf der Open-Source-Seite stehen der MiniMax-H3-Schub in !stable_diffusion und das neue Modell Boogu-Image-0.1 (Apache-2.0, zehn Milliarden Parameter). Auf der Closed-Source-Seite: Googles Nano Banana 2 Lite, Microsofts MAI-Image-2.5, Langform-Experimente mit Sora 2 und die überraschende Nachricht, dass Midjourney in Richtung medizinischer Spa-Angebote pivotiere 😲. Auch die Präsenz der Anti-KI-Community !fuck_ai (8.252 Mitglieder) ist eine spezifische Lemmy-Erkenntnis.

Pinterest: Von 50 vorab gesammelten Pins wurden 30 inklusive Bildern geprüft. Listen mit Closed-Source-Tools und wiederverwendete „AI NEWS“-Thumbnail-Vorlagen werden massenhaft produziert, während Open Source nahezu unsichtbar bleibt – nur Amuse 3.0 tauchte als lokales Tool einmal auf. Auffällig sind die häufig wiederverwendeten Veo-Visuals von Google und die Etablierung von Echtheitsquizzen nach dem Muster „Ist das KI oder echt?“ 🎨

Beobachtungspunkte

Empfehlungen

  • Die X-Phase sollte mit direkt themenbezogenen Suchbegriffen wie "Sora 2" "Midjourney" "Stable Diffusion" "Runway Gen" "Kling AI" "open source image generation" erneut erhoben werden.
  • Die Veröffentlichungsfrequenz chinesischer Open-Source-Anbieter wie MiniMax-H3, Qwen, Wan und Z-Image sollte bei jeder Ausgabe auf der Watchlist stehen.
  • Reaktionen in allgemeinen und beruflichen Communities sollten zusätzlich zu KI-Spezialforen fortlaufend beobachtet werden, da dort die Backlash-Signale stärker sind.
  • Bis zum nächsten Durchlauf sollten Umgehungs- beziehungsweise Alternativlösungen für das 403-Problem der offiziellen Bluesky-Such-API geprüft werden.
  • Das „Production-Memory“-Problem von Sora 2 und Midjourneys Wechsel in den medizinischen Spa-Bereich sollten beim nächsten Durchlauf weiterverfolgt werden.
  • Pinterest-Erhebungen sollten mit Genre-Tags erfolgen, damit Open und Closed Source automatisiert sortiert werden können.

Datenqualität

Die X-Phase verwendete Suchbegriffe ohne Themenbezug – Geopolitik, Kryptowährungen, Fußball und Ähnliches. Von 40 erfassten Posts waren daher null thematisch relevant und es gab faktisch keine nutzbaren Daten. Reddit (12 Einträge) und Bluesky (wegen der blockierten Such-API etwa 12 Einträge über persönliche Accounts) erreichten das im Briefing festgelegte Ziel von etwa 20 Beiträgen pro Plattform nicht. Pinterest und YouTube unterlagen ebenfalls Einschränkungen: Pinterest verfügte über keine Genre-Tags und kein Live-Browsing, während YouTube-Aufruf- und Abonnentenzahlen wegen JavaScript-Abhängigkeit nicht abrufbar waren. Für die Kernaussagen liegen jedoch genügend Informationen vor. Lemmy und YouTube waren vergleichsweise belastbar und lieferten konkrete Erkenntnisse zu beiden Seiten.

Zusammenfassung nach Plattform

Reddit

Reddit — Nachrichten zu KI-Bild- und Videogenerierung

Wo

Die zwölf gesammelten Threads stammen aus neun Subreddits.

Subreddit Mitgliederzahl Anzahl gesammelter Threads
r/generativeAI 154,961 4
r/graphic_design 2,929,382 1
r/GeminiAI 375,783 1
r/grandrapids 161,719 1
r/aitubers 28,785 1
r/ImagineAiArt 19,335 1
r/AIToolTalks 6,757 1
r/aifilmmaking 8,200 1
r/aivideomaking 7,267 1

r/generativeAI ist der zentrale Hub für KI-Bild- und Videogenerierung selbst (vier Einträge). r/GeminiAI und r/ImagineAiArt enthalten Erfahrungen mit geschlossenen Modellen; r/aifilmmaking und r/aivideomaking betrachten die praktische Videoproduktion. r/grandrapids und r/graphic_design zeigen Reaktionen, wenn KI-Inhalte in der realen Welt – bei Kunstwettbewerben oder am Arbeitsplatz – aufschlagen. r/AIToolTalks dient als Auffangbecken für Sorgen rund um KI allgemein.

Was Menschen sagen
  • Thread 1 „Which AI video generator can still be used for free?“ (r/generativeAI, 18 Punkte, 57 Kommentare, 2026-09-16) https://www.reddit.com/r/generativeAI/comments/1whtesl/ — Open Source/lokale Generierung (Wan, MiniMax) wird zum Ausweg, sobald kostenlose Closed-Source-Kontingente erschöpft sind. u/RioMetal: „If you can go local you have plenty of them, like Wan or Minimax“
  • Thread 2 „GPT Image 2.5 Flare — is this actually the best AI image generating model right now?“ (r/ImagineAiArt, 84 Punkte, 60 Kommentare, 2026-09-16) https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/ — Die Bewertungen sind gespalten. u/oldboi777 lobt ein „incredible upgrade“, während u/SeaworthinessFresh16 feststellt: „The result in Comfyui with Krea2 looks the same“.
  • Thread 12 „Need a good video generation AI for image to video of people“ (r/generativeAI, 0 Punkte, 22 Kommentare, 2026-09-15) https://www.reddit.com/r/generativeAI/comments/1wh1y9d/ — Kern des Posts ist Unzufriedenheit mit Zensurfiltern bei geschlossenen Modellen (Google Flow / Nano Banana Pro). u/f5alcon: „Minimax H3 is the best local generator“; u/jworm0624: „Krea 2 turbo for images, minimax h3 for videos. All on comfyui“.
  • Thread 7 „Google Flow is giving creators a surprisingly generous amount of free AI video generation right now“ (r/aifilmmaking, 8 Punkte, 7 Kommentare, 2026-09-14) https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ — Googles Closed-Source-Angebot Flow/Veo erweitert Gratisguthaben und entwickelt sich von einfacher Text-zu-Video-Generierung zu einem Produktionsarbeitsraum für Szenenaufbau, Kamerasteuerung und Medienreferenzen. u/MrBoondoggles sieht das nüchtern: „I'm not surprised Google is giving away Veo at this point... trying to maintain some interest in their product“.
  • Thread 8 „Did Anyone Notice Sudden Quality Drop of Image Generation? From 2 MB to 500 KB“ (r/GeminiAI, 10 Punkte, 25 Kommentare, 2026-09-17) https://www.reddit.com/r/GeminiAI/comments/1wj02p4/ — Bei Gemini wird ein Qualitätsverlust gemeldet (PNG → JPEG, 8 MB → 2 MB → 500 KB); auch Nutzende kostenpflichtiger Tarife beschweren sich. u/Well_HellooF: „there's no difference in quality between the free version and the paid one. suck“
  • Thread 5 „ArtPrize Allows Generative AI“ (r/grandrapids, 354 Punkte, 176 Kommentare, 2026-09-16) https://www.reddit.com/r/grandrapids/comments/1wi4ub0/ — Starker Widerstand gegen die Zulassung KI-generierter Werke zu einem Kunstwettbewerb. u/Chirotera (319 Punkte): „Fucking disgusting. It is not AI "Art," it's fucking theft.“ In einer allgemeinen Community ist die Empörung größer als in Technik-Subreddits.
  • Thread 10 „Company expects us to generate 500 AI images PER WEEK. Is this realistic?“ (r/graphic_design, 63 Punkte, 133 Kommentare, 2026-09-17) https://www.reddit.com/r/graphic_design/comments/1wieke2/ — Designerinnen und Designer klagen über Massenproduktionsquoten mit Closed-Source-Tools wie ChatGPT. u/Diligent-Educator409 (123 Punkte): „500 AI images? Yes. 500 good AI images? No. 1 good AI image? Also no.“
  • Thread 9 „best apps for generating AI videos“ (r/aitubers, 0 Punkte, 46 Kommentare, 2026-09-14) https://www.reddit.com/r/aitubers/comments/1wg3duk/ — Es gibt Nachfrage nach geschlossenen Tools wie InVideo AI und Steve AI, die aus Skripten vollautomatisch Videos erstellen, aber die Community reagiert kühl. u/RobJames007 (15 Punkte): „Youtube is trying to reduce AI slop, not allow more of it onto the platform.“
  • Thread 3 „Please help me generate free ai video without subscription“ (r/aivideomaking, 0 Punkte, 20 Kommentare, 2026-09-15) https://www.reddit.com/r/aivideomaking/comments/1wh80z3/ — u/Chance-Business: „google flow you get 50 free credits per day, each vid is 6-12 credits“; u/Bastisheen92: „Local Generation is free if you already own the Hardware“. Das reproduziert den üblichen Gegensatz zwischen Gratis-Kontingenten geschlossener Dienste und lokaler Open-Source-Ausführung.
  • Thread 11 „Are all of you also anxious about recent news about AI?“ (r/AIToolTalks, 12 Punkte, 36 Kommentare, 2026-09-13) https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ — Nicht direkt zur Bild- oder Videogenerierung, sondern zu Sorgen über Wasserverbrauch, Arbeitsplatzverlust und Regulierung. Die Kommentare stehen sich unversöhnlich gegenüber: u/Big-Pops78 relativiert Wasserbedenken, während u/UnburyingBeetle mit Ironie über den Begriff „cost efficiency“ antwortet.
Signale
  • Aufwärtstrend: Namen offener/lokal laufender Modelle wie Wan, MiniMax H3, LTX Video und Krea2 tauchen unabhängig voneinander in mehreren Threads (1, 2, 12) im selben Kontext auf: als Ersatz nach ausgeschöpften Gratis-Kontingenten geschlossener Dienste. Lokale Generierung wird zum Synonym für „kostenlos und hochwertig“.
  • Wird geringgeschätzt oder verspottet: Der Sarkasmus gegenüber Videogenerierungsdiensten, die sich als „kostenlos“ vermarkten, ist ausgeprägt. In mehreren Threads (1, 4, 6, 12) postete der Bot-Account u/Jenna_AI ähnlich formulierte lange, spöttische Kommentare darüber, dass kostenlose Angebote letztlich doch kostenpflichtig würden. Das steht beispielhaft für die zynische Stimmung der Community.
  • Überraschend: Allgemeine Communities (r/grandrapids, 354 Punkte, 176 Kommentare) und Berufscommunities (r/graphic_design, 63 Punkte, 133 Kommentare) erzielten höhere Werte und mehr Engagement als KI-Technik-Subreddits wie r/generativeAI, die meist bei einstelligen bis einigen Dutzend Punkten lagen. Widerstand und Diskussionen nehmen zu, sobald KI-Inhalte auf Alltag oder Arbeit treffen.
  • Meinungskonflikt: GPT Image 2.5 Flare wird in Thread 2 als „incredible upgrade“ (u/oldboi777) oder als Ergebnis auf Krea2-Niveau (u/SeaworthinessFresh16) bewertet. Auch Thread 7 vereint positive Stimmen über großzügige Gratisguthaben für Google Flow/Veo mit Kritik wie „it's weak at physics and logic. Even Minimax is far better“ (u/Sea-Temporary-6995).
Grenzen
  • Es wurden nur zwölf Threads gesammelt; das Abschlusskriterium des Briefings – etwa 20 Posts pro Plattform analysieren – wurde nicht erreicht. Die zwölf vom Worker gesammelten Threads sind sämtliche verfügbaren Reddit-Daten; in dieser Phase kann Reddit gemäß Playbook nicht weiter durchsucht oder aufgerufen werden.
  • Als Suchbegriff wurde nur das englische „Image and Video Generation AI News“ verwendet. Es gibt keine Hinweise, dass japanische Abfragen oder perspektivische Begriffe wie „Open Source“ und „Closed Source“ getestet wurden.
  • Aus einigen Subreddits wie r/aitubers, r/aivideomaking und r/AIToolTalks wurde jeweils nur ein Thread gesammelt; Aussagen über die Stärke eines Trends innerhalb dieser Subreddits sind deshalb nicht möglich.

X

X — Nachrichten zu KI-Bild- und Videogenerierung (Closed/Open Source)

Accounts

Die 39 Accounts und 40 Posts in output/x.posts.md haben ausnahmslos nichts mit KI-Bild- oder Videogenerierung zu tun. Gesucht wurde nach „Greenland“, „Denmark“, „#Bitcoin“, „NATO“, „Christ“, „Jubjub“, „Charles“, „Bosnia“, „Chelsea“ und „Belgrade“. Dabei handelt es sich um allgemeine Trendbegriffe aus der Explore-Liste von X, die offenbar anhand des Verbindungsorts – Kroatien und Umgebung – geolokalisiert wurde. Kein einziger Suchbegriff bezog sich auf das Forschungsbriefing zu KI-Bild- und Videogenerierung.

Daher enthält diese Datensammlung keine Accounts, die beantworten könnten, wer dieses Thema auf X prägt. Erfasst wurde stattdessen Folgendes:

  • Politik-/Geopolitik-Cluster: @RapidResponse47 (30.291 Likes, Grönland-bezogen), @AJENews, @Rusia_HD, @Globalsurv, @NepCorres und weitere Posts zu Grönland, Dänemark und NATO.
  • Krypto-Cluster: @aacryptoverse, @Bitcoin_Pirate_, @StackandRun, @bitcr_org und andere Posts mit dem Tag #Bitcoin, jeweils mit einstelligen bis einigen Dutzend Likes.
  • Royal-Gossip-Cluster: @barristerlawusa, @hernandez_64876, @thebluestshade, @Rimmesfk; „Charles“ bezieht sich hier auf ein Enthüllungsbuch über Charles Spencer.
  • Fußball-Cluster: @icunga_, @john322226, @Cfc_Kemboi, @Pats_Aura; „Chelsea“ meint Ergebnisse des Chelsea FC.
  • Meme-/Smalltalk-Cluster: @SardineKing_O, @isellbeforeyou, @0xHeatt zu der Krypto-Memecoin-Idee „$jubjub“, sowie zwei serbischsprachige Smalltalk-Posts von @MarquiseDeBelgr.

Kein Account erschien mehr als ein- oder zweimal. Der einzelne Post von @RapidResponse47 mit 30.000 Likes und etwa 6,8 Millionen Views sticht zwar heraus, betrifft aber die Frage der Zugehörigkeit Grönlands und nicht dieses Thema.

Posts

Unter den 40 gesammelten Posts gibt es null Erwähnungen von KI-Bild- oder Videogenerierung – unabhängig davon, ob Closed oder Open Source. Deshalb gibt es keinen repräsentativen Beitrag. Nur als Hinweis auf den Charakter der Daten hier der Post mit dem höchsten Engagement, ausdrücklich ohne Themenbezug:

  1. @RapidResponse47 (nicht thematisch, nur als Referenz) — 30.291 Likes, 5.022 Reposts, 1.164 Antworten, etwa 6.800.000 Views, 2026-09-18. https://x.com/RapidResponse47/status/2101059494587285834 Treffer für „Greenland“. Ein politischer Post über die Zugehörigkeit Grönlands, ohne Bezug zu KI-Bildern oder -Videos.
Signale
  • In dieser X-Phase gab es im erfassten Material keinerlei Erwähnungen, Diskussionen oder Nachrichten zu KI-Bild- und Videogenerierung – etwa Midjourney, Sora, Runway, Stable Diffusion, Flux, Wan oder Kling. Es gibt nicht einmal Material, um zu bewerten, was gerade diskutiert oder nicht diskutiert wird.
  • Die verwendeten Suchbegriffe (Greenland, Denmark, #Bitcoin, NATO, Christ, Jubjub, Charles, Bosnia, Chelsea, Belgrade) stimmen vollständig mit den Überschriften der „X's own Explore list“ am Anfang von output/x.posts.md überein. Offenbar wurden einfach aktuelle allgemeine X-Trends am geolokalisierten Verbindungsort abgefragt: Geopolitik, Royal-Gossip, Fußball und Krypto-Memes. Themennahe Begriffe wie KI-Bildgenerierung, KI-Videogenerierung, Sora, Midjourney, Stable Diffusion oder Open-Source-KI wurden nie verwendet.
  • Daher lässt sich aus dieser Phase weder zu Closed-Source- noch zu Open-Source-Entwicklungen auch nur eine Erkenntnis ableiten.
Grenzen
  • Die Erhebung selbst passt nicht zum Thema. Die zehn Suchbegriffe aus output/x.posts.md betreffen keine KI-Bild- oder Videogenerierung, sondern folgen Explore-Trends zu Geopolitik, Royal-Gossip, Fußball und Krypto-Memes. Da der Worker nie themennahe Suchanfragen ausführte, ist das Abschlusskriterium der X-Phase – etwa 20 relevante Posts analysieren und zusammenfassen – nicht erfüllt.
  • Zwar wurden 40 Posts analysiert, aber keiner erwähnte KI-Bild- oder Videogenerierung.
  • output/x.posts.json enthält dieselben Daten und bot keine zusätzlichen Hinweise.
  • Das einzige Ergebnis dieses X-Durchlaufs lautet daher: Aus den gesammelten Suchbegriffen und Posts lassen sich keine Erkenntnisse zu Closed- oder Open-Source-Entwicklungen bei KI-Bild- und Videogenerierung berichten. Eine erneute Erhebung mit Suchbegriffen wie „Sora 2“, „Midjourney“, „Stable Diffusion“, „Runway Gen“, „Kling AI“, „Flux“ oder „open source image generation“ ist erforderlich.

YouTube

YouTube — Aktuelle Entwicklungen bei KI-Bild- und Videogenerierung (Closed/Open Source)

Kanäle

Eher Closed Source

  • Theo - t3.gg (@t3dotgg) — technische Erklärungen zu Google Nano Banana Pro
  • Astrovah (@astrovah) — Rezensionen und Anwendungsbeispiele für Sora 2
  • Woollyfern (@woollyferncreative) — Kanal für monatliche Midjourney-Updates
  • FixNode (@Fixnode1) — Tutorials zu Runway Gen-4.5
  • Higher E-Learning (@higherelearning) — Tests integrierter Modelle in Adobe Firefly
  • AIPOD-CAST (@AIPOD-CAST) — wöchentliche KI-Nachrichtenübersicht, Episoden aus dem 220er-Bereich
  • Lev Selector (@lev-selector) — wöchentliche KI-Update-Zusammenfassungen

Eher Open Source

  • Bijan Bowen (@Bijanbowen) — lokale Tests von Qwen Image
  • HitPaw Edimakor (@HitPawEdimakorOfficial) — Reviews und Anleitungen zur Wan-Serie
  • MaxonShire (@MaxonShire) — Vergleichstests offener Videomodelle
  • Promptus AI (@promptusai) — Anleitungen zur lokalen Einrichtung neuer Modelle wie Z-Image
  • 黎黎原上啃 / SweetValberry (@SweetValberry) — chinesischsprachige Erklärungen, etwa zu FLUX.1 Kontext

Abonnentenzahlen konnten auf keiner Kanalseite abgerufen werden (siehe Grenzen unten); die Größenordnung der Kanäle bleibt daher unklar.

Videos
  1. „Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN“ — Theo - t3.gg, Veröffentlichungszeitpunkt unbekannt (Nano Banana Pro selbst wurde am 20. November 2025 angekündigt; das Video ist später), Aufrufe unbekannt
    https://www.youtube.com/watch?v=UV9GqinedQ8
    Behauptet, die Bildqualität von Nano Banana Pro auf Gemini-3-Pro-Basis sei so gut, dass Photoshop nicht mehr nötig sei, und das Modell hebe sich selbst innerhalb der Closed-Source-Gruppe ab.

  2. „Sora 2 - An Honest Review As Well As 20 Creative Use Cases To Try“ — Astrovah, 7. Oktober 2025, Aufrufe unbekannt
    https://www.youtube.com/watch?v=pJHWIgri5vk
    Bewertet Sora 2 als bislang realistischstes KI-Video und stellt 20 Praxisanwendungen vor.

  3. „Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More!“ — Woollyfern, Juli 2026, Aufrufe unbekannt
    https://www.youtube.com/watch?v=dvfH5HzCARY
    Erklärt, dass Midjourney V8.2 Personalisierung und einen Stil-Generator für NIJI ergänzt. Die jüngste Folge einer monatlichen Serie.

  4. „I Tested Every AI Video Model in Adobe Firefly So You Don't Have To (July 2026)“ — Higher E-Learning, Juli 2026, Aufrufe unbekannt
    https://www.youtube.com/watch?v=nOSYufWVdq8
    Testet Veo 3.1, Kling 3.0, Runway Gen-4.5 und Sora 2 nebeneinander, nachdem sie in Adobe Firefly integriert wurden.

  5. „Ultimate Runway Gen 4.5 Tutorial For New Users in 2026“ — FixNode, 29. März 2026, Aufrufe unbekannt
    https://www.youtube.com/watch?v=IUge3u4ZrqQ
    Ein Tutorial zur Bild-zu-Video-Generierung mit Runway Gen-4.5, das die filmische Anmutung hervorhebt.

  6. „Episode 222: Weekly AI News Summary - 6 September 2026“ — AIPOD-CAST, 6. September 2026, Aufrufe unbekannt
    https://www.youtube.com/watch?v=8f34nSLdNtk
    Wöchentliche Zusammenfassung zu Modellen, Agenten und Business-Entwicklungen, die auch Nachrichten zur KI-Bild- und Videogenerierung aufgreift.

  7. „Exciting AI Updates Weekly - September 18, 2026“ — Lev Selector, 18. September 2026, Aufrufe unbekannt
    https://www.youtube.com/watch?v=Utu4zIcqPtM
    Ein persönlicher Kanal fasst die KI-Updates der jüngsten Woche zusammen. Der aktuellste Beitrag im Untersuchungsbereich.

  8. „Qwen Image-2512 First Test – The BEST Open Source Image Model!“ — Bijan Bowen, Veröffentlichungszeitpunkt unbekannt (das Modell selbst stammt aus der Dezemberausgabe 2025), Aufrufe unbekannt
    https://www.youtube.com/watch?v=SBaK616nP6Q
    Testet Alibabas Qwen-Image-2512 mit 20 Milliarden Parametern lokal und bezeichnet es als aktuell stärkstes Open-Source-Bildmodell.

  9. „Wan 2.6 Review | How to Use Wan 2.6 for Free | New AI Video Generator Tutorial“ — HitPaw Edimakor, Veröffentlichungszeitpunkt unbekannt (das Modell erschien im Dezember 2025), Aufrufe unbekannt
    https://www.youtube.com/watch?v=6FMisTHYYgA
    Review und kostenlose Nutzung von Alibaba Wan 2.6; erwähnt mehrere Modi wie T2V, I2V und R2V.

  10. „HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?“ — MaxonShire, 25. Juni 2026, Aufrufe unbekannt
    https://www.youtube.com/watch?v=4GNT4-QYekg
    Direkter Vergleich der zwei großen kostenlosen lokalen Videomodelle Tencent HunyuanVideo 1.5 und Alibaba Wan 2.7, das am 22. April 2026 erschien.

  11. „Z-Image Open-Source Image Generator: Free Online and Local Setup“ — Promptus AI, 2026, genauer Zeitpunkt unbekannt, Aufrufe unbekannt
    https://www.youtube.com/watch?v=JF4Q5hXh-_Q
    Stellt Alibabas Z-Image vor: sechs Milliarden Parameter, S3-DiT-Architektur, trotz geringerer Größe bessere Qualität als Flux 2 und Qwen Image; außerdem mit ComfyUI-Integration.

  12. „FLUX.1 Kontext [dev] is open source! Try image editing locally in ComfyUI“ — 黎黎原上啃, 2025, kurz nach Veröffentlichung von Flux Kontext Dev, Aufrufe unbekannt
    https://www.youtube.com/watch?v=v4pp3TdbWNw
    Demonstriert lokale Bildbearbeitung in ComfyUI, nachdem Black Forest Labs die Gewichte des Flux-Kontext-Dev-Modells veröffentlicht hatte. Etwas älter, aber zur Einordnung der Entwicklungslinie offener Bildbearbeitung aufgenommen.

Signale
  • Die Closed-Source-Seite etabliert monatliche Updates als Regeltermin: Die Midjourney-„Update“-Serie von Woollyfern erscheint monatlich; 2026 folgten auf V8 die Versionen V8.1 und V8.2. Auch Runway und Adobe Firefly erhalten alle paar Monate große Updates, die Technikkanäle sofort testen.
  • Synchronisiertes Audio wird bei Closed-Source-Videogenerierung zur Standardfunktion: Kling 3.0 mit nativen Dialogen in fünf Sprachen, Seedance 2.0 mit integrierter Audio-Video-Architektur bis hin zu Raumhall und Grok Imagine 1.5 mit gleichzeitig generierten Dialogen und Umgebungsgeräuschen. Mehrere Suchergebnisse betonen die gemeinsame Generierung von Bild und Ton. Der Wettbewerb verlagert sich von einzelnen Videoclips zu Kurzfilmen mit Ton.
  • Open Source, besonders aus China, veröffentlicht mindestens so schnell wie Closed Source: Allein bei Alibaba folgen Qwen-Image → Qwen-Image-2512 → Z-Image und Wan 2.5 → 2.6 → 2.7 in kurzen Abständen. Tencent HunyuanVideo 1.5 und Lightricks LTX-2 → 2.3 → 2.5 entwickeln sich ebenfalls fast monatlich oder quartalsweise weiter. Videotitel arbeiten häufig mit Aussagen wie „bestes Open Source“ oder „besiegt X“, was auf hohes Zuschauerinteresse hindeutet.
  • Die meisten Open-Source-Videos setzen auf „ComfyUI“, lokale Ausführung und „kostenlos“: Kanäle wie HitPaw Edimakor, Promptus AI und MaxonShire stellen vor allem kostenlose Nutzung und lokale GPUs heraus. Das kontrastiert mit Closed-Source-Kanälen wie Theo, Astrovah und Woollyfern, die eher Qualität und Funktionen bewerten.
  • Wöchentliche KI-Nachrichtenkanäle wie AIPOD-CAST und Lev Selector behandeln Bild- und Videogenerierung als regelmäßiges Segment, also als kontinuierlichen Beobachtungsgegenstand statt als Einzelmeldung.
Grenzen
  • Die YouTube-Suchergebnisseite (https://www.youtube.com/results?search_query=…) wird dynamisch in JavaScript gerendert. WebFetch lieferte nur Navigationslinks aus dem Footer, sodass die vom Playbook erwartete Auslesung von Titel, Kanal, Aufrufen und Veröffentlichungsdatum aus dem HTML nicht funktionierte.
  • Als Ersatz wurden Videos über reguläre Websuche mit site:youtube.com gefunden und Titel sowie Kanal über YouTubes oembed-Endpunkt bestätigt. Damit konnten weder Aufruf- noch Abonnentenzahlen abgerufen werden; in der obigen Liste stehen die Aufrufe daher als „unbekannt“.
  • Bei einigen Videos ließ sich das exakte Datum nicht prüfen: der Nano-Banana-Pro-Beitrag, der Qwen-Image-2512-Test, das Wan-2.6-Review und die Z-Image-Vorstellung. Es wurden nur ungefähre Zeiträume auf Basis von Suchmaschinen-Snippets und Modellveröffentlichungen angegeben.
  • Auch Beschreibungen und Top-Kommentare der Videos waren wegen derselben JavaScript-Abhängigkeit nicht direkt lesbar.
  • Beiträge aus den letzten 60 Tagen ab dem 22. Juli 2026 wurden bevorzugt. Einzelne ältere Videos, etwa zu Flux Kontext oder das Runway-Gen-4.5-Tutorial, wurden als Kontext für die jeweilige Open-/Closed-Source-Entwicklungslinie ergänzt.

Bluesky

Bluesky — Neueste Entwicklungen bei KI-Bild- und Videogenerierung

Accounts
  • Simon Willison (@simonwillison.net) — unabhängiger KI-Forscher. Prüft jedes neue multimodale Modell mit seinem eigenen Benchmark eines „Pelikanen auf einem Fahrrad“. Etwa 50.000 Follower, hohe Postingfrequenz.
  • Max Woolf (@minimaxir.bsky.social) — ehemaliger Datenwissenschaftler bei BuzzFeed. Kennt sich mit Ethik und Forschung & Entwicklung rund um KI-Inhaltsgenerierung aus und reagiert oft auf neue Bildmodelle.
  • Ethan Mollick (@emollick.bsky.social) — Professor an der Wharton School. Spricht im Rahmen allgemeiner KI-Trends auch über Veränderungen der Qualität KI-generierter Videos.
  • Replicate (@replicate.com) — offizieller Account des Model-Hosting-Dienstes. Kündigt neue geschlossene Bild- und Videomodelle an, sobald sie auf der Plattform verfügbar sind.
  • Stability AI (@stabilityai.bsky.social) — offizieller Account des Stable-Diffusion-Entwicklers. Die letzten Posts drehten sich jedoch überwiegend um Stable Audio und Bildbearbeitungs-APIs für Unternehmen; seit 19. November 2025 gab es keine neuen Posts.
  • Stable Diffusion online AI (@stablediffusion.bsky.social) — Account für Prompt-Sharing und KI-Kunst zu SDXL/ComfyUI, etwa 1.800 Follower. Seit 24. Februar 2025 inaktiv.
  • AI Art News (@ai-art-news.bsky.social) — kuratierter News-Account zu KI-Kunst. Seit 18. September 2025 inaktiv.
Posts
  1. Simon Willison (2026-09-19) — Stellt im Zuge eines Posts darüber, GPT-6 Astra und Claude Fable 5.1 mithilfe von Kartendaten 3D-Modelle für Blender generieren zu lassen, einen Workflow von Bildgenerierung zu 3D-Umsetzung vor. 57 Likes, 5 Reposts.
    https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24

  2. Simon Willison (2026-09-05) — Test, bei dem GPT-6 Astra eine Szene mit einem Pelikan auf einem Fahrrad in Blender rendert. 405 Likes, 30 Reposts.
    https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s

  3. Simon Willison (2026-09-04) — Benchmark-Gitter mit „Pelikan auf Fahrrad“ für GPT-6 Astra sowie GPT-5.6 Sol/Terra/Luna im direkten Bildgenerierungsvergleich. 206 Likes, 9 Reposts.
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c

  4. Simon Willison (2026-09-02) — Claude Fable 5.1 erzeugt mit maximalem Denkbudget und Kosten von 3,30 US-Dollar pro Durchlauf sein bislang hochwertigstes SVG-Pelikanbild; danach wurde es animiert. 362 Likes, 22 Reposts.
    https://bsky.app/profile/simonwillison.net/post/3muimzxo2sk2g

  5. Max Woolf (2026-09-19) — Weist darauf hin, dass ein vektorähnliches Bild eines Pelikans auf einem Fahrrad aus einer Bild-KI die Beziehung zwischen Beinen und Pedalen nicht versteht. 1 Like.
    https://bsky.app/profile/minimaxir.bsky.social/post/3mvtt3uxdrk2c

  6. Max Woolf (2026-09-08) — Kommentiert nach der Ankündigung eines neuen OpenAI-Bildmodells, es sei gut gewesen, seinen Artikel zu ChatGPT Images 2.0 aufgeschoben zu haben; das neue Modell scheine wichtiger. Gemeint ist die Ankündigung von ChatGPT Images 2.5. 4 Likes.
    https://bsky.app/profile/minimaxir.bsky.social/post/3muzq6mcadk2n

  7. Ethan Mollick (2026-09-19) — Beobachtet, dass in der Flut von „Slop“, also massenhaft produziertem minderwertigem Content, nun auch wirklich interessante KI-Videowerke auftauchen. 58 Likes, 7 Reposts.
    https://bsky.app/profile/emollick.bsky.social/post/3mvuss476oc2b

  8. Replicate (2026-04-21) — GPT Image 2 von OpenAI wurde zu Replicate hinzugefügt. Hervorgehoben werden Fotorealismus, Textrendering und Layouttreue. 5 Likes.
    https://bsky.app/profile/replicate.com/post/3mjzygaefs224

  9. Replicate (2026-04-09) — ByteDances Videomodell Seedance 2.0 wurde für alle Nutzer freigeschaltet. Es integriert Text, Bild, Video und Audio und unterstützt synchronen Stereoton sowie realistische Physik. 2 Likes, 1 Repost.
    https://bsky.app/profile/replicate.com/post/3mj3junhvnh26

  10. Replicate (2026-02-18) — Ankündigung der Veröffentlichung von Runway Gen-4.5, einem cineastischen Videogenerator mit Fokus auf physikalische Genauigkeit und Realismus. 2 Likes.
    https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c

  11. Replicate (2026-02-17) — Kuaishou Kling 3.0 und Kling o3 wurden zu Replicate hinzugefügt. Unterstützt Multi-Shot-4K-Generierung, synchronisiertes Audio, Videobearbeitung und Stiltransfer. 2 Likes.
    https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q

  12. Replicate (2026-03-11) — Shengshu Vidu Q3 wurde zu Replicate hinzugefügt. Bis zu 16 Sekunden in 1080p mit synchronisiertem Audio, aus Text, Bild oder Start-/Endframes. 1 Like.
    https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w

Signale
  • Closed Source dominiert: Die auf Bluesky tatsächlich gefundenen themenbezogenen Posts handeln fast alle von großen geschlossenen Modellen: OpenAI (GPT Image 2 / ChatGPT Images 2.5), Runway Gen-4.5, Kling 3.0, Seedance 2.0 und Vidu Q3. Die Posts sind nicht primär organisch viral, sondern stammen von Modellhostern wie Replicate oder von individuellen KI-Forschenden wie Simon Willison und Max Woolf.
  • Open Source ist nahezu unsichtbar: Es fanden sich keine aktiven Accounts, die über Flux, Stable Diffusion, Qwen-Image, Wan oder ComfyUI-Workflows posten. Der einzige ähnliche Community-Account, stablediffusion.bsky.social, ist seit Februar 2025 still. Auch Stability AI ist seit November 2025 still; die jüngsten Posts bezogen sich eher auf Stable Audio und Unternehmens-APIs als auf Stable Diffusion für Bilder.
  • „Pelikan auf Fahrrad“ wird zum De-facto-Benchmark: Wenn neue multimodale Modelle wie GPT-6 Astra oder Claude Fable 5.1 erscheinen, vergleichen mehrere unabhängige KI-Beobachter Bildqualität anhand derselben Vorgabe. Das ist ein Bluesky-spezifischer Insidertrend und offenbar ein informeller gemeinsamer Maßstab für Modellfähigkeit.
  • Unternehmensaccounts fehlen: Erwartete Accounts zentraler Marken – OpenAI, Midjourney, Runway ML, Black Forest Labs, Hugging Face, Civitai und ComfyUI – existieren entweder nicht oder sind ungenutzt. Bluesky ist also kein primärer Ankündigungskanal dieser Unternehmen; Nachrichten verbreiten sich vor allem über Forschende oder Zwischenplattformen wie Replicate.
  • Veränderte Bewertung der Videogenerierung: Wie Ethan Mollicks Post zeigt, verbreitet sich die Auffassung, dass zwischen massenhaftem KI-Video-„Slop“ allmählich wirklich hochwertige Werke auftauchen. Das ist allerdings eine allgemeine Beobachtung und keine Aussage über ein bestimmtes offenes Videomodell.
Grenzen
  • Die offizielle Bluesky-Such-API (https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) gab unabhängig von Suchbegriff und trotz Versuchen über zwei CORS-Proxies stets HTTP 403 Forbidden zurück. Auch die Weboberfläche unter https://bsky.app/search?q=... ist eine clientseitig gerenderte SPA, deren Inhalte WebFetch nicht abrufen konnte.
  • Als Ersatz wurden die ohne Authentifizierung funktionierenden Endpunkte app.bsky.actor.getProfile und app.bsky.feed.getAuthorFeed genutzt. Nach über Websuche oder Schätzung gefundenen Accounts wurden deren Feeds abgerufen. Die Ergebnisse sind daher keine plattformweite Keyword-Suche, sondern auf Posts gefundener Accounts beschränkt.
  • Die offiziellen Accounts wichtiger Marken waren entweder ungenutzt oder still, sodass sich von ihnen keine Direktnachrichten beziehen ließen.
  • Wegen der fehlenden Suchmöglichkeit ließ sich das Briefingziel von etwa 20 eindeutig themenbezogenen Posts nicht erfüllen. Mehr als 100 Beiträge aus sieben Accounts wurden gelesen; zwölf direkt thematische Posts wurden ausgewählt.
  • Bilder und Videos selbst wurden nicht dargestellt oder geprüft; Informationsquelle waren nur die Beschreibungen in den Posttexten.

Lemmy

Lemmy — Aktuelle Entwicklungen bei KI-Bild- und Videogenerierung (Closed/Open Source)

Communities
  • !«メールアドレス» — 5.712 Abonnenten, davon 893 lokal; 1.407 Posts und 1.927 Kommentare. Allgemeine Themen rund um Open-Weight-Modelle für Bild- und Videogenerierung. Mit zehn täglich und 66 monatlich aktiven Nutzenden klein, aber sehr aktiv.
  • !«メールアドレス» — 2.362 Abonnenten, 24 täglich, 114 wöchentlich und 344 monatlich aktiv. Ort für Werke aus Open-Weight-Modellen der Stable-Diffusion-Familie; überwiegend direkte civitai-Bildlinks.
  • !«メールアドレス» (Community-Name share_anime_art, Anzeigename „Stable Diffusion Anime“) — 1.598 Abonnenten, davon 206 lokal. SFW-Community für KI-generierte Anime-Illustrationen.
  • !«メールアドレス» — 8.252 Abonnenten, davon 3.027 lokal; mit 9.179 monatlich aktiven Nutzenden insgesamt eine der größten beobachteten Communities. Beschreibt sich als „a place for all those who loathe AI“; im Mittelpunkt stehen Kritik und Spott über KI im Allgemeinen, nicht speziell Bild- oder Videogenerierung.
  • !«メールアドレス» — nur 52 Abonnenten, aber als RSS-Spiegel von Reddit-Threads wie r/ArtificialInteligence laufen dort Bild- und Video-KI-Themen häufig ein. 725 halbjährlich aktive Nutzende.
  • !«メールアドレス», !«メールアドレス» und !«メールアドレス» — allgemeine Tech-Communities. Größere Midjourney-Nachrichten tauchten hier auf.
Posts
  1. ComfyUI-Tools für MiniMax-H3 nehmen im September stark zu (Open Source) — In !«メールアドレス» gab es allein vom 1. bis 16. September 2026 mindestens 15 Tool-Posts zu MiniMax-H3, einem Videogenerierungsmodell. Beispiele:
  2. Boogu-Image-0.1 – neues offenes Bild-Basismodell aus einem Huawei-nahen Labor (Open Source) — !«メールアドレス», Score 5, 2026-06-17. Apache-2.0-Lizenz, zehn Milliarden Parameter und fünf Varianten: Base, Turbo mit drei bis vier Schritten, FP8 und Bearbeitung. Zweisprachiges Textrendering auf Chinesisch und Englisch ist das zentrale Verkaufsargument. https://boogu.org/
  3. Technische Analyse von Seedream 5.0 Pro, einem geschlossenen ByteDance-Modell (Closed Source) — über !«メールアドレス», Score 1, 2026-07-10. Prüfbeitrag mit dem Titel „an honest comparison and technical breakdown“. https://www.reddit.com/gallery/1usc03q
  4. Google kündigt „Nano Banana 2 Lite“ an (Closed Source) — Hacker-News-Spiegel, Score 1, 2026-06-30, mit Link zur offiziellen DeepMind-Seite. Parallel erschien ein deutschsprachiger Beitrag eines Schweizer Tech-Mediums (Score 0, swisstechnews, 2026-07-02). https://deepmind.google/models/gemini-image/flash-lite/
  5. Microsoft MAI-Image-2.5 kommt Nano Banana 2 in Benchmarks nahe (Closed Source) — !«メールアドレス», Score 1, 2026-05-28. Ein Beitrag zum Wettbewerb der Bildmodelle von Google und Microsoft. https://www.reddit.com/r/ArtificialInteligence/comments/1tpu2cd/
  6. Experimentbericht über eine Langformgeschichte mit Sora 2 (Closed Source) — !«メールアドレス», Score 1, 2026-09-13. Rund einen Monat nach dem Start von Sora 2 wurden sieben einstündige Videos produziert. Die zentrale Erkenntnis: Schöne Einzelclips sind nicht schwer; wirklich schwer ist „production memory“, also Konsistenz zu bewahren. https://lemmy.durstig.online/post/59922 (ursprünglich Reddit: https://www.reddit.com/r/ArtificialInteligence/comments/1wfabp9/)
  7. Midjourney pivotiert laut Bericht radikal von KI-Bildern zu medizinischen Spas (Closed Source/Unternehmensentwicklung) — !«メールアドレス» mit einem Artikel von The Register, auf lemmy.zip gekreuzt gepostet, Score 58–66, 2026-06-18. Das Unternehmen soll zu einem Ganzkörperscan-Angebot namens „Golden Light“ wechseln und dafür Basistechnik von Partnern leihen. Die Kommentare verglichen das mit Theranos. https://lemmy.zip/post/66397234
  8. Midjourney fordert von Hollywood-Studios Offenlegung ihrer KI-Nutzung (Closed Source) — !«メールアドレス», Score 73, 2026-07-05. Im Zusammenhang mit urheberrechtlichen Klagen. https://lemmy.today/post/56011946
  9. Vorstellung des Papers InterleaveThinker (Open Source/Forschung) — !«メールアドレス», Score 0, 2026-06-12. Link zu dem arXiv-Paper „Reinforcing Agentic Interleaved Generation“. https://arxiv.org/abs/2606.13679
  10. Stimmungsbild des Widerstands gegen KI-Inhalte (gesellschaftliches Signal) — !«メールアドレス», Score 923, 2026-09-13. Der Post behandelt nicht direkt Bild- oder Videogenerierung, sondern KI-Smartglasses von Ray-Ban Meta. Umfang der Community mit 9.179 monatlich aktiven Nutzenden und die starke Reaktion sind jedoch ein Indiz für den Gegenwind im Umfeld von Bild- und Video-KI. https://lemmy.world/post/51874921
Signale
  • Open Source ist fast vollständig MiniMax-H3: In der !stable_diffusion-Community auf lemmy.dbzer0.com erschienen in der ersten Septemberhälfte täglich Nodes, LoRAs, Quantisierungen und VAE-Beschleunigungen für MiniMax-H3. Namen älterer Modellgenerationen wie Wan, Flux oder HunyuanVideo traten in der Suche kaum noch auf. Dass die ursprünglichen Poster überwiegend individuelle Entwickler mit GitHub-Accounts sind, zeigt ein graswurzelartiges Ökosystem rund um Hugging Face und civitai.
  • Auf der Closed-Source-Seite laufen Google (Nano Banana), Microsoft (MAI-Image), ByteDance (Seedream), OpenAI (Sora 2) und Midjourney parallel, doch die Erwähnungsmenge auf Lemmy selbst ist klein; Scores liegen meist im einstelligen Bereich. Der Hauptstrom kommt lediglich über Reddit-Spiegel wie !ai_reddit. Originäre Lemmy-Beiträge konzentrieren sich auf Unternehmensnachrichten wie Midjourneys angeblichen Wechsel zu medizinischen Spas.
  • Werke mit direkten civitai-Links in stable_diffusion_art und share_anime_art sind aktiv, enthalten aber selten Modellnamen oder Prompt-Details und bleiben als Nachrichtenquelle eher Rohmaterial.
  • Die Anti-KI-Community !fuck_ai zählt zu den größten auf Lemmy. Wenn Beiträge über Bild- oder Video-KI dort landen, dominieren eher ablehnende Kommentare als ausgewogene Debatten.
Grenzen
  • Lemmy hat eine geringe Gesamtreichweite. Die Such-API liefert zudem viele alte oder irrelevante Treffer, etwa HunyuanVideo-I2V aus März 2025 oder Beiträge zu einem Nuklearbrennstoff-Startup namens Fluxnium bei einer Suche nach „Flux“. Der Suchlärm wurde für jeden Begriff manuell bereinigt.
  • Runway Gen, Kling AI und Wan 2.5 wurden einzeln gesucht, aber es fanden sich keine direkt relevanten Posts. Zu Kling gab es keine Treffer, zu Runway keine Treffer und zu Wan nur irrelevante Beiträge. Ein eigenständiger Lemmy-Hype für diese Modelle war nicht erkennbar.
  • !«メールアドレス» ist ein RSS-Bot, der Reddit spiegelt, keine eigenständige Lemmy-Diskussion. Daher wurden nur spezifische Erkenntnisse aufgenommen und die Quelle kenntlich gemacht, um Überschneidungen mit der Reddit-Phase zu vermeiden.
  • Die Nachrichten zu Midjourneys Spa-Pivot und der Hollywood-Offenlegungsforderung stammen vom 18. Juni beziehungsweise 5. Juli 2026 und nicht aus der letzten Woche. Neuere Folgeberichte wurden auf Lemmy nicht gefunden.
  • Rund 20 Posts wurden näher geprüft. Beiträge mit zweistelligen Scores, die wirklich viral gingen, waren nur die Nachricht zu Midjourneys Spa-Pivot und der Smartglasses-Post in !fuck_ai. Ein großer Hype rund um einzelne Bild- oder Videomodelle ließ sich auf Lemmy nicht feststellen.

Pinterest

Pinterest — Nachrichten zu KI-Bild- und Videogenerierung

30 der 50 gesammelten Pins wurden direkt geöffnet und gelesen, einschließlich der Bilder, um diese Zusammenfassung zu schreiben. Die übrigen 20 Titel – überwiegend generische Stockfoto-Listen zu „KI-Content-Erstellung“ und doppelte Grafikzusammenfassungen von Tools – wurden nicht geöffnet, weil ihre Themen bereits durch die nachfolgenden Ergebnisse bestätigt waren.

Visuelle Themen
  • Die YouTube-Thumbnail-Vorlage für „KI-News“ dominiert: Schwarzer oder dunkelblauer Hintergrund, ein reagierendes menschliches Gesicht mit hochgezogenen Augenbrauen oder Lachen, große weiße/rote Schrift „AI NEWS“ und eine Reihe leuchtender Marken-Logos von OpenAI, Google, Anthropic in Orange, Meta, Microsoft und Notion. Wiederholt bei nicht zusammenhängenden Themen, teils mit Titeln, die nicht zum Bild passen. Das Bild ist eine wiederverwendete Kanalvorlage, keine individuell angefertigte Grafik. [6, 14, 41, 43, 47]
  • Tool-Listen verwenden dieselbe dunkel-neonfarbene Infografik-Sprache: Nummerierte lila, orange und türkisfarbene Badges, Laptop-Mock-ups mit Generierungsoberfläche und ein Raster konkurrierender Logos – Runway, Pika, Kling AI, Luma/Dream Machine, Canva, Hailuo, invideo AI, CapCut, Synthesia und HeyGen. Alle genannten Tools sind Closed-Source-SaaS. [2, 29]
  • „Echt gegen KI“-Authentizitätsangst ist ein eigenes wiederkehrendes Format: Gegenübergestellte Quizze wie „Welche ist KI?“, rote „AI-GENERATED“-Banner über Fotos und Meme-Vergleiche „AI GENERATED / ORIGINAL CLIP“. Dieses Genre ist mindestens so verbreitet wie die News-Thumbnails. [3, 21, 32]
  • Googles Veo liefert das visuelle Standardvokabular für cineastische KI-Videos: Dieselben warmen, Pixar-artigen Standbilder – ein Mädchen in einer Küche, Flamingos, eine Tänzerin unter Sternen, ein Schwimmer, eine Wissenschaftlerin oder ein Wissenschaftler am Mikroskop – kehren in mehreren getrennten Pins wieder. Dazu kommt eine Bild-zu-Video-Demo mit einem Plüschmonster für Veo 3. Keine Demo eines Konkurrenten erscheint so oft. [8, 9, 13, 27]
  • Hyperrealistische KI-Porträts dienen als generische Ködergrafik, unabhängig vom tatsächlichen Thema des Artikels: das faltige Gesicht eines Fischers für eine Tool-Ankündigung, das Profil einer Frau mit glitzernder Haut für eine News-Karte oder ein Triptychon mit Gesichtsverwandlung für eine Spielerei-App. Hautporen, Lichtreflexe und geringe Schärfentiefe verraten, dass diese Bilder selbst KI-generiert sind. [33, 45, 48, 20]
  • Generische Sci-Fi- und Leiterplatten-Stockbilder füllen Lücken, wenn es keine echte Produktansicht gibt: leuchtende Drahtgitter-Gehirne, ein chromfarbener humanoider Roboter, ein Geschäftsmann vor einem holografischen KI-Dashboard. Sie vermitteln Stimmung, aber keinen Nachrichtenwert. [1, 37, 50]
  • Einsteigerfreundliche Bildungsinfografiken setzen auf Pastellfarben und Cartoon-Stil – Gelb und Pink, freundliche Roboter-Maskottchen, handgezeichnete Pfeile. Der Stil ist deutlich weicher als die News-Thumbnail-Ästhetik und richtet sich an Menschen, die den Begriff „generative KI“ noch nicht kennen. [7]
  • Echte technische Diagramme sind selten: Nur ein Pin zeigte eine tatsächliche Modellarchitektur mit Text-Embedding, Diffusion und Upscaling-Stufen. Selbst dieses war eher als Hochglanz-Magazingrafik gestaltet denn als Forschungsillustration. [34]
Auffällige Pins
  1. #48 – „Amuse 3.0“, ein Tool für KI-Kunst (Pin) — Ein von AMD gebrandeter, lokal laufender Bildgenerator, dargestellt durch ein hyperrealistisches Porträt. Das einzige eindeutig lokale bzw. Open-Source-nahe Tool in der Stichprobe, gegenüber einer Flut geschlossener SaaS-Listen.
  2. #27 – Google kündigt die Video-KI „Veo 3“ an (Pin) — Zeigt ein Eingabebild eines Plüschmonsters und drei generierte Videos in unterschiedlichen Szenen. Der eigentliche Verkaufspunkt ist Veo 3s Konsistenz bei Bild-zu-Video.
  3. #46 – ByteDance und Hollywood schließen weltweite Vereinbarung zum KI-Urheberrecht (Pin) — Eine Cointelegraph-artige Nachrichtenkarte über eine ByteDance-MPA-Vereinbarung zu geistigem Eigentum für dessen Bild- und Videotools, illustriert mit einem Pixar-artig generierten Jungen.
  4. #10 – „4 Major AI Updates“ (Pin) — Nennt GPT-6 Astra, ein agentischeres Gemini, generative Medien in Adobe Premiere und Cognitions Series E über 2 Milliarden US-Dollar bei 48 Milliarden US-Dollar Bewertung in einer Infografik.
  5. #49 – „Today's AI News, May 20 2026“ (Pin) — Rückblick auf Google I/O mit Gemini 3.5 Flash, Gemini Omni, Gemini Spark und einem Vorstoß zu KI-Smartglasses.
  6. #3 – Hollywood Reporter interviewt die erste KI-Schauspielerin (Pin) — TV-Einblendung zu „Tilly Norwood“, einer KI-generierten Schauspielerin; das Bild selbst trägt den Stempel „AI-GENERATED IMAGE“.
  7. #41 – „Mehr als 20 % von YouTube sind inzwischen KI-generiert“ (Pin) — Ein reiner Statistik-Headline-Pin ohne belegendes Diagramm, der die Zahl als Fakt darstellt.
  8. #29 – „10 Best Free AI Video Generators for YouTube 2026“ (Pin) — Die umfangreichste Tool-Übersicht der Stichprobe: Google Veo, Runway, Pika, invideo AI, CapCut, Synthesia und HeyGen, sämtlich als kostenlos und YouTube-tauglich positioniert.
  9. #34 – „OpenAI's Secret Image Generation Tool to Debut Soon“ (Pin) — Schlagzeile über ein unveröffentlichtes Closed-Source-Tool, illustriert mit einem echten, wenn auch magazinartig aufbereiteten Diagramm einer Diffusions-Pipeline statt eines Produktbildes.
  10. #32 – Meme-Vergleich „AI GENERATED“ gegen „ORIGINAL CLIP“ (Pin) — Eine Geste bzw. ein Gesicht wird von KI neben dem realen Quellclip nachgebildet; Teil des fortlaufenden Authentizitätserkennungs-Genres der Plattform.
Signale
  • Aktuell: Google Veo 2 und 3 ist das am häufigsten wiederholte Videomodell auf dem Board, öfter als jedes andere benannte Tool. „KI geht über Chat hinaus in echte Arbeit“ ist in mehreren Pins ein explizites Framing – etwa generative Timelines in Adobe Premiere, Cognitions Devin-Finanzierung oder Gemini als Agent in Gmail, Drive und Docs. Vereinbarungen zu geistigem Eigentum und Urheberrecht wie ByteDance × MPA sind inzwischen Mainstream-News statt reiner Nischenrechtsgeschichte. Das Format „KI erkennen“ bzw. Authentizität kennzeichnen ist ein eigenes Genre und deutet auf reale Sorgen über gefälschte Bilder und Schauspieler wie Tilly Norwood hin. Wiederverwendete generische Thumbnails, etwa dieselbe Gesichts- und Logo-Vorlage unter unterschiedlichen Überschriften, sprechen dafür, dass viele dieser „News“-Inhalte eher Low-Effort-Content-Mill-Produkte als Originalberichterstattung sind.
  • Nicht vorhanden: Open-Source-Modellkultur ist nahezu unsichtbar. Es fanden sich keine Screenshots zu Stable Diffusion, Flux, ComfyUI, LoRA oder GitHub-Repositories. Amuse 3.0 (#48) war das einzige lokale bzw. Open-Source-nahe Tool und wurde als polierte Consumer-App statt als Open-Source-Projekt präsentiert. Nicht englischsprachige Pins erschienen nicht. Kein Stichprobeninhalt wurde als Video wiedergegeben; alles waren statische Thumbnails. Die tatsächliche Ausgabequalität lässt sich daher nicht bewerten, nur die jeweiligen Behauptungen.
Grenzen
  • Gemäß Playbook wurde Pinterest nicht direkt durchsucht. Diese Zusammenfassung basiert vollständig auf der vom Worker vorab gesammelten Tabelle output/pinterest.pins.md sowie images/pinterest/manifest.json und den Bildern. Alle stammen aus einer einzigen unbenannten Anfrage („Image and Video Generation AI News“) statt einer Aufschlüsselung nach Genre. Das Feld genre ist im Manifest für jeden Pin leer, daher war kein Vergleich nach Genre möglich.
  • 30 von 50 Pins wurden geöffnet. Die übrigen 20 wurden übersprungen, weil ihre Titel bereits abgedeckte Formate wiederholen: generische Stockfoto-Listen zu KI-Content-Erstellung und wiederholte Tool-Übersichten. Es handelt sich um eine Stichprobe, nicht um vollständige Abdeckung.
  • Einige Pin-Titel sind in der Quelltabelle leer („(untitled)“). In diesen Fällen beruht die Beschreibung auf Text, der im Bild selbst sichtbar ist.
  • Bei einigen Pins passt der Bildinhalt nicht wörtlich zum Titel, etwa bei #47: Das Bild ist eine allgemeine „AI NEWS“-Karte und nichts Spezifisches zu Grok 5. Das unterstützt zwar die Feststellung wiederverwendeter generischer Thumbnails, bedeutet aber auch, dass Titel nur als Richtungshinweis und nicht als bestätigte Berichterstattung gelesen werden sollten.
  • Kein Pin zeigte ein sichtbares Veröffentlichungsdatum. Die Aktualität der „News“-Behauptungen, etwa die 20-%-KI-generiert-Statistik zu YouTube, konnte aus dem Bild allein nicht verifiziert werden.

Empfohlene Maßnahmen

  • Die X-Phase mit themennahen Suchbegriffen wie 'Sora 2' 'Midjourney' 'Stable Diffusion' 'Runway Gen' 'Kling AI' und 'open source image generation' erneut erheben.
  • Die Veröffentlichungsfrequenz chinesischer Open-Source-Anbieter wie MiniMax-H3, Qwen, Wan und Z-Image fortlaufend beobachten.
  • Nicht nur KI-Spezialcommunities, sondern auch allgemeine und berufliche Communities verfolgen, um die Ausbreitung des Backlash gegen KI-Inhalte zu beobachten.
  • Alternative Zugriffsmöglichkeiten für das 403-Problem der offiziellen Bluesky-Such-API prüfen.
  • Folgeberichte zum „Production-Memory“-Problem von Sora 2 und zu Midjourneys Wechsel in den medizinischen Spa-Bereich beim nächsten Durchlauf verfolgen.
  • Die Pinterest-Erhebung mit Genre-Tags versehen, damit Open und Closed Source automatisiert sortiert werden können.

Gesammelte Bilder

🎨 Erstellung von KI-Bildern und -VideosEinfach perfekt 🎥Hollywood Reporter interviewt die erste KI-Schauspielerin...Konzept zur KI-Content-Erstellung mit Symbolen für Text-, Bild-, Musik- und Videogenerierung – 66 Stockfotos, Vektoren und Videos ansehenSorgen zu KI-Inhalten und sozialen MedienKI-News: Anthropic-Leak zeigt uns die Zukunft der KI...🤯 GENERATIVE KI ERKLÄRT! 🤖✨ Wie KI Text, Bilder, Videos und mehr erstellt!BildGoogle stellt Veo 2 vor: fortschrittliches KI-Videogenerierungstool mit mehr Realismus und filmischen Funktionen4 wichtige KI-Updates, die du 2026 kennen musstGoogle kündigt ultrahochwertiges Video an...KI-generierte Videos für Content-MarketingVeo 3 Bild-zu-Video: schnelle Generierung und natives Audio über die Gemini-APIKI-News: OpenAI hat endlich veröffentlicht, worum wir gebeten habenKI für Bild- und VideogenerierungKonzept zur KI-Content-Erstellung mit Symbolen für Text-, Bild-, Musik- und Videogenerierung – 57 Stockfotos, Vektoren und Videos ansehenWas ist Imagvio AI und wie hilft es Kreativen...BildBild7 beste KI-Baby-Generatoren: So lässt sich das Gesicht deines Kindes vorhersagen (2026)BildSoftware für KI-VideoerstellungErstelle fotorealistische KI-Fotoshootings von dir selbst mit ChatGPT + Higgsfield 📸🤖KI-generierte Videos: Gut oder schlecht? Hier ist die Wahrheit! 🤖🎥Die Geheimwaffe für Content Creators: KI-gestützte VideogenerierungTop-KI-Videogeneratoren von 2025Google kündigt Video-KI „Veo 3“ an,...KI-Tools für Videobearbeitung – was Kreative 2026 tatsächlich nutzen, um Inhalte zu erstellenBildVerwandle deine Ideen in atemberaubende Visuals! 🎥Kannst du die Fälschung erkennen? KI-Video gegen echte Welt – Challenge!BildBildOpenAIs geheimes Bildgenerierungstool soll bald erscheinenProfessionelle KI-Videoerstellung | filmische KI-Videos | individuelle VideobearbeitungKI-gestützte Bild- und Videoanalyse‎🚨 KI wird erschreckend gut.KI-BildgenerierungKI-generiertes realistisches Porträtvideo | gemütliche Innenraumszene, keine Kamera„Verwandle deine Vision mit personalisierten KI-gestützten 4K-Videos 🎥✨“Mehr als 20 % von YouTube sind inzwischen KI-generiertDiese Woche in den KI-News – 15. Aug. 2026GPT 5.2, Videoeditor in Echtzeit, KI-Stereovideos, mobile KI-Agenten, vollständige Körpersteuerung: KI-NEWSAls KI Menschen ihre eigenen Erinnerungen neu erleben ließViraler KI-Effekt mit winzigen Menschen – so erstellst du ihn!BildGrok 5: Elon Musks KI-Revolution – eine überraschende...„Amuse 3.0“, ein Tool für KI-Kunst, das ... enthältBildKI

Hinweis zur Datenqualität

Bei X waren die Suchbegriffe themenfremd, sodass von 40 Einträgen kein einziger nutzbar war. Reddit mit zwölf Einträgen und Bluesky mit rund zwölf Beiträgen über persönliche Accounts wegen blockierter Such-API erreichten ebenfalls nicht das Ziel von rund 20. Pinterest beruht auf vorab gesammelten Daten ohne Genre-Tags; bei YouTube waren Aufruf- und Abonnentenzahlen nicht verfügbar.

Galerie