Neuigkeiten zu KI-Bild- und Videogenerierung — 2026-09-11
Die Closed-Source-Seite wird von einem Duell der beiden Bild-KI-Schwergewichte GPT Image 2 und Nano Banana Pro sowie direkten Vergleichen von Runway/Kling/Veo/Seedance bei Videos geprägt. Im Open-Source-Bereich gewinnen die ComfyUI-Ökosysteme rund um Wan 3.0, Z-Image Turbo, FLUX.2 und MiniMax-H3 mit Fokus auf Leichtgewichtigkeit und Geschwindigkeit rasant an Dynamik.
Neuigkeiten zu KI-Bild- und Videogenerierung — 2026-09-11
Krass, die Welt der Bild- und Video-KI ist gerade richtig heiß🔥🔥 Auf der Closed-Source-Seite liefern sich Google und OpenAI mit Nano Banana Pro und GPT Image 2 einen echten Schlagabtausch; bei Videos werden Runway Gen-4.5, Kling 3.0, Veo 3.1 und Seedance 2.5 ständig direkt miteinander verglichen📹✨. Auch die Open-Source-Seite ist mit Alibabas Wan 3.0 und Z-Image Turbo, Black Forest Labs’ FLUX.2 und Tencents HunyuanImage 3.0 extrem aktiv. Besonders im ComfyUI-Umfeld tauchen mit jedem neuen Modell sofort LoRAs und beschleunigte Varianten auf🛠️⚡. Nur bei X ging das Thema diesmal komplett vorbei – vermutlich waren die Suchbegriffe daneben –, was eine echte Lücke hinterlässt😅. Insgesamt war es eine Ausgabe mit zwei klaren Achsen: „Closed Source = Integrations- und Vergleichsfestival“, „Open Source = leichte, ultraschnelle Modelle und ein lebendiges Ökosystem“!
Plattformübergreifende Zusammenfassung
- Das Dreikampfszenario Seedance 2.5 (Closed Source/ByteDance) × Wan 3.0 (Open Source/Alibaba) × MiniMax H3 ist derzeit die spannendste Konstellation. Auf YouTube erschien ein groß angelegter Vergleich mit 75 Prompts (Seedance 2.5 vs 2.0 vs MiniMax H3 vs FLUX 3 vs Wan 3.0), während aetherwavestudio auf Bluesky eine Preis-Meldung veröffentlichte: „Wan 3.0 is live! 480p/1080p für 14 Credits/Sekunde“ (Beitrag). Auch auf Reddit wurden vergleichbare Tools in Fragen zur Modellwahl genannt.
- Das Closed-Source-Duell GPT Image 2 (OpenAI) vs. Nano Banana Pro (Google) war gleichzeitig auf mehreren Plattformen Thema: von einer einzelnen YouTube-Review (GPT Image 2 Finally Fixed AI Image Generation) über ein direktes Vergleichsvideo (GPT Image 2 vs Nano Banana Pro) und die praktische Tool-Auswahl eines Produktionsaccounts auf Bluesky (picatrix-picori) bis zu einer Reddit-Frage nach dem Wechsel zu GPT Image 2, weil Gemini Generierungen ablehnt.
- Misstrauen gegenüber Versprechen wie „kostenlos, unbegrenzt, ohne Wasserzeichen“ ist ein wiederkehrendes Thema: unabhängig voneinander auf Reddit (r/generativeAI: „Unlimited is a lie“ Thread) und Bluesky (zsky.ai testet und bewertet entsprechende Tools Link).
- Konkrete Schäden durch KI-Inhalte und Moderationsversagen sind ebenfalls plattformübergreifende Sorgen. Reddit verweist auf eine Enthüllung über KI, die direkt ein Grafiktablett bedient und gefälschte Zeitraffer erstellt (Thread), sowie auf einen Artikel zu nicht entfernten KI-Videos über Kindesmissbrauch auf Facebook (Thread). Lemmy verweist auf einen Wired-Bericht zu Meta-Anzeigen mit CSAM (Artikel). Auf Bluesky erhielt ein Beitrag mit der Forderung nach KI-Erkennung mittels SynthID mit 213 Likes besonders viel Aufmerksamkeit (Beitrag).
Zusammenfassung nach Plattform
Reddit: Praktische Fragen zu Tools in r/generativeAI und r/aivideomaking stehen scharf neben Ablehnung und Enthüllungen in r/antiai. Die mit Abstand größte Resonanz bekam diesmal ein r/antiai-Thread, der davor warnt, dass KI echte Zeitraffer fälschen kann (7.137 Punkte, 1.024 Kommentare). Die Wachsamkeit gegenüber KI, die „wie echt wirkt“, nimmt stark zu📈.
X: Voll daneben😇. Alle 40 Beiträge wurden geprüft, aber kein einziger bezog sich auf KI-Bild- oder Videogenerierung. Die verwendeten Suchbegriffe – etwa Charlie Kirk, Apple und MAGA – passten nicht zum Thema und übernahmen offenbar nur die X-Trends. Da dies auf einer ausdrücklich geforderten Plattform eine echte Lücke ist, sollte beim nächsten Mal gezielt nach Modellnamen wie Midjourney, Sora oder Kling gesucht werden.
YouTube: Hier gab es die größte Informationsdichte🎬. Von der offiziellen Ankündigung von Runway Gen-4.5 über direkte Vergleiche von Kling 3.0/Grok Imagine/Runway/Veo und Adobes Bündelung mehrerer Closed-Source-Modelle in Firefly bis zu Reviews von Z-Image Turbo, FLUX.2 und HunyuanImage 3.0 auf der Open-Source-Seite war das Spektrum breit. Wegen JavaScript-Rendering konnten allerdings keine Aufruf- und Abonnentenzahlen erhoben werden.
Bluesky: Die offizielle Such-API lieferte 403, aber über Feed-Generatoren ließen sich Preiswettbewerb und praktische Produktions-Workflows von Video-KI-Accounts wie ZSky, aetherwavestudio und picatrix-picori erfassen. Während die Plattform insgesamt viele kunstbezogene Feeds mit einer „keine KI“-Haltung aufweist, ist das japanischsprachige #AIイラスト-Tag-Ökosystem eigenständig und aktiv🎨.
Lemmy: Klein, aber gehaltvoll. !«メールアドレス» wird rund um MiniMax-H3 und Krea2 Turbo zur Art „Eilmeldungsfeed“ für ComfyUI-Nodes und LoRAs und zeigt die Bewegungen des Open-Source-Ökosystems besonders konkret. Closed-Source-Themen drehen sich dagegen vor allem um Urheberrecht und Moderation, etwa Googles nach Problemen schnell eingestellte Earth-AI-Funktion mit Nano Banana.
Pinterest: 30 von 50 Ergebnissen wurden detailliert geprüft. Auffällig sind offizielle Google-Promos für Veo 2/3 und Gemini-API-Anbindungen sowie konkrete Zahlen aus dem Closed-Source-Bereich, etwa eine Milliarde Gemini-Nutzer und 150 Millionen Bildgenerierungen täglich. Open Source ist dagegen mit nur einer Erwähnung von Stable Video Diffusion stark unterrepräsentiert. Viele Bilder dienen SEO- oder Affiliate-Zwecken und wirken eher wie Übersichten und Anleitungen als wie aktuelle Meldungen.
Besonders wichtige Punkte
- Preiswettbewerb rund um die Wan-3.0-Serie — Bluesky, Beitrag von aetherwavestudio. 3.0, 3.0 Pro und 2.7 Spicy wurden gleichzeitig gestartet, inklusive klar ausgewiesener Credit-Preise. Die Preisentwicklung im Open-Weights-Lager ist beobachtenswert.
- Dreikampf Seedance 2.5 vs. Wan 3.0 vs. MiniMax H3 — YouTube, 75 AI Video Tests. Die zentrale Konstellation im aktuellen Trend der Videogenerierung.
- GPT Image 2 vs. Nano Banana Pro — YouTube, direktes Vergleichsvideo. Wohin sich das Duell der beiden führenden Closed-Source-Bildgeneratoren entwickelt.
- Ausbreitung der „Fake-Timelapse“-Enthüllung aus r/antiai — Reddit, Thread. Entscheidend ist, wie weit sich der Widerstand gegen Methoden zur Vortäuschung von Authentizität ausbreitet.
- Streit um die Abschaltung von Googles Nano-Banana-Earth-AI — Lemmy, Fortune-Artikel. Zu beobachten ist, wie sich die Moderationspraxis großer Closed-Source-Anbieter verändert.
- Wachsende Unterstützung für die KI-Erkennungstechnologie SynthID — Bluesky, Beitrag von aimod.social. Offen ist, ob der Wunsch, KI-Inhalte erkennen zu können, zu neuen Produktfunktionen führt.
Empfohlene Maßnahmen
- Die nächste X-Erhebung mit Modellnamen wie Midjourney, Sora und Kling erneut durchführen, um den Ausfall dieser Runde zu kompensieren.
- Den Dreikampf zwischen Wan 3.0, Seedance 2.5 und MiniMax H3 weiter beobachten und das Kräfteverhältnis monatlich aktualisieren.
- Nachrichten über Moderationsversagen bei großen Closed-Source-Anbietern – Google, Meta und OpenAI – sowohl auf Lemmy als auch auf Reddit kontinuierlich verfolgen.
- Lemmys ComfyUI-/LoRA-Eilmeldungen weiter als Primärquelle für Open-Source-Entwicklungen beobachten.
- Solange Blueskys offizielle Such-API weiterhin 403 liefert, den Erhebungsprozess über Feed-Generatoren beibehalten.
- Pinterest wegen seiner geringen Eignung für Eilmeldungen nachrangig behandeln: YouTube, Lemmy und Reddit für Trendbeobachtung priorisieren und Pinterest als ergänzendes Material für visuelle Trends nutzen.
Zur Datenqualität
Bei X gab es keine thematisch passenden Beiträge; durch die falsche Auswahl der Suchbegriffe war die Erhebung faktisch gescheitert. Reddit blieb mit 11 Threads deutlich unter dem Ziel von rund 20. Die offizielle Bluesky-Such-API war vollständig durch 403 blockiert, weshalb auf Erhebung über Feed-Generatoren ausgewichen wurde. Bei YouTube verhinderten JavaScript-Rendering-Beschränkungen die Erfassung quantitativer Daten wie Aufrufe und Abonnenten. Auf Lemmy lag die praktische Obergrenze bei etwa 10 bis 15 direkt themenbezogenen Beiträgen. Pinterest bestand vor allem aus SEO- und Affiliate-Übersichtsbildern und enthielt fast keine Open-Source-Erwähnungen.
Zusammenfassung nach Plattform
Reddit — Neuigkeiten zu KI-Bild- und Videogenerierung
Wo
Es wurde nach „Image and Video Generation AI News“ gesucht; aus sieben Subreddits wurden insgesamt 11 Threads gesammelt.
| Subreddit | Mitglieder | Anzahl gesammelter Threads |
|---|---|---|
| r/generativeAI | 152,155 | 3 |
| r/antiai | 321,679 | 2 |
| r/aivideomaking | 6,743 | 2 |
| r/AItips101 | 1,269 | 1 |
| r/GetNoted | 298,268 | 1 |
| r/clevercomebacks | 2,805,289 | 1 |
| r/TrueReddit | 628,575 | 1 |
Praktische Fragen zu generativen KI-Tools konzentrieren sich vor allem auf r/generativeAI und r/aivideomaking. Widerstand gegen und Enthüllungen zu KI-Inhalten finden sich in r/antiai. Fälle, in denen KI-Bilder als virale Memes verbreitet wurden, erscheinen in r/GetNoted und r/clevercomebacks; vertiefende gesellschaftliche Artikel in r/TrueReddit.
Was die Leute sagen
-
Thread #1 (r/AItips101, 132 Punkte, 70 Beiträge, 2026-09-07): In „The best uncensored AI image generators in 2026“ wird WildOwl.ai als führender, vergleichsweise wenig zensierter Dienst empfohlen, der mehr als 35 Modelle unterstützt, darunter Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo und GPT Image. u/reliablemicrophone84 (4 Punkte) stimmt in den Kommentaren zu: „Ive wasted so many credits elsewhere on frustrating filters“. Andere empfehlen Konkurrenztools wie Mage.space, Perchance und die Venice API. https://www.reddit.com/r/AItips101/comments/1w9yftp/
-
Thread #2 (r/antiai, 7.137 Punkte, 1.024 Beiträge, 2026-09-05): „Warning: There is a new form of ai generated image“. Laut Enthüllung können LLMs – als GPT-6 bezeichnet – Maus und Tastatur nutzen, direkt in einer Zeichensoftware arbeiten und dadurch „echte Zeitraffer“ fälschen. Der Top-Kommentar von u/Nayutantantan (2.510 Punkte) äußert deutliche Ablehnung: „I hate this. So. So. MUCH ... the trends of creating fake timelapses are getting common“. https://www.reddit.com/r/antiai/comments/1w81kdd/
-
Thread #11 (r/antiai, 7 Punkte, 6 Beiträge, 2026-09-08): In einem Ankündigungsvideo zu GPT Image 2.5 wurde eine Frau thematisiert, die einen von KI erzeugten Tattoo-Entwurf direkt auf ihren echten Arm tätowieren ließ. u/Realistic-Buy4975 (5 Punkte) berichtet von konkretem Schaden: „An expensive tattoo artist in my city ... tried to give my girlfriend an AI generated tattoo, I hate this timeline“. https://www.reddit.com/r/antiai/comments/1waxzvf/
-
Thread #3 (r/generativeAI, 1 Punkt, 10 Beiträge, 2026-09-07): Auf die Frage „Cheapest UNLIMITED 1080p Image-to-Video AI Generator?“ konzentrierten sich die Antworten auf Misstrauen gegenüber der Bezeichnung „unlimited“. u/ai_art_is_art (3 Punkte): „Unlimited is a lie. You put $550 in, you get $200 out and you have to wait 24 hours between generations“. Artlist.io (€550/Jahr) und die teuren Runway-Pläne wurden zum Vergleich herangezogen. https://www.reddit.com/r/generativeAI/comments/1wa4k88/
-
Thread #4 (r/aivideomaking, 15 Punkte, 36 Beiträge, 2026-09-07): Auf die Bitte nach einem kostenlosen KI-Videogenerator für 45 Sekunden antwortet u/NewLifeWares (2 Punkte): „45 seconds is reaching data center level requirements of hardware. At best you might find a free 5 second generator ... with a watermark“. Die gemeinsame Einschätzung: kostenlose längere Videogenerierung ist unrealistisch. https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/
-
Thread #5 (r/aivideomaking, 3 Punkte, 17 Beiträge, 2026-09-09): Bei der Frage nach Tools für realistische Bilder und Videos wurden zahlreiche konkrete Namen genannt: OpenArt AI, fal, dzine, pixverse, Higgsfield, RunningHub – das über ComfyUI sowohl offene als auch geschlossene Modelle nutzbar macht – sowie cyberbara, für das gilt: „Seedance 2.5 on it is uncensored and supports real face“. https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/
-
Thread #7 (r/GetNoted, 1.339 Punkte, 160 Beiträge, 2026-09-10): Ein KI-generierter Bildbeitrag auf X ging viral, weil ihm vorgeworfen wurde, gezielt Empörung zu erzeugen. Der Text im Bild war zerstört; u/NegativeMammoth2137 (51 Punkte) verspottet die Fehler: „Today's schedule 9:00 - Room 9:00 - Handloags 10:00 - 5 pm“. Gerade die leichte Entlarvbarkeit von KI-Bildern wird zur Pointe. https://www.reddit.com/r/GetNoted/comments/1wcw3n9/
-
Thread #9 (r/clevercomebacks, 5.664 Punkte, 269 Beiträge, 2026-09-09): Zu einem politischen Meme-Bild mit der Aussage „this AI generated image shows exactly how life really is!!!“ verlagerte sich die Kommentardiskussion von KI auf politische Auseinandersetzungen über Einwanderung und Sozialhilfe. Ein Beispiel dafür, wie KI-Bilder als Propagandamaterial verwendet werden. https://www.reddit.com/r/clevercomebacks/comments/1wbri5x/
-
Thread #10 (r/TrueReddit, 1.188 Punkte, 51 Beiträge, 2026-09-09): Artikel: „Facebook Is Hosting Huge Numbers of Horrifying AI-Generated Videos of Violent Child Abuse, and Meta Is Barely Even Pretending to Care“. u/mirh (24 Punkte) weist unter Bezug auf eine offizielle Erklärung darauf hin, dass Meta offenbar bereits Systeme zur Erkennung dieser extrem verstörenden Videos einsetzt, sich jedoch dagegen entscheidet, sie zur Moderation zu verwenden. https://www.reddit.com/r/TrueReddit/comments/1wbnann/
-
Thread #6 (r/generativeAI, 2 Punkte, 3 Beiträge, 2026-09-08): Auf eine Frage nach Fan-Art mit Disney-Figuren, die Grok abgelehnt hatte, wurden PixelForge für iOS mit unbegrenzter Nutzung und dreamfort.ai/image als Alternativen vorgeschlagen. Der Bedarf an Umgehung von Einschränkungen bei urheberrechtlich geschützten Figuren bleibt bestehen. https://www.reddit.com/r/generativeAI/comments/1waapc1/
-
Thread #8 (r/generativeAI, 1 Punkt, 3 Beiträge, 2026-09-10): Auf die Frage nach Bildern für Tarotkarten, da Gemini die Generierung häufig verweigere, wurden GPT Image 2 und Google Flow als Alternativen genannt. https://www.reddit.com/r/generativeAI/comments/1wc347t/
Signale
- Steigender Trend: Die Sorge darüber, dass KI „wie echt wirkt“, wächst in r/antiai deutlich. Thread #2 mit 7.137 Punkten und 1.024 Beiträgen war mit Abstand die stärkste Reaktion der Sammlung. Besonders heraus sticht die Angst vor LLMs, die ein Grafiktablett direkt bedienen und gefälschte Zeitraffer herstellen. Auch der Tattoo-Fall in Thread #11 gehört zu derselben Sorge: KI-Erzeugnisse fließen unmittelbar in Entscheidungen der realen Welt ein.
- Zwei gegensätzliche Perspektiven: Beim Thema unzensierte und unbegrenzte generative KI werden in r/AItips101 Tools wie WildOwl.ai und cyberbara als „unrestricted“ positiv vorgestellt, während r/antiai vergleichbare Techniken – Imitation und Täuschung durch KI – scharf kritisiert. Der Unterschied in der Haltung zwischen Tool-orientierten und Anti-KI-Communities wird unmittelbar sichtbar.
- Bagatellisierte oder verworfene Behauptungen: Beiträge, die kostenlose, unbegrenzte und hochqualitative Videogenerierung verlangen (Threads #3 und #4), werden von der Community umgehend zurückgewiesen: „So etwas gibt es nicht“ und „unlimited ist eine Lüge“. Die Lücke zwischen Erwartungen und tatsächlicher Kostenstruktur ist ein Standardthema.
- Überraschend: Der inhaltlich gravierendste Fall – die TrueReddit-Enthüllung, dass Facebook KI-generierte Videos über Kindesmissbrauch duldet, Thread #10 – erzielte mit 1.188 Punkten nur 51 Kommentare. Damit blieb er deutlich hinter dem politischen Meme-Thread #9 mit 5.664 Punkten und 269 Beiträgen sowie Thread #7 über fehlerhaften KI-Bildtext mit 1.339 Punkten und 160 Beiträgen zurück. Memetische und unterhaltsame KI-Inhalte erzeugen offenbar mehr Engagement als schwere Sicherheitsprobleme.
Grenzen
- Die Erhebung nutzte ausschließlich den Suchbegriff „Image and Video Generation AI News“. Einzelne Modellnamen wie „Nano Banana“, „Sora“, „Flux“, „Wan“, „Kling“ oder „Seedream“ wurden nicht gesucht; Open Source und Closed Source wurden ebenfalls nicht separat abgefragt. Als streng getrennte Grundlage für die geforderten mindestens zehn Erkenntnisse je Kategorie ist das Material daher eher dünn.
- Insgesamt wurden nur 11 Threads gesammelt und damit das Ziel von rund 20 analysierten Beiträgen pro Plattform nicht erreicht.
- Pro Thread wurden nur die sechs obersten Kommentare erhoben; spätere Kommentare sowie Widerspruch oder Korrekturen innerhalb der Diskussionen wurden nicht geprüft.
- Reddit wurde nur vorab über einen Headless-Browser erhoben. Dieses Agentensystem selbst führte aufgrund der Vorgaben des Playbooks keine WebFetch- oder zusätzlichen Suchabfragen durch. Weitere Suchen oder Zugriffe auf nicht gesammelte Threads waren nicht möglich.
X
X — Null Themenbezug zu KI-Bild- und Videogenerierung; gesammelt wurden nur irrelevante Trends
Alle 40 in output/x.posts.md gesammelten Beiträge wurden geprüft. Keiner erwähnte Bild- oder Videogenerierungs-KI, weder Closed Source noch Open Source. Die Suchbegriffe lauteten „Charlie Kirk“, „Apple“, „MAGA“, „Palestinian“, „iPhone“, „Britain“, „Anthropic“, „#CyberSecurity“, „harvey as the ai os“ und „The OS“. Sie zielen nicht auf das Briefing-Thema, sondern scheinen unverändert von der Explore-Trendseite von X übernommen worden zu sein. Details stehen unter ## Limits.
Accounts
Alle 40 gesammelten Accounts tauchen jeweils nur mit einem Beitrag auf; spezialisierte KI-Accounts zum Thema waren nicht darunter. Nach Engagement waren besonders auffällig:
- @esjesjesj (evan loves worf) — 63.289 Likes. Politischer Beitrag zu einer Meme-Kontroverse rund um Charlie Kirk.
- @TheAnglo_ (Anglo) — 60.624 Likes. Politischer Provokationsbeitrag über Großbritannien und Israel.
- @anickytwts (Anicky) — 48.010 Likes. Reaktion während des Apple Events.
- @allaboutthem3ts (sofia (she/her)) — 32.919 Likes. Witz über die Ermordung von Charlie Kirk.
- @luquinha (luquinhas) — 20.828 Likes. Beitrag ausschließlich mit dem Tag #AppleEvent.
- @MurdoinkGS (Green Screen Videos by Murdoink) — 21.480 Likes, etwa 11 Millionen Views. Greenscreen-Video zu iPhone Duo, also ein Gerätethema ohne Bezug zu generativer KI.
Nur sehr wenige Beiträge hatten überhaupt KI-Bezug:
- @restitutorII — verweist auf einen Bericht von Anthropic zu wirtschaftlichen Auswirkungen, allerdings zu Text-LLMs und nicht zu Bild- oder Videogenerierung.
- @bcherny (Boris Cherny, Anthropic) — kurzer Beitrag unbekannten Inhalts: „It's the little things“.
- @krisfredrickson und weitere Accounts (#33–36) — Meldungen über die 550-Millionen-Dollar-Finanzierung des Legal-AI-Start-ups Harvey.
- @Iziedking, @SYNEX98_36 — Handel mit Agent-OS/MCP von Binance.
Alle genannten Beiträge sind zwar KI-bezogen, berühren aber weder Bild- noch Videogenerierungsmodelle wie Midjourney, Stable Diffusion, Sora, Runway, Kling oder Flux.
Beiträge
Da es keine Beiträge gab, die dem Briefing-Thema entsprechen, lassen sich keine repräsentativen Beiträge nennen. Als Referenz folgen die KI-bezogenen Beiträge:
- Vorstellung eines Anthropic-Wirtschaftsberichts — @restitutorII, 434 Likes, 68 Reposts, 39 Antworten, etwa 50.000 Views, 2026-09-10. „Anthropic in its report imagines 3 possible futures for the American economy in 2030...“ — Prognosen zu den Effekten von LLMs auf Beschäftigung und BIP, ohne Bezug zu Bild- oder Videogenerierung.
- Harvey, eine Legal AI, sammelt 550 Millionen US-Dollar ein — @krisfredrickson sowie drei weitere Beiträge (#34, #35, #36), maximal 10.474 Likes und etwa 252.000 Views, 2026-09-09 bis 10. Finanzierungsmeldungen zu KI für juristische Arbeit, nicht zu Bild- oder Videogenerierungsmodellen.
- Automatisierter Handel mit Agent OS/MCP — @SYNEX98_36, 80 Likes, 71 Antworten, etwa 2.700 Views, 2026-09-09. „What happens when you give an AI agent access to Binance?“ — Erfahrungsbericht zu Agenten-KI, nicht zu generativer Bild- oder Video-KI.
Diese drei Fälle können nicht als Neuigkeiten zur KI-Bild- und Videogenerierung verwendet und weder als Closed-Source- noch als Open-Source-Erkenntnisse gezählt werden.
Signale
- In diesem Datensatz von 40 Beiträgen findet sich keinerlei Erwähnung von Bild- oder Videogenerierungs-KI wie Midjourney, Stable Diffusion, Sora, Runway, Kling, Flux, ComfyUI oder Nano Banana.
- Was auf X tatsächlich Aufmerksamkeit erhielt, waren politische Debatten über den ersten Jahrestag der Ermordung von Charlie Kirk, Reaktionen auf Apples neue Produkte – darunter das faltbare iPhone Duo –, diplomatische Spannungen zwischen Großbritannien und Israel, Kritik an MAGA-Politik und Beiträge zu Palästina.
- KI wurde nur in drei Zusammenhängen erwähnt: Anthropics Bericht über wirtschaftliche Effekte, die große Finanzierung von Harvey als Legal AI und Agent-OS für den Handel. Alle gehören zu Text- oder Agenten-KI und stehen nicht im Kontext der Bild- und Videogenerierung.
- Folglich liefert die X-Erhebung dieser Runde weder zur Closed-Source- noch zur Open-Source-Entwicklung auch nur eine Erkenntnis.
Grenzen
- Die Suchbegriffe passen nicht zum Thema: „Charlie Kirk“, „Apple“, „MAGA“, „Palestinian“, „iPhone“, „Britain“, „Anthropic“, „#CyberSecurity“, „harvey as the ai os“ und „The OS“ zielen nicht auf KI-Bild- und Videogenerierung. Offenbar wurden stattdessen Begriffe von X Explore verwendet. Daher konnte die Erhebung die im Briefing verlangten aktuellen Meldungen zu Closed- und Open-Source-Modellen der Bild- und Videogenerierung nicht erreichen.
- Regionale Abhängigkeit von Explore: Acht der zehn Trends waren nur mit „Politics · Trending“ oder „Technology · Trending“ versehen. Bei den zwei übrigen – #CyberSecurity, harvey as the ai os und The OS – stand „Trending in Croatia“. Da Explore die Region der Serversitzung berücksichtigt, handelt es sich nicht zwingend um globale Trends, sondern um Trends einer bestimmten Region – Kroatien oder des Verbindungsorts.
- Die Abschlusskriterien des Briefings werden nicht erfüllt: Das Briefing verlangt die Analyse von etwa 20 Beiträgen pro sozialem Netzwerk. Obwohl alle 40 Beiträge analysiert wurden, waren null davon thematisch passend. Daher kann die X-Stufe nicht jeweils mindestens zehn Erkenntnisse zu Closed Source und Open Source liefern. Die Lücke muss durch andere Plattformen – Reddit, YouTube, Bluesky, Lemmy und Pinterest – oder eine erneute X-Erhebung mit passenden Suchbegriffen wie „Midjourney“, „Stable Diffusion“, „Sora“, „Runway“, „Kling“, „Flux“, „ComfyUI“ und „Nano Banana“ geschlossen werden.
- Die Sitzung selbst war gültig und die Beiträge wurden normal erhoben; es gab keine Hinweise auf Session-Ablauf oder Fehler. Ausschlaggebend war allein die Wahl der Suchbegriffe.
YouTube
YouTube — Neuigkeiten zu KI-Bild- und Videogenerierung (Closed Source/Open Source)
Kanäle
In den YouTube-Suchergebnissen ließ sich nicht immer der Name des uploadenden Kanals erfassen; soweit überprüfbar, fielen jedoch folgende auf:
- RunwayML (offizieller Kanal) — offizieller Ankündigungskanal von Runway, unter anderem für die Vorstellung von Gen-4.5.
- Innovate Futures @ Benji — Creator-Kanal, der lokale KI-Bildmodelle wie Z-Image Turbo testet.
- Die übrigen Ergebnisse stammen überwiegend von individuellen Kanälen für Tool-Vergleiche und Reviews, etwa zu Kling/Veo/Grok/Seedance. In den Suchergebnissen war der Kanalname ohne Klick nicht immer sichtbar und konnte daher nicht eindeutig identifiziert werden.
Videos
-
Introducing Gen-4.5 | Runway
Offizieller Runway-Kanal / 2025-12-01 / https://www.youtube.com/watch?v=ei2PsDpPbB4
Offizielle Vorstellung von Runways neuem Flaggschiffmodell für Videogenerierung, Gen-4.5. Runway beansprucht Platz eins im Text-to-Video-Benchmark von Artificial Analysis mit Elo 1.247. -
Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison
2026-03-10 / https://www.youtube.com/watch?v=x5fMQvhKP60
Direkter Vergleich von vier führenden Closed-Source-Videomodellen. Kling 3.0 wird bei der Produktion großer Mengen aus Text als überlegen bewertet, Veo 3.1 bei filmischer Qualität und Runway Gen-4.5 bei kreativer Steuerbarkeit. -
I Tested Every AI Video Model in Adobe Firefly So You Don't Have To (July 2026)
Juli 2026 / https://www.youtube.com/watch?v=nOSYufWVdq8
Test von insgesamt 14 Modellen in Adobe Firefly, darunter Veo 3.1, Kling 3.0, Runway 4.5 und Sora 2. Das zeigt den Trend, Closed-Source-Modelle auf einer einzigen Plattform zu bündeln. -
GPT Image 2 Finally Fixed AI Image Generation
2026-04-27 / https://www.youtube.com/watch?v=VH9vxd3Uzzc
Review von OpenAIs GPT Image 2. Hervorgehoben werden präziseres Text-Rendering, dichtere Kompositionen und Unterstützung mehrsprachiger Schrift. -
OpenAI GPT Image 2 vs Gemini Nano Banana Pro
2026-04-22 / https://www.youtube.com/watch?v=RIWI82PZFNo
Direkter Vergleich von GPT Image 2 und Googles Nano Banana Pro, eingeordnet als Duell der beiden führenden Closed-Source-Bildgeneratoren. -
Best AI Video Generator for 2026 (Seedance 2.5 vs. WAN 3.0 vs. Minimax H3)
Etwa August 2026 („vor drei Wochen“) / https://www.youtube.com/watch?v=0EozcQ3HMHE
Vergleich von ByteDances Seedance 2.5 als Closed-Source-API, Alibabas Wan 3.0 aus dem offenen Umfeld und MiniMax H3. Eines der aktuellsten Vergleichsvideos. -
Seedance 2.5 vs 2.0 vs MiniMax H3 vs FLUX 3 vs Wan 3.0 | 75 AI Video Tests
Etwa August 2026 („vor drei Wochen“) / https://www.youtube.com/watch?v=RM2XAhLNlxc
Umfangreicher Test von fünf Modellen mit 75 Prompts. Er zeigt das Kräfteverhältnis im August 2026. -
Wan 3.0 Prime Review: Can It Beat Flux 3 and Seedance 2.5?
Etwa August bis September 2026 („vor zwei Wochen“) / https://www.youtube.com/watch?v=REZiNOWyen0
Review von Alibabas beschleunigter Version Wan 3.0 Prime. Die Generierung ist schneller, die Kosten liegen aber etwa 40 % höher – ein deutlicher Zielkonflikt zwischen Geschwindigkeit und Kosten. -
MiniMax H3 Max 動画生成性能テスト (2026.08.27)
2026-08-27 / https://www.youtube.com/watch?v=NT1gYHWQ_T0
Japanischer Leistungstest für MiniMax H3 Max anhand realistischer Prompts; geprüft werden Geschwindigkeit und Bildqualität. -
Z-Image Turbo Released - Fast Distilled Image Model - Slap On The Face Next Day
Innovate Futures @ Benji / 2025-11-27 / https://www.youtube.com/watch?v=3mT7KnotPqk
Direkter Vergleich des Open-Weights-Bildmodells Z-Image Turbo von Alibaba Tongyi Lab – sechs Milliarden Parameter, unter einer Sekunde Generierungszeit und Betrieb auf Consumer-GPUs – mit FLUX.2. -
HunyuanImage 3.0 — The Most Powerful Open-Source Image Generator Yet
2025-09-30 / https://www.youtube.com/watch?v=U-8RjjU7x14
Vorstellung von Tencents Open-Source-MoE-Bildmodell mit 80 Milliarden Parametern insgesamt und 13 Milliarden aktiven Parametern bei der Inferenz. Stärken sind das Verständnis langer Prompts und bildliche Ergänzungen auf Basis von Weltwissen. -
FLUX.2 Review: Is This The AI Generator That Puts Midjourney To Shame? (2026)
2025-12-01 / https://www.youtube.com/watch?v=szTub67xQ4Y
Review von Black Forest Labs’ Open-Weights-Modell FLUX.2. Im Vergleich zum geschlossenen Midjourney wird ein deutliches Aufholen der offenen Modelle bei der Bildqualität festgestellt.
Signale
- Im Closed-Source-Lager ist „Integration auf einer Plattform“ das Schlüsselwort: Adobe Firefly bündelt Veo, Kling, Runway und Sora. Damit nehmen plattformübergreifende Vergleichsreviews stärker zu als Werbung für Einzelmodelle (#3).
- August bis September 2026 ist der heiße Dreikampf der Videogenerierung: Seedance 2.5 von ByteDance als Closed-Source-API, Wan 3.0 von Alibaba aus dem offenen Umfeld und MiniMax H3 werden zunehmend zeitgleich verglichen. Diese drei Modelle bilden den Kern der aktuellen Aufmerksamkeit (#6, #7, #9).
- Open Source konkurriert über Leichtgewichtigkeit und Geschwindigkeit: Z-Image Turbo läuft mit kleineren sechs Milliarden Parametern auf Consumer-Hardware, während Wan 3.0 Prime eine kostenpflichtige Geschwindigkeit-Variante anbietet. Der Zielkonflikt „Geschwindigkeit vs. Qualität/Kosten“ ist das zentrale Wettbewerbsfeld (#8, #10).
- Bei der Bildgenerierung etabliert sich OpenAI GPT Image 2 gegen Google Nano Banana Pro/Gemini als Closed-Source-Duell. Das Muster „Ankündigung eines neuen Modells → sofortiges Vergleichsvideo“ hat sich gefestigt (#4, #5).
- Reviews chinesischer offener Modelle wie HunyuanImage 3.0 und Qwen-Image erscheinen kontinuierlich und betonen häufig besonders große Parameterzahlen im Bereich von 80 Milliarden (#11).
Grenzen
- Die YouTube-Suchergebnisse und individuellen Videoseiten werden mit JavaScript gerendert. Über WebFetch wurde nur die Footer-Navigation zurückgegeben; Aufrufzahlen, Abonnentenzahlen, ausführliche Beschreibungen und Top-Kommentare konnten daher nicht direkt bestätigt werden. Die genannten Daten und Kanalnamen beruhen auf Such-Snippets und Abgleichen mit externen Artikeln; Aufrufzahlen werden nicht berichtet.
- Es sollte auf Videos aus den 60 Tagen vor dem 11. September 2026, also ab Mitte Juli, eingeschränkt werden. Die Ergebnisse enthielten jedoch weiterhin viele Videos aus November 2025 bis April 2026. Von den 12 genannten Videos lassen sich nur #3, #6, #7, #8 und #9 mit hoher Sicherheit den jüngsten 60 Tagen zuordnen.
- Zu Seedream 5.0 Pro von ByteDance, veröffentlicht am 2026-07-08, ließen sich zahlreiche Blogartikel, aber keine eigenständige YouTube-Review finden. Das Modell wird nur in Vergleichsvideos wie #6 erwähnt.
Bluesky
Bluesky — Neuigkeiten zu KI-Bild- und Videogenerierung
Accounts
- @zsky.ai (Profil): Werbeaccount für den eigenen KI-Videogenerierungsdienst ZSky. Veröffentlicht laufend Vergleichsartikel zu kostenlosen, unbegrenzten und wasserzeichenfreien Tools sowie Benchmarks mit ChatGPT aus dem Bild-/Videobereich.
- @aetherwavestudio.bsky.social (Profil): Account für Wiederverkauf beziehungsweise Vermittlung von Credits für KI-Videos. Meldet neue Versionen und Preisänderungen verschiedener Modelle, darunter Wan, Grok Imagine und SUNO.
- @picatrix-picori.bsky.social (Profil): Indie-Creator, der Closed-Source-Tools wie Nano Banana 2, Omni 1.1 Flash, Hailuo und Nijijourney in der tatsächlichen Produktion von Anime-artigen Videos und Spiel-Assets kombiniert.
- @aimod.social (Profil): Inoffizieller Moderationsdienst auf Bluesky zur Erkennung und Kennzeichnung KI-generierter Bilder. Der Account wirbt für die Verbreitung von Erkennungstechnologien wie Googles SynthID und kehrte im Juli 2026 nach zehn Monaten Betriebspause zurück.
#AIイラスト-Community (zum Beispiel @sheenaaiart.bsky.social, @muranarkabs.bsky.social und @modean987.bsky.social): Ein eigenständiges Hashtag-Ökosystem japanischsprachiger KI-Illustratoren, die stündlich Dutzende Beiträge mit#AIイラストund#AIartposten. Genutzt werden Tools auf beiden Seiten, etwa Midjourney und SDXL-basierte Modelle wie „MiaoMiao Harem Base“.- @morisato.jp: Betreibt über Blueskys Feed-Generator-Funktion den Feed „AIart (worldwide)“, der KI-Kunstbeiträge über Schlüsselwörter wie StableDiffusion, Midjourney und DALLE sammelt.
Beiträge
- picatrix-picori.bsky.social (2026-09-10, 5 Likes): Beitrag mit „📷 Nano Banana 2 / 🎥Omni 1.1 Flash / 🎵Omni 1.1 Flash“ und den Hashtags
#anime #aivideo #solodev #gamedev. Ein konkretes Beispiel dafür, wie ein einzelner Creator aktuelle Closed-Source-Modelle für Bild, Video und Audio kombiniert. https://bsky.app/profile/picatrix-picori.bsky.social/post/3mv6x2oxe3k2b - picatrix-picori.bsky.social (2026-09-09, 10 Likes, 2 Reposts): Beitrag zur Leistung von MiniMax’ Videomodell Hailuo im Vergleich mit anderen KI-Videotools. Einer der Beiträge dieses Accounts mit vergleichsweise hoher Resonanz. https://bsky.app/profile/picatrix-picori.bsky.social/post/3mv3n3s7hzs2e
- aetherwavestudio.bsky.social (2026-09-10): „Wan 3.0 is live! 480p and 1080p from 14 credits/sec. Wan 3.0 Pro and Wan 2.7 Spicy landed too. Every bundle is 30% off through Sunday night. 500 credits for $3.49“. Eilmeldung über die parallele Einführung von Wan 3.0, 3.0 Pro und 2.7 Spicy sowie Preisänderungen. https://bsky.app/profile/aetherwavestudio.bsky.social/post/3mv6gtlugvo2u
- aetherwavestudio.bsky.social (2026-08-18): „Grok Imagine 1.5 won our 8-model AI video test at $0.20/clip. The $2.00 entry lost.“ Der eigene Benchmark behauptet für xAIs Closed-Source-Videomodell Grok Imagine 1.5 einen Vorsprung bei Preis und Leistung. https://bsky.app/profile/aetherwavestudio.bsky.social/post/3mtdvieyai22c
- zsky.ai (2026-09-10): „Watermark-free, paywall-free AI video tools that actually exist. Tested and ranked.“ Link zu einem Blogbeitrag, der wasserzeichenfreie und kostenlose Videogenerierungstools tatsächlich testet und bewertet. https://bsky.app/profile/zsky.ai/post/3mv6myhip772h
- zsky.ai (2026-04-21 bis 25, mehrere Beiträge, zusammen etwa 3 bis 4 Likes): Direkter Vergleich von ZSky und OpenAIs ChatGPT-Bildgenerierung. Nach dem Benchmark liegt ZSky bei einem Median von sieben Sekunden, während ChatGPT 30 bis 60 Sekunden plus 14 Minuten Abkühlzeit benötigt. ChatGPT sei stärker bei Textdarstellung, ZSky bei fotografischer und filmischer Bildgestaltung. Zwar älter, aber als Primärinformation zum Wettbewerb geschlossener Systeme wertvoll. https://bsky.app/profile/zsky.ai/post/3mkdmaxmv332i
- aimod.social (2026-08-02, 213 Likes, 61 Reposts): „At the end of the day what people keep asking for is the ability to know when something is or is not AI... Hopefully tools like SynthID become widespread“. Der Beitrag für die breite Einführung von Googles Wasserzeichen-Technologie SynthID erzielte die größte Resonanz dieses Accounts in der Sammlung. https://bsky.app/profile/aimod.social/post/3ms55omd4bc2m
- sheenaaiart.bsky.social (2026-09-11, 7 Likes, 2 Reposts): Täglicher Themenbeitrag mit
#AIイラスト. Die einzelne Resonanz ist gering, aber die hohe Veröffentlichungsfrequenz kennzeichnet diese Community. https://bsky.app/profile/sheenaaiart.bsky.social/post/3mv7ehe3hdo2k - modean987.bsky.social (2026-09-11): Werk mit dem Titel „Lunar Fungal Reverie“ und den Tags
#AIイラスト #AiArt #SynthArt #Midjourney8.2. Ein Beispiel für den Produktionseinsatz der aktuellen Closed-Source-Version Midjourney 8.2. https://bsky.app/profile/modean987.bsky.social/post/3mv7eoj33jqbo - alexip718.com (2026-09-11, 8 Likes, 4 Reposts): Vorwurf, die Lokalzeitung McClatchy ersetze gewerkschaftlich organisierte Journalisten durch generative KI, beschrieben als „Generative AI slop“. Nicht direkt Bild- oder Videogenerierung, aber Kontext für Widerstand gegen generative KI in den Nachrichtenmedien. https://bsky.app/profile/alexip718.com/post/3mv7eapxg5s2k
Signale
- Die Plattform ist standardmäßig eher KI-ablehnend: In der offiziellen Feed-Generator-Suche von Bluesky liefern Begriffe zu KI-Bildern und generativer KI vor allem Kunstfeeds, die ausdrücklich „no AI“, „excludes generative AI“ oder „suppresses AI and NFT“ angeben – etwa Queer Art, Gay Art, Animal Art und Merfolk. Im Gegensatz zu KI-freundlichen Communities auf X oder Reddit schließen viele kunstbezogene Nutzer auf Bluesky KI-Inhalte standardmäßig aus.
- Daneben existiert ein eigenständiges
#AIイラスト-Hashtag-Ökosystem: Unabhängig von dieser Ausschlusskultur fließen im japanischsprachigen#AIイラスト-Tag stündlich Dutzende Beiträge. Illustratoren, die Midjourney und SDXL-basierte Modelle nutzen, bilden dort eine eigene Community. Der Kontrast zwischen der allgemeinen Plattformstimmung und diesem Tag-Umfeld ist groß. - Wettbewerb um kostenlose, unbegrenzte und günstige Videogenerierung ist aktiv: Wiederverkäufer- und Serviceaccounts wie zsky.ai und aetherwavestudio posten regelmäßig konkrete Preis- und Geschwindigkeitsdaten, etwa Wan 3.0 mit 14 Credits/Sekunde und 500 Credits für 3,49 US-Dollar oder Grok Imagine 1.5 für 0,20 US-Dollar pro Clip. Der Preiswettbewerb wird mit greifbaren Zahlen sichtbar und spiegelt die Reddit-Skepsis gegenüber „unlimited“-Versprechen.
- KI-Erkennung und Kennzeichnung stehen im Fokus: Der SynthID-Beitrag von aimod.social mit 213 Likes hebt sich deutlich von allen anderen erfassten Beiträgen ab. Das deutet auf ein starkes Nutzerbedürfnis hin, erkennen zu können, ob etwas KI-generiert ist.
Grenzen
- Die im Playbook vorgesehene öffentliche Bluesky-Such-API (
https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) gab aus dieser Umgebung bei allen Zugriffen HTTP 403 Forbidden zurück, selbst bei einfachen Abfragen wieq=banana. Deshalb wurden alternative öffentliche API-Endpunkte wiegetAuthorFeed,getFeedüber Feed-Generatoren undgetPopularFeedGeneratorskombiniert. - Aufgrund dieser Einschränkung stammen die direkt thematischen Beiträge nicht aus einer Volltextsuche, sondern wurden über Feed-Generatoren und einzelne Account-Feeds gefunden. Das Ziel von rund 20 analysierten Beiträgen pro Plattform wurde durch mehrere Feeds – AI Creators, AIart worldwide, GenAI-Links und Account-Timelines – in Summe erreicht, nicht aber durch eine einzelne umfassende Suchanfrage.
- Die Vergleichsbeiträge von zsky.ai zu ChatGPT Images 2.0 stammen aus April 2026 und sind daher keine aktuellen September-Neuigkeiten. Sie werden ausdrücklich nur als ältere Referenzdaten geführt.
- Der Abruf von JSON-Seiten per WebFetch lief über ein Zusammenfassungsmodell; die wortwörtliche Genauigkeit jedes Beitragstextes kann daher nicht garantiert werden, die Zuordnung von Kernaussage und URL wurde jedoch geprüft.
- Eine Suche mit expliziter Trennung zwischen Closed Source und Open Source war nicht möglich. Die Einordnung von Wan als Open Weights sowie Nano Banana 2, Grok Imagine, Midjourney und ChatGPT Images als Closed Source basiert auf der allgemein bekannten Veröffentlichungssituation der Modelle und nicht zwingend auf einer Aussage der Beitragsersteller.
Lemmy
Lemmy — Aktuelle Entwicklungen bei KI-Bild- und Videogenerierung (Closed Source/Open Source)
Communities
- !«メールアドレス» (5.712 Mitglieder) — Größte Lemmy-Community für KI-Bild- und Videogenerierung. Neue GitHub- und Hugging-Face-Releases werden automatisch gepostet; der Charakter ähnelt stark einem Eilmeldungsfeed.
- !«メールアドレス» (2.364 Mitglieder) — Schaufenster für generierte Bilder. Fast tägliche Beiträge mit Scores von etwa 6 bis 16, aber kaum Kommentaren.
- !«メールアドレス» (1.662 Mitglieder)
- !«メールアドレス» (1.593 Mitglieder) — spezialisiert auf Anime-artige KI-Kunst
- !«メールアドレス» (363 Mitglieder) — beim Zugriff wegen Anubis-Schutz 403; Inhalte konnten in dieser Untersuchung nicht geprüft werden
- !«メールアドレス» (222 Mitglieder) — keine aktuellen Beiträge
- !«メールアドレス» (186 Mitglieder) — seit Mitte 2025 fast nicht mehr aktualisiert
- !«メールアドレス» (143 Mitglieder) — zuletzt 2023 bis 2024 aktiv und faktisch ruhend
- !«メールアドレス» (136 Mitglieder)
Beiträge
- Hauptthema der Open-Source-Videogenerierung ist MiniMax-H3 — In !«メールアドレス» erscheinen täglich ComfyUI-Nodes und LoRAs wie
lightx2v/Minimax-h3-Turbo(beschleunigende LoRA für 8 Schritte/768p; Version 1.1 mit 4 Schritten am 2026-09-08, Score 6 bis 7),Smite79/MiniMax-H3-Longvideos(bis zu etwa 120 Sekunden lange Videos, 2026-08-24, Score 5) undkaruvanan/MiniMax-H3-Director-Cut-Studio(Premiere-artige Bearbeitungsoberfläche, 2026-08-28, Score 5).
https://lemmy.dbzer0.com/post/74605337 / https://lemmy.dbzer0.com/post/74466719 - LTX-2.5 erhält Day-zero-Unterstützung in ComfyUI — Der offizielle Blogbeitrag von Lightricks, „LTX-2.5 is now available in ComfyUI“, wurde am 2026-08-12 gepostet (Score 5). Das zeigt, wie schnell offene Videomodelle praktisch integriert werden.
https://lemmy.dbzer0.com/post/73842995 - Krea 2 Turbo etabliert sich bei der Bildgenerierung — Veröffentlichungen wie
F16/krea2-turbo-sda(Rank-32-LoRA, 2026-09-10) undlvladikov/Krea2-Turbo-Distill-4step-LoRA(2026-09-08) erscheinen fortlaufend. Viele Werke in !«メールアドレス», etwa „Red Crowned Island“ mit Score 14 oder „Giant Wire Walker“ mit Score 13, wurden mit Krea2 Turbo erstellt.
https://lemmy.dbzer0.com/post/75284619 / https://lemmy.dbzer0.com/post/75284622 Viggle/Viggle-Animate— Verfahren, das die Figur in einem Video anhand eines einzelnen Bildes ersetzt. Der Beitrag vom 2026-09-05 erzielte mit Score 10 den höchsten Wert dieses Zeitraums.
https://lemmy.dbzer0.com/post/75036488- Forschungspapier „LLaDA-Image“ wird geteilt — arXiv-Arbeit zu Bildgenerierung mit Diffusions-Sprachmodellen, 2026-09-04, Score 3.
https://lemmy.dbzer0.com/post/74988021 - [Closed Source] DC Studios ließ versehentlich erkennen, dass KI-Bilder für Konzeptkunst zu „Supergirl“ eingesetzt wurden — Ein Making-of-Video wurde von YouTube entfernt. Kommentare merkten an, dass die Generierungsoberfläche nach Midjourney aussehe. Mitte August 2026, Score 33 und vier Kommentare.
https://lemmy.today/post/58316222 - [Closed Source] Googles Earth-AI-Funktion mit „Nano Banana“ wurde am Tag nach Veröffentlichung eingestellt — Es zeigte sich, dass Nutzer unangemessene Bilder („no-no images“) erzeugen konnten. Artikel von Fortune, am 2026-08-07 aus r/ArtificialInteligence crossgepostet.
https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/ - [Closed Source] Die japanische Regierung fordert OpenAI auf, gegen Urheberrechtsverletzungen durch Sora 2 vorzugehen — Im Community-Bereich technology mit Score 91 und sechs Kommentaren, datiert auf 2025-10-15 und damit für diese Untersuchung etwas älter.
https://lemmy.world/post/37391040 - [Closed Source] Wired berichtet über KI-generiertes CSAM in Meta-Anzeigen — Ein Fall von Moderationsversagen bei generierten Bildern. 2026-08-06, Score 50.
https://www.wired.com/story/meta-ran-ads-that-contained-ai-generated-child-sexual-abuse-imagery/ - [Closed Source] Elon Musk/xAI (Grok) produziert eine KI-Filmversion der „Odyssee“ — Ein niederländischer Artikel wurde in der Community films gepostet, 2026-07-22, Score 1, keine Kommentare. Der verlinkte Artikel lieferte beim Zugriff 403; geprüft werden konnten nur Titel und Beitragsmetadaten.
https://lemy.nl/post/4342454 - Allgemeine Diskussion über den Wert von KI-Bildgenerierung — Ein Beitrag in der Community memes vom 2026-08-24 mit „Promting to copy is art...I swear“ führte zu einer typischen Pro-und-Contra-Diskussion darüber, ob promptbasierte Generierung Kunst ist.
https://lemmy.world/post/51072174
Signale
- Bei Open Source steht eher das Ökosystem als das einzelne Modell im Mittelpunkt. Nicht Modellankündigungen selbst, sondern die vielen ComfyUI-Custom-Nodes, LoRAs und beschleunigten Varianten – Distill- und Turbo-Versionen – rund um MiniMax-H3 und Krea2 Turbo bilden die eigentlichen Neuigkeiten. Die Beiträge erzielen meist Scores von 2 bis 10 und keine Kommentare; sie dienen mehr dem Teilen technischer Primärinformationen als der Diskussion.
- Closed-Source-Meldungen erscheinen verstreut in allgemeinen News-Communities, nicht in technischen KI-Communities. Die Themen sind überwiegend negativ: Urheberrecht, Moderationsversagen und Regulierung statt Funktionen.
- Die Haltung gegenüber generativer KI ist auf Lemmy gespalten. Ausdrücklich Anti-KI-Communities wie
!fuck_aihaben sichtbare Präsenz. So erreichte „How to get back to habits without AI?“ einen Score von 83 bei 33 Kommentaren, was die starke Skepsis und Ablehnung gegenüber KI-Erzeugnissen unterstreicht. - Die Such-API ist unpräzise. Stichwortsuchen mit
type_=All&sort=TopMonthliefern oft viele irrelevante populäre Beiträge. Bei „Kling AI“ waren beispielsweise faktisch keine relevanten Treffer dabei. Direkte Navigation über Community-Namen erwies sich als deutlich nützlicher.
Grenzen
- Lemmy hat für dieses Thema insgesamt nur eine sehr kleine Beitragsbasis. Zwar wurden bei allgemeinen KI-Neuigkeiten mehr als 20 Beiträge analysiert, doch bei direkt einschlägiger KI-Bild- und Videogenerierung liegt die praktische Obergrenze bei etwa 10 bis 15 Beiträgen.
- Suchanfragen zu „Kling AI“, „Sora“, „Grok Imagine“, „ChatGPT image“ und ähnlichen Modellnamen lieferten fast nur irrelevante Ergebnisse. Solche modellspezifischen Meldungen waren auf Lemmy nahezu nicht auffindbar.
- !«メールアドレス» war aufgrund des Anubis-Bot-Schutzes per 403 nicht zugänglich.
- !«メールアドレス», !«メールアドレス» und !«メールアドレス» haben keine aktuellen Beiträge oder sind seit 2023 bis 2025 weitgehend inaktiv und daher keine brauchbaren Quellen für laufende Nachrichten.
- Beim Beitrag über Elon Musk/Groks „Odyssee“-KI-Film (#10) konnte der verlinkte Artikel aufgrund von 403 nicht gelesen werden; bestätigt wurden nur Titel und Metadaten.
Pinterest — Neuigkeiten zu KI-Bild- und Videogenerierung
50 Pins wurden vom Worker gesammelt, ohne Kategorisierung und als eine Gruppe. Von ihnen wurden 30 Bilder tatsächlich geöffnet und inhaltlich geprüft; die übrigen nur anhand ihrer Titel.
Visuelle Themen
- Standardisierte YouTube-Thumbnails im Stil von „AI NEWS“: Ein bärtiger Mann mit Hut und Kopfhörern zeigt einen überraschten Gesichtsausdruck; um ihn herum stehen Logos von OpenAI, Google, Microsoft, Meta, Nvidia und DeepSeek als Wal-Symbol. Diese Komposition wiederholt sich bei mehreren Anbietern [4, 18, 28].
- Vereinheitlichte Infografiken zu „Best AI video tools“: Nummerierte Listen nennen immer wieder Runway, Pika, Kling AI, Luma Dream Machine, Hailuo AI und Canva, meist in nahezu derselben Reihenfolge [8, 14, 25, 32, 50].
- Digitale Menschen als KI-Nachrichtensprecher oder für Lip-Sync: Häufig zu sehen sind weibliche Gesichter mit Audiowellen und Wireframe-Gesichtern oder Nachrichtengrafiken im Stil von „LIVE / AI NEWS VIDEO“ [19, 29, 43, 49].
- Bilder, die Sorge vor Fälschungen sichtbar machen: Roboter, die auf Smartphones Bilder mit „FAKE“-Stempel betrachten, vermummte verdächtige Personen und aus Matrix-Code gebildete Gesichter repräsentieren Deepfake- und Desinformationsängste [2, 30, 39, 37].
- Dunkelblaues, cyberartiges Collage-Design für State-of-the-art-Ankündigungen: Die Promos zu Google Veo 2/3 und zur Gemini API setzen durchgehend auf dunkle Hintergründe, Videostills und leuchtende Bildflächen [1, 7, 10, 17].
- Style-Transfer-Demo: Ein Quellvideo wird in Texturen aus Holzklötzen, Origami, Lego oder Blumen neu erzeugt. Als Demonstration konsistenter Multi-Style-Generierung sticht dieses Bild hervor [9].
- KI-Roboterreporter und Nachrichtensprecher: Mehrfach erscheinen Roboter im Anzug vor oder neben „BREAKING NEWS“-Grafiken im Kontext von KI-generierten Nachrichten [13, 40, 49].
Bemerkenswerte Pins
- [7] Google Unveils Veo 2 — Originales offizielles Promo-Bild von Google. Es zeigt auf einem Bild verschiedene Ausgabebeispiele wie Unterwasseraufnahmen, Anime-Figuren und Tanz unter Sternen und vermittelt die Qualitätspositionierung der Veo-Reihe.
- [17] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Zeigt eine aktuelle Closed-Source-Funktion: Bild-zu-Video mit nativem Audio über die Gemini API.
- [9] (Luma-Style-Transfer-Demo) — Vergleichsraster, das ein Quellvideo als „Holzklötze“, „Origami“, „Lego“ und „Blumen“ neu zusammensetzt. Ein auffälliger Technologietest für konsistente Mehrstil-Generierung aus einem Video.
- [27] Breaking News: Grok 4.6, Gemini 1B users, Honor robot phone (datiert 2026-08-12) — Nachrichtenzusammenfassung mit Datum. Sie kombiniert Grok 4.6 für autonome Aufgaben, das Überschreiten von einer Milliarde Gemini-Nutzern mit 150 Millionen Bildgenerierungen täglich sowie ein Honor-Smartphone mit Roboterarm und nennt konkrete Kennzahlen.
- [29] Microsoft VASA-1 — Visuelle Erklärung einer Technik, die aus einem einzigen Standbild und einem Audioclip Gesprächsvideos mit unterschiedlichen Gesichtsausdrücken erzeugt. Ein repräsentatives Beispiel für Talking-Head-Generierung.
- [32] AI Video Creation Tools Changing How Content Is Made — Große Infografik mit 20 Tools für Text-zu-Video, Bild-zu-Video, Bearbeitung, Voice-over, Stockmaterial und Veröffentlichungsoptimierung. Als Überblick über das gesamte Ökosystem nützlich; Stable Video Diffusion ist das einzige klar als OSS aufgeführte Tool.
- [38] A Brief History of the Rise of Generative AI & Its Applications — Infografik, die die Entwicklung von ELIZA in den 1950ern bis GPT in den 2020ern chronologisch darstellt. Hilfreich für den Kontext.
- [22] AI Generated Video is Good or Not? — Infografik mit beiden Seiten: Vorteile wie Zeitersparnis, geringere Kosten und hohe Qualität; Nachteile wie fehlende menschliche Kreativität, mangelnde emotionale Verbindung und Bearbeitungsbedarf. Sie verdeutlicht die allgemeine Nutzerwahrnehmung.
- [23] More than 20% of YouTube is now AI-generated — Pin, dessen Titel allein eine konkrete Statistik behauptet: mehr als 20 % aller YouTube-Inhalte seien KI-generiert.
- [16] Adobe udvikler AI-model til opskalering af videoer — Dänischsprachige Vorstellung eines Adobe-KI-Modells, das unscharfes Material auf HD-Qualität hochskaliert. Mit Vorher-Nachher-Bildern und damit ein Beispiel für Video-Rekonstruktion und Qualitätsverbesserung.
Signale
- Closed Source steht im Mittelpunkt: Google Veo 2/3, OpenAI Sora, Gemini API, Grok 4.6, Microsoft VASA-1 und andere namentlich genannte Produkte sind fast durchgehend Closed Source. Auch konkrete Zahlen wie eine Milliarde Gemini-Nutzer, 150 Millionen Bildgenerierungen am Tag oder mehr als 20 % KI-generierte YouTube-Inhalte konzentrieren sich auf dieses Lager [27, 23].
- Homogenisierung der Listen mit Standardtools: Mehrere unterschiedliche Anbieter und Blogs veröffentlichen Infografiken zu den besten KI-Videotools; die Tool-Auswahl ist aber fast identisch: Runway, Pika, Kling AI, Luma, Hailuo, Canva, Sora und Veo. Dieses Set wirkt auf Pinterest wie der etablierte De-facto-Standard [8, 14, 25, 32, 50].
- Open Source ist kaum sichtbar: Unter 50 Ergebnissen findet sich nur Stable Video Diffusion als klar erkennbare OSS-Erwähnung in einer Infografik [32]. Pins zu Hugging Face, ComfyUI, LoRA, offenen Modellgewichten oder eigenem Fine-Tuning wurden nicht gefunden. Da Pinterest-Suchergebnisse vor allem SEO- und Affiliate-Übersichten zeigen, ist ein Open-Source-Community-Umfeld offenbar ohnehin schwach ausgeprägt.
- Deepfake-Sorgen und Skepsis gegenüber KI-generierten Nachrichten bilden ein eigenes Thema: Bilder mit „FAKE“-Stempeln, vermummten Figuren und Hinweisen auf Verifikationswerkzeuge kommen mehrfach vor und belegen ein sichtbares Misstrauen gegenüber KI-generierten Inhalten [2, 30, 39, 37].
- Nebenverdienst und Affiliate-Marketing sind beigemischt: Pins für Fiverr-Angebote zur KI-Videoproduktion oder Werbung zum Skalieren einer Premium-Tech-Agentur ohne Code stehen neben den Nachrichten. Pinterest ist damit eher eine Plattform für Anleitungen und Monetarisierung als für Eilmeldungen.
Grenzen
- Pinterest-Suchergebnisse bestanden überwiegend nicht aus aktuellen Nachrichten, sondern aus SEO-/Affiliate-Übersichten und übernommenen YouTube-Thumbnails. Links zu Primärquellen wie offiziellen Ankündigungen oder Forscherbeiträgen waren selten.
- Der Worker sammelte alle 50 Pins ohne Genre-Aufteilung in eine Gruppe. Eine vom Playbook vorgesehene Zusammenfassung nach Genres wurde daher nicht erstellt; die Auswertung ist themenübergreifend.
- Von 50 Pins wurden 30 visuell detailliert geprüft. Bei den übrigen 20 – Index 3, 6, 11, 12, 15, 20, 21, 24, 26, 31, 33, 34, 35, 41, 42, 46, 47, 48 und weitere – wurde nur der Titel geprüft. Sechs Pins ohne Titel hatten zu wenig Hinweise auf ihren Inhalt und wurden niedriger priorisiert.
- Pins sind Standbilder, Thumbnails oder Infografiken. Die Qualität realer Videos und tatsächlicher Generierungsergebnisse konnte damit nicht geprüft werden.
Empfohlene Maßnahmen
- Die nächste X-Erhebung mit Modellnamen wie Midjourney, Sora und Kling erneut durchführen, um den Ausfall dieser Runde zu kompensieren.
- Den Dreikampf zwischen Wan 3.0, Seedance 2.5 und MiniMax H3 weiter beobachten und das Kräfteverhältnis monatlich aktualisieren.
- Nachrichten über Moderationsversagen bei großen Closed-Source-Anbietern sowohl auf Lemmy als auch auf Reddit kontinuierlich verfolgen.
- Lemmys ComfyUI-/LoRA-Eilmeldungen weiter als Primärquelle für Open-Source-Entwicklungen beobachten.
- Solange Blueskys offizielle Such-API weiterhin 403 liefert, den Erhebungsprozess über Feed-Generatoren beibehalten.
Gesammelte Bilder


















































Hinweis zur Datenqualität
Bei X wurden 40 Beiträge analysiert, aber kein einziger thematisch passender Beitrag gefunden – faktisch ein Erhebungsfehler aufgrund falscher Suchbegriffe. Blueskys offizielle Such-API war vollständig durch 403 blockiert, sodass nur eine alternative Erhebung über Feed-Generatoren möglich war. Reddit erreichte mit 11 Threads nicht das Ziel von rund 20, und Pinterest enthielt fast keine Erwähnungen zu Open Source.



