KEN’S CAT LOG

News zur KI-Bild- und Videogenerierung — 2026-09-27

Während das Ende der Sora-API die Kräfteverhältnisse bei Closed-Source-Videogenerierung erschüttert, bauen Open-Weight-Modelle rund um Qwen-Image-2.1 und LTX-2.5 ihr Ökosystem unmittelbar nach der Veröffentlichung rasch über mehrere Plattformen hinweg aus.

News zur KI-Bild- und Videogenerierung — 2026-09-27

Ehrlich: Am meisten begeistert hat mich beim Zusammenstellen diesmal, dass der Schwung des Open-Source-Lagers einfach nicht nachlässt 🔥🔥 Bei Qwen-Image-2.1 oder LTX-2.5 stürzen sich YouTube, Lemmy und Bluesky praktisch gleichzeitig darauf, sobald sie veröffentlicht werden. Auf der Closed-Source-Seite wurde Sora 2 dagegen wirklich eingestellt (App am 26.4., API am 24.9.), und nun beginnt offenbar das Gerangel zwischen Veo, Kling, Runway und Grok Imagine 🪑💨 Plattformübergreifend ist außerdem die Stimmung sehr deutlich: „Versteck nicht, dass es mit KI erstellt wurde.“ Von Immobilienfotos bis zu Wissenschaftswettbewerben drohen bei Aufdeckung ganz normal Shitstorms und Kündigungen 😱 Bei X waren die Daten leider völlig unbrauchbar – das sage ich ganz offen 🙏

Plattformübergreifend

  • Neue Open-Weight-Modelle lösen unmittelbar nach Veröffentlichung auf mehreren Plattformen Reaktionen aus. Qwen-Image-2.1 (Alibaba, 7 Milliarden Parameter, Ausgabe mit Transparenz) erhielt auf YouTube mehrere „Day-0-Review“-Videos; in Lemmys !stable_diffusion erschienen innerhalb weniger Tage nacheinander Beiträge zur ComfyUI-Unterstützung, LoRAs und ControlNet, und auf Bluesky nannten einzelne Kreative das Tool in ihren Profilen. Auch LTX-2.5 (Lightricks, 22 Milliarden Parameter, Audiosynchronisierung) wurde auf YouTube und Bluesky erwähnt. Die Anfangsgeschwindigkeit der Open-Source-Szene nach einem Release ist wirklich enorm ⚡
  • Die Gegenreaktion auf nicht offengelegte KI-Nutzung wird branchenübergreifend zum Aufregerthema. Auf Reddit brach in drei völlig unterschiedlichen Kontexten dieselbe Empörung aus: Immobilien-Listingfotos (26.980 Punkte), ein prämiertes Video eines Wissenschaftswettbewerbs (über 1.100 Punkte) und die Entlassung eines CEOs wegen KI-generierter Werbebilder (585 Punkte). Auch auf Lemmy tauchen Unterstützung für ein Wasserzeichen-Gesetz und der Midjourney-gegen-Hollywood-Prozess mit Forderungen nach Offenlegung der KI-Nutzung unter demselben Thema auf; Pinterest enthält zudem zahlreiche Bilder, die Sorgen über Deepfakes und Desinformation anheizen. Das ist kein einzelner Aufreger mehr, sondern wird zu einem strukturellen Thema 🔥
  • Nano Banana (Google) ist de facto zum Vergleichsmaßstab geworden. Auf YouTube gibt es sowohl Videos, die Grok Imagine 2.0 als „15-mal günstiger als Nano Banana Pro“ vorstellen, als auch solche, die das offene Qwen-Image-2.1 als „Better than Nano Banana“ bezeichnen. Sowohl Closed- als auch Open-Source-Modelle werden an diesem Modell gemessen 👀
  • ComfyUI ist die gemeinsame Infrastruktur der Entwickler-Community. Auf Reddit (Ratschläge zum lokalen Betrieb für Menschen, die kostenlose Videos erzeugen wollen), YouTube (Einrichtungsvideos für LTX-2.5 und Qwen-Image-2.1) und Lemmy (über fünf Erweiterungsknoten in zwei Wochen) taucht überall ComfyUI auf. Es fühlt sich wie das Heimstadion der Open-Source-Szene an 🏠

Plattform für Plattform

Reddit — 12 Threads gesammelt (das Ziel von 20 wurde nicht erreicht). Im Mittelpunkt standen Fragesthreads zu Tool-Empfehlungen sowie Aufregerthreads nach dem Muster „Verheimliche nicht, dass du KI verwendet hast“. Beiträge, die Closed und Open Source direkt entlang dieser zwei Achsen diskutierten, waren selten; in r/generativeAI ließen sich jedoch praktische Hinweise mit konkreten Modellnamen wie Seedance 2.5 und Grok Imagine Video finden.

X — Diese Phase war praktisch ein Fehlschlag 😂 Die 40 gesammelten Beiträge kamen ausschließlich über Trendbegriffe wie Jugoslawien, Prominente oder Sweepstakes-Werbung; kein einziger behandelte KI-Bild- oder Videogenerierung. Die Suche des Workers war überhaupt nicht mit dem Thema verknüpft. Beim nächsten Mal ist eine erneute Sammlung mit direkten Keywords wie „Midjourney“ oder „Sora 2“ nötig.

YouTube — Über Such-Snippets wurden 12 Videos geprüft (WebFetch konnte die eigentlichen YouTube-Seiten nicht abrufen). Auf der Closed-Source-Seite fielen der rasche Aufstieg von Grok Imagine 2.0 und Vergleiche von Alternativen nach Soras Rückzug auf; bei Open Source waren Qwen-Image-2.1, das FLUX-3-Konzept und LTX-2.5 die prominentesten jüngsten Releases.

Bluesky — Die Kommunikation offizieller Unternehmensaccounts ist sowohl bei Closed als auch bei Open Source nahezu tot. Midjourney war der einzige aktive offizielle Account, doch der jüngste Beitrag liegt etwa ein Jahr zurück; die offiziellen Accounts von Stability AI, Black Forest Labs und Kling AI haben keine Beiträge oder sind inaktiv. Die tatsächliche Aktivität zeigte sich eher in Profilen einzelner Kreativer, in denen konkrete Tools wie Qwen-Image, LTX-2 und Wan Video aufgeführt waren.

Lemmy — In !«メールアドレス» konzentrieren sich fast alle Primärinformationen zu Open Source. Qwen-Image-2.1, Krea 2, MiniMax H3 und Wan2GP wurden innerhalb der vergangenen zwei Wochen gleichzeitig an mehreren Stellen aktualisiert; nach Entwicklungsgeschwindigkeit übertraf das Open-Source-Lager das Closed-Source-Lager beim Gesprächsvolumen. Closed Source erschien vor allem im Kontext von Nachrichten und Klagen, etwa dem Ende der Sora-API oder dem Midjourney-gegen-Hollywood-Prozess.

Pinterest — 30 von 50 Beiträgen wurden geprüft. Es handelte sich nicht um Primärankündigungen, sondern überwiegend um News-Zusammenfassungen im Stil von YouTube-Thumbnails, Affiliate-Listen wie „Top 10 Video-Tools“ sowie Bilder, die Deepfake-Ängste schüren. Open-Source-Workflows wie ComfyUI-Screenshots oder LoRAs kamen kein einziges Mal vor; sowohl Closed als auch Open Source bestanden fast ausschließlich aus sekundär verbreiteten Inhalten.

Was beobachten

Empfehlungen

  • Die X-Sammelphase sollte mit direkt zum Briefing passenden Keywords wie „Midjourney“, „Sora 2“ und „Stable Diffusion“ statt mit Trendbegriffen erneut durchgeführt werden.
  • Qwen-Image-2.1 und LTX-2.5 bauen ihr Ökosystem direkt nach dem Release schnell aus und sollten auch künftig vorrangig beobachtet werden.
  • Fälle, in denen nicht offengelegte KI-Nutzung zu Kündigungen, Klagen oder Regulierung führt, sollten fortlaufend verfolgt werden.
  • Ein regelmäßiger Vergleich der Kräfteverhältnisse von Veo, Kling, Runway und Grok Imagine nach Soras Rückzug ist sinnvoll.
  • Da offizielle Unternehmenskommunikation auf Bluesky fast nicht funktioniert, ist es effizienter, die Profile einzelner Kreativer zu beobachten.
  • Pinterest ist als Primärquelle schwach und sollte auf die Prüfung der Stimmung bei sekundär verbreiteten Inhalten wie News-Zusammenfassungen und Affiliate-Beiträgen beschränkt bleiben.

Datenqualität

X war ein vollständiger Fehlschlag: Es wurden nur themenfremde Beiträge über Trendbegriffe gesammelt, daher ist eine erneute Sammlung zwingend. YouTube stützte sich wegen der Blockade von WebFetch durch YouTube auf Such-Snippets und blieb bei 12 Beiträgen; Kanalnamen und Aufrufzahlen sind vielfach unbekannt. Reddit (12 Beiträge) und Bluesky (wegen API-403 nur kontobezogene Feeds mit weniger als 20 Beiträgen) erreichten ebenfalls nicht das Ziel von 20. Lemmy kam zwar auf mehr als 20 Beiträge, doch viele davon waren Release-Bots ohne Kommentare und mit geringer Diskussionsintensität. Bei Pinterest wurden nur 30 von 50 Beiträgen geprüft.

Zusammenfassung nach Plattform

Reddit

Reddit — News zur KI-Bild- und Videogenerierung (Image and Video Generation AI News)

Wo

Die 12 gesammelten Threads stammen aus neun Subreddits.

Subreddit Mitgliederzahl Anzahl gesammelter Threads
r/mildlyinfuriating 12,597,694 1
r/labrats 726,858 2
r/WhitePeopleTwitter 3,145,714 1
r/generativeAI 157,421 3
r/DeepSeek 141,431 1
r/isthisAI 423,156 1
r/Earth199999 54,355 1
r/CriticalState 39,741 1
r/aivideomaking 7,823 1

Das Thema erstreckt sich sowohl auf kleine, auf generative KI spezialisierte Communities (r/aivideomaking, r/generativeAI) als auch auf sehr große Meme- und Plauder-Subreddits (r/mildlyinfuriating, r/WhitePeopleTwitter). Alle wurden über den Suchbegriff „Image and Video Generation AI News“ gefunden.

Was Menschen sagen
  • #1 r/aivideomaking · 24 Punkte · 58 Kommentare · 2026-09-20 — Auf einen Beitrag von jemandem, der kostenlos KI-Videos erstellen wollte, antwortete u/AztecWheels (2 Punkte): „Mit Pinokio herunterladen, mit ComfyUI Bilder erstellen und mit FramePack zu Videos machen. Selbst auf schwacher Hardware lassen sich lokal Videos zwischen 1 und 120 Sekunden erzeugen.“ Viele Stimmen ringen mit der Wahl zwischen lokaler Generierung und Cloud-Abos. (https://www.reddit.com/r/aivideomaking/comments/1wled0f/)
  • #2 r/labrats · 1.103 Punkte · 133 Kommentare · 2026-09-23 — Ein prämiertes Video von Nikon Small World in Motion stellte sich als KI-generiert bzw. KI-bearbeitet heraus. Top-Kommentar von u/Barkinsons (630 Punkte): „Bei wissenschaftlichen Mikroskopiebildern gibt es keinen Platz für KI-Tools; wir sind verpflichtet, Bilder so getreu wie möglich wiederzugeben.“ (https://www.reddit.com/r/labrats/comments/1wo0j5e/)
  • #4 r/labrats · 416 Punkte · 90 Kommentare · 2026-09-24 — Fortsetzung des vorigen Falls. Der Autor räumte ein, mit unüberwachter KI Strukturen segmentiert und beschriftet zu haben. u/Feline_Diabetes (299 Punkte) kommentierte: „Ich möchte sehen, welcher Anteil des Originalbilds echt ist und welcher KI-Halluzination.“ Nikon prüft den Preis Berichten zufolge erneut. (https://www.reddit.com/r/labrats/comments/1woxdhk/)
  • #3 r/generativeAI · 7 Punkte · 40 Kommentare · 2026-09-23 — In Antworten auf „Wie erstellt man lange KI-Videos?“ nannte u/kaboom-o (2 Punkte) konkrete Modelle: „Für lange konsistente Gesichter Seedance 2.5 (bis etwa 30 Sekunden, native Audiospur). Für günstige Bewegungsentwürfe Grok Imagine Video (480p, 5 Sekunden). Für fotorealistische Endfassungen Gemini Omni Flash.“ Viele kurze Clips zu generieren und sie in DaVinci zusammenzusetzen, gilt als gängiger Praxisworkflow. (https://www.reddit.com/r/generativeAI/comments/1wog53q/)
  • #6 r/generativeAI · 4 Punkte · 17 Kommentare · 2026-09-22 — u/jmbirn (2 Punkte): „Mit Diensten wie Magnific AI (oder Fal, Krea) kann man mit einem Konto viele Modelle ausprobieren.“ u/sharktank123456 (2 Punkte) wies darauf hin, dass Dream Machine keine neuen Registrierungen mehr annimmt und stattdessen Luma Agents verfügbar ist. (https://www.reddit.com/r/generativeAI/comments/1wngj3w/)
  • #8 r/generativeAI · 2 Punkte · 20 Kommentare · 2026-09-26 — Auf die Frage nach kostenlosen Bildgenerierungstools antwortete u/Scuzzy_Womack (3 Punkte): „ComfyUI ist kostenlos, wenn du es ohne Internetverbindung nutzt.“ Außerdem wurden Yodayo/MoescapeAI (50 Credits alle 24 Stunden) und Leonardo (täglich kostenlose Tokens) empfohlen. (https://www.reddit.com/r/generativeAI/comments/1wqfleb/)
  • #5 r/mildlyinfuriating · 26.980 Punkte · 723 Kommentare · 2026-09-21 — Empörung darüber, in Immobilien-Listingfotos mit KI erzeugte „Inspirations“-Inneneinrichtungen zu verwenden. Der Beitragsteller: „Es werden etwa Heizkörper entfernt – Inszenierungen, die sich in der Realität nicht nachbilden lassen.“ u/BojackWorseman13 (1.140 Punkte) schlug vor, die Seite des Maklers mit Beschwerden zu überziehen. Die Größe der Gegenreaktion in diesem riesigen Subreddit sticht deutlich hervor. (https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/)
  • #7 r/WhitePeopleTwitter · 585 Punkte · 64 Kommentare · 2026-09-25 — Ein CEO wurde wegen eines KI-generierten Bilds eines „Lake America“-Pullovers entlassen. u/samanime (294 Punkte): „Wenn mehr von diesen Idioten zur Verantwortung gezogen werden, wird es weniger solche Leute geben.“ Ein Fall, in dem der Aufreger um KI-Inhalte direkt zu realen Beschäftigungsfolgen führte. (https://www.reddit.com/r/WhitePeopleTwitter/comments/1wq3juw/)
  • #9 r/DeepSeek · 318 Punkte · 53 Kommentare · 2026-09-21 — Die täglichen aktiven Nutzer von DeepSeek stiegen von 120 auf 200 Millionen (+66,7 %), während die Rechenressourcen nur um 8,3 % zunahmen; dies wird als Ursache für Qualitätsverlust analysiert. Außerdem soll Huawei 160.000 Ascend-960DT-Einheiten bestellt haben, um den Rechenmangel zu beheben. u/Equivalent-Grass-527 (14 Punkte): „Das Missverhältnis zwischen Nachfrage und Rechenleistung erklärt einen Großteil der jüngsten Verschlechterung.“ (https://www.reddit.com/r/DeepSeek/comments/1wmcgex/)
  • #10 r/CriticalState · 1.280 Punkte · 13.849 Kommentare · 2026-09-21 — Thread zu einem Gesetzesvorschlag, nach dem KI-generierte Bilder und Texte mit Wasserzeichen gekennzeichnet werden müssen. Die außergewöhnlich hohe Zahl an Kommentaren und mehrere hochbewertete Kommentare, darunter u/Timedforfun (19 Punkte), der per Abstimmungsstil „Dafür ✅“ erklärte, zeigen die starke Unterstützung für eine Kennzeichnungspflicht. (https://www.reddit.com/r/CriticalState/comments/1wmktek/)
  • #12 r/isthisAI · 605 Punkte · 104 Kommentare · 2026-09-23 — Bei einem Malvideo eines kleinen YouTube-Kanals wurde diskutiert, ob es „KI oder echt“ sei. u/chekhovsdickpic (444 Punkte) prüfte Bild für Bild und kam zu dem Schluss: „Es gibt Bearbeitungen, aber keine KI.“ Später bestätigte der Urheber dies selbst in einem Kommentar. Das zeigt, wie ausgefeilt die Prüfmethoden der KI-Erkennungscommunity werden. (https://www.reddit.com/r/isthisAI/comments/1wohq6s/)
Signale
  • Was wächst: Bei langen KI-Videos etabliert sich statt „einmal generieren“ ein Workflow, bei dem zahlreiche kurze Clips (5–30 Sekunden, etwa mit Seedance 2.5 oder Grok Imagine Video) erstellt und in DaVinci oder Capcut zusammengeschnitten werden (#3). Außerdem setzt sich die gemeinsame Erkenntnis durch, dass kein Tool zugleich kostenlos, hochwertig und ohne Wasserzeichen ist (symbolisch dafür steht u/Jenna_AIs Formulierung in #6: „Wähle zwei und heule“). Die Wahl verdichtet sich auf lokalen Betrieb mit ComfyUI oder günstige Abos wie Grok für 10 US-Dollar monatlich (#1, #8).
  • Was abgelehnt wird: Gegen das Verstecken oder Verschleiern von KI-Bearbeitung herrscht sehr starker Widerstand. In Wissenschaftswettbewerben (#2, #4), Immobilienfotos (#5) und Unternehmenswerbung (#7) wird nicht offengelegte KI-Nutzung einheitlich scharf verurteilt. Die 26.980 Punkte in r/mildlyinfuriating (#5) und 13.849 Kommentare in r/CriticalState (#10) zeigen, dass sich diese Gegenreaktion über einzelne Communities hinaus auf ein breites Publikum ausdehnt.
  • Überraschend: Die zwei r/labrats-Threads (#2, #4) zeigen technische Empörung darüber, dass KI in der Wissenschaftscommunity Strukturen „halluziniert“ hat. Es gibt jedoch teilweise auch Mitgefühl mit dem Autor – der Beitragsteller betont ausdrücklich, es gehe nicht um Abneigung gegen ihn – weshalb die Meinungen geteilt sind. Kommentare wie von u/holydiver18 (#4, 55 Punkte), wonach ein gewisses Maß an Kritik selbstverständlich sei, zeigen zugleich: Nicht die KI-Nutzung an sich, sondern Offenlegung und Überprüfbarkeit sind der Kern des Konflikts.
  • Kontext der Ressourcenknappheit auf Plattformseite: Das starke Wachstum von DeepSeek (#9) bei begrenzten Rechenressourcen ist ein indirektes Signal für die angespannte Nachfrage nach den Basismodellen hinter KI-Bild- und Videogenerierung.
Einschränkungen
  • Es wurden nur 12 Threads gesammelt, nicht die im Briefing angestrebten etwa 20 pro Plattform. Es gab nur einen Suchbegriff, „Image and Video Generation AI News“; ergänzende Suchen nach konkreten Closed-Source-Produkten wie Midjourney, Sora oder Veo sowie Open-Source-Produkten wie Stable Diffusion, Flux oder HunyuanVideo wurden nicht durchgeführt.
  • Deshalb konzentriert sich der Großteil der Sammlung auf Fragesthreads nach Tool-Empfehlungen und ethische Gegenreaktionen auf KI-Inhalte; Threads, die Open Source und Closed Source direkt vergleichen, wurden nicht gefunden. Eine Synthese muss mit den Ergebnissen anderer Plattformen erfolgen.
  • In dieser Phase wurden lediglich die bereits vom Worker gesammelten Dateien output/reddit.threads.md / .json gelesen; ein direkter Zugriff auf Reddit oder zusätzliche Suchen fanden gemäß Playbook nicht statt.

X

X — News zur KI-Bild- und Videogenerierung

Accounts

Die 39 Accounts in output/x.posts.json zeichnen kein Bild davon, wer die Diskussion über KI-Bild- und Videogenerierung auf X prägt – siehe Einschränkungen. Der Vollständigkeit halber kam jeweils ein Beitrag von allen 39 Accounts, außer @Amateraspi0x (Jungle Channel, 2 Beiträge, insgesamt 0 Likes). Nach Engagement stammten die größten Einzelbeiträge von @LagunaBiotchIG (28.975 Likes, ein Foto von Taylor in Cleveland), @_daddydisco (60.755 Likes, ein Spoken-Word-Clip über das Gesicht eines Mannes, das „zu Ton wird“), @NIKKE_en (5.608 Likes, ein Mobile-Game-Screenshot zu einem Event) und @newheightshow (11.282 Likes, „Shoutout Cleveland!“). Keiner dieser Accounts postet über generative KI-Tools, Modelle oder Kunst – es handelt sich um Sport- und Promi-Fanaccounts, einen offiziellen Gacha-Game-Account sowie Giveaway-Bots (@Miledge1, @CSharp66427821, @RaeWirth posteten dieselbe Fanatics-Werbung zu „Quad Goals #sweepstakes“).

Beiträge

0 der 40 gesammelten Beiträge erwähnen KI-Bild- oder Videogenerierung, ein KI-Modell oder ein KI-Tool. Keiner nennt Midjourney, Stable Diffusion, Sora, Veo, Runway, Flux, Grok Imagine, Nano Banana oder ein anderes generatives System. Der nächste Bezug zu visuellen Medien ist Beitrag #4 (@vintagemapstore, 234 Likes, 52 Reposts, rund 13.000 Aufrufe, 2026-09-26, https://x.com/vintagemapstore/status/2103834220624068946): eine handgemachte Kartenanimation über den Zerfall Jugoslawiens, ausdrücklich als „Work by me“, also als nicht durch KI entstanden, präsentiert. Nichts anderes in der Sammlung berührt auch nur am Rande generative Medien. Hier werden keine Erkenntnisse berichtet, weil es keine gibt; eine Auflistung irrelevanter Beiträge würde verfälschen, was X zu diesem Thema gesagt hat.

Signale

In diesem Datensatz gibt es kein Signal zu KI-Bild- oder Videogenerierung, weder steigendes noch anderes. Die Daten zeigen jedoch den Grund: Die Suchbegriffe des Workers (Yugoslavia, #chance, Taylor, #sweepstakes, #giveaways, Czechia, #gaming, Goddess, Lando, Cleveland) stehen in keinem Zusammenhang mit dem Briefing. Sie wurden wörtlich aus Xs eigener Explore-/Trend-Liste zum Sammelzeitpunkt übernommen (siehe output/x.posts.json, "source": "trending"), und acht von zehn sind als „Trending in Croatia“ markiert; die übrigen als nationale oder globale Trends in Politik, Musik, Sport, Gaming und Motorsport. Explore ist an den Standort der X-Sitzung gebunden – in diesem Durchlauf offenbar Kroatien. Diese Liste ist die Trend-Sidebar eines Orts, keine globale Sicht, und von Anfang an keine Suche nach dem Forschungsthema.

Einschränkungen
  • Die Sammlung suchte nicht nach dem Thema. output/x.posts.json dokumentiert zwar "query": "Image and Video Generation AI News", aber "source": "trending" und Begriffe, die ausschließlich aus Xs Explore-Trends stammen (Jugoslawien, #chance, Taylor, #sweepstakes, #giveaways, Tschechien, #gaming, Goddess, Lando, Cleveland). Keiner davon bezieht sich auf KI oder generative Medien. Das wirkt wie ein Fallback-Pfad, bei dem der Worker einfach die Explore-Seite abrief, statt eine tatsächliche Stichwortsuche nach News zur KI-Bild- und Videogenerierung durchzuführen; die Datei kann das Briefing daher nicht beantworten.
  • Daher gibt es in diesem Durchlauf keine themenbezogenen Accounts, Beiträge oder Signale von X zu berichten – alle 40 Beiträge behandeln andere Themen wie Promi-Fandom, Sportergebnisse, ein Mobile Game, Giveaway-Werbung, eine Animation alter Karten oder Formel-1-Fandramen.
  • Eigene Suchen zur Korrektur konnten nicht durchgeführt werden: Laut Playbook liefert anonymer bzw. nicht instrumentierter Lesezugriff auf X keine Ergebnisse, und nur die vorab authentifizierte Sitzung des Workers kann Beiträge sammeln. Für diese Phase gibt es keine alternative Datenquelle.
  • Empfohlen wird, die X-Sammlung mit expliziten, ans Briefing gebundenen Suchbegriffen wie „Midjourney“, „Sora 2“, „Stable Diffusion“, „Runway Gen-4“, „Nano Banana“, „Veo 3“, „open-source image model“ und „open weights video model“ statt mit Trendthemen erneut auszuführen, damit beim nächsten Mal tatsächlich Diskussionen zur KI-Bild- und Videogenerierung erscheinen.

YouTube

YouTube — News zur KI-Bild- und Videogenerierung (Image and Video Generation AI News)

Kanäle

Als größere Kanäle, die dieses Thema auf YouTube kontinuierlich behandeln, konnten über die Suche folgende gefunden werden:

  • Matt Wolfe (@mreflow) — etwa 690.000 bis 970.000 Abonnenten, je nach Quelle. Ein repräsentativer Kanal, der allgemeine KI-News mit einem Blick auf das große Ganze zusammenfasst.
  • Wes Roth — etwa 321.000 Abonnenten. Bietet tägliche KI-News in Form kurzer Briefings.

Diese beiden Kanäle wurden in externen Artikeln (atakinteractive.com, vidiq.com) als feste Größen für allgemeine KI-News genannt; es wurde nicht bestätigt, dass die in dieser Sammlung aufgeführten Einzelvideos von diesen zwei Kanälen stammen (siehe Einschränkungen unten). Bei den meisten gefundenen Einzelvideos war der Kanalname im YouTube-Such-Snippet nicht sichtbar und ließ sich nicht prüfen.

Videos

Closed-Source-Seite:

  1. Grok Imagine 2.0 Just WIPED OUT Expensive Design Tools (Full Asset Workflow) — etwa August 2026 — https://www.youtube.com/watch?v=jH7-krxfarU — Behauptet, dass xAIs am 7. August 2026 veröffentlichte Bildgenerierungsmodell „Grok Imagine 2.0“ den kompletten Workflow bestehender kostenpflichtiger Designtools ersetzen kann.
  2. [Image Gen AI] Grok Imagine 2.0 Hits #2 Globally — etwa August 2026 — https://www.youtube.com/watch?v=X6PChZ59LrQ — Berichtet, dass Grok Imagine 2.0 weltweit Platz zwei in einer Rangliste für Bildgenerierung erreicht habe.
  3. Grok Imagine 2 is out of control (And It's 15x Cheaper Than Nano Banana Pro) — etwa August 2026 — https://www.youtube.com/watch?v=NE2_w4_aDig — Vergleicht Grok Imagine 2 mit Nano Banana Pro und behauptet Konkurrenzqualität bei einem 15-mal niedrigeren Preis.
  4. BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives — 27. März 2026 — https://www.youtube.com/watch?v=Zf9979o8RGk — Nach der Einstellung von OpenAIs Sora 2 (App am 26. April, API vollständig am 24. September) werden Alternativdienste praktisch getestet und verglichen. Im September ist diese Einstellung Realität geworden.
  5. Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison — etwa März 2026 — https://www.youtube.com/watch?v=x5fMQvhKP60 — Direkter Vergleich von vier Closed-Source-Videogenerierungsmodellen. Kling wird bei langen Videos, 4K und Bewegungsübertragung, Veo bei Audioqualität und Referenzbildkontrolle als überlegen eingeordnet.
  6. Midjourney V8 Is Close: Here's What We Know — etwa 2026 — https://www.youtube.com/watch?v=aEVvqmwDVu8 — Fasst die bekannten Informationen zum nächsten Schritt nach Midjourney V8 zusammen; V8.1 wurde bereits am 14. April veröffentlicht.

Open-Source-Seite:

  1. Qwen-Image-2.1 Is INSANE… Just 7B Parameters?! — etwa 20.–21. September 2026 — https://www.youtube.com/watch?v=3qGl0wiv2G0 — Kurzreview von Alibabas am 20. September veröffentlichtem „Qwen-Image-2.1“ (7 Milliarden Parameter, kombiniert Text-zu-Bild-Generierung und Bearbeitung, native Unterstützung transparenter Hintergründe, Kombination von bis zu zehn Referenzbildern).
  2. Qwen Image 2.1 best open source Image Editor. Better than Nano Banana - 10 refs transparency faster — etwa September 2026 — https://www.youtube.com/watch?v=AIgYj5RG-FQ — Untersucht mit einer ComfyUI-Demonstration die Vorteile gegenüber Nano Banana: zehn Referenzbilder, Transparenz und Geschwindigkeit.
  3. FLUX 3 Might Be the Open Source Sora 2 We Deserve — 24. Juli 2026 — https://www.youtube.com/watch?v=1s3zslFOSh0 — Stellt das Konzept vor, die FLUX-Reihe von Black Forest Labs zu einem multimodalen Modell „FLUX 3“ auszubauen, das nicht nur Bilder, sondern auch Video, Audio und Robotik umfasst.
  4. LTX-2.5 Is Open Weights - Full Setup and Test on ComfyUI — 18. August 2026 — https://www.youtube.com/watch?v=sIOC9pzHzjs — Richtet das von Lightricks als Open Weights veröffentlichte Videogenerierungsmodell „LTX-2.5“ mit 22 Milliarden Parametern und synchronisiertem Audio in ComfyUI ein und testet es.
  5. New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local) — 12. August 2026 — https://www.youtube.com/watch?v=pA2BQw9LY8A — Führt LTX-2.5 lokal aus und betont die hohe Generierungsgeschwindigkeit.
  6. Z Image Undistilled Just Dropped | Day 0 Review — etwa November 2025 bis Februar 2026 (Veröffentlichungsdatum unklar) — https://www.youtube.com/watch?v=mtk4IL-Bv28 — Day-0-Review der Undistilled-Version des leichten, unter Apache-2.0 lizenzierten Open-Source-Bildmodells „Z-Image“.
Signale
  • Die Open-Source-Seite hat starken Schwung: Von den in dieser Phase gefundenen Videos der letzten 60 Tage (Ende Juli bis September 2026) sticht – abgesehen von Grok Imagine 2.0 auf der Closed-Source-Seite im August – vor allem Open Source heraus: Qwen-Image-2.1 (20. September), das FLUX-3-Konzept (24. Juli) und LTX-2.5 (12.–26. August, gleichzeitig von mehreren Kanälen behandelt). Insbesondere für Qwen-Image-2.1 und LTX-2.5 erschienen unmittelbar nach Veröffentlichung mehrere „Day-0-Review“- und lokale Einrichtungs-Videos; die Community reagierte schnell.
  • Die Erzählung „Kann Nano Banana (Google) übertroffen oder ersetzt werden?“ wird zum Standard: Sowohl Open-Source-Videos (#8 „Better than Nano Banana“, außerdem zahlreiche ähnliche Qwen-Überschriften) als auch Closed-Source-Videos (#3 „15x Cheaper Than Nano Banana Pro“) verwenden Nano Banana beziehungsweise Gemini-Bildgenerierung als gemeinsamen Bezugspunkt. Die Nano-Banana-Reihe von Google wird zum De-facto-Vergleichsmaßstab.
  • Die Closed-Source-Videogenerierung wird durch Soras Rückzug neu geordnet: Sora 2 wurde in der App am 26. April und über die API am 24. September vollständig eingestellt (#4). Dadurch sind Vergleichsvideos mit den vier Optionen Veo 3.1, Kling 3.0, Grok Imagine und Runway Gen-4.5 (#5) zum typischen Closed-Source-Format geworden.
  • Überraschend: Reviews offener Videogenerierungsmodelle wie LTX-2.5 oder HunyuanVideo 1.5 konzentrieren sich gegenüber Bildmodell-Reviews stärker auf praktische Aspekte wie ComfyUI-Einrichtung und VRAM-Anforderungen. Das Interesse gilt weniger der reinen Leistung als der Frage, ob das Modell auf dem eigenen PC läuft.
Einschränkungen
  • Auch bei direktem Öffnen von YouTube-Suchergebnis- und Videoseiten mit WebFetch wurden nur Cookie-Zustimmung und Footer-Vorlagen abgerufen, nicht aber tatsächliche Titellisten, Kanalnamen, Abonnentenzahlen, Aufrufe, Veröffentlichungsdaten, Beschreibungen oder Kommentare (mehrfach getestet; auch JSON wie ytInitialData war nicht verfügbar). Die Videoinformationen in dieser Datei basieren daher nicht auf direkt geöffneten YouTube-Suchseiten wie im Playbook vorgesehen, sondern auf Snippets aus Websuchen.
  • Folglich konnten Kanalnamen, Abonnentenzahlen und konkrete Aufrufzahlen nicht für jedes Video bestätigt werden. Von den im Playbook für den Abschnitt „Videos“ geforderten Angaben – Titel, Kanal, Datum, Aufrufe, Link und Zusammenfassung – sind Kanal und Aufrufe bei den meisten Videos unbekannt; die Daten sind oft aus Such-Snippets geschätzt und mit „etwa“ versehen.
  • Das Abschlussziel des Briefings von rund 20 analysierten Beiträgen/Videos je Plattform wurde nicht erreicht. Weil die Detailprüfung einzelner Videoseiten nicht funktionierte, blieb die Sammlung bei 12 auf Websuch-Titeln und Kurzbeschreibungen basierenden Einträgen.
  • Ein YouTube-Video aus dem September, das die vollständige Einstellung der Sora-API am 24. September direkt meldet, wurde nicht gefunden; stattdessen wird das frühe Ankündigungsvideo aus dem März (#4) genutzt. Ein direktes Video zur vollzogenen Einstellung im September wurde nicht bestätigt.
  • Die in der Kanalliste genannten Matt Wolfe und Wes Roth stammen als repräsentative, regelmäßig über das Genre berichtende Kanäle aus externen Artikeln. Ob die einzelnen gefundenen Videos (#1–12) von ihnen stammen, wurde nicht bestätigt.

Bluesky

Bluesky — Recherche zu News über KI-Bild- und Videogenerierung (Closed/Open Source)

Accounts
  • Offizieller Midjourney-Account @midjourneyofficial.bsky.social — Der einzige offizielle Account auf der Closed-Source-Seite, der regelmäßig postete. Die Inhalte bestehen jedoch vor allem aus alltäglichen Video-/Bildbeiträgen und Feature-Vorstellungen wie Style Explorer, nicht aus großen News-Ankündigungen.
  • Stability AI @stabilityai.bsky.social — Offizieller Account der Open-Weight-Reihe Stable Diffusion. Der jüngste Beitrag kündigte am 19. November 2025 die Partnerschaft mit Warner Music Group an; seitdem gab es keine Updates mehr, also rund zehn Monate lang keine Beiträge bis September 2026.
  • Black Forest Labs (FLUX-Entwickler) @blackforestlabs.bsky.social — Das Handle wurde reserviert, aber es gibt keinen einzigen Beitrag. Praktisch ein verwaister Account.
  • Offizielle ComfyUI-nahe Accounts (real-comfyui.bsky.social / comfy-ui.bsky.social) — Beide ohne Beiträge. Die ComfyUI-Community betreibt auf Bluesky keine offizielle Kommunikation.
  • Civitai-Update-Bot @civitai-bot.bsky.social (bekannt als „CivitaiCheckPoint Update BOT“, japanischsprachig) — Automatischer Bot für Checkpoint-Updates auf Civitai. Die jüngsten geprüften Beiträge stammen vom 9. Mai 2024; die automatische Bluesky-Verknüpfung scheint danach eingestellt worden zu sein.
  • Offizieller Kling-AI-Account @klingai.bsky.social — Handle vorhanden, aber keine Beiträge.
  • Für OpenAI, Google DeepMind und Adobe Firefly wurden keine offiziellen Primäraccounts gefunden. Treffer waren nur inoffizielle Mirror-/Bot-Accounts wie openai-m.extwitter.link und googledeepmind.zpravobot.news.ap.brid.gy oder persönliche Accounts von Botschaftern und gegenwärtigen Mitarbeitenden.
  • Einzelne Kreative, bei denen Open-Source-Nutzung bestätigt wurde:
    • @you32081.bsky.social — veröffentlicht Werke, die mit Qwen-Image und Z-Image-Turbo erstellt wurden
    • @andyt79.bsky.social — führt „LTX-2 Qwen Image“ im Profil und nimmt an Midjourneys Prompt-Sharing-Projekt (#QP) teil
    • @generate-cmyxt.bsky.social — kündigt Erklärungen zu Workflows mit ComfyUI, Qwen Image Edit, Wan Video und BindWeave an (X-Verknüpfung)
Beiträge
  1. Midjourney-Video „Happy Friday!“ — 2025-08-22, 64 Likes / 4 Reposts / 3 Antworten. Der Beitrag mit der stärksten Reaktion unter den geprüften Posts von midjourneyofficial.bsky.social, aber kein Feature-News-Beitrag, sondern alltägliches Engagement.
    https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lwz7idyu4k27
  2. Ankündigung der Erweiterung von Midjourney Style Explorer — 2025-09-10, 10 Likes / 1 Repost / 1 Quote. Vorstellung eines neuen Features, mit dem sich Styles wie die Explore-Seiten für Videos und Bilder durchsuchen lassen.
    https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lyj6kbu47k2c
  3. Midjourney kündigt vervielfachte Zahl von Styles im Style Explorer an — 2025-09-18, 10 Likes / 2 Reposts / 1 Quote. Enthält auch die Ergänzung einer fuzzy style search.
    https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lz5cskktzk2c
  4. Midjourney-Video „Time for some chaos?“ — 2025-10-08, 12 Likes / 1 Repost / 1 Bookmark. Der jüngste geprüfte Beitrag; seitdem, also seit etwa einem Jahr, gab es keine Updates.
    https://bsky.app/profile/midjourneyofficial.bsky.social/post/3m2ndua75gc26
  5. Midjourney reagiert auf Nutzerbeitrag „Odin's Chariot does not exist“ — Der ursprüngliche Beitrag stammt vom 2025-09-04 und wurde vom Bot @ttaships.airminded.org als automatisch erzeugte Kunst mit 20 Likes / 2 Reposts veröffentlicht. Midjourney reagierte per Reply; die Interaktion mit Community-Bots ist offenbar ein wichtiger Teil der Aktivität des offiziellen Accounts.
    https://bsky.app/profile/ttaships.airminded.org/post/3lxzwpuriuf2y
  6. Ankündigung der Partnerschaft Stability AI × Warner Music Group — 2025-11-19, Ankündigung der gemeinsamen Entwicklung von Musikproduktionstools mit „ethically trained models“. Die Reaktion fiel jedoch mit nur 1 Like / 2 Antworten / 0 Reposts sehr gering aus. Selbst eine Partnerschaftsmeldung eines der größten Open-Source-Akteure erzeugte auf Bluesky nahezu keine Resonanz.
    https://bsky.app/profile/stabilityai.bsky.social/post/3m5ynoibe3s2k
  7. Civitai-Update-Bot „Carrot Caramel Batake updated“ — 2024-05-09, Update eines auf SD1.5 basierenden Checkpoints, 3 Likes (mit Pornografie-Label).
    https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nnatkqi24
  8. Civitai-Update-Bot „AnimeMixV2 updated“ — 2024-05-09, SD1.5-basiert, 2 Likes. Diese zwei Beiträge sind die jüngsten derzeit auffindbaren Posts des Bots; seit Mai 2024 sind die automatischen Updates auf Bluesky faktisch eingestellt.
    https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nn7lydr2y
  9. Aktuelle Open-Weight-Tools in Profilen einzelner Kreativer — @you32081.bsky.social nennt Qwen-Image und Z-Image-Turbo, @andyt79.bsky.social LTX-2 und Qwen Image, @generate-cmyxt.bsky.social erklärt Workflows mit ComfyUI + Qwen Image Edit + Wan Video + BindWeave. Die Resonanz einzelner Beiträge wurde nicht geprüft, doch es ließ sich bestätigen, welche Open-Weight-Modelle Einzelpersonen auf Bluesky 2026 tatsächlich nutzen.
  10. Offizieller Black-Forest-Labs-Account ohne Beiträge — Der offizielle Bluesky-Account des Entwicklers der FLUX-Reihe, die bei Open-Weight-Bildgenerierung zu den führenden zählt, hat nie einen Beitrag veröffentlicht. Informationen aus der Open-Source-Spitze konzentrieren sich vermutlich auf andere Orte wie X, GitHub und Discord.
    https://bsky.app/profile/blackforestlabs.bsky.social
Signale
  • Die Closed-Source-Kommunikation auf Bluesky ist extrem dünn. Für OpenAI, Google DeepMind, Adobe Firefly, Runway, Kling AI und Ideogram gibt es, soweit geprüft, keine praktisch aktiven offiziellen Primäraccounts – nur Mirrors, Bots oder leere Accounts. Selbst der einzig regelmäßig postende offizielle Midjourney-Account hat seit Oktober 2025, also seit etwa einem Jahr, nichts mehr veröffentlicht.
  • Auch die offizielle Open-Source-Kommunikation stagniert. Der offizielle Stability-AI-Account erhielt selbst auf eine große Partnerschaftsmeldung mit Warner Music Group nur einen Like. Die offiziellen Accounts von Black Forest Labs und ComfyUI haben keine Beiträge. Der Civitai-Update-Bot ist seit Mai 2024 inaktiv.
  • Die tatsächliche Themenlage wird in Bios und Beiträgen einzelner Kreativer sichtbar. Modellnamen wie Qwen-Image, Qwen-Image-Edit, Z-Image-Turbo, Wan Video/WanAnimate, LTX-2 und BindWeave erscheinen in mehreren Profilen als konkret verwendete Tools. Das ist weniger ein als News berichtetes Thema als ein Beleg dafür, dass einzelne Menschen die Tools still und kontinuierlich nutzen.
  • Insgesamt ist Bluesky kein Ort für Primärkommunikation der KI-Bild- und Videogenerierungsbranche wie X (ehemals Twitter). Unternehmensaccounts haben nur minimale Präsenz. Aktiv sind vor allem persönliche KI-Kunst-Communities, die Werke und Prompts etwa über #QP teilen, sowie japanischsprachige KI-Illustrations- und Civitai-nahe Fan-Communities.
Einschränkungen
  • Die offizielle Bluesky-Volltextsuch-API (app.bsky.feed.searchPosts) lieferte über WebFetch in dieser Sitzung durchgehend HTTP 403 Forbidden und konnte nicht genutzt werden. Deshalb waren Volltextsuchen und Mengenanalysen nach Stichwörtern wie „Stable Diffusion“ oder „Midjourney“ nicht möglich. Stattdessen wurde über app.bsky.actor.searchActors nach Accounts und über app.bsky.feed.getAuthorFeed nach den Beitragsverläufen einzelner Accounts recherchiert. Eine umfassende Sammlung von 20 Beiträgen nach Hashtags oder Themen wurde daher nicht durchgeführt.
  • Während der Recherche lieferte WebFetch einmal eine zusammenfassende Darstellung mit Feldern wie data.sample_accounts, die nicht Teil der tatsächlichen API-Antwort waren, wenn nicht ausdrücklich um Roh-JSON ohne Zusammenfassung gebeten wurde. Danach wurde jedes Mal ausdrücklich „verbatim, no summarization“ verlangt und Roh-JSON erneut abgerufen; die Ergebnisse dieses einen Durchlaufs wurden in diesem Bericht nicht verwendet.
  • Für Runway, Luma AI, Pika, Hailuo, Ideogram, Leonardo AI, Adobe Firefly, OpenAI (DALL-E/Sora) und Google DeepMind (Veo/Nano Banana) konnte über die Accountsuche kein offizieller Primäraccount identifiziert werden. Treffer waren inoffizielle Mirrors, Botschafter oder irrelevante Accounts. Als Ergebnis wird deshalb berichtet, dass auf Bluesky fast keine Primärkommunikation stattfindet.
  • getAuthorFeed rief pro Account maximal 20 Beiträge ab; Paging wurde nicht genutzt. Dass innerhalb dieses Ausschnitts keine großen Modellankündigungen wie eine neue FLUX- oder Stable-Diffusion-Version erschienen, bedeutet nicht zwingend, dass sie auf Bluesky überhaupt nicht existieren.

Lemmy

Lemmy — Aktuelle Entwicklungen bei KI-Bild- und Videogenerierung

Communities
  • !«メールアドレス» — 1.230 lokale Abonnenten / 5.710 im Fediverse insgesamt. Mit 3 täglich, 20 wöchentlich und 67 monatlich aktiven Nutzern recht klein, aber Bots posten automatisch neue Modelle, LoRAs und Tools von Hugging Face/GitHub. Damit ist die Community die dichteste Primärquelle für Open-Source-Bild- und Videogenerierung.
  • !«メールアドレス» — Community zum Teilen von Werken auf derselben Instanz. Statt News gibt es vor allem mehrere tägliche SDXL-/Flux-Kunstbeiträge; für Trendanalysen wenig geeignet.
  • !«メールアドレス» — Mit 8.531 Abonnenten eine der größten KI-Bild-Communities auf Lemmy, aber viele Beiträge haben negative Scores und sowohl Aufrufe als auch Diskussionen sind gering.
  • !«メールアドレス» — Allgemeine Tech-News-Community. Closed-Source-Themen wie Berichte über Midjourneys Klage erscheinen hier.
  • !ai_reddit — Crosspost-Community auf Lemmy für Beiträge aus r/ArtificialIntelligence. Nachrichten wie die Einstellung der Sora-API wurden über diesen Weg gefunden.
  • !«メールアドレス» — Ankündigungscommunity für AI Horde, einen dezentralen kostenlosen Stable-Diffusion-Generierungsdienst; ein typisch offenes, föderiertes Thema.
Beiträge
  1. Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing — !«メールアドレス», 2026-09-22, Score 13
    https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
    Alibabas Qwen-Image-2.1 wird offiziell von ComfyUI unterstützt. Vorgestellt als Open-Weight-Modell mit Bearbeitungsfunktionen und Transparenzausgabe.

  2. Kijai/QwenImage_experimental — Qwen Image 2.1 Fun_controlnet_union — !«メールアドレス», 2026-09-26, Score 1
    https://huggingface.co/Kijai/QwenImage_experimental/tree/main/model_patches
    ControlNet-Integrationspatch eines bekannten Entwicklers, Kijai, für Qwen-Image-2.1.

  3. PrunaAI/Pruna-Qwen-Image-2.1 — Few-step LoRA adapters — !«メールアドレス», 2026-09-26, Score 1
    https://huggingface.co/PrunaAI/Pruna-Qwen-Image-2.1
    Beschleunigungs-LoRAs, die die Zahl der Generierungsschritte von Qwen-Image-2.1 reduzieren.

  4. Cierpliwy/krea2-inpaint-edit — LoRAs for Krea-2-Raw und lvladikov/Krea2-Turbo-Distill-2step-LoRA — !«メールアドレス», 2026-09-26 / 2026-09-13–16, Score 0–2
    https://huggingface.co/Cierpliwy/krea2-inpaint-edit ・ https://huggingface.co/lvladikov/Krea2-Turbo-Distill-2step-LoRA
    Kurz nacheinander erschienen ein Inpainting-Bearbeitungs-LoRA und ein auf zwei Schritte destilliertes Beschleunigungs-LoRA für das „Krea 2“-Modell aus dem Umfeld von Black Forest Labs.

  5. SupraLabs/Supra2-IMG — tiny 100M parameters text-to-image model — !«メールアドレス», 2026-09-22, Score 8
    https://huggingface.co/SupraLabs/Supra2-IMG
    Ein extrem leichtes Text-zu-Bild-Modell mit nur 100 Millionen Parametern. Ein Beispiel für den Trend zu lokalen Anwendungen auf schwächerer Hardware.

  6. Rascher Anstieg von MiniMax-H3-Tools (ComfyUI-Fizgig-H3-Tweaks / ComfyUI_MinimaxH3_AutoContext / 3d-Camera-control-H3-Minimax / MiniMax-H3-Image-Training-Adapter / TaoMate-H3-3Step-ComfyUI) — !«メールアドレス», 2026-09-12–09-26, Score 1–5
    Beispiel: https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext (für lange Videogenerierung) ・ https://github.com/NyckM/3d-Camera-control-H3-Minimax (3D-Kamerasteuerung)
    Rund um das Open-Weight-Videomodell „MiniMax H3“ wurden in zwei Wochen mehr als fünf Erweiterungsknoten für ComfyUI veröffentlicht; das Ökosystem wird schnell ausgebaut.

  7. g3n3rativ3/wan2gp-h3-latent-continue — !«メールアドレス», 2026-09-16, Score 1
    https://github.com/g3n3rativ3/wan2gp-h3-latent-continue
    Ergänzt die Alibaba-nahe Videogenerierungs-GUI „Wan2GP“ um eine Funktion, um Videos aus einem Latent weiterzuerzeugen.

  8. The AI Horde has a new Interface, a new Image generation frontend, new backend, and all new documentation! — !«メールアドレス» / !aihorde, 2026-09-19, Score 8 / -2
    https://haidra.net/an-image-generation-studio-and-documentation-on-aihorde-net/
    Der dezentrale Dienst „AI Horde“, über den alle Rechenressourcen bereitstellen und kostenlos Bilder der Stable-Diffusion-Familie erzeugen können, erneuert Frontend, Backend und Dokumentation.

  9. OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !ai_reddit, 2026-09-20, Score 1
    https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/openai-is-shutting_down-soras-api-next-week-while/
    Beitrag darüber, dass OpenAIs Videogenerierungs-KI Sora ihre API einstellt, während ein chinesischer Wettbewerber 3 Milliarden US-Dollar eingesammelt hat. Dies zeigt die sich verschiebenden Kräfteverhältnisse in der Closed-Source-Videogenerierung.

  10. OpenAI's Identity Crisis (The Atlantic) — !theatlantic, 2026-03-26, Score 2
    https://www.theatlantic.com/technology/2026/03/sora-openai-identity-crisis/686544/
    Kritisiert im Zusammenhang mit dem Ende von Sora OpenAIs orientierungslose Abfolge von Funktions- und Geschäftsmodellwechseln auf der Suche nach Monetarisierung. Hohe Rechenkosten werden als Hauptgrund für den Rückzug analysiert.

  11. Midjourney Wants Hollywood Studios to Reveal AI Usage Details (TechCrunch) — !«メールアドレス», 2026-07-05, Score 73
    https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/
    Im Urheberrechtsprozess gegen Disney, Universal und Warner Bros. fordert Midjourney von Studios eine vollständige Offenlegung ihrer KI-Nutzung, einschließlich internen KI-Trainings und Prompt-Nutzung. Der Urheberrechtskonflikt großer Closed-Source-Akteure verschärft sich.

Signale
  • Die Themen rund um Open-Source-KI-Bild- und Videogenerierung konzentrieren sich auf Lemmy fast vollständig in !«メールアドレス». Viele Beiträge sind keine menschlichen Diskussionen, sondern automatisch weitergeleitete Release-Posts von Hugging Face und GitHub, meist ohne Kommentare – eher ein Release-Feed als Nachrichten.
  • Allein in den vergangenen zwei Wochen (2026-09-12–09-26) wurden vier unabhängige Open-Weight-Reihen – Qwen-Image-2.1, Krea 2, MiniMax H3 und Wan2GP – gleichzeitig mit zugehörigen Tools wie LoRAs, ComfyUI-Knoten und Beschleunigungsadaptern aktualisiert. Die Entwicklungsgeschwindigkeit der Open-Source-Seite übersteigt das Closed-Source-Gesprächsvolumen.
  • Closed-Source-Themen erscheinen auf Lemmy weniger in technischen Communities und eher im Kontext von Nachrichten, Klagen und Unternehmensfragen – Sora-API-Ende, Midjourney-gegen-Hollywood-Prozess. Bewertungen der generierten Inhalte selbst finden nahezu nicht statt.
  • Scores und Kommentarzahlen liegen bei fast allen Beiträgen im ein- bis niedrigen zweistelligen Bereich; im Vergleich zu Reddit und X ist die Diskussionsintensität auf Lemmy allgemein gering.
Einschränkungen
  • Lemmy hat nur wenige Nutzende und Beiträge; genug unabhängige Diskussionen für die geforderten etwa 20 Beiträge pro Plattform wurden nicht gefunden. Tatsächlich wurden mehr als 20 Posts geprüft, aber viele waren Release-Bots ohne Kommentare und keine lebhafte Unterhaltung.
  • Zu aktuellen Closed-Source-Modellen wie „Nano Banana“, „Midjourney v7“, „Gemini-Bildgenerierung“ oder „Flux 2“ wurden bei Lemmy-Suchen und in verwandten Communities keine speziellen Beiträge gefunden; Suchergebnisse gingen in allgemeinen Tech-Artikeln oder irrelevanten Posts unter.
  • Es gab auch Beiträge über Alibabas Open-Source-Videomodell „Wan 2.1“ und die problematisierte Nutzung für KI-Pornografie, doch diese Beiträge und Artikel stammen aus März 2025 und wurden wegen des Fokus auf aktuelle Entwicklungen im September 2026 nicht aufgenommen.
  • Die lemmy.world-Such-API lieferte bei mehreren Abfragen 500-Fehler, etwa beim direkten Abruf der stablediffusion-Community oder beim erneuten Abruf einzelner Beiträge; manche Seiten konnten daher nicht geladen werden.

Pinterest

Pinterest — News zur KI-Bild- und Videogenerierung

30 der 50 gesammelten Pins wurden geöffnet und als Bilder gelesen (die Tabelle in
output/pinterest.pins.md ist eine flache Liste und nicht nach Genres getrennt,
daher handelt es sich um einen einzigen Durchlauf statt um genreweise Auswertung).

Visuelle Themen
  • Zusammenfassungen im Stil von YouTube-Thumbnails mit „AI NEWS“, erneut auf Pinterest gepostet. Ein Gesicht mit schockiertem/überraschtem Ausdruck neben einer Reihe leuchtender Anbieterlogos – OpenAI, Google, Microsoft, Anthropic-Wirbel, Metas Unendlichkeitszeichen, Notions N. [1, 20]
  • Dichte Infografiken nach dem Muster „X Updates you need to know“. Mehrteilige Karten bündeln mehrere Geschichten: GPT-6 Astra, Gemini wird in Gmail/Docs/Slides „agentisch“, Adobes Premiere erhält generatives Video/Sound direkt in der Timeline, Cognitions Series E über 2 Milliarden US-Dollar; eine weitere Karte zu Google I/O 2026 behandelt Gemini 3.5 Flash, Gemini Omni, AI Overviews als Suchersatz und Android-XR-Brillen. [22, 35]
  • Listenartikel „Top N AI video generator“, immer mit derselben Tool-Auswahl – Kling AI, Runway, Pika, Luma Dream Machine, HeyGen, Hailuo AI, Google Veo, OpenAI Sora, Synthesia, D-ID – als Smartphone- oder Poster-Grafiken für SEO-/Affiliate-Blogs gestaltet. [27, 47, 49]
  • Hero-Art mit humanoiden Robotern als allgemeine Dekoration für Tool-Werbe-Pins: verchromte Roboterhände, die ein OpenAI-Logo halten, ein Android aus orangefarbenem Glas auf einem Monitor, eine Cyborg-Frau halb Mensch, halb Schaltkreis. [16, 21, 41]
  • Angstbilder zu Deepfakes und Desinformation: ein NBC-News-artiger Clip mit „AI GENERATED“-Label eines gefälschten Reporters im Schnee, ein Splitscreen „Human Journalism vs. Machine-Generated Media“, ein mit „FAKE“ beschrifteter Roboter neben einem KI-Katzenfoto mit erfundenen Engagement-Zahlen, ein als „AI“ beschrifteter Dämon, der handysüchtige Zombies als Puppen führt, sowie ein synthetisches Bild von Trump mit Daumen hoch im Cockpit vor einem 9/11-Bild. [4, 19, 26, 30, 44]
  • Technikdemos zur Stil-Konsistenz: Ein Video wird fünfmal neu gerendert – als Holzklötze, Origami, Lego-Steine und blumenbedeckte Versionen derselben Person und desselben Autos –, mit Wasserzeichen eines Videomodells. Es demonstriert die Umwandlung eines Quellclips in mehrere Stile. [2]
  • Werbung für KI-Video-Dienstleistungen kleiner Unternehmen: WhatsApp-Kontaktgrafiken von Freelancern und Agenturen, die „AI Video Generation from Gemini“ oder „Professional AI Video Creation“ anbieten. Sie nutzen den Trend, statt über ihn zu berichten. [9, 24, 37]
  • Generische Corporate-Stockfotografie ohne eigentlichen KI-Inhalt trotz KI-naher Titel: ein Büroteam am Laptop, ein Vater mit Sohn in einer leuchtenden Erinnerungswand, ein Werbeporträt eines alten Fischers für „Amuse 3.0“ (AMDs lokalen Bildgenerator, nur an einem kleinen Logo erkennbar). [13, 28, 40, 45]
Bemerkenswerte Pins
  • [1] „AI News: Anthropic Leak Shows Us The Future of AI...“ — generisches Presenter-Thumbnail, das OpenAI, Google, Microsoft und Anthropic bündelt; der Titel verspricht einen Anthropic-Leak, das Bild selbst liefert aber keine Einzelheiten.
  • [2] „Just Nail It 🎥“ — ein 3×5-Raster verwandelt ein Quellvideo einer Person und eines Autos in Holzklotz-, Origami-, Lego- und Blumenstile, mit Wasserzeichen eines Videomodells namens „Lumiere“; die deutlichste echte Produktdemo im Datensatz.
  • [10] „Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API“ — Closed Source von Google, vermarktet Geschwindigkeit und natives Audio als Unterscheidungsmerkmale.
  • [14] „Kling.ai AI-Powered Text-to-Video Generation“ — chinesisches Closed-Source-Tool von Kuaishou, als „Top Pick“ neben westlichen Tools dargestellt.
  • [15] „ByteDance and Hollywood reach global deal on AI copyright“ — Vereinbarung zwischen ByteDance und MPA, den Schutz geistigen Eigentums in ByteDances KI-Bild-/Video-Tools zu stärken; eine der wenigen Rechts- und Policy-Geschichten im Datensatz.
  • [23] „Google's Gemini Omni Turns Anything Into Video“ — Repost einer Agentur, Osiz Technologies, zu Googles Ankündigung des Omni-Modells.
  • [30] „AI news videos blur line between real and fake reports“ — ein mit NBC News gelabelter „AI GENERATED“-Clip mit einem erfundenen Reporter im Schnee, der das Vertrauensproblem direkt illustriert.
  • [34] „Google Makes AI Watermarks Optional for Images and...“ — die Überschrift deutet an, dass Google SynthID-/Wasserzeichenanforderungen lockert.
  • [35] „4 Major AI Updates You Need to Know in 2026“ — Infografik zu GPT-6 Astra, Geminis agentischem Vorstoß, generativen Medien in der Adobe-Premiere-Timeline und Cognitions Finanzierung über 2 Milliarden US-Dollar bei 48 Milliarden US-Dollar Bewertung.
  • [43] „Stability AI's Stable Diffusions Maker Can Now Build AI Generative Video“ — der einzige Pin, der eine Open-Weight-Linie, konkret Stability AI, ausdrücklich für Video nennt.
Signale
  • Was aktuell ist: Das Angebot auf Pinterest zu diesem Thema wird von sekundärer Aggregation dominiert – News-Zusammenfassungen im Stil von YouTube-Thumbnails, Affiliate-Listen mit denselben rund zwölf Videotools und erklärenden Infografiken – und nicht von Primärankündigungen oder praktischen Generierungen. Chinesische Closed-Source-Tools wie Kling und Hailuo stehen in allen geprüften Listen gleichberechtigt neben westlichen Tools wie Veo, Sora und Runway. Deepfake- und Desinformationssorgen bilden ein eigenständiges wiederkehrendes visuelles Genre; gefälschte Nachrichtensprecher, erfundene politische Bilder und „Mensch gegen Maschine“-Journalismusgrafiken sind offenbar ein stärkerer emotionaler Engagement-Hook als die Tools selbst.
  • Was fehlt: Trotz Pinterests üblicher Stärke als Moodboard- und Kreativplattform zeigten keine Pins tatsächliche Open-Source-Workflows – keine ComfyUI-Screenshots, keine LoRA-/Fine-Tuning-Inhalte, keine Verbindung zu Flux, SDXL, HunyuanVideo oder Wan und keine ästhetischen Boards aus der Künstler-Community. Nur ein Pin ([43]) nannte überhaupt eine Open-Source-Linie, und zwar nur die Marke Stability AI, nicht Modell oder Technik. Anthropic wird zwar in einem Titel [1] erwähnt, eigene Bild-/Videoarbeit des Unternehmens erscheint jedoch nicht. Werbung kleiner Unternehmen und Freelancer für „KI-Videodienste“ kommt häufiger vor als echte Produktnachrichten.
Einschränkungen
  • Es wurden 30 von 50 Pins gelesen (60 %); die restlichen 20 wurden wegen Zeitmangels nicht geöffnet, sodass bemerkenswerte Pins unterrepräsentiert sein können.
  • Die Pin-Tabelle enthält keine Genreabschnitte, sondern eine flache Liste unter einer einzigen Suche; die Zusammenfassung konnte daher nicht wie im Playbook für Mehrgenre-Durchläufe erlaubt nach Genres gegliedert werden.
  • 12 der 50 Pins haben keinen Titel („(untitled)“). Mehrere entpuppten sich als generische Stockfotografie mit nur beiläufigem oder gar keinem KI-Bezug, was die Aussagekraft eines reinen Titelindex einschränkt.
  • Die Titel neigen zu fehlerhaftem Englisch und SEO-/Affiliate-Blogspam wie „AI For Image And video Generation“ oder „AI black GPT“. Das entspricht den Bildern, aber mehrere „bemerkenswerte“ Titel versprechen mehr Spezifität, als der verlinkte Pin tatsächlich liefert.

Empfohlene Maßnahmen

  • Die X-Sammelphase mit expliziten Keywords wie Midjourney, Sora 2 und Stable Diffusion statt mit Trendbegriffen erneut ausführen
  • Open-Weight-Reihen wie Qwen-Image-2.1 und LTX-2.5, deren Ökosystem unmittelbar nach dem Release rasch wächst, vorrangig beobachten
  • Fälle weiterverfolgen, in denen nicht offengelegte Nutzung KI-generierter Inhalte zu Kündigungen, Klagen oder Regulierung führt
  • Die Kräfteverhältnisse von Veo, Kling, Runway und Grok Imagine nach Soras Rückzug regelmäßig beobachten
  • Bluesky auf Profile einzelner Kreativer fokussieren, da offizielle Unternehmenskommunikation dort fast nicht funktioniert

Gesammelte Bilder

KI-News: Anthropic-Leak zeigt uns die Zukunft der KI...Google kündigt Video in ultrahoher Qualität an...Genau getroffen 🎥Bedenken zu KI-Inhalten und sozialen MedienVerwandle deine Ideen in beeindruckende Visuals! 🎥KI-Chip auf einer Leiterplatte, 4K-VideoKI-generierte Videos für Content-MarketingKI für Bild- und VideogenerierungKI-Tool zur Umwandlung von Text in BilderVeo 3 Bild-zu-Video: Schnelle Generierung & natives Audio über Gemini APIKI-BildgenerierungKonzept für KI-Content-Erstellung mit Symbolen für Text-, Bild-, Musik- und Videogenerierung, Bilder künstlicher Intelligenz – 57 Stockfotos, Vektoren und Videos durchsuchenBildKling.ai KI-gestützte Text-zu-Video-GenerierungBildBildBildKINew Yorks mutiger Vorstoß: Einblick in die Gesetzgebung...‎🚨 KI wird beängstigend gut.BildBildGoogles Gemini Omni verwandelt alles in VideoProfessionelle KI-Videoerstellung | Cinematische KI-Videos | Individuelle VideobearbeitungKI-News: OpenAI hat endlich veröffentlicht, worum wir gebeten habenBildTop-KI-Videogeneratoren 2025BildBildKI-News-Videos verwischen die Grenze zwischen echten und gefälschten BerichtenKI-Bildgenerierung und die UnterhaltungsindustrieBildGenerative KI erklärt: Ein vollständiger Leitfaden für Einsteiger (2026)Google macht KI-Wasserzeichen für Bilder optional und...4 wichtige KI-Updates, die du 2026 kennen musstVorstellung von Luma Dream Machine – KI-Video der nächsten GenerationBildKI-News & aktuelle Updates | Trends und Durchbrüche der künstlichen IntelligenzKI-generierte Videos: Gut oder schlecht? Hier ist die Wahrheit! 🤖🎥Als KI Menschen ihre eigenen Erinnerungen neu erleben ließKIVideo und KI meistern: Wichtige Social-Media-Marketingtrends 2025Der Hersteller von Stability AIs Stable Diffusion kann jetzt generatives KI-Video erstellen„Warum KI-Chatbots bei Eilmeldungen nicht mithalten können“Schwarze KI GPTMit dem Verkauf von KI-Fotos und -Videos online Geld verdienen22 beste und kostenlose KI-Videogeneratoren 2026 🎬🤖 | Erstelle fantastische Videos mit KIBild12 beste KI-Videogeneratoren 2026 (kostenlos & kostenpflichtig) | Google Veo, Sora, Runway & mehrElon Musks neue KI wird bereits zur Generierung von ... verwendet

Anmerkung zur Datenqualität

X lieferte nur irrelevante Beiträge über Trendbegriffe und damit praktisch keine themenbezogenen Daten. Auch Reddit, YouTube, Bluesky und Pinterest erreichten nicht das Abschlussziel von rund 20 Beiträgen; YouTube und Bluesky mussten ihre Sammelmethode wegen technischer Einschränkungen ändern (WebFetch-Blockade beziehungsweise Such-API 403).

Galerie