KEN’S CAT LOG

KI-News zur Bild- und Videogenerierung — 2026-09-22

Soras API-Abschaltung am 2026-09-24 ist die prägende Closed-Source-Geschichte des Augenblicks, während MiniMax H3 und chinesische Open-Weight-Labore (Alibaba/Qwen, ByteDance, Baidu, Tencent) das am schnellsten wachsende Open-Source-Ökosystem rund um ComfyUI vorantreiben.

KI-News zur Bild- und Videogenerierung — 2026-09-22

Das größte Closed-Source-Thema ist die vollständige Einstellung der Videoerzeugungs-API von OpenAI Sora am 2026-09-24 (zwei Tage nach diesem Bericht) — die App wurde bereits im April eingestellt. Hintergrund ist eine verschlechterte Wirtschaftlichkeit: Betriebskosten von etwa 1 Mio. US-Dollar pro Tag bei kumulierten Umsätzen von rund 2,1 Mio. US-Dollar. Gleichzeitig liefern sich GPT Image 2.5 und Google DeepMinds Nano Banana Pro/2 einen Wettbewerb bei Geschwindigkeit und Fotorealismus; der Entwicklungswettlauf der Closed-Source-Anbieter verschärft sich mit Updates im Abstand weniger Wochen. Auf Open-Source-Seite wächst das ComfyUI-Ökosystem rund um MiniMax H3 weiter, während neue Modelle chinesischer Labore wie Alibaba (Qwen), ByteDance, Baidu und Tencent besonders auffallen. Auf mehreren Plattformen wird zudem berichtet, dass sich der wahrgenommene Qualitätsabstand zwischen Closed und Open Source verringert.

Plattformübergreifend

  • Die Sora-API-Einstellung (2026-09-24) ist das größte gemeinsame Closed-Source-Thema. Der Bluesky-Post von Ed Zitron (3.572 Likes, das höchste Engagement der gesamten Erhebung) meldete die Nachricht zuerst; auch ein YouTube-Rückblick zum Stand von KI-Video und ein !ai_reddit-Beitrag auf Lemmy greifen sie auf. Drei Plattformen bewerten den Vorgang unabhängig als besonders wichtig und behandeln die schlechtere Kosten-Umsatz-Bilanz als Beispiel dafür, dass Closed Source nicht zwangsläufig ein Winner-takes-all-Geschäft ist.
  • MiniMax H3 ist das gemeinsame Stichwort für Open-Source-Videogenerierung. Auf Reddit werden konkrete kostenlose Einsatzmöglichkeiten von Wan und MiniMax H3 besprochen; Adina Yakup auf Bluesky stellt die schnelle, in acht Schritten destillierte MiniMax-H3-Variante „HyperFlow“ vor. Auf Lemmy wurden von August bis September 2026 mehr als fünf MiniMax-H3-bezogene Nodes für ComfyUI veröffentlicht. Der Modellname taucht unabhängig auf drei Plattformen auf und kann als das derzeit dynamischste Open-Weight-Videomodell gelten.
  • GPT Image 2.5 wird auf drei Plattformen als führendes Closed-Source-Bildmodell erwähnt. Auf Reddit (r/ImagineAiArt, Thread mit 92 Punkten) finden sich sowohl begeisterte Reaktionen als auch die Einschätzung, es gebe keinen spürbaren Unterschied zu KREA2. YouTube erklärt 50 % geringere Generierungslatenz und die Sketch-Funktion; Simon Willison auf Bluesky erzeugt damit selbst Konzeptbilder.
  • Chinesische Labore sind auf Open-Source-Seite besonders präsent. Alibaba (Qwen-Image-2.1), ByteDance (Lance, Seedance), Baidu (ERNIE-Image) und Tencent (HunyuanVideo 1.5) werden auf Bluesky, YouTube und Lemmy wiederholt erwähnt. Mehrere Plattformen bestätigen damit das Bild, dass chinesische Unternehmen die Open-Weight-Bewegung mit Apache-2.0-ähnlichen Lizenzen maßgeblich prägen.
  • ComfyUI ist de facto die gemeinsame Grundlage. Fast alle YouTube-Reviewvideos und der Großteil der Beiträge in !«メールアドレス» nennen Implementierungen oder Workflows in ComfyUI. Der praktische Einsatz von Open-Source-Tools konzentriert sich zunehmend darauf.
  • Der wahrgenommene Qualitätsabstand zwischen Closed und Open Source schrumpft. Auf Reddit heißt es, GPT Image 2.5 und KREA2 erzeugten im Ergebnis dasselbe. Pinterest wiederum wird stark von Closed-Source-Marketing dominiert, während Open Source fast gar nicht erwähnt wird — was eher auf geringere Sichtbarkeit gegenüber Endverbrauchern als auf technische Schwäche hindeuten könnte.

Plattform für Plattform

Reddit: Es wurden 12 Threads aus sieben Subreddits erfasst. Die Nachfrage nach kostenloser KI-Videogenerierung und die abweisende Haltung „Begreift endlich, dass das nicht funktioniert“ bilden die zentrale Spannung. Hinweise auf Open-Weight-Modelle wie Wan und MiniMax H3 entstehen dabei häufig organisch. Der starke Zuwachs bei DeepSeek-Nutzern (+66,7 %) bei gleichzeitigem Mangel an Rechenleistung ist ebenfalls ein klares Signal. In mehreren Threads tauchen Werbekommentare mit demselben Empfehlungscode auf; bei scheinbar organischen Diskussionen ist daher Vorsicht geboten.

X: Unter den 32 erfassten Posts von 31 Accounts erwähnte kein einziger Bild- oder Videogenerierungs-KI. Die verwendeten Suchbegriffe (Bitcoin, Zelensky, Zagreb usw.) übernahmen offenbar lediglich die Standard-Explore-Trends von X, vermutlich regionale Trends rund um Kroatien, und waren thematisch irrelevant. Für X liegen zu diesem Thema keine substanziellen Erkenntnisse vor.

YouTube: Über WebSearch wurden mehr als 30 Titel gefunden; 13 repräsentative Videos wurden aufgenommen. Auf Closed-Source-Seite ist der Dreifachvergleich GPT Image 2.5, Nano Banana Pro/2, Sora 2, Veo 3.1 und Kling 3.0 ein verbreitetes Format. Bei Open Source setzt sich der Trend zu kompakteren Modellen ohne Qualitätsverlust fort, etwa Z-Image Turbo, Qwen-Image-2.1, LTX-2 und HunyuanVideo 1.5. Da die Seiten per JavaScript gerendert werden, konnten Aufrufzahlen und exakte Daten nicht abgerufen werden und sind nur Näherungswerte.

Bluesky: Da die Such-API (searchPosts) dauerhaft mit 403 nicht verfügbar war, wurde stattdessen direkt aus Feeds relevanter Accounts gelesen. Ed Zitrons Sora-Beitrag erzielte das größte Engagement. Open-Source-Eilmeldungen hängen fast vollständig an Hugging-Face-Mitarbeiterin Adina Yakup; die offiziellen Accounts von Civitai, ComfyUI und Stability AI waren überwiegend still oder inaktiv.

Lemmy: Acht Communities und 16 Beiträge wurden analysiert. Closed-Source-Nachrichten sind fast immer indirekte Übernahmen aus Reddit (!ai_reddit) oder Hacker News (!hackernews) und erzielen geringe Scores. Nur die Nachricht über Midjourneys Wechsel von Bildgenerierung zu medizinischen Ultraschall-CT-Scannern wurde viral (Score 40). Auf Open-Source-Seite erschienen von August bis September fortlaufend ComfyUI-Nodes für MiniMax H3.

Pinterest: 50 Pins wurden analysiert. Den Großteil bilden Listicle-Grafiken wie „Best AI Video Generator“ und generische KI-Roboterbilder. Kling AI und Hailuo AI sind neben Runway, Pika und Luma in die Spitzengruppe aufgerückt. Open Source wird faktisch in keinem der 50 Pins erwähnt; nur einmal erscheint die Überschrift „Open Models. Open weights.“ — ein wichtiger Befund dafür, dass Open Source auf verbraucherorientierten Plattformen nahezu unsichtbar ist.

Von den sechs im Briefing genannten Plattformen erfüllen X (praktisch 0 relevante Beiträge wegen falscher Suchbegriffe) und Reddit (12 statt der angestrebten 20 Threads) das Abschlusskriterium „Analyse von etwa 20 Beiträgen“ nicht. Diese Lücken werden ausdrücklich benannt; fehlende Plattformen, die nicht im Briefing genannt wurden, liegen außerhalb des Umfangs.

Worauf achten

Empfehlungen

  • Beim nächsten Research verfolgen, wohin der Migrationsverkehr nach der Sora-API-Einstellung fließt: Seedance 2.5, MiniMax H3 oder Kling v3.
  • Weiter beobachten, ob sich die Lizenzpolitik von Qwen-Image-2.1 verändert, insbesondere offizielle Mitteilungen von Hugging Face und Alibaba.
  • Die Häufigkeit von ComfyUI-Node-Beiträgen zu MiniMax H3 als Frühindikator für die Dynamik von Open-Source-Videogenerierung beobachten.
  • Bei der nächsten X-Erhebung nicht mehr auf regionale Trends setzen, sondern themenspezifische Begriffe wie "AI image generation", "Sora" und "Midjourney" verwenden.
  • Die Reddit-Erhebung von einer einzelnen Suche auf mehrere Suchen nach einzelnen Modellnamen umstellen, um das Ziel von 20 Beiträgen zu erreichen.
  • Midjourneys Wechsel zu medizinischem Ultraschall-CT anhand der Primärquelle (midjourney.com/medical) prüfen und von viralen Sekundärinformationen trennen.

Datenqualität

Bei X führten falsch gewählte Suchbegriffe dazu, dass unter 32 erfassten Beiträgen kein einziger themenrelevant war; damit lieferte X keine substanziellen Erkenntnisse. Reddit blieb wegen nur eines Suchbegriffs bei 12 Threads und verfehlte das Ziel von etwa 20. Da die offizielle Bluesky-Such-API dauerhaft 403 zurückgab, wurde auf Account-Feed-Stichproben ausgewichen, nicht auf eine umfassende Keyword-Suche. YouTube-Seiten werden per JavaScript gerendert, weshalb Aufrufzahlen und exakte Veröffentlichungstermine nicht abgerufen werden konnten; Datumsangaben sind Näherungswerte. Aufgrund verteilter Instanzen lässt Lemmy keine instanzübergreifende Suche zu; die Prüfung beschränkte sich auf sechs große Instanzen. Pinterest erlaubte zwar die Analyse von 50 Pins, enthält aber nahezu keine Open-Source-Erwähnungen und ist deshalb stark auf die Closed-Source-Perspektive verzerrt.

Zusammenfassung nach Plattform

Reddit

Reddit — KI-News zur Bild- und Videogenerierung

Wo

Die 12 erfassten Threads stammen aus sieben Subreddits.

Subreddit Mitglieder Erfasste Threads
r/generativeAI 155.851 5
r/ImagineAiArt 19.415 1
r/aivideomaking 7.414 2
r/DeepSeek 140.403 1
r/Purdue 100.714 1
r/aivideos 123.539 1
r/Instagramreality 1.155.229 1

r/generativeAI stellt den größten Anteil; im Zentrum steht dort die Nachfrage „Ich möchte kostenlos KI-Videos erzeugen“. Spezialisierte Communities (r/aivideomaking, r/aivideos, r/ImagineAiArt) diskutieren konkrete Tools und Technik. r/DeepSeek behandelt Modellnachrichten, während r/Purdue und r/Instagramreality — eine riesige Community mit über 1,15 Millionen Mitgliedern — Fälle zeigen, in denen KI-Erzeugnisse in reale Umgebungen gelangten und Kontroversen auslösten.

Was die Leute sagen
  • Die Nachfrage nach kostenloser KI-Videogenerierung bleibt hoch, doch die Community-Stimmung kippt in Richtung „Begreift endlich, dass das nicht geht“. Im Thread #2 „Why do so many people expect to find a free AI video generator?“ (39 Punkte, 79 Kommentare, 2026-09-21, https://www.reddit.com/r/generativeAI/comments/1wm2csy/) schreibt der Autor selbst, Sora 2 sei kostenlos veröffentlicht worden und habe viele Nutzer angezogen, sei am Ende aber von OpenAI eingestellt worden. Als Fazit heißt es: "AI video generation is just expensive, and free is not a sustainable model".
  • Im selben Thread erklärt u/buttchuckjones (4 Punkte), er generiere nach einer 10-GB-VRAM-Karte nun lokal auf einer 5080 (16 GB), und wünscht sich: "I very much wish that people on this subreddit would be more inclined to do local generation". Das stärkt die lokale/Open-Source-Position.
  • In Thread #1 „Which AI video generator can still be used for free?“ (20 Punkte, 68 Kommentare, 2026-09-16, https://www.reddit.com/r/generativeAI/comments/1whtesl/) empfiehlt u/RioMetal (4 Punkte) Open-Weight-Modelle: "If you can go local you have plenty of them, like Wan or Minimax". u/tuckken2 (3 Punkte) teilt eine konkrete Methode: "Wan 2.2 and Minimax H3 are free on cnaps studio, credit resets every 5 hours".
  • Auf Closed-Source-Seite steht GPT Image 2.5 Flare im Mittelpunkt. In Thread #3 „GPT Image 2.5 Flare — is this actually the best AI image generating model right now?“ (92 Punkte, 62 Kommentare, 2026-09-16, https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/) lobt u/oldboi777 (4 Punkte): "its really good, its an incredible upgrade I think". u/Dependent_Quit_3730 (3 Punkte) bevorzugt dagegen weiterhin KREA 2: "É um modelo perfeito... mas eu ainda fico com o KREA 2". u/SeaworthinessFresh16 (2 Punkte) sagt: "The result in Comfyui with Krea2 looks the same" — ein wahrgenommener Unterschied zu Open-Source-Tools bestehe nicht.
  • DeepSeek (Open Weight) erlebt zugleich starkes Wachstum und Kapazitätsengpässe. Thread #6 „some deepseek news, if you care“ (206 Punkte, 36 Kommentare, 2026-09-21, https://www.reddit.com/r/DeepSeek/comments/1wmcgex/) berichtet, dass die täglich aktiven Nutzer von 120 auf 200 Millionen (+66,7 %) gestiegen seien, während die Rechenleistung nur um 8,3 % zugenommen habe. Das wird mit Qualitätsverlusten und Problemen bei erneuten Generierungen in Verbindung gebracht. Als Gegenmaßnahme sollen 160.000 Ascend-960DT-Einheiten bei Huawei bestellt worden sein. u/Equivalent-Grass-527 (6 Punkte) schreibt: "The demand vs. compute mismatch is probably the most important part here".
  • Die Bewertung handwerklicher Methoden, um den KI-Look zu entfernen, ist gespalten. Thread #8 „I stopped prompting for clean shots and my AI video finally stopped looking like AI“ (63 Punkte, 56 Kommentare, 2026-09-20, https://www.reddit.com/r/aivideos/comments/1wl6op9/、Seedance 2.5 verwendet) erläutert ausführliche Prompt-Techniken, doch die Kommentare sind skeptisch. u/TCristatus (9 Punkte) schreibt: "What a load of waffle, and the video is still obviously AI". u/Biscuits4u2 (6 Punkte) merkt an: "You need 5 percent uglier people to make it look realistic. Faces are too perfect." Nicht die Technik, sondern gerade die zu große Perfektion verrate die Erzeugung.
  • KI-generierte Bilder in realen Räumen lösen Empörung aus. In Thread #7 „AI generated image on MSEE wall“ (61 Punkte, 13 Kommentare, 2026-09-21, r/Purdue, https://www.reddit.com/r/Purdue/comments/1wmq43f/) gerät ein an der Universität ausgestelltes KI-Bild wegen seines unsinnigen Leiterplattenlayouts in die Kritik. u/j909m (11 Punkte): "Whoever did the PCBA layout for that IC gets an F."
  • Auch in einer Community mit über 1,15 Millionen Mitgliedern wird intensiv über das Erkennen KI-generierter Bilder gestritten. Thread #12 „AI generated images on Reddit with thousands of upvotes and comments“ (2.109 Punkte, 341 Kommentare, 2026-09-18, r/Instagramreality, https://www.reddit.com/r/Instagramreality/comments/1wk0euk/) erzielte das mit Abstand höchste Reddit-Engagement der Erhebung. u/Smart-Membership-117 (405 Punkte) weist auf Detailwidersprüche hin: "The trim on the baseboard by her knee in pictures 2 and 3 is different and the greenery outside the window completely changes as well." u/Negative-Raise-8286 (275 Punkte) beklagt, dass er den Hinweis im ursprünglichen Thread nicht posten konnte.
  • Mehrere Stimmen halten kostenlose Credits weiterhin für großzügig; es gibt nicht nur Pessimismus. In Thread #9 (r/aivideomaking, 3 Punkte, 26 Kommentare, 2026-09-15, https://www.reddit.com/r/aivideomaking/comments/1wh80z3/) lobt u/Chance-Business (2 Punkte) das kostenlose Kontingent von Google Flow (Veo): "google flow you get 50 free credits per day, each vid is 6-12 credits. I have most days not hit 50." Auch in Thread #4 (https://www.reddit.com/r/aivideomaking/comments/1wled0f/) sagt u/MrBoondoggles (1 Punkt): "You can use Nanobanana and Veo in Google flow. They have very generous daily free credit allowance."
  • Derselbe Empfehlungscode wird in mehreren Threads beworben. u/MeatStickMcFapperton postete sowohl in Thread #2 (4 Punkte) als auch in Thread #5 (1 Punkt) nahezu identische Kommentare, die für Metas „Muse“ mit dem Code "42JB8K" und „einer Milliarde kostenloser Tokens“ werben.
Signale
  • Aufwärtstrend: Hinweise auf lokale/Open-Weight-Videogenerierung (Wan, MiniMax H3, FramePack, ComfyUI) erscheinen in der Mehrheit der Threads über kostenlose Generierung organisch. Auch der deutliche DeepSeek-Nutzerzuwachs (+66,7 %) ist ein klares positives Signal.
  • Skepsis und Abweisung: Forderungen nach kostenlosen KI-Videos stoßen auf starken Gegenwind. u/activematrix99 (2 Punkte) in Thread #4 schreibt: "Imagine showing up at a restaurant and demanding to eat for free... what makes YOU so important that they should just give it to you for free?" Dass ähnliche belehrende Kommentare in mehreren Threads hohe Bewertungen erhalten, zeigt einen Stimmungswandel.
  • Überraschender Punkt: Derselbe Empfehlungscode ("42JB8K") und nahezu identische Werbetexte erscheinen mehrfach in unterschiedlichen Threads. Organische Diskussionen könnten daher durch Werbe- oder Eigenwerbungskommentare durchsetzt sein; Kennzahlen sollten vorsichtig interpretiert werden.
  • Konflikt: Die Position „kostenlose Videogenerierung ist eine Illusion“ (mehrere hochbewertete Kommentare in Threads #2, #9 und #10) steht der Position gegenüber, kostenlose Kontingente von Google Flow/Veo/Muse/Nanobanana seien durchaus großzügig (Threads #4, #5, #9). Beide Seiten argumentieren aus eigener Erfahrung; keine lässt sich pauschal als richtig einstufen.
  • Der wahrgenommene Abstand zwischen Closed und Open Source ist gering: Thread #3 bewertet das Closed-Source-Modell GPT Image 2.5 Flare und KREA 2 aus dem Open-Tool-Umfeld als visuell gleichwertig. Das deutet darauf hin, dass sich der Qualitätsunterschied aus Nutzersicht bei Bildgenerierung stark verringert hat.
Grenzen
  • Das Erhebungstool verwendete nur den Suchbegriff "Image and Video Generation AI News". Gegenüber dem Ziel des Briefings — etwa 20 Beiträge je sozialem Netzwerk zu analysieren — wurden nur 12 Threads aus sieben Subreddits gefunden. Zusätzliche Suchen nach "Sora", "Veo", "Kling", "Stable Diffusion", "Flux", "open source" / "closed source" hätten wahrscheinlich mehr und präzisere Threads geliefert.
  • Für Thread #9 enthält das Erhebungsdatenset keinen Beitragstext; die Einschätzung beruht nur auf Kommentaren.
  • Aufgrund der Vorgaben des Playbooks wurde Reddit in dieser Phase nicht eigenständig durchsucht; geprüft werden konnte nur der Inhalt von output/reddit.threads.md / .json. Diskussionen außerhalb dieser Dateien, etwa modellbezogene Spezialthreads, sind nicht Teil dieses Berichts.

X

X — KI-News zur Bild- und Videogenerierung

Accounts

In output/x.posts.md wurden 32 Beiträge von 31 Accounts geprüft, aber kein einziger Account behandelte Bild- oder Videogenerierungs-KI. Die Accounts verteilen sich auf themenfremde Bereiche:

Kategorie Betroffene Accounts
Kryptowährungen/Aktien ($SDOG, $AMD, Bitcoin) @SDOGWITHSNAP, @DeItaone, @AJM_web, @S500ALERTS, @blackwidowbtc, @0xSweep, @USronaldcarter, @TedPillows
Ukraine-Russland-Lage @dystoman, @sentdefender, @Polymarket, @Alex_Oloyede2, @bayraktar_1love, @AlaskanTzar, @SomaliSasuke, @gmanredux, @idkmypronouns, @Katauroraaa, @AbotGrenfield, @jaccocharite
Promi- und Politikklatsch (Lauren) @Rach_delauren, @fvslaurs, @LimeriTweets, @karignejauregui
Sport und Kampfsport (Muhammad) @CylinderAnalyst, @bullyb170(2 Beiträge)
Religion @TaymiFawaid
Persönliche Accounts zum Standorttrend Zagreb @slimey34, @AlphaGainer, @enafriedric2372, @Earldormancy

Es gibt sowohl Accounts, die mit einem einzelnen viralen Beitrag hohe Reichweite erzielen (beispielsweise @AlaskanTzar mit 34.704 Likes), als auch solche mit vielen kleinen Beiträgen. Keiner veröffentlichte jedoch Nachrichten oder Tools zur Bild- oder Videogenerierung, weder Closed noch Open Source.

Beiträge

Da die erfassten Daten keinen thematisch passenden Beitrag enthalten, lassen sich keine üblichen fünf bis zwölf Erkenntnisse zu Bild- und Videogenerierungs-KI berichten. Zur Einordnung einige der tatsächlich erfassten Beiträge:

  1. #8 @TedPillows(2.829 Likes, 293 Reposts, etwa 486.000 Aufrufe, 2026-09-20, https://x.com/TedPillows/status/2101642897535762562)— "If Bitcoin breaks $83,000, the cycle bottom will be confirmed..." Eine Bitcoin-Marktanalyse ohne KI-Bezug.
  2. #30 @AlaskanTzar(34.704 Likes, 1.083 Reposts, etwa 1.500.000 Aufrufe, 2026-09-20, https://x.com/AlaskanTzar/status/2101819330703032636)— "Back in 2017 Russia and Ukraine were ratioing each other on twitter". Der Beitrag mit dem höchsten Engagement der gesamten Erhebung, aber ein Russland-Ukraine-Meme.
  3. #22 @Katauroraaa(2.840 Likes, etwa 309.000 Aufrufe, 2026-09-20, https://x.com/Katauroraaa/status/2101716186132087180)— Ein scherzhafter Beitrag über Russland und die baltischen Staaten.

Keiner dieser Beiträge erwähnt Bild- oder Videogenerierungs-KI, weder aus dem Closed- noch aus dem Open-Source-Bereich.

Signale
  • Das einzige aus den Daten ableitbare Signal ist, dass die Suchbegriffe dieser Phase selbst themenfremd waren. Da die Explore-Trends von X direkt als Suchbegriffe verwendet wurden, drehten sich die Ergebnisse um Kryptowährungen, Geopolitik, Promiklatsch und Sport.
  • Zur Bild- und Videogenerierungs-KI wurde in den vorliegenden Daten keine Diskussion beobachtet, die als Aufwärts-, Skepsis- oder sonstiges Marktsignal eingeordnet werden könnte.
Grenzen
  • Die Suchbegriffe waren themenfremd: Wie am Anfang von output/x.posts.md steht, wurden "$SDOG", "Bitcoin", "Zelensky", "Lauren", "Muhammad", "Russians", "Zagreb", "Ukraine", "Weeknd", "USSR" verwendet. Sie wurden direkt aus der „Explore-Liste von X“ übernommen; keiner bezog sich auf Bild-KI, Video-KI, Sora, Midjourney oder Stable Diffusion.

    # Trend Ort (X-Bezeichnung)
    1 $SDOG Trending in Croatia
    2 Bitcoin Business & finance · Trending
    3 Zelensky Politics · Trending
    4 Lauren Trending in Croatia
    5 Muhammad Politics · Trending
    6 Russians Politics · Trending
    7 Zagreb Trending in Croatia
    8 Ukraine Politics · Trending
    9 Weeknd Trending in Croatia
    10 USSR Politics · Trending

    Diese Explore-Liste ist offenbar geografisch an den Standort des Servers dieser Sitzung gebunden, vermutlich an die Region Kroatien, und stellt keine globalen Trends dar.

  • Das Abschlusskriterium wurde nicht erfüllt: brief.md verlangt die Analyse von etwa 20 Beiträgen je sozialem Netzwerk. Von 32 erfassten Beiträgen waren 0 zur Bild- oder Videogenerierungs-KI relevant. Für X liefert dieser Bericht daher keine substanziellen Erkenntnisse zum Thema.

  • Die Sitzung selbst war funktionsfähig; es wurden angemeldet Daten erfasst, und keine Meldung wie "no posts were collected" ausgegeben. Das Problem lag bei der Auswahl der Suchbegriffe, nicht bei Suche oder Darstellung von X.

  • Bei der nächsten Ausführung sollten Suchbegriffe wie "AI image generation", "AI video generation", "Sora 2", "Midjourney", "Stable Diffusion", "Nano Banana" und "Veo" verwendet werden.

YouTube

YouTube — KI-News zur Bild- und Videogenerierung (Closed Source/Open Source)

Kanäle
  • Matt Wolfe (@mreflow) — KI-Nachrichtenkanal mit über 925.000 Abonnenten. Veröffentlicht laufend schnelle Reviews zu Closed-Source-Themen wie Nano Banana Pro / Nano Banana 2. (https://www.youtube.com/@mreflow)
  • Theoretically Media — Spezialisiert auf Reviews und Praxistests von Open-Source-KI-Videotools wie LTX-2 / LTX-2.3 und HunyuanVideo. (https://theoreticallymedia.com/videos/)
  • Aitrepreneur — Besonders stark bei ComfyUI-Workflow-Erklärungen und lokaler Einrichtung aktueller Open-Source-Videomodelle wie LTX-2.3. (Patreon-Integration: https://www.patreon.com/aitrepreneur)
  • Weitere mittelgroße KI-Tool-Reviewkanäle zu Z-Image Turbo, Flux.2 und HunyuanVideo 1.5; die Kanalnamen waren nur über Videotitel erkennbar, Abonnentenzahlen nicht bestätigt — siehe Grenzen.
Videos
  1. Google won image generation (it's not even close) — NANO BANANA PRO BREAKDOWN
    date: 2025-11-26 | views: nicht bestätigt | https://www.youtube.com/watch?v=UV9GqinedQ8
    Google DeepMinds Nano Banana Pro (Gemini 3 Pro Image) soll bestehende Bild-KI auf einem Niveau übertreffen, bei dem „es nicht einmal knapp ist“. Das Review betont Textrendering und Fotorealismus als Closed-Source-Stärken.

  2. Google's Nano Banana Pro is raising concerns over realistic AI image generation
    date: Ende November 2025 | views: nicht bestätigt | https://www.youtube.com/watch?v=RmmrVCUGYp8
    Ein Nachrichtenbeitrag über Sorgen wegen Deepfakes und Desinformation, da der Fotorealismus stark zugenommen hat.

  3. GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model
    date: ungefähr 2026-09-08 (vor zwei Wochen veröffentlicht) | views: nicht bestätigt | https://www.youtube.com/watch?v=DY6TkI8XtkQ
    Vollständige Funktionsübersicht zu OpenAIs GPT Image 2.5: 50 % geringere Generierungslatenz und eine Sketch-Funktion, die Zeichnungen in KI-Bilder umwandelt.

  4. Sketch with ChatGPT Images 2.5
    date: Anfang September 2026 | views: nicht bestätigt | https://www.youtube.com/watch?v=imPtIEAEHSU
    Demo der neuen Funktion, mit der sich in ChatGPT durch Eingabe von „@Sketch“ handgezeichnete Inhalte direkt in KI-Bilder verwandeln lassen.

  5. State of AI Video in 2026: Sora 2, Veo 3.1, Kling 3.0 & Cinematic Prompting Workflows
    date: 2026-03-20 | views: nicht bestätigt | https://www.youtube.com/watch?v=vtJzDgmWVWc
    Überblick über Sora 2, Veo 3.1 und Kling 3.0 sowie filmische Prompting-Workflows.

  6. Seedance 2.5 REVIEW: ByteDance's New AI Video Model Explained
    date: 2026-08-01 | views: nicht bestätigt | https://www.youtube.com/watch?v=LTAOvsH6cjM
    ByteDances Seedance 2.5 unterstützt 30-sekündige One-Take-Generierung und bis zu 50 Referenzbilder. Durch längere konsistente Sequenzen als Sora 2 und Veo 3.1 erlangte es Aufmerksamkeit. Closed Source.

  7. Kling 2.6 Pro DESTROYS Competition - Veo 3.1 & Sora 2 Pro
    date: 2025-12-19 | views: nicht bestätigt | https://www.youtube.com/watch?v=-vRsjX9seUU
    Benchmarkvideo, laut dem Kling 2.6 Pro schon vor Kling 3.0 Veo 3.1 und Sora 2 Pro übertraf. Diese Dynamik setzte sich mit Kling 3.0 fort, das am 2026-02-05 erschien und mit einem ELO-Score von 1.243 an der Spitze lag.

  8. Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro)
    date: 2025-11-27 | views: nicht bestätigt | https://www.youtube.com/watch?v=sPQQPpQ9X4E
    Ein von Alibabas Tongyi-MAI-Team entwickeltes Modell mit 6 Milliarden Parametern und Apache-2.0-Lizenz. Es ermöglicht schnelle Inferenz in acht Schritten auf Consumer-GPUs mit 16 GB und gilt als Open-Source-Hoffnungsträger auf dem Niveau von Nano Banana Pro.

  9. New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial
    date: 2025-12-11 | views: nicht bestätigt | https://www.youtube.com/watch?v=JF4Q5hXh-_Q
    Vergleichs- und Tutorialvideo, das Z-Image vor Flux.2 sieht.

  10. FLUX.2 EL MEJOR MODELO OPEN SOURCE, EN LOCAL Y GGUF
    date: ungefähr November–Dezember 2025 | views: nicht bestätigt | https://www.youtube.com/watch?v=t4eVxZPP0b0
    Anleitung zur lokalen Ausführung der FLUX.2-Reihe von Black Forest Labs in ComfyUI, einschließlich Pro, Flex, Dev und des Apache-2.0-Modells Klein. Stärken sind bis zu 4-MP-Ausgabe und konsistente Nutzung von bis zu zehn Referenzbildern.

  11. The "Holy Grail" of Open Source AI Video is Here (LTX-2)
    date: Anfang Januar 2026 | views: nicht bestätigt | https://www.youtube.com/watch?v=27UAb_Tlv4E
    LTX-2 von Lightricks, veröffentlicht am 2026-01-06, wird als erstes produktionsreifes Open-Source-Videomodell mit nativem 4K, audiosynchroner Ausgabe sowie veröffentlichten Gewichten und Trainingscode gelobt.

  12. Tencent HunyuanVideo 1.5 has been officially open-sourced!
    date: erste Hälfte 2026 | views: nicht bestätigt | https://www.youtube.com/watch?v=MJShdc8tkkA
    Tencent veröffentlichte HunyuanVideo 1.5 und senkte die Parameterzahl von 13B auf 8,3B, ohne die Leistung wesentlich zu beeinträchtigen. Positiv bewertet wird die Ausführbarkeit auf Consumer-GPUs.

  13. Qwen-Image 2.1 | Early Access Showcase
    date: ungefähr 2026-09-20 (vor zwei Tagen veröffentlicht) | views: nicht bestätigt | https://www.youtube.com/watch?v=tP_gGGJzEqg
    Early-Access-Demo von Alibaba Qwens Qwen-Image-2.1, veröffentlicht am 2026-09-20: ein auf 7B komprimierter visueller Generator, der Erstellung und Bearbeitung vereint und transparente RGBA-Ausgabe unterstützt. Die Lizenz ist jedoch nur für nichtkommerzielle Forschung.

Signale
  • Bei Closed Source verschärft sich der Wettbewerb um „Geschwindigkeit und Fotorealismus“: GPT Image 2.5 (2026-09-08, 50 % weniger Generierungslatenz) und Nano Banana Pro → Nano Banana 2 (2026, doppelte Geschwindigkeit) zeigen, wie OpenAI und Google im Abstand weniger Wochen Updates liefern. Bei Video ist der Vergleich Sora 2, Veo 3.1 und Kling 3.0 zum Standardformat geworden.
  • Sora wird einschließlich API eingestellt: Sora Web/App wurde bereits am 2026-04-26 beendet, die API soll am 2026-09-24 folgen — zwei Tage nach Erstellung dieses Berichts. Als Ursache gelten Betriebskosten von rund 1 Mio. US-Dollar pro Tag bei kumulierten Umsätzen von nur rund 2,1 Mio. US-Dollar. Der Vorgang zeigt, dass Closed-Source-Videogenerierung nicht automatisch ein Winner-takes-all-Markt ist.
  • Open Source setzt auf kompakte, schnelle Modelle: Z-Image Turbo (6B, Apache-2.0), Qwen-Image-2.1 (auf visuellen Generator mit 7B komprimiert) und HunyuanVideo 1.5 (13B → 8,3B) folgen alle dem Muster, Parameter zu verringern und dennoch hohe Leistung auf Consumer-GPUs anzubieten.
  • Die Grenze zwischen Open Weight und kommerziell nutzbarem Open Source wird diskutiert: Flux.2 ist in Teilen, etwa Klein, vollständig unter Apache 2.0 verfügbar. Qwen-Image-2.1 veröffentlicht dagegen Gewichte unter einer nichtkommerziellen Forschungslizenz. Kommentare und Reviews fragen daher, ob dies noch als Open Source gelten kann.
  • LTX-2 könnte der Benchmark für Open-Source-Video werden: Die Kombination aus nativem 4K, Audiosynchronisierung und offenem Trainingscode wird als neuartig bewertet. Mehrere Kanäle vergleichen es mit Wan 2.2 und HunyuanVideo 1.5 als führenden lokalen Videogenerierungsmodellen.
  • ComfyUI ist de facto die gemeinsame Grundlage: Für Flux.2, Z-Image, LTX-2, Wan und HunyuanVideo erscheinen zahlreiche Day-0-Unterstützungs- und Workflowvideos für ComfyUI. Fast alle Open-Source-Reviews beinhalten dort praktische Tests.
Grenzen
  • Such- und Videoseiten von YouTube (/results?search_query=... und /watch?v=...) werden per JavaScript gerendert. WebFetch konnte deshalb nur Footer-Navigationslinks lesen; exakte Aufrufzahlen, Kanalnamen, Veröffentlichungszeitpunkte sowie Untertitel und Kommentartexte ließen sich nicht direkt abrufen. Datumsangaben beruhen auf Snippets und verwandten Artikeln und sind Näherungswerte; Aufrufzahlen sind überall als nicht bestätigt markiert.
  • Das ideale Playbook-Verfahren, rund 20 Videos einzeln zu öffnen und auszuwerten, war unter diesen Einschränkungen nicht möglich. Stattdessen wurden über WebSearch Titel, Kanalsignale und ungefähre Veröffentlichungszeiträume gesammelt. Insgesamt wurden mehr als 30 Videotitel gefunden; 13 sind oben als repräsentative Auswahl aufgeführt.
  • Videos zu Qwen-Image-2.1 waren erst zwei Tage verfügbar; die Anzahl von Reviews ist noch gering und dürfte in den kommenden Wochen steigen.

Bluesky

Bluesky — KI-News zur Bild- und Videogenerierung

Accounts
  • Ed Zitron (edzitron.com) — Kritiker der Tech- und KI-Industrie (Where's Your Ed At); meldete auf Bluesky die Sora-Einstellung mit einem starken Engagementanstieg.
  • Simon Willison (simonwillison.net) — unabhängiger KI-Forscher; vergleicht regelmäßig neue Modelle, darunter Bildgeneratoren, mit seinen „Pelikan“-Tests und veröffentlicht dabei erzeugte Konzeptkunst.
  • Adina Yakup (adinayakup.bsky.social) — Open-Source-ML-Befürworterin bei Hugging Face; mit Abstand die aktivste Chronistin neuer Open-Weight-Modelle für Bild und Video auf Bluesky.
  • useapi.net (useapi.bsky.social) — Anbieter von REST-APIs für KI-Video-, Bild- und Musikgenerierung (Veo, Kling, Seedance, Runway, MiniMax usw.); veröffentlicht häufig direkte Modellvergleiche.
  • GPT Image Prompt (gptimageprompt.bsky.social) — Prompt-Sharing-Account rund um OpenAIs ChatGPT/GPT-Image-Tool.
  • Stable Diffusion online AI (stablediffusion.bsky.social) — langjähriger Community-Account für Stable-Diffusion-Prompts und KI-Kunst-Challenges.
  • Stability AI (offiziell) — seit etwa November 2025 bei Bild und Video still; die jüngeren Beiträge drehen sich fast nur um Stable Audio und Partnerschaften mit Musiklabels wie Warner und Universal, nicht um Stable Diffusion.
Beiträge
  1. Ed Zitron — OpenAI stellt Sora ein (2026-03-24, 👍 3.572 · 🔁 984)
    "Both the Wall Street Journal and The Information confirming that OpenAI is killing Sora - both the app and access to its video-generating model for developers. This is a huge move that suggests things are a bit desperate."
    https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
    (Dies deckt sich mit Berichten, dass die Sora-App am 26. April 2026 geschlossen wurde und die API selbst am 24. September 2026 eingestellt werden soll — zwei Tage nach dieser Recherche.)

  2. Simon Willison — Entwickeln mit ChatGPT Images 2.5 (2026-09-10, 👍 56 · 🔁 5)
    "Here's a Blender model of a Pluribus themed Fabergé egg I had GPT-6 Astra build - I generated the concept image using ChatGPT Images 2.5"
    https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24

  3. Adina Yakup — HyperFlow (offene Videodestillation) (2026-09-19, 👍 6 · 🔁 1)
    "HyperFlow⚡ New MiniMax-H3 variant from Video Rebirth — Open weight 8 step LoRA — 3× faster with data free self distillation — Video + stereo audio intact"
    https://bsky.app/profile/adinayakup.bsky.social/post/3mvunely5222b

  4. Adina Yakup — ByteDances Lance (2026-05-19, 👍 48 · 🔁 5)
    "ByteDance dropped Lance👀 — This 3B model can generate images + edit images + generate videos + edit videos, and understand both images/videos."
    https://bsky.app/profile/adinayakup.bsky.social/post/3mm6xqsryf22b

  5. Adina Yakup — Baidus ERNIE-Image (2026-04-14, 👍 1)
    "Baidu just released ERNIE-Image on Hugging Face🔥 — 8B DiT - Image/Image Turbo — Apache 2.0"
    https://bsky.app/profile/adinayakup.bsky.social/post/3mjhrc3y7u22i

  6. Adina Yakup — Skyworks Matrix-Game 3.0 (2026-03-27, 👍 13 · 🔁 2)
    "Matrix-Game 3.0🔥 real-time interactive world models from Skywork — ✨ 720p @ 40FPS with a 5B model"
    https://bsky.app/profile/adinayakup.bsky.social/post/3mi2efsyp7k2x

  7. Adina Yakup — LongCat-Video-Avatar 1.5 (2026-05-22, 👍 16 · 🔁 3)
    "LongCat-Video-Avatar 1.5🐱 an audio driven avatar video generation [model]"
    https://bsky.app/profile/adinayakup.bsky.social/post/3mmglm72zn22i

  8. Adina Yakup — HiDream-O1-Image (2026-05-19, 👍 10 · 🔁 2)
    "HiDream-O1-Image is getting a lot of attention🔥"
    https://bsky.app/profile/adinayakup.bsky.social/post/3mm73u27jek26

  9. useapi.net — Sora-2-API-Alternativen (2026-09-21, 👍 0)
    "Sora 2 API Alternatives Compared, With Code: Seedance 2.5, Omni Flash, MiniMax H3, Kling v3 #sora2 #seedance #kling #aivideo"
    https://bsky.app/profile/useapi.bsky.social/post/3mvyugq6wgz27

  10. useapi.net — MiniMax H3 gegen Seedance 2.0 (2026-07-31, 👍 0)
    "MiniMax H3 head to head with Seedance 2.0 on identical omni references #minimax #seedance #ai #api"
    https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x

  11. GPT Image Prompt — Meme-Prompt geteilt (2026-05-07, 👍 0)
    "Theme: Text to Meme — Prompt put on comment — Welcome to our website:gptimageprompt.io #Chatgpt2 #GPTImagePropmt #AIPrompts"
    https://bsky.app/profile/gptimageprompt.bsky.social/post/3mlaa6swzc226

Signale
  • Die Sora-Einstellung ist die Closed-Source-Geschichte, über die Bluesky tatsächlich spricht. Ed Zitrons Beitrag ist mit 3.500 Likes das bei weitem stärkste Element dieser Recherche; weit mehr als neue Modellankündigungen. Die KI-Community auf Bluesky ist hier stärker von Industrieanalyse und Kritik als von Labormarketing geprägt.
  • Open-Source-Nachrichten auf Bluesky sind praktisch ein Ein-Personen-Ressort. Fast jede konkrete gefundene Open-Weight-Veröffentlichung — Baidu ERNIE-Image, ByteDance Lance, Skywork Matrix-Game 3.0, LongCat-Video-Avatar, HyperFlow, HiDream-O1-Image — stammt von Adina Yakup bei Hugging Face. Das Muster wird stark von chinesischen Laboren wie Baidu, ByteDance, Alibaba/Qwen, Ant Group, Skywork und Tencent getragen, die unter Apache-2.0-ähnlichen Lizenzen veröffentlichen.
  • Kein großes Closed-Source-Labor unterhält auf Bluesky eine aktive Präsenz für Bild- oder Video-Launches. Keine offiziellen Accounts von OpenAI, Google DeepMind, Adobe oder Midjourney tauchten auf. Closed-Source-Berichterstattung erfolgt indirekt über unabhängige Tester wie Simon Willison oder API-Reseller wie useapi.net.
  • Technische, toolspezifische Beiträge erzielen fast kein Engagement: 0–13 Likes für useapi.net-Vergleiche und die meisten Adina-Yakup-Veröffentlichungen, gegenüber Tausenden Likes für die Sora-Geschichte. Das Engagement folgt auf dieser Plattform eher Branchen-Narrativen als technischer Neuheit.
  • Mehrere offensichtliche Hubs für KI-Kunst sind auf Bluesky tot oder inaktiv: Die offiziellen und Bot-Accounts von Civitai, der ComfyUI-Account sowie Stability AI selbst, das sich auf Stable Audio und Musiklabel-Inhalte verlagert hat und seit Mitte 2025 keine Stable-Diffusion-Bildmodelle mehr behandelte.
Grenzen
  • Die öffentliche Keyword-Such-API ist blockiert. app.bsky.feed.searchPosts lieferte bei jedem Versuch HTTP 403 Forbidden; die Weboberfläche bsky.app/search wird vollständig clientseitig per JavaScript gerendert und lieferte ebenfalls keinen Beitragsinhalt. Eine echte aktuelle Keyword-Suche war damit nicht möglich. Die Informationen wurden aus per Websuche identifizierten Accounts und deren über die öffentliche AT-Protocol-API gelesenen getAuthorFeed-Historien zusammengestellt.
  • Mehrere vielversprechende Accounts waren beim Direktcheck leer oder inaktiv: civitai.bsky.social (leerer Feed), civitai-bot.bsky.social (letzter Beitrag Mai 2024), real-comfyui.bsky.social (leerer Feed), runwayml.bsky.social (unzusammenhängender persönlicher Account mit einem Beitrag aus 2024), midjourney-api.bsky.social (inoffizieller Reseller, ein Beitrag aus November 2024), qwen1.bsky.social (Fanaccount, ein Beitrag aus Februar 2025).
  • Alibabas Qwen-Image-2.1, laut externer Berichterstattung am 2026-09-20 veröffentlicht, tauchte in keinem gefundenen Bluesky-Beitrag auf. Entweder wurde es von den beobachteten Accounts noch nicht aufgegriffen oder liegt außerhalb dessen, was die blockierte Suche geliefert hätte.
  • Ethan Mollick (emollick.bsky.social) und Tanishq Abraham (iscienceluvr.bsky.social) wurden geprüft und ausgeschlossen: Sie konzentrieren sich auf allgemeine bzw. textbasierte LLM-Nachrichten und ältere akademische Arbeiten, nicht auf aktuelle Bild- oder Videogenerierung.
  • Das Ziel einer Stichprobe von etwa 20 Beiträgen wurde aggregiert durch vollständige Feed-Historien erreicht — etwa 30 Beiträge von Adina Yakup, etwa 15 von useapi.net, etwa 20 von Stable Diffusion sowie jüngere Feeds von Simon Willison und Ed Zitron — nicht durch eine einzige rangierte Suche. Es handelt sich daher um eine zielgerichtete, accountbasierte Stichprobe, nicht um eine vollständige Keyword-Erhebung.

Lemmy

Lemmy — Aktuelle Entwicklungen bei Bild- und Videogenerierungs-KI

Communities
  • !«メールアドレス»(5.713 Mitglieder) — wichtigste Community für Open-Source-Technik zur KI-Bild- und -Videogenerierung. Neue Tools von GitHub und Hugging Face erscheinen nahezu täglich.
  • !«メールアドレス»(2.361 Mitglieder) — Ort für mit Stable Diffusion und anderen Open-Weight-Modellen erzeugte Werke.
  • !«メールアドレス»(1.599 Mitglieder) — nur jugendfreie Anime-KI-Kunst.
  • !«メールアドレス»(52 Mitglieder, 157 monatlich aktive Mitglieder) — spiegelt KI-bezogene Reddit-Threads. Closed-Source-Nachrichten zu Sora oder Midjourney gelangen häufig über diesen Weg hierher.
  • !«メールアドレス»(204 Mitglieder, Beiträge aus der Instanz lemmy.bestiver.se gemischt) — Hacker-News-Spiegel für Modellveröffentlichungen wie Qwen-Image und Nano Banana.
  • !«メールアドレス» — ironisch-satirische Community zur KI-Industrie. Die Nachricht über Midjourneys Kurswechsel war hier besonders stark.
  • !«メールアドレス»(8.265 Mitglieder) — große Community kritischer Stimmen zu generativer KI. Kein direkter Nachrichtenraum, aber relevant für die allgemeine Stimmung auf Lemmy.
  • !stable_diffusion_furry / _witches / _mycology / «メールアドレス» — Nischencommunities für genrebezogene SD-Kunst. Es gibt Beiträge, aber Scores meist im einstelligen oder negativen Bereich.
Beiträge

Closed-Source-bezogen

  1. OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !«メールアドレス», 2026-09-20, Score 1. Stellt die Sora-API-Einstellung einer Milliardenfinanzierung chinesischer Konkurrenz gegenüber.
  2. Midjourney AI pivots to Theranos: Ultrasonic CT — !«メールアドレス», 2026-06-19, Score 40. Thema ist Midjourneys abruptes Umschwenken von KI-Bildgenerierung zu medizinischer Ultraschall-CT-Technik; der meistbeachtete Midjourney-Beitrag auf Lemmy.
  3. Midjourney Ultrasonic CT Scanner — !hackernews, 2026-06-18, Score 2. Hacker-News-Spiegel der Primärquelle (midjourney.com/medical).
  4. Beitrag über Midjourney wants Hollywood studios to reveal AI usage details — !«メールアドレス», 2026-07-05, Score 73. Vorstellung eines TechCrunch-Artikels mit vergleichsweise hohem Score in einer Tech-Community.
  5. Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images — !ai_reddit, 2026-08-07, Score 1.
  6. Seedream 5.0 Pro is here: an honest comparison and technical breakdown — !ai_reddit, 2026-07-10, Score 1. Prüfung von ByteDances Closed-Source-Bildmodell.
  7. Nano Banana 2 Lite — !hackernews, 2026-06-30, Score 1. Ankündigung des leichten Bildmodells von Google DeepMind.
  8. Microsoft's MAI-Image-2.5 Pulls Even With Google's Nano Banana 2 on Benchmarks — !ai_reddit, 2026-05-28, Score 1.

Open-Source-bezogen

  1. Qwen-Image-2.1: Compact, efficient, and unified image creation — !hackernews, 2026-09-20, Score 1. Die aktuelle Version von Alibabas Qwen-Open-Weight-Bildmodell.
  2. supElement/ComfyUI_MinimaxH3_AutoContext — !«メールアドレス», 2026-09-16, Score 1. Node für längere MiniMax-H3-Videos über Speichergrenzen hinweg.
  3. Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder — gleiche Community, 2026-09-16, Score 3. Prompt-Builder für MiniMax H3.
  4. nazgut/ComfyUI-MiniMaxH3-CLSS — gleiche Community, 2026-09-01, Score 0. Erzeugung beliebig langer Videos mit Audio bei 16 GB VRAM.
  5. filliptm/ComfyUI-FL-MiniMaxH3 — gleiche Community, 2026-08-30, Score 5.
  6. Luisacaotica/ComfyUI-MiniMaxH3Mod — gleiche Community, 2026-08-20, Score 7. Trainingsfreier Adapter für die Komprimierung von Referenzbildern und -videos.
  7. I've been testing Wan for AI video generation — !«メールアドレス», 2026-09-10, Score -9 (unbeliebt bzw. kontrovers). Review der Videogenerierung mit dem Open-Weight-Modell Wan.
  8. Boogu-Image-0.1 — Efficient Image Generation Foundation Model — !«メールアドレス», 2026-06-17, Score 5. Neues offenes Basismodell für Bildgenerierung.
Signale
  • Das ComfyUI-Ökosystem rund um MiniMax H3 wächst von August bis September kontinuierlich. Zwischen dem 2026-08-07 und dem 2026-09-16 wurden mindestens fünf relevante Nodes oder Tools in !«メールアドレス» gepostet. Der Veröffentlichungsrhythmus reißt nicht ab; „MiniMax H3“ war in dieser Community das wichtigste Stichwort für Open-Source-Videogenerierung.
  • Closed-Source-Nachrichten haben auf Lemmy kaum native Diskussionen. Fast alles sind indirekte Übernahmen aus Reddit (!ai_reddit) oder Hacker News (!hackernews), mit Scores meist zwischen 1 und 3. Eigenständige Diskussionen gibt es nahezu nicht.
  • Das einzige deutlich erfolgreiche Closed-Source-Thema war Midjourneys Wechsel von Bildgenerierung zu medizinischen Ultraschall-CT-Scannern (!techtakes, Score 40), das in einer stark ironisch geprägten Community viral ging.
  • Communities zum Teilen von Werken wie stable_diffusion_art und share_anime_art haben hohe Beitragsfrequenz, oft mehrere Beiträge pro Tag, aber Scores meist im ein- bis niedrigen zweistelligen Bereich. Dort stehen Kreationen statt Nachrichten im Vordergrund.
  • Mit !«メールアドレス» (8.265 Mitglieder) ist eine KI-kritische Community größer als die positive Generierungscommunity stable_diffusion (5.713 Mitglieder). Die Community-Struktur deutet auf starken Gegenwind für generative KI im Lemmy-Umfeld hin.
Grenzen
  • Die Lemmy-Such-API bietet nur Volltextsuche mit schwachem Relevanz-Ranking. Bei allgemeinen Begriffen wie "Sora" und "Veo" erschienen viele irrelevante politische Nachrichten, etwa aus latam oder pravda_news. Zur Filterung wurden je Keyword 15 bis 20 und insgesamt über 100 Ergebnisse geprüft; passend waren am Ende nur rund ein Dutzend Beiträge.
  • Lemmy ist auf Instanzen verteilt, ohne instanzübergreifende Suche. Durchsucht wurden vor allem lemmy.world, lemmy.dbzer0.com, lemmy.durstig.online, awful.systems, lemmy.bestiver.se und lemmy.today. Diskussionen in abgeschotteten kleineren Instanzen können fehlen.
  • Zu Runway, Kling, Ideogram, Recraft, Grok Imagine, Flux.2 und HunyuanImage wurden auf Lemmy keine bedeutsamen Beiträge gefunden: entweder null Ergebnisse oder nur völlig irrelevante Treffer.
  • Insgesamt ist Lemmy als Ort für aktuelle Bild- und Videogenerierungsnachrichten klein. Die Aktualität hängt von Reddit- und Hacker-News-Spiegeln ab; originäre Inhalte konzentrieren sich auf das Teilen von Implementierungstools für Open-Weight-Modelle in ComfyUI.

Pinterest

Pinterest — KI-News zur Bild- und Videogenerierung

Visuelle Themen
  • Neonleuchtende „AI“-Wortmarken und Roboterbilder mit Leiterplattenoptik sind die Standard-Kurzform für „KI“ auf Pinterest — leuchtende Chips, holografische Roboterköpfe und -hände sowie Partikelschaltungen dienen als generische Titelgrafiken statt der Darstellung konkreter Tools oder Nachrichten [1, 2, 8, 22, 25, 28, 29, 31, 39, 49].
  • Nummerierte Listicle-Thumbnails zu „Best AI Video/Image Generator“ mit großen Überschriften und App-Logo-Rastern (Runway, Pika, Kling AI, Luma Dream Machine, Canva, Hailuo AI, Synthesia, HeyGen, D-ID, CapCut, InVideo, Adobe Firefly) bilden das häufigste Pin-Format im gesamten Set [7, 13, 20, 30, 32, 33, 41, 43].
  • Thumbnails im Stil gesichtsloser YouTuber-Reaktionsbilder — überraschter bärtiger Mann, Kopfhörer, unscharfer Explosionshintergrund — kombiniert mit Big-Tech-Logos, um „AI NEWS“-Rückblicksvideos zu verkaufen [6, 19, 40].
  • Datierte Karten mit KI-News-Zusammenfassungen wie „Today's/This Week's AI News“, gestaltet als kleine Titelseiten oder Instagram-Karussells, die mehrere reale Schlagzeilen pro Karte bündeln [17, 35, 44, 47].
  • „Spot the AI“- und Realismus-Demos — ein fotorealistischer Tennisspieler mit der Beschriftung „This is AI“ oder ein Katzenfoto mit „FAKE“-Stempel — vermarkten den Realismus generierter Medien statt eines bestimmten Produkts [5, 23].
  • Demos zu Stiltransfer mit konsistenten Charakteren — ein Lumalabs-Pin verwandelt ein Quellvideo in vier Stile: Holzblöcke, Origami-Papierkunst, Spielzeugsteine und Blumen. Das entspricht dem in diesem Zyklus verbreiteten viralen Format „Mach daraus Material X“ [10].
  • Werbung für Freelance- und Nebenverdienstangebote, die „KI-Video für deine Marke“ anbieten und WhatsApp-Nummern sowie Gmail-Adressen direkt in die Grafik einbrennen [24].
  • Einsteiger-Infografiken, die die Pipeline in Prompt → latenter Raum → Denoising → Frames → Ausgabe zerlegen; sie richten sich an Personen ohne Grundkenntnisse der Generierung [3, 36].
Bemerkenswerte Pins
  • #9 — Offizielle Veo-2-Produktseite („Our state-of-the-art video generation model“, Anmelde-CTA für VideoFX). Tatsächliches Closed-Source-Produktmarketing, kein Listicle. https://www.pinterest.com/pin/716705728243313502/
  • #10 — Lumalabs „Made of wooden blocks / origami folded paper art / colorful toy bricks / flowers“: Ein Quellvideo wird in vier konsistente Stile umgerendert. https://www.pinterest.com/pin/308144799526598925/
  • #17 — „4 Major AI Updates: Real News. Real Impact.“ bündelt OpenAIs GPT-6 Astra, den agentischeren Einsatz von Gemini in Gmail/Drive/Docs/Slides/Chat, Adobes generative Video-/Soundfunktionen in Premiere sowie Cognitions Series E über 2 Mrd. US-Dollar bei 48 Mrd. US-Dollar Bewertung. https://www.pinterest.com/pin/982558843745608433/
  • #20 — „AI Image Video: Best Quality vs Best Free“, ein Entscheidungsdiagramm für kostenpflichtige Tools (ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber, Synthesia) und kostenlose Optionen (Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape, CapCut, Pika Free, Runway Free). https://www.pinterest.com/pin/37295503160959330/
  • #26 — Nachrichtenkarte: „ByteDance and Hollywood reach global deal on AI copyright“ — ByteDance und die Motion Picture Association vereinbaren stärkeren Schutz geistigen Eigentums für ByteDances Bild- und Videogenerierungstools. https://www.pinterest.com/pin/1074530792376376121/
  • #27 — Infografik zu KI-Ethik und Stimmenprüfung mit einem Ergebnis „97% likely AI-generated“, neben Panels zu „AI video generators“ und „AI ethics & prompt engineering“ — ein Ausdruck breit verbreiteter Sorge um die Vertrauenswürdigkeit generierter Medien. https://www.pinterest.com/pin/951104015101996491/
  • #32 — „22 Best & Free AI Video Generators“, die umfangreichste Tool-Übersicht im Set. Unter den „Top 5 Picks“ werden Kling AI und Hailuo AI bei Realismus über Runway und Pika eingestuft. https://www.pinterest.com/pin/128493395623874987/
  • #35 — „Today's AI News, May 20 2026“: Rückblick auf Google I/O 2026 mit Gemini 3.5 Flash, Gemini Omni, dem Gemini-Spark-Agenten und Android-XR-Smartglasses. https://www.pinterest.com/pin/652670171044638578/
  • #44 — „This Week in AI News“, eine nachgemachte Zeitung vom 15. August 2026, mit Schlagzeilensträngen zu „Open Models / Open weights“, „Sovereign AI“ und „Agent Harness“. Der einzige Pin im ganzen Set, der Open-Weight-Modelle überhaupt nennt — allerdings nur als Schlagzeilen-Teaser, nicht als Demo. https://www.pinterest.com/pin/644577765463965693/
  • #48 — „Amuse 3.0“, Markteinführung eines von AMD unterstützten lokalen KI-Kunstwerkzeugs. Einer der wenigen Pins, die eine konkrete Produktneuheit statt eines generischen Listicles oder einer News-Logo-Karte nennen. https://www.pinterest.com/pin/4601060441986715264/
Signale
  • Kling AI und Hailuo AI gehören inzwischen zur Spitzengruppe neben Runway, Pika und Luma und erscheinen in fast jedem gesammelten Listicle ([7, 13, 30, 32, 41, 43]). Das Top-Set ist breiter als das Runway/Pika-Duopol vor einem Jahr.
  • Googles Veo-/Gemini-Offensive ist auf dieser Plattform die sichtbarste Closed-Source-Geschichte und erscheint wiederholt in unabhängigen KI-News-Pins: Veo-2-Start, Gemini 3.5/Omni/Spark und Android-XR-Brillen bei I/O 2026.
  • OpenAI erscheint meist nur als Logo-Bestandteil. Es gibt nur eine konkrete Erwähnung von Sora-2 (#4, eine unscharfe Bildschirmaufnahme eines Drittanbietertools namens „zeely.ai“ im Modus „sora-2-video-ad“), deutlich weniger als auf anderen Plattformen.
  • Sorgen um Deepfakes und Authentizität bilden einen wiederkehrenden Unterton, nicht nur ein Einzelthema: Ein „FAKE“-Pin, eine 97-%-KI-Stimmenbewertung und eine Grafik „Human Journalism vs. Machine-Generated Media“ tauchen unabhängig voneinander auf ([5, 16, 27]).
  • Monetarisierung und Nebenverdienst sind ausdrücklich präsent: Anzeigen für KI-Video-Freelancing mit Kontaktangaben (#24), Pitches für „faceless channels“ und Content-Marketing (#23, #25). Die Pinterest-Zielgruppe für KI-Video besteht eher aus Creators, die Inhalte verkaufen oder skalieren wollen, als aus Forschenden.
  • Open Source fehlt praktisch vollständig. Unter allen 50 Pins finden sich keine Erwähnungen von Stable Diffusion, Flux, ComfyUI, Wan, HunyuanVideo, LTX, Mochi oder Links zu GitHub/Hugging Face. Die einzige Spur ist die Formulierung „Open Models. Open weights.“ in einer Überschrift einer nachgemachten KI-News-Titelseite (#44), nie als eigener Pin, Tool-Logo oder Demo. Für dieses Thema besteht Pinterest fast vollständig aus Closed-Source-SaaS-Marketing und SEO-Listicles; wer sich allein auf diese Plattform stützt, erfährt nicht, dass Open-Source-Bild- und -Videogenerierung überhaupt eine Szene ist.
Grenzen
  • Die Tabelle pinterest.pins.md des Workers enthielt keine Abschnitte nach Genres, sondern eine einzige flache Liste von 50 Pins unter einem impliziten Genre. Daher wurden alle Pins zusammen statt genreweise analysiert, wie es das Playbook für Multi-Genre-Läufe vorsieht.
  • Die Titel einiger Pins stimmten nicht mit dem sichtbaren Bildinhalt überein. Da Pinterest in dieser Phase gemäß Playbook nicht direkt durchsucht wird, sind diese Punkte als unbestätigt markiert: #42 („Nvidia #NEW AI Tools“) zeigt nur ein generisches Foto von Jensen Huang ohne sichtbaren Tool-Text; #45 („Grok 5: Elon Musk's AI Revolution“) und #50 („Discover how Grok is revolutionizing video“) zeigen generische Stock- bzw. KI-News-Anchor-Bilder ohne Grok-spezifischen Inhalt; #40 („GPT 5.2, realtime video editor...“) zeigt nur ein generisches Reaktionsthumbnail zu „huge AI news“.
  • Einige Pins sind nahezu identische generische Stockgrafiken ohne eigenständigen Informationswert ([2, 8, 22, 29, 39, 45, 49]). Sie wurden zu den 50 gezählt, aber nicht als separate Signale behandelt.
  • Für dieses Thema wurde auf Pinterest kein Open-Source-Inhalt zu Bild- oder Videogenerierung gefunden. Diese Abwesenheit ist selbst der zentrale Befund der Plattform, keine Forschungslücke — siehe Signale oben.

Empfohlene Maßnahmen

  • Verfolgen, wohin Sora-API-Verkehr nach dem 2026-09-24 abwandert — Seedance 2.5, MiniMax H3 oder Kling v3.
  • Änderungen an der nichtkommerziellen Forschungslizenz von Qwen-Image-2.1 angesichts der aktiven Debatte „Ist das Open Source?“ beobachten.
  • Die Häufigkeit von MiniMax-H3-ComfyUI-Node-Beiträgen auf Lemmy als Frühindikator für die Akzeptanz von Open-Weight-Video nutzen.
  • Die X-Erhebungsphase mit themenspezifischen Suchbegriffen statt regionaler Trending Topics wiederholen.
  • Die Reddit-Erhebungsphase mit Suchbegriffen pro Modell wiederholen, um das Ziel von etwa 20 Beiträgen zu erreichen.
  • Midjourneys Wechsel zu medizinischem Ultraschall-CT anhand der Primärquelle prüfen, bevor er als bestätigt behandelt wird.

Gesammelte Bilder

Wie KI-Videogenerierung moderne Kreativarbeit unterstützt...🎨 KI-Bild- und VideoerstellungKI & maschinelles Lernen: Infografik zur KI-Videogenerierung | LivePhysics™KI-VideogenerierungsprozessBedenken zu KI-Inhalten und sozialen MedienKI-News: Anthropic-Leak zeigt uns die Zukunft der KI...Einfach perfekt 🎥Konzept zur KI-Inhaltserstellung mit Symbolen für Text-, Bild-, Musik- und Videogenerierung – 66 Stockfotos, Vektoren und VideosGoogle stellt Veo 2 vor: Fortgeschrittenes KI-Videogenerierungstool mit verbessertem Realismus und filmischen FunktionenGoogle kündigt Video in ultrahoher Qualität an...Adobe entwickelt KI-Modell zur Video-Hochskalierung und macht unscharfe Aufnahmen zu HD-QualitätGeheimnisse des KI-Content-Studios und der Automatisierung 🚀📱Die besten KI-Videogeneratoren 2026: Veo, Kling,...BildVeo 3 Bild-zu-Video: schnelle Generierung und natives Audio über die Gemini-APINew Yorks mutiger Vorstoß: Einblick in die Gesetzgebung...4 wichtige KI-Updates, die du 2026 kennen musstTop-KI-Videogeneratoren 2025KI-News: OpenAI hat endlich veröffentlicht, worum wir gebeten habenKI für Bild- und VideogenerierungWas ist Imagvio AI und wie hilft es Creators...Konzept zur KI-Inhaltserstellung mit Symbolen für Text-, Bild-, Musik- und Videogenerierung – 57 Stockfotos, Vektoren und VideosKreatives KI-Lifestyle-Video | KI-Videoproduktion für Lifestyle-MarkenKI-generierte Videos für Content-MarketingDie Geheimwaffe für Content-Creators: KI-gestützte VideogenerierungBild‎🚨 KI wird erschreckend gut.Professionelle KI-Videoerstellung | Filmische KI-Videos | Individuelle VideobearbeitungHand hält Symbole für künstliche Intelligenz und Generierung, einschließlich Text, Bild und Audio – 2 Stockfotos, Vektoren und Videos8 KI-Cartoon-Videogeneratoren, die du 2026 ausprobieren musstKI-Bildgenerierung22 beste und kostenlose KI-Videogeneratoren 2026 🎬🤖 | Erstelle mit KI großartige VideosBildKI-generierte Videos: gut oder schlecht? Hier ist die Wahrheit! 🤖🎥BildInfografik: Wie KI-Bildgenerierung funktioniert | LivePhysics™Video und KI meistern: zentrale Social-Media-Marketingtrends 2025KI-News und aktuelle Updates | Trends und Durchbrüche bei künstlicher IntelligenzKIGPT 5.2, Videoeditor in Echtzeit, KI-Stereovideos, mobile KI-Agenten, Ganzkörpersteuerung: KI-NEWSVideogenerierung 📹Nvidia #NEUE KI-Tools 🤯 #news #ai #openai #chatgpt #highlights #shortsKling.ai: KI-gestützte Text-zu-Video-GenerierungDiese Woche in den KI-News – 15. Aug. 2026Grok 5: Elon Musks KI-Revolution: eine überraschende...Die Zukunft der Kreativität: MrBeast über den Einfluss von KI auf YouTubeHeutige KI-News und ethischer Wandel'Amuse 3.0', ein KI-Kunstwerkzeug, das ... enthältBildEntdecke, wie Grok Video revolutioniert...

Hinweis zur Datenqualität

X lieferte aufgrund einer Diskrepanz bei den Suchbegriffen unter 32 Beiträgen null themenrelevante Posts. Reddit sammelte mit einem einzelnen Suchbegriff nur 12 der angestrebten etwa 20 Threads. Die Bluesky-Such-API war blockiert (403), weshalb mit Account-Feed-Stichproben gearbeitet werden musste; bei YouTube konnten Aufrufzahlen und exakte Daten wegen JavaScript-gerenderter Seiten nicht bestätigt werden.

Galerie