KEN’S CAT LOG

News zur KI-Bild- und Videogenerierung — 2026-09-25

Bei den Closed-Anbietern führt die rasante Verbreitung von Seedance 2.5 und das Ende der Sora-API zu einer Neuordnung. Gleichzeitig kommt das 7B-Modell Qwen-Image-2.1 den größten Closed-Anbietern nahe. Auffällig waren jedoch auch Fälle wie MiniMax H3 und Wan 3.0, bei denen die Bezeichnung „Open Source“ wenig mit der tatsächlichen Verfügbarkeit zu tun hat.

Überblick: KI-News zur Bild- und Videogenerierung — Closed vs. Open Source, wo stehen wir? — 2026-09-25

Hallo! In der Welt der KI-Bild- und Videogenerierung war diese Woche richtig viel los 🔥 Auf der Closed-Seite herrscht mit Seedance 2.5, Nano Banana und dem Ende von Sora praktisch Volksfeststimmung 🎉. Gleichzeitig tritt mit Qwen-Image-2.1 ein Modell mit gerade einmal 7B Parametern direkt gegen die stärksten Closed-Modelle an – und das ist wirklich spannend 👀. Andererseits gibt es mit MiniMax H3 oder Wan 3.0 auch mehrere Fälle von „Pseudo-Open-Source“: Modelle, die als „Open Source!“ beworben werden, aber durch restriktive Lizenzen oder API-Exklusivität stark eingeschränkt sind. Hier ist Vorsicht geboten ⚠️. Auf Reddit und Pinterest schwelt zudem weiterhin der Ärger darüber, dass KI-Inhalte als echt durchgehen. Technik- und Vertrauensfragen werden deshalb gemeinsam diskutiert.

Plattformübergreifend

  • Seedance 2.5 (ByteDance, Closed) ist plattformübergreifend einer der Hauptakteure 🎬. Der Name taucht auf Reddit (Tipps für längere Videos), X (Bearbeitung von MiniMax-H3-Ausgangsmaterial in AE), YouTube (Tutorials zur Massenproduktion von UGC-Werbung) und Lemmy auf. Es ist derzeit offenbar das am stärksten tatsächlich genutzte Closed-Video-Modell.
  • MiniMax H3 (Video-Modell mit offenen Gewichten) gilt als „kostenlos nutzbar“, ist aber kein echtes Open Source 😅. Es ist auf Reddit, X, YouTube und Lemmy Thema. YouTube-Recherchen zeigen jedoch, dass die „MiniMax H3 Community License“ Nutzer in der EU, im Vereinigten Königreich, Südkorea und den USA ausschließt. Viele springen auf den Titel „Open Source“ an, doch die Realität sollte geprüft werden.
  • Qwen-Image-2.1 (Alibaba, offen) tritt mit 7B Parametern gegen Nano Banana 2.0, einen führenden Closed-Anbieter, an 💪. Auf YouTube und Lemmy wird das Modell positiv als klein, aber leistungsfähig bewertet. Es ist ein gutes Beispiel für die Parameter-Effizienz offener Modelle.
  • Die Bezeichnung „Open Source“ wird zunehmend inflationär verwendet 📢. YouTube weist darauf hin, dass nicht nur MiniMax H3, sondern auch Wan 3.0 (Alibaba) häufig mit dem unter Apache 2.0 stehenden Vorgänger Wan 2.2 verwechselt wird, obwohl Wan 3.0 nur per API verfügbar ist. Auch auf Lemmy trennen nur wenige Beiträge sauber zwischen „offen“ und „geschlossen“; das Etikett eilt der Realität voraus.
  • Der Ärger über KI-Inhalte, die sich als echt einschleichen, ist auf mehreren Plattformen ein gemeinsames Thema 😤. Auf Reddit sorgten unerlaubt KI-bearbeitete Immobilienfotos, der Verdacht wissenschaftlicher Fälschung beim Nikon-Small-World-in-Motion-Wettbewerb und entlarvte KI-Bilder auf Instagram für Diskussionen. Auch auf Pinterest gehören Bilder von „Fake-News-Moderatoren“ mit NBC-News-artigen Bauchbinden zu einem festen Genre. Die Vertrauensfrage bleibt eng mit technischen Trends verbunden.
  • Das Ende der Sora-API (OpenAI) am 2026-09-24 zeigt sich plattformübergreifend als Lücke in der Berichterstattung 🕳️. Auf Lemmy wurde es zusammen mit der Meldung verbreitet, ein chinesischer Konkurrent habe 3 Milliarden US-Dollar eingesammelt, aber die Resonanz blieb gering. Auch auf YouTube fanden sich keine spezialisierten Videos; das Interesse ist offenbar bereits zu Nachfolgern wie Seedance und Wan weitergezogen.

Nach Plattform

Reddit sieht immer wieder Fragerunden zum Thema „Wie erstelle ich kostenlos hochwertige KI-Videos?“. Die größten Diskussionen drehten sich jedoch um den Ärger über KI-Immobilienbilder auf r/mildlyinfuriating (27.000 Punkte) und den Verdacht auf Manipulation beim Nikon-Wissenschaftswettbewerb auf r/labrats (1.089 Punkte). Beiträge, die Closed und Open Source klar unterscheiden, sind selten; meist werden nur Toolnamen aufgezählt.

X lieferte wegen eines kroatischen Trendpanels als Suchausgangspunkt 32 irrelevante Beiträge von insgesamt 40 (Krypto, Fußball, Promi-Klatsch) 🙈. Die acht verbleibenden Beiträge handelten fast alle davon, Claude Opus 5.5 After Effects, Blender, Unreal oder Godot steuern zu lassen. Im Mittelpunkt stand weniger die Generierung als vielmehr die Überraschung darüber, dass KI-Agenten bestehende Kreativwerkzeuge bedienen.

YouTube hatte zwar nur wenige Kanäle (7 Beiträge), aber gehaltvolle Inhalte: Schnell reagierende Kanäle testeten GPT Image 2.5, Qwen-Image-2.1, MiniMax H3 und Seedance 2.5 direkt nach Veröffentlichung. Nur hier wurde die unscharfe Grenze zwischen Open und Closed – etwa die Lizenzprobleme bei MiniMax H3 und Wan 3.0 – eindeutig benannt.

Bluesky konnte wegen eines 403-Fehlers der Such-API nicht per Schlüsselwort durchsucht werden 😢; vorhandene Accounts mussten einzeln geprüft werden. Closed-Ankündigungen, etwa neue Modelle auf Replicate, konzentrierten sich auf die erste Hälfte von 2026. Open-orientierte Accounts wie ostris, doctordiffusion und Hugging Face hatten ihre Updates dagegen bereits 2024 bis 2025 eingestellt. Themen wie Qwen-Image-2.1 waren auf Bluesky 2026 kaum sichtbar.

Lemmy hat mit den !stable_diffusion-Communities eine faktische Heimat für Open Source, mit Schwerpunkt auf technischen Themen wie ComfyUI-Integration und HF-Links. Closed-News – das Ende von Sora oder Midjourneys Wechsel zu Medizintechnik – gelangen nur über Crossposts von r/ArtificialInteligence dorthin; mit Scores von meist 0 bis 1 entstanden vor Ort kaum Diskussionen.

Pinterest: Von 50 Pins wurden 20 direkt geöffnet. Zu sehen waren vor allem Closed-Vergleichsgrafiken im Stil „Welche App sollte ich verwenden?“ für Runway, Pika, Kling, Luma und Google/OpenAI sowie Visuals über Misstrauen gegenüber KI. Nicht ein einziges Mal erschienen Namen offener Modelle oder ComfyUI-Screenshots 📌. Die vom Briefing gewünschte Aufteilung in je zehn Open- und Closed-Beiträge ist mit Pinterest allein wegen fehlenden Materials nicht möglich.

Worauf achten

Empfehlungen

  • Kleine offene Modelle wie Qwen-Image-2.1 weiter beobachten und Benchmark-Updates einzeln verfolgen.
  • Bei Modellen, die „Open Source“ behaupten, vor der Einordnung immer die Lizenzbedingungen prüfen – MiniMax H3 und Wan 3.0 sind typische Beispiele.
  • Wechselbewegungen zu Ersatzdiensten wie Seedance, Wan und Kling nach dem Ende der Sora-API als Punkt in die nächste Recherche aufnehmen.
  • Bei der nächsten Bluesky- und Pinterest-Recherche konkrete Begriffe wie „ComfyUI“, „Hugging Face“ und „Flux“ ergänzen, um die schwache Sichtbarkeit offener Modelle auszugleichen.
  • Das auf Reddit und Pinterest gemeinsame Thema des Misstrauens gegenüber KI-Inhalten fortlaufend und nicht losgelöst von Techniknachrichten verfolgen.
  • X nicht mehr anhand des Trendpanels durchsuchen, sondern mit themenspezifischen Schlüsselwörtern neu erheben.

Datenqualität

Auf keiner Plattform wurde das Abschlussziel des Briefings – ungefähr 20 analysierte Beiträge je Netzwerk – erreicht: Reddit 12, X 8 thematisch passende von 40, YouTube 7, Bluesky etwa 12 verwertbare Erkenntnisse aus rund 30 Beiträgen, Lemmy 12, Pinterest 20 geöffnete von 50 Pins. Besonders auf X waren wegen des kroatischen Trendpanels 80 % der Inhalte irrelevant. Bluesky lieferte fortlaufend API-403-Fehler, wodurch keine übergreifende Schlüsselwortsuche möglich war; Pinterest hatte keine nach Open/Closed getrennten Abfragen und daher überhaupt kein Open-Source-Material. Dadurch konzentrieren sich aktuelle Nachrichten insbesondere auf der Open-Source-Seite auf YouTube und Lemmy; die Absicherung durch X, Bluesky und Pinterest ist schwach.

Zusammenfassung nach Plattform

Reddit

Reddit — News zur KI-Bild- und Videogenerierung

Woher

Aufschlüsselung der 12 gesammelten Threads (nur der Suchbegriff „Image and Video Generation AI News“ wurde verwendet):

Subreddit Mitglieder Gesammelte Threads
r/generativeAI 156,863 5
r/labrats 726,659 1
r/aivideomaking 7,660 1
r/mildlyinfuriating 12,593,078 1
r/Instagramreality 1,155,761 1
r/AIdaily_news 3,108 1
r/aiwars 169,389 1
r/antiai 338,300 1

r/generativeAI ist mit fünf Beiträgen das eigentliche „News“-Zentrum, doch die meisten Inhalte sind Fragen nach kostenlosen Videogenerierungsdiensten. Die stärkste Resonanz kam dagegen weder aus einem Fach- noch aus einem Pro-KI-Subreddit, sondern von r/mildlyinfuriating (allgemeine Community mit 12,59 Millionen Mitgliedern) und r/labrats (Forschungscommunity mit 730.000 Mitgliedern) – beide mit Ärger über KI-generierte Inhalte als Thema.

Was Menschen sagen
  • #1 r/generativeAI · 37 Punkte · 36 Kommentare · 2026-09-22 (Link) — Ein unabhängiger Entwickler bewirbt den angeblich unzensierten Bild-, Video- und Textgenerator „Locally Uncensored“. Die Reaktionen sind skeptisch. u/No_Laugh_3115 stellt die Kernfrage: Wenn Upstream-Modelle aktualisiert werden, werde der „unzensierte“ Teil zuerst schlechter – wie werde das gelöst? Mit eigenen Fine-Tunes oder nur durch das Umschließen offener Gewichte?
  • #2 r/labrats · 1,089 Punkte · 131 Kommentare · 2026-09-23 (Link) — Das Sieger-Video des diesjährigen Nikon-Small-World-in-Motion-Wettbewerbs soll mit KI „verstärkt und koloriert“ worden sein; darin tauchten biologisch unmögliche Strukturen auf und verschwanden wieder. u/Barkinsons (618 Punkte): „KI-Tools haben in wissenschaftlichen Mikroskopiebildern keinen Platz. Wir sind verpflichtet, Bilder möglichst getreu wiederzugeben, nicht sie schöner zu machen.“ u/holydiver18 (53 Punkte) kritisiert die Reaktion der Veranstalter scharf: „Das ist eindeutig Betrug.“
  • #3/#9/#11/#12 r/generativeAI · r/aivideomaking (je 16/2/0/4 Punkte, 2026-09-19 bis 22) — Vier getrennte Threads fragen danach, kostenlos KI-Videos zu erstellen – offenbar das häufigste Bedürfnis auf Reddit. Die wiederkehrende Antwort: Echte Kostenlosigkeit, hohe Qualität und keine Wasserzeichen lassen sich nicht gleichzeitig haben. Der Bot Jenna_AI wiederholt diese Argumentation in #9, #11 und #12. Genannte Tools: FramePack, ComfyUI, Grok (10 $/Monat), Venice, Nanobanana/Veo (über Google Flow), Muse (Meta), dreamfort.ai.
  • #4 r/mildlyinfuriating · 26,766 Punkte · 719 Kommentare · 2026-09-21 (Link) — Mit Abstand der höchste Score der Sammlung. Auslöser ist Ärger darüber, dass KI-generierte „Inspirationsbilder“ ohne Kennzeichnung in Immobilienanzeigen gemischt werden. u/slothboy (5,749 Punkte): „Dieses Esszimmer in ein Bad umzuwandeln, wäre ein Projekt mit fünfstelligen Kosten.“ u/BojackWorseman13 (1,138 Punkte) schlägt vor, dass KI-Erzeugung groß auf dem Bild stehen müsse.
  • #5 r/generativeAI · 7 Punkte · 31 Kommentare · 2026-09-23 (Link) — u/kaboom-o (2 Punkte) liefert eine hilfreiche praktische Erklärung für lange KI-Videos: Niemand erstellt sie in einem Durchgang. Man zerlegt das Skript in eine Shotliste, generiert zahlreiche Clips von 5 bis 15 Sekunden und schneidet sie anschließend zusammen. Für längere Gesichtsausdrücke nennt der Beitrag Seedance 2.5 (bis etwa 30 Sekunden, natives Audio), für Bewegungsentwürfe Grok Imagine Video (480p, 5 Sekunden) und für fotorealistische Qualität Gemini Omni Flash.
  • #6 r/Instagramreality · 2,206 Punkte · 351 Kommentare · 2026-09-18 (Link) — Ein Thread weist darauf hin, dass ein auf Reddit hoch bewertetes KI-generiertes Bild gefälscht war. u/Smart-Membership-117 (427 Punkte): „Die Sockelleiste neben dem Knie ist in Foto 2 und 3 unterschiedlich. Auch das Grün außerhalb des Fensters hat sich vollständig verändert.“ u/Habibti-Mimi81 (154 Punkte): „Ehrlich gesagt hätte ich es nicht bemerkt. Es ist eine traurige und gefährliche Zeit.“
  • #7 r/AIdaily_news · 0 Punkte · 12 Kommentare · 2026-09-24 (Link) — Ein Rückblick auf KI-Videos, die 2024 diskutiert wurden. Bezeichnend ist u/Erosion139s Kommentar (1 Punkt): „Damals träumte KI noch“ – viele Kommentare erinnern sich nostalgisch an die merkwürdigen Artefakte jener Zeit.
  • #8 r/aiwars · 0 Punkte · 144 Kommentare · 2026-09-24 (Link) — Kontroverse um einen Animationsclip, der mit Seedance 2.5 von einer Person für 13 $ erstellt worden sein soll. Der Poster lobt eine Zeit, in der man ohne Animator Arbeiten auf Industrieniveau schaffen könne. u/GameMask (4 Punkte) hält dagegen, dass gerade die Kosten von 13 $ unangenehm seien und keinen Fortschritt für die Animationsbranche bedeuteten. u/Onionadin (7 Punkte) kritisiert noch härter: Es wirke, als freue man sich darüber, Menschen besser täuschen zu können.
  • #10 r/antiai · 18,115 Punkte · 623 Kommentare · 2026-09-23 (Link) — Die Anti-KI-Community feiert die Nachricht, dass DreamWorks dem neuen Film „Forgotten Island“ einen Haftungshinweis gegen KI-Training hinzugefügt habe. u/SlowlyDyingInAPit (2,561 Punkte, Top-Kommentar) bleibt nüchtern: Das sei gut, aber KI-Anhänger würden es trotzdem benutzen, um „Slop“ zu produzieren; ein Verbot mache es für manche sogar reizvoller. u/Arckanoid (143 Punkte) analysiert das rechtliche Ziel: Es gehe nicht nur ums Stoppen, sondern darum, eine Grundlage für Klagen zu schaffen.
Signale
  • Sichtbarkeit von Open Source und lokalen Tools: ComfyUI, FramePack, Seedance 2.5 und MiniMax H3 tauchen in mehreren Threads wiederholt auf. Besonders kaboom-os Antwort in #5 wird als praktische Erfahrung zum Kombinieren mehrerer Modelle wahrgenommen.
  • Closed Source wird als fragmentiertes Nutzungserlebnis beschrieben: Bei der Vielzahl von Diensten wie Grok, Veo, Nanobanana, Runway, Luma, Kling, Hailuo und Pixverse hat sich die Resignation etabliert, dass kostenlos, hochwertig und ohne Wasserzeichen nicht gleichzeitig möglich ist. Jenna_AIs Standardkommentar wiederholt sich in drei Threads (#9, #11, #12).
  • Der Konflikt verschärft sich bei der Frage der Erkennbarkeit: #6 (Instagramreality) und #2 (Nikon) zeigen Ärger darüber, dass KI-Erzeugnisse als echt konsumiert werden. #8 (aiwars) stellt die positive Sicht auf Demokratisierung der Technik direkt der Sicht gegenüber, sie sei ein Täuschungswerkzeug. Die Spaltung ist auf Reddit sichtbar.
  • Überraschend: Bei einem renommierten wissenschaftlichen Wettbewerb wie Nikon Small World in Motion gewann ein Video mit KI-„Verstärkung“ – faktisch Manipulation – den Hauptpreis, und die Veranstalter reagierten trotzig (#2). Die wissenschaftliche Community sieht darin nicht nur eine Debatte über KI-Kunst, sondern ein Problem der Forschungsethik.
  • Ignoriert oder bereits resigniert akzeptiert: Fragen nach „kostenlosen hochwertigen KI-Videos“ (#3, #9, #11, #12) enden immer wieder beim gleichen Fazit: Kostenlos gibt es nicht, denn Strom- und GPU-Kosten zahlt immer jemand. Die Community ist dieses Thema offenbar leid.
Einschränkungen
  • Es wurde nur nach "Image and Video Generation AI News" gesucht, nicht mit alternativen Formulierungen oder einzelnen Namen offener Modelle und Closed-Dienste. Statt der angestrebten etwa 20 analysierten Beiträge wurden nur 12 Threads erhoben.
  • Für Thread #6 (r/Instagramreality) und #7 (r/AIdaily_news) enthielten die Daten keinen eigentlichen Beitragstext; der Inhalt wurde nur anhand der Top-Kommentare erschlossen.
  • Die Sammlung ist vollständig auf englischsprachige Subreddits konzentriert; japanische oder andere nicht englischsprachige Reddit-Communities wurden nicht gefunden.
  • Nur wenige Threads unterscheiden explizit zwischen Closed Source und Open Source. Meist werden beide Kategorien in Toollisten vermischt, weshalb das vom Briefing verlangte saubere Verhältnis von zehn Open- und zehn Closed-Entwicklungen nicht allein aus Reddit abgeleitet werden konnte.

X

X — Claude Opus 5.5s agentische Übernahme kreativer Tools ist im betrachteten Zeitraum das einzige Signal für Bild-/Video-KI

Herkunft dieser Liste

Das X-Explore-Panel, das die Suchbegriffe lieferte, war auf Kroatien lokalisiert (output/x.posts.md, „What X says is happening“): Sechs der zehn Trends sind ausdrücklich „Trending in Croatia“, die übrigen sind allgemeine Trends aus Sport, Musik, Wirtschaft und Technik. Es handelt sich also um eine lokale kroatische X-Aufnahme, nicht um eine globale. Nur zwei der zehn Begriffe – „Opus 5.5“ und „Claude“ – betreffen überhaupt KI-Bild- oder Videogenerierung; die anderen acht ($song, Serbia, Taylor, Cardano, Croats, Croatia, NFTs, England) sind nicht relevante Krypto-, Fußball-, Promi- und Geopolitik-Themen. Siehe ## Limits für die Folgen für die Abdeckung.

Accounts

Alle Accounts zum Thema veröffentlichten nur einmal, bis auf einen:

  • @KanaWorks_AI (KANA|東京AI映像) — der einzige wiederkehrende Account mit 2 Beiträgen (150 + 335 Likes). Ein auf KI-Video spezialisierter Account aus Tokio; beide Beiträge behandeln Claude Opus 5.5 in Spiele-Engines, erst Unreal, dann Godot.
  • @kevin_t_ngo (Kevin Ngo) — 1 Beitrag, aber die größte Reichweite der Sammlung: 3.480 Likes und rund 236.000 Aufrufe. Verlinkt @claudeai direkt; eine Python/Blender-Animation wurde „von Claude Opus 5.5“ gerendert.
  • @developedbyed (Dev Ed) — 1 Beitrag, 1.071 Likes und etwa 70.000 Aufrufe. Ein bekannter Dev-Education-Account mit einem direkten Vergleich „OPUS 5.5 vs GPT 6 Astra“ für Animationen.
  • @ring_hyacinth — 1 Beitrag, 712 Likes und rund 44.000 Aufrufe. Ein einzelner Kreativer berichtet über ein persönliches Experiment: Aus einem alten Kurzfilm ein Pixel-Art-Spiel machen.
  • @aicreataro — 1 Beitrag, 444 Likes und rund 45.000 Aufrufe. Ein KI-Creator-Account mit strukturiertem Testprotokoll aus Basisklip und After-Effects-Arbeitsschritten.
  • @seiiiiiiiiiiru (SEIIIRUAIを使う映像クリエイター) — 1 Beitrag, 163 Likes und etwa 7.900 Aufrufe. Ein japanischer KI-Video-Creator, der sich selbst über sein verwendetes Tool beschreibt.
  • @ponzponz15 (ぽんず) — 1 Beitrag, 212 Likes und rund 32.000 Aufrufe. Ein japanischer Creator, der eine konkrete Schnitttechnik dokumentiert.

Damit bleibt: ein spezialisierter KI-Video-Account mit zwei Beiträgen und sechs einzelne Kreative mit jeweils einer gut laufenden Demo bzw. einem Test. Keiner der Accounts ist ein Nachrichten- oder Branchenmedium; alles ist persönliches „Ich habe das ausprobiert“-Material.

Beiträge
  1. @developedbyed (1.071 Likes · 26 Reposts · 35 Antworten · ~70.000 Aufrufe · 2026-09-23) — https://x.com/developedbyed/status/2102789774461280370

    OPUS 5.5 vs GPT 6 Astra Loss Screen Animation
    Ein direkter Modellvergleich für Animationen von einem Account mit großem Entwicklerpublikum – der nächste Beitrag dieser Auswahl zu einem Benchmarking „Closed Source vs. Closed Source“.

  2. @kevin_t_ngo (3.480 Likes · 167 Reposts · 81 Antworten · ~236.000 Aufrufe · 2026-09-23) — https://x.com/kevin_t_ngo/status/2102761406315839798

    Thank you @claudeai ! GIF animated in Python and rendered in Blender by Claude Opus 5.5
    Der Beitrag mit dem höchsten Engagement der gesamten 40-Post-Sammlung. Er zeigt vor allem echte Überraschung darüber, dass ein LLM einen 3D-Renderer Ende zu Ende steuern kann, statt nur ein statisches Bild zu erzeugen.

  3. @ring_hyacinth (712 Likes · 81 Reposts · 51 Antworten · ~44.000 Aufrufe · 2026-09-23) — https://x.com/ring_hyacinth/status/2102865595675050010

    Opus 5.5 is really amazing! I sent the short film Pixel Shanghai that I made a year ago to Opus 5.5, asking him to turn this video into a pixel game about Shanghai, where the protagonist Xiaoman collects 42 memories about Shanghai in this city. The scenes use the pixel [Text von X abgeschnitten]
    Umwandlung von Video in Spiel-Assets: Opus dient als kreative Regieebene für vorhandenes Material, nicht als Generator von Grund auf.

  4. @aicreataro (444 Likes · 66 Reposts · 7 Antworten · ~45.000 Aufrufe · 2026-09-23) — https://x.com/aicreataro/status/2102656273112326609

    Opus 5.5にAfter Effectsを操作させて、AI動画を加工するテスト。■ベース MiniMax H3で15秒を1本 ■AEでやらせたこと ・カットの切れ目を拍に合わせて速さを調整 ・区間ごとにエフェクトを1つずつ(粒子/光線/万華鏡/データモッシュなど)■わかったこと [abgeschnitten]
    Nennt mit MiniMax H3 ein konkretes Videogenerierungsmodell als Basisschicht für einen 15-Sekunden-Clip; Opus 5.5 übernimmt die Nachbearbeitung in After Effects. Das liefert ein konkretes Detail zu einer Open-/Closed-Pipeline.

  5. @KanaWorks_AI (335 Likes · 39 Reposts · 16 Antworten · ~18.000 Aufrufe · 2026-09-24) — https://x.com/KanaWorks_AI/status/2102955708321062975

    Claude Opus 5.5 × Godotで3Dゲーム開発。Godotでゲームを作るのは、Unityより少し手軽に感じる。動作も軽くて、仕上がりもかなりいい感じ
    Der zweite Beitrag desselben Accounts zeigt, dass es keine Einzelaktion ist: Der Account testet Opus 5.5 als kleine Serie mit verschiedenen Engines.

  6. @KanaWorks_AI (150 Likes · 16 Reposts · 11 Antworten · ~8.300 Aufrufe · 2026-09-24) — https://x.com/KanaWorks_AI/status/2103138051165933661

    Claude Opus 5.5 × Unreal まさか、自分でこんなARPGを作れる日が来るなんて思ってもいませんでした。コントローラーを握って、キャラクターを走らせて、ローリングして、剣を振る。実際に動かしてみた瞬間、心臓がドキドキして、手のひらは汗びっしょり。
    Eine emotionale Ich-Perspektive auf ein mit Opus 5.5 in Unreal erstelltes spielbares ARPG – als persönlicher Meilenstein, nicht als Produktankündigung.

  7. @ponzponz15 (212 Likes · 17 Reposts · 7 Antworten · ~32.000 Aufrufe · 2026-09-24) — https://x.com/ponzponz15/status/2102931824918106499

    3Dカメラ×立体テキスト演出② After Effectsで作るような編集がClaude OpusやCodexでも可能に。上 Seedance 2.5 prev 下 Codex + Hyperframes skill #dreaminacpp
    Nennt zwei weitere Bausteine – Seedance 2.5 für Videogenerierung und einen Codex + „Hyperframes“-Skill –, die mit Claude zu After-Effects-artigen Motion Graphics kombiniert werden.

  8. @seiiiiiiiiiiru (163 Likes · 23 Reposts · 9 Antworten · ~7.900 Aufrufe · 2026-09-24) — https://x.com/seiiiiiiiiiiru/status/2103227982592831846

    AI広告動画 → AI音声 × AI編集 もうここがゴール地点ってことでいいでしょ。笑 Cluad Opus 5.5にGemini 3.8 Flash TTSでナレーション生成させて、その音声に合わせた動画をそのままClaudeでAEやその他ツールを操作して作りました。
    Eine vollständige Werbevideo-Pipeline: Gemini 3.8 Flash TTS erstellt die Sprecherstimme, Claude Opus 5.5 steuert After Effects und weitere Tools, um den Schnitt daran auszurichten.

Signale
  • Im Aufwind: Auf X geht es nicht um „Prompt eingeben, Bild/Video erhalten“, sondern um Claude Opus 5.5 als Agenten, der bestehende Kreativsoftware wie After Effects, Blender, Unreal und Godot über Clips oder Assets aus anderen Quellen steuert. Alle relevanten Beiträge behandeln genau das als neue, aufregende Fähigkeit.
  • Im Aufwind: ein Verkettungsmuster – ein spezialisiertes Generierungsmodell produziert das Rohmaterial (MiniMax H3, Seedance 2.5, Gemini 3.8 Flash TTS), Opus 5.5 übernimmt Montage, Nachbearbeitung und Regie. Zwei Beiträge (@aicreataro, @ponzponz15) nennen den Upstream-Generator explizit.
  • Überraschend: Beim engagiertesten Beitrag (@kevin_t_ngo, ~236.000 Aufrufe) geht es nicht um Ausgabequalität, sondern darum, dass ein LLM Blender Ende zu Ende bedienen kann. Die Reaktion betrifft Fähigkeit und Handlungsmacht, nicht visuelle Treue.
  • Ausgeblendet/fehlend: In den in diesem Zeitraum auf X gefundenen Beiträgen gibt es keine Erwähnung von Midjourney, Stable Diffusion, Flux, Sora, Runway, Kling oder einer expliziten „Open Source vs. Closed Source“-Einordnung. Jede spätere Einordnung dieser Art wäre daher eine Schlussfolgerung und kein X-Zitat.
Einschränkungen
  • Die Suchbegriffe kamen aus X-Trends, nicht aus dem Thema. Die zehn Begriffe stammten direkt aus dem kroatisch lokalisierten Explore-Panel von X. Nur „Opus 5.5“ und „Claude“ waren thematisch relevant; die anderen acht ergaben Krypto-Pumping, Fußballergebnisse, Promi-Klatsch und politische Debatten auf dem Balkan – 32 der 40 gesammelten Beiträge waren für dieses Briefing unbrauchbar.
  • Unter dem Ziel von etwa 20 Beiträgen. Nur 8 von 40 Beiträgen passen zum Thema. Das ist eine Abdeckungslücke der Erhebung, nicht eine Lücke beim Lesen.
  • Keine direkten Beiträge zu Open Source vs. Closed Source. Kein gesammelter Beitrag verwendet diese Gegenüberstellung explizit. Die Zuordnung wird aus den erwähnten Tools abgeleitet.
  • Mehrere Beitragstexte sind abgeschnitten, genau an der Stelle, an der die X-Sammlung endete (@aicreataro, @ring_hyacinth, @pfPokeFUN und andere).
  • Es erschienen nur englische und japanische Beiträge; chinesische, koreanische oder andere Kreativ-Communities auf X wurden nicht abgedeckt.

YouTube

YouTube — News zur KI-Bild- und Videogenerierung (Closed Source/Open Source)

Kanäle

Die Abonnentenzahlen waren auf der JavaScript-gerenderten YouTube-Suchergebnisseite nicht direkt abrufbar (siehe ## Limits); aufgeführt sind nur Daten, die per oEmbed und Websuche gefunden wurden.

  • AI WITH Rithesh (RitheshSreenivasan, etwas über 10.000 Abonnenten, mehr als 1 Million Gesamtaufrufe) — indischer KI-Bildungskanal. Bewertet sowohl OpenAIs ChatGPT Images 2.5 als auch Alibabas Qwen-Image-2.1 direkt nach Veröffentlichung und ermöglicht damit einen seltenen Blick auf beide Lager.
  • Astrovah (@astrovah) — KI-Tool-Kanal für Kreative mit einem Video im Stil einer ehrlichen Bewertung von GPT Image 2.5.
  • REBEL AI (@realrebelai) — veröffentlichte eine Early-Access-Demo zu Qwen-Image 2.1; ein Showcase für ein Open-Source-Bildmodell.
  • Adrian Viral AI Marketing (@AdrianViralAIMarketing) — Vergleichskanal für KI-Marketer, der neue Modelle unabhängig von Open oder Closed zusammenfasst und rankt.
  • Miko (@MikoxAI) — Tutorial-Kanal zur Massenproduktion von UGC-Werbung mit Closed-Video-Modellen wie Seedance 2.5.
  • jingchen573 — spezialisiert auf lokale Ausführung in ComfyUI und berichtete schnell über die Veröffentlichung offener MiniMax-H3-Gewichte.
Videos
  1. Qwen-Image-2.1 Is INSANE… Just 7B Parameters?! — AI WITH Rithesh — etwa 2026-09-20, direkt nach Veröffentlichung von Qwen-Image-2.1 — https://www.youtube.com/watch?v=3qGl0wiv2G0
    Testet Alibabas am 2026-09-20 veröffentlichtes Open-Weight-Bildmodell Qwen-Image-2.1 mit nur 7B Generator-Parametern und berichtet von Benchmarks auf Niveau des Closed-Modells Nano Banana 2.0 von Google.

  2. Qwen-Image 2.1 | Early Access Showcase — REBEL AI — Ende 2026-09 — https://www.youtube.com/watch?v=tP_gGGJzEqg
    Demonstriert Generierungsbeispiele im Early Access. Hervorgehoben wird, dass ein Modell sowohl Bilder mit Transparenz erzeugen als auch bearbeiten kann.

  3. [ComfyUI] Breakthrough Release: MiniMax H3, the New Leading Open-Source Video Model — jingchen573 — etwa 2026-08-03, Zeitpunkt der Open-Weight-Veröffentlichung von MiniMax H3 — https://www.youtube.com/watch?v=XJ4mHfQzZ7I
    Berichtet über die Hugging-Face-Veröffentlichung von MiniMax H3 (33 Milliarden Parameter, omni-modal, bis 2K/24 fps und natives Stereo-Audio) samt ComfyUI-Installation. Der Titel nennt es „Open Source“, tatsächlich schließt die Lizenz jedoch EU, UK, Südkorea und USA aus (siehe ## Signals).

  4. ChatGPT Images 2.5 Is INSANE… 48 Hours Later, I'm Still Shocked! — AI WITH Rithesh — etwa 2026-09-10, zwei Tage nach Veröffentlichung von GPT Image 2.5 — https://www.youtube.com/watch?v=LYUr4BY33h4
    Testet OpenAIs am 2026-09-08 veröffentlichtes ChatGPT Images 2.5 mit bis zu 50 % geringerer Latenz und der neuen Funktion „Sketch“ 48 Stunden nach dem Start.

  5. GPT Image 2.5 - Creative Use Cases You've Probably Missed And A Honest Review — Astrovah — etwa 2026-09-21 — https://www.youtube.com/watch?v=_S71zN5tgQY
    Eine ehrliche Bewertung weniger offensichtlicher, aber praktischer Einsatzmöglichkeiten des Modells.

  6. I Ranked Every New AI Video Model (Omni 1.1, Seedance 2.5, H3 Max, Wan 3.0, Flux 3, Grok) — Adrian Viral AI Marketing — Ende 2026-08, etwa vor einem Monat — https://www.youtube.com/watch?v=4BoTXsJrxQ4
    Rankt Gemini Omni 1.1, Seedance 2.5 und Grok (Closed) neben Wan 3.0 und Flux 3, einschließlich Modellen, die häufig fälschlich für offen gehalten werden. Ein „Was sollte man jetzt nutzen?“-Video mit gemischten Kategorien.

  7. Seedance 2.5 + Grok Bot = 50 Viral AI UGC Ads a Day (Full Tutorial) — Miko — 2026-08-22 — https://www.youtube.com/watch?v=mcY7ReDNrd0
    Praktisches Tutorial zur Kombination der Closed-Modelle Seedance 2.5 und Grok für die Massenproduktion von UGC-Werbung. Ein typisches Beispiel dafür, wie einzelne Kreative Closed-APIs als kommerzielle Pipeline einsetzen.

Signale
  • Die Grenze zwischen Open und Closed wird unscharf: Viele Videotitel bezeichnen MiniMax H3 als „Open Source“, obwohl die tatsächliche MiniMax H3 Community License USA, EU, UK und Südkorea ausschließt. Häufig wird nicht zwischen offenen Gewichten und wirklich frei nutzbarem Open Source unterschieden.
  • Wan 3.0 ist ebenfalls nicht offen: Die neueste Wan-Serie von Alibaba, Wan 3.0 (API-Veröffentlichung etwa am 2026-08-06), stellt weder Gewichte auf Hugging Face noch auf GitHub bereit und ist ausschließlich per API nutzbar. YouTube-Vergleiche verwechseln es häufig mit Wan 2.2 unter Apache 2.0, wodurch leicht der Eindruck entsteht, alle Wan-Modelle seien Open Source.
  • Ein offenes 7B-Modell tritt gegen Marktführer an: Qwen-Image-2.1 gilt trotz nur 7B Generator-Parametern als mit Nano Banana 2.0 vergleichbar. Parameter-Effizienz wird damit zu einem wichtigen Narrativ der Open-Source-Seite.
  • Closed-Anbieter differenzieren sich über Bearbeitungs-UX: Bei GPT Image 2.5 liegt der Schwerpunkt der Reviews weniger auf der Rohqualität als auf Funktionen wie „@Sketch“ für Skizze-zu-Bild und konsistenter Mehrschritt-Bearbeitung. Der Wettbewerb verlagert sich von reiner Generierung zu Bearbeitungsworkflows.
  • Videogenerierung wird zunehmend zur Toolkette: Tutorials wie Mikos Kombination aus Seedance 2.5 und Grok für UGC-Werbung zeigen, dass das Interesse von Modellvergleichen zu der Frage wandert, wie mehrere Modelle zur Monetarisierung kombiniert werden können. Das stimmt mit den X-Ergebnissen überein.
  • OpenAI Sora ist eine Nachrichtenlücke: Die Sora-API war am 2026-09-24, einen Tag vor dieser Recherche, bereits eingestellt. Auf YouTube fanden sich jedoch keine spezialisierten Videos dazu, nur Blogartikel. Das Interesse der YouTuber scheint bereits zu Seedance, Wan, Kling und anderen Alternativen weitergezogen zu sein.
Einschränkungen
  • Die YouTube-Suchergebnisseite (youtube.com/results?...) ist JavaScript-gerendert; WebFetch konnte die Videoliste mit Titeln, Aufrufen und Veröffentlichungsdaten nicht direkt abrufen. Stattdessen wurden WebSearch (site:youtube.com) und die YouTube-oEmbed-API kombiniert. Titel und Kanalnamen wurden über oEmbed bestätigt, Veröffentlichungsdaten aus relativen Snippets abgeleitet.
  • Bei den meisten Videos konnten weder Aufrufe noch Abonnentenzahlen erhoben werden. oEmbed liefert keine Aufrufe; WebSearch-Snippets enthalten oft keine Zahlen. Daher enthält die Videoliste keine Aufrufzahlen.
  • Viele Veröffentlichungsdaten sind Schätzungen aus Angaben wie „vor n Tagen/Wochen“ und keine exakten Daten. Das betrifft besonders #1, #2, #5 und #7.
  • Das Ziel von rund 20 analysierten Beiträgen wurde nicht streng erfüllt. Es wurden sieben Videos gesammelt, was innerhalb der Playbook-Spanne von 5 bis 12 liegt, aber unter dem plattformübergreifenden Ziel von etwa 20. Ursache ist die nicht abrufbare Suchergebnisseite.
  • Es wurde kein spezialisiertes YouTube-Video zum Ende der Sora-API gefunden. Blog- und Nachrichtenseiten berichteten darüber, auf YouTube könnte das Thema jedoch unter Nachfolger- und Toolvorstellungen verborgen sein.
  • Kommentare wurden nicht analysiert. Die Analyse beschränkt sich auf Titel und Beschreibungen, da Videoseiten nicht vollständig abrufbar waren.

Bluesky

Bluesky — Aktuelle Nachrichten zur KI-Bild- und Videogenerierung

Accounts
  • replicate.com (Replicate) — kündigt neue API-Modelle unabhängig davon an, ob sie Closed oder Open sind. Der einzige Account, der 2026 regelmäßig Neuigkeiten zur KI-Bild- und Videogenerierung postet.
  • ostris.com (Ostris / Entwickler von AI-Toolkit) — berichtet über LoRA-Fine-Tuning offener Modelle wie FLUX, Flex und Wan2.1. Seit April 2025 keine Updates mehr.
  • doctordiffusion.bsky.social — Ersteller des Stable-Diffusion-3.5-Ablegers „Absynth“, berichtet auch über LoRA-Training für HunyuanVideo. Seit März 2025 keine Updates.
  • reach-vb.hf.co / hf.co (offizielle Hugging-Face-Accounts und Mitarbeitende) — stellen Spaces mit offenen Modellen vor. Der letzte bild- oder videogenerierungsbezogene Beitrag stammt aus Dezember 2024.
  • simonwillison.net — unabhängiger KI-Forscher. Nicht auf Bildgenerierung spezialisiert, aber mit Beiträgen zu multimodalen Frontier-LLM-Funktionen; im September 2026 weiterhin aktiv.
  • midjourneynews.bsky.social — Fan-/Community-Account für Midjourney-Prompt-Experimente. Geringes Engagement, aber bis Juni 2026 sporadisch aktiv.
Beiträge
Closed-Source-Seite
  1. GPT Image 2 (OpenAI) auf Replicate ergänzt — „Killer photorealism and crisp text rendering with strong adherence to layouts, UI, and design use cases.“
    2026-04-21|Likes 5 · Reposts 0|https://bsky.app/profile/replicate.com/post/3mjzygaefs224

  2. Seedance 2.0 (ByteDance) für alle Nutzer allgemein verfügbar — Vereinigt Text, Bild, Video und Audio und generiert Studio-Videoqualität mit synchronem Stereo-Audio und Physiksimulation.
    2026-04-09|Likes 2 · Reposts 1|https://bsky.app/profile/replicate.com/post/3mj3junhvnh26

  3. Testbericht zu Seedance 2.0 — „We've spent a lot of time with Seedance 2.0. Here is what we found.“ mit Link zum Replicate-Blog.
    2026-04-15|Likes 1 · Reposts 0|https://bsky.app/profile/replicate.com/post/3mjkkogr7nd2f

  4. Vidu Q3 erscheint auf Replicate — Videoerzeugung aus Text, Bild sowie Start-/Endframe, bis 16 Sekunden/1080p und mit Audio-Synchronisierung.
    2026-03-11|Likes 1 · Reposts 0|https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w

  5. Runway Gen-4.5 startet — bewirbt „unprecedented physical accuracy and realism“ für die neue Videogenerierungs-Generation.
    2026-02-18|Likes 2 · Reposts 0|https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c

  6. Kling 3.0 / o3 auf Replicate ergänzt — Multi-Shot-4K-Generierung, Audio-Synchronisierung, bis 15 Sekunden sowie Videobearbeitung und Stiltransfer.
    2026-02-17|Likes 2 · Reposts 0|https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q

  7. GPT-6 Astra + Blender erzeugen einen 3D-Pelikan — Simon Willisons Experiment, bei dem GPT-6 Astra schrittweise ein Blender-Modell erstellt. Zeigt einen Workflow von Bildgenerierung zu 3D.
    2026-09-05|Likes 406 · Reposts 30|https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s

Open-Source-Seite (2024–2025, keine aktuellen Updates gefunden)
  1. Flex.2-preview veröffentlicht — „text to image, universal control (line, pose, depth), and inpainting all baked into one model. Fine tunable with AI-Toolkit, Apache 2.0 license, 8B parameters.“
    2025-04-22|Likes 4 · Reposts 0|https://bsky.app/profile/ostris.com/post/3lngo5cf66k2a

  2. LoRA-Fine-Tuning für HiDream unterstützt — verfügbar über AI-Toolkit CLI/GUI, mindestens 36 GB VRAM.
    2025-04-16|Likes 3 · Reposts 0|https://bsky.app/profile/ostris.com/post/3lmxfwzrjlc2v

  3. Ferienvideo eines per LoRA trainierten „KI-Ichs“ mit HunyuanVideo — auch die Trainingsmethode mit diffusion-pipe wird geteilt.
    2024-12-25|Likes 1 · Reposts 0|https://bsky.app/profile/doctordiffusion.bsky.social/post/3le5ovtycmk23

  4. Absynth 2.0 veröffentlicht (Stable-Diffusion-3.5-Ableger) — „SD3.5 Lives! 🎨🤖“, Verteilung über Civitai/Hugging Face.
    2025-01-19|Likes 3 · Reposts 0|https://bsky.app/profile/doctordiffusion.bsky.social/post/3lg36y7u2i22x

  5. Wöchentliche Hugging-Face-Spaces-Zusammenfassung — stellt offene Bildgenerierungs-Spaces wie „Flux Kolors Character“ und „JanusFlow 1.3B“ vor.
    2024-11-18|Likes 7 · Reposts 0|https://bsky.app/profile/reach-vb.hf.co/post/3lb7slz2ycc2j

Signale
  • Closed Source erhielt in der ersten Jahreshälfte 2026 rasch aufeinanderfolgende Updates: OpenAI GPT Image 2, ByteDance Seedance 2.0, Kling 3.0, Runway Gen-4.5 und Vidu Q3 erschienen konzentriert zwischen Februar und April. Multi-Shot, Audio-Synchronisierung und 4K/1080p werden zum Standard. Auf Bluesky ist Replicate nahezu die einzige Primärquelle.
  • Open-Source-Kommunikation zu Bild und Video ist auf Bluesky faktisch zum Stillstand gekommen: Kreative wie ostris und doctordiffusion sowie offizielle Hugging-Face-Accounts, die über Fine-Tuning für FLUX/Flex/Wan2.1/HunyuanVideo posteten, stellten bild- und videobezogene Updates Ende 2024 bis Frühjahr 2025 ein. Die Websuche bestätigte dagegen reale Veröffentlichungen offener Gewichte im Jahr 2026 – Qwen-Image-2.1 am 20. September, HunyuanImage 3.0 und Z-Image Turbo –, die auf Bluesky nahezu unsichtbar blieben.
  • Das Engagement ist insgesamt klein: Abgesehen von Accounts mit allgemeinem Tech-Publikum wie Simon Willison liegen die Like-Zahlen meist nur im ein- bis niedrigen zweistelligen Bereich. Bluesky scheint kein primärer Informationshub für dieses Feld zu sein; X, Discord und Hugging Face sind wahrscheinlich wichtiger.
Einschränkungen
  • app.bsky.feed.searchPosts, die offizielle Such-API, lieferte für alle getesteten Schlüsselwörter wie „image generation AI“ und „nano banana“ fortlaufend HTTP 403. Die Webversion von bsky.app/search ist JavaScript-getrieben und per WebFetch nicht auslesbar. Als Ersatz wurden per Websuche gefundene Accounts einzeln über getAuthorFeed geprüft.
  • Dadurch basiert die Recherche nicht auf einer vollständigen Schlüsselwortsuche, sondern nur auf Beiträgen bereits entdeckter Accounts. Relevante, aber nicht gefundene Accounts und Posts fehlen vermutlich.
  • Erwartete Accounts wie Black Forest Labs, fal.ai, Stability AI und Civitai konnten auf Bluesky nicht aufgelöst werden; sie existieren entweder nicht oder sind wie civitai.bsky.social leere Accounts mit 19 Followern und 0 Beiträgen.
  • Für wichtige Open-Weight-Releases 2026 wie Qwen-Image-2.1, HunyuanImage 3.0 und Z-Image Turbo wurden keine Primärposts auf Bluesky gefunden.
  • Gegenüber dem Ziel von etwa 20 analysierten Beiträgen je Netzwerk wurden von sechs Accounts rund 30 Kandidaten gesammelt und zwölf konkrete Erkenntnisse berichtet. Wegen der defekten Such-API war eine verlässliche Erweiterung kaum möglich.

Lemmy

Lemmy — Aktuelle Entwicklungen der KI-Bild- und Videogenerierung

Communities
  • !«メールアドレス» (auch auf lemmy.world föderiert sichtbar) — 5.71K Abonnenten, davon 894 lokal. Ort für Gespräche über bevorzugte KI-Kunsttechnologien; Schwerpunkt auf Technikthemen mit offenen Gewichten, ComfyUI-Integration und HF-/GitHub-Links. Die faktische Heimat des Themas auf Lemmy.
  • !«メールアドレス» — 2.36K Abonnenten, davon 362 lokal, 3.55K Beiträge, 31 täglich und 97 wöchentlich aktive Nutzer. Ein Ort zum Teilen von mit Stable Diffusion oder offenen Gewichten erzeugten Werken, nahezu täglich aktiv.
  • !share_anime_art (Teil des stable_diffusion_art-Umfelds) — KI-generierte Kunst mit Animefiguren, etwa Fate, Idolmaster und Disgaea.
  • !stable_diffusion_abstract / !stable_diffusion_mycology (kleine Communities aus dem stable_diffusion_art-Umfeld) — Nutzer PapaSkwat erzeugt fortlaufend abstrakte Kunst und Pilzmotive mit eigener, auf Öl- und Acrylbildern trainierter LoRA auf lokalem SDXL.
  • !ai_reddit (Instanz unbekannt, vermutlich automatischer Crosspost von r/ArtificialIntelligence) — viele Closed-News zu Sora-API-Ende, Nano Banana, Seedance, Veo und Kling, aber Scores von meist 0 bis 1 und kaum echte Gespräche.
  • !hackernews (Hacker-News-Mirror-Community) — einzelne Links zu offiziellen Ankündigungen wie Qwen-Image-2.1 und Seedance 2.5.
  • Hinweis: !«メールアドレス», !«メールアドレス» und !«メールアドレス» sind ebenfalls KI-Communities, aber nicht speziell auf Bild-/Videogenerierung ausgerichtet.
Beiträge
  1. Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency — !stable_diffusion, Score 13, 2026-09-22. Neue Version eines Open-Weight-Bildmodells mit 7B Parametern, nativer 2K-Ausgabe, RGBA-Transparenz und Bearbeitung mit bis zu zehn Bildern. https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
  2. Qwen-Image-2.1: Compact, efficient, and unified image creation — !hackernews, Score 2, 2026-09-20. Offizielle Qwen-Ankündigung. https://qwen.ai/blog?id=qwen-image-2.1
  3. ComfyUI-Fantastic-MiniMaxH3-PromptBuilder / ComfyUI_MinimaxH3_AutoContext / comfyui-obvpm-timeline — !stable_diffusion, Score 1 bis 6, 2026-09-16 bis 09-22. Eine Reihe neuer ComfyUI-Tools für längere MiniMax-H3-Videos und Prompt-Verwaltung.
  4. tencent/HunyuanVideo-I2V — !stable_diffusion, Score 5. Open-Source-Modell für Bild-zu-Video mit FP8-Modell und ComfyUI-Workflow. https://huggingface.co/tencent/HunyuanVideo-I2V
  5. I ran the same prompt through 6 AI video models and had ~40 people blindrank the results — !ai_reddit, Score 1, 2026-09-17. Subjektive Bewertung: Veo auf Platz 1, Seedance 2.5 knapp dahinter auf Platz 2 und Hailuo mit deutlichem Abstand Letzter. https://www.reddit.com/r/ArtificialInteligence/comments/1wipgwa/
  6. OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !ai_reddit, Score 1, 2026-09-20. Fazit: Auffällige Consumer-Produkte seien gescheitert, während unauffällige Enterprise-Angebote wie Synthesia, Heygen, Kling und Argil Geld verdienten. https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
  7. Seedance 2.5 offizielle Ankündigung — !hackernews, Score 3, 2026-08-01. Verbesserungen wie 30-Sekunden-Videos und bis zu 50 Referenzbilder. https://seed.bytedance.com/en/blog/
  8. Google quietly discontinues its Earth AI feature a day after its rollout — !ai_reddit, Score 1, 2026-08-07. Google nahm die Integration von Nano Banana 2 in Google Earth nach 24 Stunden zurück, nachdem Nutzer gefälschte Katastrophen- und Konfliktbilder realer Orte erzeugt hatten. https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/
  9. Nano Banana 2 Lite offizielle Seite — !hackernews, Score 1, 2026-06-30. Start als kostengünstiges Bildgenerierungsmodell für etwa 3 Yen pro Bild. https://deepmind.google.com/models/gemini-image/flash-lite/
  10. Microsoft's MAI-Image-2.5 Pulls Even With Google's Nano Banana 2 on Benchmarks — !ai_reddit, Score 1, 2026-05-28. Aufstieg auf Platz 3 der Arena-Bestenliste. https://www.reddit.com/r/ArtificialInteligence/comments/1tpu2cd/
  11. Midjourney pivots from AI image generation to body scanning medical spa / Midjourney Medical — !technology (Score 58) / !hackernews / !techtakes (Score 40), 2026-06-18 bis 19. Überraschende Nachricht, dass Midjourney von Bildgenerierung zu „Ultrasonic CT“-Medizinscannern wechsle. Im selben Zeitraum erschien auch die Meldung „Midjourney wants Hollywood studios to reveal AI usage“ (!technology, Score 73, 2026-07-05) über eine Klage zur Offenlegung von KI-Nutzung. https://www.theregister.com/ (Midjourney medical spa), https://techcrunch.com/ (Hollywood AI usage)
  12. Same Berserk spread, 4 AI colorizations. Looks like GPT wins again? — !ai_reddit, Score 1, 2026-09-14. Vergleicht automatische Manga-Kolorierungen durch ChatGPT Images 2.5, Wan 2.7 Pro, Nano Banana Pro und Seedream 5.0 Pro; ChatGPT wird bei der Erhaltung der Linienführung vorn gesehen. https://www.reddit.com/gallery/1wfyqdy
Signale
  • Lemmy selbst steht KI kühl gegenüber: In einem Beitrag „Where are the AI user communities on Lemmy?“ antwortet der höchstbewertete Kommentar mit 36 Stimmen, man solle außerhalb des Fediverse suchen, denn Lemmy neige zu Anti-KI. Die eigentlichen Auffangräume für KI-Interessierte sind die !stable_diffusion-Communities auf der db0-Instanz.
  • Die Open-Source-Seite dokumentiert vor allem das Bauen und Nutzen: !stable_diffusion konzentriert sich auf ComfyUI-Nodes und Hugging-Face-Modelllinks, !stable_diffusion_art auf täglich erzeugte Werke mit Krea2 turbo, Qwen-Modellen und eigenen LoRAs. Die Scores liegen meist nur im ein- bis niedrigen zweistelligen Bereich, doch die Aktivität ist kontinuierlich.
  • Closed-News sind fast ausschließlich Importware: Große Geschichten wie Soras API-Ende, Nano Banana, Seedance und Midjourneys Wechsel zu Medizintechnik kommen auf Lemmy nur über Crossposts à la !ai_reddit von r/ArtificialInteligence an. Mit Scores von meist 0 bis 1 gibt es kaum lokale Diskussionen. Als alleinige Quelle für diese Nachrichten ist Lemmy ungeeignet.
  • Insgesamt wurden in den obigen Beiträgen zwölf Erkenntnisse zu beiden Seiten festgestellt, ungefähr sechs offen und sechs geschlossen. Da damit die Playbook-Obergrenze von zwölf erreicht ist, wurde die Auswertung beendet.
Einschränkungen
  • Direkte Abfragen an Lemmys offizielle API (/api/v3/community, /api/v3/post/list) antworteten mit HTTP 400/500. Beitragstexte und ein Teil der Abonnentenzahlen beruhen daher auf Websuche und Fragmenten aus Seiten.
  • Bei bestimmten Suchbegriffen mischten sich große Mengen irrelevanter Politik- und Gesellschaftsnachrichten ein. Einzelabfragen für „Flux AI“, „Runway AI“ oder „Kling AI“ lieferten keine passenden Treffer; einzelne Flux- oder Runway-News wurden auf Lemmy nicht gefunden.
  • Die genaue Instanz von !ai_reddit konnte nicht bestimmt werden.
  • Das Ziel von etwa 20 analysierten Beiträgen wurde wegen geringer Beitragsdichte nicht erfüllt. Wie vom Playbook vorgesehen wurden 5 bis 12 Beiträge ausgewählt; tatsächlich wurden mehr als 30 passende Kandidaten geprüft und nach Duplikaten und Rauschen reduziert.

Pinterest

Pinterest — News zur KI-Bild- und Videogenerierung

50 Pins wurden mit einer einzigen Suche („Image and Video Generation AI News“, ohne Genre-Aufteilung) gesammelt. 20 Bilder wurden direkt geöffnet (Indizes 1–13, 16, 22, 25–26, 28, 31–33, 36, 38–39, 41–43, 45, 47–49), da die meisten Titel knapp oder generisch sind.

Visuelle Themen
  • „AI NEWS“-Thumbnails von YouTubern: Ein bärtiger Mann mit schockiertem oder weit aufgerissenem Blick neben einem Raster leuchtender 3D-Firmenlogos von OpenAI, Google, Microsoft, Meta und Notion. Klassisches MrBeast-artiges Clickbait-Layout für KI-News-Rundschauen [1, 28].
  • Nahaufnahmen weißer humanoider Roboter/Androiden mit leuchtend blauen Augen als generisches KI-Symbol für völlig unterschiedliche Themen: Erkennung gefälschter Nachrichten, Ethik-Erklärungen, Industrie-Infografiken zu generativer KI und Illustrationen von News-Moderatoren [3, 22, 41, 43, 48, 49].
  • SaaS-Werbeinfografiken in Neon auf Dunkelblau: schwarze oder dunkelblaue Hintergründe, leuchtende lila-rosa-türkise Icon-Rahmen und fette schmale Überschriften wie „6+ BEST AI VIDEO GENERATION WEBSITES“ oder „AI IMAGE VIDEO — BEST QUALITY VS BEST FREE“. Das ist das dominierende Pin-Format für die Frage „Welches Tool soll ich verwenden?“ [4, 9, 39].
  • Tool-Logo-Raster und Vergleichslisten mit immer denselben Produkten: Runway, Pika, Kling AI, Luma (Dream Machine), Canva AI und Hailuo AI für Video; ChatGPT/DALL·E, Midjourney, Gemini, Adobe Firefly, Recraft, Ideogram und Krea für Bilder [4, 9, 39].
  • Angstbilder zu „KI-generierten Nachrichten“: echte nachgeahmte Bauchbinden mit „AI GENERATED“ und NBC-News-Stil über offensichtlich synthetischen Moderatoren sowie ein „FAKE“-Stempel über einem Roboter mit Handy. Misstrauen und Desinformation sind ein wiederkehrendes visuelles Thema, nicht nur Text [3, 32, 45, 48].
  • Makroaufnahmen von Leiterplatten und Chips mit leuchtendem „AI“-Schriftzug im Silizium als generische Hardware-/Compute-Bilder für „KI ist überall“ [5].
  • Demo-Raster für Stiltransfer und Identitätserhalt: Ein Quellvideo oder -foto wird nebeneinander als Holzklötze, Origami, Lego oder Blumen neu gerendert – ein konkretes Format für Produktdemos, hier im Stil einer Luma-Funktionsvorstellung [2].
  • Collagen bzw. „Wände aus Thumbnails“: Dutzende kleine KI-generierte Videoframes oder vertikale Kurzvideo-Karten in einem hohen Bild, als Symbol für die Menge an KI-Inhalten, die Feeds überflutet [31, 49].
Auffällige Pins
  • #1 — „AI News: Anthropic Leak Shows Us The Future of AI...“: Reaktions-Thumbnail, das Anthropic neben Logos von OpenAI, Google und Microsoft nennt. Es zeigt, dass Nachrichten zu Closed-Labs als Drama- und Leak-Content für Klicks verpackt werden.
  • #2 — „Google announces ultra-high quality video...“: Ein 3x5-Raster, das ein Quellvideo als Holzklötze, Origami, Lego und Blumen neu rendert. Eine konkrete Demo für identitätserhaltenden Video-Stiltransfer im Nano-Banana-/Gemini-Stil, nicht nur eine Logo-Folie.
  • #4 — „6+ Best AI Video Generation Websites“: Infografik mit Runway, Pika, Kling AI, Luma, Canva und Hailuo als aktuellem Standard-Toolkit für Videogenerierung sowie der Aussage, dass bis 2026 80 % aller Online-Inhalte Video enthalten werden.
  • #9 — „AI Image Video: Best Quality vs Best Free“: Entscheidungsbaum, der kostenpflichtige Tools wie ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber und Synthesia von kostenlosen Tools wie Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape, CapCut, Pika Free und Runway Free trennt. Nützlich als Momentaufnahme dessen, was Pinterest als Spitzenklasse behandelt.
  • #11 — „Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API“: Funnel-Grafik, in der Bild- und Texteingaben zu einem Ausgabestrom zusammenlaufen, mit „Gemini API“-Branding. Closed-Videogenerierung mit Audio wird hier als Entwickler-API vermarktet, nicht nur als Consumer-App.
  • #26 — „Google’s Gemini Omni Turns Anything Into Video“: Pin einer externen Marketingagentur, Osiz Technologies, der eine Gemini-„Omni“-Ankündigung neu verpackt. Closed-Modell-News werden sofort von fremden Entwicklungsagenturen für SEO und Lead-Generierung wiederverwendet.
  • #28 — „AI News: OpenAI Finally Released What We Asked For“: Dasselbe Reaktions-Thumbnail-Format desselben Creators wie #1, diesmal mit OpenAI. Es handelt sich offenbar um eine wiederkehrende Reihe.
  • #38 — „Amuse 3.0“: Fotorealistisches Porträt eines alten Fischers mit dem Hinweis „AI generated image created on AMD“. Einer der wenigen Pins, die Bildgenerierung mit einem konkreten Hardwareanbieter und On-Device-/NPU-Computing verbinden statt mit Cloud-APIs.
  • #39 — „4 Major AI Updates“: Nennt GPT-6 Astra, Gemini-Agenten über Apps hinweg, generatives Video und Audio direkt in Adobe Premiere sowie Cognitions Series E über 2 Milliarden US-Dollar bei 48 Milliarden Bewertung. Die konkreteste und aktuellste Closed-News-Zusammenfassung der Auswahl.
  • #45 — „AI Generated News Clip“: Synthetischer Moderator mit klarer Bildbeschriftung. Das deutlichste Einzelbild für KI-Video im Nachrichten- und Medienbereich und ein Echo der NBC-Bauchbinden-Pins #32 und #48.
Signale
  • Was aktuell ist: Die Pinterest-Toollandschaft wird von wenigen Closed-Namen dominiert – Runway, Pika, Kling, Luma/Dream Machine, Google Gemini/Veo, OpenAI und Adobe Firefly/Premiere. Offene Modelle wie Stable Diffusion, Flux, HunyuanVideo, Wan und LTX sowie ComfyUI erscheinen in dieser Auswahl praktisch nicht namentlich. Das Pinterest-Publikum interessiert sich eher für „Welche kostenlose oder kostenpflichtige App soll ich nutzen?“ und reaktive News-Rundschauen als für Modelltechnik.
  • Ein starkes zweites Thema: Angst und Vertrauen. „FAKE“-Stempel, KI-News-Moderatoren, KI-generierte NBC-artige Clips und Grafiken wie „Kannst du dieser Stimme vertrauen?“ sind ungefähr so häufig wie Toolvergleiche. Das Thema Desinformation und Medienvertrauen ist hier ein eigenständiges visuelles Genre.
  • Fehlend: Keine Namen offener Modelle oder Repositories, kein Hugging-Face-Branding, keine LoRA-/Fine-Tuning-/ComfyUI-Workflow-Screenshots, keine Benchmark-Diagramme und kaum Forschung zu Videogenerierung. Pinterest zeigt das Thema fast vollständig aus Consumer- und Marketingperspektive, nicht aus Entwickler- oder Enthusiastensicht.
  • Mehrere Pins sind alte oder zeitlose SEO-Inhalte, etwa generische Stockfotos zu Bildgenerierung oder eine Liste der besten Videogeneratoren von 2025, nicht aktuelle Nachrichten dieser Woche. Die Aktualität muss deshalb Pin für Pin anhand sichtbarer Daten und Versionsnummern wie „GPT-6 Astra“ und „Amuse 3.0“ beurteilt werden.
Einschränkungen
  • Laut Stage-Playbook wurden die Bilder bereits von einem Headless-Browser-Worker gesammelt. Pinterest selbst wurde nicht durchsucht; es konnte nur auf pinterest.pins.md und images/pinterest/ zurückgegriffen werden.
  • Alle 50 Pins stammen aus einer einzigen flachen Suchabfrage ohne Genre-Aufteilung. Daher konnten Open- und Closed-Pins nicht wie im Briefing verlangt getrennt werden; die Bildsammlung enthält schlicht keine offenen Tools oder Projekte für diese Hälfte.
  • 20 der 50 Pins wurden direkt geöffnet. Die übrigen 30, meist generische „(untitled)“-Stockgrafiken laut Tabelle, wurden nicht einzeln geprüft, ihre Titel deuten aber auf Wiederholungen derselben Muster hin.
  • Pinterest liefert in den erhobenen Daten keine Engagement-Metriken wie Saves oder Kommentare. Aussagen darüber, was trendet, beruhen deshalb auf visueller und thematischer Wiederholung, nicht auf Popularitätswerten.

Empfohlene Maßnahmen

  • Benchmark-Updates kleiner offener Modelle wie Qwen-Image-2.1 fortlaufend verfolgen.
  • Modelle, die sich „Open Source“ nennen, erst nach Prüfung ihrer Lizenzbedingungen einordnen.
  • Wechsel zu Alternativen nach dem Ende der Sora-API in die nächste Recherche aufnehmen.
  • Für Bluesky und Pinterest konkrete Suchbegriffe wie ComfyUI und Hugging Face ergänzen, um die geringe Sichtbarkeit offener Modelle auszugleichen.
  • X mit themenspezifischen Schlüsselwörtern statt anhand des Trendpanels neu erheben.

Gesammelte Bilder

KI-News: Anthropic-Leak zeigt uns die Zukunft der KI...Google kündigt Video in ultrahoher Qualität an...Bedenken zu KI-Inhalten und sozialen MedienMach es einfach richtig 🎥KI-Chip auf einer Leiterplatte, 4K-VideoKonzept für KI-Content-Erstellung mit Symbolen für Text-, Bild-, Musik- und Videogenerierung – 66 Stockfotos, Vektoren und Videos durchsuchenVerwandle deine Ideen in beeindruckende Visuals! 🎥KI-generierte Videos für Content-MarketingKI für Bild- und VideogenerierungKI-Tool zum Umwandeln von Text in BilderVeo 3 Bild-zu-Video: schnelle Generierung und natives Audio über Gemini APIKI-BildgenerierungGeheimnisse von KI-Content-Studio und Automatisierung 🚀📱Konzept für KI-Content-Erstellung mit Symbolen für Text-, Bild-, Musik- und Videogenerierung – 57 Stockfotos, Vektoren und Videos durchsuchenBildKling.ai: KI-gestützte Text-zu-Video-GenerierungBildBildProfessionelle KI-Videoproduktion in Dubai | Schnellere, intelligentere InhalteBildBildNew Yorks mutiger Vorstoß: Einblick in die Gesetzgebung...KIBild‎🚨 KI wird erschreckend gut.Googles Gemini Omni verwandelt alles in VideoProfessionelle KI-Videoerstellung | Filmische KI-Videos | Individuelle VideobearbeitungKI-News: OpenAI hat endlich veröffentlicht, worum wir gebeten habenBildBildDie besten KI-Videogeneratoren 2025KI-News-Videos verwischen die Grenze zwischen echten und gefälschten BerichtenKI-Bildgenerierung und die UnterhaltungsindustrieBildBildEinführung von Luma Dream Machine – KI-Video der nächsten GenerationGenerative KI erklärt: Ein vollständiger Leitfaden für Einsteiger (2026)„Amuse 3.0“, ein KI-Kunstwerkzeug, das ... enthält4 wichtige KI-Updates, die du 2026 kennen musstKIKI-News und aktuelle Updates | Trends und Durchbrüche der künstlichen IntelligenzKI-generierte Videos: Gut oder schlecht? Hier ist die Wahrheit! 🤖🎥KI-News-Moderatoren und creator-getriebene Berichterstattung übernehmen US-Medien!Video und KI meistern: Zentrale Social-Media-Marketingtrends 2025„Warum KI-Chatbots bei aktuellen Nachrichten scheitern“BildWie Augmented Reality (AR) die Zukunft der Technologie verändertKI-Moderator von Channel1Wie generative KI jede Branche verändern wirdBild

Hinweis zur Datenqualität

Auf allen sechs Plattformen wurde das Briefing-Ziel von etwa 20 Beiträgen je Netzwerk verfehlt. Bei X passten nur 8 von 40 Beiträgen zum Thema, weil der kroatische Trendbereich als Suchausgangspunkt verwendet wurde. Bluesky ließ wegen der 403-Sperre keine Schlüsselwort-API-Suche zu und war auf bekannte Accounts angewiesen. Pinterest verwendete nur eine einzige Anfrage und sammelte deshalb von vornherein kein Material zu Open Source.

Galerie