KI-News zur Bild- und Videogenerierung — 2026-09-23
Closed-Source-Bild-/Video-KI zieht sich stark zurück (Sora-2-API wird am 2026-09-24 eingestellt, Midjourney schwenkt auf Medizinprodukte um, Gegenwind wegen Preisen von Grok Imagine/Seedance), während Open-Source-Tools rund um ComfyUI (Wan, HunyuanVideo, FLUX.2, Qwen-Image, MiniMax H3) still und leise zum Standard für echte Produktionsarbeit werden.
Bild- und Video-KI: Open Source vs. Closed Source – die Frontlinie ist gerade extrem spannend — 2026-09-23
Ich habe mich umgesehen: Gerade ist das wirklich eine ausgesprochen spannende Phase 🔥 Während Closed-Source-Anbieter (Sora 2, Midjourney, Grok Imagine und andere) mit auffälligen Releases Schlagzeilen machen, ziehen sie sich zugleich zurück, erhöhen Preise oder ändern ihre Richtung – und wirken ehrlich gesagt zunehmend instabil 😳 Open-Source-Anbieter (Wan, FLUX.2, Qwen-Image, HunyuanVideo) sammeln sich dagegen um ComfyUI als Hub und dringen zwar unauffällig, aber sehr real in die professionelle Produktion vor 💪 Nach einem Blick auf Reddit, X, YouTube, Bluesky, Lemmy und Pinterest zeigt sich ein klares Muster: „laute Nachrichten = Closed Source“, „solide Praxis = Open Source“. Zugleich wird der Ruf nach einer Kennzeichnungspflicht für KI-generierte Inhalte deutlich lauter 📢
Plattformübergreifend
- Der Rückgang und Strategiewechsel der Closed-Source-Anbieter ist auf mehreren Plattformen sichtbar. Auf YouTube wurde berichtet, dass Sora 2 nach nur einem halben Jahr seine App am 2026-04-26 einstellt und die API bereits am Tag nach dieser Recherche, dem 2026-09-24, abschaltet. Den geschätzten Betriebskosten von rund 1 Mio. US-Dollar pro Tag standen demnach insgesamt nur 2,1 Mio. US-Dollar an Aboerlösen gegenüber (https://www.youtube.com/watch?v=bIL7uU4CYnE). Dieselbe Nachricht zur Sora-API wurde auf Lemmy über einen Spiegel von r/ArtificialInteligence geteilt (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/) und dort dem gegenübergestellt, dass Chinas Kuaishou (Kling) 3 Mrd. US-Dollar eingesammelt hat – die Diskussion lautete deutlich: Gerade unspektakuläre Geschäftsanwendungen verdienen Geld.
- Open Source taucht überall als „Produktionsinfrastruktur“ rund um ComfyUI auf. Auf Reddit geht es um ComfyUI plus FramePack für Videogenerierung auf schwächeren PCs, auf Lemmy erschienen innerhalb einer Woche zwei ComfyUI-Erweiterungen für MiniMax H3, und auf YouTube entstehen massenhaft Tutorials für die lokale Nutzung von Wan, HunyuanVideo und LTX. ComfyUI und die Wan-Familie wurden auf drei Plattformen unabhängig voneinander zu Schlüsselbegriffen.
- Der Frust über eine zunehmende Paywall richtet sich gegen Closed Source. Auf Reddit gab es gleich drei Threads auf der Suche nach kostenloser Videogenerierungs-KI, nachdem kostenlose Kontingente geschrumpft waren. Auf Bluesky bezeichnete ein Künstler aus Tokio die hohen Kosten von Seedance 2.5 wiederholt als „devastating“ (https://bsky.app/profile/metalmickey.bsky.social/post/3mu25rbs4dk2e).
- Auf Verbraucherseite entsteht Ermüdung durch zu viele Tool-Vergleiche. Vergleichsvideos wie Sora 2 vs. Seedance 2.0 vs. Runway sind auf YouTube zum Standard geworden, während auf Pinterest Entscheidungsmatrizen wie „Best Quality vs Best Free“ stark verbreitet sind (YouTube: https://www.youtube.com/watch?v=rb0p_mY3tPs / Pinterest #10). Immer mehr Menschen wollen nicht einem einzelnen Modell folgen, sondern wissen, welches gerade am besten ist.
- Misstrauen gegenüber KI-Inhalten und der Wunsch nach Kennzeichnungspflicht sind plattformübergreifend. Ein Reddit-Thread zu einem Gesetzesvorschlag erhielt 13.841 Kommentare – mit weitem Abstand die intensivste Diskussion der Sammlung (https://www.reddit.com/r/CriticalState/comments/1wmktek/). Auf Pinterest haben sich Visuals mit „FAKE“-Stempeln und KI-Erkennungsbadges als eigenes Genre etabliert.
Nach Plattform
Reddit — Von 12 gesammelten Threads stammten nur vier aus Communities, die sich auf Bild- oder Video-KI spezialisiert haben. Der Rest bestand aus allgemeinen Subreddits mit Beiträgen nach dem Muster „KI-generierten Inhalt entdeckt / das nervt“. Während der Bedarf an kostenloser, lokaler Videogenerierung immer wieder auftaucht, zeigte DeepSeek (Open Weights) zugleich ein seltenes Gegenmuster: Die Nutzerzahlen stiegen so schnell an (DAU 120 Mio. → 200 Mio.), dass die Rechenkapazität nicht nachkam und die Qualität litt (https://www.reddit.com/r/DeepSeek/comments/1wmcgex/).
X — Unter vor allem japanischsprachigen Accounts gab es eine Welle von „One-shot“-Demos mit Claude Opus 5.5 und Grok 4.7. @cherry_mx_reds, @NFT_Chen, @riku720720 und @chetaslua veröffentlichten zwischen dem 21. und 22. September unabhängig voneinander Demos – wie eine gemeinsame Testwelle direkt nach einem Release. Auf der Open-Source-Seite fielen individuelle Entwickler wie @shinshin86 und @GeekCatX durch Beiträge über GitHub-Stars auf. Ein Problem: Mehr als 20 der 40 gesammelten Beiträge waren themenfremdes Rauschen, das durch X-spezifische Trendbegriffe hereinkam.
YouTube — Hier war die Informationsdichte am höchsten. Der rasche Aufstieg und Fall von Sora 2 – glänzende Ankündigung, Rückzug nach einem halben Jahr – war das größte Thema. Gleichzeitig lief der Update-Wettlauf um Nano Banana 2, GPT Image 2.5 und Midjourney V8 weiter. Auf Open-Source-Seite waren Alibaba (Wan), Tencent (HunyuanVideo), Black Forest Labs (FLUX) und Lightricks (LTX) die wichtigsten Akteure, während ComfyUI sich als „Schaltpult“ für immer neue Nodes festigte.
Bluesky — Es gibt keinen starken Hub speziell für Bild- und Video-KI. Offizielle Accounts von Stability AI, Midjourney und Runway sind nahezu inaktiv. Kontinuierlich postete nur der xAI-Mitarbeiter @ethanhe. Die Volltextsuche per API lieferte allerdings dauerhaft 403, sodass die Recherche nur durch das Durchsehen bekannter Accounts möglich war.
Lemmy — Die Plattform ist klein – selbst die größte einschlägige Community hat nur 5.713 Mitglieder –, doch die ComfyUI-bezogenen Posts in !«メールアドレス» waren informationsreich. Auf Closed-Source-Seite dominierten Nachrichten über Rückzug und Richtungswechsel: Sora-API-Ende, Midjourneys Wechsel zu Medizinprodukten und Googles sofortiger Rückzug von Earth AI. Über neue, spektakuläre Releases wurde deutlich weniger gesprochen als über Kurskorrekturen.
Pinterest — Im Mittelpunkt standen nicht so sehr Nachrichtenartikel, sondern Bilder im Stil von „AI NEWS“-Thumbnails, Vergleichstabellen und Warnvisuals zu Deepfakes. Open Source war fast unsichtbar; AMDs „Amuse 3.0“ war praktisch der einzige Fund. Umgekehrt waren die Unsicherheit der Verbraucher bei der Tool-Auswahl und Skepsis gegenüber KI-Inhalten als visuelle Genres sehr deutlich.
Wichtige Punkte
- Sora-2-API wird eingestellt (2026-09-24) — YouTube: https://www.youtube.com/watch?v=bIL7uU4CYnE
- Starker Anstieg der DeepSeek-DAU und Qualitätsverlust durch Rechenkapazitätsmangel — Reddit: https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- Gesetzesvorschlag für Kennzeichnungspflicht von KI-Inhalten (13.841 Kommentare) — Reddit: https://www.reddit.com/r/CriticalState/comments/1wmktek/
- Immer mehr Erweiterungen für lange Videos mit ComfyUI + MiniMax H3 — Lemmy: https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
- Grok 4.7 erzeugt automatisch eine 3D-Szene in Blender (410.000 Views) — X: https://x.com/cherry_mx_reds/status/2102098340699668865
- Midjourney vollzieht einen großen Wechsel von Bildgenerierung zu Medizinprodukten, einschließlich Ultraschall-CT-Scannern — Lemmy: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
Empfohlene Maßnahmen
- Angesichts steigender Preise und Rückzüge bei Closed Source den OSS-Stack aus Wan, HunyuanVideo, FLUX.2 sowie ComfyUI + MiniMax H3 weiter als wichtigste praktische Alternative beobachten.
- Der auf Reddit und Pinterest stärker werdenden Forderung nach Kennzeichnung von KI-Inhalten zuvorkommen und jetzt eine Richtlinie zur Herkunfts- und Inhaltskennzeichnung vorbereiten.
- Nach dem Ende der Sora-2-API am 24. September verfolgen, wohin die Nutzer wechseln – Kling, Seedance und Runway sind wahrscheinliche Profiteure.
- Die One-shot-Demowelle zu Opus 5.5 und Grok 4.7 auf X als kurzlebigen Hype direkt nach dem Release verstehen und nicht als dauerhafte Gefahr für die Aufmerksamkeit rund um OSS überschätzen.
- DeepSeeks Belastung durch das Hochskalieren der Rechenkapazität als Frühindikator beobachten: Sie zeigt, was passiert, wenn die Akzeptanz offener Gewichte die Infrastruktur eines Betreibers überholt.
- Die auf YouTube und Pinterest sichtbare Ermüdung bei der Tool-Auswahl mit Vergleichsinhalten adressieren, statt nur über einzelne Produkte zu berichten.
Datenqualität
Das Abschlusskriterium von rund 20 analysierten Beiträgen je sozialem Netzwerk wurde nur bei YouTube und Pinterest ungefähr erreicht (je 20 bzw. 50 gesammelte Elemente). Reddit blieb bei 12 Threads, davon nur vier aus spezialisierten Subreddits. Für X wurden 40 Beiträge gesammelt, aber mehr als die Hälfte war themenfremdes Rauschen durch Trendbegriffe; direkt relevante Beiträge gab es ungefähr 11. Bei Bluesky war die API für die Volltextsuche dauerhaft per 403 nicht nutzbar; die Recherche beschränkte sich auf bekannte Accounts und ergab 10 Beiträge. Lemmy ist insgesamt klein – die wichtigste Community hat 5.713 Mitglieder –, 20 Beiträge waren dort schon strukturell kaum erreichbar, und rund die Hälfte bestand aus Reddit-Spiegelungen. Von 50 Pinterest-Pins wurden nur 26 visuell geprüft; Engagement-Metriken wie Likes waren nicht verfügbar.
Zusammenfassung nach Plattform
Reddit — Nachrichten zu Bild- und Video-KI
Wo (Subreddits)
Die 12 gesammelten Threads verteilen sich auf zehn Subreddits. Nur wenige sind auf Bild- und Video-KI spezialisiert; die übrigen behandeln Erwähnungen oder Beschwerden über KI-Inhalte in allgemeinen Communities.
| Subreddit | Mitglieder | Gesammelte Threads |
|---|---|---|
| r/generativeAI | 156.181 | 3 |
| r/mildlyinfuriating | 12.586.808 | 1 |
| r/aivideomaking | 7.498 | 1 |
| r/CriticalState | 39.096 | 1 |
| r/Instagramreality | 1.155.566 | 1 |
| r/Purdue | 100.731 | 1 |
| r/DeepSeek | 140.681 | 1 |
| r/ImagineAiArt | 19.446 | 1 |
| r/youngpeopletiktoks | 8.226 | 1 |
| r/youtube | 3.459.719 | 1 |
Auf generative KI spezialisiert sind nur r/generativeAI, r/aivideomaking, r/DeepSeek und r/ImagineAiArt (vier Threads). Die übrigen acht Threads stammen aus allgemeinen Subreddits und erwähnen KI-generierte Inhalte im Kontext „entdeckt / ärgert mich“.
Reaktionen der Community
- Die Suche nach kostenloser Videogenerierungs-KI tauchte in drei unterschiedlichen Threads wiederholt auf (Thread #2 „Which AI video generator can still be used for free?“ in r/generativeAI, 20 Punkte, 73 Kommentare, 2026-09-16 / Thread #3 „Looking for a free AI video generator“ in r/aivideomaking, 7 Punkte, 28 Kommentare, 2026-09-20 / Thread #10 mit demselben Titel in r/generativeAI, 4 Punkte, 28 Kommentare, 2026-09-20). Da Closed-Source-Angebote fast durchgehend kostenpflichtig werden, empfahl u/RioMetal (+4): „Wenn du es lokal ausführen kannst, gibt es jede Menge Wan und Minimax.“
https://www.reddit.com/r/generativeAI/comments/1whtesl/ - Frust darüber, dass „alles, was die KI empfiehlt, kostenpflichtig ist“ (Thread #2, Beitragstext). Eine typische Reaktion auf die schrumpfenden kostenlosen Kontingente von Closed-Source-Angeboten.
https://www.reddit.com/r/generativeAI/comments/1whtesl/ - Konkreter Rat für lokale Open-Source-Nutzung: u/AztecWheels (+2, Thread #3) empfahl, FramePack über Pinokio zu installieren; damit lasse sich selbst auf einem schwächeren PC Bild-zu-Video ohne Ton für 1 bis 120 Sekunden nutzen. ComfyUI plus FramePack wurde als etablierte Kombination für Open-Source-Videogenerierung auf schwächerer Hardware genannt.
https://www.reddit.com/r/aivideomaking/comments/1wled0f/ - Gegenreaktion auf Forderungen nach kostenlosen Angeboten: u/activematrix99 (+2, Thread #3) verglich das mit der Forderung nach einem kostenlosen Essen im Restaurant: Unternehmen investierten Milliarden in diese Technologie. Auch innerhalb der Community gehen die Meinungen auseinander.
https://www.reddit.com/r/aivideomaking/comments/1wled0f/ - Rasantes Wachstum von DeepSeek (Open Weights) und Rechenkapazitätsmangel: Laut Thread #7 „some deepseek news, if you care“ (r/DeepSeek, 292 Punkte, 45 Kommentare, 2026-09-21) stiegen die DAU von DeepSeek von 120 Mio. auf 200 Mio. (+66,7 %), während die Rechenleistung nur um 8,3 % zunahm. Das soll zu Qualitätsverlusten und Problemen bei erneuten Generierungen geführt haben. Als Gegenmaßnahme wurden 160.000 Huawei-Ascend-960DT-Chips bestellt. u/Equivalent-Grass-527 (+13) schrieb, die Diskrepanz zwischen Nachfrage und Rechenressourcen erkläre die jüngste Verschlechterung am plausibelsten.
https://www.reddit.com/r/DeepSeek/comments/1wmcgex/ - Debatte um GPT Image 2.5 Flare (Closed Source) versus KREA 2 (Open Source): In Thread #9 „GPT Image 2.5 Flare — is this actually the best AI image generating model right now?“ (r/ImagineAiArt, 93 Punkte, 62 Kommentare, 2026-09-16) schrieb u/Dependent_Quit_3730 (+3, auf Portugiesisch), es sei perfekt für Menschen, die es einfach möchten, sie selbst nutze aber weiter KREA 2. u/SeaworthinessFresh16 (+2) fand, die Ergebnisse mit ComfyUI + Krea2 sähen gleich aus. Dem Hype um das neue Closed-Modell stand die Wahrnehmung gegenüber, dass es praktisch kaum einen Unterschied zu Open Source gebe.
https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/ - Starke Ablehnung von KI-generierten Immobilienfotos: Thread #1 „It should be illegal to post AI-generated "inspirational" images in house listing photos.“ (r/mildlyinfuriating, 25.962 Punkte, 706 Kommentare, 2026-09-21; höchster Score der Sammlung). u/BojackWorseman13 (+1.128) meinte, er würde als Makler massiv Beschwerden in sozialen Netzwerken einreichen; selbst wenn es nicht illegal sei, müsse deutlich stehen, dass die Bilder KI-generiert sind.
https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/ - Gesetzesvorschlag für eine Kennzeichnungspflicht von KI-Inhalten: Thread #4 „[Law Proposal] Every ai generated image and text must need to have watermark.“ (r/CriticalState, 1.246 Punkte, 13.841 Kommentare, 2026-09-21; die meisten Kommentare in der Sammlung). Die obersten Kommentare waren nahezu durchgehend zustimmend, etwa u/Timedforfun (+16): Es sei nichts, das man verstecken müsse; stimme dafür.
https://www.reddit.com/r/CriticalState/comments/1wmktek/ - KI-Bilder, die für Laien kaum erkennbar sind, gehen viral: Thread #5 „AI generated images on Reddit with thousands of upvotes and comments“ (r/Instagramreality, 2.148 Punkte, 343 Kommentare, 2026-09-18). u/Habibti-Mimi81 (+146): Die Person hätte es selbst nicht erkannt; nur die Ecken der grauen Fliesen seien ein Hinweis gewesen. Eine traurige und gefährliche Zeit.
https://www.reddit.com/r/Instagramreality/comments/1wk0euk/ - KI-generierte Bilder selbst auf offiziellen Hochschul-Aushängen werden als „Slop“ kritisiert: Thread #6 „AI generated image on MSEE wall“ (r/Purdue, 139 Punkte, 19 Kommentare, 2026-09-21). Im Beitragstext heißt es: „Konnte man keinen Grafikdesigner einstellen? Man kann dem KI-Slop nirgends entkommen.“
https://www.reddit.com/r/Purdue/comments/1wmq43f/ - Video-KI-Inhalte von Sora und ähnlichen Diensten gelangen in TikTok-Repost-Subreddits: Thread #11 „another ai generated grounded video“ (r/youngpeopletiktoks, 81 Punkte, 35 Kommentare, 2026-09-19). u/Pretend-Goat-8065 (+5) benennt Closed Source direkt: „Another Sora ai“.
https://www.reddit.com/r/youngpeopletiktoks/comments/1wkjvor/ - Ablehnung gegen automatisch generierte KI-Kapitel auf YouTube: Thread #12 (r/youtube, 3 Punkte, 22 Kommentare, 2026-09-17). u/avatar0027 (+2) schrieb, automatisch aus Transkripten erzeugte Kapitel würden stärker angezeigt. Zuschauer hätten keine Möglichkeit, sie pauschal abzuschalten; nur Creator könnten sie einzeln deaktivieren. Keine Videogenerierung im engeren Sinn, aber ein Indiz für Ermüdung durch zunehmende KI-Funktionen.
https://www.reddit.com/r/youtube/comments/1wiqamq/
Signale
- Zunahme: Der Bedarf an kostenloser, lokal ausführbarer Videogenerierung (Wan 2.2, Minimax H3, ComfyUI + FramePack) taucht in drei unabhängigen Threads wiederholt auf. Preiserhöhungen und Paywalls bei Closed Source fördern das Interesse an Open Source.
- Zunahme: Öffentliche Forderungen nach einer Kennzeichnungspflicht für KI-Inhalte. Thread #4 erreichte mit 13.841 Kommentaren die größte Diskussion der Sammlung. Regulierung und Transparenz erzeugen auf Reddit deutlich mehr Engagement als der Wettbewerb um Modellleistung.
- Oft übersehen: Gegenwind gegen die Forderung „gebt es kostenlos“. Innerhalb der Community gibt es auch eine nüchterne Haltung, dass kostenlose Nutzung nicht selbstverständlich sei.
- Überraschend: DeepSeek ist als Open-Weights-Angebot zwar schnell gewachsen, leidet aber wegen mangelnder Rechenkapazität unter Qualitätsverlusten. Diskutiert wurde damit nicht einfach Open vs. Closed, sondern eine neue Lieferbeschränkung: Ein offenes Modell wird so beliebt, dass die eigene Infrastruktur nicht nachkommt.
- Gegensätzliche Meinungen: In Thread #9 spaltete sich die Diskussion über GPT Image 2.5 Flare und KREA 2. Mehrere Stimmen sahen viel Aufmerksamkeit für Closed Source, aber kaum spürbare Qualitätsunterschiede.
Einschränkungen
- Das Briefing verlangte ungefähr 20 analysierte Beiträge pro sozialem Netzwerk, aber in reddit.threads.md/.json lagen nur 12 Threads vor; gesucht wurde ausschließlich nach „Image and Video Generation AI News“. Da die Arbeitsweise vorsah, bereits gesammelte Daten auszuwerten, wurden keine zusätzlichen Suchen durchgeführt.
- Nur vier der 12 Beiträge stammten aus spezialisierten Communities zu Bild- und Video-KI (r/generativeAI, r/aivideomaking, r/DeepSeek, r/ImagineAiArt). Die anderen acht waren Ableitungen allgemeiner Subreddits zum Thema entdeckte KI-Inhalte. Eigentliche News zu neuen Closed- oder Open-Source-Produkten und Updates waren fast nicht enthalten.
- Wichtige spezialisierte Subreddits wie r/StableDiffusion, r/midjourney, r/runwayml und r/aivideo waren im Datensatz überhaupt nicht vertreten.
- Der Beitragstext von Thread #9 zu GPT Image 2.5 Flare endet mitten im vollständigen Prompt; der Rest des Beitrags und der angehängte Bildinhalt konnten nicht geprüft werden.
- Reddit konnte nicht eigenständig durchsucht werden; über diese 12 Beiträge hinaus wurden keine weiteren Suchbegriffe oder Threads untersucht.
X
X — Nachrichten zu Bild- und Video-KI
X (Twitter) erlebte vor allem unter japanischsprachigen Accounts eine Welle von Video- und Animationsdemos mit „Claude Opus 5.5“ und „Grok 4.7“. Mehr als die Hälfte der 40 gesammelten Beiträge war allerdings themenfremdes Rauschen (Details unter Limits).
Accounts
- @cherry_mx_reds (Tak) — Der sichtbarste Account dieser Sammlung. Zwei Demos: Eine One-shot-Animation „Oktoberfest“ mit Opus 5.5 (373 Likes) und eine von Grok 4.7 in Blender erzeugte 3D-Szene (1.636 Likes, ca. 410.000 Views). Ein Live-Kommentar-Account mit Vergleichsperspektive, der zwei unterschiedliche Modelle getestet hat.
- @NFT_Chen (SuSu_酥酥) — Postete eine Demo, in der Opus 5.5 per Code eine Stop-Motion-Animation im handgezeichneten Stil erstellt (151 Likes, ca. 40.000 Views). Ein einzelner, aber ausführlich erklärter und verbreiteter Beitrag.
- @chetaslua — Zeigte eine interaktive Videogenerierung mit Opus 5.5, nur mit JavaScript und ohne Assets, MCP oder Skills (435 Likes). Stark implementierungsorientierte Technikdemo.
- @riku720720 (Rikuo) — Postete eine Pixelanimation mit Opus 5.5 (173 Likes) und teilte den Prompt in den Antworten. Praxisorientiertes Teilen.
- @old_pgmrs_will (Betreiber von NeuralWire.org) — Zwei Beiträge zu Grok 4.7: eine automatisch erzeugte Fotoretusche-App inklusive Demofunktion (8 Likes) sowie eine Erwiderung auf negative Stimmen und ein Bericht über UI-Verbesserungen in einer Videoschnitt-App (8 Likes). Kleine Reichweite, aber kontinuierliche Veröffentlichung als KI-News-Account.
- @shinshin86 (Entwickler von AITuber OnAir) — Berichtete als Entwickler des Open-Source-Tools „Still2Rig PSD“ über mehr als 60 GitHub-Stars (586 Likes, ca. 28.000 Views).
- @ishitaku39 (いしたく) — Stellte „ARDY Mini“ vor, eine von einem individuellen Entwickler so weit verschlankte Variante des NVIDIA-Forschungsmodells ARDY, dass sie im Browser läuft (226 Likes).
- @GeekCatX (知识猫AI实验室) — Berichtete über mehr als 2.000 GitHub-Stars für das Open-Source-Tool „Hand-drawn Video Skill“ für Story-to-handdrawn-video (103 Likes).
- @so_ainsight — Wöchentliche Übersicht schnell wachsender KI-Repositories auf GitHub (573 Likes, ca. 49.000 Views). Nicht auf Bild- und Videogenerierung beschränkt, aber im weiteren Kontext relevant.
Beiträge
Closed Source (Opus 5.5 / Grok 4.7)
-
#1 @riku720720 — 173 Likes, 19 Reposts, 1 Antwort, rund 19.000 Views, 2026-09-22. https://x.com/riku720720/status/2102515055116063144
Opus 5.5 ist wirklich unfassbar ... es hat diese Pixelanimation in nicht einmal fünf Minuten herausgehauen.
Das Erstaunen über die Geschwindigkeit – Pixelanimation in weniger als fünf Minuten als One-shot-Generierung – bildet den Kern des Beitrags. -
#2 @NFT_Chen — 151 Likes, 20 Reposts, 13 Antworten, rund 40.000 Views, 2026-09-22. https://x.com/NFT_Chen/status/2102455102896509431
Das wurde nicht von einem Menschen gezeichnet! Claude Opus 5.5 hat diese Animation per Code Bild für Bild im handgezeichneten Stil erstellt. ... 32 Sekunden, alles von KI generiert.
Nicht nur das Ergebnis, sondern die Methode – per Code handgezeichnet wirkende Stop-Motion – wird als überraschend hervorgehoben. -
#3 @cherry_mx_reds — 373 Likes, 17 Reposts, 10 Antworten, rund 36.000 Views, 2026-09-21. https://x.com/cherry_mx_reds/status/2102493303388475855
Opus 5.5 hat diese „Oktoberfest“-Animation als One-shot in 14 Min. und 48 Sek. erstellt.
Der Begriff „one-shot“ wird betont; auch die konkrete Dauer von 14 Minuten und 48 Sekunden wird genannt. -
#4 @chetaslua — 435 Likes, 23 Reposts, 10 Antworten, rund 20.000 Views, 2026-09-22. https://x.com/chetaslua/status/2102501773705670994
Interaktive Videogenerierung in jedem gewünschten Kunststil – von @claudeai Opus 5.5 programmiert, ohne Assets, MCP oder Skill, nur JavaScript.
Eine technische Demo, die betont, wie leichtgewichtig die Umsetzung ohne Assets, MCP oder Skills ist. -
#17 @AbhinavXJ — 57 Likes, 2 Reposts, 2 Antworten, rund 3.200 Views, 2026-09-22. https://x.com/AbhinavXJ/status/2102473742723260606
Sie sagten, das Frontier-Tempo solle gedrosselt werden, und jetzt haben wir Grok 4.7, Claude Opus 5.5, GPT-6 sol und luna innerhalb von zwei Tagen.
Keine Diskussion eines einzelnen Modells, sondern eine Reaktion auf die Geschwindigkeit der gesamten Release-Welle. -
#19 @cherry_mx_reds — 1.636 Likes, 215 Reposts, 127 Antworten, rund 410.000 Views, 2026-09-21. https://x.com/cherry_mx_reds/status/2102098340699668865
Grok 4.7 hat das in Blender erstellt. Ich habe ihm nicht gesagt, was es machen soll, sondern nur, dass es etwas sein solle, das es in ungefähr zehn Minuten schaffen kann.
Der Beitrag mit dem größten Engagement in der Sammlung. Neu daran ist der Schritt zur 3D-Generierung in Blender. -
#18 @old_pgmrs_will — 8 Likes, 0 Reposts, 0 Antworten, rund 611 Views, 2026-09-21. https://x.com/old_pgmrs_will/status/2102182047989338264
Mit Grok 4.7 habe ich eine Fotoretusche-App für mich selbst erzeugt und gleich eine automatische Demofunktion implementieren lassen, die die Bedienung vorführt.
Ein praxisnaher Bericht über eine individuell erzeugte App inklusive Demofunktion. -
#20 @old_pgmrs_will — 8 Likes, 0 Reposts, 0 Antworten, rund 599 Views, 2026-09-22. https://x.com/old_pgmrs_will/status/2102376309020299517
Vor allem international sehe ich vereinzelt Beiträge im Stil von „Grok-4.7 taugt nichts“, aber entweder sind das Hater oder sie können es nicht richtig nutzen.
Negative Stimmen zu Grok 4.7 existieren; der Autor widerspricht ihnen und berichtet stattdessen von Fortschritten bei UI/UX einer KI-Videoschnitt-App. Die Bewertung ist also gespalten.
Open Source
-
#33 @shinshin86 — 586 Likes, 59 Reposts, 2 Antworten, rund 28.000 Views, 2026-09-21. https://x.com/shinshin86/status/2102163713679577301
Das KI-Tool „Still2Rig PSD“, das aus Standbildern PSD-Dateien erstellen kann, hat mehr als 60 GitHub-Stars erreicht ... Wenn man Bild und Auftrag an einen KI-Agenten wie Codex übergibt, kann dieser See-through auf Google Colab ausführen, die Ebenen trennen und bis zum Aufbau der PSD fortfahren.
Ein individueller Open-Source-Entwickler berichtet über mehr als 60 GitHub-Stars. Charakteristisch ist die Integration mit KI-Agenten. -
#34 @ishitaku39 — 226 Likes, 22 Reposts, 3 Antworten, rund 9.800 Views, 2026-09-21. https://x.com/ishitaku39/status/2102038146489946532
Die Bewegungen einer Figur konnten passend zu Kommentaren in Echtzeit erzeugt werden ... Ich habe „ARDY Mini“ in meinen selbstgebauten AITuber integriert. Das ist eine von einem individuellen Entwickler bis zur Browser-Ausführung verschlankte Variante des NVIDIA-Forschungsmodells ARDY.
Ein Beispiel dafür, wie die OSS-Community ein Forschungsmodell praxistauglich macht. -
#35 @GeekCatX — 103 Likes, 18 Reposts, 4 Antworten, rund 7.800 Views, 2026-09-22. https://x.com/GeekCatX/status/2102336276230025224
Hand-drawn Video Skill wurde erneut aktualisiert! ... Die GitHub-Stars für Story-to-handdrawn-video haben jetzt 2.000 überschritten. Diesmal liegt der Schwerpunkt auf weiteren Kunststilen.
Das Open-Source-Projekt für Story-to-handdrawn-video überschreitet 2.000 Stars; die Ergänzung weiterer Kunststile ist der Kern des Updates. -
#36 @so_ainsight — 573 Likes, 75 Reposts, 6 Antworten, rund 49.000 Views, 2026-09-21. https://x.com/so_ainsight/status/2101871551255830529
Zehn KI-Repositories, die diese Woche auf GitHub stark gestiegen sind: 1. OpenCodeReview ...
Eine wöchentliche Übersicht über aufstrebende KI-Repositories, nicht nur für Bild- und Video-KI. Dennoch ein Hinweis auf die Dynamik im OSS-KI-Umfeld.
Signale
- Im Aufwind: Persönliche Demos, die mit Claude Opus 5.5 oder Grok 4.7 zeigen, dass Video und Animation in kurzer Zeit und zu geringen Kosten als One-shot erzeugt werden können, erzielen durchgehend Engagement. Besonders zu Opus 5.5 erschienen von vier unabhängigen Accounts (@riku720720, @NFT_Chen, @cherry_mx_reds, @chetaslua) nahezu gleichzeitig zwischen 2026-09-21 und 2026-09-22 unterschiedliche Demos – eine sichtbare Testwelle direkt nach dem Release.
- Unterschätzt / umstritten: Grok 4.7 erhält sowohl Lob für 3D-Generierung in Blender mit rund 410.000 Views als auch Kritik im Stil von „taugt nichts“. @old_pgmrs_will widerspricht dieser Kritik selbst. Es gibt also kein einhelliges Lob.
- Überraschend: Auf der Open-Source-Seite fielen vor allem individuelle Entwickler aus dem japanischsprachigen Raum (@shinshin86, @ishitaku39, @GeekCatX) auf, die konkrete GitHub-Star-Zahlen hervorhoben. Im Vordergrund standen weniger Unternehmensankündigungen als die Kombination bestehender Forschungsmodelle und KI-Agenten zu nutzbaren Tools.
- Zweite Überraschung: Von zehn X-Suchbegriffen bezogen sich nur „Opus 5.5“, „Grok 4.7“ und „GitHub“ direkt auf Bild- oder Video-KI. Die übrigen sieben Begriffe (#chance, England, #sweepstakes, #giveaways, Lauren, $SONG, Jesus) stammten aus X-Explore-Trends und waren thematisch nicht relevant.
Einschränkungen
- Sieben von zehn Suchbegriffen waren nicht mit Bild- oder Video-KI verbunden: #chance (ABEMAs Dating-Reality-Show), England (Wetter- und Fußballgespräche), #sweepstakes (Gewinnspiele, etwa in der Fanatics-App), #giveaways (Gewinnspielbeiträge rund um indische Feste), Lauren (Skandal um eine R&B-Sängerin und die brasilianische Telenovela „Estrelas da Casa“), $SONG (Kryptotoken auf Cardano) und Jesus (religiöse Beiträge, Kritik an der Spieleindustrie, Fußballkommentare). Mehr als 20 der 40 Beiträge waren dieses Rauschen. Vermutlich wurden sie mechanisch aus X-Explore-Trends übernommen und liefern kein sinnvolles Signal zum Thema.
- Die X-Explore-Trendliste des verbundenen Servers war regional auf Kroatien ausgerichtet, einschließlich „Trending in Croatia“. Sie kann nicht als globale Entwicklung gelten; die irrelevanten Suchbegriffe dürften aus diesen lokalen Trends stammen.
- Direkt relevante Beiträge umfassten nur vier zu Opus 5.5, vier zu Grok 4.7 und drei zu Open-Source-Tools von GitHub, insgesamt also elf. Für die vom Briefing verlangten mindestens zehn Erkenntnisse zu Open Source und Closed Source jeweils reichen die Posts allein nicht aus; die anderen Plattformen müssen ergänzen.
- Namen wichtiger weiterer Akteure wie OpenAI (GPT-6/Sora), Midjourney, Stable Diffusion und Runway waren nicht unter den X-Suchbegriffen und erschienen auch nicht in den gesammelten Daten. Reaktionen zu diesen Akteuren auf X konnten in diesem Durchlauf nicht bestätigt werden.
YouTube
YouTube — Aktuelle Nachrichten zu Bild- und Video-KI (Closed Source / Open Source)
Kanäle
- OpenAI (offizieller Kanal) — offizielle Ankündigungen zu Sora 2 und ChatGPT Images 2.5.
- Google / Google DeepMind (offiziell) — Ankündigungen zur Gemini-Serie „Nano Banana“.
- Adobe (offiziell) — Ankündigungen zu Firefly und dem Multi-Modell-Angebot.
- Runway (offiziell) — Ankündigungen zu Gen-4.5 und dem MCP-Server.
- Lev Selector — individueller Kanal mit wöchentlichen KI-News in der Reihe „Exciting AI Updates Weekly“.
- Tutorial-Kanäle rund um ComfyUI / Stable Diffusion, etwa zu „AI on the Lot“ und ComfyUI-Workflows — produzieren viele Anleitungen zur lokalen Nutzung offener Modelle wie Wan, LTX, Flux und HunyuanVideo.
- Vergleichs- und Review-Kanäle mit Titeln wie „Best AI Video Generator“ — vergleichen Sora 2, Seedance 2.0, Runway und Kling direkt miteinander.
- Abonnentenzahlen konnten nicht geprüft werden, weil die Seiten HTML mit JavaScript-Rendering benötigen und die Suchergebnis-Snippets sie nicht nennen (siehe
## Einschränkungen).
Videos
Closed Source
- Introducing Sora 2 — OpenAI offiziell / 2025-09-30 / https://www.youtube.com/watch?v=gzneGhpXwjU — Bill Peebles, Rohan Sahai und Thomas Dimson stellten Sora 2 und die neue Sora-App vor: ein Videogenerierungsmodell mit physikalisch plausibler Darstellung und synchronisierten Dialogen.
- OpenAI Abandons Sora to Refocus on Enterprise Solutions — Erklärkanal / etwa März 2026 / https://www.youtube.com/watch?v=bIL7uU4CYnE — Erklärt, dass OpenAI die Sora-App am 2026-04-26 und die API am 2026-09-24 schließen will. Vorgestellt wurde auch die Berichterstattung zu rund 1 Mio. US-Dollar Betriebskosten pro Tag gegenüber nur 2,1 Mio. US-Dollar Gesamteinnahmen aus Bezahlzugängen.
- OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans | What Happened? — Erklärkanal / etwa März bis April 2026 / https://www.youtube.com/watch?v=9rhmczPT6Jk — Erläutert als Hintergrund des Sora-Endes, dass eine angeblich 1 Mrd. US-Dollar schwere KI-Partnerschaft mit Disney unmittelbar vor der Ankündigung geplatzt sei.
- Introducing ChatGPT Images 2.5 — OpenAI offiziell / etwa 2026-09-08 / https://www.youtube.com/watch?v=6l7ble9P74o — Ankündigung von GPT Image 2.5 beziehungsweise ChatGPT Images 2.5. Die Generierung soll 50 % schneller sein; neu ist „Sketch“, mit dem handgezeichnete Skizzen direkt in Bilder umgesetzt werden.
- Sketch with ChatGPT Images 2.5 — OpenAI offiziell / September 2026 / https://www.youtube.com/watch?v=imPtIEAEHSU — Demo, bei der Nutzer in ChatGPT „@Sketch“ eingeben, direkt eine Skizze zeichnen und sie unmittelbar als KI-Bild erzeugen lassen.
- The New Gemini Image Generator is Insane (Nano Banana 2) — Review-Kanal / 2026-02-27 / https://www.youtube.com/watch?v=nikIxHM_AQY — Review darüber, dass Google das Standard-Bildmodell der Gemini-App durch „Nano Banana 2“ ersetzt hat.
- Midjourney Update | March 2026: V8 Alpha, BIG Changes Coming, New Edit Model + More — Midjourney-Erklärkanal / etwa März 2026 / https://www.youtube.com/watch?v=TZ1zWvbXFug — Vorstellung der V8-Alpha als Ausgangspunkt weiterer Updates: V8.1 am 2026-04-14, V8.2 mit besserer Qualität und Personalisierung sowie ein ab 2026-08-27 für alle Nutzer zugängliches Bearbeitungsmodell.
- Kling 3.0: the biggest advancement in AI video generation? — Review-Kanal / erste Hälfte 2026 / https://www.youtube.com/watch?v=G1VHCrl4jy4 — Prüfung von Kuaishous „Kling 3.0“, das als erstes Modell native 4K-Videos mit 60 fps generiere und in der Video-Kategorie von Artificial Analysis Platz eins erreicht habe.
- Grok Imagine 1.5 Preview - Mind-Blowing AI Video Just Dropped 🔥 | xAI — Review-Kanal / 2026-06-03 / https://www.youtube.com/watch?v=grxiFAC-NNI — Prüfung der Vorschau auf xAIs Grok Imagine 1.5.
- Sora 2 vs. Seedance 2.0 vs. Runway: The 2026 AI Video War Explained — Vergleichskanal / 2026-02-13 / https://www.youtube.com/watch?v=rb0p_mY3tPs — Gegenüberstellung von Sora 2, ByteDances Seedance 2.0 und Runway.
- Runway Ships an MCP Server - Generate Video From Inside Claude, ChatGPT, Cursor and Replit — Runway offiziell / etwa 2026-05-27 / https://www.youtube.com/shorts/t9Bg_4rOQqM — Runway kündigt einen MCP-Server an, mit dem Videogenerierung direkt aus Claude, ChatGPT, Cursor und Replit möglich wird.
Open Source
- Now that Wan 2.5 (open source model from Alibaba China) can do AI dialogues, AI Lip Syncing to... — Erklärformat / erste Hälfte 2026 / https://www.youtube.com/watch?v=kzXNJO6caGw — Vorstellung, dass Alibabas Open-Source-Modell Wan 2.5 Dialoge und Lippensynchronisation unterstützt.
- Wan2.6: Multi-shot Storytelling & Cinematic Shot Control — Tutorialformat / Ende 2025 bis Anfang 2026 / https://www.youtube.com/watch?v=VHJ925WoWgw — Erklärung der Funktion „Multi-shot Storytelling“ in Wan 2.6: Aus einem Prompt entstehen bis zu 15 Sekunden lange, filmische Videos mit mehreren Einstellungen.
- Black Forest Labs: FLUX 2 – The King of AI Image Generation — Review-Kanal / 2026-06-04 / https://www.youtube.com/watch?v=WZfKzzX65-o — Prüfung von Black Forest Labs’ FLUX.2.
- FLUX.2 Just Beat Every AI Image Model — Black Forest Labs' Most Powerful Release Yet — Review-Kanal / 2025-11-27 / https://www.youtube.com/watch?v=VMBSUBKON_U — Behauptet, dass FLUX.2 bestehende Bildmodelle bei Qualität, Steuerbarkeit und Konsistenz übertroffen habe.
- Qwen Image-2512 First Test – The BEST Open Source Image Model! — Review-Kanal / 2026 / https://www.youtube.com/watch?v=SBaK616nP6Q — Prüfung der neuesten Qwen-Image-2.1-Familie von Alibaba: Textdarstellung, Bildbearbeitung und Erzeugung transparenter Bilder sind integriert; der Generierungsteil hat 7 Mrd. Parameter.
- HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model? — Vergleichskanal / 2026 / https://www.youtube.com/watch?v=4GNT4-QYekg — Lokaler Vergleich von Tencents HunyuanVideo 1.5 (8,3 Mrd. Parameter, auch auf Consumer-GPUs lauffähig) und Alibabas Wan 2.7.
- LTX 2 Full Tutorial | Run on Low VRAM PC + Video & Audio AI Generation (2026 Strongest Open-Source?) — Tutorialformat / 2026 / https://www.youtube.com/watch?v=ytxbq9ZSgxo — Anleitung für Lightricks’ LTX-2, das im Januar 2026 vollständig Open Source wurde; im März erschien LTX-2.3 samt Desktop-Videoeditor. Der Fokus liegt auf der Nutzung auf PCs mit wenig VRAM.
- Best Open-Source AI Video in 2026: WAN 2.2 vs LTX 2.3 — Vergleichskanal / 2026 / https://www.youtube.com/watch?v=ZZ5VH-rqHXQ — Vergleich der beiden großen Open-Source-Videoanbieter Wan 2.2 und LTX 2.3.
- Inpaint Canvas for ComfyUI: Krita-Style Layers, Colour Match & Retouch in One Node — ComfyUI-Erklärkanal / Anfang September 2026, zwei Wochen zuvor veröffentlicht / https://www.youtube.com/watch?v=Lz7AT8SByx8 — Vorstellung des am 2026-09-05 veröffentlichten Open-Source-Custom-Nodes „Inpaint Canvas“ für ComfyUI. Er bietet Ebenen, Auswahlbereiche, SAM-gestützte Auswahl und PSD-Export und macht ComfyUI zu einem ernsthaften Malwerkzeug.
Signale
- Die größte Closed-Source-Nachricht ist das Ende von Sora 2: Sora 2 wurde Ende September 2025 glanzvoll vorgestellt, doch nach nur einem halben Jahr endete die App am 2026-04-26; die API soll am Folgetag der Recherche, dem 2026-09-24, folgen. Mehrere YouTube-Erklärvideos greifen Berichte auf, nach denen ungefähr 1 Mio. US-Dollar Betriebskosten pro Tag insgesamt nur 2,1 Mio. US-Dollar Aboerlösen gegenüberstanden. Auch die angeblich 1 Mrd. US-Dollar schwere Disney-Partnerschaft sei kurz vor der Sora-Abschaltung gescheitert.
- Bei der Bildgenerierung aktualisieren Google, OpenAI und Midjourney in schneller Folge: Nano Banana 2 (Gemini, 2026-02), GPT Image 2.5 / ChatGPT Images 2.5 (2026-09-08, mit Sketch) und Midjourney V8 → V8.1 → V8.2 (2026-03 bis 08, Bearbeitungsmodell für alle Nutzer) zeigen, dass Closed-Source-Anbieter weiterhin alle paar Monate neue Modelle veröffentlichen.
- Vergleichsinhalte zum „Krieg“ der Videogenerierung sind zum Standard geworden: Viele Videos und Shorts vergleichen Sora 2, Seedance 2.0, Runway Gen-4.5, Kling 3.0 und Grok Imagine. Das legt nahe, dass sich die Aufmerksamkeit von der Bindung an ein einzelnes Tool zur Frage verschiebt, welches gerade am stärksten ist.
- Alibaba (Wan), Tencent (HunyuanVideo), Black Forest Labs (FLUX) und Lightricks (LTX) bilden das Kernfeld von Open Source: Alle veröffentlichen Modelle über Hugging Face oder GitHub, und es erscheinen viele Tutorials für ComfyUI und lokale GPUs. Wan erweitert seine Funktionen schnell um Dialoge, Lippensynchronisation und Multi-shot-Aufnahmen (2.5 → 2.6).
- Das ComfyUI-Ökosystem hat sich als „Schaltpult“ der generativen KI etabliert: Allein im September 2026 erschienen unter anderem Core Sparse Attention Node, Comfy Compiler, Inpaint Canvas, MiniMax H3 RefMods und Krea2T Enhancer. ComfyUI wird damit immer sichtbarer zur Mittelschicht, die Open-Source-Modelle in reale Produktionsabläufe überführt.
- Adobe Firefly entwickelt sich zum Integrationshub für Closed und Open Source: Neben eigenen Modellen bündelt Firefly mehr als 30 externe Modelle, darunter Runway Gen-4.5, Google Nano Banana Pro, OpenAIs Bildgenerierung und Black Forest Labs FLUX.2 [pro]. Auch im Unternehmensumfeld breitet sich damit die Nutzung verschiedener Tools je nach Zweck aus, statt sich für nur eines zu entscheiden.
- Reißerische Review- und Vergleichstitel machen einen großen Teil des Angebots aus: Titel wie „BEST AI Image Generator in 2026 (Don't Choose Wrong!)“ sind weit verbreitet. Die Wahl eines Modells selbst wird damit zum Content, oft stärker als die eigentliche technische Information.
Einschränkungen
- Die YouTube-Such- und Videoseiten benötigen JavaScript-Rendering; mit WebFetch konnten keine tatsächlichen Aufrufe, Abonnentenzahlen oder Veröffentlichungsdaten aus dem HTML gelesen werden. Die genannten Daten und Zusammenfassungen basieren daher ausschließlich auf Such-Snippets; exakte Aufrufzahlen wurden nicht angegeben.
- Bei einigen Videos, etwa zu Wan 2.6 oder dem HunyuanVideo-Vergleich, war nur „2026“ und nicht der Monat ermittelbar. Ob sie das Kriterium „innerhalb von 60 Tagen“ strikt erfüllen, ist daher offen. Bevorzugt wurden eindeutig aktuelle Inhalte wie die Berichte zum Sora-API-Ende, ChatGPT Images 2.5 und Inpaint Canvas.
- Kein offizielles YouTube-Video zu der bevorstehenden Sora-API-Abschaltung am 2026-09-24 wurde gefunden; verfügbar waren nur nachgelagerte Videos von Erklärkanälen.
- Japanischsprachige YouTube-Kanäle und -Videos erschienen bei den verwendeten Suchanfragen nicht weit oben; die Informationen stammen überwiegend aus dem englischsprachigen Raum.
Bluesky
Bluesky — Aktuelle Entwicklungen bei Bild- und Video-KI
Accounts
- @stabilityai.bsky.social — offizieller Stability-AI-Account. In der zweiten Hälfte von 2025 ging es jedoch überwiegend um Stable Audio und Unternehmenspartnerschaften, nicht um Bildmodelle; Likes lagen meist bei null.
- @midjourneyofficial.bsky.social — offizieller Midjourney-Account. Midjourney kündigte im August 2025 den Start auf Bluesky an, aber der jüngste Post stammt vom 2025-10-08; aktuelle Nachrichten fehlen.
- @promptheroofficial.bsky.social — offizieller Account von PromptHero, einem Prompt-Sharing-Dienst. Kommuniziert die Verfügbarkeit geschlossener Modelle wie Sora 2.
- @ethanhe.bsky.social — xAI-Ingenieur im Grok-Imagine-Team, zuvor bei NVIDIA und Meta. Einer der wenigen Insider-Accounts, die direkt über neue Grok-Imagine-Funktionen und Recruiting posten.
- @chorizemabang.bsky.social — japanischsprachiger Nutzer von Grok Imagine, der Videos generiert. Bietet Nutzerperspektiven, Beschwerden und Störungsmeldungen.
- @metalmickey.bsky.social (澤村徹) — Künstler aus Tokio, der mit Seedance 2.5, GPT-6 und Suno V6 Musikvideos und Ausstellungsarbeiten erstellt. Seine Beiträge enthalten konkrete Berichte zu Produktionskosten.
- @you32081.bsky.social — Creator, der R-18-Illustrationen mit Open-Source-Modellen wie Qwen-Image und Z-Image-Turbo erstellt.
- @lijack1001.bsky.social — SEO-Spam-Account, der massenhaft Klonseiten zu Nano Banana Pro, Seedance, Sora 2, Veo 3, Wan und GPT-5 Image postet. Keine Nachrichtenquelle, aber ein Hinweis darauf, welche Modellnamen als lukrative Suchbegriffe gelten.
- @runwayml.bsky.social / @blackforestlabs.bsky.social / @comfy-ui.bsky.social — Die offiziellen Handles von Runway, Black Forest Labs und ComfyUI existieren, sind aber praktisch inaktiv oder haben nur einen aktuellen Post aus 2024.
Beiträge
- PromptHero: „Sora 2 is now available on Prompthero: No watermarks, Available in Europe, Combine it with other models“ — 2025-10-13, 0 Likes / 0 Reposts. Beitrag
Closed Source. Zeigt, dass ein Drittanbieter Sora 2 als „ohne Wasserzeichen, in Europa verfügbar“ und kombinierbar mit anderen Modellen vermarktet. - xAI, Ethan He: „Excited to share our most advanced image generation model at xAI! Grok Imagine Quality mode — enhanced details, stronger text rendering...“ — 2026-04-05, 0 Likes / 0 Reposts. Beitrag
Closed Source. Ein offizieller xAI-Ingenieur kündigt für Grok Imagine den Quality-Modus mit mehr Details und besserer Texterzeugung an. - xAI, Ethan He: Stellenausschreibung für Video-Trainer, „familiarity with AI video generation tools (Grok Imagine, Runway, Kling, Sora, Veo, or similar)“ — 2026-03-29. Beitrag
Closed Source. Beleg dafür, dass xAI Personal in die Erstellung von Trainingsdaten für Videomodelle investiert; Runway, Kling, Sora und Veo werden direkt als Vergleich genannt. - @chorizemabang: „Grok Imagine kann echt gar nichts mehr erzeugen, aber es hat auch seinen Reiz, sich Zeit zu lassen und ein Werk pro Tag zu machen.“ — 2026-06-05, 13 Likes / 1 Repost. Beitrag
Closed Source. Nutzerbericht über eine Störung bei Grok Imagine. - @chorizemabang: „Grok Imagine ist kaputt, daher als Entschuldigung frühere Arbeiten ...“ — 2026-05-31, 11 Likes / 1 Repost. Beitrag
Closed Source. Zusammen mit dem vorherigen Beitrag ein Hinweis auf Stabilitätsprobleme im Mai und Juni. - @metalmickey: „road movie rain version. Stitched Seedance2.5's 30-second clips. Fees are devastating.“ — 2026-08-27. Beitrag
Closed Source. Ein etwa fünfminütiger KI-Roadmovie aus Seedance-2.5-Clips und Frust über die hohen Kosten. - @metalmickey: „Attempted creating music video entirely AI-delegated without writing a single prompt line. GPT-6 Astra enables voice-directed workflow.“ — 2026-09-07. Beitrag
Closed Source. Ein neues Produktionsbeispiel: Ein Musikvideo nur durch Sprachanweisungen mit GPT-6 Astra, ohne selbst eine Prompt-Zeile zu schreiben. - Stability AI: „We're launching our Stability AI Image Services on Amazon Bedrock, bringing professional-grade image editing capabilities...“ — 2025-09-18, 0 Likes / 0 Reposts. Beitrag
Eher Closed-Source-API. Bildbearbeitung wie Inpainting und Stiltransfer wird über AWS Bedrock als Dienst angeboten. - Midjourney offiziell: „#Midjourney is now on BlueSky! Who are the best creators to follow here?“ — 2025-08-15, 41 Likes / 4 Reposts. Beitrag
Midjourney selbst ist Closed Source, aber der Account stellte die Kommunikation auf Bluesky danach weitgehend ein; ein Beispiel für einen Einstieg ohne dauerhafte Etablierung. - @you32081: R-18-KI-Illustrationen mit Qwen-Image / Z-Image-Turbo — 2026-08-01, 6 Likes / 0 Reposts. Beitrag
Open Source. Ein Beispiel dafür, dass chinesische Open-Weights-Modelle wie Qwen-Image und Z-Image-Turbo im Dōjin- und R-18-Umfeld reale Produktionswerkzeuge sind.
Signale
- Auf Bluesky gibt es keinen starken, spezialisierten Hub für Nachrichten zu Bild- und Video-KI. Offizielle Accounts von Midjourney, Stability AI, Runway, Black Forest Labs und ComfyUI sind fast vollständig still oder erzielen nur null bis wenige Interaktionen. Anders als X oder Reddit ist Bluesky kein schneller Diskussionsort für das Thema.
- Closed-Source-Themen erscheinen fast ausschließlich über individuelle Insider-Accounts der Modellunternehmen. Der einzige kontinuierlich aktive Account war Ethan He von xAIs Grok-Imagine-Team; er postete im März und April 2026 praxisnahe Informationen zum Quality-Modus und zur Einstellung von Video-Trainern.
- Grok Imagine scheint im Mai und Juni 2026 instabil gewesen zu sein. Der japanische Nutzer @chorizemabang schrieb mehrfach, dass keine Generierung mehr möglich sei oder der Dienst „kaputt“ sei. Kurz zuvor hatte xAI im April noch Verbesserungen angekündigt. Möglicherweise kam der Betrieb mit schnellem Wachstum nicht nach.
- Als Produktionsprotokoll fällt vor allem ByteDances Seedance 2.5 auf. Ein Künstler aus Tokio erstellte im August 2026 einen etwa fünfminütigen KI-Roadmovie aus Seedance-2.5-Clips und beklagte wiederholt die hohen Kosten – ein konkretes Problem bei kostenpflichtigen Closed-API-Workflows.
- Open-Source-Modelle wie Flux, Wan, Qwen-Image, Z-Image-Turbo, HunyuanImage und ComfyUI tauchen nicht als Nachrichten auf, sondern nur fragmentarisch als Hashtags in individuellen R-18- und Dōjin-KI-Kunstbeiträgen. Ein spezialisierter Nachrichten-Account wie r/StableDiffusion wurde auf Bluesky nicht gefunden.
- Es gibt viel Affiliate- und SEO-Spam mit Modellnamen. Accounts wie @lijack1001 posten mechanisch Links zu Klonseiten für „Nano Banana Pro“, „Seedance 2.0“, „Sora 2“, „Veo 3“, „Wan 2.2“ und „GPT-5 Image“. Das sagt etwas über Suchnachfrage, aber nichts über Nachrichtenqualität.
- Nano Banana Pro wird im R-18- und KI-Kunst-Umfeld häufig erwähnt. In Hashtags und Profilbeschreibungen erscheint es neben Ideogram 4 und Krea 2 als eines der derzeit verwendeten kommerziellen Tools.
Einschränkungen
- Die offizielle Bluesky-Volltextsuche (
app.bsky.feed.searchPosts) antwortete bei allen getesteten Anfragen – darunterStable Diffusion,Midjourney,Fluxundtest– dauerhaft mit HTTP 403. Andere Endpunkte wieapp.bsky.actor.getProfile,app.bsky.actor.searchActorsundapp.bsky.feed.getAuthorFeedfunktionierten. Daher war nur die indirekte Methode Account-Suche → jeweilige Beitragslisten möglich. - Die Webversion
bsky.appist eine clientseitig gerenderte SPA und lieferte beim Abruf nur leere Seiten. Die öffentlichen JSON-APIs mussten direkt verwendet werden. - Weil keine Volltextsuche verfügbar war, wurden unbekannte relevante Accounts und Beiträge möglicherweise übersehen. Insbesondere bleibt offen, ob spezialisierte News-Accounts für Open-Source-Modelle nicht existieren oder nur wegen der Suchbeschränkung nicht gefunden wurden.
- Die offiziellen Accounts von Stability AI, Midjourney, Runway, Black Forest Labs und ComfyUI wurden geprüft, enthielten aber keine aktuellen Nachrichten zu neuen Bild- oder Videomodellen. Das beschreibt die Besonderheit von Bluesky, nicht die Aktivität auf anderen Plattformen.
Lemmy
Lemmy — Nachrichten zu Bild- und Video-KI (Open Source / Closed Source)
Lemmy ist ein kleines dezentrales Forum. Diskussionen über KI-Bildgenerierung konzentrieren sich vor allem auf !«メールアドレス» und angrenzende Communities sowie auf !«メールアドレス», das r/ArtificialInteligence automatisch spiegelt. Die Such-API von lemmy.world (/api/v3/search) und Websuche wurden plattformübergreifend mit Begriffen wie „image generation“, „video generation“, „Stable Diffusion“, „Flux“, „Qwen Image“, „Sora“, „Midjourney“, „Nano Banana“, „Grok Imagine“ und „ComfyUI“ genutzt.
Communities
!«メールアドレス»— 5.713 Abonnenten. Schwerpunkt auf Open-Weights-Bild- und Videomodellen sowie ComfyUI-Technikbeiträgen.!«メールアドレス»— 2.361 Abonnenten. Überwiegend geteilte generierte Werke, kaum Nachrichtenwert.!«メールアドレス»— Täglich viele Anime-artige generierte Bilder über civitai; keine Nachrichtenartikel, sondern Werkbeiträge.!«メールアドレス»(Free Open-Source AI) — 4,84 K Abonnenten, davon 1,81 K lokal. Allgemeine Open-Source-KI-Community; wenige Beiträge speziell zu Bild- und Videogenerierung.!«メールアドレス»— Automatischer Spiegel von r/ArtificialInteligence. Es handelt sich nicht um originäre Lemmy-Diskussionen, sondern um Bot-Reposts.!stable_diffusion_abstraction(50 Personen) /!stable_diffusion_furry(52 Personen) /!stable_diffusion_mycology(97 Personen) — Kleine Nischen-Communities zur Präsentation von Werken.
Beiträge
Open-Source-nah
-
Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency
!«メールアドレス», 2026-09-22, Score 9
https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
Ein Open-Weights-Modell für Bildgenerierung und -bearbeitung des Qwen-Teams von Alibaba mit 7 Mrd. Parametern. Unterstützt RGBA-Ausgaben mit Transparenz für Logos und freigestellte Assets, native 2.048 × 2.048 Auflösung und bis zu zehn Referenzbilder; native ComfyUI-Integration. -
Qwen-Image-2.1: Compact, efficient, and unified image creation
!«メールアドレス», 2026-09-20, Score 1
https://qwen.ai/blog?id=qwen-image-2.1
Ankündigung im offiziellen Qwen-Blog; Primärquelle für den vorherigen ComfyUI-Beitrag. -
supElement/ComfyUI_MinimaxH3_AutoContext: A long video generation solution that breaks through the memory barrier
!«メールアドレス», 2026-09-16, Score 1
https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
Eine ComfyUI-Erweiterung für MiniMax H3. Sie teilt Videos automatisch in Segmente und verbindet sie mit Latent Anchoring, um VRAM-Beschränkungen bei der Generierung längerer Videos zu umgehen. Apache-2.0, 31 Stars, 153 Commits. -
Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
!«メールアドレス», 2026-09-16, Score 3
https://github.com/Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
Ein weiterer ComfyUI-Prompt-Builder für MiniMax H3. Ein Beispiel für die aktiv aktualisierte Werkzeugschicht rund um lokale Videogenerierungs-Workflows. -
Boogu-Image-0.1 — Efficient Image Generation Foundation Model
!«メールアドレス», 2026-06-17, Score 5
https://boogu.org/
Veröffentlichung eines neuen Open-Source-Foundation-Modells für Bildgenerierung mit Fokus auf geringem Ressourcenbedarf und Effizienz. -
AI video generation is becoming less about the model and more about the workflow
!«メールアドレス»(Reddit-Spiegelung), 2026-09-19, Score 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wkl4db/
Ein Beitrag mit der These, dass die Qualität von Videogenerierung immer weniger vom einzelnen Modell und immer stärker von Open-Weights-Modellen plus ComfyUI-ähnlichen Workflows abhängt.
Closed-Source-nah
-
OpenAI is shutting down Sora's API next week while a Chinese competitor raised $3B
!«メールアドレス»(Reddit-Spiegelung), 2026-09-20, Score 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
Sora 2 soll seine API am 24. September schließen, nachdem die App bereits im April eingestellt wurde; zugleich sammelte der chinesische Wettbewerber Kuaishou (Kling) 3 Mrd. US-Dollar ein. Die Diskussion: Auffällige Consumer-Angebote scheitern, während unauffällige Geschäftsanwendungen Erträge erzielen. -
Midjourney pivots from AI image generation to body scanning medical spa (Hintergrundartikel; großer Wechsel vom Juni mit fortdauernder Wirkung)
!«メールアドレス», 2026-06-18, Score 58
https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
Bericht, dass Midjourney von KI-Bildgenerierung in das Geschäft mit medizinischen Geräten wie Ultraschall-CT-Scannern wechselt. Dazu erschienen in!«メールアドレス»auch „Midjourney Medical“ und „Midjourney Ultrasonic CT Scanner“, beide am 2026-06-18. -
Midjourney wants Hollywood studios to reveal the details of their AI usage
!«メールアドレス», 2026-07-05, Score 73
https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-ai-usage/
Fortsetzung: Auch nach dem Wechsel in die Medizintechnik streitet Midjourney mit Hollywood über Urheberrecht und den tatsächlichen KI-Einsatz in Bild- und Videoproduktion. -
Google lanciert KI-Bildgenerierung Nano Banana 2 Lite
!«メールアドレス», 2026-07-02, Score 0
https://www.itmagazine.ch/artikel/87529/
Schweizer Techmeldung über die Veröffentlichung von Googles Gemini-Bildmodell „Nano Banana 2 Lite“. In!«メールアドレス»gab es außerdem einen Link zur Primärquelle auf deepmind.google vom 2026-06-30. -
Seedream 5.0 Pro is here: an honest comparison and technical breakdown
!«メールアドレス»(Reddit-Spiegelung), 2026-07-10, Score 1
https://www.reddit.com/gallery/1usc03q
Review und technischer Vergleich des Closed-Source-Modells „Seedream 5.0 Pro“ von ByteDance. -
Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images
!«メールアドレス»(Reddit-Spiegelung), 2026-08-07, Score 1
https://fortune.com/2026/08/07/
Bericht, dass Google die Funktion „Earth AI“ unmittelbar nach der Veröffentlichung zurückzog, nachdem Nutzer problematische Bilder erzeugt hatten. Ein Beispiel für Guardrail-Probleme bei Closed-Source-Anbietern. -
Elon Musk maakt complete AI-film met zijn versie van The Odyssey
!«メールアドレス», 2026-07-22, Score 1
https://lemy.nl/post/4342454
Niederländischer Artikel darüber, dass Elon Musk mit den Videogenerierungsfunktionen von Grok (xAI) einen Film zu seiner eigenen Interpretation der „Odyssee“ erstellt. Ein Thema mit starkem Marketingcharakter. -
Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?
!«メールアドレス»(Reddit-Spiegelung), 2026-09-14, Score 1
https://www.reddit.com/gallery/1wfyqdy
Vergleich von vier KI-Farbgebungen derselben Manga-Seite, darunter ein GPT-Bildmodell. Der Beitrag bewertet GPT als überlegen.
Signale
- Die meisten „lebendigen“ Diskussionen über Bild- und Video-KI auf Lemmy beschränken sich auf ComfyUI-Werkzeuge in
!«メールアドレス»und Reddit-Spiegelungen in!ai_reddit. Originäre Lemmy-News sind selten. - Open Source dreht sich eher um ComfyUI-Workflows und Erweiterungs-Nodes als um einzelne Modelle. Zwei Erweiterungen für MiniMax H3 wurden innerhalb einer Woche gepostet, was eine aktive praktische Werkzeugschicht für Videogenerierung zeigt.
- Bei Closed Source dominieren Rückzug und Strategiewechsel: Sora-API-Ende, Midjourneys Wechsel zu Medizinprodukten und Googles sofortiger Rückzug von Earth AI. Statt spektakulärer Releases stehen fehlgeschlagene Monetarisierung und Kurskorrekturen im Vordergrund.
- Werk-Communities wie
!«メールアドレス»haben zwar viele Beiträge, bestehen aber aus einer Abfolge von civitai-Bildern und besitzen kaum Nachrichtenwert.
Einschränkungen
- Lemmy ist im Vergleich zu Reddit und X sehr klein; selbst
!«メールアドレス»hat nur 5.713 Abonnenten. Lemmy allein verfügt nicht über genügend originäre Nachrichten, um die rund 20 geforderten analysierten Beiträge zu erreichen; erwartungsgemäß liegt die Menge bei fünf bis zwölf. !ai_redditbietet keine originären Lemmy-Diskussionen, sondern automatische Reddit-Reposts mit fast keinen Kommentaren. Reaktionen der Lemmy-Community selbst waren praktisch nicht beobachtbar.- Der API-Endpunkt
/api/v3/communityverlangte oft einecommunity_id; einige Communities wieaiwarsoder eine Suche nachimageaiführten zu 400/404-Fehlern. Diese Fälle wurden nur anhand von Websuchergebnissen ergänzt. - Spezifische Suchen nach Videomodellen wie „Wan“, „HunyuanVideo“ und „Kling“ erzeugten viel Rauschen, weil die Begriffe mit allgemeinen Wörtern oder Abkürzungen kollidierten. Klar originäre Lemmy-Beiträge dazu wurden nicht gefunden.
Pinterest — Nachrichten zu Bild- und Video-KI
Visuelle Themen
- „AI NEWS“-YouTuber-Thumbnail-Stil: überraschte oder begeisterte bärtige Creator vor neonfarbenen, abgerundeten Logos von OpenAI, Google, Microsoft, Meta und Notion im Raster – der mit Abstand häufigste Pin-Stil. [1, 8, 30]
- SaaS-Headerbilder für KI-Videogenerierungstools: dunkelblaue oder violette UI-Mockups mit leuchtendem „Textprompt → Generieren“-Feld oder einem niedlichen weißen Roboter-Maskottchen mit Filmklappe, kombiniert mit Funktionsreihen wie Text-to-Video / KI-Bearbeitung / automatischer Soundtrack / Untertitel. [6, 11, 16]
- Vergleichstabellen und Rankings für „das beste Tool“: neonumrandete Entscheidungsmatrizen und „My Top Picks“-Karten zu ChatGPT Plus, Midjourney, Gemini, Ideogram, Kling, Runway, Luma und Pika, nach Preisstufe und Anwendungsfall. [10, 20]
- Warnbilder zu Deepfakes und Desinformation: rote „FAKE“-Stempel, Lupen über einem „?“, halb menschliche und halb drahtmodellartige Augen, ein Badge „97% likely AI generated“ für Spracherkennung und der eingebrannte Hinweis „AI GENERATED NEWS CLIP“ über einem erfundenen Nachrichtensprecher. [4, 27, 38, 49]
- Werbeanzeigen für Face-Swap- und Identitäts-Mix-Apps: zwei in ein dreieckiges Mesh übergehende Gesichter („Professional Face Swap“) sowie ein Triptychon aus Mutter, Vater und prognostiziertem Kind („AI Baby in Seconds“). [43, 44]
- Verspielte KI-Bilder als Stil-Demos oder Engagement-Köder: ein hyperrealistischer Otter in Schwimmweste auf einem Surfbrett, ein Porträt eines alten Fischers und eine Fantasy-Collage mit Schloss, Eisbär, Samurai-Paar und Kuchen. Der Fokus liegt auf Generierungsqualität statt Nachrichten. [13, 34, 45]
- Einfach erklärte Infografiken: Ein achtstufiges Diagramm „wie KI Video generiert“ (Prompt → Sprachverständnis → latenter Raum → Frame-Diffusion → Konsistenzprüfung → Ausgabe) für Laien, nicht für Entwickler. [12]
- Bilder zur Veränderung von Nachrichtenräumen und Avatar-Ökonomie: Eine Regieraum-Collage mit KI-generierten Nachrichtensprechern auf Monitorwänden, ein Raster stilisierter Influencer-Avatare hinter einem fotorealistischen Gesicht und eine Grafik „Human Journalism vs Machine-Generated Media“ mit zwei Wegen. [38, 40, 23]
Auffällige Pins
- #1 — „AI News: Anthropic Leak Shows Us The Future of AI...“: Klassisches Thumbnail mit schockiertem Creator und OpenAI-/Google-/Microsoft-/ChatGPT-Logos; setzt die visuelle Vorlage, die viele andere „AI NEWS“-Pins kopieren.
- #3 — „Google announces ultra-high quality video...“: Ein 3×5-Raster, das ein Quellvideo in Varianten wie Holzklötze, Origami, Lego und Blumen überführt – eine konkrete Demo zur Videostilübertragung im Lumiere-Stil, nicht nur eine Schlagzeilenkarte.
- #10 — „AI Image Video: Best Quality vs Best Free“: Eine vollständige Entscheidungsmatrix mit zehn kostenpflichtigen Tools, zehn kostenlosen Tools und Anwendungsfällen – das klarste Einzelartefakt für die in dieser Sammlung sichtbare Unsicherheit „Welches KI-Tool soll ich eigentlich nutzen?“.
- #12 — „AI & Machine Learning: How AI Generates Video Infographic“: Eine achtstufige Infografik zur Diffusions- und Frame-Vorhersage-Pipeline von LivePhysics.com, die sich an Einsteiger richtet – gut geeignet als „Erklär es einem Freund“-Referenz.
- #27 — „AI is getting scary good“: Vereint KI-Videogeneratoren, KI-Spracherkennung mit „97% likely AI generated“ und KI-Ethik in einer Infografik – die konzentrierteste Darstellung des Deepfake-Angstthemas.
- #38 — „AI News Anchors & Creator-Led Coverage Take Over U.S. Media“: Regieraum-Collage mit KI-generierten Sprechern auf einer Monitorwand; visualisiert direkt, wie KI-Avatare traditionelle Nachrichtentalente verdrängen.
- #40 — Niederländischsprachiges „Het perfecte avatar-tijdperk“ (das perfekte Avatar-Zeitalter): Ein fotorealistisches Gesicht vor einem Raster stilisierter KI-Avatare – zeigt den KI-Influencer-Trend als spezifisch europäisches Pinterest-Suchergebnis und die Mehrsprachigkeit des Themas.
- #43 — Akool „Professional Face Swap“ (spanischsprachige Anzeige): Zwei Frauengesichter verschmelzen über ein Face-Mesh-Overlay. Ein kommerzielles Face-Swap-Produkt, das auf Pinterest direkt beworben wird, nicht nur diskutiert.
- #44 — „AI Baby in Seconds“: Triptychon aus Mutter, prognostiziertem Kind und Vater – ein eigenständiges, schnell wachsendes Subgenre der KI-Baby-Generatoren, das als eigener Pin-Cluster erschien.
- #49 — „You Are Not Prepared for This Terrifying New Wave of AI-Generated Videos“: Ein KI-generierter Fake-Nachrichtensprecher mit dem direkt eingeblendeten Label „AI GENERATED NEWS CLIP“ – der deutlichste Warn-Pin der Sammlung.
Signale
- Die Ermüdung bei der Tool-Auswahl ist die vorherrschende Verbraucherperspektive. Ein großer Anteil der Pins besteht aus Vergleichstabellen, „best free vs paid“-Matrizen und „my top picks“-Karten statt aus Nachrichten zu einzelnen Releases. Pinterest-Nutzer suchen eher nach Kauf- und Einführungsorientierung als nach Ankündigungen. [10, 20, 29]
- Angst vor Deepfakes und Desinformation ist ein eigenes visuelles Genre, keine Randnotiz: FAKE-Stempel, Sprachdetektor-Badges und Offenlegungslabels für KI-Inhalte erscheinen nahezu so häufig wie Werbeinhalte für Tools. [4, 27, 38, 41, 49]
- Der Trend zu KI-Nachrichtensprechern hat klare visuelle Präsenz: Mehrere unabhängige Pins – Regieraum-Collagen, Channel1-Inhalte und „AI generated news clip“-Labels – behandeln KI-Moderatoren als aktuelles, diskutiertes Phänomen statt als Hypothese. [38, 49, 50]
- Fehlend: Open Source ist nahezu unsichtbar. In der Stichprobe ist AMDs „Amuse 3.0“ [34] das einzige eindeutig lokale/offene Tool. Es gibt keine Screenshots von Stable Diffusion, ComfyUI oder lokalen Modelloberflächen – ein klarer Kontrast zur starken Präsenz Closed-Source-naher Namen und Oberflächen wie ChatGPT, Gemini, Midjourney, Kling, Runway und Luma.
- Fehlend: Direkte Produktscreenshots der neuesten bekannten Closed-Modelle. In der Stichprobe tauchten keine nativen UI-Aufnahmen von Sora 2, Nano Banana oder Veo 3 auf. Die meisten Closed-Source-Pins sind Affiliate- oder Creator-Thumbnails, die über Neuigkeiten sprechen, keine Produktbilder.
- Warnsignal: Pin #47 mit dem Titel „Elon Musk's New AI Already Being Used to Generate...“ zeigt tatsächlich eine Montage von Donald Trump und einer Frau mit Daumen hoch in einem Cockpit, im Hintergrund das brennende World Trade Center. Der Titel beschreibt das Bild überhaupt nicht. Das ist ein konkretes Beispiel für realistisch wirkende, KI-komponierte Katastrophen- und Politbilder unter unpassenden Clickbait-Titeln und zeigt, dass Pin-Titel in diesem Datensatz nicht als verlässliche Bildbeschreibung gelten können.
Einschränkungen
- Für diesen Durchlauf wurden keine Genres definiert; eine einzige ungefilterte Suche nach „Image and Video Generation AI News“ mischt deshalb Creator-Thumbnails, Produktanzeigen, Stockfotos und nachrichtenartige Bilder statt sie thematisch vorzusortieren.
- Von 50 gesammelten Bildern wurden nur 26 geöffnet und visuell geprüft. Sie bilden eine repräsentative Auswahl mit Fokus auf unterschiedliche Titel und Themen; die Schlussfolgerungen beruhen auf dieser Stichprobe.
- Einige Titel passten nicht zu den Bildern, besonders #47. Themen, die nur aus einer Titeltabelle abgeleitet werden, wären daher unzuverlässig; dieser Bericht basiert auf dem tatsächlich sichtbaren Bildinhalt.
- Für Pinterest-Pins lagen keine Repin- oder Like-Zahlen vor. Was „im Trend“ ist, wird aus der Häufigkeit wiederkehrender visueller Stile abgeleitet, nicht aus gemessener Popularität.
- Pinterest ist stark von sekundären und abgeleiteten Inhalten geprägt – Thumbnails, Blog-Header und Werbemittel statt Primärankündigungen. Konkrete Produkt- oder Versionsangaben, etwa zu Veo- oder Kling-Releases, müssten auf Primärplattformen geprüft werden.
Empfohlene Maßnahmen
- Den lokalen OSS-Video-Stack aus Wan, HunyuanVideo, FLUX.2 sowie ComfyUI + MiniMax H3 als praktische Alternative beobachten, während geschlossene Tools Preise erhöhen und Produkte einstellen.
- Der wachsenden Haltung auf Reddit und Pinterest zugunsten einer Kennzeichnung von KI-Inhalten vorgreifen und jetzt Botschaften zu Herkunft und Kennzeichnung vorbereiten.
- Verfolgen, wohin Nutzer nach der Abschaltung der Sora-2-API am 2026-09-24 wechseln; Kling, Seedance und Runway sind wahrscheinliche Profiteure.
- Die One-shot-Generierungsdemos zu Opus 5.5 und Grok 4.7 auf X als kurzlebigen Hype im Release-Fenster behandeln, nicht als dauerhafte Gefahr für die Wahrnehmung von OSS.
- Die Rechenkapazitätsprobleme beim Hochskalieren von DeepSeek als Frühindikator dafür beobachten, was passiert, wenn die Nutzung von Open Weights die eigene Infrastruktur eines Betreibers überholt.
- Die auf YouTube und Pinterest sichtbare Ermüdung bei der Frage „Welches Tool nutze ich?“ mit Vergleichsinhalten ansprechen, nicht mit Neuigkeiten zu einzelnen Produkten.
Gesammelte Bilder


















































Hinweis zur Datenqualität
Nur YouTube und Pinterest erreichten ungefähr das Ziel des Briefings von rund 20 Elementen. Reddit lieferte nur 12 Threads, meist aus themenfremden allgemeinen Subreddits. Von den 40 X-Beiträgen war mehr als die Hälfte Rauschen durch nicht verwandte Trendbegriffe. Die Bluesky-Volltextsuche antwortete dauerhaft mit 403, sodass die Abdeckung ausschließlich auf bekannten Accounts beruhte. Lemmy ist schlicht zu klein (wichtigste Community: rund 5.713 Abonnenten; etwa die Hälfte der Beiträge sind Reddit-Spiegelungen), um 20 originäre Beiträge zu erreichen.



