KEN’S CAT LOG

KI-News zur Bild- und Videogenerierung — 2026-09-09

Bei Closed-Source liefern sich Googles Nano Banana Pro und OpenAIs GPT Image 2 ein Kopf-an-Kopf-Rennen, während Sora ausläuft. Open Source rückt mit Qwen-Image, FLUX, Wan und HunyuanImage an Closed-Source-Qualität heran.

Zusammenfassung der KI-News zur Bild- und Videogenerierung — 2026-09-09

Ich habe alles zusammengetragen 🔥 Unterm Strich liefern sich auf der Closed-Source-Seite Googles Nano Banana Pro (Gemini 3 Pro Image) und OpenAIs GPT Image 2 ein Kopf-an-Kopf-Rennen. Die eigenständige Sora-App steht dagegen kurz vor dem Aus, und bei Video sind Kling, Seedance und Veo – also chinesische Anbieter plus Google – das zentrale Schlachtfeld 😤 Auf der Open-Source-Seite sind Qwen-Image, Z-Image, FLUX, Wan und HunyuanImage inzwischen auf einem Niveau, bei dem man denkt: „Das gibt es kostenlos?!“ Die Communities rund um ComfyUI und lokale Workflows sind weiterhin ausgesprochen aktiv 💪 Bei X gab es dieses Mal allerdings einen kompletten Fehlgriff – das halte ich offen fest.

Plattformübergreifend

Erkenntnisse zu Closed Source (10) 🏢

  1. Nano Banana Pro (Gemini 3 Pro Image) gilt als Modell, das „alle anderen bei der Bildgenerierung überrollt“, und dominiert die YouTube-Diskussion → https://www.youtube.com/watch?v=UV9GqinedQ8
  2. OpenAIs GPT Image 2 ist erschienen: über 99 % Textgenauigkeit in mehr als 12 Sprachen, im Thinking-Modus acht Bilder pro Durchlauf und laufende 4K-Unterstützung → https://www.youtube.com/watch?v=blOlUnC75O4
  3. Google hat Imagen am 17. August 2026 vollständig eingestellt und konzentriert sich nun auf die Nano-Banana-Reihe. Closed-Source-Bildgenerierung orientiert sich damit stärker an Google.
  4. OpenAI stellt die Sora-App am 26. April ein; auch die Sora-API soll am 24. September abgeschaltet werden. Die Marke Sora läuft faktisch aus → https://lemmy.world/post/44721138
  5. Bluesky-Nutzer dahara1 berichtete ebenfalls, dass die kostenlose Sora-Version nach dem Aufbrauchen der Credits nicht mehr funktioniere → https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
  6. xAIs Grok Imagine Image 2.0, am 7. August veröffentlicht, liegt in der Arena knapp hinter GPT Image 2 auf Platz zwei – daraus wird ein Dreikampf.
  7. ByteDance stellte Seedance 2.5 am 7. August allgemein per API bereit; neben Veo 3.1 und Kling 3.0 ist es zu einer Kernoption geworden.
  8. Reddit-Nutzer verglichen Seedance 2.5 und das offene Wan 3.0 mit demselben Prompt – die Meinungen gingen weit auseinander → https://www.reddit.com/r/generativeAI/comments/1w60fip/
  9. Midjourney sorgt mit der überraschenden Ausrichtung auf medizinische Ultraschallscanner statt Bildgenerierung für Kritik; es gibt bereits spöttische Vergleiche mit Theranos → Lemmy (über theregister.com)
  10. ByteDance und Hollywoods MPA haben eine weltweite Vereinbarung zum Schutz von KI-Urheberrechten getroffen. Der Umgang mit Copyright wird damit konkreter → Pinterest-Recherche
  11. Auf Reddit löste eine Technik, mit KI „echte handgezeichnete Zeitraffer“ vorzutäuschen, mit 7.088 Punkten heftige Kritik aus; gefordert wird unter anderem eine Kennzeichnungspflicht → https://www.reddit.com/r/antiai/comments/1w81kdd/
  12. Allein auf Bluesky erschienen von Dezember 2025 bis Februar 2026 nacheinander neue Modelle von Kling, Runway, PixVerse, Vidu, Seedance und Niji – die Dynamik chinesischer Anbieter ist deutlich.

Erkenntnisse zu Open Source (10) 🛠️

  1. Qwen-Image 2512 von Alibaba mit Apache-ähnlicher Lizenz und Z-Image Turbo sind die beiden großen Trends; Vergleichsvideos schießen aus dem Boden → https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  2. Flux 2.0 wird gegen Qwen-Image 2512 und Z-Image in einem 15-Punkte-Stresstest antreten gelassen → https://www.youtube.com/watch?v=54zvSiAWz2Y
  3. Lightricks’ LTX-2.3 mit 22 Milliarden Parametern, Audio-Synchronisation und 4K/50 fps wird als Closed-Source-ähnliche Qualität bewertet → https://www.youtube.com/watch?v=qQXzlk134Sw
  4. Praxisvideos behaupten, dass Alibabas Wan 2.5 Googles geschlossenes Veo 3 übertreffe → https://www.youtube.com/watch?v=yvD8TxNsR4Q
  5. Mit WanGP erscheint ein kostenloser Agent, der mehrere OSS-Modelle wie LTX-2.3, Qwen, Flux.2 Klein und Z-Image bündelt. Integrierte Workflows gewinnen an Bedeutung → https://www.youtube.com/watch?v=h-k6xOEITx4
  6. Tencents HunyuanImage 3.0 mit über 80 Milliarden Parametern und MoE-Architektur bleibt ein Referenzpunkt unter großen offenen Bildmodellen.
  7. Black Forest Labs’ FLUX 3 unterstützt Bilder sowie 20-sekündige Videos mit Audio und wurde begrenzt veröffentlicht → https://bfl.ai/blog/flux-3
  8. Es gibt eine leichtgewichtige FLUX.2-klein-9b-kv-fp8-Variante und ein neues FLUX Creator Program; sogar Regisseur Scorsese ist als Berater beteiligt.
  9. In Lemmys Stable-Diffusion-Communities mit rund 5.000 Mitgliedern werden weiterhin täglich Arbeiten aus ComfyUI, SDXL und Krea2 veröffentlicht – ein Zeichen starker Praxisnutzung.
  10. Simon Willison berichtete auf Bluesky, dass Qwen 3.7 27B lokal auf einem M5 MacBook läuft und mit 17 GB GGUF sein bestes Pelikanbild erzeugte. Das stärkt eine Benchmark-Kultur für lokale LLM-Bildgenerierung → https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
  11. Auch das offene Video-Basismodell SkyReels V1 auf HunyuanVideo-Basis sowie der kostenlose All-in-one-OSS-Workflow „Open Creative Studio“ werden kontinuierlich weiterentwickelt → https://bsky.app/profile/perilli.com/post/3mdddenkss22v

Wichtigster plattformübergreifender Punkt: Reddit, YouTube und Lemmy wiederholen dasselbe Bild: „bequem, aber zensiert und teuer“ bei Closed Source gegenüber „frei, aber aufwendig“ bei Open Source. Mehrere Communities sind sich außerdem bei der Skepsis gegenüber Angeboten einig, die „kostenlos und unbegrenzt“ versprechen 🙅‍♂️ Pinterest fällt aus diesem Muster heraus: Dort dominieren Toolvorstellungen und News-Thumbnails.

Plattform für Plattform

Reddit: Es wurden zwölf Threads gesammelt. Ein Anti-KI-Thread mit 7.088 Punkten war auffälliger als alle technischen Themen zusammen. Das zeigt realistisch, dass Ablehnung von KI-Missbrauch leichter sichtbar wird als Begeisterung für Technik. Zentrale Subreddits wie r/StableDiffusion wurden diesmal nicht erfasst – eine Lücke in der Abdeckung.

X: Hier gab es ehrlich gesagt einen kompletten Fehlschlag 😅 Die Suchbegriffe des Workers waren mit Wörtern wie „Harvey“ und „$LAPTOP“ themenfremd. Unter den 40 gesammelten Beiträgen war kein einziger zur Bild- oder Video-KI. Das ist die einzige echte Datenlücke unter den sechs im Briefing genannten Plattformen.

YouTube: Reviews und Vergleichsvideos sind reichlich vorhanden. Bei Closed Source ergibt sich ein Dreikampf zwischen Google, OpenAI und xAI; bei Open Source reicht die Abdeckung von Qwen-Image, FLUX, Wan, LTX-2.3 und HunyuanImage bis zu integrierten WanGP-Workflows. Abrufzahlen und Abonnentenzahlen konnten wegen JavaScript-Abhängigkeit jedoch nicht erhoben werden.

Bluesky: Die Such-API (searchPosts) gab bei allen Anfragen 403 zurück. Deshalb wurde auf Feeds einzelner Accounts ausgewichen. Dadurch ist die Abdeckung geschlossener Videoanbieter über luok.ai gut, offene Video-Themen sind jedoch dünn. Außer SkyReels V1 wurde kaum etwas gefunden.

Lemmy: Closed-Source-News drehen sich vor allem um Midjourneys medizinische Neuausrichtung und Spott über das Ende von Sora. Bei Open Source dominiert Black Forest Labs mit FLUX; dort gibt es quartalsweise konkrete Entwicklungen.

Pinterest: Alle 50 Pins wurden als Bilder geprüft. Neonfarbene News-Thumbnails mit Robotergesichtern und Tool-Infografiken sind vorherrschend. Bilder, die die selbst gehostete Open-Source-Kultur von Stable Diffusion oder ComfyUI repräsentieren, waren unter den 50 Ergebnissen nicht vorhanden. Engagement-Zahlen waren überwiegend nicht verfügbar.

Worauf achten

  • Einstellung der OpenAI-Sora-API am 24. September 2026 — Lemmy https://lemmy.world/post/44721138
  • Entwicklung der Arena-Rangliste: Grok Imagine Image 2.0 gegen GPT Image 2 — YouTube-Vergleichsvideos von Marin Method
  • Der Open-Source-Dreikampf Qwen-Image / Z-Image / FLUX: Welches Modell setzt sich als Standard durch? — YouTube https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  • Ob Midjourneys Geschäft mit Ultraschall-Medizinscannern tatsächlich trägt — Lemmy (über theregister.com)
  • Konkrete Umsetzungsregeln der Copyright-Vereinbarung ByteDance × Hollywood — Pinterest-Recherche [24]
  • Wie weit sich OSS-Integrationsagenten wie WanGP verbreiten — YouTube https://www.youtube.com/watch?v=h-k6xOEITx4

Empfehlungen

  • Für zusätzliche X-Recherchen sollten die Suchbegriffe durch direkt passende Begriffe wie „Midjourney“, „Stable Diffusion“, „Sora“, „Nano Banana“ und „Qwen-Image“ ersetzt werden.
  • Künftige Reddit-Recherchen sollten große Kern-Subreddits wie r/StableDiffusion, r/midjourney und r/comfyui zwingend einschließen.
  • Als Ersatz für Blueskys Such-API mit 403 sollten die hier gefundenen zentralen Accounts wie luok.ai und simonwillison.net als Watchlist kontinuierlich beobachtet werden.
  • Um den Gegensatz zwischen Closed und Open Source sichtbar zu machen, sollten die meinungsstarken Kommentarbereiche von Reddit und Lemmy stärker gewichtet werden als Pinterest.
  • Die Abschaltung der OpenAI-Sora-API am 24. September sowie neue Entwicklungen bei Midjourneys Geschäftswechsel sollten bei der nächsten Recherche höchste Priorität haben.

Datenqualität

Auf X wurde wegen unpassender Suchbegriffe kein einziger relevanter Beitrag zur Bild- oder Video-KI gesammelt; faktisch liegen dort keine Daten vor. Bei Bluesky und Pinterest konnten weder Such-APIs noch Engagement-Zahlen wie Abrufe oder Likes zuverlässig genutzt werden, sodass die Verbreitung der Themen nicht quantitativ belegt ist. Auch auf YouTube waren Videotexte und Abrufzahlen wegen JavaScript-Abhängigkeit nicht abrufbar; die Analyse stützte sich auf WebSearch-Snippets. Für Reddit und Lemmy standen dagegen insgesamt ausreichend viele und hochwertige Materialien zur Verfügung.

Zusammenfassung nach Plattform

Reddit

Reddit — News zur KI-Bild- und Videogenerierung

Wo

Die zwölf gesammelten Threads verteilen sich auf acht Subreddits.

Subreddit Mitgliederzahl Zahl gesammelter Threads
r/generativeAI 151,605 4
r/antiai 319,039 1
r/RemoteWorkers 75,979 1
r/Seedance_AI 20,508 1
r/freetoolsAI 7,942 1
r/aivideomaking 6,614 2
r/AItips101 1,153 1
r/Unrouted_AI 517 1

Das allgemeine Generative-AI-Subreddit r/generativeAI führt mit vier Threads. Bei Punkten und Kommentaren dominiert jedoch ein einzelner KI-kritischer Thread in r/antiai; sein Engagement übertrifft deutlich die Summe aller anderen Threads.

Was die Leute sagen
  • Unzensierte Integrationsplattformen mit viel Freiheit gewinnen an Bedeutung: Thread 1 (r/AItips101, 81 Punkte, 2026-09-07, https://www.reddit.com/r/AItips101/comments/1w9yftp/) stellt „WildOwl.ai“ vor: einen nutzungsbasierten Dienst ohne Abonnement, der Zugang zu mehr als 35 Modellen wie Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo und GPT Image bietet. u/reliablemicrophone84 lobt, dass WildOwl genau das Problem löse, nicht zwischen Spitzenmodellen und kreativer Freiheit wählen zu müssen; u/Clear-Assistance449 hält mit einem Hinweis auf Mage.space und dessen unbegrenztes Abo dagegen.
  • Starke Skepsis gegenüber „kostenlos und unbegrenzt“: In Thread 2 (r/aivideomaking, 2 Punkte, 22 Kommentare, 2026-09-06, https://www.reddit.com/r/aivideomaking/comments/1w953eo/) und Thread 5 (r/generativeAI, 1 Punkt, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1wa4k88/) überwiegt die Ansicht, dass es keine wirklich kostenlosen und unbegrenzten Angebote gibt. u/ai_art_is_art (Thread 5, 3 Punkte) formuliert scharf: „Unlimited is a lie. You put $550 in, you get $200 out and you have to wait 24 hours between generations."
  • Die Bitte um ein 45-Sekunden-Video wird belächelt: In Thread 4 (r/aivideomaking, 13 Punkte, 22 Kommentare, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/) möchte jemand ausschließlich mit Smartphone und iPad kostenlos ein 45-sekündiges KI-Video erstellen. u/NewLifeWares (2 Punkte) verweist auf die technischen Grenzen: „45 seconds is reaching data center level requirements of hardware. At best you might find a free 5 second generator...with a watermark“.
  • KI-gefälschte „echte Zeichnungen“ lösen massive Kritik aus: Thread 3 (r/antiai, 7.088 Punkte, 1.023 Kommentare, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/) behandelt ein GPT-6-ähnliches LLM, das Maus und Tastatur steuert und in einer Malsoftware einen „echten Zeitraffer“ vortäuschen kann. Der mit Abstand höchste Score aller gesammelten Threads. u/Nayutantantan (2.512 Punkte) äußert Enttäuschung darüber, dass sich gefälschte Zeitraffer verbreiten; u/Soggy_Supermarket100 (171 Punkte) fordert: „EVERY SINGLE online space NEEDS AI filtering“.
  • Bei Deepfakes realer Prominenter verdichtet sich die Debatte auf „Nutzerverantwortung“: In Thread 6 (r/Seedance_AI, 0 Punkte, 22 Kommentare, 2026-09-07, https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/) erklärt u/Jean_velvet (7 Punkte), dass neuere Gerichtsentscheidungen die Verantwortung beim Nutzer sehen und vor allem Verbreitung und Teilen potenziell strafbar seien. u/Alchemist42 (1 Punkt) deutet dagegen an: „They don't use Seedance“ – möglicherweise werden weniger regulierte Tools verwendet.
  • Modellvergleich Closed gegen Open: Thread 10 (r/generativeAI, 110 Punkte, 31 Kommentare, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) vergleicht Seedance 2.5 von ByteDance mit Wan 3.0 von Alibaba anhand desselben Prompts. u/SpecialistDragonfly9 (5 Punkte) hält Seedance für „by FAR superior“, während u/Positive-Key6640 (5 Punkte) die Methode kritisiert: Gleich-Prompt-Vergleiche zeigten eher, welches Modell diesen Prompt-Stil möge, als welches insgesamt besser sei.
  • OpenAIs neues Bildmodell wird leise diskutiert: Thread 7 (r/Unrouted_AI, 2 Punkte, 6 Kommentare, 2026-09-08, https://www.reddit.com/r/Unrouted_AI/comments/1waxp14/) verlinkt auf den OpenAI-Blog „introducing-chatgpt-images-2-5“. u/Ok_Homework_1859 interessiert sich besonders für die Sketch-Funktion, mit der Zeichnungen in ChatGPT die Bildgenerierung steuern können.
  • Unmut über Beschränkungen bei urheberrechtlich geschützten Figuren: Thread 11 (r/generativeAI, 2 Punkte, 2 Kommentare, 2026-09-08, https://www.reddit.com/r/generativeAI/comments/1waapc1/) kritisiert, dass sich mit Grok nicht einmal Fanart für den privaten Gebrauch mit Disney-Figuren erzeugen lasse. u/frighten empfiehlt PixelForge für iOS, das keine eingebauten Einschränkungen habe.
  • Nostalgie und Korrekturen zur zehnjährigen Geschichte der Bild-KI: Thread 9 (r/generativeAI, 15 Punkte, 9 Kommentare, 2026-09-06, https://www.reddit.com/r/generativeAI/comments/1w8gzt6/) fasst die Entwicklung von StackGAN 2016 bis zu ChatGPT-Bildern 2026 zusammen. u/noctalla weist darauf hin, dass Google DeepDream dem vorausging und bereits um 2015 existierte.
  • Rund um Bildgenerierung entsteht neue „KI-Nebenarbeit“: Thread 8 (r/RemoteWorkers, 169 Punkte, 787 Kommentare, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/) bewirbt einen Heimarbeitsjob für 30 US-Dollar pro Stunde zur Prüfung KI-generierter Bildunterschriften. Obwohl es 787 Kommentare gibt, bestehen die gesammelten Top-Kommentare fast nur aus „Images“-Antworten, die Bewerbungslinks anfordern; inhaltliche Diskussionen sind kaum vorhanden.
  • Fragen zur Nachhaltigkeit kostenloser Generatoren: Thread 12 (r/freetoolsAI, 40 Punkte, 50 Kommentare, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) stellt aifreeforever.com als kostenlos, unbegrenzt und ohne Registrierung vor. u/thecragmire fragt jedoch: „How do you maintain this? It's got to cost you something, right?“ u/Relevant_Syllabub895 kritisiert die strengen NSFW-Regeln.
Signale
  • Stark im Aufwind: Aggregatoren mit „ungefiltertem Zugang zu vielen Modellen“ wie WildOwl.ai, Venice, Mage.space und PixelForge werden in mehreren Threads als Alternative zu einzelnen Modellabos genannt. Auffällig sind Dienste, die freie Modellwahl und weniger strenge Filter verkaufen.
  • Zurückgewiesene Behauptung: Dienste für Video- oder Bildgenerierung, die „kostenlos und unbegrenzt“ versprechen, werden in r/aivideomaking, r/generativeAI und r/freetoolsAI fast einhellig skeptisch oder ablehnend beurteilt. Entweder Hardwarekosten oder Bezahlung fallen nach allgemeiner Auffassung zwangsläufig an.
  • Konfligierende Ansichten: Beim Vergleich Seedance gegen Wan in Thread 10 herrscht Uneinigkeit darüber, welches Modell besser ist; zusätzlich wird die Vergleichsmethode selbst bestritten. Auch in Thread 6 unterscheiden sich die Haltungen zwischen Nutzerverantwortung und Verantwortung des Dienstes.
  • Überraschung: Unter zwölf gesammelten Threads erzielt der Anti-KI-Thread 3 mit 7.088 Punkten und 1.023 Kommentaren deutlich mehr Engagement als technische Themen. Er liegt fast auf Höhe der Summe aller anderen Thread-Scores von knapp 7.600 Punkten. Das legt nahe, dass auf Reddit Widerstand gegen Missbrauch und Täuschung sichtbarer wird als Begeisterung für generative KI.
  • Closed-/Open-Source-Muster: Die deutlichsten Gegenüberstellungen sind Wan als Open-Weights-Modell gegen Seedance als geschlossenes Modell in Thread 10 sowie lokale Generierung mit ComfyUI/Civitai/Hugging Face gegen Cloud-Bezahldienste in Threads 1, 2 und 6. Wiederholt wird Open Source als frei, aber aufwendig beschrieben; Closed Source als bequem, aber von Zensur und Kosten begrenzt.
Grenzen
  • Es wurden nur zwölf Threads gesammelt, nicht die von brief.md geforderten etwa 20. Gesucht wurde nur nach „Image and Video Generation AI News“; getrennte Zusatzsuchen für Closed und Open Source gab es nicht.
  • Zentrale große Subreddits wie r/StableDiffusion, r/midjourney, r/aivideo und r/comfyui fehlen vollständig. Das ist eine Abdeckungslücke; die Ergebnisse repräsentieren daher nicht zwingend die gesamte Reddit-Stimmung.
  • Bei Thread 8 aus r/RemoteWorkers bestehen die Top-Kommentare praktisch ausschließlich aus wiederholten Bewerbungsanfragen mit „Images“ und liefern kaum Diskussionsgehalt.
  • Da Reddit selbst und Suchergebnisse nicht direkt aufgerufen werden konnten, basiert alles auf den vorab gesammelten Dateien output/reddit.threads.md / .json; weitere Threads oder Kommentare konnten nicht überprüft werden.

X

X — News zur KI-Bild- und Videogenerierung

Vorbemerkung: Die gesammelten Ergebnisse passen nicht zum Thema

Bei der Prüfung von output/x.posts.md zeigte sich, dass in dieser Phase tatsächlich nach
„Harvey“, „#Crypto“, „#sweepstakes“, „#Chance“, „#giveaways“, „Serbia“,
„$LAPTOP“, „Arsenal“, „Germans“ und „Nazis“ gesucht wurde. Diese Begriffe haben keinerlei Bezug zu Bild- oder Video-KI. Auch die 40 gesammelten Posts von 39 Accounts enthalten keinen passenden Beitrag. Die Explore-Liste von X, deren Trends an den Serverstandort Kroatien gebunden sind, enthält ebenfalls keine KI-Themen.

# Trend Wo
1 Harvey Trending in Croatia
2 #Crypto Business & finance · Trending
3 #sweepstakes Trending in Croatia
4 #Chance Trending in Croatia
5 #giveaways Trending in Croatia
6 Serbia Politics · Trending
7 $LAPTOP Trending in Croatia
8 Arsenal Sports · Trending
9 Germans Politics · Trending
10 Nazis Politics · Trending

Gemäß Regel 7, Quellen nicht zu erfinden, werden irrelevante Beiträge nicht so dargestellt, als lieferten sie thematische Erkenntnisse. Im Folgenden stehen ausschließlich Tatsachen aus dem tatsächlich gesammelten Material.

Accounts

Die 39 gesammelten Accounts bilden je nach Suchbegriff sehr unterschiedliche Cluster: Fans von Dating-Reality-Shows, Krypto-Trader, Accounts für Gewinnspiele und Werbeaktionen, politische Debatten im Balkanraum, Memecoin-Communities, Arsenal-Fans sowie Accounts zu Geschichtsrevisionismus und Antisemitismus. Kein einziger Account sprach über Bild- oder Video-KI oder veröffentlichte ausdrücklich damit erzeugte Inhalte. Zwar waren einzelne Beiträge als „has an image“ markiert, doch es gab weder eine KI-Erwähnung noch einen Hinweis darauf, dass das Bild generiert wurde. Das höchste Engagement hatten @saintjupitr mit 64.747 Likes und @Kwin8675309 mit 42.021 Likes; beide gingen mit einzelnen politischen Beiträgen viral und sind thematisch irrelevant.

Posts

Keine. Von 40 Beiträgen passte keiner zum Thema Bild- und Video-KI oder zu Entwicklungen bei Closed bzw. Open Source. Einzelne Beiträge, etwa die Serbien-Debatten #21–24, Arsenal-Posts #29–32 und deutsche bzw. NS-bezogene Geschichtsdebatten #33–40, erzielten zwar hohe Engagement-Zahlen, haben aber keinen Bezug zu KI-Bild- oder Videogenerierung und werden deshalb nicht als Erkenntnisse gezählt.

Signale
  • Es konnten keine thematischen Aufwärts-, Abwärts- oder sonstigen Signale erkannt werden, da keine passenden Daten vorliegen.
  • Das Einzige, was sich festhalten lässt: Die Explore-Ergebnisse waren auf Kroatien geolokalisiert, und die verwendeten Suchbegriffe wie „Harvey“ oder „$LAPTOP“ waren nicht themenbezogen.
Grenzen
  • Die Suchbegriffe passen nicht zum Thema: Die in output/x.posts.md dokumentierten Begriffe haben keinen Bezug zu KI-Bild- oder Videogenerierung. Da gemäß Playbook kein eigener neuer Suchlauf durchgeführt wurde, ist eine erneute Sammlung mit passenden Begriffen wie „AI image generation“, „Midjourney“, „Stable Diffusion“, „Sora“, „Veo“ oder „オープンソース 画像生成AI“ erforderlich.
  • Unter den 40 gesammelten Beiträgen gab es keine Erkenntnisse zu Closed- oder Open-Source-Entwicklungen in der Bild- und Video-KI. Die in brief.md verlangte Analyse von etwa 20 thematisch passenden Posts war daher nicht möglich.
  • Auch X Explore mit den Trends 1–10 enthielt ausschließlich allgemeine kroatische Trends und keine KI-bezogenen Themen.
  • Die Sitzung selbst funktionierte; es gab keinen Fehler wie „session expired“. Das Problem liegt allein in der Wahl der Suchbegriffe.

YouTube

YouTube — Aktuelle Entwicklungen bei KI-Bild- und Videogenerierung (Closed Source / Open Source)

Kanäle
Videos
  1. „Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN“
    Kanal: Theo - t3.gg|Veröffentlicht: etwa 26. November 2025|https://www.youtube.com/watch?v=UV9GqinedQ8
    → Ein Breakdown, der behauptet, Googles Nano Banana Pro (Gemini 3 Pro Image) übertreffe alle anderen Bildmodelle. Ein symbolisches Video für die Closed-Source-Spitze.

  2. „Nano Banana PRO (Gemini-3.0-Pro-Image): I GOT EARLY ACCESS...“
    Kanal: AICodeKing|https://www.youtube.com/watch?v=13AovEj4oDM
    → Early-Access-Review zu Gemini 3 Pro Image mit vielen Beispielen, die als „umwerfend“ bewertet werden.

  3. „GPT Image 2 Is Here — Everything You NEED to Know“
    Kanal: ElevenLabs|Veröffentlicht: 23. April 2026|https://www.youtube.com/watch?v=blOlUnC75O4
    → Erklärung zu OpenAIs GPT Image 2 (ChatGPT Images 2.0): mehr als 99 % Textgenauigkeit in über zwölf Sprachen, bis zu acht Bilder pro Prompt im Thinking-Modus und 4K-Unterstützung in API/Beta.

  4. 【ナノバナナ超え】OpenAIの新しい画像生成AIモデル「GPT Image 2」とは?
    Kanal: AI大学【AI&ChatGPT最新情報】 (Japanisch)|https://www.youtube.com/watch?v=ZrO7tv-uv1E
    → Japanische Erklärung von GPT Image 2 im Vergleich zu Nano Banana, einschließlich Leistung, Bedienung und Anwendungsfällen.

  5. „Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison“
    Kanal: Marin Method|Veröffentlicht: 10. März 2026|https://www.youtube.com/watch?v=x5fMQvhKP60
    → Direkter Vergleich von vier geschlossenen Videomodellen. Kling 3.0 wird bei der Gesamtleistung vorn gesehen, Grok Imagine beim Übergang Bild-zu-Video.

  6. „Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 - Comparison“
    Kanal: Youri van Hofwegen|https://www.youtube.com/watch?v=vw_Jk2-phsA
    → Vergleichstest, laut dem ByteDances Seedance 2.0 die etablierten geschlossenen Hauptmodelle übertrifft.

  7. „New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)“
    Kanal: AIOnTrend|Veröffentlicht: Anfang Januar 2026|https://www.youtube.com/watch?v=uAGH_yRZ2Gw
    → Vergleich des offenen Alibaba-Bildmodells Qwen-Image 2512 mit Z-Image Turbo; betont werden kostenlose Nutzung und die Apache-ähnliche Lizenz.

  8. „Is Flux 2.0 DEAD? Qwen image 2512 & Z-Image vs. The King (15 Stress Tests)“
    https://www.youtube.com/watch?v=54zvSiAWz2Y
    → FLUX von Black Forest Labs wird in 15 Stresstests gegen Qwen-Image 2512 und Z-Image verglichen. Das Video analysiert einen möglichen Wandel im Kräfteverhältnis offener Bildmodelle.

  9. „LTX-2.3 Review: The Open-Source AI Video Model Built for Creators“
    Kanal: BMF MEDIA|Veröffentlicht: laut Suche etwa einen Monat zuvor (August 2026)|https://www.youtube.com/watch?v=qQXzlk134Sw
    → Review aus Kreativperspektive zu Lightricks’ offenem LTX-2.3: 22 Milliarden Parameter, Audio-Synchronisation und 4K/50 fps. Der Beitrag liegt innerhalb der vergangenen 60 Tage und ist daher besonders aktuell.

  10. „WAN 2.5 CRUSHES VEO 3 (Higgsfield AI Workflow)“
    Kanal: Jack Vs. AI|https://www.youtube.com/watch?v=yvD8TxNsR4Q
    → Praxis-Workflow, der behauptet, Alibabas offenes Wan 2.5 übertreffe Googles geschlossenes Veo 3.

  11. „This AI Agent Can Make Movies WanGP Deepy - Open source free Agent for LTX 2.3 Qwen Klein Z-Image“
    Kanal: AI Late to Class|https://www.youtube.com/watch?v=h-k6xOEITx4
    → Vorstellung eines kostenlosen Agents namens WanGP, der offene Modelle wie LTX-2.3, Qwen, Flux.2 Klein und Z-Image für automatisierte Videoproduktion bündelt. Ein Beleg für die zunehmende Integration im Open-Source-Ökosystem.

  12. „HunyuanImage 3.0 : Open Source Text To Image Model (Forget Nano Banana & Seedream 4)“
    https://www.youtube.com/watch?v=32lhiZKhgOY
    → Vorstellung von Tencents offenem HunyuanImage 3.0 mit über 80 Milliarden Parametern, MoE-Struktur und 13 Milliarden aktiven Parametern. Es wird als Nano Banana ebenbürtig oder überlegen dargestellt. Die Erstveröffentlichung stammt zwar aus September 2025, doch das Modell bleibt ein wichtiger Referenzpunkt für große offene Bildmodelle.

Signale

Bewegungen auf der Closed-Source-Seite

  • Google stellte am 17. August 2026 die Imagen-Reihe vollständig ein und bündelt seine Bildgenerierung in der Nano-Banana-Familie, einschließlich Gemini 3 Pro Image. Die geschlossene Bildgenerierung konzentriert sich zunehmend auf Googles Gemini-Reihe.
  • OpenAI stellte die Sora-App am 26. April 2026 ein; die Sora-API soll am 24. September 2026 folgen. Als eigenständiges Videoprodukt läuft Sora faktisch aus, während sich Entwicklungsressourcen offenbar in Richtung GPT Image 2 und ChatGPT-Integration verschieben.
  • GPT Image 2 von OpenAI, veröffentlicht im April 2026, wird in den Arena-Kategorien Text-zu-Bild und Bildbearbeitung an der Spitze bewertet. Grok Imagine Image 2.0 von xAI, veröffentlicht am 7. August 2026, folgt knapp auf Platz zwei. Die geschlossene Bildgenerierung entwickelt sich zum Dreikampf OpenAI, Google und xAI.
  • Bei Video ist ByteDances Seedance 2.5 seit seiner allgemeinen API-Verfügbarkeit am 7. August 2026 schnell neben Google Veo 3.1 und Kling 3.0 zu einer wesentlichen Option geworden.
  • Vergleichsvideos zu geschlossener Video-KI etablieren eine Arbeitsteilung: Kling 3.0 für Gesamtleistung, Veo 3.1 für Bildästhetik und Runway Gen-4.5 für kreative Freiheit.

Bewegungen auf der Open-Source-Seite

  • Bei Bildgenerierung sind Qwen-Image 2512 von Alibaba mit Apache-ähnlicher Lizenz und Z-Image Turbo, das mit acht Schritten und 16 GB VRAM läuft, die zwei dominanten Trends. Die Vielzahl an Vergleichsvideos zeigt das hohe Interesse.
  • Black Forest Labs’ Flux.2 Klein mit 4B Parametern, 13 GB VRAM auf RTX-3090-Niveau und Apache-2.0-Lizenz wird häufig als leichtgewichtige Open-Source-Option genannt.
  • Tencents HunyuanImage 3.0 mit über 80B Parametern und MoE-Architektur bleibt der Bezugspunkt für große offene Bildmodelle.
  • Bei Video erreichen Alibabas Tongyi Wan 2.2/2.5 mit MoE-Diffusion und einer 8-GB-GGUF-Version sowie Lightricks’ LTX-2.3 mit Audio-Synchronisation, 4K/50 fps und 22B Parametern laut mehreren Kanälen Closed-Source-ähnliche Qualität.
  • Videos über Agents und Workflows, die mehrere offene Modelle bündeln – etwa ComfyUI oder WanGP –, nehmen zu. Das Interesse verschiebt sich von einzelnen Modellen zu integrierten Produktionsabläufen.
  • Insgesamt teilen Review- und Vergleichsvideos den Tenor, dass sich die Qualitätslücke zwischen Open und Closed Source schließt und viele Kreativteams zunächst Open Source prüfen.
Grenzen
  • In dieser Umgebung werden YouTube-Suchergebnisse und Videoseiten per JavaScript gerendert. WebFetch konnte deshalb weder tatsächliche Abrufzahlen, Veröffentlichungsdaten noch Abonnentenzahlen direkt erfassen. Die Kanalnamen ließen sich über die YouTube-oEmbed-API (youtube.com/oembed?url=...&format=json) abrufen, nicht jedoch Abrufe oder Abonnentenzahlen.
  • Daher werden Abruf- und Abonnentenzahlen als unbekannt behandelt. Stattdessen wurden nur über WebSearch-Snippets sichtbare Datums- und Kontextinformationen verwendet; ein zahlenbasierter Aktualitätsvergleich war nicht möglich.
  • Videoinhalte und Top-Kommentare konnten wegen der JavaScript-Abhängigkeit nicht direkt gelesen werden. Die Einordnung beruht indirekt auf Titeln, Snippets und Zusammenfassungen verwandter Suchergebnisse, nicht auf wörtlichen Aussagen aus den Videos.
  • Das Video zu HunyuanImage 3.0 stammt ursprünglich aus September 2025 und liegt damit außerhalb des empfohlenen 60-Tage-Fensters; es wird nur als fortbestehender Referenzpunkt genannt.
  • Es gab nur einen direkten Treffer eines japanischsprachigen Kanals, AI大学. Die Tiefe der YouTube-Diskussion im japanischsprachigen Raum wurde im Vergleich zum englischsprachigen Raum nicht bestätigt.

Bluesky

Bluesky — Aktuelle Entwicklungen bei KI-Bild- und Videogenerierung

Accounts
  • Simon Willison @simonwillison.net — Bekannter KI-Entwickler. Bei neuen Modellen veröffentlicht er häufig Benchmark-Bilder eines „Pelikan auf einem Fahrrad“. Viele Beiträge erhalten mehr als 100 bis 500 Likes.
  • Ethan Mollick @emollick.bsky.social — Professor an der Wharton School der University of Pennsylvania. Veröffentlicht häufig Experimente, in denen Modelle wie GPT-6 Astra und Fable 5.1 3D-Inhalte in Blender generieren.
  • Alessandro Perilli @perilli.com — Entwickler von „Open Creative Studio“, früher AP Workflow, einem offenen All-in-one-Generierungsworkflow für ComfyUI. Informiert fortlaufend über ein Tool für Text, Bild, Video und Audio.
  • luokai @luok.ai — Account, der fortlaufend Updates zu geschlossenen Videogenerierungsmodellen wie Kling, Runway, Vidu, PixVerse, Seedance und Niji vorstellt.
  • dahara1 @dahara1.bsky.social — Japanischsprachiger Entwickler, der über die Nutzung von LLMs und generativer KI schreibt und auch eigene Werkzeuge wie Übersetzungstools baut. Greift aktuelle Themen wie Soras Ende und Nano-Banana-Vergleiche auf. Mit 113 Followern ein kleiner Account.
  • Midjourney Experience Newsletter @midjourneynews.bsky.social — Kein offizieller Midjourney-Account, sondern ein inoffizieller Fan- bzw. Newsletter-Account für Prompt-Experimente und Branchenmeldungen; mit geringem Engagement.
  • Stable Diffusion online AI @stablediffusion.bsky.social — Feed zum Teilen von SD-/Midjourney-Werken. Die jüngsten Beiträge stammen aus Januar bis Februar 2025; als Quelle für aktuelle News ist der Account nicht brauchbar.
  • Ergebnis der Suche nach offiziellen Accounts: Offizielle Bluesky-Accounts von Black Forest Labs, Runway, Stability AI und Civitai konnten nicht bestätigt werden. Der vermutlich offizielle Account midjourney.bsky.social ist leer.
Posts
  1. „Ende von Sora“ — dahara1, 2026-04-28, 0 Likes/0 RPs
    https://bsky.app/profile/dahara1.bsky.social/post/3mkjnla6hnk2m
    Kommentar zur Einstellung von OpenAIs Video-Service Sora: Man habe offenbar nicht besonders daran gehangen. Auch durch WebSearch abgesichert; Berichte nennen die Einstellung der Sora-App und Entwickler-API um März 2026.

  2. Die kostenlose Sora-Version kann nach aufgebrauchten Credits nichts mehr generieren — dahara1, 2026-04-04
    https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
    Der Account berichtet, dass trotz eines verbleibenden Credits kein Video erstellt werden kann. Das passt zu den späteren Meldungen über die Einstellung.

  3. Vergleich der Wasserzeichen von Nano Banana kostenlos und ChatGPT Images 2.0 — dahara1, 2026-05-04, 1 Like
    https://bsky.app/profile/dahara1.bsky.social/post/3mkztj6phrk2l
    Laut Beitrag hat ChatGPT Images 2.0 ebenso wie die kostenlose Nano-Banana-Version kein auffälliges Wasserzeichen und ist daher leichter nutzbar.

  4. Seedance 2 übertrifft andere Modelle — luokai, 2026-02-10, 5 Likes
    https://bsky.app/profile/luok.ai/post/3mehseuzlls2r
    Ein in nur einem Tag produziertes Originalvideo begleitet die Einschätzung, dass Seedance 2 eine außergewöhnliche Leistung liefert.

  5. Niji 7 veröffentlicht — luokai, 2026-01-10, 3 Likes
    https://bsky.app/profile/luok.ai/post/3mc2422hgck2m
    Das auf Anime spezialisierte Bildmodell Niji 7 erscheint mit schärferen Augen, besserer Konsistenz und höherer Prompt-Treue.

  6. Runway Gen-4.5 — luokai, 2025-12-02, 4 Likes/1 RP
    https://bsky.app/profile/luok.ai/post/3m6xsakpud226
    Vorgestellt als Modell, das Maßstäbe bei Bewegung, Treue und Prompt-Steuerung anhebt, mit Betonung der World-Modeling-Grundlage.

  7. Kling IMAGE O1 — luokai, 2025-12-03, 3 Likes
    https://bsky.app/profile/luok.ai/post/3m72caiexw225
    Eine Full-Stack-Erneuerung der Kling-Bildgenerierung mit dem Anspruch, „alles eingeben, verstehen und erzeugen“ zu können.

  8. Kling VIDEO 2.6 — luokai, 2025-12-05, 2 Likes
    https://bsky.app/profile/luok.ai/post/3m7aio7hntk2f
    Präsentiert als „Story-first“-Videogenerierung mit Audio-Synchronisation, Lippensynchronisation und Szenenkonsistenz.

  9. PixVerse V5.5 — luokai, 2025-12-02, 4 Likes/2 RPs
    https://bsky.app/profile/luok.ai/post/3m6xrxnh47c27
    Betont vereinfachte Produktion mit One-Tap-Multishot-Generierung und automatischen Soundeffekten.

  10. Vidu AI Q2 Bildmodell — luokai, 2025-12-02, 5 Likes/2 RPs
    https://bsky.app/profile/luok.ai/post/3m6xrt43ll227
    Bewirbt „4K-Erzeugung in fünf Sekunden“ und eine Aktion mit unbegrenzter Generierung bis zum 31. Dezember.

  11. SkyReels V1, offenes Video-Basismodell — luokai, 2025-02-18, 3 Likes/1 RP
    https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27
    Wird als erstes offenes, menschenzentriertes Video-Basismodell bezeichnet. HunyuanVideo sei mit mehr als zehn Millionen Videos feinabgestimmt worden, um 33 Gesichtsausdrücke und über 400 natürliche Bewegungen abzubilden. Der Beitrag ist älter als ein Jahr, aber der einzige klar gefundene Post zu einem offenen Videomodell dieses Accounts.

  12. Open Creative Studio v13.0, offener integrierter Workflow für ComfyUI — Alessandro Perilli, 2026-01-26, 0 Likes
    https://bsky.app/profile/perilli.com/post/3mdddenkss22v
    Beworben als besonders funktionsreicher All-in-one-ComfyUI-Workflow für Text, Bilder, Videos, Audio, Musik, Soundeffekte und Liedtexte; kostenlos und unbegrenzt.

  13. Lokale Bildgenerierung mit Qwen 3.7 27B, Pelikan — Simon Willison, 2026-08-14, 183 Likes/14 RPs
    https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
    Qwen 3.7 27B läuft auf einem M5 Max MacBook Pro über LM Studio und 17 GB GGUF. Willison beschreibt das Ergebnis als besten Fahrrad-Pelikan, den er von einem auf seinem Laptop laufenden Modell gesehen habe.

  14. Pelikan-Vergleichsraster: GPT-6 Astra gegen GPT-5.6-Familie — Simon Willison, 2026-09-04, 202 Likes/9 RPs
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
    Zwölfteiliger Bildvergleich von GPT-6 Astra und GPT-5.6 Sol, Terra und Luna. Ein fortlaufender Benchmark für die Bildgenerierung geschlossener Modelle.

  15. Blender-3D-Generierung eines Architekturmodells durch GPT-6 Astra — Ethan Mollick, 2026-09-05, 163 Likes/17 RPs
    https://bsky.app/profile/emollick.bsky.social/post/3murua22igs2i
    Aus Skizze und Beschreibung wurde das nie gebaute Denkmal von Boullée aus dem 18. Jahrhundert als Blender-3D-Modell samt kommentiertem Rundgang erstellt. Ein anderer Post desselben Accounts vom 7. September betont, dass solche visuelle Generierung allgemeinen LLMs spürbare Präsenz verschafft.

  16. „Midjourney ist Teil von Meta.ai geworden“ — Midjourney Experience Newsletter, 2026-02-03, 1 Like
    https://bsky.app/profile/midjourneynews.bsky.social/post/3mdxymie7pi25
    ⚠️ Vorsicht: Der Beitrag eines inoffiziellen Fan-Accounts vereinfacht die Lage wahrscheinlich zu stark. Eine Überprüfung ergab, dass Meta im August 2025 eine Lizenzpartnerschaft für Midjourneys „aesthetic tech“ ankündigte. Es handelt sich nicht um eine Übernahme; Midjourney bleibt unabhängig (Referenz: TechCrunch, implicator.ai).

Signale
  • Closed-Source-Video ist ein umkämpftes Feld: Allein zwischen Dezember 2025 und Februar 2026 erschienen im luok.ai-Feed mindestens sieben neue Modelle oder Versionen: Runway Gen-4.5, Kling IMAGE O1/VIDEO 2.6/O1, PixVerse V5.5, Vidu AI Q2, Seedance 2 und Niji 7. Besonders deutlich ist der Schwung chinesischer Modelle wie Kling, Vidu, PixVerse und Seedance.
  • Sora verliert an Fahrt und läuft aus: Aus den Beiträgen von dahara1 geht hervor, dass Generierungscredits der kostenlosen Sora-Version im April 2026 nicht mehr funktionierten und Ende desselben Monats explizit vom „Ende von Sora“ gesprochen wurde. Das passt zu Berichten über das Ende der App und Entwickler-API um März 2026. Die Führungsrolle bei Video scheint auf chinesische Modellreihen sowie Funktionen in Google- und OpenAI-Allzweckmodellen überzugehen.
  • Bildgenerierung wird als Funktion allgemeiner LLMs benchmarked: Die Posts von Simon Willison und Ethan Mollick behandeln Bild- und 3D-Generierung weniger als eigenständiges Produkt denn als kontinuierlichen Leistungsvergleich allgemeiner LLMs wie GPT-6 Astra, Claude Fable 5.1 oder Qwen 3.7/3.8 27B. Visuelle Fähigkeiten, etwa die 3D-Rekonstruktion eines Bauwerks in Blender, werden auf Social Media zum Stärkeindikator.
  • Open-Source-Video ist auf Bluesky wenig sichtbar: Bei Suche und Feed-Recherche wurde nur ein klarer Beitrag zu einem offenen Videomodell gefunden: SkyReels V1 auf HunyuanVideo-Basis aus Februar 2025. Themen wie Wan2.2, Qwen-Image und Z-Image wurden nicht entdeckt. ComfyUI kommt hauptsächlich durch die regelmäßigen Ankündigungen von Alessandro Perilli vor, eher als einzelnes Projekt denn als breite Bewegung.
  • Das Verhältnis Midjourney × Meta wird leicht missverstanden: Ein inoffizieller Account verkürzt die Situation auf „Midjourney ist Teil von Meta.ai“. Tatsächlich handelt es sich um eine Technologie-Lizenzpartnerschaft, nicht um einen Kauf. Das ist ein gutes Beispiel dafür, wie vorsichtig Social-Media-Informationen bewertet werden sollten.
Grenzen
  • Die offizielle Bluesky-Such-API (app.bsky.feed.searchPosts) lieferte für alle Abfragen 403 Forbidden, sodass keine Keyword-Suche möglich war. Andere öffentliche Endpunkte wie app.bsky.actor.getProfile, app.bsky.feed.getAuthorFeed und app.bsky.feed.getPostThread funktionierten; die Einschränkung scheint sich auf Suche zu beschränken.
  • Auch die Websuche unter https://bsky.app/search?q=... wird clientseitig gerendert und gab beim Abruf keine Post-Inhalte zurück.
  • Statt einer Keyword-Suche wurden über Websuche relevante Accounts entdeckt und deren Feeds mit getAuthorFeed gelesen. Das hängt von zufällig durch Suchmaschinen auffindbaren Accounts ab und kann Verzerrungen verursachen, besonders bei der schwachen Abdeckung offener Videomodelle.
  • Die Websuche nach Bluesky-Posts zu Wan2.2, Qwen-Image, Z-Image und HunyuanVideo führte vor allem zu arXiv-Papers oder irrelevanten Accounts; passende Beiträge wurden nicht gefunden.
  • Offizielle Bluesky-Accounts großer Bild- und Video-KI-Firmen wie Black Forest Labs, Runway, Stability AI und Civitai ließen sich nicht verifizieren; die Handled-Suche gab 400-Fehler oder keine Treffer zurück.
  • Der Feed von stablediffusion.bsky.social endete im Januar bis Februar 2025 und ist keine aktuelle Quelle.
  • Das Ziel, pro Social Network etwa 20 Beiträge zu analysieren, wurde nur teilweise erreicht: Es wurden mehr als 100 Feed-Beiträge aus sechs Accounts gesichtet und daraus 16 relevante Posts ausgewählt.

Lemmy

Lemmy — Aktuelle Trends bei KI-Bild- und Videogenerierung

Lemmy ist ein föderiertes Fediverse mit verteilten Instanzen. Für die Recherche wurden vor allem die API-Suche von lemmy.world (/api/v3/search) und lemmy.today, das Communities von lemmy.dbzer0.com spiegelt, sowie Websuchen wie site:lemmy.world verwendet. Insgesamt wurden etwa 25 Beiträge geprüft.

Communities
  • !«メールアドレス» — Etwa 5.050 Abonnenten; zentrale Community für offene Bildgenerierung aus dem Stable-Diffusion-Umfeld.
  • !«メールアドレス» (lemmy.today mit dem Namen „Stable Diffusion Art“) — 2.362 Abonnenten. Täglich mehrere Werke aus SDXL, ComfyUI und Krea2; oft mit Links zu civitai.com.
  • Stable Diffusion Anime, Stable Diffusion Abstraction, Stable Diffusion Witches, Stable Diffusion Furry und Stable Werewolves – Genre-Communities aus dem lemmy.dbzer0.com-Umfeld. Abonnentenzahlen sind nicht öffentlich, doch auch im September 2026 erscheinen täglich Beiträge.
  • c/«メールアドレス» — Allgemeine Tech-Community, in der große Closed-Source-News wie Midjourneys medizinische Scanner-Ambitionen und Sora-Meldungen erscheinen.
  • c/genart — 47 Abonnenten; kleine Community, die ausdrücklich offene und frei lizenzierte generative KI-Modelle unterstützt.
  • c/«メールアドレス» — Community für Anti-KI-Stimmung. Nicht spezifisch für Bild- oder Video-KI, aber ein Beitrag über den Wunsch, sich von KI-Abhängigkeit zu lösen, erreichte 83 Punkte.
  • c/euroai — Nischen-Community mit Listen europäischer Open-Source-KI und LLMs.
Posts
Eher Closed Source
  1. „Midjourney pivots from AI image generation to body scanning medical spa“ (2026-06-18, Score 58, technology) https://lemmy.world/post/... via theregister.com — Midjourney soll sich von Bildgenerierung weg und hin zu Ultraschall-CT-Scannern für medizinische Anwendungen bewegen. The Register merkt an, die Grundtechnologie sei real, aber Partner würden nicht genannt.
  2. „Midjourney AI pivots to Theranos: Ultrasonic CT“ (2026-06-19, Score 40, techtakes) via pivot-to-ai.com — Spöttischer Beitrag, der diesen Wandel mit Theranos vergleicht.
  3. „I was wrong about the Midjourney ultrasound scanner“ (2026-06-21, hackernews) https://twitter.com/MattZirwas/status/2068365802491834541 — Ein ursprünglich skeptischer Poster überprüft die Fakten und nimmt seine Kritik zurück.
  4. „Midjourney wants Hollywood studios to reveal details of their AI usage“ (2026-07-05, Score 73, technology) via techcrunch.com — Midjourney verlangt im Rechtsstreit mit drei Studios Offenlegung über deren eigene KI-Nutzung.
  5. Reaktion auf die Einstellung von OpenAI Sora: „OpenAI: decides to shut down their AI slop video generating model Sorahttps://lemmy.world/post/44721138 — Spott über das Ende der eigenständigen Sora-App, angekündigt am 24. März 2026 und gestoppt am 26. April; die Sora-2-API soll am 24. September 2026 eingestellt werden.
  6. „OpenAI collapses media reality with Sora AI video generator“ https://lemmy.world/post/12056737 — Verweis auf einen Artikel über den Vertrauensverlust bei anonymen Videos.
  7. „OpenAI's new Sora video generator to require copyright holders to opt out, WSJ reports“ https://lemmy.world/post/36665644 — Kritik an einem Ansatz, bei dem Rechteinhaber aktiv widersprechen müssen.
  8. „Elon Musk maakt complete AI-film met zijn versie van The Odyssey“ (2026-07-22, films) via ad.nl — Musk kündigt an, mit Grok Imagine einen KI-Spielfilm zu „The Odyssey“ zu produzieren.
  9. Geteilter Beitrag zur ChatGPT-Umsatzanalyse (2026-07-15, ai_reddit) — Analysiert, dass der Großteil der Grok-Umsätze von kostenpflichtigen NSFW-Bild- und Videoinhalten stammen soll.
  10. „Video AI“ — Frage zu kostenlosen Kontingenten für Adobe Firefly-Video. Firefly bietet zwei kostenlose Generierungen; Hailuo, Kling, Runway, Pixverse und Hunyuan werden als Alternativen verglichen.
Eher Open Source
  1. „Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio“ (2026-07-24, Score 1, tech) https://bfl.ai/blog/flux-3 — Begrenzte Veröffentlichung von FLUX 3, einem multimodalen Modell für Bilder und 20-sekündige Videos mit Audio.
  2. „FLUX.2-klein-9b-kv-fp8 optimized variant“ (2026-03-14, Score 8, stable_diffusion) via huggingface.co — Leichte FLUX.2-Variante mit KV-Cache-Unterstützung.
  3. „Black Forest Labs Opening up the first FLUX Creator Program“ (2026-05-06, Score 3, stable_diffusion) — Ankündigung eines Programms für Kreative.
  4. „Regisseur Martin Scorsese wordt adviseur bij AI-bedrijf“ (2026-06-03, films) via nu.nl — Regisseur Martin Scorsese wird Berater bei Black Forest Labs.
  5. „FLUX Chroma (The Perchance T2i model)“ (vor etwa einem Jahr, Perchance-Community) via huggingface.co(lodestones/Chroma) — Abgeleitetes Modell mit NAG, Normalized Attentive Guidance; Kommentare bewerten die Lippensynchronisation positiv.
  6. Beispiele täglicher Beiträge aus Stable-Diffusion-Communities (2026-09-06 bis 09, jeweils lokal erzeugt mit SDXL/ComfyUI/Krea2): „Erika - Mahouka Koukou No Rettousei“ (Score 16), „Colors in Quiet Water“ (Score 14), „Giant Wire Walker“ (Score 11), „Karin - Umi Monogatari“ (Score 13) – jeweils mit civitai.com-Link.
  7. „Opendream = NEW! Stable Diffusion Automatic1111/ComfyUI alternative that uses nondestructive layering like Gimp“ https://lemmy.world/post/3243205 — Vorstellung einer OSS-Oberfläche mit nicht-destruktiver Ebenenbearbeitung im Stil von GIMP.
  8. „Europäische KI- & LLM-Anbieter“ (2026-02-15, euroai) — Liste europäischer Open-Source-KI unter dem Stichwort technologische Souveränität und Datenschutz, einschließlich Bildmodelle.
  9. „Your Lemmy Crash Course to Free Open-Source AI“ https://lemmy.world/post/76020 — Einsteigerleitfaden für lokale Generierungstools wie text-generation-webui, Automatic1111 und ComfyUI+Pinokio.
Signale
  • Das größte Closed-Source-Thema ist der Streit um Midjourneys medizinischen Kurswechsel (Scores 40 bis 73): Der Wechsel von Bildgenerierung zu Ultraschall-Diagnostik wird in technology, hackernews und techtakes kontrovers diskutiert. Neben Spott mit Theranos-Vergleichen gab es auch Korrekturen ursprünglich skeptischer Stimmen.
  • OpenAI Sora wird wiederholt als Paradebeispiel für „KI-Slop“ angegriffen. Auch nach dem App-Ende von März bis April 2026 bleibt die Abschaltung der Sora-2-API am 24. September 2026 ein Thema.
  • Auf der Open-Source-Seite dominiert Black Forest Labs mit FLUX: FLUX 3 mit Bild- und Audio-Video-Erzeugung, die FLUX.2-klein-Leichtversion, das Creator Program und Scorsese als Berater liefern quartalsweise greifbare Neuigkeiten.
  • Alltägliche Kreativcommunities rund um Stable Diffusion Art, Anime und Abstraction sind zwar klein – etwa 2.000 bis 5.000 Abonnenten –, veröffentlichen aber auch im September 2026 täglich lokal erzeugte Arbeiten mit SDXL, ComfyUI und Krea2. Das zeigt eine belastbare Open-Source-Praxisbasis.
  • Anti-KI-Gefühle sind ein relevantes Signal: Ein Post in c/fuck_ai über den Wunsch, sich aus KI-Abhängigkeit zu lösen, erzielte 83 Punkte und damit mehr als viele typische KI-Beiträge. Das weist auf eine spürbare Ablehnung generierter Inhalte auf Lemmy hin.
  • Closed-Source-News werden auf Lemmy überwiegend nicht originär entdeckt, sondern als Reaktionen auf Artikel etablierter Medien wie TechCrunch, The Register oder WSJ diskutiert. Die Primärinformationen liegen außerhalb von Lemmy.
Grenzen
  • Lemmy ist bei Nutzer- und Beitragszahlen klein. Im Vergleich zu Reddit gibt es wenig spezialisierte Diskussionen zu Bild- und Video-KI; insbesondere wurden keine tiefgehenden Communities zu Sora, Veo, Kling oder Runway gefunden.
  • Die Volltextsuche der lemmy.world-API ist ungenau. Allgemeine Suchen wie „AI image generation“ liefern viele irrelevante Treffer, etwa zu Weltkarten der UN oder Eulenzucht. Relevante Beiträge ließen sich eher über Modellnamen wie Sora, Midjourney oder FLUX finden.
  • Einige Seiten, darunter lemmy.world/post/44721138 und ein DLSS-5-Post unter lemmy.world/post/44347792, gaben bei WebFetch HTTP-500-Fehler zurück oder konnten inhaltlich nicht abgerufen werden. Die Beurteilung beruht dort auf Titeln und WebSearch-Snippets.
  • Wichtige aktuelle Modellnamen wie Grok Imagine, Qwen Image, HunyuanVideo, Wan2.2, Nano Banana/Gemini und Veo wurden auf Lemmy gesucht, aber kaum direkt erwähnt. Grok Imagine erschien lediglich einmal im Kontext einer Filmproduktion. Diese Modelle scheinen auf Lemmy wenig Gesprächsstoff zu liefern.
  • Zusätzliche Suchen auf lemmy.ml und lemm.ee ergaben überwiegend Duplikate aus der föderierten Lemmy-Welt oder gespiegelte Beiträge und lieferten keine eigenständigen zusätzlichen Informationen.

Pinterest

Pinterest — News zur KI-Bild- und Videogenerierung

Alle 50 gesammelten Pins wurden als Bilder geöffnet und geprüft. Es gab keine Genre-Unterteilung; die Ergebnisse stammen gesammelt aus einer einzigen Suche nach „Image and Video Generation AI News“.

Visuelle Themen (visual themes)
  • Flut aus Vorlagen mit „Robotergesicht + Eilmeldung“: Wiederholt erscheinen Thumbnails mit halbseitigen weißen humanoiden Robotergesichtern und roten bzw. blauen Neon-Schriftzügen wie „AI NEWS“ oder „BREAKING NEWS“. Darunter ein Roboter am Nachrichtentisch [22], ein Mix aus überrascht dreinblickendem männlichen YouTuber und Robotergesicht [29] sowie ein weiblicher Roboter mit „THE FUTURE IS AI“ [39]. Dunkles Marineblau mit Neonfarben wie Cyan, Magenta und Orange dominiert.
  • Thumbnails mit Reaktionsgesichtern von YouTubern: Fotos überrascht oder skeptisch blickender weißer Männer werden mehrfach mit rund gerahmten Neon-Icons von OpenAI, Google, Meta, Anthropic, Grok oder Notion kombiniert [4, 18]. Sie wirken wie Reposts aus YouTube-Videos.
  • Listen-Infografiken mit Tool-Auswahl: Das häufigste Format sind lange Infografiken im dunkelvioletten bis schwarzen Stil, die Tools auf nummerierten Karten aufführen. Runway, Pika, Kling AI, Luma AI/Dream Machine, Canva AI und Hailuo AI erscheinen in ähnlicher Reihenfolge wiederholt [9, 10, 27, 36, 50].
  • Before/After- und Vergleichsquiz-Formate: Zweigeteilte Bergbilder mit „Which is AI?“ [13] sowie Raster, in denen Quellvideos in Figuren aus Holzblöcken, Origami, Lego oder Blumen umgewandelt werden [11], betonen die schwer erkennbare Herkunft und die Materialumwandlungskraft generativer KI.
  • Zusammenarbeit von Robotern und Menschen sowie medizinische Szenen: Fotorealistische CG-Bilder mit weißen humanoiden Robotern neben medizinischem Personal, die Hologramme bedienen [3, 33], oder Illustrationen eines Arztes mit Stethoskop und Roboter [32] zeigen eine ruhigere Bildsprache von KI-Mensch-Koexistenz.
  • Tech-Ästhetik durch dunkle Hintergründe und Neon: Indigo- bis schwarze Hintergründe mit cyan-, magenta- und lilafarbenen Leuchtlinien und Partikeln sind bei ungefähr 70 % der Pins prägend. Das scheint ein typischer Pinterest-Stil für Tech-News-Bilder zu sein.
  • Werbung für KI-Videogenerierung mit Avataren und Icon-Persönlichkeiten: Mehrere Pins nutzen prominente Gesichter oder fotorealistische Porträts, um die Qualität von KI zu demonstrieren – etwa eine Fiverr-artige Anzeige für „AI video creation explainer“ mit Jeff Bezos [38] und AMDs fotorealistisches Amuse-3.0-Demo eines alten Fischers [46].
  • Bilder über die Frage, ob KI-Inhalte erkennbar sind: Wiederholt thematisieren Motive KI-Erkennung und Falschinformationen, etwa ein Roboter am Smartphone mit „FAKE“-Stempel und Katzenbild oder eine Personensilhouette [3] sowie Empfehlungen für KI-Erkennungstools [37].
Auffällige Pins (notable pins)
  • [11] Luma-AI-artiges Demo zur Materialumwandlung: Dasselbe Quellvideo mit Person, Panda-Plüschtier und Auto wird in fünf Varianten aus Holzblöcken, Origami, Legosteinen und Blumen dargestellt. Der Pin zeigt besonders konkret die Fähigkeit von Video-KI zur Materialtransformation.
  • [24] KI-Urheberrechtsvereinbarung zwischen ByteDance und Hollywood: Screenshot eines Artikels mit der Überschrift „ByteDance and Hollywood reach global deal on AI copyright“. ByteDance und die Motion Picture Association sollen sich weltweit auf besseren Schutz geistigen Eigentums bei KI-Bild- und Videotools geeinigt haben. Ein relativ primärnahes Signal zur Copyright-Strategie großer Closed-Source-Anbieter.
  • [35] KI-News-Zusammenfassung vom 12. August 2026: Dreiteilig: „Grok 4.6 drops“ mit autonomer Bearbeitung von Dutzenden Schritten und Selbstprüfung; „Gemini hits 1 billion users“ mit Googles angeblich schnellstem Erreichen von 100 Millionen Nutzern, zwei von drei Nutzern mit Spracheingabe und 150 Millionen täglich erzeugten Bildern; außerdem „Honor's robot phone“ mit Titanarm auf der Rückseite für automatisches Kamera-Tracking. Einer der seltenen Pins mit Datum und konkreten Zahlen.
  • [36] Rangliste „Best AI Video Generators of 2026“: Google Veo 3.1, Runway Gen 4.5 und Kling 3.0 tragen Kronensymbole als Top drei; danach folgen Adobe Firefly, Seedance 1.5 Pro, Pika 2.5 und HeyGen. Eine aktuelle Modellübersicht mit Versionsnummern.
  • [42] Vidu S1 von ShengShu Technology: Produktvisual für ein chinesisches Modell zur Echtzeit-interaktiven KI-Videoerzeugung, beschrieben als „The World's Most Advanced Model for Real-Time AI Interaction“. Eines der wenigen Beispiele, die über westliche Modelle hinausweisen.
  • [45] Ankündigungsartikel zu OpenAIs neuem Bildtool: Artikelbild mit der Überschrift „OpenAI's Secret Image Generation Tool to Debut Soon“, das Erwartungen an ein unangekündigtes Tool schürt.
  • [25] Google-I/O-2026-Übersicht: Zusammenfassung vom 20. Mai 2026 über Gemini 3.5 Flash, Gemini Omni und Gemini Spark, die Umstellung auf KI-Suche sowie Apples und Googles Wettbewerb bei XR-Brillen. Liefert Kontext zum Umfeld der Bild-KI, nicht nur zum Segment selbst.
  • [9] Vergleichsinfografik „Just Nail It“ zu Videotools: Ordnet Runway, Pika, Kling AI, Luma AI, Canva AI und Hailuo AI nach Funktionen und Zielgruppen. Enthält zudem die Statistik, dass bis 2026 80 % der Online-Inhalte Video enthalten sollen.
  • [8] Stockfoto-Iconset zur KI-Content-Erstellung: Adobe-Stock-artiges Bild „Ai Content Creation Concept“ mit Symbolen für Text-, Bild-, Musik- und Videogenerierung. Eher ein Hinweis auf die Nachfrage nach Bildmaterial als auf konkrete News.
  • [43] Historische Infografik zu generativer KI: Violette Zeitleiste von ELIZA in den 1950ern bis GPT in den 2020ern. Ordnet den gegenwärtigen Boom pädagogisch ein.
Signale (signals)
  • Der Gegensatz Open Source versus Closed Source ist anhand einzelner Bilder kaum ablesbar: Die Pinterest-Pins bestehen überwiegend aus Toolvorstellungen, News-Thumbnails und How-to-Listen. Ein expliziter Vergleich wie „Seedance gegen Wan“, wie er auf Reddit oder X vorkäme, ist nicht sichtbar. Allenfalls Vidu S1 [42] und Amuse 3.0 von AMD [46] treten als Alternativen zu großen westlichen Closed-Source-Anbietern wie Google Veo, OpenAI Sora und Runway hervor.
  • Listen, Vergleiche und Anleitungen dominieren; Eilmeldungen sind selten: Nur ungefähr [24], [25], [35] und [45] enthalten Datum oder konkrete Ankündigungsinhalte. Der große Rest besteht aus langlebigen, speicherfreundlichen Listen wie „Best AI Video Generators“ oder „10 Smart Ways“, häufig mit Affiliate-Charakter.
  • Sorge um Authentizität und Erkennung ist sichtbar: Mehrere Bilder, etwa [3], [22] und [37], behandeln „FAKE“-Markierungen, Roboter-Nachrichtenmoderatoren und KI-Detektion. Das deutet auf ein gewisses Interesse der Pinterest-Nutzerschaft an Vertrauen und Echtheit generierter Inhalte hin.
  • Modellgenerationen wechseln schnell: [36] zeigt mit Veo 3.1, Runway Gen 4.5, Kling 3.0 und Seedance 1.5 Pro aktuelle Versionsstände von 2026. Zusammen mit Grok 4.6 und Gemini-Nutzerzahlen in [35] stützt das die Beobachtung, dass Versionsupdates im Quartalsrhythmus normal werden.
  • Nicht vorhanden: Bilder, die die lokale bzw. selbst gehostete Open-Weights-Kultur rund um Stable Diffusion, ComfyUI oder Hugging Face verkörpern, gab es in keinem der 50 Pins. Pinterest-Ergebnisse sind stark auf Werbung für kommerzielle Tools und SaaS-Produkte ausgerichtet; Open-Source-Community-Inhalte sind kaum sichtbar.
Grenzen
  • Die Sammlung wurde vorab durch einen Headless-Browser-Worker erstellt; Pinterest wurde hier nicht direkt durchsucht.
  • Es gab keine Genre-Unterteilung durch ## <genre> (n)-Abschnitte; alle 50 Ergebnisse stammen aus einem einzigen Suchlauf. Vergleiche zwischen Genres waren nicht möglich.
  • Fünf Pins hatten den Titel „(untitled)“: [5, 13, 15, 20, 24]. Bei [24] fehlte zwar der Pin-Titel, der Inhalt ließ sich aber anhand der Artikelüberschrift im Bild erkennen.
  • Zwar wurden URLs im Format pinterest.com/pin/... erfasst, aber die Ziele selbst wurden nicht geöffnet und überprüft. Beurteilungen beruhen nur auf Bild und Titel. Daten wie Veröffentlichungszeitpunkt und Likes waren nicht gesammelt; nur bei Bildern mit eingebranntem Datum wie [25] und [35] lässt sich der Zeitpunkt bestimmen.
  • Gegenüber dem Ziel, mindestens zehn konkrete Erkenntnisse für Closed und Open Source zu liefern, bietet Pinterest selbst kaum klar zuordenbare Open-Source-Fälle. Sichtbar sind hauptsächlich [42] mit einem chinesischen Anbieter und [46] mit AMD-Bezug. Die Lücke muss durch die anderen Plattformen ausgeglichen werden.

Empfohlene Maßnahmen

  • Für X sollten die Suchbegriffe durch direkt passende Begriffe wie Midjourney, Stable Diffusion, Sora, Nano Banana und Qwen-Image ersetzt und die Sammlung erneut ausgeführt werden.
  • Reddit sollte künftig große Kern-Subreddits wie r/StableDiffusion, r/midjourney und r/comfyui einbeziehen.
  • Als Ersatz für die nicht funktionierende Bluesky-Suche sollten die entdeckten Hauptaccounts als Watchlist regelmäßig beobachtet werden.
  • Neue Meldungen zur Einstellung der OpenAI-Sora-API am 24. September 2026 und zu Midjourneys Geschäftswechsel sollten bei der nächsten Recherche höchste Priorität erhalten.

Gesammelte Bilder

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 AI Image and Video CreationAI content and social media concernsAI News: Anthropic Leak Shows Us The Future of AI...imageThe Ultimate AI Image and Video Generation Platform - The Data ScientistGoogle Unveils Veo 2: Advanced AI Video Generation...Ai Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoJust Nail It 🎥🎬 10 FREE AI VIDEO TOOLS IN 2026 🤯 Create Videos Without Expensive Software!Google announces ultra-high quality video...AI For Image And video GenerationimageAI Video Content Creation: High earners,...imageAI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIAI News: OpenAI Finally Released What We Asked For️ Image to Video AI – Animate Your Photos With AIimageDiscover how Grok is revolutionizing video...‎🚨 AI is getting scary good.Top AI Video Generators of 2025imageimageMore than 20% of YouTube is now AI-generated5+ Best AI Video Generation Websites 2026 | Runway, Pika, Kling AI, Canva & MoreArtificial intelligence: let’s maintain our...AI Video Creation: 10 Smart Ways to Create Engaging Videos FasterWhat is Imagvio AI and how it helps creators...AI driven image and video analysisThe potential impact of artificial intelligence on...AiAI Tools for Video Editing — What Creators Actually Use to Make Content in 2026Breaking News Latest AI Developments - Grok 4.6 Gemini 1B Honor Robot PhoneFuture of Video Creation: Best AI Video Generators of 2026🔸How To Detect AI-Generated Images Online For FreeI will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoProfessional AI Video Creation | Cinematic AI Videos | Custom Video EditingAI Video Creation: Complete Guide to Create Professional Videos Faster with AIHow AI Is Transforming Video EditingShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI Videohistory generative AIMastering Video and AI: Key Social Media Marketing Trends 2025OpenAI’s Secret Image Generation Tool to Debut Soon'Amuse 3.0', an AI art creation tool that includes...The most impressive creations from Internet users...Transform your ideas into stunning visuals! 🎥Viral Tiny People AI Effect—Learn How to Create It!12 Best AI Video Generators in 2026 (Free & Paid) | Google Veo, Sora, Runway & More

Hinweis zur Datenqualität

Wegen unpassender Suchbegriffe wurden auf X keine thematisch relevanten Posts erhoben. Bei Bluesky, Pinterest und YouTube waren Such-APIs oder Engagement-Zahlen teilweise nicht verfügbar, weshalb einige quantitative Belege schwach bleiben.

Galerie