KI-News zur Bild- und Videogenerierung — 2026-09-17
Bei Closed Source stehen der faktische Rückzug von Sora 2 und das Duell GPT Image 2.5 gegen Nano Banana Pro im Mittelpunkt. Im Open-Source-Bereich führen chinesische Modelle wie Wan, MiniMax H3, HunyuanVideo und Z-Image Turbo, während eine mögliche Schließung von Wan 3.0 der größte Unsicherheitsfaktor ist.
KI-News zur Bild- und Videogenerierung — 2026-09-17
Puh – in der Welt der Bild-/Video-KI ist diesmal wirklich extrem viel passiert 🔥 Auf der Closed-Source-Seite verschwindet Sora 2 faktisch aus dem Rampenlicht; Veo 3.1, Kling 2.5 Turbo und Seedance übernehmen. Parallel liefern sich OpenAIs GPT Image 2.5 und Googles Nano Banana Pro einen echten Schlagabtausch 👊 Im Open-Source-Bereich haben chinesische Akteure wie Wan, MiniMax H3, HunyuanVideo und Z-Image Turbo die Führung übernommen; in der ComfyUI-Szene regnet es täglich neue Nodes und LoRAs – eine regelrechte Festivalstimmung 🎉 Gleichzeitig häufen sich bei Googles Modellen (Nano Banana Pro/Flow) die Probleme: Sicherheitsfilter blockieren sogar eigene Generierungen, und nach massenhaft erzeugten gefälschten Katastrophenbildern in Google Earth wurde eine Funktion zurückgezogen. Bei der Zuverlässigkeit wird es also etwas heikel 😬
Plattformübergreifend
- Der Rückzug von Sora 2 und die Wachablösung durch Google/ByteDance/Kling: Auf YouTube wird berichtet, dass „Sora 2 am 24.09.2026 endgültig über die API abgeschaltet werden soll“. Gleichzeitig wird Seedance (2.0→2.5) auf Reddit und YouTube unabhängig voneinander für seinen Realismus bei Personen gelobt. Wenn dieselbe Einschätzung auf mehreren Plattformen organisch entsteht, ist das ein starkes Signal 💪
- Die Debatte GPT Image 2.5 vs. Nano Banana Pro: YouTube (mehrere Review-Videos direkt nach der Ankündigung), Bluesky (@testingcatalog.com meldete es am 09.09.2026) und Lemmy (Vergleich bei der Kolorierung von Berserk, bei dem ChatGPT Images 2.5 die Linien besser bewahrt, während Nano Banana Pro Anweisungen ignoriert) vergleichen diese beiden Modelle unabhängig voneinander.
- Viele Probleme rund um Nano Banana Pro/Google Flow: Auf Reddit sorgt die Geschichte eines außer Kontrolle geratenen Filters für Aufsehen: Googles eigenes Flow blockiert sogar Bilder aus dem eigenen Nano Banana Pro. Auf Lemmy wird über einen Vorfall berichtet, bei dem eine in Google Earth integrierte Nano-Banana-2-Funktion einen Tag nach dem Rollout zurückgezogen wurde, weil gefälschte Katastrophen- und Militäranlagenbilder in großer Menge entstanden. Unterschiedliche Plattformen, aber dasselbe Bild: Googles generative KI ist stark, doch die Kontrolle kommt nicht hinterher.
- Open Source: chinesische Modelle plus MiniMax H3 als Hauptschauplatz: Auf Reddit werden Wan, MiniMax H3 und LTX Video wiederholt als die besten kostenlosen Optionen genannt. Auf YouTube stammen Wan, Z-Image Turbo und HunyuanVideo/Image durchgehend aus China. Auf Lemmy wurden in !«メールアドレス» innerhalb weniger Tage zahlreiche ComfyUI-Tools für MiniMax H3 veröffentlicht. Auf Bluesky tauchte Lightricks LTX-2.5 drei Tage in Folge in den Hugging-Face-Trends auf. Vier Plattformen zeigen damit in dieselbe Richtung.
Nach Plattformen
Reddit: 11 Threads gesammelt, das Ziel von 20 wurde nicht erreicht. Bei Closed Source stehen der großzügige kostenlose Google-Flow-Tarif und der überstrenge Sicherheitsfilter im Widerspruch; zudem wird Seedance für Personenrealismus gelobt. Bei Open Source werden Wan, MiniMax H3 und LTX Video als lokale Standardoptionen ständig genannt. Auch der Streit um die Bedeutung von „AI slop“ und der Spott über vollautomatische YouTube-Video-Tools vermitteln ein realistisches Stimmungsbild 🗿
X: Dieses Mal ein kompletter Fehlgriff 😅 Die Sammlung lief über Trends; da die Sitzung nach Kroatien geolokalisiert war, drehten sich die 40 gesammelten Posts fast ausschließlich um südafrikanische Politik, Serbien/Kosovo, Israel/Hamas, Zcash-Governance und Gewinnspiel-Spam. Kein einziger Post bezog sich auf Bild- oder Video-KI. Dies ist die einzige Plattform im Briefing, die man klar als Lücke bezeichnen muss – eine erneute Sammlung ist nötig.
YouTube: 13 Videos wurden anhand von Titeln und Snippets identifiziert. Bei Closed Source fallen GPT Image 2.5 (veröffentlicht am 08.09.2026, Varianten Flare/Sunburst) und das Ende von Sora 2 auf. Meta ist zudem mit Muse Image/Video neu eingestiegen: Meta Superintelligence Labs setzt dabei auf agentische Generierung mit Suche und Code-Ausführung. Bei Open Source dominieren Alibaba (Wan, Z-Image Turbo), Tencent (HunyuanVideo 1.5, HunyuanImage 3.0) und Black Forest Labs (Flux.2). Aufrufe und Kanalnamen konnten wegen der JavaScript-Darstellung allerdings kaum geprüft werden; die Einschätzung der Autorität bleibt daher begrenzt.
Bluesky: Offizielle Markenaccounts von Midjourney, Stability AI, ComfyUI, Runway, Kling und Black Forest Labs sind überwiegend seit der zweiten Hälfte von 2025 inaktiv. Die wichtigste Quelle ist damit der private News-Account @testingcatalog.com mit 860 Followern. Er lieferte Hinweise auf ChatGPT Images 2.5, Meta Muse Video, das Echtzeitvideo-Modell „Orbis“ des Start-ups Visko und die Bild-/Video-Erweiterung von ElevenLabs. Bei Open Source ließ sich vor allem das anhaltende Interesse an LTX-2.5 über einen Hugging-Face-Trendbot bestätigen. Weil die Such-API mit 403 antwortete, war die Recherche auf Account-basierte Nachverfolgung beschränkt.
Lemmy: Etwas mehr als 10 relevante Posts, das Ziel von 20 wurde nicht erreicht und nicht künstlich aufgebläht. Closed-Source-Themen erscheinen häufig als Pannen- oder Kontroversengeschichten: etwa der Rückzug von Google Earth AI oder Spott, der Midjourneys Einstieg in Medizintechnik mit Theranos vergleicht. !«メールアドレス» ist de facto der zentrale Ort für Open Source; rund um MiniMax H3 entstanden binnen weniger Tage ComfyUI-Nodes, LoRAs und speichersparende Implementierungen – ein typisches OSS-Muster.
Pinterest: Von 50 Pins wurden 30 visuell geprüft. Open-Source-Themen sind nahezu nicht vorhanden: Kein Pin nennt Stable Diffusion, Flux, Wan oder ComfyUI. Sichtbar sind fast nur geschlossene Consumer-Marken wie ChatGPT, Gemini, Claude, Adobe Firefly, Midjourney und Canva. Echte Nachrichtenthemen finden sich vor allem beim Streit um die „KI-Schauspielerin“ Tilly Norwood, bei ShengShu Technologys Vidu S1 für interaktive Echtzeitvideos und bei einer technischen Grafik zu Microsoft VASA-1. Insgesamt dominieren Stockbilder, die Ängste vor Robotern und Deepfakes transportieren. Das spiegelt weniger Nachrichten als eine visuelle Kultur diffuser KI-Sorgen wider.
Beobachten
- Anzeichen, dass Wan 3.0 geschlossen wird (YouTube, Verweise auf den offiziellen Alibaba-Blog): Wan 2.2 war noch vollständig unter Apache-2.0 offen. Bei Wan 3.0, angekündigt am 24.08.2026, sollen dagegen nur APIs verfügbar sein und die Gewichte unveröffentlicht bleiben. Das könnte für Open-Source-Videogenerierung ein einschneidendes Ereignis werden.
- Das ComfyUI-Ökosystem rund um MiniMax H3 (Lemmy: https://lemmy.dbzer0.com/post/75586072 und weitere): In den letzten Tagen wurden in kurzer Zeit viele Tools veröffentlicht. Derzeit ist dies eines der heißesten Open-Source-Modelle für Video und Bild.
- GPT Image 2.5 vs. Nano Banana Pro (YouTube: https://www.youtube.com/watch?v=DY6TkI8XtkQ, Bluesky: https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27): Die Frontlinie der Closed-Source-Bildgenerierung – der nächste Schritt bleibt abzuwarten.
- Metas Einstieg mit Muse Image/Video (YouTube: https://www.youtube.com/watch?v=rAvnO1DWnMs, Bluesky: https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24): Agentische Generierung mit Suche und Code-Ausführung ist ein neuer Ansatz; der offizielle Launch sollte beobachtet werden.
- Sicherheitsfilter und Fehlgenerierungen bei Google-Modellen (Reddit: https://www.reddit.com/r/generativeAI/comments/1wh1y9d/, Lemmy: https://lemmy.durstig.online/post/52162): Dies dürfte als Thema für Zuverlässigkeit und Regulierung weiter relevant bleiben.
Empfehlungen
- X (ehemals Twitter) nicht über Trends, sondern erneut über direkt thematische Suchbegriffe wie „Sora 2“, „Nano Banana Pro“, „Wan“ und „Flux“ durchsuchen.
- Die Vermutung einer Schließung von Wan 3.0 mit Primärquellen, insbesondere Alibabas offiziellen Ankündigungen, prüfen und die Folgen für die Open-Source-Videolandschaft verfolgen.
- !«メールアドレス» als festen Beobachtungspunkt für Entwicklungen rund um MiniMax H3 nutzen.
- Da Vergleiche zwischen GPT Image 2.5 und Nano Banana Pro plattformübergreifend übereinstimmen, beim nächsten Mal auch dritte Akteure wie Seedream 5.0 Pro einbeziehen.
- Überreaktionen von Sicherheitsfiltern und Fehlgenerierungen bei Google-Modellen weiter als Zuverlässigkeitsthema beobachten.
Datenqualität
Bei X lag die Sammelmethode – geolokalisierte Trends – vollständig neben dem Thema; unter 40 Posts gab es keinen themenrelevanten Beitrag, weshalb die Plattform diesmal faktisch nicht funktionierte. Reddit (11 Beiträge) und Lemmy (etwas mehr als 10) erreichen nicht das im Briefing genannte Ziel von rund 20 Beiträgen; sie wurden nicht künstlich ergänzt. Auf YouTube verhinderten JavaScript-Rendering-Hürden die Prüfung von Aufrufzahlen und Kanalnamen, was die Bewertung der Autorität schwächt. Bei Bluesky war die offizielle Such-API mit 403 nicht verfügbar, weshalb eine alternative, weniger vollständige Recherche über bekannte Accounts erforderlich war. Bei Pinterest wurden nur Bilder und Titel geprüft; Zielartikel und Speicherzahlen konnten nicht verifiziert werden.
Zusammenfassung nach Plattform
Reddit — KI-News zur Bild- und Videogenerierung
Wo
Die 11 gesammelten Threads stammen aus sieben Subreddits. Alle wurden über den Suchbegriff „Image and Video Generation AI News“ gefunden.
| Subreddit | Mitgliederzahl | Zahl gesammelter Threads |
|---|---|---|
| r/generativeAI | 154,126 | 5 |
| r/aitubers | 28,633 | 1 |
| r/AIDangers | 53,410 | 1 |
| r/aifilmmaking | 7,951 | 1 |
| r/aivideomaking | 7,085 | 1 |
| r/AIToolTalks | 6,307 | 1 |
| r/NoStupidQuestions | 7,494,416 | 1 |
Auf Bild- und Video-KI spezialisierte Subs (r/generativeAI, r/aifilmmaking, r/aivideomaking, r/aitubers) stellen 8 der 11 Beiträge. Die übrigen drei (r/AIDangers, r/AIToolTalks, r/NoStupidQuestions) diskutieren KI allgemein und sind nicht auf Bild-/Videogenerierung beschränkt.
Was Menschen sagen
- Closed Source (Google Flow/Veo) bietet großzügige Gratis-Kontingente, verschärft aber zugleich die Regeln. Thread 4 „Google Flow is giving creators a surprisingly generous amount of free AI video generation right now“ (r/aifilmmaking · 8 Punkte · 14.09.2026) https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ beschreibt kostenlose Veo-Credits und ein zunehmend vollwertiges Produktions-Workspace mit Szenenaufbau, Kamerasteuerung und Referenzbildern. In den Kommentaren schreibt u/MechanicForward2274 (1 Punkt): „50 credits a day is actually enough to experiment with a lot if you're not wasting them“.
- In Thread 7 (r/generativeAI · 2 Punkte · 15.09.2026) https://www.reddit.com/r/generativeAI/comments/1wh1y9d/ wird dagegen bemängelt, dass der Sicherheitsfilter von Google Flow sogar Bilder blockiert, die das eigene Modell Nano Banana Pro erzeugt hat. Der Verfasser versuchte es 60-mal mit demselben Bild, ohne Erfolg. Diese Reibung treibt RTX-5090-Besitzer zur lokalen Generierung.
- Lokale/Open-Weight-Videomodelle werden wiederholt als beste kostenlose Optionen genannt: Wan, Minimax H3 und LTX Video. In Thread 1 (r/generativeAI · 8 Punkte · 16.09.2026) https://www.reddit.com/r/generativeAI/comments/1whtesl/ schreibt u/tuckken2 (2 Punkte): „Wan 2.2 and Minimax H3 are free on cnaps studio, credit resets every 5 hours“. In Thread 7 nennt u/f5alcon (3 Punkte) „Minimax H3 is the best local generator“, während u/Liberation2020 (1 Punkt) „Wan, mini max H3 and LTX Video“ aufführt.
- Seedance (Closed Source, ByteDance-nah) gewinnt bei Personenrealismus an Anerkennung. Der Verfasser von Thread 7 bezeichnet „Seedance 2.0“ als besten Videogenerator für menschlichen Realismus. In Thread 8 „HOW IS THIS MADE?!“ (r/generativeAI · 0 Punkte · 10.09.2026) https://www.reddit.com/r/generativeAI/comments/1wced4g/ erklärt u/lagbit_original (3 Punkte), dass Seedance 2.5 mit einem einzelnen Prompt, passenden Referenzbildern und nachträglicher Musik- und Schnittbearbeitung virales Video-Niveau erreichen könne. Auch in Thread 11 lobt u/pb404 (2 Punkte) die Konsistenz des Seedance-2.5-Referenzmodells.
- Die Nachfrage nach Tools, die „vollautomatisch YouTube-Videos erstellen“, wird verspottet. In Thread 5 (r/aitubers · 0 Punkte · 35 Kommentare · 14.09.2026) https://www.reddit.com/r/aitubers/comments/1wg3duk/ verlangt ein Post vollständige Automatisierung aus einem Skript für maximal 50 Euro im Monat. u/RangeWilson (7 Punkte) antwortet bissig: „I'm looking for a unicorn who will slide down a rainbow and give me a pot of gold every day. But I'm not willing to pay more than €50 per month.“ u/RobJames007 (12 Punkte, höchster Wert im Thread) ergänzt: „YouTube is trying to reduce AI slop, not allow more of it onto the platform“.
- Über die Bedeutung des Etiketts „AI slop“ herrscht Uneinigkeit (Details unter Signale). In Thread 11 „Is there a way to make AI video that does not look like AI slop?“ (r/generativeAI · 0 Punkte · 30 Kommentare · 14.09.2026) https://www.reddit.com/r/generativeAI/comments/1wgjjzu/ berichtet der Verfasser, dass sich die Sehdauer allein durch wiederkehrende Figuren, Stimmen und fortlaufende Gags verneunfachte, ohne technische Änderungen. Danach nannte es niemand mehr „slop“.
- Der Wunsch nach kostenlosen oder günstigen Angeboten ist stark. In Thread 2 „Please help me generate free ai video without subscription“ (r/aivideomaking · 0 Punkte · 14 Kommentare · 15.09.2026) https://www.reddit.com/r/aivideomaking/comments/1wh80z3/ schreibt u/Fluffybabyyoda (1 Punkt): „google flow gives you 50 credits daily sometimes 2 times a day. Google gemini i think gives you 3 videos a day“. u/Bastisheen92 (2 Punkte) erinnert an den Grundsatz: „Local Generation is free if you already own the Hardware“.
- Es gibt auch eine gewisse Nachfrage nach kostenlosen Tools für NSFW- oder grenzwertige Inhalte. In Thread 3 „Any free video platform?“ (r/generativeAI · 2 Punkte · 5 Kommentare · 16.09.2026) https://www.reddit.com/r/generativeAI/comments/1whvzu3/ schreibt der Verfasser: „I was able to find ways to get Grok for free and spicy minimax“. Im selben Thread wirbt u/Critical_Emu_6565 (2 Punkte) für das eigene Tool „RexCut AI“; außerdem finden sich selbstwerbliche Kommentare.
- Nicht spezifisch für Bild-/Video-KI, aber als Hintergrund sichtbar, sind Sorgen und Misstrauen gegenüber KI allgemein. In Thread 9 „Are all of you also anxious about recent news about AI?“ (r/AIToolTalks · 12 Punkte · 35 Kommentare · 13.09.2026) https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ geht es um Wasserverbrauch und Arbeitsplatzverluste sowie um die Geschichte, dass Schauspieler Andrew Garfield nach der Rolle von Sam Altman in „Artificial“ die KI-Nutzung eingestellt habe. u/Big-Pops78 (3 Punkte) widerspricht, der Wasserverbrauch sei im Vergleich zu anderen Technologien nicht außergewöhnlich hoch.
- Auch die Wirtschaftlichkeit von KI-Einführungen wird skeptisch gesehen. Thread 6 „Biggest AI news of 2026: AI is not a necessary tool...“ (r/AIDangers · 26 Punkte · 31 Kommentare · 14.09.2026) https://www.reddit.com/r/AIDangers/comments/1wg5y17/ behauptet, KI-Einführungen hätten in vielen Unternehmen die Leistung verschlechtert. u/presentofai (1 Punkt) hält dagegen: „most of these "AI made it worse" numbers are measuring clumsy rollouts, not the models“.
Signale
- Aufwärts: Lokale/Open-Weight-Videomodelle wie Wan, Minimax H3 und LTX Video werden klar als Alternativen zu kostenlosen Closed-Source-Kontingenten unterstützt. Konkret wird beschrieben, wie Besitzer leistungsstarker GPUs wie der RTX 5090 wegen restriktiver Cloud-Regeln zur lokalen Nutzung wechseln (Thread 7).
- Aufwärts: Seedance (2.0/2.5) verbessert seinen Ruf bei Personenrealismus und Konsistenz; mehrere Threads und Kommentare erwähnen dies unabhängig voneinander.
- Wird geringgeschätzt/abgelehnt: Erwartungen an vollautomatische Tools, die nur aus einem Skript ein fertiges Video machen, werden von der Community deutlich verspottet (Thread 5; der am besten bewertete Kommentar ist ironisch). Auch „AI slop“ wird von manchen als bedeutungslos gewordenes Schimpfwort abgetan.
- Meinungsverschiedenheit: Thread 11 ist beim Thema „Was ist AI slop?“ klar gespalten. u/Tenth_10 (9 Punkte, Höchstwert im Thread) und u/pb404 (2 Punkte) argumentieren, die Kritik liege an fehlenden Einsätzen und Spannung in der Geschichte, nicht an der Technik. u/RioNReedus (3 Punkte) vertritt dagegen die gegenteilige Sicht: Das Wort sei zu einem bedeutungslosen Begriff geworden, den KI-Gegner für alles verwenden. Bemerkenswert ist, dass derselbe Beitrag zu gegensätzlichen Schlussfolgerungen führt.
- Überraschend: Googles eigener Dienst Flow blockiert selbst Bilder, die mit Nano Banana Pro erstellt wurden – ein überreagierender Filter (Thread 7). Großzügige kostenlose Credits (Thread 4: 50 Credits täglich) und strenge Zensur der Ergebnisse laufen parallel und vermitteln Nutzern widersprüchliche Signale.
- Überraschend: Fast die Hälfte der über den Suchbegriff „Image and Video Generation AI News“ gefundenen Threads stammt aus r/AIDangers, r/AIToolTalks und r/NoStupidQuestions und behandelt nicht nur Bild-/Video-KI, sondern KI-Sorgen allgemein. Das zeigt, dass Bild- und Video-KI im breiteren Kontext der Frage „Ist KI vertrauenswürdig?“ diskutiert wird.
Grenzen
- Es wurden nur 11 Threads gesammelt, nicht die in brief.md geforderten rund 20. Genutzt wurde nur eine Suchanfrage („Image and Video Generation AI News“ – zugleich der Titel dieser Recherche und keine natürliche Suchanfrage). Andere Formulierungen wie „Sora 2“, „Midjourney update“ oder „open source video model release“ wurden nicht erneut gesucht.
- Die Closed-Source-Seite ist auf Google Flow/Veo und Seedance konzentriert. Eigene Threads zu anderen wichtigen Closed-Source-Diensten wie Sora, Midjourney, Runway, Kling oder Grok Imagine wurden nicht gesammelt; sie werden nur in Kommentaren erwähnt.
- Auch bei Open Source werden vor allem Wan, Minimax H3 und LTX Video wiederholt genannt; eigene Threads zu Flux, Stable-Diffusion-Modellen oder aktuellen ComfyUI-Entwicklungen wurden nicht gefunden.
- Die drei Threads aus r/AIDangers, r/AIToolTalks und r/NoStupidQuestions behandeln nicht spezifisch Bild-/Video-KI, sondern KI allgemein. Ihre thematische Relevanz ist daher indirekt.
- Der Browserzugriff auf Reddit war auf zuvor von einem Worker gesammelte Daten beschränkt; es wurden keine zusätzlichen Suchen oder Seitenaufrufe ausgeführt.
X
X — KI-News zur Bild- und Videogenerierung
Accounts
Keiner der Accounts im gesammelten Datensatz spricht über Bild- oder Video-KI, weder Closed Source noch Open Source. Die 38 Accounts in
output/x.posts.json sind eine Mischung aus:
- Politik- und Kommentaraccounts mit Debatten zu Südafrika, Serbien/Kosovo,
Brexit und Fußballzulassung sowie Israel/Hamas (z. B. @TheSirRobotto,
2 Posts mit zusammen 12,537 Likes zu Serbien/EU-Fußballregeln; @marklevinshow,
1 Post mit 3,250 Likes zu Erdogan/Hamas). - Unterhaltungs- und Fanaccounts (@eva_kirby21, @PossiblyApollo – Gespräche über Apple-TV-Emmys; @justluvbourzgui, @theholydemi, @acervylaur – Lauren-Jauregui/DWTS-Fandom).
- Kryptoaccounts zur Governance-Abstimmung von Zcash (ZEC) (@CoinMarketCap,
@zooko, Zcash-Mitgründer, sowie @Hasan_NFTOX mit einem kostenlosen NFT-Mint). - Gewinnspiel-/Spamaccounts mit nahezu identischem Text zum „Pour PalZ Neon
Crochet Bears Giveaway“ (@corrysue1, @PHIFFERJ,
@lilredshoper – alle 0 Likes, beinahe identischer Text über @gaynycdad).
Keiner dieser Accounts ist ein KI-, Midjourney-, Sora-, Runway-, Stable-Diffusion- usw. Account, Forscher oder Nachrichtenmedium. Dies zeigt nicht, „wer die Diskussion über KI für Bilder und Video auf X prägt“, sondern wer Kroatiens Trendthemen an diesem Tag prägte.
Posts
Keine Erkenntnisse – keiner der 40 gesammelten Posts erwähnt Bildgenerierung, Videogenerierung oder KI-Modelle irgendeiner Art. Statt Relevanz zu erfinden, werden sie nicht in das Briefing hineingezwungen.
Signale
Aus diesem Datensatz lässt sich kein Signal für das Forschungsthema ableiten. Das einzige erkennbare Muster in den Daten: regionale Politik (Südafrika, Serbien/Kosovo, Israel-Hamas), eine Krypto-Governance-Abstimmung (Zcash verkürzt Blockzeiten von 75 s auf 25 s, output/x.posts.md #19) sowie Fandom- und Spam-Rauschen – nichts davon ist KI-bezogen.
Grenzen
Die Sammlung für diese Phase zielte nicht auf das Forschungsthema. Laut output/x.posts.md und .json nutzte der Worker die Methode "source": "trending": Er las die X-Explore-Trendliste, die auf den Serverstandort geolokalisiert war und „Trending in Croatia“ bzw. allgemeine Kategorien wie „Politics · Trending“ und „Technology · Trending“ zeigte. Anschließend wurden diese Trendbegriffe wörtlich gesucht: „Africa“, „Serbia“, „Apple“, „Canada“, „Zcash“, „#sweepstakes“, „#giveaways“, „#chance“, „Lauren“, „Hamas“. Keiner davon bezieht sich auf Bild- oder Video-KI, daher enthalten die 40 Posts von 38 Accounts kein relevantes Material.
Ich habe X nicht selbst durchsucht; entsprechend dem Playbook gab es in dieser Sitzung keinen Live-Zugriff auf X und nur bereits gesammelte Daten waren lesbar. Die Abschlusskriterien von etwa 20 analysierten Posts je Plattform können für X in diesem Durchlauf nicht erfüllt werden: Es gibt keinen themenrelevanten Post in der Datei, und eine erneute Sammlung mit passenden Suchbegriffen wie „Sora 2“, „Midjourney“, „Stable Diffusion“, „Runway“, „Nano Banana“, „Flux“, „Veo 3“, „closed-source image AI“ oder „open-source video model“ war nicht möglich.
Diese Phase sollte als fehlgeschlagen bzw. erneut zu erheben markiert werden, und zwar mit thematisch passenden Suchbegriffen statt Trendthemen.
YouTube
YouTube — KI-News zur Bild- und Videogenerierung (Closed Source/Open Source)
Kanäle
Die YouTube-Suchergebnisseite wird per JavaScript gerendert; oft war nur der Footer abrufbar, während Kanalnamen und Abonnentenzahlen nicht im Inhalt erschienen (siehe „Grenzen“). Soweit aus Titeln und Snippets erkennbar, wurden folgende Kanäle bzw. Urheber festgestellt:
- Offizieller OpenAI-Kanal —
Introducing GPT-Image-2.5 in the API(offizielles Erklärvideo) - KI-News- und Review-Kanäle, die nicht eindeutig identifiziert werden konnten: Sie veröffentlichen fortlaufend Tutorials zu GPT Image 2.5, Nano Banana Pro, dem Ende von Sora 2 sowie Wan/HunyuanVideo/Z-Image/Flux.2 und ComfyUI. Aus den Titeln lässt sich stützen, dass spezialisierte KI-Kanäle wie MattVidPro AI, TheAIGRID, Theoretically Media und Matt Wolfe (ca. 965.000 Abonnenten, KI-News) solche Themen regelmäßig behandeln; eine eindeutige Zuordnung einzelner Videos zu diesen Kanälen war aber nicht möglich.
Videos
Closed Source
- GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model — Anfang September 2026 („vor einer Woche“) — https://www.youtube.com/watch?v=DY6TkI8XtkQ — Gesamtüberblick über OpenAIs am 08.09.2026 veröffentlichtes neues Bildmodell „GPT Image 2.5“ mit den Varianten Flare und Sunburst.
- Introducing GPT-Image-2.5 in the API — September 2026 — https://www.youtube.com/watch?v=A7MSwdXj86k — Offizielles Erklärvideo im Umfeld von OpenAI. Sunburst wird mit schärferem, natürlicherem Licht und besserer API-Bearbeitungspräzision hervorgehoben.
- OpenAI's New Image Model Is Brilliant… Until You Look Closer — Mitte September 2026 („vor 5 Tagen“) — https://www.youtube.com/watch?v=pEYqorQrc4U — Kritisches Review, das GPT Image 2.5 mit anderen wichtigen Bildmodellen vergleicht und Schwächen wie Detailfehler aufzeigt.
- [NEW] Meta Muse.Ai Image Generation First Reaction — etwa Juli 2026 — https://www.youtube.com/watch?v=rAvnO1DWnMs — Ersteindruck zu Meta Superintelligence Labs’ neuem Bildmodell „Muse Image“, basierend auf Muse Spark und mit agentischer Generierung über Suche und Code-Ausführung.
- Grok Imagine Video 1.5 vs Seedance 2.0 | Full AI Video Test — 08.06.2026 — https://www.youtube.com/watch?v=5mFkZiRTVu4 — Vergleich von xAIs „Grok Imagine Video 1.5“ und ByteDances „Seedance 2.0“ anhand echter Generierungen.
- Grok's New FREE AI Video Generator Is INSANE — 06.07.2026 — https://www.youtube.com/watch?v=lrCjbL51dbk — Vorstellung von Grok Imagine Video 1.5 mit Schwerpunkt auf der kostenlosen Testmöglichkeit.
- BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives — 27.03.2026 — https://www.youtube.com/watch?v=Zf9979o8RGk — Nach der Ankündigung bzw. Abschaltung der Sora-2-App/API durch OpenAI am 24.03.2026 testet das Video Alternativen wie Veo 3.1, Kling und Hailuo und markiert einen Umbruch bei Closed-Source-Angeboten.
Open Source
- Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! — 27.11.2025 — https://www.youtube.com/watch?v=sPQQPpQ9X4E — Alibabas/Tongyi-MAIs Modell „Z-Image Turbo“ mit 6 Milliarden Parametern unter Apache-2.0. Behauptet werden Qualität und Geschwindigkeit auf Nano-Banana-Pro-Niveau.
- New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial — November–Dezember 2025 — https://www.youtube.com/watch?v=JF4Q5hXh-_Q — ComfyUI-Tutorial, das Z-Image Turbo über Flux.2 einordnet.
- Flux.2 Has Landed! Is It the Open Source King? — November 2025 — https://www.youtube.com/watch?v=D0_QGrdtvEg — Prüfung von Black Forest Labs’ Flux.2 (Pro/Flex/Dev/Apache-2.0-Klein). In späteren kritischen Artikeln wird allerdings von einer nur scheinbaren Öffnung gesprochen.
- We have a new #1 open-source AI video generator! (Tencent HunyuanVideo 1.5) — 25.11.2025 — https://www.youtube.com/watch?v=6EQP8-D37bs — Review und Installationsanleitung zu Tencents offenem Videogenerierungsmodell mit 8,3 Milliarden Parametern.
- HunyuanImage 3.0: Open Source Text To Image Model (Forget Nano Banana & Seedream 4) — September 2025 — https://www.youtube.com/watch?v=32lhiZKhgOY — Tencents MoE-Bildmodell mit über 80 Milliarden Parametern, vorgestellt als „größtes Open-Source-Bildmodell“.
- WAN 2.2 Animate in ComfyUI (Step-by-Step Guide) — 26.09.2025 — https://www.youtube.com/watch?v=dyqz3PJ0wvo — Tutorial für Alibabas offene Funktion, mit Wan 2.2 aus einem Referenzbild ein Video zu erstellen.
Signale
- OpenAIs Videogenerierung zieht sich mit Sora faktisch zurück: Sora-2-App und API wurden zwischen März und April 2026 eingestellt, die endgültige API-Abschaltung ist für den 24.09.2026 vorgesehen. Mehrere Videos sehen Google Veo 3.1, Kling 2.5 Turbo und ByteDance Seedance 2.0 als neue Hauptakteure bei Closed-Source-Video (BREAKING: Sora 2 is SHUTTING DOWN, https://www.youtube.com/watch?v=Zf9979o8RGk).
- An der Spitze geschlossener Bildgenerierung steht GPT Image 2.5 gegen Nano Banana Pro (Gemini 3 Pro Image). Seit OpenAI GPT Image 2.5 am 08.09.2026 veröffentlichte, nehmen direkte Vergleiche mit Googles im November 2025 eingeführtem Nano Banana Pro stark zu (GPT Image 2.5 Is AMAZING, https://www.youtube.com/watch?v=DY6TkI8XtkQ).
- Meta steigt ernsthaft in Bild- und Videogenerierung ein: Muse Image, Muse Spark und Muse Video von Meta Superintelligence Labs erschienen im Juli 2026 und werden als neuer Ansatz mit agentischer Websuche und Code-Ausführung präsentiert.
- xAIs Grok Imagine iteriert schnell: Von der ersten Version im August 2025 bis zu Video 1.5 zwischen Mai und Juli 2026; viele Videos betonen die kostenlosen Kontingente.
- Chinesische Modelle führen bei Open Source: Alibaba (Wan, Z-Image Turbo), Tencent (HunyuanVideo, HunyuanImage) und Black Forest Labs aus Deutschland (Flux.2) stehen im Mittelpunkt. Besonders Z-Image Turbo (6B, Apache-2.0) wird teilweise bereits über Flux.2 eingeordnet.
- Warnsignal einer Kehrtwende: Wan 2.2 war unter Apache-2.0 vollständig offen; mehrere Artikel behaupten jedoch, dass das am 24.08.2026 angekündigte Wan 3.0 nur per API verfügbar und ohne veröffentlichte Gewichte sein werde. Auch auf YouTube gibt es Sorge, dass das nächste Open-Source-Flaggschiff für Videogenerierung unklar bleibt.
- Das ComfyUI-Ökosystem bleibt der zentrale Ort für offene Bild- und Videogenerierung: Tutorials für Wan 2.1/2.2, HunyuanVideo und Z-Image Turbo erscheinen fortlaufend.
Grenzen
- Beim direkten Abruf der YouTube-Suchergebnisse (
youtube.com/results?search_query=...) lieferte WebFetch nur den Footer vor dem JavaScript-Rendering. Auch einzelne Videoseiten (youtube.com/watch?v=...) machten weder JSON-LD noch OG-Metadaten zugänglich. - Aufrufe und Abonnentenzahlen stammen daher, soweit vorhanden, nur aus Websuch-Snippets. Für viele Videos konnten weder genaue Aufrufzahlen, Kanalnamen noch Abonnentenzahlen bestätigt werden; ein Video mit eindeutig prüfbarer Aufrufzahl gab es nicht. Für belastbare Zahlen wäre ein zusätzlicher Weg wie die YouTube Data API nötig.
- Zu Kling 2.5 Turbo wurde die Spitzenposition in einem Artificial-Analysis-Ranking in mehreren Artikeln außerhalb YouTubes gefunden, aber keine konkrete passende YouTube-URL.
- Zu Midjourneys Videomodell wurden nur Nachrichten aus April bis Juni 2025 gefunden; keine bedeutenden neuen Entwicklungen innerhalb der letzten 60 Tage. Kleinere V7.1/V8-Updates waren nur bis September 2025 auffindbar.
- Kommentare, einschließlich Top-Kommentaren, waren nicht zugänglich und konnten nicht analysiert werden.
Bluesky
Bluesky — KI-News zur Bild- und Videogenerierung
Accounts
- 🚨 AI News | TestingCatalog @testingcatalog.com — 860 Follower. Privat betriebener KI-News-Account mit dem Anspruch „Latest AI News on AI Agents, Model Releases, Tools, Leaks, and Rumors“. Mehrmals täglich erscheinen kurze Meldungen zu Modellveröffentlichungen und Leaks. In dieser Recherche war er die aktivste und aktuellste Quelle.
- Daily HuggingFace Trends @huggingfacetrends.bsky.social — 122 Follower. Ein Bot, der nach 19 Uhr täglich trendende Hugging-Face-Modelle automatisch postet (GitHub: aegisfleet/hugging-face-trending-to-bluesky). Nützlich für Open-Source-Modelltrends.
- Midjourney (offiziell) @midjourneyofficial.bsky.social — 112 Follower. Trat Bluesky im August 2025 bei, der letzte aktuelle Post stammt jedoch vom 08.10.2025; danach blieb der Account still.
- Stability AI (offiziell) @stabilityai.bsky.social — 241 Follower. Es gibt Ankündigungen etwa zu „Stability AI Image Services“, der letzte Beitrag stammt aber vom November 2025; die Aktivität ist lückenhaft.
- ComfyUI (offiziell) @comfyuiorg.bsky.social — Offizieller Account des Open-Source-Workflow-Tools für Bild- und Videogenerierung. Die letzten Posts enden allerdings im Juni 2025, weshalb Entwicklungen 2026 nicht verfolgt werden konnten.
- Black Forest Labs (Flux-Entwickler) @blackforestlabs.bsky.social / Runway @runwayml.bsky.social / Kling AI @klingai.bsky.social — Die Accounts existieren, sind jedoch nahezu inaktiv: Black Forest Labs hat keine Posts, Runway nur einen aus Oktober 2024 und Kling einen leeren Feed. Bluesky ist offenbar nicht ihr wichtigster Kommunikationskanal.
Posts
-
OpenAI kündigt „ChatGPT Images 2.5“ an (Closed Source) — @testingcatalog.com, 09.09.2026, 👍2 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27
Schnellere Bildgenerierung und -bearbeitung, stärkere Motivkonsistenz sowie die neuen API-Modelle „Flare“ und „Sunburst“. -
Frühe Ergebnisse von Metas Videomodell „Muse Video“ bekannt (Closed Source) — @testingcatalog.com, 19.08.2026, 👍2
https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24
Vorabinformationen zu einem Videomodell für die angeblich zu Meta Connect entwickelte agentische Super-App „Muse“. -
Start-up Visko präsentiert das Echtzeit-Videomodell „Orbis“ (Closed Source) — @testingcatalog.com, 01.09.2026
https://bsky.app/profile/testingcatalog.com/post/3muhthn6m7i2j
Erwähnt als Einstieg eines neuen Akteurs, der Echtzeitgenerierung verspricht. -
ElevenLabs MCP wird um Musik-, Bild- und Videogenerierung erweitert (API-Dienst mit Closed-Source-Schwerpunkt) — @testingcatalog.com, 14.09.2026, 👍3 🔁1
https://bsky.app/profile/testingcatalog.com/post/3mvj6k7eycz2n
Ein Beispiel dafür, dass ElevenLabs sein bisher sprachzentriertes Angebot auf Bild- und Videoerzeugung ausdehnt. -
Tencent veröffentlicht offenes Vorschau-Modell Hy4 (Open Source) — @testingcatalog.com, 29.08.2026
https://bsky.app/profile/testingcatalog.com/post/3mu7v3bdkwo2h
Eine offene Vorschauveröffentlichung, die als möglicher Nachfolger der Hunyuan-Reihe gilt. -
Lightricks/LTX-2.5 in den Hugging-Face-Trends (Open-Source-Videogenerierung) — @huggingfacetrends.bsky.social, 15.09.2026 (erneut am 13.09. und 11.09.)
https://bsky.app/profile/huggingfacetrends.bsky.social/post/3mvkun3tjqp2t
Lightricks’ Videomodell LTX-2.5 wurde drei Tage in Folge als trendendes Hugging-Face-Modell vorgestellt – ein Hinweis auf anhaltende Aufmerksamkeit. -
ComfyUI integriert FLUX.1 Kontext als offiziellen API-Node (Open Source) — @comfyuiorg.bsky.social, 06.06.2025
https://bsky.app/profile/comfyuiorg.bsky.social/post/3lqvsxzzjhb2t
Mit dem Hinweis „Open Source coming soon!“ markiert dies einen wichtigen Schritt für die tiefe Einbindung des Flux-Ökosystems von Black Forest Labs in ComfyUI. Das Datum liegt zurück, bleibt aber ein wesentlicher Meilenstein für offene Bildbearbeitungsmodelle. -
Wan2.1 mit ComfyUI-Unterstützung veröffentlicht (Open-Source-Videogenerierung) — @comfyuiorg.bsky.social, 26.02.2025
https://bsky.app/profile/comfyuiorg.bsky.social/post/3lj42stgelb2l
Vier Modelle zugleich: Text-zu-Video mit 14B/1.3B und Bild-zu-Video mit 14B. Das Datum liegt zurück, der Beitrag bleibt aber ein wichtiger Meilenstein chinesischer offener Videomodelle. -
Stability AI bietet Bildbearbeitungs-APIs über Amazon Bedrock an (Closed/API) — @stabilityai.bsky.social, 18.09.2025
https://bsky.app/profile/stabilityai.bsky.social/post/3lz5eotkuvk2i
Unternehmensorientierte Bildbearbeitung, beispielsweise die Umwandlung einer Skizze in ein fotorealistisches Produktfoto, wird als API angeboten. -
Midjourney verdoppelt die Zahl der Stile im „Style Explorer“ (Closed Source) — @midjourneyofficial.bsky.social, 18.09.2025, 👍10 🔁2
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lz5cskktzk2c
Eine der wenigen direkten Ankündigungen eines Funktionsupdates vom offiziellen Account.
Signale
- Bluesky ist für aktuelle KI-News zur Bild- und Videogenerierung nur dünn besetzt. Offizielle Markenaccounts wie Midjourney, Runway, Kling AI, Black Forest Labs, ComfyUI und Stability AI existieren zwar, posten aber selten oder sind seit Ende 2025 größtenteils inaktiv. Anders als X oder Reddit ist Bluesky offenbar kein zentraler Ort für diese Kommunikation.
- Der einzige Account mit kontinuierlichen aktuellen Meldungen war @testingcatalog.com. Allein im September 2026 postete er täglich ein bis drei Meldungen zu OpenAI, Meta, Google, Anthropic und anderen. Direkt relevante Bild-/Video-Themen waren aber nur ein Teil davon: ChatGPT Images 2.5, Meta Muse Video, Visko Orbis, ElevenLabs’ Erweiterung und Tencent Hy4. Insgesamt dominierten Agenten- und LLM-News.
- Open-Source-Entwicklungen waren über automatische Trendbots wie „Daily HuggingFace Trends“ besser auffindbar als über News-Accounts. LTX-2.5 tauchte am 11., 13. und 15. September wiederholt auf, was auf anhaltendes Interesse als offenes Videomodell hindeutet.
- Es fanden sich viele persönliche KI-Kunstposts aus Stable Diffusion, ComfyUI oder Midjourney, doch sie waren Werkspräsentationen und keine belastbaren Primärquellen für Nachrichten; daher wurden sie nicht in die Posts aufgenommen.
Grenzen
- Blueskys offizielle Postsuch-API (
app.bsky.feed.searchPosts) lieferte unabhängig vom Suchbegriff immerHTTP 403 Forbiddenund war aus dieser Umgebung nicht nutzbar.getProfile,getAuthorFeed,getPostThreadundactor.searchActorsfunktionierten. Daher wurde alternativ überactor.searchActorsnach Accounts gesucht, deren Feeds übergetAuthorFeedgeprüft und relevante Posts übergetPostThreadeinzeln bestätigt. Allgemeine Keyword- oder Hashtag-Suche war nicht möglich. - Die Websuche von
bsky.appunterhttps://bsky.app/search?q=...ist eine clientseitig gerenderte SPA; Posttexte lagen nicht im HTML und konnten nicht direkt gelesen werden. - Websuchmaschinen lieferten bei
site:bsky.appüberwiegend alte, meist aus 2024 oder der ersten Hälfte 2025 stammende Beiträge. Aktuelle Posts von September 2026 waren kaum indexiert. - Deshalb konzentriert sich die Sammlung auf einzelne Accounts, vor allem @testingcatalog.com, @huggingfacetrends.bsky.social und offizielle Markenaccounts. Umfang und Stimmung der gesamten Plattform lassen sich damit nicht messen.
Lemmy
Lemmy — Themen rund um KI für Bild- und Videogenerierung (Recherche vom 17.09.2026)
Communities
- !«メールアドレス» — 5.71K Abonnenten, 1.41K Beiträge, 1.93K Kommentare. Moderiert von db0 und Even_Adder. Schwerpunkt sind Ankündigungen zu Open-Weight-Tools, LoRAs und benutzerdefinierten ComfyUI-Nodes; fast täglich erscheinen neue Beiträge. Die aktivste Community.
- !«メールアドレス» — 2.36K Abonnenten, davon 362 lokal. Eine Galerie für Werke aus Stable Diffusion und Open-Weight-Modellen. Ein Nutzer, Even_Adder, postet dort fast stündlich bis alle paar Stunden.
- !«メールアドレス» — 51 Abonnenten, insgesamt 25.2K Beiträge. Ein RSS-Spiegel von KI-Subreddits auf Reddit. Wenige Abonnenten, aber nützlich für Vergleiche generativer KI, die auf anderen Instanzen nicht auftauchen.
- !«メールアドレス» — Enthält Werke rund um Nano Banana, aber Anubis-Bot-Schutz verhinderte den Abruf der Übersicht.
- !«メールアドレス» — Laut Suchergebnissen eine sehr kleine Community mit 222 Abonnenten und 11 Beiträgen; der direkte Zugriff schlug mit Fehler 500 fehl.
- !«メールアドレス» (auch sneerclub) — Community für Spott und Kritik an der KI-Industrie allgemein. Gelegentlich erscheinen auch skeptische Beiträge zu Bild-KI-Unternehmen.
Posts
-
„Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?“ — !«メールアドレス», 14.09.2026, Score 1
https://lemmy.durstig.online/post/60037
Vergleich von vier KI-Kolorierungen eines Berserk-Panels. ChatGPT Images 2.5 bewahrt Linien und Komposition am besten. Wan 2.7 Pro liefert gutes Licht, übermalt aber Teile. Nano Banana Pro ignoriert die Anweisung, nichts zu verändern, und ergänzt Elemente. Seedream 5.0 Pro hält die Komposition, ist aber zu stark gesättigt. Die Gesamtkosten des Tests werden mit 0,30 US-Dollar angegeben. -
„Taking a traditional filmmaking approach while making the Robo Dad animation“ — !«メールアドレス», 22.08.2026, Score 0
https://lemmy.durstig.online/post/55214
Beispiel für einen hybriden Workflow: handgemachte Puppenaufnahme → Charakter-Design mit Nano Banana → Videoerzeugung mit Seeddance 2.0. -
„Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images“ — !«メールアドレス», 07.08.2026, Score 1
https://lemmy.durstig.online/post/52162
Eine Google-Earth-Funktion mit Nano Banana 2 wurde einen Tag nach dem Rollout zurückgezogen, weil Nutzer Bilder von angeblichen Katastrophen oder Militäranlagen an realen Orten in großer Zahl erzeugten. -
„It's like an album cover...“ — !«メールアドレス», 07.08.2026, Score -8
https://lemmy.ca/post/69025640
Tropisch wirkendes Albumcover-artiges Bild, erstellt mit Nano Banana (Gemini 2.5 Flash). Der negative Score zeigt auch eine kühle Reaktion auf KI-generierte Bilder. -
„Midjourney wants Hollywood studios to reveal AI usage“ — !«メールアドレス», 05.07.2026, Score 12
https://lemmy.today/post/56011946
Nachricht darüber, dass Midjourney Hollywood-Studios zur Offenlegung ihrer KI-Nutzung auffordert. -
„Midjourney AI pivots to Theranos: Ultrasonic CT“ — !«メールアドレス» (Autor David Gerard), Mitte Juni 2026, Score 41
https://awful.systems/post/8731127
Ein spöttischer Beitrag zu Midjourneys Einstieg in Medizintechnik für ultraschallähnliche Ganzkörperscans unter Wasser, verglichen mit Theranos. Zahlreiche Kommentare fragen skeptisch, warum ein Bildgenerierungs- und Urheberrechtsstreit-Unternehmen Medizintechnik betreibt. -
Neue Open-Source-Tools (!«メールアドレス», Autor Even_Adder, 14.–17.09.2026)
- ComfyUI-Fantastic-MiniMaxH3-PromptBuilder https://lemmy.dbzer0.com/post/75586072 (vor 7 Stunden, Score 3)
- wan2gp-h3-latent-continue https://lemmy.dbzer0.com/post/75586070 (fügt Wan2GP eine Funktion für fortgesetzte Videogenerierung hinzu)
- ComfyUI_MinimaxH3_AutoContext https://lemmy.dbzer0.com/post/75586069
- TaoMate-H3-3Step-ComfyUI (3-Schritt-Destillations-LoRA) https://lemmy.dbzer0.com/post/75427443
- ComfyUI-VDN-H3-24GB (speichersparende Implementierung für 24 GB VRAM) https://lemmy.dbzer0.com/post/75382764
- MiniMax-H3-Image-Training-Adapter https://lemmy.dbzer0.com/post/75382765
- Krea2-Turbo-Distill-2step-LoRA https://lemmy.dbzer0.com/post/75427441
Auffällig ist, wie sich innerhalb weniger Tage rund um das Open-Weight-Modell „MiniMax H3“ zahlreiche ComfyUI-Tools, LoRAs und speichersparende Implementierungen konzentriert entwickelt haben.
-
„Dark Wings Silhouette“ — !«メールアドレス», 17.09.2026, Score 2
https://lemmy.dbzer0.com/post/75601450
Ein Werk aus Krea2 und Qwen Image. In den Kommentaren geht es darum, wie sich Qwen-3.5/3.8-Modelle und GLM 5.2 lokal einsetzen lassen, sowie um Hardware: Selbst B300-Cluster mit 2.1 TB HBM seien für Frontier-Modelle nicht ausreichend.
Signale
- Closed-Source-Themen werden häufiger als Pannen-, Kontroversen- oder Spottgeschichten als über neue Modellankündigungen diskutiert, etwa Nano Bananas Google-Earth-Vorfall oder die Theranos-Vergleiche zu Midjourney. Viele Themen tauchen nur in r-/Reddit-Spiegelcommunities wie !ai_reddit und !imageai auf; in originären Lemmy-Communities sind sie schwach vertreten.
- Bei Open Source ist !«メールアドレス» de facto die zentrale Anlaufstelle. Rund um ein einzelnes Modell, MiniMax H3, wurde das ComfyUI-Ökosystem aus Nodes, LoRAs und Speichervarianten innerhalb weniger Tage ausgebaut – ein typisches Muster der Open-Source-Entwicklung.
- Die Communities sind insgesamt klein, mit einigen Dutzend bis einigen Tausend Abonnenten; gegenüber Reddit oder X ist das Volumen gering.
- Die Suche ist anfällig für Rauschen. Ein Beitrag mit „#BringSoraHome“ wurde zunächst beinahe als Thema rund um OpenAIs Sora-Abschaltung missverstanden; tatsächlich ging es um ein Kind namens Sora und einen irischen Sorgerechtsfall. Nach Prüfung des Texts wurde der Beitrag nicht aufgenommen.
Grenzen
- Das Ziel, etwa 20 Beiträge zu analysieren, wurde auf Lemmy nicht erreicht. Selbst mit API-Suche und Community-Durchsicht fanden sich nur etwas mehr als zehn direkt relevante Posts. Aufgrund der Größe der Plattform wurde nicht künstlich aufgefüllt.
lemmy.world/c/stablediffusionundlemmy.world/c/«メールアドレス»lieferten beim direkten Zugriff Fehler 500.- !«メールアドレス» war durch Anubis-Bot-Schutz blockiert und konnte nicht als Übersicht abgerufen werden.
- Suchen nach „Grok Imagine“, „Veo 3“ und „Kling AI“ ergaben keine relevanten Beiträge; zu diesen einzelnen Closed-Source-Videoangeboten scheint es auf Lemmy kaum Diskussionen zu geben.
- Die API-Suche liefert viele irrelevante politische und technische Treffer. Es wurden nur Beiträge aufgenommen, deren Inhalt einzeln geöffnet und geprüft wurde.
Pinterest — KI-News zur Bild- und Videogenerierung
Visuelle Themen
- Verchromter oder weißer humanoider Android als visuelle Kurzform für „KI“: Ein glänzender Roboterkopf oder -torso mit blau leuchtenden Augen bzw. Schaltkreisen, oft an einem Nachrichtentisch oder mit Mikrofon, steht in Dutzenden ansonsten nicht zusammenhängenden Pins für „KI“ [5, 7, 10, 12, 20, 26, 30, 33, 47]. Das ist das mit Abstand häufigste Motiv.
- Die Rahmung „Stirbt Journalismus durch KI?“: Nachrichtenszenen, in denen Roboter menschliche Moderatoren oder Reporter ersetzen bzw. neben ihnen sitzen; oft ist eine besorgte Person zu sehen. Dazu Schlagzeilen wie „AI Is Writing the News — Can We Still Trust Journalism?“ [2, 7, 12, 17, 19, 26, 33].
- Grafiken zu Deepfake- und Desinformationsängsten: Gesichter mit Mesh-Overlays, biometrische Scan-HUDs und deutliche „FAKE“-Stempel auf KI-generierten Inhalten wie Katzenbildern oder vermummten Figuren [9, 14, 16, 18, 44, 47].
- Blau-/Cyan-Farben und Schaltkreisoptik dominieren: Ob Roboter, Hände mit leuchtenden KI-Chips oder holografische Büro-Dashboards – der Standardlook ist tiefes Blau/Cyan mit weißen Akzenten [6, 16, 20, 21, 30, 44].
- Werbung für gesichtslose Inhalte und UGC-Commerce: Fiverr-artige Anzeigen und Tools mit Botschaften wie „Go Viral Without Showing Your Face“, die KI-Avatare, Face-Swaps und Produktdemo-Videos an Vermarkter und Creators verkaufen [4, 9, 11, 18].
- Listicles und Übersichtsinfografiken zur Tool-Entdeckung: „Top 5 Free AI Tools for Photo Generation“, „Top AI News of July 2026“, große Logowände mit ChatGPT, Gemini, Claude, Microsoft, Google, Apple, Samsung, Meta und Nvidia – alles große geschlossene Marken [30, 36, 42].
- Tatsächlich sichtbare geschlossene Produkte: Adobe Firefly in einer Branding-Collage [42], Microsofts technische Grafik zu VASA-1 für audio-getriebene Gesichtsanimation [14], ShengShu Technologys Echtzeit-Videomodell Vidu S1, zweimal mit nahezu identischem Cyberpunk-Key-Art [29, 38], sowie die Kontroverse um die KI-Schauspielerin Tilly Norwood als TV-Screenshot [1].
- Niedliche KI-generierte Tierdarstellungen als sanfter Marketing-Köder: Ein Otter mit Schwimmweste auf einem Paddleboard oder ein Welpe zwischen Blumen dienen als Demo-Ergebnisse für Bild- und Videogeneratoren, nicht als KI-News im engeren Sinn [13, 36].
Auffällige Pins
- #1 — „Hollywood Reporter Interviews the First AI Actress...“: TV-Screenshot mit deutlichem „AI-GENERATED IMAGE“-Hinweis über einem Tilly-Norwood-/Instagram-Bild – die klarste reale Closed-Source-Kontroverse im Datensatz.
- #7 — unbetitelter Roboter im Newsroom: Ein Android am Moderationstisch, umgeben von schwebenden „NEWS“-Panels, während ein menschlicher Reporter erschrocken schaut – die konzentrierteste Visualisierung der Sorge, KI übernehme den Nachrichtentisch.
- #47 — „AI content and social media concerns“: Ein Roboter hält ein Smartphone; daneben ein „FAKE“-Stempel über einem KI-Katzenbild und einer vermummten Figur – die direkteste Darstellung des gemeinsamen Vertrauensproblems bei offener und geschlossener KI.
- #14 — VASA-1-Diagramm: Einzelbild + Audioclip + Steuersignale → Raster aus Live-Gesichtsanimationen. Eine echte technische Abbildung statt Stockart, zu Microsofts Forschung für audio-gesteuerte sprechende Gesichter.
- #29 / #38 — Vidu S1 (ShengShu Technology): „The World's Most Advanced Model for Real-Time AI Interaction“, mehrfaches Cyberpunk-Key-Art – ein tatsächlich benannter Launch eines Closed-Source-Videomodells aus China.
- #42 — Adobe-Branding-Collage: Rotes Adobe-/Firefly-Wortzeichen über generierten Porträts und Naturbildern – ein Closed-Source-Anbieter positioniert sich deutlich im Markt.
- #36 — „Top 5 Free AI Tools for Photo Generation“: Rangliste aus Midjourney, Bing Image Creator, Canva AI, Leonardo AI und Playground AI mit Beispielergebnissen – das Nächste, was im Datensatz an einer Gratis-/Tool-Übersicht liegt.
- #13 — KI-generierter Otter auf einem Paddleboard: Als „3D digital render“ beschriftet und als Demo-Material für ein Videogenerator-Tool eingesetzt – zeigt, dass „KI-Video-News“ auf Pinterest oft eher Produktdemo als Journalismus bedeutet.
- #18 — „Go Viral Without Showing Your Face“: Vermummter Creator an einem Face-Clone-Bearbeitungsplatz mit zwei Monitoren – KI-Avatar- und Gesichtstechnologie wird als Wachstumstool vermarktet.
- **#9 — Face-Swap-Werbung („Videos Pro“) **: Zwei Frauengesichter verschmelzen über ein Tracking-Mesh; „hyperrealistische Gesichtsretusche“ wird direkt an Verbraucher verkauft.
Signale
- Was aktuell wirkt: Auf Pinterest lautet die dominierende Erzählung nicht „Welches Modell hat welche Funktion veröffentlicht?“, sondern Sorge und Geschäftschance rund um KI-Gesichter: Deepfakes, KI-Nachrichtenmoderatoren, Face-Swap-Apps und Tools für gesichtslose Inhalte treten gebündelt auf. Die Tilly-Norwood-Geschichte [1] und Vidus interaktives Echtzeitvideomodell S1 [29, 38] sind die zwei Pins, die am ehesten wie echte aktuelle Nachrichten wirken statt wie Stockgrafik oder Affiliate-Inhalt.
- Was weitgehend fehlt: Open-Source-spezifische News sind in diesem Pin-Datensatz praktisch unsichtbar. Kein Pin nennt Stable Diffusion, Flux, HunyuanVideo, Wan, ComfyUI oder ein GitHub-natives Projekt. Die vorhandenen KI-Tool-Pins [30, 36, 42] nennen geschlossene gehostete Produkte wie ChatGPT, Gemini, Claude, Adobe Firefly, Midjourney, Bing Image Creator, Canva und Leonardo. Pinterests Anreizstruktur aus SEO-Blog-Thumbnails, Affiliate-Listen und Marketplace-Anzeigen scheint konsumnahe geschlossene Produkte gegenüber Community-Releases zu bevorzugen.
- Echte technische Details sind rar: Abgesehen vom VASA-1-Diagramm [14] und dem Vidu-S1-Branding [29, 38] handelt es sich fast überall um allgemeine Stockfotos oder Clipart, die das Konzept von KI illustrieren statt ein konkretes Ereignis, einen Release oder eine Demo.
Grenzen
- Diese Phase basierte auf bereits von einem Worker per Headless-Browser gesammelten Pins (
output/pinterest.pins.md, 50 Pins aus einer einzelnen unbenannten Suche bzw. Kategorie). Pinterest wurde nicht selbst durchsucht; das Ergebnis spiegelt einen Suchdurchlauf und keinen umfassenden Crawl wider. - 30 der 50 gesammelten Bilder wurden direkt geöffnet und visuell geprüft. Die übrigen 20 wurden nicht einzeln geöffnet, ihre Titel wurden jedoch gesichtet und passen zu den genannten Themen.
- Keine Zielseiten der Pins wurden abgerufen. Verfügbar waren nur Pin-Bild und gespeicherter Titel; zusätzlicher Kontext wie vollständiger Artikeltext, Kommentardiskussion oder Speicher-/Repin-Zahlen konnte nicht verifiziert werden.
- Open-Source-News zur Bild-/Videogenerierung sind auf dieser Plattform für dieses Briefing nahezu eine Sackgasse: Der Datensatz enthält schlicht keine benannten Open-Source-Projekte. Die Hälfte des Berichts zu Open-Source-Trends muss daher vor allem auf Reddit, X, YouTube, Bluesky und Lemmy beruhen, nicht auf Pinterest.
Empfohlene Maßnahmen
- X (ehemals Twitter) nicht über Trends, sondern erneut über direkt thematische Begriffe wie „Sora 2“, „Nano Banana Pro“, „Wan“ und „Flux“ durchsuchen.
- Die mögliche Schließung von Wan 3.0 mit Primärinformationen aus Alibabas offiziellen Ankündigungen absichern und die Auswirkungen auf die Open-Source-Videolandschaft verfolgen.
- Entwicklungen rund um MiniMax H3 über !«メールアドレス» kontinuierlich beobachten, da dort die Informationen am frischesten sind.
- Da der Vergleich GPT Image 2.5 gegen Nano Banana Pro auf mehreren Plattformen übereinstimmt, beim nächsten Mal auch dritte Akteure wie Seedream 5.0 Pro einbeziehen.
- Überreaktionen von Sicherheitsfiltern und Fehlgenerierungen bei Google-Modellen wurden wiederholt gemeldet und sollten als Zuverlässigkeitsnachrichten weiter beobachtet werden.
Gesammelte Bilder


















































Hinweise zur Datenqualität
Bei X lag die Sammelmethode neben dem Thema, weshalb es keine themenrelevanten Beiträge gab und die Plattform faktisch nicht funktionierte. Reddit und Lemmy erreichten das Ziel von etwa 20 Beiträgen nicht. Auf YouTube konnten Aufrufzahlen und Kanalnamen nicht verifiziert werden; Bluesky erforderte wegen der nicht verfügbaren Such-API alternative Recherchewege.



