Actualités de l’IA de génération d’images et de vidéos — 2026-09-10
Alibaba livre Wan 3.0 comme une API payante à poids non publiés, tandis qu’OpenAI mettra fin à l’API Sora 2 le 24 septembre : l’IA de génération vidéo se réorganise sous l’impulsion des acteurs chinois, alors que la frontière entre ouvert et fermé devient instable.
Actualités de l’IA de génération d’images et de vidéos — 2026-09-10
Du côté des modèles fermés, OpenAI a annoncé l’arrêt de l’API Sora 2 le 24 septembre 2026, tandis que les annonces de nouveaux modèles se succèdent, notamment la famille Nano Banana de Google (Gemini 2.5 Flash Image, concurrente de ChatGPT Images 2.5), « Muse » de Meta et « Grok Imagine » de xAI, rendant le paysage très mouvant. Du côté open source, la principale découverte est que la frontière même entre ouvert et fermé vacille : malgré sa réputation de porte-étendard des poids ouverts acquise avec Wan 2.2 et Qwen-Image, Alibaba livre son dernier modèle Wan 3.0 sous forme d’API fermée, payante et sans poids publiés. Dans la génération vidéo, les modèles chinois (Seedance 2.0 de ByteDance, Wan d’Alibaba et MiniMax-H3) gagnent en visibilité aussi bien dans les vidéos comparatives que dans l’écosystème ComfyUI ; parallèlement, les craintes concernant l’authenticité des contenus générés par IA et les défaillances de modération grandissent sur plusieurs plateformes. Six plateformes ont été étudiées — Reddit, X, YouTube, Bluesky, Lemmy et Pinterest — et, à l’exception de X, des publications pertinentes ont pu être recueillies sous une forme ou une autre.
Sur l’ensemble des plateformes
- La frontière entre open source et fermé vacille : sur YouTube, Alibaba est explicitement critiquée pour avoir livré Wan 3.0 comme une API payante sans publier les poids, contrairement à son image de « porte-étendard de l’open source ». Sur Lemmy, au même moment, les discussions open source se concentrent sur l’écosystème ComfyUYI autour de MiniMax-H3, tandis que les discussions sur les modèles fermés se limitent surtout aux polémiques et procès (abus de Nano Banana Earth AI, procès Midjourney). La séparation entre les deux camps ne peut donc plus être expliquée simplement par l’opposition « entreprise contre individu ».
- Les modèles de la famille « Nano Banana » de Google sont au centre des discussions sur plusieurs plateformes : des mentions explicites apparaissent indépendamment sur Bluesky (dfl.bsky.social publie quotidiennement des paysages créés avec Nano Banana 2), Lemmy (la fonction de composition Google Earth de Nano Banana a été retirée un jour après son lancement à la suite d’abus) et YouTube (GPT Image 2 est présenté comme un « Nano Banana Pro Killer », et Midjourney V8 est comparé à Nano Banana 2).
- La méfiance envers les contenus générés par IA et le besoin de vérification s’étendent : Reddit (fils recherchant des indices visuels précis pour distinguer l’IA, et forte réaction contre les méthodes faisant passer du travail réalisé par LLM pour du dessin à la main), Pinterest (infographies de vérification avec tampon « FAKE » ou badge « 97% likely AI generated ») et Lemmy (emploi fréquent de l’insulte « AI slop » et visibilité de communautés anti-IA) expriment la même inquiétude sous des angles différents.
- Les modèles chinois tirent la génération vidéo : dans les comparatifs YouTube, Seedance 2.0 de ByteDance est régulièrement mis en scène comme écrasant Kling, Sora et Veo. Sur Lemmy, plus de dix publications autour de nœuds ComfyUI, LoRA et outils d’accélération VAE pour MiniMax-H3 lié à Alibaba ont été publiées durant la seule semaine du 2 au 8 septembre 2026 ; l’élan chinois est visible dans les univers fermé comme ouvert.
- Les contenus de comparaison et de classement sont devenus un format natif sur chaque plateforme : les vidéos YouTube de type « X vs Nano Banana/Sora/Kling », les infographies Pinterest présentant dix outils gratuits de génération vidéo et les fils Reddit classant les générateurs d’images non censurés expriment tous le même intérêt pratique : savoir quel outil utiliser.
Plateforme par plateforme
Reddit : analyse de 12 fils déjà collectés par un worker, provenant de 10 subreddits. La demande pour des générateurs d’images non censurés et sans limites (WildOwl, Mage.space, PixelForge) est mise en contraste avec le durcissement des restrictions sur les personnages protégés par propriété intellectuelle dans Grok, ChatGPT et Gemini. Parallèlement, le problème de l’hébergement par Meta de vidéos d’abus d’enfants générées par IA (772 points, r/TrueReddit) ressort comme une inquiétude majeure face aux échecs de modération, avec une réaction notable (1 024 commentaires). La durée des vidéos générées, limitée à 5–15 secondes, constitue un constat partagé dans plusieurs fils.
X : parmi les 40 publications collectées auprès de 37 comptes, seulement deux abordaient réellement le thème (@DotCSV, brève réaction à une mise à jour de modèle d’image, et @QingQ77, présentation d’un dépôt de génération IA × 3D). Les requêtes de recherche reposaient sur les tendances générales du jour autour de la Croatie (Apple, $LAPTOP, Hunter Biden, etc.) plutôt que sur l’IA de génération d’images ou de vidéos ; cette étape ne capture donc pas réellement l’état du sujet.
YouTube : sur 11 vidéos, confirmation de l’arrêt de l’API OpenAI Sora le 24 septembre 2026 — la principale information sur les modèles fermés —, des évolutions de nouveaux modèles comme GPT Image 2 et Midjourney V8, ainsi que du passage « ouvert → fermé » de Wan 3.0 d’Alibaba. Les tutoriels consacrés à ComfyUI et à l’exécution locale (DevsKingdom, GeekatPlay) constituent le principal format de diffusion côté open source. Les pages étant rendues en JavaScript, les nombres de vues et d’abonnés n’ont pas pu être obtenus.
Bluesky : l’API de recherche plein texte a renvoyé une erreur 403 pour toutes les requêtes, imposant une enquête indirecte à partir des comptes. Les bots agrégateurs d’actualités tels que testingcatalog.com et genainews.bsky.social relaient rapidement les annonces d’OpenAI « ChatGPT Images 2.5 » et de Meta « Muse », tandis que les comptes importants du côté open source — Black Forest Labs, Stability AI, Midjourney officiel ou bot de notifications Civitai — sont presque silencieux et ne fonctionnent pas comme sources primaires.
Lemmy : la concentration autour de !«メールアドレス» est nette ; le contenu y est principalement un flux automatisé de nouveautés HuggingFace et GitHub. Au cours de la semaine écoulée, l’écosystème ComfyUI autour de MiniMax-H3 a été le principal sujet. Du côté fermé, aucune publication correspondante n’a été trouvée en recherchant Sora, Kling, Runway, Ideogram ou Veo 3 ; à la place, seules des questions polémiques ou éthiques, comme les abus de Nano Banana ou le procès Midjourney, circulaient.
Pinterest : 23 épingles sur 50 ont été examinées. La plupart sont des contenus secondaires reprenant des miniatures YouTube ou des infographies de blogs récapitulatifs, et aucun indicateur d’engagement tel que les mentions J’aime ou enregistrements n’était disponible. Les visuels d’annonces de grandes entreprises, notamment Google Veo 2 et Microsoft VASA-1, ressortent, alors que les acteurs open source (Stable Diffusion, Flux, Qwen, Wan, etc.) ne sont présents qu’à travers un unique schéma technique et une entrée de classement d’outils, soit une présence extrêmement faible.
À surveiller
- L’arrêt de l’API OpenAI Sora 2 le 24 septembre 2026 et l’éventuelle existence d’un modèle successeur — YouTube (Zoom Vantage) https://www.youtube.com/watch?v=H2jVcy5PuBI
- La livraison de Wan 3.0 d’Alibaba comme API payante sans poids publiés (virage par rapport à la stratégie open source) — YouTube (Prompt Engineer) https://www.youtube.com/watch?v=gbI8XV4Szrk
- L’expansion rapide de l’écosystème ComfyUI autour de MiniMax-H3 — Lemmy (!«メールアドレス») https://huggingface.co/OpenVDN/vdn-minimax-h3
- L’annonce de « ChatGPT Images 2.5 » d’OpenAI (fonction Sketch, modèles API Flare/Sunburst) — Bluesky (testingcatalog.com) https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27
- L’hébergement par Meta de vidéos d’abus d’enfants générées par IA et les défaillances de modération — Reddit (r/TrueReddit) https://www.reddit.com/r/TrueReddit/comments/1wbnann/
- Le retrait immédiat de la fonction d’images compositées dans Google Earth, à la suite d’abus de fonctionnalités Nano Banana de Google — Lemmy (reprise via !ai_reddit) https://lemmy.durstig.online/post/52162
Recommandations
- Suivre l’évolution de l’utilisation de Veo 3.1, Kling 3.0, Seedance 2.0 et de la famille Wan comme alternatives après l’arrêt de l’API Sora le 24 septembre.
- Continuer de surveiller le risque de changement de stratégie chez d’autres laboratoires de poids ouverts, en prenant le basculement « ouvert → fermé » de Wan 3.0 comme précédent.
- Observer régulièrement les outils ComfyUI autour de MiniMax-H3 sur Lemmy et HuggingFace afin d’identifier tôt les signes du prochain modèle vidéo open source majeur.
- Remplacer sur X les mots-clés de recherche dépendants des tendances régionales par des termes propres à l’IA de génération d’images et de vidéos (Stable Diffusion, Sora, Nano Banana, etc.) et refaire l’étude.
- Suivre l’état de la modération des contenus préjudiciables générés par IA sur des plateformes telles que Meta comme indicateur avancé des risques réglementaires et de réputation.
- Continuer d’observer l’extension des fonctionnalités grand public fermées de Nano Banana et Gemini Image comme indicateur des réponses concurrentielles des autres entreprises.
Qualité des données
- X : 40 publications ont été collectées, mais seulement 2 (5 %) étaient liées au thème. Les requêtes dépendaient des tendances régionales du jour (Apple, $LAPTOP, Hunter Biden, etc.) et n’utilisaient aucun terme propre à l’IA de génération d’images ou de vidéos ; les résultats exploitables pour cette plateforme sont donc pratiquement inexistants.
- Bluesky : l’API officielle de recherche plein texte (
app.bsky.feed.searchPosts) renvoyait une erreur 403 pour toutes les requêtes et était inutilisable ; l’enquête a été remplacée par une recherche indirecte par comptes. Seules une dizaine de publications directement pertinentes ont été trouvées, loin du seuil de 20 fixé pour l’achèvement. - Reddit : analyse de 12 fils déjà collectés par un worker, pour une seule requête de recherche. Le seuil d’environ 20 éléments n’est pas atteint, et les sujets propres aux modèles open source restent particulièrement peu présents.
- Lemmy : le volume de publications sur ce thème est faible, et la plupart des scores ne dépassent pas quelques unités ou dizaines. Aucune publication correspondante n’a été trouvée pour les principaux services fermés tels que Sora, Kling, Runway, Ideogram ou Veo 3.
- YouTube : en raison du rendu JavaScript des pages, WebFetch n’a pas pu récupérer la grille de vidéos, les vues ou les commentaires ; seuls les titres et noms de chaînes ont été confirmés via oEmbed. Les vues et abonnés sont donc omis comme indisponibles.
- Pinterest : les indicateurs d’engagement, tels que les mentions J’aime et enregistrements, n’étaient pas associés aux épingles ; aucune comparaison quantitative de la performance des publications n’a donc été possible. En outre, la majorité des éléments collectés étaient des reprises de miniatures YouTube ou d’articles de blog, ce qui limite leur valeur en tant que sources primaires.
Résumé par plateforme
Reddit — Actualités de l’IA de génération d’images et de vidéos
Où
- r/AItips101 (1 210 abonnés) — 1 élément
- r/antiai (320 447 abonnés) — 1 élément
- r/aivideomaking (6 681 abonnés) — 1 élément
- r/aiwars (167 556 abonnés) — 2 éléments
- r/generativeAI (151 900 abonnés) — 2 éléments
- r/freetoolsAI (7 991 abonnés) — 1 élément
- r/isthisAI (407 630 abonnés) — 1 élément
- r/RemoteWorkers (76 520 abonnés) — 1 élément
- r/ChatGPT (11 626 217 abonnés) — 1 élément
- r/TrueReddit (628 511 abonnés) — 1 élément
Total : 12 fils, avec une seule requête de recherche : « Image and Video Generation AI News ».
Ce que disent les gens
-
Fil 1 « The best uncensored AI image generators in 2026 » (r/AItips101, 110 points, 45 commentaires, 2026-09-07) https://www.reddit.com/r/AItips101/comments/1w9yftp/ — Publication classant les générateurs d’images IA « non censurés ». WildOwl.ai arrive en première position, avec accès à plus de 35 modèles tels que Qwen, Flux, Seedream, Wan, Kling, Seedance, Veo et GPT Image ; l’absence d’abonnement et les crédits sans expiration constituent ses arguments de vente. Dans les commentaires, u/reliablemicrophone84 salue WildOwl comme une solution au dilemme « derniers modèles ou liberté », tandis que u/Clear-Assistance449 préfère Mage.space, qui permet selon lui une génération illimitée dans son abonnement. Le secteur des outils d’images non censurés paraît donc très fragmenté.
-
Fil 2 « Warning: There is a new form of ai generated image » (r/antiai, 7 130 points, 1 024 commentaires, 2026-09-05) https://www.reddit.com/r/antiai/comments/1w81kdd/ — Avertissement sur une méthode donnant à un LLM (GPT-6) le contrôle de la souris et du clavier afin de le faire « dessiner » directement sur une tablette graphique. Comme elle peut même produire un faux timelapse crédible, il deviendrait pratiquement impossible de distinguer une véritable création artistique. Avec 1 024 commentaires, c’est de loin le fil ayant suscité le plus de réactions parmi les douze. Le commentaire principal d’u/Nayutantantan (2 510 points) exprime un fort rejet : « même les preuves n’ont plus de sens ; pourquoi vouloir à ce point se faire passer pour un véritable artiste ? ».
-
Fil 11 « Facebook Is Hosting Huge Numbers of Horrifying AI-Generated Videos of Violent Child Abuse... » (r/TrueReddit, 772 points, 40 commentaires, 2026-09-09) https://www.reddit.com/r/TrueReddit/comments/1wbnann/ — Partage d’un article dénonçant l’abondance de vidéos d’abus d’enfants générées par IA laissées en ligne sur Meta (Facebook). u/mirh cite la réponse des relations presse de Meta : « des règles strictes s’appliquent aux contenus montrant des dommages physiques, qu’ils soient réels ou générés par IA », et précise que les vidéos auraient été supprimées. Toutefois, le commentaire note que des systèmes de détection existent mais ne seraient pas employés. u/NinjaLion avertit que Meta, X, puis peut-être Reddit, semblent évoluer vers un abandon de la modération consistant à « vendre des épées sans vendre d’armures ».
-
Fil 9 « Get Paid $30/Hour Reviewing AI-Generated Images » (r/RemoteWorkers, 175 points, 828 commentaires, 2026-09-04) https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/ — Offre d’emploi à distance pour vérifier des légendes générées par IA, rémunérée 30 $ de l’heure. Bien que la publication ait reçu 828 commentaires, la plupart sont de simples répétitions standardisées de « Images » destinées à obtenir le lien de candidature ; la discussion réelle est presque inexistante. C’est néanmoins un exemple de l’émergence rapide sur Reddit d’une nouvelle catégorie de travail : la vérification et l’évaluation de contenus IA.
-
Fil 4 « This Is a render made in Blender (not an AI generated video) by GPT 6 - Astra » (r/aiwars, 18 points, 14 commentaires, 2026-09-06) https://www.reddit.com/r/aiwars/comments/1w96yaf/ — Reprise d’une vidéo devenue populaire sur X montrant GPT-6 « Astra » manipuler Blender pour créer un rendu. u/not_food (6 points) explique qu’il ne peut pas attendre une exécution locale : tant que demeurent les risques de changement de prix ou de politique, voire de fermeture de serveurs, il ne peut pas l’utiliser dans son travail. u/ComfortPhil (1 point) s’étonne : « fabriqué par GPT-6 mais pas généré par IA ? Je ne comprends pas », ce qui illustre l’ambiguïté des définitions.
-
Fil 10 « Updated image generator. Trying to get back to "weird AI art" » (r/ChatGPT, 32 points, 26 commentaires, 2026-09-09) https://www.reddit.com/r/ChatGPT/comments/1wbdbdj/ — Publication essayant de retrouver avec la génération d’images actuelle de ChatGPT l’étrangeté des débuts de Disco Diffusion et Stable Diffusion. u/Cubic_Inequality504 (9 points) observe : « vous ne le voyez pas ? Ces textures étranges et picturales sont toujours là ; en 2.5, c’est exactement la même chose que dans Image 2 ». La publication montre une certaine déception face à une évolution devenue plus réaliste et plus jolie.
-
Fil 5 « Even a lot of Pros here will admit that current AI models suck at generating appetizing images of food » (r/aiwars, 4 points, 177 commentaires, 2026-09-03) https://www.reddit.com/r/aiwars/comments/1w69cdj/ — Critique selon laquelle les images alimentaires générées par IA ne donnent pas envie de manger. u/LCI_Jake (14 points) les juge volontairement grotesques, comparables à des nids d’insectes. À l’inverse, u/Bassed_Hummble (5 points) affirme qu’un bon prompt permet déjà d’atteindre cette qualité en 40 secondes avec Krea 2 gratuit, et que le problème relève des entreprises et de leur utilisation, davantage que du modèle. Les avis divergent.
-
Fil 6 « Non Restrictive AI Image Generator » (r/generativeAI, 2 points, 3 commentaires, 2026-09-08) https://www.reddit.com/r/generativeAI/comments/1waapc1/ — Demande d’un utilisateur souhaitant créer pour son usage personnel du fan art de personnages Disney, mais bloqué par Grok. C’est un exemple concret du durcissement des restrictions de génération de personnages sous propriété intellectuelle chez les grands acteurs fermés (Grok, ChatGPT, Gemini). u/frighten (1 point) propose PixelForge comme outil potentiellement sans restriction.
-
Fil 7 « Free AI Image Generator » (r/freetoolsAI, 40 points, 51 commentaires, 2026-09-04) https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/ — Publication promotionnelle pour un générateur d’images gratuit sans inscription, sans limite et sans filigrane (aifreeforever.com). u/Puzzleheaded_Lab4757 (1 point) affirme que le site lui a fait économiser des centaines de dollars et de nombreuses heures, tandis qu’u/Relevant_Syllabub895 (2 points) déplore l’interdiction du NSFW par les services.
-
Fil 8 « Is This Video AI-Generated or Real? Looking for Opinions From People Who Can Spot AI » (r/isthisAI, 0 point, 31 commentaires, 2026-09-09) https://www.reddit.com/r/isthisAI/comments/1wbspxo/ — Publication demandant de déterminer si une vidéo est réelle ou générée par IA. u/BouncingSphinx (3 points) note qu’elle dure exactement 15 secondes, ce qui semble correspondre à la limite des vidéos IA actuelles. u/smalltiddygothb (16 points) et u/EmergencyWaffleBox (14 points) citent la disparition puis la réapparition d’un collier comme artefact visuel concret permettant de repérer une génération IA.
-
Fil 3 « free video ai generator » (r/aivideomaking, 12 points, 29 commentaires, 2026-09-07) https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/ — Demande d’un outil gratuit pour créer des vidéos de 45 secondes uniquement avec un téléphone ou un iPad. u/NewLifeWares (2 points) explique que 45 secondes nécessitent du matériel de niveau centre de données et que les offres gratuites ne permettent guère plus que des vidéos de cinq secondes avec filigrane. La brièveté demeure le principal goulot d’étranglement des IA vidéo gratuites.
Signaux
- La demande d’outils « non censurés / sans limites » du côté fermé (WildOwl, Mage.space, PixelForge, etc.) et le durcissement des restrictions de personnages sous propriété intellectuelle chez les grands services (Grok, ChatGPT, Gemini) apparaissent en parallèle dans plusieurs fils. Plus les restrictions augmentent, plus les fils présentant des outils alternatifs semblent recherchés.
- Le rejet des techniques visant à cacher ou à déguiser le caractère généré par IA progresse fortement. Le fil 2, sur la méthode de contrôle de souris permettant à un LLM de faire passer un timelapse pour un travail « réel », a généré 1 024 commentaires, de loin la plus forte réaction de la collecte. Issu de r/antiai, il fait écho au fil 8 de r/isthisAI, consacré à la recherche d’indices visuels pour identifier l’IA.
- La limite de durée des vidéos générées, autour de 5 à 15 secondes, est toujours perçue comme un mur : les fils 3 et 8 convergent sur ce point. À la demande de vidéo gratuite de 45 secondes, la réponse est unanimement « impossible », souvent avec moquerie ; il s’agit d’un constat partagé plutôt que d’un désaccord.
- Les évaluations de qualité sont divisées : le fil 10 déplore que les textures étranges n’aient pas changé malgré les progrès, tandis que le fil 5 soutient que le problème vient des prompts et non des limites du modèle. Les opinions divergent sur la responsabilité de la qualité des images IA.
- Le travail humain lié à l’IA, notamment la vérification de légendes à 30 $/heure, commence à ressortir sur les tableaux d’offres Reddit. Cela signale que l’essor de l’image et de la vidéo IA crée aussi des emplois périphériques de vérification et de supervision.
- Les inquiétudes liées aux défaillances de modération deviennent un thème transversal (fil 11). Le cas Meta est particulier, mais les commentaires anticipent que X et Reddit pourraient suivre la même voie ; l’écart entre l’expansion de l’IA générative et les capacités de modération des plateformes risque de devenir un point de tension majeur.
Limites
- Le critère d’achèvement demandait l’analyse d’environ 20 fils par plateforme, mais la collecte du worker ne contient que 12 fils provenant de 10 subreddits. Une seule requête, « Image and Video Generation AI News », a été utilisée ; aucune recherche supplémentaire n’a été menée en japonais ni avec d’autres requêtes anglaises, telles que « Stable Diffusion », « Midjourney », « Sora » ou « open source diffusion model ». Les 12 fils peuvent donc constituer un échantillon insuffisant face à l’exigence de brief.md d’au moins dix constats pour chacun des volets fermé et open source.
- Les fils centrés sur des modèles open source précis — familles Stable Diffusion, ComfyUI ou nouveaux modèles spécifiques autres que Civitai — sont presque absents de cette collecte, alors que les références à des services fermés (WildOwl, ChatGPT, Grok, GPT-6, etc.) sont plus nombreuses.
- Dans le fil 9 de r/RemoteWorkers, la plupart des 828 commentaires consistent en répétitions du mot « Images » ; il y a donc presque aucune matière pouvant être citée comme discussion réelle.
- Ce fichier a été produit exclusivement à partir de
output/reddit.threads.md/.json, déjà collectés par le worker ; aucun accès supplémentaire à Reddit (WebFetch ou recherche) n’a été réalisé, conformément au playbook.
X
X — Évolution des actualités de l’IA de génération d’images et de vidéos
Comptes
Parmi les 40 publications collectées auprès de 37 comptes, seuls deux comptes abordent réellement le thème de cette recherche, l’IA de génération d’images et de vidéos.
- @DotCSV (Carlos Santana) — YouTubeur/commentateur IA connu dans l’espace hispanophone. Une publication, 890 mentions J’aime ; c’est une réaction d’ampleur moyenne au sein de la collecte. Trouvée avec la recherche « AI OS », elle ne contient qu’une courte réaction à une mise à jour de modèle d’image.
- @QingQ77 (Geek Lite) — Petit compte avec une publication et 24 mentions J’aime. Présente un dépôt GitHub (jangtrinh/design-os-3d-blender) où des agents IA génèrent dans Blender des pièces destinées à l’impression 3D. Il ne s’agit pas de génération d’images ou de vidéos à proprement parler, mais d’un domaine voisin : génération IA × 3D/CAO.
Les 35 autres comptes abordent Apple, le memecoin $LAPTOP, le Real Madrid ou le football, Hunter Biden, des débats catholiques, Love Island USA et des commentaires d’anime (ABEMA « CHANCE & CHANGE »), avec une à trois publications chacun ; ils ne peuvent pas être comptés comme sources sur ce thème.
Publications
-
#19 @DotCSV — 890 likes, 46 reposts, 15 réponses, environ 63 000 vues, 2026-09-08
https://x.com/DotCSV/status/2097406200006537543 (trouvé par recherche « AI OS »)« Fuck, and on top of that, they roll out an update to the image model... just in case the math milestone wasn't enough for you. »
La seule publication évoquant une mise à jour de modèle d’image. Toutefois, le modèle et l’entreprise concernés ne sont pas identifiables à partir du texte ; ce n’est qu’une réaction isolée. -
#17 @QingQ77 — 24 likes, 2 reposts, 15 réponses, environ 2 300 vues, 2026-09-08
https://x.com/QingQ77/status/2097258894280347971 (trouvé par recherche « AI OS »)« Let AI agents build real parts with correct dimensions and 3D printability according to specifications in Blender 5.2, directly connecting to the printing production stage. » (avec un lien GitHub vers jangtrinh/design-os-3d-blender)
Il ne s’agit pas directement de génération d’images ou de vidéos, mais c’est un exemple digne d’être mentionné de la diffusion de la même tendance dans le domaine 3D/CAO : l’IA relie directement les contenus générés à la chaîne de production. La réaction reste toutefois limitée à une niche.
Les 38 autres publications, trouvées avec « Apple », « $LAPTOP », « Hunter Biden », « iPhone », « Real Madrid », « Harvey », « Germans », « #chance », « Catholic », ou les deux autres résultats « AI OS », ont été exclues des constats car elles n’étaient pas liées au thème de l’IA de génération d’images et de vidéos.
Signaux
- Le signal le plus clair de cette étape est que les publications collectées sont presque toutes sans rapport avec le sujet. Seulement 2 publications sur 40 sont liées à l’IA de génération d’images et de vidéos, qu’elle soit fermée ou open source, et aucune ne constitue une source primaire solide : l’une est un avis isolé, l’autre un partage de dépôt.
- La publication de @DotCSV, seule à aborder le thème, montre qu’une réaction d’un influenceur IA à une mise à jour de modèle d’image peut produire une diffusion notable, de l’ordre de 63 000 vues. Mais elle ne nomme ni modèle précis ni fonctionnalité et ne permet aucune vérification ultérieure.
- Aucun des noms propres directement liés au sujet — Stable Diffusion, Midjourney, Flux, Sora, Veo, Runway, Kling, Seedance, ComfyUI, Civitai ou Nano Banana — n’apparaissait parmi les requêtes. Cette collecte ne permet donc pas d’évaluer le volume réel ni l’intensité des conversations X à leur sujet.
Limites
- Les requêtes de recherche ne correspondent pas au thème. Conformément au playbook, le worker a utilisé directement les tendances affichées par la page Explore de X, qui indiquait « Trending in Croatia » selon la localisation du serveur de cette session : Apple, $LAPTOP, Hunter Biden, iPhone, AI OS, Real Madrid, Harvey, Germans, #chance et Catholic. Il s’agit de tendances généralistes autour de la Croatie, et non de requêtes construites pour étudier l’IA de génération d’images et de vidéos. Par conséquent, les neuf requêtes autres que « AI OS » — soit environ 30 publications — sont sans rapport avec le thème.
- Même dans la recherche « AI OS », deux résultats sur quatre étaient sans rapport : #18 concernait le biais des sondages d’opinion régionaux et #20 « ai os cat beanie ».
- Le critère d’achèvement demandait l’analyse d’environ 20 publications par réseau social, mais la collecte ne contient que deux publications pertinentes. Plutôt que de présenter de force des contenus non pertinents comme une « analyse », seuls les deux éléments qui abordaient vraiment le sujet ont été retenus.
- Ce fichier est fondé uniquement sur les données déjà collectées dans
output/x.posts.md/.posts.json. Conformément au playbook, aucun accès supplémentaire à X, par recherche ou navigation, n’a été réalisé. De nouvelles recherches avec Stable Diffusion, Midjourney, Sora, Veo ou des modèles vidéo open source auraient probablement donné des résultats différents, mais cela sortait du périmètre de cette collecte.
YouTube
YouTube — Actualités de l’IA de génération d’images et de vidéos (modèles fermés vs open source)
Chaînes
- Qwen (chaîne officielle Alibaba Qwen) — publie directement les annonces de sorties de modèles, telles que Qwen-Image-2.0.
- Youri van Hofwegen — testeur et comparateur d’outils vidéo IA, couvre des face-à-face Seedance/Kling/Veo/Wan.
- DevsKingdom — tutoriels open source de génération locale (FLUX.2, workflows ComfyUI).
- Vladimir Chopine [GeekatPlay] — axé sur ComfyUI ; réalise des comparaisons locales de plusieurs modèles texte-vers-image (Qwen, Z-Image, FLUX.2 klein, Ovis, LongCat).
- CyberJungle — chaîne de réaction et de test de sorties de modèles fermés (GPT Image 2).
- Creative AI Show — chaîne de comparaisons de modèles fermés (Midjourney contre ses concurrents).
- Codedigipt — chaîne de synthèse qui suit plusieurs sorties de modèles fermés dans une même vidéo (GPT, Grok Imagine, etc.).
- Airt — chaîne de démonstrations à haut volume de génération vidéo IA (méga-compilation Wan 3.0).
- Prompt Engineer — chaîne explicative qui vérifie les affirmations promotionnelles face à ce qui a réellement été livré (licence Wan 3.0).
- Zoom Vantage — chaîne d’actualités et d’explications IA couvrant les aspects économiques (arrêt de Sora).
Les nombres d’abonnés n’ont pas pu être récupérés — voir Limites.
Vidéos
-
Why OpenAI Shut Down Sora So Fast: What's Next? — Zoom Vantage — https://www.youtube.com/watch?v=H2jVcy5PuBI — Soutient que le coût de fonctionnement de Sora, environ 1 M$ par jour, et la baisse de l’utilisation — pic d’environ 1 million d’utilisateurs, tombé sous les 500 000, avec un rang App Store passé de la première à la 165e place — ont forcé OpenAI à fermer l’application grand public et, selon son propre avis de dépréciation, à supprimer entièrement l’API Sora 2 le 24 septembre 2026, sans modèle de remplacement annoncé. (Modèle fermé.)
-
🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — Qwen (officiel) — https://www.youtube.com/watch?v=1tM7Wd0lEeI — 10 février 2026 — La chaîne d’Alibaba annonce Qwen-Image-2.0, un modèle de 7B unifiant génération et édition à une résolution native 2K. (Open source.)
-
Flux.2 Dev: The Best Free Image Generation Model Outperforms Nano Banana — DevsKingdom — https://www.youtube.com/watch?v=NCvbMKV9e8c — 4 décembre 2025 — Affirme que FLUX.2 Dev de Black Forest Labs, gratuit et exécutable localement, surpasse le modèle fermé Nano Banana de Google en qualité. (Open source.)
-
ComfyUI Text-to-Image Models Compared (Local): Qwen 2512, Z-Image, FLUX.2 klein, Ovis, LongCat — Vladimir Chopine [GeekatPlay] — https://www.youtube.com/watch?v=IwZbOXCZZGM — 6 mars 2026 — Benchmark local côte à côte de cinq modèles texte-vers-image à poids ouverts actuels exécutables dans ComfyUI. (Open source.)
-
OpenAI JUST Dropped GPT Image 2 and It's WILD (Nano Banana Pro Killer?) — CyberJungle — https://www.youtube.com/watch?v=Tj3jFnx5IW0 — 21 avril 2026 — Réagit à la sortie de GPT Image 2 et le présente comme la réponse d’OpenAI à Nano Banana Pro de Google ; la vidéo note qu’il arrive en tête de l’Artificial Analysis Image Arena (Elo d’environ 1 370), Microsoft MAI-Image-2.6 réduisant l’écart. (Modèle fermé.)
-
MIDJOURNEY 8 — Compared to Nano Banana 2 & Midjourney V7 — Creative AI Show — https://www.youtube.com/watch?v=MgMZ6e2NBGA — 19 mars 2026 — Compare le nouveau V8 de Midjourney à son propre V7 ainsi qu’à Nano Banana 2 de Google. (Modèle fermé.)
-
Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 — Comparison — Youri van Hofwegen — https://www.youtube.com/watch?v=vw_Jk2-phsA — 11 avril 2026 — L’une des nombreuses vidéos comparatives presque identiques du printemps affirmant que Seedance 2.0 « détruit tout » ; elle s’inscrit dans une tendance visible où Seedance 2.0 de ByteDance domine les face-à-face contre Kling, Sora et Veo. (Modèle fermé.)
-
Best AI Video Generator in 2026 (Don't Choose Wrong) — Youri van Hofwegen — https://www.youtube.com/watch?v=PsJLCiWnZhM — 3 août 2026 — Comparatif plus récent, dans les 60 derniers jours, entre Seedance 2.0, Gemini « Omni Flash », Kling 3.0 et d’autres options pour les acheteurs de fin 2026. (Modèle fermé.)
-
Finally Got FR*EE GPT 5.6 Luna & Grok Imagine Image 2.0 Is INSANE & OpenAI New Cyber Model Astra — Codedigipt — https://www.youtube.com/watch?v=aqiTD2dESFU — 8 août 2026 — Synthèse récente couvrant la sortie de Grok Imagine Image 2.0 de xAI, parmi d’autres actualités de modèles fermés. (Modèle fermé.)
-
China Did It AGAIN? — 100+ Wan 3.0 AI Videos — Airt — https://www.youtube.com/watch?v=fNvv2u-1cGw — début août 2026 — Démonstration de la bêta publique de Wan 3.0 d’Alibaba, ouverte le 6 août 2026. Elle étend la durée de génération à 30 secondes, contre 15 secondes pour Wan 2.7, avec 1080p natif et audio synchronisé. (Lignée nominalement « open source », mais voir #11.)
-
FREE Wan 3.0: what actually shipped (there are no weights) and How to use it for FREE — Prompt Engineer — https://www.youtube.com/watch?v=gbI8XV4Szrk — fin août 2026 — Vidéo de vérification indiquant que, malgré la réputation open source de Wan, les publications publiques de poids d’Alibaba s’arrêtent à Wan 2.2 : Wan 3.0 n’a été livré que comme API fermée, payante et facturée à l’usage, sans poids publiés. (Virage ouvert → fermé notable.)
Signaux
- La sortie de Sora est actuellement la principale histoire de modèle fermé sur la plateforme : plusieurs vidéos présentent l’arrêt de l’API du 24 septembre 2026 comme un référendum sur l’économie unitaire de la génération vidéo, non comme un échec de capacités. Elles soulignent aussi qu’OpenAI ne propose aucun successeur et orientent les spectateurs vers Veo 3.1, Kling 3.0, Seedance 2.0 et Wan 2.7.
- Les vidéos de comparaison « X vs Nano Banana / Sora / Kling » constituent un format dominant et presque standardisé : les mêmes chaînes, notamment Youri van Hofwegen et Creative AI Show, publient des face-à-face très similaires à chaque sortie de nouveau modèle fermé, ce qui suggère une forte demande pour savoir « lequel payer ».
- La couverture open source privilégie les tutoriels ComfyUI et d’installation locale (DevsKingdom, GeekatPlay), plutôt que les réactions aux actualités. Le public de FLUX.2, Qwen-Image et Z-Image est composé de créateurs et de passionnés exécutant les modèles localement, plutôt que du grand public.
- La ligne entre open source et fermé s’estompe et s’inverse : Alibaba, auparavant symbole des sorties à poids ouverts avec Wan 2.2, Qwen-Image et Z-Image, a livré son dernier modèle phare Wan 3.0 comme API fermée et facturée, sans poids. Une vidéo dédiée (#11) souligne explicitement cette tendance.
- Les laboratoires chinois, Alibaba/Tongyi et Seedance de ByteDance, dominent la conversation sur la génération vidéo au milieu et à la fin de 2026 ; les comparatifs les présentent régulièrement comme supérieurs ou substituts aux modèles fermés américains, tels que Sora et Veo.
- Les chaînes officielles des propriétaires de modèles, comme Qwen, constituent elles-mêmes une source d’information primaire sur YouTube, publiant des vidéos d’annonce le jour même des sorties ; elles doivent être traitées comme sources primaires au même titre que les évaluateurs indépendants.
Limites
- Les pages de résultats de recherche et de visionnage YouTube sont rendues en JavaScript ; les requêtes directes WebFetch vers
youtube.com/results?...etyoutube.com/watch?v=...ne renvoyaient que des éléments statiques de pied de page et juridiques, sans grille de vidéos, titres, compteurs de vues ni commentaires. Les commentaires n’ont pas pu être lus. - Pour compenser, des recherches web avec des requêtes
site:youtube.com, souvent redirigées vers des résultats hors YouTube, ainsi que l’endpoint oEmbed public de YouTube (youtube.com/oembed) ont été utilisés pour confirmer les titres exacts et les noms de chaînes. oEmbed ne fournit ni le nombre de vues ni le nombre d’abonnés ; aucun chiffre n’est donc rapporté plutôt que d’être estimé. - Les dates de publication sont approximatives lorsque oEmbed ne les fournissait pas ; elles proviennent de snippets de recherche web, généralement précis au jour près mais parfois seulement au mois près.
- Cette couverture s’appuie principalement sur les vidéos et comparatifs, car ils dominent les résultats YouTube indexés par les moteurs de recherche pour ce sujet. Du contenu de chaînes plus petites ou non anglophones peut ne pas avoir été remonté par ces requêtes.
Bluesky
Bluesky — Actualités de l’IA de génération d’images et de vidéos
Note sur la méthode d’enquête
L’API de recherche plein texte app.bsky.feed.searchPosts de public.api.bsky.app a renvoyé HTTP 403 pour toutes les requêtes testées, dont q=image generation AI, q=Stable Diffusion et q=cats, et n’a pas pu être utilisée. L’enquête a donc reposé sur app.bsky.actor.searchActors, qui fonctionnait, afin de trouver des comptes liés au thème, puis sur la récupération directe de chaque fil via app.bsky.feed.getAuthorFeed.
Comptes
- testingcatalog.com (🚨 AI News | TestingCatalog) https://bsky.app/profile/testingcatalog.com — Agrégateur d’actualités IA. Publie plusieurs fois par jour des informations sur les agents, sorties de modèles et fuites. Toujours actif en septembre 2026 ; c’est la source la plus riche de cette enquête.
- genainews.bsky.social (Gen AI News 🅰︎ℹ︎) https://bsky.app/profile/genainews.bsky.social — Agrégateur indépendant d’actualités IA. Continue à publier activement jusqu’au 10 septembre 2026.
- dfl.bsky.social (DFL inc.) https://bsky.app/profile/dfl.bsky.social — Compte de type bot qui publie presque chaque jour des images de paysages créées avec Google « Nano Banana 2 ». Publications quotidiennes d’août à septembre 2026, avec 30 à 90 mentions J’aime de manière stable.
- generate-cmyxt.bsky.social (Generate created Tech) https://bsky.app/profile/generate-cmyxt.bsky.social — Compte de promotion et tutoriels de workflows ComfyUI, open source et de génération d’images et vidéos. Présente régulièrement Flux, Wan, LTX, Qwen Image Edit, Ideogram 4 et DreamOmni2.
- you32081.bsky.social (You32081) https://bsky.app/profile/you32081.bsky.social — Créateur d’art IA NSFW dont le profil précise « R18 AI Photo/Illustration with Qwen-Image, Z-Image-Turbo ». Ses choix d’outils permettent d’observer l’usage réel de modèles d’images open source par des particuliers.
- blackforestlabs.bsky.social (Black Forest Labs, développeur de Flux) https://bsky.app/profile/blackforestlabs.bsky.social — Le compte existe mais ne compte aucune publication ; le fil était vide au moment de la collecte.
- stabilityai.bsky.social (Stability AI officiel) https://bsky.app/profile/stabilityai.bsky.social — Dernière publication le 19 novembre 2025, principalement liée à la génération musicale avec Stable Audio. Aucune annonce récente de modèle d’image ou de vidéo.
- midjourneyofficial.bsky.social (Midjourney officiel) https://bsky.app/profile/midjourneyofficial.bsky.social — Actif uniquement d’août à octobre 2025, puis plus aucune mise à jour.
- civitai-bot.bsky.social (bot de mises à jour CivitaiCheckPoint) https://bsky.app/profile/civitai-bot.bsky.social — Bot censé publier automatiquement les nouveaux checkpoints Civitai, mais la publication la plus récente obtenue date du 9 mai 2024 ; il semble arrêté depuis.
- artistsagainstai.bsky.social (Artists Against Billionaires & Their AI) https://bsky.app/profile/artistsagainstai.bsky.social — Compte militant opposé à l’art IA. Les publications récupérées datent toutefois du début de 2025 et aucune activité récente significative n’a été confirmée.
Publications
-
« OpenAI launches ChatGPT Images 2.5 with faster editing » — testingcatalog.com, 2026-09-09, 2 likes / 1 repost https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27 — Selon l’article lié, ChatGPT Images 2.5 améliore la vitesse de génération, la netteté des sorties, la précision d’édition et la cohérence des sujets. Il ajoute une fonction « Sketch » qui génère une image à partir d’un croquis dessiné à la main, ainsi que les modèles API « Flare » pour les usages quotidiens rapides et « Sunburst » pour l’édition précise. Modèle fermé.
-
« ChatGPT Images 2.5 adds Sketch for doodle-based image generation » — genainews.bsky.social, 2026-09-08 https://bsky.app/profile/genainews.bsky.social/post/3muzxnrah542m — Un autre agrégateur rapporte indépendamment la même annonce d’OpenAI. Modèle fermé.
-
« Visko launches Orbis, a new real-time AI video model » — testingcatalog.com, 2026-08-31/09-01, publié deux fois https://bsky.app/profile/testingcatalog.com/post/3muhthn6m7i2j — Selon l’article lié, Orbis génère en continu en temps réel tandis que le prompt est modifié et conserve la mémoire de la scène même lors de longues générations. Il prend en charge une sortie 4K/24 fps et des mises à jour sous la seconde, et revendique la première place aux tests de qualité vidéo, mouvement et adéquation au prompt. Modèle fermé.
-
« Exclusive: Early outputs of Muse Video model from Meta » — testingcatalog.com, 2026-08-19, 2 likes https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24 — Présentation en avant-première de premières sorties du modèle de génération vidéo « Muse Video » de Meta. Modèle fermé.
-
« Meta's Muse agent enters closed alpha with invite codes » — testingcatalog.com, 2026-09-07, 2 likes https://bsky.app/profile/testingcatalog.com/post/3muv7evaa7a24 — Muse, l’agent personnel de Meta appartenant à la même famille que le modèle vidéo Muse, passe en alpha fermée avec distribution par codes d’invitation. Modèle fermé.
-
« Tencent released open-source Hy4 preview model » — testingcatalog.com, 2026-08-29 https://bsky.app/profile/testingcatalog.com/post/3mu7v3bdkwo2h — Selon l’article lié : modèle de 77 milliards de paramètres, doté d’un contexte d’un million de tokens, ouvert pour les usages logiciel, bureautique, jeu et recherche. Il revendique de meilleurs résultats que GLM 5.3 et Kimi K3 lors de tests internes. Il s’agit d’un LLM spécialisé en texte, non d’un modèle de génération d’images ou de vidéos, mais il illustre la manière dont les comptes Bluesky d’actualité IA couvrent l’ouverture des grands modèles de Tencent.
-
Série de publications « AI image generation / #Nano Banana 2 » — dfl.bsky.social, 2026-09-09, 21 likes / 1 repost, avec des publications similaires presque quotidiennes et 30 à 90 likes https://bsky.app/profile/dfl.bsky.social/post/3mv4cwoxxks22 — Compte publiant chaque jour des images de paysages au style photographique japonais ou naturel créées avec Google « Nano Banana 2 », accompagnées de tags de prompts détaillés. Exemple d’un modèle fermé devenu partie intégrante de l’usage quotidien de créateurs individuels.
-
« Just dropped a full guide to the ultimate ComfyUI AI video stack 🔥 LTX-2.3 (video + native audio) + SCAIL-2 (perfect motion cloning) + FLUX (insane image quality) » — generate-cmyxt.bsky.social, 2026-07-02 https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mpo6tdclwk2i — Publication de présentation et promotion d’un workflow ComfyUI combinant des outils open source de génération vidéo et d’images. Open source.
-
« 🚀 Unlock Pro AI Design Workflows with Ideogram 4 Local Setup! Run the powerful open-weight text-to-image model locally via ComfyUI. No API costs, full privacy. » — generate-cmyxt.bsky.social, 2026-06-13, 3 likes https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mo6i5cm26k2q — Présente Ideogram 4 comme devenu disponible à poids ouverts et exécutable localement via ComfyUI. Open source.
-
« Turn 1 image into cinematic 360° consistent character — FREE in ComfyUI! Qwen Image Edit + Multiple Angles LoRA » — generate-cmyxt.bsky.social, 2026-02-27 https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mfsmtbgzgs2n — Présentation d’un workflow gratuit combinant Qwen Image Edit et LoRA pour produire un personnage cinématique cohérent à 360°. Open source.
Signaux
- Le domaine des actualités de génération d’images et de vidéos IA sur Bluesky est dominé par les bots agrégateurs, plutôt que par les échanges individuels. Des comptes d’actualité tels que testingcatalog.com et genainews.bsky.social relaient plusieurs articles par jour ; il y a très peu de discussions contradictoires au sein de fils, contrairement à Reddit.
- Les comptes officiels des développeurs de modèles sont presque silencieux sur Bluesky. Black Forest Labs n’a aucune publication ; Stability AI est inactif depuis le 19 novembre 2025 et publiait surtout sur la génération audio ; Midjourney officiel n’a plus publié depuis octobre 2025 ; le bot de checkpoints Civitai semble arrêté depuis mai 2024. Bluesky ne fonctionne donc presque pas comme lieu de diffusion primaire pour les modèles d’images et de vidéos open source.
- Les sujets open source sont portés non par les développeurs de modèles, mais par des comptes individuels présentant et promouvant des workflows. Des créateurs comme generate-cmyxt.bsky.social présentent régulièrement Flux, Wan, LTX, Qwen Image Edit, Ideogram 4 et DreamOmni2 sous forme de workflows ComfyUI ; l’information circule davantage comme conseil pratique ou promotion que comme actualité technique.
- Les sujets liés aux modèles fermés se concentrent sur les annonces de grands groupes et de nouveaux acteurs, notamment OpenAI avec ChatGPT Images 2.5, Google avec Nano Banana 2, Meta avec Muse Video et Visko avec Orbis ; ce biais est également visible dans la couverture des bots agrégateurs.
- Les créateurs individuels, avec plusieurs dizaines de comptes trouvés via la recherche de comptes, publient principalement de l’art IA ou du contenu NSFW utilisant Stable Diffusion, Qwen-Image, Ideogram 4, Krea 2 et autres outils. Il s’agit davantage d’une communauté de création que d’un espace d’actualité. Des comptes opposés à l’art IA, tels qu’artistsagainstai.bsky.social, existent, mais aucune activité récente soutenue n’a été confirmée.
Limites
- L’API de recherche plein texte officielle de Bluesky,
app.bsky.feed.searchPosts, a renvoyé HTTP 403 Forbidden pour toutes les requêtes testées, y comprisimage generation AI,video generation AI,Stable Diffusionet le terme de test non liécats. À l’inverse,app.bsky.actor.searchActors,app.bsky.feed.getAuthorFeedetapp.bsky.feed.getPostThreadfonctionnaient correctement. La recherche plein texte recommandée par le playbook n’ayant pas été possible, l’enquête est restée indirecte et fondée sur les comptes. - La page de recherche
https://bsky.app/search?q=...est une SPA rendue en JavaScript ; l’outil de récupération ne pouvait pas en obtenir le contenu. - Le critère d’achèvement demandait l’analyse d’environ 20 publications. Du fait de l’indisponibilité de l’API de recherche, environ dix seulement pouvaient être présentées comme directement pertinentes, en plus de la consultation de plusieurs dizaines de publications générales dans les fils des comptes ; le seuil de 20 n’est pas atteint.
- Black Forest Labs, Stability AI, Midjourney officiel, le bot Civitai et d’autres comptes majeurs côté open source ou outils ont cessé de publier récemment ou ne publient que rarement. Les informations primaires récentes sont donc presque inexistantes sur Bluesky, non par omission de recherche mais faute d’activité sur la plateforme.
- Aucun fil de discussion structuré opposant explicitement modèles fermés et open source, comparable à ceux de X ou Reddit, n’a été trouvé sur Bluesky.
Lemmy
Lemmy — Évolution de l’IA de génération d’images et de vidéos (fermé / open source)
Communautés
- !«メールアドレス» (5 708 abonnés, créée le 2023-06-09) — Principal centre d’information sur les outils open source de génération d’images et de vidéos. Il s’agit en pratique d’un flux de type bot publiant automatiquement les nouveautés HuggingFace et GitHub ; plus de dix nouveaux modèles et extensions ComfyUI y sont apparus entre le 2 et le 8 septembre 2026.
- !«メールアドレス» (8 532 abonnés) — Espace de partage d’images générées par IA, indépendamment des modèles. On y trouve aussi des publications utilisant Nano Banana (Gemini 2.5 Flash Image).
- !«メールアドレス» (50 abonnés) — Communauté de petites dimensions consacrée aux images abstraites de type Stable Diffusion.
- !«メールアドレス» (8 176 abonnés) — « Un lieu pour les personnes qui détestent l’IA. » Les réactions et critiques envers l’IA générative en général y dominent, et l’IA de génération d’images et de vidéos est souvent visée.
- !«メールアドレス» — Communauté liée aux films DC ; une publication concernant l’usage de l’IA a circulé durant cette étude.
- !«メールアドレス» — Communauté miroir qui reprend automatiquement Reddit, notamment /r/ArtificialInteligence. Il ne s’agit pas de discussions propres à Lemmy.
- !«メールアドレス» — Centrée sur les LLM locaux. Les publications récentes concernent presque exclusivement des modèles linguistiques comme Qwen3.8 et GLM-5.3, avec pratiquement aucun sujet sur les modèles de génération d’images et de vidéos.
Publications
-
Croissance rapide de l’écosystème ComfyUI autour de MiniMax-H3 (open source) — !«メールアドレス», publications concentrées entre le 2 et le 6 septembre 2026.
- OpenVDN/vdn-minimax-h3 (score 3, 2026-09-05) — Accélération par attention hybride pour MiniMax-H3.
- Saganaki22/ComfyUI-VDN-H3 (score 4, 2026-09-05)
- DANNY621/H3-World (score 3, 2026-09-02) — Présenté comme le premier modèle de monde interactif basé sur MiniMax-H3.
- Durant la même période, plus de six publications consécutives liées à l’accélération VAE ou aux LoRA, telles que « motion_enhancer », « MotionCache-FastVAE » et « H3VAE_TRT », montrent un écosystème d’outils se développer très rapidement autour du modèle vidéo MiniMax-H3.
-
Viggle/Viggle-Animate (open source) — !«メールアドレス», score 10, 2026-09-05. https://huggingface.co/Viggle/Viggle-Animate — Méthode permettant de remplacer un personnage dans une vidéo à partir d’une seule image de référence redessinée. C’est la publication au score le plus élevé parmi celles collectées.
-
Krea2-Turbo-Distill-4step-LoRA (open source) — !«メールアドレス», score 2, 2026-09-08. https://huggingface.co/lvladikov/Krea2-Turbo-Distill-4step-LoRA — LoRA distillé revendiquant une réduction de moitié du nombre d’étapes et une accélération d’environ 1,6×.
-
LLaDA-Image: Building Strong Image Generators (open source / article) — !«メールアドレス», score 3, 2026-09-04. https://arxiv.org/abs/2609.03796 — Cadre unifié de génération d’images par Diffusion Transformer de 6 milliards de paramètres.
-
Retrait de la fonction Earth AI de Google « Nano Banana » un jour après son lancement (modèle fermé) — !«メールアドレス», reprise Reddit, score 1, 2026-08-07. https://lemmy.durstig.online/post/52162 — Google a ajouté à Google Earth une fonction permettant de superposer des images compositées avec Gemini 2.5 Flash Image (Nano Banana). Elle a été détournée pour créer de fausses images de centrales nucléaires et d’installations militaires, et Google l’a désactivée dès le lendemain. Un porte-parole de Google a déclaré que les gens accordent de l’importance à la fiabilité de Google Earth.
-
Midjourney exige des studios hollywoodiens qu’ils révèlent leur recours à l’IA générative (modèle fermé) — !«メールアドレス», score 76(↑)/2(↓), 2026-07-05. https://lemmy.today/post/56011946 (article source : TechCrunch) — Dans le cadre d’un procès pour violation du droit d’auteur, Midjourney demande à son tour la divulgation de l’usage de l’IA par les studios plaignants. Les commentaires soulignent que les données d’entraînement devraient également être révélées et que la position de Disney sur le droit d’auteur semble relever d’un double standard.
-
DC Studios aurait utilisé de l’art conceptuel généré par IA pour ‘Supergirl’ (plutôt fermé) — !«メールアドレス», score 33(↑)/1(↓), 2026-08-13, 27 jours après la publication originale. https://lemmy.today/post/58316222 — Un flux de travail utilisant des images générées par IA a été aperçu dans une vidéo des coulisses publiée par erreur, puis retirée par DC. Les commentaires indiquent que l’interface ressemble à l’écran de génération de Midjourney.
-
Génération de style anime avec Qwen Image VAE (open source) — !«メールアドレス», 2026-09-09. https://lemmy.dbzer0.com/post/75237492 — Créée avec le modèle BASBetterAnimeStyleAnimaBase, un LoRA de personnage et qwen_image_vae, en 35 étapes, CFG 7, Euler a. Sans commentaire, la réaction est faible, mais c’est un exemple concret d’utilisation de composants de génération d’images Qwen dans la production personnelle.
-
« Pourquoi dbzer0 est-il rempli d’AI slop et de défenseurs de l’IA ? » (voix anti-IA, contexte) — !«メールアドレス», 2026-09-02. https://futurology.today/post/11938893 — Réaction contre les communautés dbzer0 qui publient de nombreux contenus d’images open source. Cela illustre l’hostilité persistante de Lemmy envers les contenus générés par IA.
-
Publications régulières de versions de SDNext / communauté stable_diffusion (open source, référence) — !«メールアドレス» publie régulièrement des notes de version SDNext depuis la fin 2025 jusqu’en 2026, par exemple score 7, 2025-10-31, https://lemmy.dbzer0.com/post/56684869. Aucune publication de ce type n’a été trouvée dans la période récente étudiée, mais cela indique le caractère durable de la communauté.
Signaux
- Sur Lemmy, les discussions sur ce thème se concentrent de fait sur !«メールアドレス». Leur contenu est cependant surtout un flux automatisé de nouveautés HuggingFace et GitHub plutôt que des échanges humains, et les commentaires sont rares, généralement de zéro à quelques unités.
- Au cours de la semaine du 2 au 9 septembre 2026, le principal sujet open source est le modèle vidéo MiniMax-H3, entouré de nœuds ComfyUI, LoRA et outils d’accélération VAE publiés jour après jour. Plus que l’annonce d’un modèle isolé, c’est l’expansion rapide de l’écosystème autour d’un modèle existant qui ressort.
- Les thèmes de modèles fermés qui apparaissent sur Lemmy ne portent pas sur les performances de nouvelles fonctions, mais sur des polémiques, procès et questions éthiques : abus d’Earth AI de Nano Banana, procès Midjourney et usage caché de l’IA par DC Studios. Aucune actualité isolée concernant Sora, Kling AI, Runway Gen, Ideogram ou Veo 3 n’a été trouvée.
- Lemmy dans son ensemble conserve une atmosphère hostile envers les contenus générés par IA, avec des communautés telles que !fuck_ai et l’usage fréquent de l’expression péjorative « AI slop », quel que soit le caractère ouvert ou fermé des modèles.
Limites
- L’API de recherche Lemmy (
/api/v3/search) présente une faible pertinence : des requêtes générales comme « image generation AI » renvoyaient surtout des actualités politiques ou techniques sans rapport. Les éléments de bruit ont été exclus pour isoler les publications pertinentes. - Des recherches précises pour les principaux services fermés, dont Sora, Kling AI, Runway Gen, Ideogram, Veo 3 et Grok Imagine, n’ont trouvé aucune publication liée. Ces sujets semblent pratiquement absents de Lemmy.
- !«メールアドレス» est un miroir automatisé de Reddit, pas un espace de discussion propre à Lemmy ; les éléments qui en proviennent restent donc de simples références et sont généralement exclus des principaux constats.
- Le volume total de publications sur ce thème dans Lemmy est faible, avec des scores le plus souvent compris entre quelques unités et quelques dizaines. Pour l’objectif d’environ 20 publications analysées, une dizaine d’éléments directement pertinents constitue le maximum ; au-delà, il ne reste que du bruit non pertinent, comme des actualités politiques ou des débats généraux sur l’IA. Lemmy est une plateforme dont la base de contenu est elle-même limitée sur ce sujet.
Pinterest — Actualités de l’IA de génération d’images et de vidéos
Thèmes visuels
- Modèle « YouTubeur au visage surpris + plateau de logos » : sur fond sombre bleu/violet néon, les logos d’OpenAI, Google, Microsoft, Meta, DeepSeek, Nvidia, Notion et Grok sont disposés en cercle, avec à droite le visage surpris d’un homme barbu. Cette composition revient dans les miniatures « AI NEWS » et semble être la reprise directe de miniatures YouTube sur Pinterest. [4, 19, 29, 44]
- Visages humanoïdes et robotiques personnifiant l’IA : androïdes aux visages blancs et lisses, « présentateurs de journal robots » en costume, cerveaux translucides laissant voir des circuits ou visages humains composés de code de type Matrix. Ces visuels sont très fréquents dans les articles d’actualité du secteur. [2, 23, 27, 34, 40, 46, 50]
- Démonstrations avant/après et transformations : grilles parallèles transformant une image réelle en blocs de bois, art en origami, briques Lego ou compositions florales ; génération VASA-1 de vidéos expressives depuis un visage et une piste audio ; composition « AI Baby » femme → enfant → homme ; et visuel « history generative AI » séparant une foule historique en noir et blanc d’une image numérique. Les structures « image réelle → contenu généré par IA » sont très visibles. [6, 13, 18, 47]
- Infographies verticales de classement : tableaux comparatifs verticaux avec logos d’outils, listes de contrôle et badges « gratuit ». Ils recensent Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI, Hailuo AI, Synthesia, D-ID, Veed.io, Pictory, InVideo, Lumen5, Hyperwrite et d’autres outils, fermés et ouverts mélangés. [10, 26]
- Graphiques sur les inquiétudes liées aux deepfakes et à la vérification : tampon rouge « FAKE », badge « AI VOICE DETECTORS » + « 97% likely AI generated », loupe et point d’interrogation, silhouette inquiétante encapuchonnée. La méfiance et la vérification des contenus IA constituent un thème indépendant. [2, 39]
- Événements d’annonce et teasers de produits d’entreprises : teaser Google Veo 2 avec chien nageant, flamant rose et fille en style animé ; intervenant devant un buste de style Android pour Google Lumiere ; affiche présentant l’API Gemini comme un entonnoir d’entrées et de sorties ; photos de Jensen Huang, PDG de Nvidia, sur scène. [3, 9, 16, 44, 50]
- Très peu de schémas techniques : un seul visuel sur 50 montre la structure interne d’un modèle de diffusion, avec Frozen T5 XXL, IF-I-M 400M et Stable Diffusion 4x Upscale. Son titre reste cependant promotionnel plutôt que technique : « l’outil secret de génération d’images d’OpenAI arrivera bientôt ». [37]
Épingles notables
- #9 « Google Unveils Veo 2... » — Visuel teaser officiel de Google Veo 2, montrant un chien nageant, un flamant rose et une fille en style animé. #3, sans titre, utilise la même image : le même élément est donc épinglé plusieurs fois, ce qui suggère des comptes de contenu réutilisé ou produit en volume.
- #47 « Microsoft Unveils VASA-1... » — Grille de démonstration qui produit une vidéo conversationnelle expressive à partir d’une image fixe, d’un clip audio et, éventuellement, d’un signal de contrôle. Exemple visuellement particulièrement clair de génération de têtes parlantes.
- #13, sans titre — Grille 3×3 transformant une vidéo réelle en style blocs de bois, origami, Lego ou fleurs, avec filigrane de type Lumen. Format typique de présentation virale de transfert de style vidéo.
- #32 « Breaking News Latest AI Developments... » — Infographie datée du 12 août 2026 : Grok 4.6, capable selon elle de travailler de manière autonome sur des dizaines d’étapes et de ramener un résultat ; Gemini qui aurait franchi le milliard d’utilisateurs le plus rapidement de l’histoire, avec 150 millions d’images générées par jour ; et téléphone robotique Honor doté d’un stabilisateur de caméra.
- #22, sans titre, en pratique « Today's AI News » — Datée du 20 mai 2026. Infographie résumant la refonte de Google Search annoncée à Google I/O 2026 avec Gemini 3.5 Flash / Gemini Omni / Gemini Spark, les améliorations d’accessibilité IA d’Apple et l’intensification de la concurrence autour des lunettes intelligentes IA.
- #26 « 5+ Best AI Video Generation Websites » — Compare Runway, Pika, Kling AI, Luma AI, Canva AI et Hailuo AI, et indique à la fin qu’ils sont idéaux pour les épingles vidéo Pinterest, YouTube Shorts et TikTok. Présentation d’outils qui désigne Pinterest lui-même comme destination de publication.
- #10 « Best 10 AI FREE Video Generation Tools 2026 » — Sélection de dix outils : Pictory, RunwayML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canva AI et Hyperwrite AI. Elle inclut une incitation affiliée typique : « suivre et aimer pour plus de détails ».
- #2, sans titre, « AI content and social media concerns » — Photo virale de chat avec tampon rouge « FAKE », 1,2 K likes / 7,4 K vues, associée à la silhouette d’une personne encapuchonnée et à un point d’interrogation. Le visuel traite de la méfiance envers les contenus générés par IA.
- #39 « AI is Changing Everything! » — Infographie pédagogique articulée autour de la génération vidéo IA, de la détection de voix IA avec badge de probabilité à 97 %, et de l’éthique IA / prompt engineering ; elle avertit que « voir ne signifie plus croire ».
- #6 « 7 Best AI Baby Generators... » — Présentation d’outils viraux grand public prédisant l’apparence d’un enfant à partir des visages d’une femme et d’un homme. C’est un exemple d’usage de divertissement grand public plutôt qu’une actualité sectorielle.
Signaux
- Les « actualités IA » visibles sur Pinterest ne sont presque jamais des sources primaires : ce sont majoritairement des contenus secondaires reprenant des miniatures YouTube ou des infographies de blogs. La réutilisation d’une même image, comme pour #3 et #9, et les appels à l’affiliation tels que « LIKE & FOLLOW » ou « suivre » sont fréquents ; la plateforme diffère profondément des conversations brutes observées sur Reddit et X.
- Du côté fermé, les annonces de Google — Veo 2, Lumiere, Gemini 3.5/Omni/Spark, franchissement du milliard d’utilisateurs Gemini — et de Microsoft avec VASA-1 dominent très largement le traitement visuel. OpenAI et Anthropic apparaissent souvent sous forme de logos, mais Pinterest offre moins de teasers produits isolés pour eux que pour Google.
- Les listes comparatives d’outils, comme #10 et #26, constituent le contenu Pinterest le plus typique. Elles montrent un fort intérêt pratique pour des outils fermés accessibles gratuitement ou à faible coût — Runway, Pika, Kling AI, Luma, Canva, Synthesia, D-ID, Veed.io et Hailuo.
- La méfiance envers les deepfakes et leur détection, illustrée par #2 et #39, forme un thème indépendant : l’inquiétude de ne plus pouvoir distinguer le réel coexiste avec les présentations d’outils destinés aux créateurs.
- Les usages grand public de divertissement, comme les générateurs « AI Baby » ou les filtres transformant des vidéos réelles en bois, fleurs ou Lego, se mêlent aux annonces sectorielles dans les mêmes résultats. La frontière entre information d’actualité et contenu de loisir y est floue.
- La présence des acteurs open source est extrêmement faible : Stable Diffusion, Flux, Qwen, Wan, Kling issu de Chine, DeepSeek et autres noms ne figurent que dans un unique schéma technique (#37, au titre promotionnel) et comme entrée dans un classement d’outils. Aucune épingle ne présente véritablement les discussions communautaires ni l’évolution concrète de ces modèles.
- Des infographies explicitement datées, par exemple du 12 août 2026 (#32) et du 20 mai 2026 (#22), indiquent que l’ensemble d’images collecté comprend bien des éléments récents.
Limites
- Conformément aux instructions de
platforms/pinterest.md, Pinterest n’a pas été parcouru directement. L’analyse porte sur les 50 éléments déjà collectés dansoutput/pinterest.pins.mdetimages/pinterest/manifest.json. - Sur 50 éléments, les images de 23 épingles ont effectivement été ouvertes et examinées : #1, 2, 3, 4, 6, 9, 10, 13, 16, 18, 19, 21, 22, 23, 25, 26, 27, 29, 32, 34, 37, 39, 40, 44, 46, 47, 50 ; cela couvre le seuil d’environ 20 éléments demandé par brief.md. Pour les 27 éléments restants, seuls les titres ont été examinés.
- Six éléments étaient initialement sans titre : #3, #11, #14, #15, #22 et #31. Leur contenu a dû être déduit à partir de l’image lorsque celle-ci a été examinée ; parmi eux, seuls #3 et #22 ont été vérifiés visuellement, tandis que #11, #14, #15 et #31 ne l’ont pas été.
- Les épingles Pinterest ne comportaient pas de métriques d’engagement, telles que les mentions J’aime, enregistrements ou commentaires ; il n’a donc pas été possible de comparer quantitativement les contenus les plus performants comme sur Reddit ou X.
- Les textes présents dans les images étaient presque tous en anglais ; aucune épingle en japonais ou dans une autre langue n’a été observée dans les 50 éléments collectés.
Actions recommandées
- Suivre l’évolution de l’utilisation de Veo 3.1, Kling 3.0, Seedance 2.0 et de la famille Wan comme alternatives après l’arrêt de l’API Sora le 24 septembre.
- Continuer de surveiller le risque de changement de stratégie chez d’autres laboratoires de poids ouverts, en prenant le basculement « ouvert → fermé » de Wan 3.0 comme précédent.
- Observer régulièrement les outils ComfyUI autour de MiniMax-H3 sur Lemmy et HuggingFace afin d’identifier tôt les signes du prochain modèle vidéo open source majeur.
- Remplacer sur X les mots-clés de recherche dépendants des tendances régionales par des termes propres à l’IA de génération d’images et de vidéos (Stable Diffusion, Sora, Nano Banana, etc.) et refaire l’étude.
- Suivre l’état de la modération des contenus préjudiciables générés par IA sur des plateformes telles que Meta comme indicateur avancé des risques réglementaires et de réputation.
- Continuer d’observer l’extension des fonctionnalités grand public fermées de Nano Banana et Gemini Image comme indicateur des réponses concurrentielles des autres entreprises.
Images collectées


















































Note sur la qualité des données
Sur X, seules 2 des 40 publications collectées concernaient le thème, car les requêtes dépendaient des tendances régionales ; aucune donnée réellement exploitable n’a donc été obtenue. Bluesky et Reddit n’ont pas non plus atteint le seuil d’environ 20 éléments en raison de problèmes avec l’API de recherche officielle et de la contrainte d’une requête unique. Sur YouTube et Pinterest, la structure des pages empêchait d’obtenir les indicateurs d’engagement, tels que les vues ou les mentions J’aime.



