Actualités de l’IA de génération d’images et de vidéos — 2026-09-27
Sora API prend fin, ce qui redistribue les cartes de la génération vidéo propriétaire, tandis que le camp des poids ouverts, emmené par Qwen-Image-2.1 et LTX-2.5, étend rapidement son écosystème sur plusieurs plateformes dès leur sortie.
Actualités de l’IA de génération d’images et de vidéos — 2026-09-27
Franchement, le plus excitant dans ce récap, c’est que l’élan du camp open source ne ralentit vraiment pas 🔥🔥 Qwen-Image-2.1, LTX-2.5… à peine publiés, YouTube, Lemmy et Bluesky s’en emparent tous en même temps, c’est fou. De l’autre côté, Sora 2 côté propriétaire ferme réellement ses portes (application le 26/04, API le 24/09), et on a l’impression qu’un jeu de chaises musicales commence entre Veo, Kling, Runway et Grok Imagine 🪑💨 Il y a aussi, sur toutes les plateformes, une très forte attente : « ne cachez pas ce que vous avez créé avec l’IA ». Des photos immobilières aux concours scientifiques, se faire prendre peut tout simplement mener au bad buzz ou au licenciement 😱 Pour être honnête, les données de X étaient complètement inutilisables ; je le reconnais donc sans détour 🙏
À travers les plateformes
- Les nouveaux modèles à poids ouverts suscitent des réactions immédiates sur plusieurs plateformes dès leur publication. Qwen-Image-2.1 (Alibaba, 7B de paramètres, sortie transparente prise en charge) a déjà fait l’objet de plusieurs vidéos de « test Day 0 » sur YouTube ; sur !stable_diffusion de Lemmy, des articles de compatibilité ComfyUI, des LoRA et des ControlNet ont été publiés les uns après les autres en quelques jours ; sur Bluesky, des créateurs individuels l’indiquent explicitement parmi leurs outils de profil. LTX-2.5 (Lightricks, 22B de paramètres, synchronisation audio) est également cité sur YouTube comme sur Bluesky. La vitesse de réaction initiale de la sphère open source après une sortie est vraiment fulgurante ⚡
- Le rejet de l’« utilisation non déclarée de l’IA » devient un sujet de polémique transversal. Sur Reddit, la même indignation a éclaté dans trois contextes totalement différents : photos d’annonces immobilières (26 980 pt), vidéo récompensée dans un concours scientifique (plus de 1 100 pt) et licenciement d’un CEO lié à des images publicitaires générées par IA (585 pt). Sur Lemmy aussi, le soutien à une proposition de loi imposant les filigranes et le litige Midjourney contre Hollywood (demandant de révéler l’usage de l’IA) relèvent du même thème ; Pinterest regorge par ailleurs d’images alimentant les inquiétudes autour des deepfakes et de la désinformation. Ce n’est plus une controverse isolée : cela devient un sujet structurel 🔥
- Nano Banana (Google) est devenu le point de comparaison de facto. Sur YouTube, une vidéo présente Grok Imagine 2.0 comme « 15 fois moins cher que Nano Banana Pro », tandis qu’une autre présente le Qwen-Image-2.1 open source comme « meilleur que Nano Banana » : les modèles propriétaires comme ouverts prennent ce modèle comme étalon 👀
- ComfyUI constitue l’infrastructure commune de la communauté de développement. Reddit (conseils d’exécution locale pour celles et ceux qui veulent créer des vidéos gratuitement), YouTube (vidéos d’installation de LTX-2.5 et Qwen-Image-2.1) et Lemmy (plus de cinq nœuds d’extension en deux semaines) mentionnent tous ComfyUI. C’est vraiment le terrain de jeu des projets open source 🏠
Plateforme par plateforme
Reddit — 12 fils collectés (objectif de 20 non atteint). Les discussions portent surtout sur des demandes de recommandations d’outils et les polémiques du type « ne cachez pas que vous avez retouché avec l’IA ». Peu de publications opposent directement propriétaire et ouvert, mais r/generativeAI a permis de recueillir des conseils d’usage réel avec des noms de modèles précis comme Seedance 2.5 ou Grok Imagine Video.
X — Cette étape a été pratiquement un coup d’épée dans l’eau 😂 Les 40 publications collectées provenaient toutes de mots-clés tendance (Yougoslavie, célébrités, publicités de tirages au sort, etc.) et aucune ne concernait la génération d’images ou de vidéos par IA. Les recherches du collecteur n’étaient pas du tout liées au thème ; il faudra recommencer avec des mots-clés directs tels que « Midjourney » ou « Sora 2 ».
YouTube — 12 vidéos ont été identifiées via des extraits de recherche (WebFetch n’a pas réussi à récupérer les pages YouTube elles-mêmes). Côté propriétaire, Grok Imagine 2.0 progresse fortement et les comparatifs d’alternatives après le retrait de Sora sont nombreux ; côté ouvert, Qwen-Image-2.1, le projet FLUX 3 et LTX-2.5 se distinguent parmi les sorties récentes.
Bluesky — La communication des comptes officiels d’entreprises est quasiment à l’arrêt, aussi bien côté propriétaire qu’ouvert (Midjourney est le seul compte officiel actif, mais sa dernière publication remonte à environ un an ; les comptes officiels de Stability AI, Black Forest Labs et Kling AI n’ont aucune publication ou stagnent). L’activité réelle se lit plutôt dans les profils de créateurs individuels, qui listent des outils précis tels que Qwen-Image, LTX-2 et Wan Video.
Lemmy — !«メールアドレス» concentre presque toutes les informations de première main sur l’open source. Qwen-Image-2.1, Krea 2, MiniMax H3 et Wan2GP ont connu des mises à jour simultanées au cours des deux dernières semaines ; en termes de rythme de développement, le camp ouvert dépassait le volume d’actualité du camp propriétaire. Les sujets propriétaires relevaient surtout de l’actualité et du contentieux, comme l’arrêt de l’API Sora et le procès Midjourney contre Hollywood.
Pinterest — 30 éléments sur 50 ont été examinés. Il ne s’agit pas d’annonces de première main, mais surtout de récapitulatifs d’actualité au style miniature YouTube, de listes affiliées du type « Top 10 des outils de génération vidéo » et d’images jouant sur l’anxiété liée aux deepfakes. Aucun contenu de workflow open source, comme des captures ComfyUI ou des LoRA ; les contenus, propriétaires comme ouverts, sont presque exclusivement de la redistribution secondaire.
À surveiller
- L’expansion de l’écosystème Qwen-Image-2.1 — LoRA, ControlNet et adaptateurs d’accélération apparaissent en série quelques jours après la sortie. Lemmy: https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
- L’engouement pour l’exécution locale de LTX-2.5 (vidéo à poids ouverts, 22B, synchronisation audio) — YouTube: https://www.youtube.com/watch?v=sIOC9pzHzjs
- Après l’arrêt complet de l’API Sora (24/09), la levée de fonds de 3 milliards de dollars des acteurs chinois — Lemmy: https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/openai-is-shutting_down-soras-api-next-week-while/
- L’augmentation rapide des outils autour du modèle vidéo MiniMax H3 (plus de 5 en deux semaines) — Lemmy: https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
- L’obligation de déclarer les contenus générés par IA (soutien à une loi sur les filigranes / procès Midjourney contre Hollywood) — Reddit: https://www.reddit.com/r/CriticalState/comments/1wmktek/ / Lemmy: https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/
- Grok Imagine 2.0 émerge à un quinzième du prix de Nano Banana Pro — YouTube: https://www.youtube.com/watch?v=NE2_w4_aDig
Recommandations
- L’étape de collecte sur X devrait être relancée avec des mots-clés directement liés au brief, comme « Midjourney », « Sora 2 » et « Stable Diffusion », plutôt qu’avec des tendances.
- Qwen-Image-2.1 et LTX-2.5 étendent très vite leur écosystème dès leur sortie ; il faut continuer à les surveiller en priorité.
- Suivre dans la durée les cas où l’utilisation non déclarée de l’IA mène à des licenciements, procès ou réglementations.
- Il est utile de comparer régulièrement l’évolution du rapport de force entre Veo, Kling, Runway et Grok Imagine après le retrait de Sora.
- Comme la communication officielle des entreprises fonctionne à peine sur Bluesky, il est plus efficace de se concentrer sur les profils de créateurs individuels.
- Pinterest est faible comme source primaire ; mieux vaut le limiter à la prise de température des contenus secondaires (récaps d’actualité et affiliation).
Qualité des données
X a été un échec complet (uniquement des mots-clés tendance, et des publications sans rapport avec le thème ; une nouvelle collecte est indispensable). YouTube a été limité à 12 éléments fondés sur des extraits de recherche parce que WebFetch bloquait YouTube ; le nom des chaînes et les vues restent souvent inconnus. Reddit (12 éléments) et Bluesky (seulement des flux par compte, dans la limite de 20, car l’API renvoyait 403) n’ont pas non plus atteint l’objectif de 20. Lemmy a dépassé 20 éléments, mais beaucoup étaient des bots annonçant des sorties avec zéro commentaire, donc avec peu de discussion réelle. Sur Pinterest, seulement 30 éléments sur 50 ont été examinés.
Récapitulatif par plateforme
Reddit — Actualités de l’IA de génération d’images et de vidéos (Image and Video Generation AI News)
Où
Les 12 fils collectés proviennent de 9 subreddits.
| Subreddit | Nombre de membres | Nombre de fils collectés |
|---|---|---|
| r/mildlyinfuriating | 12,597,694 | 1 |
| r/labrats | 726,858 | 2 |
| r/WhitePeopleTwitter | 3,145,714 | 1 |
| r/generativeAI | 157,421 | 3 |
| r/DeepSeek | 141,431 | 1 |
| r/isthisAI | 423,156 | 1 |
| r/Earth199999 | 54,355 | 1 |
| r/CriticalState | 39,741 | 1 |
| r/aivideomaking | 7,823 | 1 |
Le thème s’étend à la fois aux petites communautés dédiées à l’IA générative (r/aivideomaking, r/generativeAI) et aux très grands subreddits de mèmes ou de discussion (r/mildlyinfuriating, r/WhitePeopleTwitter). Tous ont été trouvés avec la requête « Image and Video Generation AI News ».
Ce que disent les gens
- #1 r/aivideomaking · 24 pt · 58 commentaires · 2026-09-20 — En réponse à une personne souhaitant créer des vidéos IA gratuitement, u/AztecWheels (2 pt) explique : « Télécharge avec Pinokio, crée des images dans ComfyUI puis transforme-les en vidéo avec FramePack. Même sur une petite configuration, on peut créer localement des vidéos de 1 à 120 secondes. » Beaucoup hésitent entre génération locale et paiement de services cloud. (https://www.reddit.com/r/aivideomaking/comments/1wled0f/)
- #2 r/labrats · 1,103 pt · 133 commentaires · 2026-09-23 — Une vidéo récompensée au Nikon Small World in Motion a été identifiée comme générée ou retouchée par IA. Commentaire principal de u/Barkinsons (630 pt) : « L’utilisation d’outils IA n’a pas sa place dans l’imagerie scientifique au microscope ; nous avons l’obligation de reproduire les images aussi fidèlement que possible. » (https://www.reddit.com/r/labrats/comments/1wo0j5e/)
- #4 r/labrats · 416 pt · 90 commentaires · 2026-09-24 — Suite du sujet ci-dessus. L’auteur a reconnu avoir utilisé une IA non supervisée pour segmenter et étiqueter les structures ; u/Feline_Diabetes (299 pt) demande : « Je veux voir quelle part de l’image originale est réelle et quelle part est une hallucination de l’IA. » Nikon réexaminerait également le prix. (https://www.reddit.com/r/labrats/comments/1woxdhk/)
- #3 r/generativeAI · 7 pt · 40 commentaires · 2026-09-23 — Dans une réponse sur la manière de créer des vidéos IA longues, u/kaboom-o (2 pt) cite des modèles précis : « Pour conserver les visages longtemps, Seedance 2.5 (jusqu’à environ 30 secondes, audio natif). Pour des brouillons de mouvement bon marché, Grok Imagine Video (480p, 5 secondes). Pour un rendu final photoréaliste, Gemini Omni Flash. » L’usage réel dominant consiste à générer beaucoup de courts clips et les assembler dans DaVinci. (https://www.reddit.com/r/generativeAI/comments/1wog53q/)
- #6 r/generativeAI · 4 pt · 17 commentaires · 2026-09-22 — u/jmbirn (2 pt) : « En s’inscrivant à un service comme Magnific AI (ou Fal, Krea), on peut essayer de nombreux modèles avec un seul compte. » u/sharktank123456 (2 pt) note que Dream Machine n’accepte plus les nouvelles inscriptions et qu’il faut utiliser Luma Agents à la place. (https://www.reddit.com/r/generativeAI/comments/1wngj3w/)
- #8 r/generativeAI · 2 pt · 20 commentaires · 2026-09-26 — À une demande d’outil gratuit de génération d’images, u/Scuzzy_Womack (3 pt) répond : « Utilise ComfyUI hors ligne, c’est gratuit. » Yodayo/MoescapeAI (50 crédits toutes les 24 heures) et Leonardo (jetons gratuits quotidiens) sont aussi recommandés. (https://www.reddit.com/r/generativeAI/comments/1wqfleb/)
- #5 r/mildlyinfuriating · 26,980 pt · 723 commentaires · 2026-09-21 — Colère face à l’utilisation d’images d’intérieur « inspirées » par IA dans des annonces immobilières. Le posteur explique : « Ils font disparaître des radiateurs et présentent une mise en scène impossible à reproduire dans la réalité. » u/BojackWorseman13 (1,140 pt) suggère d’inonder la page de l’agence de plaintes, soulignant l’ampleur de la réaction dans ce très grand subreddit. (https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/)
- #7 r/WhitePeopleTwitter · 585 pt · 64 commentaires · 2026-09-25 — Un CEO a été licencié après une image générée par IA d’un pull « Lake America ». u/samanime (294 pt) : « Si davantage d’imbéciles de ce genre étaient tenus responsables, il y en aurait moins. » Un exemple où la controverse sur les contenus IA a directement affecté l’emploi. (https://www.reddit.com/r/WhitePeopleTwitter/comments/1wq3juw/)
- #9 r/DeepSeek · 318 pt · 53 commentaires · 2026-09-21 — Les utilisateurs actifs quotidiens de DeepSeek sont passés de 120 à 200 millions (+66,7 %) tandis que les ressources de calcul n’ont augmenté que de 8,3 %, ce qui expliquerait la baisse de qualité. L’entreprise aurait également commandé 160 000 Ascend 960DT de Huawei pour résoudre cette pénurie. u/Equivalent-Grass-527 (14 pt) : « L’inadéquation entre demande et puissance de calcul explique l’essentiel de la dégradation récente. » (https://www.reddit.com/r/DeepSeek/comments/1wmcgex/)
- #10 r/CriticalState · 1,280 pt · 13,849 commentaires · 2026-09-21 — Fil proposant une loi qui rendrait obligatoire l’affichage d’un filigrane sur les images et textes générés par IA. Le nombre de commentaires est exceptionnel ; plusieurs commentaires très appréciés, dont celui de u/Timedforfun (19 pt), expriment leur accord sous forme de vote : « Pour ✅ ». Cela montre la force du soutien à cette obligation. (https://www.reddit.com/r/CriticalState/comments/1wmktek/)
- #12 r/isthisAI · 605 pt · 104 commentaires · 2026-09-23 — Débat sur le fait qu’une vidéo de peinture d’une petite chaîne YouTube soit générée par IA ou authentique. u/chekhovsdickpic (444 pt) l’analyse image par image et conclut : « Il y a du montage, mais ce n’est pas de l’IA » ; l’auteur a ensuite confirmé en commentaire. On observe l’affinement des méthodes de vérification au sein des communautés chargées de détecter l’IA. (https://www.reddit.com/r/isthisAI/comments/1wohq6s/)
Signaux
- Ce qui progresse : les vidéos IA longues ne sont plus produites « en une fois » ; un workflow consistant à générer en masse de courts clips (5 à 30 secondes, avec Seedance 2.5 ou Grok Imagine Video, entre autres) puis à les monter et joindre dans DaVinci ou Capcut s’installe (#3). L’idée qu’aucun outil ne puisse être simultanément gratuit, de haute qualité et sans filigrane est aussi largement admise (la formule de u/Jenna_AI dans #6, « choisis-en deux et pleure », est révélatrice) ; le choix se réduit à l’exécution locale (ComfyUI) ou à un abonnement peu coûteux (Grok à 10 $/mois, par exemple) (#1, #8).
- Ce qui est délaissé ou rejeté : cacher ou rendre ambiguë une retouche IA est très mal perçu. Dans les concours scientifiques (#2, #4), les photos immobilières (#5) et la publicité d’entreprise (#7), les réactions dénoncent systématiquement l’utilisation non déclarée de l’IA. Les 26 980 pt de r/mildlyinfuriating (#5) et les 13 849 commentaires de r/CriticalState (#10) montrent que ce rejet dépasse des communautés de niche et touche aussi le grand public.
- Élément surprenant : les deux fils de r/labrats (#2, #4) expriment une colère technique liée au fait que l’IA ait « halluciné » des structures dans une communauté scientifique, mais une partie des personnes défend aussi l’auteur (le posteur précise lui-même qu’il ne le déteste pas), ce qui divise les avis. D’autres, comme u/holydiver18 (#4, 55 pt), estiment qu’un certain reproche est normal. Le point commun est que la controverse porte moins sur l’usage de l’IA en lui-même que sur la déclaration et la vérifiabilité.
- Le contexte des contraintes de capacité des plateformes : la croissance rapide de DeepSeek (#9) et son manque de ressources de calcul constituent un signal indirect de la tension entre offre et demande autour des modèles fondamentaux derrière l’IA de génération d’images et de vidéos.
Limites
- Seuls 12 fils ont été collectés, loin de l’objectif du brief d’« environ 20 éléments par plateforme ». Une seule requête, « Image and Video Generation AI News », a été utilisée ; aucune recherche complémentaire ciblant des produits ou nouvelles de sortie spécifiques, côté propriétaire (Midjourney, Sora, Veo, etc.) ou open source (Stable Diffusion, Flux, HunyuanVideo, etc.), n’a été réalisée.
- Par conséquent, la collecte est majoritairement biaisée vers des demandes de recommandations d’outils ou des réactions éthiques aux contenus générés par IA ; aucun fil ne traite directement l’opposition open source contre source fermée selon les deux axes du brief (la synthèse doit être faite avec les résultats des autres plateformes).
- Cette étape consistait uniquement à lire les fichiers déjà collectés
output/reddit.threads.md/.json, sans accès direct à Reddit ni recherche supplémentaire, conformément aux instructions du playbook.
X
X — Actualités de l’IA de génération d’images et de vidéos
Comptes
Les 39 comptes présents dans output/x.posts.json ne représentent pas les acteurs qui animent la discussion sur la génération d’images et de vidéos par IA sur X — voir Limites. Pour mémoire, une publication provient de chacun des 39 comptes, sauf @Amateraspi0x (ジャングルチャンネル, 2 publications, 0 like au total). En termes d’engagement, les plus grandes publications individuelles venaient de @LagunaBiotchIG (28,975 likes, une publication, une photo de Taylor à Cleveland), @_daddydisco (60,755 likes, un clip de spoken word à propos du visage d’un homme « qui se transforme en argile »), @NIKKE_en (5,608 likes, une capture d’écran d’un événement de jeu mobile) et @newheightshow (11,282 likes, « Shoutout Cleveland! »). Aucun de ces comptes ne publie sur les outils, modèles ou créations d’IA générative : ce sont des comptes de fans de sport ou de célébrités, un compte officiel de jeu gacha et des bots de concours (@Miledge1, @CSharp66427821 et @RaeWirth ont tous publié la même publicité Fanatics « Quad Goals #sweepstakes »).
Publications
0 des 40 publications collectées mentionnent la génération d’images ou de vidéos par IA, un modèle d’IA ou un outil d’IA. Aucune ne cite Midjourney, Stable Diffusion, Sora, Veo, Runway, Flux, Grok Imagine, Nano Banana ou tout autre système génératif. L’élément le plus proche d’un angle média visuel est la publication #4 (@vintagemapstore, 234 likes, 52 reposts, environ 13 000 vues, 2026-09-26, https://x.com/vintagemapstore/status/2103834220624068946), une animation artisanale montrant la dislocation de la Yougoslavie — explicitement présentée comme « Work by me », donc non générée par IA. Rien d’autre dans l’ensemble n’est même indirectement lié aux médias génératifs. Aucun constat n’est rapporté ici, car il n’y en a pas ; lister des publications sans rapport déformerait ce que X a dit sur ce thème.
Signaux
Il n’y a aucun signal sur l’IA de génération d’images ou de vidéos dans cet ensemble de données, qu’il soit émergent ou non. Les données montrent en revanche pourquoi : les termes de recherche du collecteur (Yugoslavia, #chance, Taylor, #sweepstakes, #giveaways, Czechia, #gaming, Goddess, Lando, Cleveland) ne sont pas liés au brief ; ils sont copiés mot pour mot depuis la liste Explore / tendances de X au moment de la collecte (voir output/x.posts.json, "source": "trending"), et huit des dix sont marqués « Trending in Croatia », les autres relevant de tendances nationales ou mondiales dans les catégories « Politics », « Music », « Sports », « Gaming » et « Motorsport ». Explore est géolocalisé selon l’endroit depuis lequel la session de collecte a accédé à X — apparemment la Croatie lors de cette exécution — ; cette liste correspond donc à la barre latérale de tendances d’un lieu, non à une vue mondiale, et n’a jamais constitué une recherche sur le thème étudié.
Limites
- La collecte n’a pas recherché le thème.
output/x.posts.jsonenregistre"query": "Image and Video Generation AI News", mais"source": "trending"et des"terms"entièrement issus des tendances Explore de X (Yugoslavia, #chance, Taylor, #sweepstakes, #giveaways, Czechia, #gaming, Goddess, Lando, Cleveland), dont aucune ne concerne l’IA ou les médias génératifs. Cela ressemble à un chemin de secours, où le collecteur a récupéré le contenu de la page Explore, et non à une véritable recherche par mots-clés sur l’actualité de l’IA de génération d’images et de vidéos ; ce fichier ne peut donc pas répondre au brief. - Il n’y a par conséquent aucun compte, publication ou signal pertinent sur le thème à rapporter pour X dans cette exécution : les 40 publications collectées portent toutes sur autre chose (fans de célébrités, scores sportifs, jeu mobile, concours publicitaires, animation de vieilles cartes, drame de fans de Formule 1).
- Il n’a pas été possible de lancer des recherches personnelles pour corriger cela : conformément au playbook, une consultation anonyme et non instrumentée de X ne renvoie rien, et seule la session préauthentifiée du collecteur peut récupérer des publications. Il n’existe pas de source de repli pour cette étape.
- Il est recommandé de relancer l’étape de collecte X avec des termes explicites liés au brief (par exemple « Midjourney », « Sora 2 », « Stable Diffusion », « Runway Gen-4 », « Nano Banana », « Veo 3 », « open-source image model », « open weights video model »), plutôt qu’avec des sujets tendance, afin que la prochaine exécution fasse réellement émerger les discussions sur l’IA de génération d’images et de vidéos.
YouTube
YouTube — Actualités de l’IA de génération d’images et de vidéos (Image and Video Generation AI News)
Chaînes
Parmi les grandes chaînes YouTube qui couvrent continuellement ce thème (IA de génération d’images et de vidéos), les recherches ont identifié les suivantes :
- Matt Wolfe (@mreflow) — environ 690 000 à 970 000 abonnés (selon les sources). Une chaîne de référence qui résume l’actualité générale de l’IA avec une vue d’ensemble.
- Wes Roth — environ 321 000 abonnés. Un format de briefing rapide des actualités IA au quotidien.
Ces deux chaînes sont citées dans des articles externes (atakinteractive.com, vidiq.com) comme des références de l’actualité IA générale ; il n’a pas été confirmé que les vidéos individuelles collectées cette fois proviennent de ces deux chaînes (voir Limites ci-dessous). Pour la plupart des vidéos individuelles trouvées (section Vidéos), le nom de la chaîne n’apparaissait pas dans les extraits de résultats YouTube et n’a pas pu être vérifié.
Vidéos
Côté source fermée :
- Grok Imagine 2.0 Just WIPED OUT Expensive Design Tools (Full Asset Workflow) — vers août 2026 — https://www.youtube.com/watch?v=jH7-krxfarU — Affirme que le modèle de génération d’images « Grok Imagine 2.0 », publié par xAI le 7 août 2026, peut remplacer de bout en bout les workflows d’outils de design payants existants.
- [Image Gen AI] Grok Imagine 2.0 Hits #2 Globally — vers août 2026 — https://www.youtube.com/watch?v=X6PChZ59LrQ — Indique que Grok Imagine 2.0 a atteint la deuxième place mondiale dans les classements de génération d’images.
- Grok Imagine 2 is out of control (And It's 15x Cheaper Than Nano Banana Pro) — vers août 2026 — https://www.youtube.com/watch?v=NE2_w4_aDig — Compare Grok Imagine 2 à Nano Banana Pro et affirme qu’il est quinze fois moins cher tout en offrant une qualité concurrentielle.
- BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives — 27 mars 2026 — https://www.youtube.com/watch?v=Zf9979o8RGk — Après l’annonce de la fermeture de Sora 2 d’OpenAI (application le 26 avril, API totalement arrêtée le 24 septembre), teste et compare concrètement les alternatives. En septembre, cette fermeture est devenue réalité.
- Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison — vers mars 2026 — https://www.youtube.com/watch?v=x5fMQvhKP60 — Compare directement quatre modèles de génération vidéo propriétaires. Kling se distinguerait pour les vidéos longues, la 4K et le transfert de mouvement ; Veo, pour la qualité audio et le contrôle par image de référence.
- Midjourney V8 Is Close: Here's What We Know — vers 2026 — https://www.youtube.com/watch?v=aEVvqmwDVu8 — Récapitule les informations connues sur la prochaine étape de Midjourney V8 (V8.1 a déjà été publiée le 14 avril).
Côté open source :
- Qwen-Image-2.1 Is INSANE… Just 7B Parameters?! — vers les 20–21 septembre 2026 — https://www.youtube.com/watch?v=3qGl0wiv2G0 — Test rapide de « Qwen-Image-2.1 », publié le 20 septembre par Alibaba Qwen : 7B de paramètres, génération et édition texte-image intégrées, prise en charge native des arrière-plans transparents, composition de jusqu’à 10 images de référence.
- Qwen Image 2.1 best open source Image Editor. Better than Nano Banana - 10 refs transparency faster — vers septembre 2026 — https://www.youtube.com/watch?v=AIgYj5RG-FQ — Teste les avantages sur Nano Banana — 10 images de référence, transparence et vitesse — avec une démonstration dans ComfyUI.
- FLUX 3 Might Be the Open Source Sora 2 We Deserve — 24 juillet 2026 — https://www.youtube.com/watch?v=1s3zslFOSh0 — Présente le projet visant à étendre la série FLUX de Black Forest Labs, au-delà des images, vers un modèle multimodal « FLUX 3 » intégrant vidéo, audio et robotique.
- LTX-2.5 Is Open Weights - Full Setup and Test on ComfyUI — 18 août 2026 — https://www.youtube.com/watch?v=sIOC9pzHzjs — Installe et teste dans ComfyUI « LTX-2.5 », modèle de génération vidéo de 22B de paramètres avec audio synchronisé, publié par Lightricks avec des poids ouverts.
- New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local) — 12 août 2026 — https://www.youtube.com/watch?v=pA2BQw9LY8A — Exécute LTX-2.5 localement et insiste sur sa rapidité de génération.
- Z Image Undistilled Just Dropped | Day 0 Review — entre novembre 2025 et février 2026 environ (date de publication incertaine) — https://www.youtube.com/watch?v=mtk4IL-Bv28 — Test Day 0 de la version Undistilled de « Z-Image », un modèle d’image open source léger sous licence Apache-2.0.
Signaux
- Le camp open source est particulièrement dynamique : parmi les vidéos de cette étape publiées dans les 60 derniers jours (fin juillet à septembre 2026), hormis Grok Imagine 2.0 côté propriétaire (août), Qwen-Image-2.1 (20 septembre), le projet FLUX 3 (24 juillet) et LTX-2.5 (12 au 26 août, couvert par plusieurs chaînes au même moment) se démarquent. Qwen-Image-2.1 et LTX-2.5 ont notamment reçu plusieurs vidéos de « test Day 0 » et d’installation locale peu après leur sortie, ce qui illustre la réactivité de la communauté.
- La question « peut-il battre ou remplacer Nano Banana (Google) ? » est devenue une formulation standard : aussi bien les vidéos open source (#8, « Better than Nano Banana », et de nombreux autres titres liés à Qwen) que les vidéos propriétaires (#3, « 15x Cheaper Than Nano Banana Pro ») s’appuient sur Nano Banana, la génération d’images Gemini, comme point de référence commun. La gamme Nano Banana de Google est devenue le comparateur de facto du domaine.
- La génération vidéo propriétaire est en train d’être redessinée par le retrait de Sora : Sora 2 a totalement arrêté son application le 26 avril et son API le 24 septembre (#4). Dès lors, les comparatifs à quatre voies entre Veo 3.1, Kling 3.0, Grok Imagine et Runway Gen-4.5 (#5) deviennent le format de référence côté propriétaire.
- Élément surprenant : les vidéos de test des modèles open source de génération vidéo (LTX-2.5, HunyuanVideo 1.5, etc.) mettent davantage l’accent sur les procédures d’installation ComfyUI et les besoins en VRAM que les tests de modèles d’images. L’intérêt porte davantage sur « est-ce que cela tourne sur mon PC ? » que sur les seules performances.
Limites
- Même en ouvrant directement les pages de recherche et les pages vidéo YouTube avec
WebFetch, seules des sections de modèle comme le consentement aux cookies et le pied de page pouvaient être récupérées ; les véritables listes de titres, noms de chaînes, abonnés, vues, dates, descriptions et commentaires restaient indisponibles (plusieurs tentatives, y compris de récupération du JSONytInitialData). Les informations vidéo de ce fichier proviennent donc d’extraits de recherche web et non de pages YouTube directement consultées, conformément au playbook. - Les noms de chaînes, nombres d’abonnés et vues précises n’ont donc pas pu être vérifiés pour chaque vidéo. Parmi les éléments exigés par le playbook dans la section « Videos » — titre, chaîne, date, vues, lien et résumé — les noms de chaînes et vues sont inconnus pour la plupart des vidéos, et les dates sont souvent approximatives car déduites d’extraits de recherche.
- L’objectif du brief, soit environ 20 publications ou vidéos analysées par plateforme, n’a pas été atteint. Comme l’étape d’ouverture des pages vidéo pour vérifier les détails ne fonctionnait pas, l’analyse s’est limitée aux 12 éléments fondés sur les titres et résumés trouvés par recherche web.
- Aucune vidéo YouTube de septembre rapportant directement la fin effective de l’API Sora le 24 septembre n’a été trouvée ; une vidéo de l’annonce initiale de mars (#4) a servi de remplacement. La confirmation vidéo directe de la fermeture achevée en septembre reste non vérifiée.
- Les noms de Matt Wolfe et Wes Roth dans la section Chaînes proviennent d’articles externes les présentant comme chaînes représentatives de ce genre ; il n’a pas été confirmé que les vidéos individuelles #1 à #12 ont été publiées par elles.
Bluesky
Bluesky — Enquête sur les actualités de l’IA de génération d’images et de vidéos (propriétaire / open source)
Comptes
- Midjourney officiel @midjourneyofficial.bsky.social — Le seul compte officiel côté propriétaire qui publie régulièrement. Son contenu porte surtout sur des images et vidéos quotidiennes ou des présentations de fonctions, comme Style Explorer, avec très peu d’annonces réellement importantes.
- Stability AI @stabilityai.bsky.social — Compte officiel du camp des poids ouverts (série Stable Diffusion). Sa dernière publication date du 19 novembre 2025 et annonçait un partenariat avec Warner Music Group ; il est resté inactif depuis, soit environ dix mois sans publication en septembre 2026.
- Black Forest Labs (créateur de FLUX) @blackforestlabs.bsky.social — Le handle est réservé, mais le compte ne contient aucune publication. Il est de fait abandonné.
- Comptes officiels liés à ComfyUI (real-comfyui.bsky.social / comfy-ui.bsky.social) — Aucun ne publie. La communauté ComfyUI ne semble pas disposer de communication officielle sur Bluesky.
- Bot de mises à jour Civitai @civitai-bot.bsky.social (aussi appelé « CivitaiCheckPoint更新BOT », utilisé en japonais) — Bot annonçant automatiquement les mises à jour de checkpoints ajoutés à Civitai. La publication la plus récente trouvée date du 9 mai 2024, sans mise à jour depuis ; l’intégration automatique côté Bluesky semble donc s’être arrêtée.
- Kling AI officiel @klingai.bsky.social — Le handle existe mais ne contient aucune publication.
- Aucun compte primaire officiel n’a été trouvé pour OpenAI, Google DeepMind ou Adobe Firefly ; les résultats renvoient vers des miroirs ou bots non officiels (par exemple
openai-m.extwitter.link,googledeepmind.zpravobot.news.ap.brid.gy) ou vers des comptes personnels d’ambassadeurs et employés actuels.- Chercheurs liés à Stability AI : @markboss.bsky.social (Co-Head of Visual Research), @drscotthawley.bsky.social (ancien de Stability AI)
- Liés à Google DeepMind : @tkipf.bsky.social (mentionne « Veo Capabilities » dans son profil), @jascha.sohldickstein.com (proposeur des modèles de diffusion, indique être passé de DeepMind à Anthropic)
- Créateurs individuels dont l’usage réel d’outils open source a été constaté :
- @you32081.bsky.social — publie des œuvres générées avec Qwen-Image et Z-Image-Turbo
- @andyt79.bsky.social — indique dans son profil utiliser « LTX-2 Qwen Image » et participe aussi à une initiative de partage de prompts Midjourney (#QP)
- @generate-cmyxt.bsky.social — annonce des explications de workflow ComfyUI, Qwen Image Edit, Wan Video et BindWeave (liaison avec X)
Publications
- Publication vidéo Midjourney « Happy Friday! » — 2025-08-22, 64 likes / 4 reposts / 3 réponses. C’est la publication ayant suscité la plus forte réaction parmi celles consultées sur midjourneyofficial.bsky.social, mais elle relève de l’engagement quotidien et non d’une actualité fonctionnelle.
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lwz7idyu4k27 - Annonce de l’extension de Midjourney Style Explorer — 2025-09-10, 10 likes / 1 repost / 1 citation. Présente une fonction permettant d’explorer les styles comme les pages Explore de vidéos et d’images.
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lyj6kbu47k2c - Annonce de l’augmentation par plusieurs fois du nombre de styles dans Midjourney Style Explorer — 2025-09-18, 10 likes / 2 reposts / 1 citation. Mentionne aussi l’ajout d’une recherche floue de styles.
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lz5cskktzk2c - Vidéo Midjourney « Time for some chaos? » — 2025-10-08, 12 likes / 1 repost / 1 marque-page. C’est la publication la plus récente observée, ce qui signifie que le compte est resté sans mise à jour depuis environ un an.
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3m2ndua75gc26 - Midjourney officiel réagit à la publication utilisateur « Odin's Chariot does not exist » — Publication originale du 2025-09-04 par le bot @ttaships.airminded.org, 20 likes / 2 reposts, présentant de l’art généré automatiquement. Midjourney officiel y a répondu ; cela montre que l’interaction avec des bots communautaires constitue une grande part de l’activité réelle du compte officiel.
https://bsky.app/profile/ttaships.airminded.org/post/3lxzwpuriuf2y - Annonce du partenariat Stability AI × Warner Music Group — 2025-11-19, annonce du développement conjoint d’outils de création musicale utilisant des « ethically trained models ». La publication n’a toutefois reçu qu’un like, deux réponses et aucun repost. Même une importante annonce de partenariat de l’un des principaux acteurs open source reçoit donc très peu de réactions sur Bluesky.
https://bsky.app/profile/stabilityai.bsky.social/post/3m5ynoibe3s2k - Bot de mise à jour Civitai « Carrot Caramel Batake updated » — 2024-05-09, notification de mise à jour d’un checkpoint basé sur SD1.5, 3 likes (étiquette pornographique).
https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nnatkqi24 - Bot de mise à jour Civitai « AnimeMixV2 updated » — 2024-05-09, basé sur SD1.5, 2 likes. Ces deux éléments sont les publications les plus récentes visibles du bot, dont les mises à jour Bluesky semblent effectivement arrêtées depuis mai 2024.
https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nn7lydr2y - Les profils de créateurs individuels montrent les forces open weight actuelles — @you32081.bsky.social mentionne Qwen-Image et Z-Image-Turbo ; @andyt79.bsky.social mentionne LTX-2 et Qwen Image ; @generate-cmyxt.bsky.social annonce des explications de workflow ComfyUI + Qwen Image Edit + Wan Video + BindWeave. Le volume de réactions aux publications individuelles n’a pas été vérifié, mais les modèles à poids ouverts effectivement utilisés par les particuliers sur Bluesky en 2026 ont été identifiés précisément.
- Le compte officiel Black Forest Labs ne compte aucune publication — Le compte officiel de l’entreprise qui développe la série FLUX, aujourd’hui parmi les modèles de génération d’images à poids ouverts les plus importants, existe mais n’a jamais publié. La communication sur la pointe de l’open source semble probablement concentrée en dehors de Bluesky, sur X, GitHub, Discord, etc.
https://bsky.app/profile/blackforestlabs.bsky.social
Signaux
- La communication Bluesky autour des modèles propriétaires est extrêmement faible. OpenAI, Google DeepMind, Adobe Firefly, Runway, Kling AI et Ideogram n’ont, dans les limites de l’enquête, aucun compte officiel primaire réellement actif ; seulement des miroirs, bots ou comptes vides. Le seul compte qui publiait continuellement, Midjourney officiel, n’a plus été mis à jour depuis octobre 2025, soit environ un an.
- La communication officielle des projets open source est tout aussi stagnante. Stability AI n’a obtenu qu’un like pour une grande actualité de partenariat avec Warner Music Group. Les comptes officiels Black Forest Labs et ComfyUI ne publient pas ; le bot Civitai ne se met plus à jour depuis mai 2024.
- La température réelle du sujet s’observe dans les biographies et publications des créateurs individuels. Les noms de modèles récents à poids ouverts pour l’image et la vidéo — Qwen-Image, Qwen-Image-Edit, Z-Image-Turbo, Wan Video/WanAnimate, LTX-2 et BindWeave — apparaissent comme outils utilisés dans les profils de plusieurs personnes. Ce n’est pas tant une actualité « rapportée » sur Bluesky que la preuve d’un usage discret et continu par les individus.
- Dans l’ensemble, Bluesky n’est pas devenu un lieu de communication primaire de l’industrie de l’IA de génération d’images et de vidéos comme peut l’être X (anciennement Twitter). Les entreprises officielles y ont une présence minimale ; l’activité vient surtout de communautés individuelles d’art IA — partage de créations et de prompts, initiatives #QP — et de communautés japonophones d’illustration IA ou liées à Civitai.
Limites
- L’API de recherche plein texte officielle de Bluesky (
app.bsky.feed.searchPosts) renvoyait systématiquementHTTP 403 Forbiddenvia WebFetch pendant cette session. Les recherches plein texte et comptages par mots-clés tels que « Stable Diffusion » ou « Midjourney » n’ont donc pas été possibles ; l’enquête a utilisé à la placeapp.bsky.actor.searchActors(recherche de comptes) etapp.bsky.feed.getAuthorFeed(historique de publications par compte). Une collecte exhaustive de 20 publications par hashtag ou sujet n’a donc pas été réalisée ; le résultat se fonde sur les historiques des principaux comptes identifiés. - Lors de l’enquête, WebFetch a une fois renvoyé une synthèse formatée différemment de la réponse API réelle, contenant notamment des champs inexistants tels que
data.sample_accounts, lorsqu’il n’était pas explicitement demandé de renvoyer le JSON brut. Toutes les requêtes suivantes ont précisé « verbatim, no summarization » pour récupérer le JSON brut, et ce résultat isolé n’a pas été utilisé dans le rapport. - Aucun compte primaire officiel n’a pu être identifié par recherche de comptes pour Runway, Luma AI, Pika, Hailuo, Ideogram, Leonardo AI, Adobe Firefly, OpenAI (DALL-E/Sora) ou Google DeepMind (Veo/Nano Banana) ; les résultats étaient des miroirs non officiels, ambassadeurs, ou comptes sans rapport. Le fait même que la communication primaire sur Bluesky soit presque absente est donc rapporté comme résultat.
getAuthorFeedne récupère qu’un maximum de 20 publications par compte (sans pagination). L’absence de grande annonce récente dans cet échantillon, telle qu’une nouvelle version de FLUX ou Stable Diffusion, ne permet pas d’affirmer qu’aucune publication de ce type n’existe sur Bluesky.
Lemmy
Lemmy — Tendances récentes de l’IA de génération d’images et de vidéos
Communautés
- !«メールアドレス» — 1 230 abonnés locaux / 5 710 sur le réseau fédéré. Avec 3 utilisateurs actifs quotidiens, 20 hebdomadaires et 67 mensuels, la communauté est assez petite, mais elle publie automatiquement les nouveaux modèles, LoRA et outils issus de Hugging Face / GitHub. C’est la source primaire la plus dense pour la génération d’images et de vidéos open source.
- !«メールアドレス» — Communauté de partage de créations sur la même instance. Elle reçoit plusieurs publications quotidiennes d’art IA SDXL/Flux, mais relève davantage du partage d’œuvres que de l’actualité et convient peu à l’analyse des tendances.
- !«メールアドレス» — Avec 8 531 abonnés, l’une des plus grandes communautés Lemmy d’images IA ; pourtant, nombre de scores sont négatifs et l’audience comme les discussions restent faibles.
- !«メールアドレス» — Communauté généraliste d’actualités technologiques. Les actualités du camp propriétaire, comme le contentieux Midjourney, y sont relayées.
- !ai_reddit (communauté Lemmy de crossposts Reddit) — Reposte les publications de r/ArtificialIntelligence ; l’actualité de la fermeture de l’API Sora a été trouvée par cette voie.
- !«メールアドレス» — Communauté d’annonce d’AI Horde, un service de génération Stable Diffusion distribué et gratuit. Elle reflète les thématiques propres au réseau open source fédéré.
Publications
-
Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing — !«メールアドレス», 2026-09-22, score 13
https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
Qwen-Image-2.1 d’Alibaba reçoit une prise en charge officielle dans ComfyUI. Il est présenté comme un modèle à poids ouverts doté de fonctions d’édition et de sortie transparente. -
Kijai/QwenImage_experimental — Qwen Image 2.1 Fun_controlnet_union — !«メールアドレス», 2026-09-26, score 1
https://huggingface.co/Kijai/QwenImage_experimental/tree/main/model_patches
Correctif de modèle intégrant ControlNet pour Qwen-Image-2.1, publié par le développeur reconnu Kijai. -
PrunaAI/Pruna-Qwen-Image-2.1 — Few-step LoRA adapters — !«メールアドレス», 2026-09-26, score 1
https://huggingface.co/PrunaAI/Pruna-Qwen-Image-2.1
LoRA d’accélération réduisant le nombre d’étapes de génération de Qwen-Image-2.1. -
Cierpliwy/krea2-inpaint-edit — LoRAs for Krea-2-Raw et lvladikov/Krea2-Turbo-Distill-2step-LoRA — !«メールアドレス», 2026-09-26 / 2026-09-13–16, score 0–2
https://huggingface.co/Cierpliwy/krea2-inpaint-edit ・ https://huggingface.co/lvladikov/Krea2-Turbo-Distill-2step-LoRA
LoRA d’édition par inpainting pour le modèle « Krea 2 » de la famille Black Forest Labs, suivis de LoRA d’accélération distillés jusqu’à deux étapes. -
SupraLabs/Supra2-IMG — tiny 100M parameters text-to-image model — !«メールアドレス», 2026-09-22, score 8
https://huggingface.co/SupraLabs/Supra2-IMG
Modèle texte-vers-image ultraléger de seulement 100 millions de paramètres. Un exemple de tendance tournée vers les environnements locaux et modestes. -
Forte hausse des outils de la famille MiniMax H3 (ComfyUI-Fizgig-H3-Tweaks / ComfyUI_MinimaxH3_AutoContext / 3d-Camera-control-H3-Minimax / MiniMax-H3-Image-Training-Adapter / TaoMate-H3-3Step-ComfyUI) — !«メールアドレス», 2026-09-12–09-26, score 1–5
Exemple : https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext (pour la génération de vidéos longues) ・ https://github.com/NyckM/3d-Camera-control-H3-Minimax (contrôle de caméra 3D)
Autour du modèle vidéo à poids ouverts « MiniMax H3 », plus de cinq nœuds d’extension ComfyUI ont été publiés en deux semaines, signe d’un écosystème qui se structure rapidement. -
g3n3rativ3/wan2gp-h3-latent-continue — !«メールアドレス», 2026-09-16, score 1
https://github.com/g3n3rativ3/wan2gp-h3-latent-continue
Ajoute à l’interface de génération vidéo Alibaba « Wan2GP » une fonction de poursuite de génération vidéo depuis un latent. -
The AI Horde has a new Interface, a new Image generation frontend, new backend, and all new documentation! — !«メールアドレス» / !aihorde, 2026-09-19, score 8 / -2
https://haidra.net/an-image-generation-studio-and-documentation-on-aihorde-net/
AI Horde, service distribué où chacun peut fournir de la puissance de calcul afin de générer gratuitement des images de la famille Stable Diffusion, a renouvelé son frontend, son backend et sa documentation. -
OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !ai_reddit, 2026-09-20, score 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/openai-is-shutting_down-soras-api-next-week-while/
Publication indiquant qu’OpenAI cesse de fournir l’API de son IA vidéo Sora alors qu’un concurrent chinois vient de lever 3 milliards de dollars. Elle illustre la redistribution des forces dans la génération vidéo propriétaire. -
OpenAI's Identity Crisis (The Atlantic) — !theatlantic, 2026-03-26, score 2
https://www.theatlantic.com/technology/2026/03/sora-openai-identity-crisis/686544/
Analyse le retrait de Sora comme la conséquence d’une stratégie instable d’OpenAI, qui aurait changé à répétition de fonctionnalités et de modèles économiques en quête de monétisation. Le coût élevé du calcul est présenté comme la principale cause du retrait. -
Midjourney Wants Hollywood Studios to Reveal AI Usage Details (TechCrunch) — !«メールアドレス», 2026-07-05, score 73
https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/
Dans son procès pour droit d’auteur avec Disney, Universal et Warner Bros., Midjourney demande aux studios de révéler entièrement leur usage de l’IA, notamment l’entraînement interne et les prompts. Le conflit de propriété intellectuelle entre grandes entreprises propriétaires s’intensifie.
Signaux
- Les discussions Lemmy sur la génération d’images et de vidéos open source se concentrent presque entièrement dans !«メールアドレス». La plupart ne sont pas des échanges humains, mais des publications automatisées de nouvelles sorties Hugging Face et GitHub, avec presque aucun commentaire : cela ressemble davantage à un flux de versions qu’à de l’actualité débattue.
- Rien que sur les deux dernières semaines (2026-09-12–09-26), quatre familles distinctes de poids ouverts — Qwen-Image-2.1, Krea 2, MiniMax H3 et Wan2GP — ont toutes été mises à jour simultanément avec leurs outils associés, tels que LoRA, nœuds ComfyUI et adaptateurs d’accélération. Le rythme de développement du camp open source dépasse ainsi le volume des sujets propriétaires.
- Sur Lemmy, les sujets propriétaires sont plutôt abordés dans une perspective d’actualité, de contentieux ou de gestion — fermeture de l’API Sora, procès Midjourney contre Hollywood — que dans les communautés techniques, et les discussions évaluant les créations générées elles-mêmes sont rares.
- Scores et nombres de commentaires restent généralement entre un et une dizaine ; en comparaison avec Reddit et X, l’intensité des échanges sur Lemmy est faible.
Limites
- Lemmy a une base d’utilisateurs et un volume de publications réduits ; il n’a pas été possible d’y trouver suffisamment de discussions indépendantes pour satisfaire l’objectif d’environ 20 publications par plateforme. Plus de 20 éléments ont été examinés, mais beaucoup étaient des notifications de sortie par bots avec zéro commentaire, non des conversations actives.
- Des sujets spécifiques aux derniers modèles propriétaires, comme « Nano Banana », « Midjourney v7 », « Gemini génération d’images » ou « Flux 2 », ont été recherchés dans Lemmy et les communautés connexes, mais aucune publication dédiée n’a été trouvée ; les résultats étaient noyés dans des articles technologiques généraux ou contenus sans rapport.
- Des contenus concernant le modèle vidéo open source Alibaba « Wan 2.1 », notamment un article sur son usage dans la pornographie IA, ont été trouvés, mais datent de mars 2025 et ont été exclus car ils sont hors du périmètre de l’actualité récente demandée en septembre 2026.
- L’API de recherche de lemmy.world a renvoyé plusieurs erreurs 500 selon les requêtes, notamment lors de la récupération directe de la communauté
stablediffusionet de certaines publications, ce qui a empêché l’accès à certaines pages.
Pinterest — Actualités de l’IA de génération d’images et de vidéos
30 des 50 épingles collectées ont été ouvertes et lues comme images (le tableau dans
output/pinterest.pins.md est une liste plate, non répartie par sections de genre ; l’analyse a donc été effectuée en un seul passage plutôt que genre par genre).
Thèmes visuels
- Récaps « AI NEWS » au style miniature YouTube, repostés sur Pinterest. Le visage d’un présentateur, avec une expression choquée ou surprise, voisinant avec une rangée de logos lumineux de fournisseurs : OpenAI, Google, Microsoft, la spirale d’Anthropic, l’infini de Meta, le N de Notion.
[1, 20] - Infographies denses de type « les mises à jour X qu’il faut connaître ». Cartes à plusieurs panneaux regroupant plusieurs actualités : GPT-6 Astra, Gemini devenant « agentique » dans Gmail/Docs/Slides, vidéo et son génératifs directement dans la timeline d’Adobe Premiere, levée de série E de 2 milliards de dollars pour Cognition ; une autre dédiée à Google I/O 2026 (Gemini 3.5 Flash, Gemini Omni, AI Overviews remplaçant la recherche, lunettes Android XR).
[22, 35] - Listes « Top N des générateurs vidéo IA », qui reprennent toujours la même sélection — Kling AI, Runway, Pika, Luma Dream Machine, HeyGen, Hailuo AI, Google Veo, OpenAI Sora, Synthesia, D-ID — présentée sous forme de graphismes de smartphone ou d’affiches pour des blogs SEO ou affiliés.
[27, 47, 49] - Illustrations héroïques de robots humanoïdes utilisées comme décor générique sur les épingles promouvant des outils : mains robotiques chromées tenant un logo OpenAI, androïde orange derrière un moniteur, cyborg femme moitié humaine moitié circuits.
[16, 21, 41] - Images jouant sur l’anxiété autour des deepfakes et de la désinformation : extrait siglé NBC News marqué « AI GENERATED » montrant une fausse correspondante dans la neige, graphique en écran partagé « Human Journalism vs. Machine-Generated Media », robot portant la mention « FAKE » à côté d’une photo de chat IA avec de faux chiffres d’engagement, démon « AI » manipulant des zombies accros au téléphone, et photo synthétique de Trump faisant un pouce levé dans un cockpit avec une image du 11 septembre en arrière-plan.
[4, 19, 26, 30, 44] - Démos techniques de cohérence stylistique : une même vidéo est réinterprétée cinq fois — blocs de bois, origami, briques Lego et versions couvertes de fleurs — à partir de la même personne et de la même voiture, avec filigrane d’un modèle vidéo, montrant la transformation multi-style depuis un clip source.
[2] - Publicités de services de vidéo IA pour petites entreprises : visuels avec contact WhatsApp de freelances ou agences proposant de la « génération vidéo IA avec Gemini » ou de la « création vidéo IA professionnelle », profitant de la tendance plutôt que rapportant l’actualité.
[9, 24, 37] - Photographies corporate génériques sans contenu IA réel, malgré des titres proches du sujet : équipe de bureau devant un ordinateur portable, père et fils intégrés dans un mur de souvenirs lumineux, portrait d’un vieux pêcheur pour une publicité « Amuse 3.0 » (générateur d’images local d’AMD, identifiable seulement grâce à un petit logo).
[13, 28, 40, 45]
Épingles notables
- [1] « AI News: Anthropic Leak Shows Us The Future of AI... » — Format générique de miniature avec présentateur, regroupant OpenAI/Google/Microsoft/Anthropic ; le titre promet une fuite Anthropic, mais l’image ne donne aucun détail précis.
- [2] « Just Nail It 🎥 » — Grille 3 × 5 transformant une vidéo source d’une personne et d’une voiture en styles blocs de bois, origami, Lego et fleurs, avec le filigrane d’un modèle vidéo nommé « Lumiere » : la démonstration de produit la plus concrète de l’ensemble.
- [10] « Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API » — Modèle propriétaire de Google, mettant en avant vitesse et audio natif.
- [14] « Kling.ai AI-Powered Text-to-Video Generation » — Outil chinois propriétaire de Kuaishou, présenté comme un « choix de premier plan » aux côtés d’outils occidentaux.
- [15] « ByteDance and Hollywood reach global deal on AI copyright » — Accord ByteDance/MPA visant à renforcer la protection de la propriété intellectuelle dans les outils IA d’image et de vidéo de ByteDance ; une rare actualité juridique et réglementaire dans l’ensemble.
- [23] « Google's Gemini Omni Turns Anything Into Video » — Repost d’une agence, Osiz Technologies, de l’annonce du modèle Omni de Google.
- [30] « AI news videos blur line between real and fake reports » — Extrait siglé NBC News marqué « AI GENERATED » montrant une fausse correspondante dans la neige, utilisé pour illustrer directement le problème de confiance.
- [34] « Google Makes AI Watermarks Optional for Images and... » — Le titre suggère que Google assouplit les exigences liées aux filigranes SynthID.
- [35] « 4 Major AI Updates You Need to Know in 2026 » — Infographie couvrant GPT-6 Astra, la poussée agentique de Gemini, les médias génératifs dans la timeline d’Adobe Premiere et la levée de 2 milliards de dollars de Cognition pour une valorisation de 48 milliards.
- [43] « Stability AI's Stable Diffusions Maker Can Now Build AI Generative Video » — La seule épingle mentionnant spécifiquement une lignée open weight, Stability AI, pour la vidéo.
Signaux
- Ce qui est actuel : l’offre Pinterest sur ce thème est dominée par l’agrégation secondaire — récapitulatifs d’actualité au style miniature YouTube, listes affiliées classant la même douzaine d’outils vidéo et infographies explicatives — plutôt que par des annonces de première main ou des générations pratiques. Les outils chinois propriétaires, Kling et Hailuo, sont mis sur un pied d’égalité avec les outils occidentaux, Veo, Sora et Runway, dans chaque liste examinée. L’anxiété liée aux deepfakes et à la désinformation constitue un genre visuel récurrent à part entière (présentateurs fictifs, images politiques fabriquées, graphiques « humain contre machine » dans le journalisme), ce qui suggère que c’est davantage ce ressort émotionnel que les outils eux-mêmes qui nourrit l’engagement.
- Ce qui est absent : malgré la force habituelle de Pinterest en tant que plateforme de tableaux d’inspiration et de création, aucune épingle ne présentait de workflow open source réel — aucune capture ComfyUI, aucun contenu LoRA ou de fine-tuning, aucun lien avec Flux, SDXL, HunyuanVideo ou Wan, ni aucun tableau esthétique de communauté d’artistes. Une seule épingle (
[43]) mentionnait une lignée open source, et seulement par la marque Stability AI, pas par modèle ou technique. Le travail d’image ou de vidéo d’Anthropic n’apparaît pas non plus, bien que la marque soit citée dans le titre[1]. Les publicités de petites entreprises et freelances pour des « services vidéo IA » sont plus fréquentes que l’actualité réelle des produits.
Limites
- 30 des 50 épingles collectées ont été lues (60 %) ; les 20 restantes n’ont pas été ouvertes faute de temps, de sorte que certains éléments notables peuvent être sous-représentés.
- Le tableau des épingles ne comporte pas de sections par genre et se présente comme une liste plate sous une seule recherche ; ce récapitulatif n’a donc pas pu être réparti par genre, comme le playbook l’autorise pour les exécutions multi-genres.
- 12 des 50 épingles n’ont aucun titre (« (untitled) ») ; plusieurs se sont révélées être des photographies de stock génériques, avec un contenu IA seulement incident ou inexistant. L’index de titres seul ne constitue donc pas un signal très fiable de pertinence.
- Les titres penchent vers du SEO ou de l’affiliation en anglais approximatif (« AI For Image And video Generation », « AI black GPT »), ce qui correspond aux images vues, mais signifie que plusieurs titres « notables » promettent davantage de précision que l’épingle liée n’en offre réellement.
Actions recommandées
- Relancer l’étape de collecte X avec des mots-clés explicites (Midjourney, Sora 2, Stable Diffusion, etc.) plutôt que des mots-clés tendance
- Surveiller en priorité les familles à poids ouverts, comme Qwen-Image-2.1 et LTX-2.5, dont l’écosystème s’élargit très vite dès la publication
- Continuer à suivre les cas où l’utilisation non déclarée de contenus générés par IA mène à des licenciements, procès ou réglementations
- Observer régulièrement le rapport de force entre Veo, Kling, Runway et Grok Imagine après le retrait de Sora
- Puisque la communication officielle d’entreprise fonctionne à peine sur Bluesky, limiter l’enquête aux profils de créateurs individuels
Images collectées


















































Note sur la qualité des données
X n’a collecté que des publications sans rapport via des mots-clés tendance et ne fournit donc pratiquement aucune donnée utile. Reddit, YouTube, Bluesky et Pinterest n’ont pas non plus atteint l’objectif d’environ 20 éléments ; YouTube et Bluesky ont dû modifier leur méthode de collecte en raison de contraintes techniques (blocage WebFetch et API de recherche renvoyant 403).



