Actualités de l’IA de génération d’images et de vidéos — 2026-09-20
Les modèles open source — notamment les modèles chinois Qwen, Wan et MiniMax-H3 — gagnent rapidement en importance comme solution de repli lorsque les quotas gratuits des modèles fermés sont épuisés. En revanche, la phase X n’a pas fourni de données en raison de requêtes de recherche sans rapport avec le sujet : cette édition repose donc, dans les faits, sur cinq plateformes seulement.
Récapitulatif des actualités de l’IA de génération d’images et de vidéos — fermé vs open source — 2026-09-20
Salut ! Cette fois, j’ai passé en revue à toute vitesse six plateformes — Reddit, X, YouTube, Bluesky, Lemmy et Pinterest 🔥🔥 En bref : les acteurs fermés (Google Veo/Nano Banana, Sora 2, Midjourney, Kling, Seedance, etc.) restent les vedettes de l’actualité, et la synchronisation audio est vraiment en train de devenir une fonctionnalité standard. Mais les acteurs open source, surtout Qwen, Wan et MiniMax-H3 venus de Chine, rattrapent leur retard à une vitesse folle et s’imposent clairement comme l’« échappatoire » des utilisateurs dont les quotas gratuits sont épuisés 🚀 Un autre point important, plus discret : le rejet des contenus générés par IA est plus fort dans les espaces fréquentés par le grand public que dans les communautés de passionnés d’IA 😤. Cela dit, soyons honnêtes : la phase X a été un échec complet, donc les fondations de ce rapport couvrent en pratique cinq plateformes 🙏
Toutes plateformes confondues
- La dynamique des acteurs open source ne ralentit vraiment pas : Reddit (Wan, Minimax H3 et Krea2 sont cités dans plusieurs fils comme alternatives une fois les quotas gratuits des outils fermés épuisés), Lemmy (plus de 15 publications d’outils ComfyUI pour MiniMax-H3 dans la communauté
!stable_diffusionau cours du seul mois de septembre) et YouTube (Qwen-Image → Qwen-Image-2512 → Z-Image, Wan 2.5 → 2.6 → 2.7, avec des mises à jour presque mensuelles) racontent la même histoire. « Open source = haute qualité gratuite » est en train de devenir la norme de fait 💪 - La génération vidéo fermée intègre désormais le son par défaut : Bluesky (audio synchronisé de Kling 3.0 annoncé par Replicate, intégration audio-vidéo de Seedance 2.0) et YouTube (Grok Imagine 1.5 présenté comme générant simultanément dialogues et sons ambiants) confirment la même évolution 🎬🔊
- La famille Veo/Nano Banana de Google est devenue le “visage” du monde fermé : Pinterest (des visuels Veo chaleureux façon Pixar réutilisés à répétition dans des épingles virales), YouTube (Theo - t3.gg affirme que « Google a gagné la génération d’images ») et Reddit (l’élargissement des quotas gratuits de Google Flow) l’ont confirmé de trois façons distinctes 👀
- Le rejet des contenus générés par IA explose au-delà des communautés pro-IA : Reddit (354 points de colère après l’acceptation d’œuvres IA par ArtPrize, 63 points pour les plaintes face aux objectifs de production massive d’images IA au travail), Lemmy (la communauté anti-IA
!fuck_aicompte 9 179 utilisateurs actifs mensuels, parmi les plus grandes de Lemmy) et Pinterest (les quiz « réel ou IA » sont devenus une catégorie à part entière) transmettent tous la même atmosphère 😨 - Les informations de première main circulent davantage via des individus que via les entreprises : sur Bluesky, les comptes officiels d’entreprises sont presque silencieux ; les sources sont des chercheurs indépendants comme Simon Willison et des hébergeurs tels que Replicate. Sur YouTube aussi, les récapitulatifs hebdomadaires de chaînes individuelles (AIPOD-CAST, Lev Selector) servent de sources d’actualité. Le peu de canaux où les entreprises publient elles-mêmes directement semble être une tendance commune 📢
Plateforme par plateforme
Reddit : 12 fils collectés dans 9 subreddits (sans atteindre l’objectif de 20). Dans plusieurs fils, les outils open source (Wan, Minimax H3, Krea2) reviennent comme solution de repli quand les quotas gratuits des services fermés sont épuisés. Les avis sur GPT Image 2.5 Flare sont très partagés : certains le trouvent « incroyable », d’autres disent qu’il donne le même résultat que Krea2 😂 Le point le plus surprenant est que les communautés généralistes (réaction à ArtPrize : 354 points) et professionnelles (plaintes de designers : 63 points) se sont révélées plus actives que les subreddits purement techniques.
X : honnêtement, c’est un accident complet 🙈 Les 40 publications collectées ne faisaient que rechercher des tendances générales liées à la zone de connexion (autour de la Croatie), comme « Greenland », « #Bitcoin » ou « Chelsea ». Aucune publication sur la génération d’images ou de vidéos par IA n’a été trouvée. Il n’a donc été possible d’en tirer aucune observation sur les modèles fermés ou open source. C’est une lacune nette sur une plateforme explicitement demandée dans le brief 🕳️
YouTube : 12 vidéos examinées. Les acteurs fermés (Theo, Astrovah, Woollyfern, spécialisé dans les mises à jour mensuelles de Midjourney, et FixNode) et open source (Bijan Bowen, HitPaw, MaxonShire, Promptus AI) sont bien séparés. Les seconds mettent en avant « ComfyUI », l’exécution locale et la gratuité ; les premiers privilégient la qualité et les fonctionnalités. En revanche, le caractère très dépendant de JavaScript des pages de résultats a empêché de récupérer presque toutes les données de vues et d’abonnés 😅
Bluesky : comme l’API officielle de recherche renvoyait continuellement des erreurs 403, la collecte a été réorientée vers les publications de chercheurs indépendants (Simon Willison, Max Woolf, Ethan Mollick) et du compte officiel de Replicate. Presque toutes les publications recueillies portent alors sur des modèles fermés (GPT Image 2, Runway Gen-4.5, Kling 3.0, Seedance 2.0, Vidu Q3), sans trouver de compte communautaire open source encore actif ; le seul compte approchant semblait inactif depuis février 2025. Le fait que l’image d’un pélican à vélo soit devenue un mème récurrent de comparaison de modèles est également amusant 🐦🚲
Lemmy : c’est la plateforme où l’équilibre entre open source et fermé est apparu le plus net. Côté open source : déferlement MiniMax-H3 dans !stable_diffusion et nouveau modèle Boogu-Image-0.1 (Apache-2.0, 10 milliards de paramètres). Côté fermé : Nano Banana 2 Lite de Google, MAI-Image-2.5 de Microsoft, expériences de récits longs avec Sora 2 et l’étonnante nouvelle selon laquelle Midjourney se tournerait vers les spas médicaux 😲 La présence marquante de la communauté anti-IA !fuck_ai (8 252 membres) est aussi une découverte propre à Lemmy.
Pinterest : 30 des 50 épingles précollectées ont été vérifiées avec leurs images. Les listes d’outils fermés et les miniatures « AI NEWS » réutilisées y sont produites en masse, tandis que l’open source est pratiquement absent — seul Amuse 3.0, un outil local, apparaît une fois. Les vidéos Google Veo sont beaucoup réutilisées, et les quiz demandant si une image est réelle ou générée par IA se sont clairement constitués en genre 🎨
À surveiller
- L’augmentation rapide des outils ComfyUI pour MiniMax-H3 (Lemmy
!stable_diffusion, exemple : https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS) — un nouveau candidat au rôle principal de la génération vidéo open source 🔥 - Le problème de « production memory » de Sora 2 (via Lemmy/Reddit, https://lemmy.durstig.online/post/59922) — préserver la cohérence des récits longs semble être le prochain obstacle, au-delà des clips isolés
- L’hypothèse d’une domination de Google Nano Banana Pro (YouTube, Theo - t3.gg, https://www.youtube.com/watch?v=UV9GqinedQ8) — vraiment au point de ne plus avoir besoin de Photoshop ? À suivre
- Le débat GPT Image 2.5 Flare contre l’open source Krea2 (Reddit, https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/) — la supériorité même des offres payantes commence à être remise en question
- L’acceptation des œuvres IA par ArtPrize (Reddit r/grandrapids, https://www.reddit.com/r/grandrapids/comments/1wi4ub0/) — pourrait devenir un indicateur de la limite d’acceptation dans la société en général
- La reconversion de Midjourney vers les spas médicaux et la demande de divulgation à Hollywood (Lemmy, https://lemmy.zip/post/66397234 、https://lemmy.today/post/56011946) — des risques apparaissent pour la crédibilité de l’entreprise
Recommandations
- Refaire la collecte X avec des requêtes directement liées au thème, telles que "Sora 2", "Midjourney", "Stable Diffusion", "Runway Gen", "Kling AI" et "open source image generation".
- Ajouter systématiquement MiniMax-H3, Qwen, Wan et Z-Image, acteurs open source chinois, à la liste de surveillance afin de suivre leur fréquence de sortie.
- Continuer à suivre les réactions des communautés généralistes et professionnelles, pas seulement des communautés spécialisées en IA, car elles émettent des signaux forts de rejet.
- Tester avant la prochaine édition des solutions de contournement au problème 403 de l’API officielle de recherche Bluesky.
- Suivre les développements du problème de « production memory » de Sora 2 et de la reconversion de Midjourney vers les spas médicaux lors de la prochaine collecte.
- Réaliser la collecte Pinterest avec des balises de genre pour pouvoir classer mécaniquement les contenus en open source ou fermé.
Qualité des données
La phase X n’a fourni aucune donnée réellement utilisable : les requêtes de recherche portaient sur des sujets sans lien avec le thème (géopolitique, cryptomonnaies, football, etc.), et aucune des 40 publications recueillies n’était pertinente. Reddit (12 éléments) et Bluesky (environ 12 éléments extraits via des comptes individuels à cause du blocage de l’API de recherche) n’atteignent pas le critère de fin du brief, soit environ 20 publications par plateforme. Pinterest et YouTube présentent également certaines contraintes : Pinterest ne comportait pas de balises de genre et n’a pas été exploré en direct ; YouTube n’a pas permis de récupérer les données de vues ou d’abonnés en raison de JavaScript. Les données recueillies sont toutefois suffisantes pour le résumé. Lemmy et YouTube se sont révélés relativement solides et ont fourni des observations concrètes sur les deux camps.
Récapitulatif par plateforme
Reddit — Actualités de l’IA de génération d’images et de vidéos
Où
Les 12 fils recueillis proviennent de 9 subreddits.
| Subreddit | Nombre de membres | Nombre de fils collectés |
|---|---|---|
| r/generativeAI | 154,961 | 4 |
| r/graphic_design | 2,929,382 | 1 |
| r/GeminiAI | 375,783 | 1 |
| r/grandrapids | 161,719 | 1 |
| r/aitubers | 28,785 | 1 |
| r/ImagineAiArt | 19,335 | 1 |
| r/AIToolTalks | 6,757 | 1 |
| r/aifilmmaking | 8,200 | 1 |
| r/aivideomaking | 7,267 | 1 |
r/generativeAI est le principal hub consacré à la génération d’images et de vidéos par IA (4 éléments). r/GeminiAI et r/ImagineAiArt recueillent les retours d’expérience sur les modèles fermés ; r/aifilmmaking et r/aivideomaking abordent la production vidéo d’un point de vue pratique ; r/grandrapids et r/graphic_design montrent les réactions lorsque les contenus générés par IA se confrontent au monde réel (concours artistiques, travail) ; r/AIToolTalks sert d’espace d’expression aux inquiétudes sur l’IA en général.
Ce que disent les gens
- Fil 1 « Which AI video generator can still be used for free? » (r/generativeAI, 18 points, 57 commentaires, 2026-09-16) https://www.reddit.com/r/generativeAI/comments/1whtesl/ — La génération open source et locale (Wan, Minimax) constitue une solution de repli après épuisement des quotas gratuits des outils fermés. u/RioMetal : « If you can go local you have plenty of them, like Wan or Minimax »
- Fil 2 « GPT Image 2.5 Flare — is this actually the best AI image generating model right now? » (r/ImagineAiArt, 84 points, 60 commentaires, 2026-09-16) https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/ — Avis très divisés. u/oldboi777 salue une « incredible upgrade », tandis que u/SeaworthinessFresh16 estime que « The result in Comfyui with Krea2 looks the same ».
- Fil 12 « Need a good video generation AI for image to video of people » (r/generativeAI, 0 point, 22 commentaires, 2026-09-15) https://www.reddit.com/r/generativeAI/comments/1wh1y9d/ — Le fil porte surtout sur l’insatisfaction envers les filtres de modération de Google Flow / Nano Banana Pro. u/f5alcon affirme que « Minimax H3 is the best local generator » et u/jworm0624 recommande « Krea 2 turbo for images, minimax h3 for videos. All on comfyui », mettant en avant les alternatives open source.
- Fil 7 « Google Flow is giving creators a surprisingly generous amount of free AI video generation right now » (r/aifilmmaking, 8 points, 7 commentaires, 2026-09-14) https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ — Google Flow/Veo, modèle fermé, a augmenté ses crédits gratuits et évolue de la simple génération texte-vers-vidéo vers un espace de production permettant construction de scènes, contrôle caméra et référence à des éléments. Mais u/MrBoondoggles note aussi : « I'm not surprised Google is giving away Veo at this point... trying to maintain some interest in their product ».
- Fil 8 « Did Anyone Notice Sudden Quality Drop of Image Generation? From 2 MB to 500 KB » (r/GeminiAI, 10 points, 25 commentaires, 2026-09-17) https://www.reddit.com/r/GeminiAI/comments/1wj02p4/ — Une baisse de qualité est signalée sur Gemini (PNG → JPEG, 8 Mo → 2 Mo → 500 Ko), y compris par des utilisateurs payants. u/Well_HellooF : « there's no difference in quality between the free version and the paid one. suck »
- Fil 5 « ArtPrize Allows Generative AI » (r/grandrapids, 354 points, 176 commentaires, 2026-09-16) https://www.reddit.com/r/grandrapids/comments/1wi4ub0/ — Forte réaction contre l’acceptation d’œuvres générées par IA dans un concours artistique. u/Chirotera (319 points) : « Fucking disgusting. It is not AI "Art," it's fucking theft. » La colère dans les communautés généralistes est plus forte que dans les communautés techniques.
- Fil 10 « Company expects us to generate 500 AI images PER WEEK. Is this realistic? » (r/graphic_design, 63 points, 133 commentaires, 2026-09-17) https://www.reddit.com/r/graphic_design/comments/1wieke2/ — Des designers sur le terrain dénoncent des objectifs de production massive au moyen d’outils fermés comme ChatGPT. u/Diligent-Educator409 (123 points) : « 500 AI images? Yes. 500 good AI images? No. 1 good AI image? Also no. »
- Fil 9 « best apps for generating AI videos » (r/aitubers, 0 point, 46 commentaires, 2026-09-14) https://www.reddit.com/r/aitubers/comments/1wg3duk/ — Il existe une demande pour les outils fermés produisant automatiquement des vidéos à partir d’un script (InVideo AI, Steve AI, etc.), mais la réaction de la communauté est froide. u/RobJames007 (15 points) : « Youtube is trying to reduce AI slop, not allow more of it onto the platform. »
- Fil 3 « Please help me generate free ai video without subscription » (r/aivideomaking, 0 point, 20 commentaires, 2026-09-15) https://www.reddit.com/r/aivideomaking/comments/1wh80z3/ — u/Chance-Business indique que « google flow you get 50 free credits per day, each vid is 6-12 credits », tandis que u/Bastisheen92 répond que « Local Generation is free if you already own the Hardware » : le contraste classique entre quota gratuit fermé et exécution locale open source.
- Fil 11 « Are all of you also anxious about recent news about AI? » (r/AIToolTalks, 12 points, 36 commentaires, 2026-09-13) https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ — Le sujet n’est pas directement la génération d’images ou de vidéos, mais les inquiétudes liées à la consommation d’eau, aux pertes d’emploi et à la réglementation de l’IA. Les commentaires opposent fortement les points de vue.
Signaux
- Tendance à la hausse : les noms de modèles open source et locaux comme Wan, Minimax H3, LTX Video et Krea2 apparaissent de manière répétée dans plusieurs fils distincts (1, 2, 12), dans le même contexte : une alternative après l’épuisement des quotas gratuits des services fermés. La génération locale devient synonyme de « haute qualité gratuite ».
- Minimisés ou tournés en dérision : le cynisme est fort envers les services de génération vidéo fermés qui promettent la gratuité. Dans plusieurs fils (1, 4, 6, 12), le compte bot u/Jenna_AI publie des commentaires ironiques de même nature : ils annoncent du gratuit, mais finissent par pousser au paiement.
- Point surprenant : les communautés généralistes (r/grandrapids, 354 points et 176 commentaires) et professionnelles (r/graphic_design, 63 points et 133 commentaires) affichent davantage d’engagement que les subreddits techniques d’IA, souvent entre un et quelques dizaines de points. Les débats s’intensifient lorsque les contenus IA touchent le quotidien ou le travail.
- Conflit d’opinions : GPT Image 2.5 Flare est qualifié d’« incredible upgrade » par u/oldboi777 mais jugé comparable à Krea2 par u/SeaworthinessFresh16. Pour Google Flow/Veo, les crédits gratuits généreux côtoient des critiques comme « it's weak at physics and logic. Even Minimax is far better » de u/Sea-Temporary-6995.
Limites
- Seulement 12 fils ont été recueillis, en dessous du critère de fin du brief, qui visait environ 20 publications analysées par plateforme. Les 12 éléments collectés constituent toutes les données disponibles pour Reddit à ce stade ; les instructions du playbook interdisaient toute recherche ou navigation Reddit supplémentaire.
- La requête utilisée était uniquement l’anglais « Image and Video Generation AI News ». Rien n’indique que des requêtes japonaises ou orientées « open source » et « fermé » aient été tentées.
- Certains subreddits — r/aitubers, r/aivideomaking et r/AIToolTalks notamment — ne sont représentés que par un seul fil ; il est donc impossible d’évaluer solidement leurs tendances internes.
X
X — Actualités de l’IA de génération d’images et de vidéos (fermé/open source)
Comptes
Les 39 comptes et 40 publications réunis dans output/x.posts.md sont tous sans rapport avec la génération d’images ou de vidéos par IA. Les requêtes étaient « Greenland », « Denmark », « #Bitcoin », « NATO », « Christ », « Jubjub », « Charles », « Bosnia », « Chelsea » et « Belgrade » : il s’agit de tendances générales d’Explore propres à X, associées à la géolocalisation de la connexion du serveur autour de la Croatie. Aucune requête ne se rattache au brief de recherche.
Il n’existe donc dans ces données aucun compte permettant de répondre à la question de savoir qui porte ce sujet sur X. Voici seulement ce qui a été collecté :
- Groupe politique/géopolitique : @RapidResponse47 (30 291 likes, sujet Groenland), @AJENews, @Rusia_HD, @Globalsurv, @NepCorres et autres, avec des publications d’actualité ou d’opinion sur le Groenland, le Danemark et l’OTAN.
- Groupe cryptomonnaies : @aacryptoverse, @Bitcoin_Pirate_, @StackandRun, @bitcr_org et autres, avec des publications sous le hashtag #Bitcoin, généralement de faible portée.
- Groupe ragots royaux : @barristerlawusa, @hernandez_64876, @thebluestshade, @Rimmesfk, autour du livre de révélations de Charles Spencer.
- Groupe football : @icunga_, @john322226, @Cfc_Kemboi, @Pats_Aura, avec « Chelsea » renvoyant aux résultats du Chelsea FC.
- Groupe mèmes/discussions : @SardineKing_O, @isellbeforeyou, @0xHeatt, autour du memecoin « $jubjub », ainsi que deux publications de discussion en serbe par @MarquiseDeBelgr.
Chaque compte ne publie qu’une ou deux fois, sans compte dominant. Une publication de @RapidResponse47, avec 30 000 likes et environ 6,8 millions de vues, ressort nettement, mais concerne la souveraineté du Groenland et n’a aucun lien avec le sujet.
Publications
Parmi les 40 publications collectées, zéro mentionne l’IA de génération d’images ou de vidéos, qu’elle soit fermée ou open source. Il n’existe donc aucune publication représentative à présenter. À titre indicatif, voici celle qui a suscité le plus d’engagement, en précisant qu’elle est hors sujet :
- @RapidResponse47 (hors sujet, référence) — 30,291 likes, 5,022 republications, 1,164 réponses, environ 6,800,000 vues, 2026-09-18. https://x.com/RapidResponse47/status/2101059494587285834 — trouvée avec la recherche « Greenland ». Publication politique sur le statut du Groenland, sans lien avec les images ou vidéos générées par IA.
Signaux
- Dans cette phase X, aucune mention, discussion ou actualité concernant Midjourney, Sora, Runway, Stable Diffusion, Flux, Wan, Kling ou d’autres outils de génération d’images et de vidéos par IA n’a été relevée dans les données. Il n’existe donc même pas de base permettant de déterminer ce qui est ou non discuté.
- Les requêtes utilisées correspondent exactement aux titres de la liste « X's own Explore list » au début de
output/x.posts.mdet semblent simplement refléter les tendances locales de X au niveau de la connexion autour de la Croatie. - Par conséquent, cette phase ne permet d’extraire aucune observation, ni sur les modèles fermés, ni sur les modèles open source.
Limites
- La collecte elle-même ne correspond pas au thème. Les dix requêtes de
output/x.posts.mdne concernent pas la génération d’images ou de vidéos par IA, mais des tendances géopolitiques, royales, sportives et liées aux cryptomonnaies. - Les 40 publications ont été analysées, mais aucune ne portait sur le thème.
output/x.posts.jsoncontient les mêmes données et n’apporte aucun indice supplémentaire.- La seule conclusion possible pour cette phase est qu’aucune observation liée aux modèles fermés ou open source ne peut être rapportée à partir des requêtes et publications collectées. Une nouvelle collecte thématique est nécessaire, avec par exemple « Sora 2 », « Midjourney », « Stable Diffusion », « Runway Gen », « Kling AI », « Flux » ou « open source image generation ».
YouTube
YouTube — Dernières évolutions de la génération d’images et de vidéos par IA (fermé/open source)
Chaînes
Plutôt fermées
- Theo - t3.gg (@t3dotgg) — analyse technique de Google Nano Banana Pro
- Astrovah (@astrovah) — critiques et cas d’usage de Sora 2
- Woollyfern (@woollyferncreative) — chaîne spécialisée dans les mises à jour mensuelles de Midjourney
- FixNode (@Fixnode1) — tutoriel Runway Gen-4.5
- Higher E-Learning (@higherelearning) — évaluation des modèles intégrés à Adobe Firefly
- AIPOD-CAST (@AIPOD-CAST) — récapitulatif hebdomadaire des actualités IA
- Lev Selector (@lev-selector) — récapitulatif hebdomadaire des mises à jour IA
Plutôt open source
- Bijan Bowen (@Bijanbowen) — tests locaux de Qwen Image
- HitPaw Edimakor (@HitPawEdimakorOfficial) — critiques et guides sur la série Wan
- MaxonShire (@MaxonShire) — comparaisons de modèles vidéo open source
- Promptus AI (@promptusai) — guides d’installation locale de nouveaux modèles comme Z-Image
- 黎黎原上啃 / SweetValberry (@SweetValberry) — explications destinées au public sinophone, notamment sur FLUX.1 Kontext
Les nombres d’abonnés n’ont pu être récupérés sur aucune page de chaîne ; leur taille relative n’a donc pas pu être vérifiée.
Vidéos
-
« Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN » — Theo - t3.gg, date de publication inconnue, vues inconnues
https://www.youtube.com/watch?v=UV9GqinedQ8
Soutient que la génération d’images de Nano Banana Pro, basé sur Gemini 3 Pro, atteint un niveau rendant Photoshop inutile et devance nettement les autres modèles fermés. -
« Sora 2 - An Honest Review As Well As 20 Creative Use Cases To Try » — Astrovah, 2025-10-07, vues inconnues
https://www.youtube.com/watch?v=pJHWIgri5vk
Évalue Sora 2 comme « la vidéo IA la plus réaliste à ce jour » et propose 20 cas d’usage pratiques. -
« Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More! » — Woollyfern, juillet 2026, vues inconnues
https://www.youtube.com/watch?v=dvfH5HzCARY
Explique que Midjourney V8.2 ajoute la personnalisation et un créateur de styles pour NIJI. -
« I Tested Every AI Video Model in Adobe Firefly So You Don't Have To (July 2026) » — Higher E-Learning, juillet 2026, vues inconnues
https://www.youtube.com/watch?v=nOSYufWVdq8
Compare Veo 3.1, Kling 3.0, Runway Gen-4.5 et Sora 2, intégrés à Adobe Firefly. -
« Ultimate Runway Gen 4.5 Tutorial For New Users in 2026 » — FixNode, 2026-03-29, vues inconnues
https://www.youtube.com/watch?v=IUge3u4ZrqQ
Tutoriel de génération image-vers-vidéo avec Runway Gen-4.5, mettant en avant un rendu cinématographique. -
« Episode 222: Weekly AI News Summary - 6 September 2026 » — AIPOD-CAST, 2026-09-06, vues inconnues
https://www.youtube.com/watch?v=8f34nSLdNtk
Récapitulatif hebdomadaire couvrant modèles, agents et enjeux d’entreprise, avec des actualités sur la génération d’images et de vidéos. -
« Exciting AI Updates Weekly - September 18, 2026 » — Lev Selector, 2026-09-18, vues inconnues
https://www.youtube.com/watch?v=Utu4zIcqPtM
Récapitulatif rapide, par une chaîne individuelle, des mises à jour IA de la semaine précédente ; la publication la plus récente du périmètre étudié. -
« Qwen Image-2512 First Test – The BEST Open Source Image Model! » — Bijan Bowen, date inconnue, vues inconnues
https://www.youtube.com/watch?v=SBaK616nP6Q
Teste localement Qwen-Image-2512 d’Alibaba, doté de 20 milliards de paramètres, et le présente comme le meilleur modèle d’image open source disponible. -
« Wan 2.6 Review | How to Use Wan 2.6 for Free | New AI Video Generator Tutorial » — HitPaw Edimakor, date inconnue, vues inconnues
https://www.youtube.com/watch?v=6FMisTHYYgA
Présente Wan 2.6 d’Alibaba et son utilisation gratuite, avec plusieurs modes, dont T2V, I2V et R2V. -
« HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model? » — MaxonShire, 2026-06-25, vues inconnues
https://www.youtube.com/watch?v=4GNT4-QYekg
Compare directement HunyuanVideo 1.5 de Tencent et Wan 2.7 d’Alibaba, deux grands modèles locaux gratuits. -
« Z-Image Open-Source Image Generator: Free Online and Local Setup » — Promptus AI, 2026, date précise inconnue, vues inconnues
https://www.youtube.com/watch?v=JF4Q5hXh-_Q
Présente Z-Image d’Alibaba, avec 6 milliards de paramètres et une architecture S3-DiT, comme un modèle léger capable de dépasser Flux 2 et Qwen Image, avec intégration ComfyUI. -
« FLUX.1 Kontext [dev] is open source! Try image editing locally in ComfyUI » — 黎黎原上啃, 2025, vues inconnues
https://www.youtube.com/watch?v=v4pp3TdbWNw
Démonstration de retouche d’images locale dans ComfyUI après la publication des poids de Flux Kontext Dev de Black Forest Labs.
Signaux
- Les acteurs fermés ont institutionnalisé les mises à jour mensuelles : la série « Update » de Woollyfern pour Midjourney publie une vidéo chaque mois et suit l’évolution V8 → V8.1 → V8.2. Les grandes mises à jour de Runway et Adobe Firefly sont elles aussi rapidement examinées par les chaînes techniques.
- La synchronisation audio devient une fonction standard de la génération vidéo fermée : Kling 3.0 (dialogue natif dans cinq langues), Seedance 2.0 (architecture intégrant son et vidéo jusqu’aux réverbérations) et Grok Imagine 1.5 (dialogues et sons ambiants simultanés) soulignent tous une transition de la génération de clips à la génération de courts films sonorisés.
- La cadence de sortie des modèles open source, surtout chinois, égale ou dépasse celle des modèles fermés : Qwen-Image → Qwen-Image-2512 → Z-Image et Wan 2.5 → 2.6 → 2.7 se succèdent à un rythme très rapproché. Tencent HunyuanVideo 1.5 et LTX-2 → 2.3 → 2.5 de Lightricks suivent également des cadences mensuelles ou trimestrielles.
- La plupart des vidéos open source mettent en avant ComfyUI, l’exécution locale et la gratuité : HitPaw Edimakor, Promptus AI et MaxonShire insistent sur la manière de les utiliser gratuitement et sur les GPU locaux, à l’inverse des chaînes axées sur les modèles fermés, plus centrées sur qualité et fonctionnalités.
- Les chaînes d’actualité IA hebdomadaires, comme AIPOD-CAST et Lev Selector, intègrent régulièrement la génération d’images et de vidéos à leurs segments, signe qu’il s’agit d’un sujet de veille continue plutôt que d’actualités ponctuelles.
Limites
- Les pages de résultats YouTube sont rendues dynamiquement par JavaScript. WebFetch ne renvoyait que des liens de navigation de pied de page, empêchant de lire les titres, chaînes, vues et dates directement dans le HTML.
- Les vidéos ont été repérées via une recherche Web classique avec des requêtes
site:youtube.com, puis leurs titres et chaînes ont été confirmés via l’endpointoembedde YouTube. Cette méthode ne permet ni d’obtenir les vues ni le nombre d’abonnés. - Plusieurs vidéos ne disposent pas d’une date précise confirmable.
- Les descriptions et principaux commentaires n’ont pas pu être consultés pour la même raison de dépendance à JavaScript.
- Les publications des 60 derniers jours ont été privilégiées, mais une ou deux vidéos plus anciennes, importantes pour comprendre les lignées open source ou fermées, ont aussi été retenues comme contexte.
Bluesky
Bluesky — Dernières évolutions de la génération d’images et de vidéos par IA
Comptes
- Simon Willison (@simonwillison.net) — chercheur IA indépendant. Il teste chaque nouveau modèle multimodal grâce à son benchmark maison montrant « un pélican à vélo ». Environ 50 000 abonnés et publications fréquentes.
- Max Woolf (@minimaxir.bsky.social) — ancien data scientist de BuzzFeed, spécialiste de l’éthique et de la R&D en génération de contenu IA.
- Ethan Mollick (@emollick.bsky.social) — professeur à Wharton, abordant les tendances générales de l’IA et l’évolution qualitative de la vidéo générée.
- Replicate (@replicate.com) — compte officiel du service d’hébergement de modèles, annonçant l’arrivée de nouveaux modèles fermés d’images et de vidéos sur sa plateforme.
- Stability AI (@stabilityai.bsky.social) — compte officiel du développeur de Stable Diffusion, mais les dernières publications concernent surtout Stable Audio et des API de retouche d’images d’entreprise. Le compte est inactif depuis le 19 novembre 2025.
- Stable Diffusion online AI (@stablediffusion.bsky.social) — compte de partage de prompts et d’art IA autour de SDXL/ComfyUI, environ 1 800 abonnés, inactif depuis le 24 février 2025.
- AI Art News (@ai-art-news.bsky.social) — compte de curation d’actualités sur l’art IA, sans publication depuis le 18 septembre 2025.
Publications
-
Simon Willison (2026-09-19) — Dans une série où il demande à GPT-6 Astra et Claude Fable 5.1 de créer des modèles 3D Blender avec des données cartographiques, il présente un flux de travail image générée → conversion 3D. 57 likes, 5 republications.
https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24 -
Simon Willison (2026-09-05) — Test demandant à GPT-6 Astra de rendre dans Blender une scène de pélican à vélo. 405 likes, 30 republications.
https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s -
Simon Willison (2026-09-04) — Grille comparative du benchmark « pélican à vélo » entre GPT-6 Astra, GPT-5.6 Sol/Terra/Luna. 206 likes, 9 republications.
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c -
Simon Willison (2026-09-02) — Claude Fable 5.1, au niveau de raisonnement Max et pour 3,30 $ par exécution, génère son image SVG de pélican de meilleure qualité à ce jour, ensuite animée. 362 likes, 22 republications.
https://bsky.app/profile/simonwillison.net/post/3muimzxo2sk2g -
Max Woolf (2026-09-19) — Note qu’une image vectorielle de pélican à vélo générée par IA ne comprend pas correctement le lien entre les jambes et les pédales. 1 like.
https://bsky.app/profile/minimaxir.bsky.social/post/3mvtt3uxdrk2c -
Max Woolf (2026-09-08) — À la suite de l’annonce d’un nouveau modèle d’images d’OpenAI, remarque qu’il a bien fait de repousser son article de synthèse sur ChatGPT Images 2.0, car cette nouveauté lui paraît plus importante. 4 likes.
https://bsky.app/profile/minimaxir.bsky.social/post/3muzq6mcadk2n -
Ethan Mollick (2026-09-19) — Observe que, au milieu d’un déluge de « slop », du contenu produit en masse et de faible qualité, de véritables œuvres vidéo IA intéressantes commencent aussi à apparaître. 58 likes, 7 republications.
https://bsky.app/profile/emollick.bsky.social/post/3mvuss476oc2b -
Replicate (2026-04-21) — Ajout de GPT Image 2 d’OpenAI à Replicate, avec mise en avant du photoréalisme, du rendu de texte et du respect de la mise en page. 5 likes.
https://bsky.app/profile/replicate.com/post/3mjzygaefs224 -
Replicate (2026-04-09) — Ouverture de Seedance 2.0 de ByteDance à tous les utilisateurs : intégration texte, image, vidéo et audio, audio stéréo synchronisé et physique réaliste. 2 likes, 1 republication.
https://bsky.app/profile/replicate.com/post/3mj3junhvnh26 -
Replicate (2026-02-18) — Annonce de Runway Gen-4.5, caractérisé par sa précision physique, son réalisme et sa génération vidéo cinématographique. 2 likes.
https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c -
Replicate (2026-02-17) — Ajout de Kling 3.0 et Kling o3 de Kuaishou : génération 4K multi-plans, audio synchronisé, retouche vidéo et transfert de style. 2 likes.
https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q -
Replicate (2026-03-11) — Ajout de Vidu Q3 de Shengshu : génération vidéo jusqu’à 16 secondes en 1080p, avec audio synchronisé, à partir de texte, d’images ou d’images de début et de fin. 1 like.
https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w
Signaux
- Avantage aux modèles fermés : les publications réellement trouvées sur ce thème concernent presque toutes GPT Image 2 / ChatGPT Images 2.5 d’OpenAI, Runway Gen-4.5, Kling 3.0, Seedance 2.0 ou Vidu Q3. Elles proviennent moins de publications organiques virales que d’annonces de plateformes d’hébergement comme Replicate ou de tests par des chercheurs indépendants.
- L’open source est presque absent : aucun compte actif parlant de Flux, Stable Diffusion, Qwen-Image, Wan ou de flux ComfyUI n’a été trouvé. Le seul compte communautaire apparent est inactif depuis février 2025 ; Stability AI est silencieux depuis novembre 2025 et ses dernières publications portent essentiellement sur l’audio et les API d’entreprise.
- « Un pélican à vélo » devient un benchmark de fait : à chaque sortie de nouveau modèle multimodal, plusieurs observateurs IA indépendants comparent les résultats avec ce même sujet. C’est une tendance interne à Bluesky et un indicateur non officiel partagé de la capacité des modèles.
- Absence des comptes d’entreprise : les comptes officiels supposés d’OpenAI, Midjourney, Runway ML, Black Forest Labs, Hugging Face, Civitai et ComfyUI sont absents, vides ou inactifs. Bluesky n’est donc pas un canal de communication directe privilégié pour ces entreprises ; les informations y passent par des chercheurs individuels ou des plateformes intermédiaires.
- Changement d’appréciation de la génération vidéo : comme le suggère Ethan Mollick, l’idée que des productions vidéo IA réellement qualitatives émergent au sein du contenu de masse gagne du terrain, sans toutefois désigner un modèle open source en particulier.
Limites
- L’API de recherche officielle Bluesky (
https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) renvoyait systématiquement HTTP 403 Forbidden, quels que soient les mots-clés ou les deux proxys CORS essayés. L’interface Web de recherche est également une SPA rendue côté client. - La collecte a donc utilisé les endpoints publics
app.bsky.actor.getProfileetapp.bsky.feed.getAuthorFeedpour les comptes découverts par recherche Web ou inférence. Les résultats ne représentent pas une recherche transversale de tout Bluesky, mais seulement les publications des comptes identifiés. - Plusieurs grands comptes de marques étaient inutilisés ou silencieux.
- Le seuil d’environ 20 publications thématiques n’a pas pu être atteint. Plus de 100 publications de sept comptes ont été lues, dont 12 seulement ont été retenues car directement liées au thème.
- Les images et vidéos elles-mêmes n’ont pas été affichées ni inspectées ; seules les descriptions textuelles des publications ont servi de source.
Lemmy
Lemmy — Dernières évolutions de l’IA de génération d’images et de vidéos (fermé/open source)
Communautés
- !«メールアドレス» — 5,712 abonnés, dont 893 locaux ; 1,407 publications et 1,927 commentaires. Communauté des modèles ouverts de génération d’images et de vidéos. Petite mais active.
- !«メールアドレス» — 2,362 abonnés. Espace de publication d’œuvres réalisées avec les modèles à poids ouverts de Stable Diffusion, majoritairement des liens directs vers des images civitai.
- !«メールアドレス» — 1,598 abonnés. Communauté d’illustrations anime générées par IA, réservée au contenu SFW.
- !«メールアドレス» — 8,252 abonnés, dont 3,027 locaux, et 9,179 utilisateurs actifs mensuels. Grande communauté anti-IA, davantage axée sur la critique et l’ironie envers l’IA en général.
- !«メールアドレス» — seulement 52 abonnés, mais miroir RSS de fils Reddit tels que r/ArtificialInteligence, où les sujets liés à la génération d’images et de vidéos arrivent fréquemment.
- !«メールアドレス»・!«メールアドレス»・!«メールアドレス» — communautés technologiques généralistes où circulent les grandes actualités Midjourney.
Publications
- Forte augmentation des outils ComfyUI pour MiniMax-H3 en septembre (open source) — Au moins 15 publications d’outils MiniMax-H3 ont été relevées dans
!«メールアドレス»entre le 1er et le 16 septembre 2026. Exemples :- « ComfyUI-MiniMaxH3-CLSS » — génération de vidéos sonorisées de longueur arbitraire avec 16 Go de VRAM grand public (score 0, 2026-09-01) https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS
- « H3-World » — se présente comme le premier modèle de monde interactif basé sur MiniMax-H3 (score 3, 2026-09-02) https://huggingface.co/DANNY621/H3-World
- « ComfyUI-VDN-H3-24GB » — implémentation d’attention hybride pour GPU de 24 Go (score 6, 2026-09-12) https://github.com/Speach1sdef178/ComfyUI-VDN-H3-24GB
- « MiniMax-H3-Image-Training-Adapter » — Circlestone Labs, score 5, 2026-09-12 https://huggingface.co/circlestone-labs/MiniMax-H3-Image-Training-Adapter
- Boogu-Image-0.1, nouveau modèle de base d’images ouvert issu d’un laboratoire lié à Huawei (open source) —
!«メールアドレス», score 5, 2026-06-17. Licence Apache-2.0, 10 milliards de paramètres et cinq variantes Base/Turbo/FP8/Edit, avec rendu bilingue chinois-anglais du texte. https://boogu.org/ - Article d’évaluation technique de Seedream 5.0 Pro, modèle fermé lié à ByteDance — via
!«メールアドレス», score 1, 2026-07-10. https://www.reddit.com/gallery/1usc03q - Annonce de Google Nano Banana 2 Lite — modèle fermé, miroir Hacker News, score 1, 2026-06-30. https://deepmind.google/models/gemini-image/flash-lite/
- MAI-Image-2.5 de Microsoft approche Nano Banana 2 dans les benchmarks — modèle fermé,
!«メールアドレス», score 1, 2026-05-28. https://www.reddit.com/r/ArtificialInteligence/comments/1tpu2cd/ - Récit expérimental de création d’une longue histoire avec Sora 2 — modèle fermé,
!«メールアドレス», score 1, 2026-09-13. Après sept vidéos d’une heure, l’auteur conclut que produire de beaux clips isolés est facile ; le vrai défi est la « production memory », c’est-à-dire maintenir la cohérence. https://lemmy.durstig.online/post/59922 - Midjourney se tournerait audacieusement de la génération d’images IA vers les spas médicaux — actualité d’entreprise, score 58 à 66, 2026-06-18. https://lemmy.zip/post/66397234
- Midjourney demande aux studios hollywoodiens de divulguer leur usage de l’IA — modèle fermé,
!«メールアドレス», score 73, 2026-07-05. https://lemmy.today/post/56011946 - Présentation de l’article InterleaveThinker — open source/recherche,
!«メールアドレス», score 0, 2026-06-12. https://arxiv.org/abs/2606.13679 - Intensité du rejet des contenus IA — signal social,
!«メールアドレス», score 923, 2026-09-13. La publication porte sur les lunettes intelligentes Ray-Ban Meta plutôt que directement sur la génération d’images ou de vidéos, mais la taille de la communauté et la force des réactions illustrent le contexte hostile. https://lemmy.world/post/51874921
Signaux
- Le côté open source est presque entièrement dominé par MiniMax-H3. Dans la première moitié de septembre,
!stable_diffusiona vu défiler quotidiennement nœuds ComfyUI, LoRA, quantifications et outils d’accélération VAE pour MiniMax-H3. Wan, Flux et HunyuanVideo apparaissent beaucoup moins, ce qui témoigne d’un écosystème populaire porté par des développeurs individuels sur GitHub, Hugging Face et civitai. - Du côté fermé, Google, Microsoft, ByteDance, OpenAI et Midjourney avancent de concert, mais les mentions sont peu nombreuses sur Lemmy et passent souvent par des miroirs Reddit. Les publications originales de Lemmy se concentrent davantage sur les actualités d’entreprise, comme le virage de Midjourney vers les spas médicaux.
- Les publications d’œuvres avec lien civitai sont actives, mais citent peu les modèles ou prompts, ce qui limite leur valeur en tant que source d’actualité.
- La communauté anti-IA
!fuck_aiest l’une des plus importantes de Lemmy : lorsqu’un sujet sur la génération d’images ou de vidéos IA y arrive, les réactions hostiles ont tendance à dominer.
Limites
- Lemmy possède une faible masse critique. Son API de recherche renvoie fréquemment de vieux résultats ou des éléments hors sujet : par exemple, chercher « Flux » produit des articles sur des start-ups de combustible nucléaire.
- Les recherches spécifiques « Runway Gen », « Kling AI » et « Wan 2.5 » n’ont fourni aucun contenu directement pertinent, ce qui ne permet pas de confirmer une dynamique propre à Lemmy autour de ces modèles.
!«メールアドレス»est un bot de republication RSS de Reddit, pas un espace de discussion propre à Lemmy.- Les nouvelles sur les spas médicaux de Midjourney et ses demandes adressées à Hollywood datent respectivement des 18 juin et 5 juillet 2026, et aucun suivi plus récent n’a été trouvé.
- Environ 20 publications ont été examinées, mais seuls le virage médical de Midjourney et la publication sur les lunettes intelligentes de
!fuck_aiont atteint des scores à deux chiffres ou plus.
Pinterest — Actualités de l’IA de génération d’images et de vidéos
30 des 50 épingles collectées ont été ouvertes et lues directement, images incluses, pour rédiger ce résumé. Les 20 titres restants — surtout des visuels de banques d’images de type « concept de création de contenu IA » et des graphiques de listes d’outils dupliqués — n’ont pas été ouverts car ils correspondaient déjà aux thèmes confirmés ci-dessous.
Thèmes visuels
- Le modèle de miniature YouTube « AI news » domine : fond noir ou bleu marine, visage humain réagissant, texte « AI NEWS » blanc ou rouge et rangée de logos lumineux. Il est réutilisé à travers des sujets sans rapport et ne constitue pas nécessairement une création éditoriale originale.
[6, 14, 41, 43, 47] - Les listes d’outils utilisent le même langage infographique sombre et néon : badges numérotés, ordinateur affichant une interface de génération et grille de logos pour Runway, Pika, Kling AI, Luma/Dream Machine, Canva, Hailuo, invideo AI, CapCut, Synthesia et HeyGen. Tous les outils cités sont des SaaS fermés.
[2, 29] - L’angoisse de l’authenticité, « réel ou IA », constitue un format récurrent : quiz en vis-à-vis, bannières rouges « AI-GENERATED » et comparaisons entre contenu généré et clip original.
[3, 21, 32] - Veo de Google fournit le vocabulaire visuel par défaut de la vidéo IA cinématographique : les mêmes images chaudes façon Pixar reviennent sur plusieurs épingles distinctes, ainsi qu’une démo image-vers-vidéo Veo 3 avec un monstre en peluche. Aucun concurrent n’apparaît aussi souvent.
[8, 9, 13, 27] - Les portraits IA hyperréalistes servent d’illustrations d’accroche génériques, quelle que soit la véritable matière de l’article.
[33, 45, 48, 20] - Les images de science-fiction et de circuits imprimés remplissent les vides lorsqu’aucune capture de produit réelle n’existe : cerveaux filaires lumineux, robots humanoïdes chromés et tableaux de bord holographiques. Elles n’apportent pas d’information.
[1, 37, 50] - Les infographies pédagogiques pour débutants adoptent un style pastel et dessiné, très différent des miniatures d’actualité, pour les personnes qui ne connaissent pas encore l’IA générative.
[7] - Les véritables diagrammes techniques sont rares : une seule épingle affiche une architecture de modèle réelle, de l’encodage texte à la diffusion puis à l’upscaling, présentée comme un visuel de magazine.
[34]
Épingles notables
- #48 — « Amuse 3.0 », outil de création artistique par IA (épingle) — générateur d’images local soutenu par AMD, illustré par un portrait hyperréaliste ; seul outil clairement local ou proche de l’open source dans cet échantillon.
- #27 — Google annonce l’IA de génération vidéo « Veo 3 » (épingle) — montre une image d’entrée d’un monstre en peluche et trois vidéos générées dans des scènes différentes, en mettant en avant la cohérence image-vers-vidéo de Veo 3.
- #46 — ByteDance et Hollywood concluent un accord mondial sur les droits d’auteur liés à l’IA (épingle) — carte d’actualité évoquant un accord ByteDance–MPA couvrant ses outils d’images et de vidéos.
- #10 — « 4 Major AI Updates » (épingle) — cite GPT-6 Astra, Gemini plus agentique, les médias génératifs dans Adobe Premiere et la série E de 2 milliards de dollars de Cognition.
- #49 — « Today's AI News, May 20 2026 » (épingle) — récapitulatif de Google I/O : Gemini 3.5 Flash, Gemini Omni, Gemini Spark et lunettes intelligentes IA.
- #3 — Hollywood Reporter interviewe la première actrice IA (épingle) — bandeau télévisé sur « Tilly Norwood », actrice générée par IA, avec la mention « AI-GENERATED IMAGE » incrustée dans l’image.
- #41 — « More than 20% of YouTube is now AI-generated » (épingle) — épingle affichant une statistique sans graphique justificatif.
- #29 — « 10 Best Free AI Video Generators for YouTube 2026 » (épingle) — la liste d’outils la plus large de l’échantillon : Google Veo, Runway, Pika, invideo AI, CapCut, Synthesia et HeyGen, tous présentés comme gratuits et adaptés à YouTube.
- #34 — « OpenAI’s Secret Image Generation Tool to Debut Soon » (épingle) — titre sur un outil fermé non publié, illustré par un diagramme de pipeline de diffusion plutôt que par une image produit.
- #32 — mème de comparaison « AI GENERATED » contre « ORIGINAL CLIP » (épingle) — une expression du visage ou un geste recréé par IA à côté du clip réel.
Signaux
- Actuel : Google Veo 2 et 3 est le modèle vidéo visuellement le plus réutilisé du tableau. Plusieurs épingles présentent explicitement l’IA comme passant de la conversation au travail réel, avec les timelines génératives d’Adobe Premiere, le financement de Devin de Cognition et Gemini agentique dans Gmail, Drive et Docs. Les accords sur propriété intellectuelle et droit d’auteur, comme ByteDance × MPA, deviennent un sujet d’actualité grand public. Les miniatures génériques réutilisées suggèrent qu’une grande part de ce contenu d’actualité est produite à faible effort plutôt que par un reportage original.
- Absent : la culture des modèles open source est presque invisible. Aucun visuel Stable Diffusion, Flux, ComfyUI, LoRA ou dépôt GitHub n’a été trouvé ; Amuse 3.0 était le seul outil local ou proche de l’open source. Aucune épingle non anglophone n’a émergé. Rien n’était visionnable sous forme de vidéo : tout était une miniature statique, de sorte que la qualité réelle des sorties de modèles ne pouvait pas être évaluée.
Limites
- Pinterest n’a pas été exploré directement. Ce résumé repose entièrement sur
output/pinterest.pins.mdetimages/pinterest/manifest.json/les images, précollectés par un worker depuis une seule requête non précisée, « Image and Video Generation AI News ». Le champgenreest vide pour chaque épingle. - 30 des 50 épingles ont été ouvertes ; les 20 autres ont été ignorées car leurs titres dupliquaient des formats déjà couverts.
- Plusieurs titres sont vides ; dans ces cas, la description repose sur le texte visible dans l’image.
- Certaines images ne correspondent pas littéralement à leur titre, ce qui confirme l’hypothèse de miniatures génériques réutilisées mais implique que les titres doivent être lus comme indicatifs, non comme des reportages confirmés.
- Aucune épingle n’affichait de date de publication, et la fraîcheur de plusieurs affirmations n’a donc pas pu être vérifiée depuis l’image seule.
Actions recommandées
- Refaire la collecte X avec des requêtes directement liées au thème, comme « Sora 2 », « Midjourney », « Stable Diffusion », « Runway Gen », « Kling AI » et « open source image generation ».
- Suivre en continu la fréquence des sorties des modèles open source chinois MiniMax-H3, Qwen, Wan et Z-Image.
- Suivre non seulement les communautés spécialisées dans l’IA, mais aussi les communautés généralistes et professionnelles afin de surveiller l’extension du rejet des contenus générés par IA.
- Évaluer des moyens alternatifs d’accès afin de résoudre le problème 403 de l’API de recherche officielle Bluesky.
- Suivre lors de la prochaine collecte les développements du problème de « production memory » de Sora 2 et de la reconversion de Midjourney vers les spas médicaux.
- Ajouter des balises de genre aux collectes Pinterest afin de pouvoir trier automatiquement les contenus open source et fermés.
Images collectées


















































Note sur la qualité des données
X n’a fourni aucune donnée exploitable parmi les 40 publications, car les requêtes ne correspondaient pas au thème. Reddit (12 éléments) et Bluesky (environ 12 éléments issus de comptes individuels en raison du blocage de l’API de recherche) n’ont pas atteint l’objectif d’environ 20 éléments. Pinterest repose sur des données précollectées sans balises de genre, et les vues ainsi que les abonnés YouTube n’ont pas pu être récupérés.



