KEN’S CAT LOG

Actualités de l’IA de génération d’images et de vidéos — 2026-09-08

Du côté des solutions fermées, un nouveau genre — des agents LLM (GPT-6 Astra) pilotant des outils GUI et Blender pour créer des images et des vidéos 3D, plutôt que des modèles de diffusion — a fait indépendamment parler de lui sur Reddit, X et Bluesky. Les activités open source se sont surtout concentrées dans la communauté ComfyUI de Lemmy et sur des chaînes YouTube de tests, et sont restées presque invisibles sur Bluesky, Pinterest, Reddit et X.

Du côté des solutions fermées, un nouveau genre — des agents LLM (GPT-6 Astra) pilotant des outils GUI et Blender pour créer des images et des vidéos 3D, plutôt que des modèles de diffusion — a fait indépendamment parler de lui sur Reddit, X et Bluesky. Les activités open source se sont surtout concentrées dans la communauté ComfyUI de Lemmy et sur des chaînes YouTube de tests, et sont restées presque invisibles sur Bluesky, Pinterest, Reddit et X.

Actualités de l’IA de génération d’images et de vidéos — 2026-09-08

Cette enquête couvrant six plateformes met avant tout en évidence, côté solutions fermées, l’émergence indépendante sur trois plateformes d’un nouveau genre : des agents LLM (GPT-6 Astra), plutôt que des modèles de diffusion, qui manipulent directement des outils GUI et Blender pour créer des images et des vidéos 3D. L’open source était globalement moins visible, mais restait très actif au niveau des communautés de développeurs : cinq à six nœuds ComfyUI d’accélération destinés aux modèles vidéo MiniMax H3 ont été publiés en succession rapide la même semaine dans la communauté !stable_diffusion de Lemmy, tandis que YouTube continuait d’évaluer la lutte pour le leadership entre Flux.2/Flux 2 Klein et Qwen-Image. Pinterest, ainsi que la majorité des publications sur Reddit et X, se concentraient sur des noms de produits fermés (Midjourney, Sora, Veo, Runway, Kling, Nano Banana, Seedream, etc.) ; les noms propres open source y apparaissaient à peine. Plus largement, Reddit et Pinterest ont aussi mis en avant les controverses sur l’authenticité des contenus et l’impact social d’agents IA qui remplacent des rôles et des tâches humaines, davantage que les tendances technologiques elles-mêmes.

À travers les plateformes

  • La génération visuelle agentique de GPT-6 Astra a émergé indépendamment sur trois plateformes : l’utilisation de Blender par Astra pour produire un rendu a été abordée séparément sur Reddit (r/DefendingAIArt) et Bluesky (@simonwillison.net), tandis qu’une démo de création de ville 3D avec Astra a déclenché une vague d’imitations sur X (@synabreu, @GulatiYajat). Le principal thème transversal de cette enquête n’était pas « l’évolution des modèles de diffusion », mais une nouvelle approche : « des agents LLM prennent les commandes d’outils existants pour créer des illustrations et de la 3D ».
  • L’évaluation selon laquelle la cohérence des personnages et des scènes reste non résolue dans la génération vidéo demeure partagée : sur Reddit (r/generativeAI, r/aivideomaking) comme sur X (@atlas_remake, qui salue Seedance 2.5, face à @Aiden_Tech_Ai, qui relève ses échecs dans les scènes complexes), des avis opposés sur le même point ont été publiés à la même période.
  • La présence de l’open source varie fortement selon les plateformes : !stable_diffusion sur Lemmy est assez dynamique pour voir paraître simultanément des nœuds ComfyUI pour MiniMax H3 (ComfyUI-Ref2VA-VSA et d’autres), et YouTube publie régulièrement des vidéos comparant Qwen-Image, FLUX et Wan 2.2. À l’inverse, Bluesky, Pinterest, Reddit et X n’ont pratiquement livré aucune publication mentionnant des modèles open source précis tels que de nouvelles versions de Stable Diffusion, FLUX, Wan ou HunyuanVideo. Plusieurs sections Limits soulignent une faiblesse structurelle : on ne sait pas si l’open source ne fait réellement pas parler de lui ou s’il a simplement été manqué en raison de requêtes de recherche orientées vers les solutions fermées.
  • Les controverses sur l’authenticité et l’impact social accompagnent les tendances techniques : des publications dont l’origine réelle ou générée est contestée (Reddit r/isthisAI, la vidéo de Thor dans r/pj_explained contre r/NewRockstars), aimod.social sur Bluesky qui étiquette automatiquement les images soupçonnées d’être générées, des vidéos truquées liées à l’élection du gouverneur de New York (Bluesky/404media), ou encore les miniatures Pinterest avec tampon « FAKE » montrent que les thèmes « repérer » et « douter » ont été observés indépendamment sur plusieurs plateformes, davantage que le simple fait de créer.

Plateforme par plateforme

Reddit : parmi 12 fils, les sous-reddits consacrés aux débats sur l’IA et à la vérification d’authenticité (r/antiai, r/aiwars, r/DefendingAIArt, r/isthisAI, r/pj_explained, r/NewRockstars) ont suscité davantage d’engagement que les sous-reddits spécialisés dans la génération d’images ou de vidéos (r/generativeAI, r/aivideomaking, r/GoogleFlow, r/freetoolsAI). Une requête unique empêchait pratiquement toute comparaison entre solutions fermées et open source.

X : les principaux thèmes étaient l’annonce de Sol-H3 de NVIDIA — inférence vidéo plus rapide que la lecture en temps réel — et sa reproduction locale par des particuliers, ainsi que la vague d’imitations de villes 3D créées avec GPT-6 Astra. Parmi 40 publications, seule une part limitée concernait directement l’IA de génération d’images et de vidéos ; de nombreuses publications hors sujet se sont mêlées aux résultats à cause des tendances régionales (Explore autour de la Croatie).

YouTube : les vues et le nombre d’abonnés n’ont pas pu être récupérés en raison du rendu JavaScript des pages, mais des chaînes de comparaison et d’explication traitant à la fois de solutions fermées (Midjourney V8.2, Grok Imagine, Google Gemini « Omni ») et open source (Qwen-Image-2.0, FLUX, Wan 2.2) ont été identifiées. C’était la source la plus adaptée, parmi les six plateformes, pour comparer les deux approches.

Bluesky : l’API de recherche (app.bsky.feed.searchPosts) renvoyant constamment une erreur 403, il a fallu basculer vers une vérification individuelle des fils de comptes connus (@simonwillison.net, @404media.co, etc.). Le critère de complétion de « 20 publications analysées » n’a donc pas été atteint. La seule publication open source concrète était un rapport d’exécution locale de Qwen 3.7 27B.

Lemmy : la controverse sur le changement de cap supposé de Midjourney vers des échographes médicaux (!techtakes) a été le sujet isolé le plus animé. Côté open source, les sorties simultanées de nœuds ComfyUI pour MiniMax H3 et la compétition de benchmarks Qwen-Image-Bench (LLaDA-Image, Boogu-Image-0.1) ont fourni la matière première open source la plus dense des six plateformes.

Pinterest : 30 des 50 épingles précollectées ont été vérifiées. Une requête unique non segmentée a surtout remonté des infographies comparant des produits fermés et des guides pratiques ; aucun nom de modèle ou de projet open source n’a été trouvé. Les dates de publication et métriques d’engagement ne figurant pas dans le manifest, il est impossible d’évaluer la fraîcheur des contenus.

À surveiller

  • L’inférence vidéo plus rapide que le temps réel de MiniMax H3 / Sol-H3 et la multiplication des nœuds d’optimisation ComfyUI — X (@xieenze_jr) / Lemmy (ComfyUI-Ref2VA-VSA et d’autres). Il faudra suivre dans quelle mesure les reproductions open weights rattrapent les annonces cloud.
  • La diffusion de la génération visuelle agentique de GPT-6 Astra — Reddit (r/DefendingAIArt) / Bluesky (@simonwillison.net) / X (@synabreu). Jusqu’où les imitations vont-elles s’étendre ?
  • La lutte pour le leadership open source entre FLUX.2/Flux 2 Klein et Qwen-Image — YouTube (SECourses, Urban Decoders). Comment les résultats de plus de 700 tests influenceront-ils les futures adoptions ?
  • Les suites de la controverse sur le virage de Midjourney vers les équipements médicaux (Midjourney Medical) — Lemmy (via pivot-to-ai.com). Le pivot d’une entreprise de génération d’images restera-t-il une plaisanterie ou sera-t-il réellement mis en œuvre ?
  • Les répercussions de l’usage abusif de vidéos IA dans la publicité politique, lors de l’élection du gouverneur de New York — Bluesky (404media.co). La réglementation et les réponses des plateformes vont-elles évoluer ?
  • L’évolution de la résolution du problème de cohérence des personnages et des scènes en génération vidéo — Reddit (r/generativeAI) / X (@Aiden_Tech_Ai). Les outils tout-en-un se rapprochent-ils réellement d’une solution ?

Recommandations

  • Continuer à suivre la génération visuelle agentique de GPT-6 Astra (pilotage de Blender, création de villes 3D) en tant que thème dédié lors des prochaines éditions.
  • Afin de ne pas manquer les annonces open source, ajouter lors de la prochaine collecte des requêtes transversales utilisant des noms précis tels que « FLUX », « Stable Diffusion », « Qwen-Image », « Wan » et « ComfyUI ».
  • En partant du principe que l’API de recherche Bluesky continuera à renvoyer des 403, élargir à l’avance la liste des comptes à surveiller.
  • Pinterest ne fournissant ni date de publication ni données d’engagement, limiter son usage à un suivi régulier de la notoriété des outils, et non à une comparaison d’actualités nécessitant de la fraîcheur.
  • La réalité et la nature du virage de Midjourney vers les équipements médicaux restant incertaines, éviter les citations affirmatives tant qu’une source primaire, telle qu’une annonce officielle de Midjourney, n’a pas été publiée.
  • Donner la priorité à !stable_diffusion sur Lemmy et aux chaînes YouTube de vérification pour le suivi des tendances open source.

Qualité des données

Bluesky — API de recherche constamment en 403, vérification limitée à des comptes individuels et seuil de 20 publications non atteint — et Pinterest — aucune date de publication ni donnée d’engagement dans le manifest, fraîcheur inconnue et absence totale de mentions open source avec une requête unique — sont les sources les moins fournies. Reddit et X se sont limités à une seule requête, correspondant au titre du brief ; ils n’ont donc pas collecté intentionnellement de publications permettant de comparer clairement les solutions fermées et open source. Les sujets open source se sont ainsi concentrés sur Lemmy et YouTube. Sur YouTube, les vues et le nombre d’abonnés n’ont pas pu être récupérés en raison des contraintes du rendu JavaScript.

Résumé par plateforme

Reddit

Reddit — Actualités de l’IA de génération d’images et de vidéos

Principaux espaces de discussion (subreddits)

Les 12 fils collectés proviennent tous de subreddits différents, à raison d’un fil chacun. Les communautés spécialisées dans l’IA de génération d’images et de vidéos sont peu nombreuses ; les sous-reddits centrés sur les films, la vérification de faux et les controverses culturelles autour de l’IA ressortent davantage.

Subreddit Nombre de membres Nombre de fils collectés
r/whenthe 813,975 1
r/isthisAI 406,607 1
r/antiai 317,903 1
r/aiwars 167,158 1
r/generativeAI 151,385 1
r/RemoteWorkers 75,332 1
r/DefendingAIArt 72,770 1
r/pj_explained 96,256 1
r/NewRockstars 15,523 1
r/freetoolsAI 7,887 1
r/aivideomaking 6,517 1
r/GoogleFlow 1,789 1

La seule requête utilisée était « Image and Video Generation AI News ». Les résultats penchaient davantage vers les sous-reddits de débat pour ou contre l’IA (r/antiai, r/aiwars, r/DefendingAIArt) et de vérification « est-ce de l’IA ? » (r/isthisAI, r/pj_explained, r/NewRockstars, r/whenthe) que vers les communautés spécialisées (r/generativeAI, r/aivideomaking, r/GoogleFlow, r/freetoolsAI).

Réactions de la communauté
  • GPT-6 dessine « à la main » avec la souris, rendant aussi possible la falsification de timelapses (fil 2, r/antiai, 7 013 points et 1 009 commentaires, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). Au lieu d’un modèle de diffusion, un LLM (GPT-6) reçoit le contrôle de la souris et du clavier pour dessiner dans un logiciel d’illustration numérique, y compris des timelapses d’apparence « authentique ». Le commentaire le plus populaire, de u/Nayutantantan (2 507 points), exprime son désespoir : « Je n’ai même plus l’énergie de filmer des timelapses comme preuve. »
  • GPT-6 « Astra » crée des rendus photoréalistes dans Blender (fil 9, r/DefendingAIArt, 143 points et 13 commentaires, 2026-09-06, https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/). Le sujet est que l’IA n’a pas généré directement la vidéo : l’agent IA a manipulé Blender pour effectuer le rendu. u/TheMaliciousSquid : « GPT-6 semble pouvoir devenir le meilleur en visuel ; je me demande s’il dépassera Claude en programmation. »
  • L’extension « AutoFlow » pour Google Flow prend en charge la génération vidéo continue (fil 12, r/GoogleFlow, 12 points et 6 commentaires, 2026-09-01, https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/). Elle ajoute « Continue from Last Frame », qui transmet automatiquement la dernière image du clip précédent à la première du suivant, ainsi qu’une gestion de file de générations et d’images de référence. Une fonctionnalité visant à fusionner les clips en une vidéo fluide est annoncée pour la suite.
  • Une publication promotionnelle pour un outil gratuit de génération d’images IA concentre la demande (fil 3, r/freetoolsAI, 39 points et 48 commentaires, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). Un service présenté comme gratuit, illimité et sans inscription a attiré des commentaires. u/Puzzleheaded_Lab4757 dit avoir économisé « des centaines de dollars et des heures », tandis que u/thecragmire s’interroge sur la viabilité : « Comment couvrent-ils leurs coûts d’exploitation ? »
  • La durée et la cohérence des personnages restent le principal obstacle de la génération vidéo IA (fil 10, r/generativeAI, 4 points et 15 commentaires, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1w9klb7/). À une personne souhaitant créer une vidéo cinématique SF de deux à quatre minutes, u/Missy_Desu répond qu’il est réaliste de créer les images avec GPT Image 2 puis de les animer avec Seedance 2.5, mais qu’il faut prévoir environ 100 dollars par minute achevée. u/KissinglyPolished souligne que le passage de l’image fixe à la vidéo rend le maintien de la cohérence des personnages extrêmement difficile et que les outils tout-en-un ne l’ont pas encore résolu.
  • La génération vidéo gratuite sur matériel léger reste irréaliste (fil 8, r/aivideomaking, 6 points et 15 commentaires, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/). À la demande de créer gratuitement une vidéo IA de 45 secondes avec seulement un téléphone et un iPad, u/NewLifeWares répond qu’une telle durée exige des ressources de centre de données ; gratuitement, le mieux serait des clips de cinq secondes avec filigrane à assembler.
  • Les images IA pour la publicité alimentaire sont toujours jugées « peu appétissantes » (fil 4, r/aiwars, 4 points et 177 commentaires, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). L’emploi croissant d’images alimentaires générées par IA dans la publicité suscite des doutes. u/LCI_Jake : « On dirait une image gore générée exprès, j’ai cru voir un nid d’insectes. » À l’inverse, u/Bassed_Hummble publie un résultat produit localement avec Krea 2 en 40 secondes et affirme qu’un meilleur prompt peut améliorer le résultat.
  • Vague de réactions à une offre de travail à domicile pour évaluer des légendes IA (fil 5, r/RemoteWorkers, 152 points et 739 commentaires, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/). L’offre propose 30 dollars de l’heure pour vérifier les erreurs de légendes générées par IA — objets mal identifiés, couleurs erronées, texte mal lu, etc. La plupart des commentaires demandent simplement le lien de candidature ; la discussion de fond reste limitée.
  • Deux controverses sur l’authenticité de vidéos IA « trop réalistes » (fils 1/6, r/NewRockstars et r/pj_explained, diffusion en doublon de la même publication, 2026-09-02). Une publication affirmant qu’une fuite montrant Thor percuter un pilier est du CGI et non de l’IA a suscité une réponse frontale dans r/pj_explained : le commentaire principal de u/ceaserisnothome estime que l’explosion qui se répand en cercle parfait est une preuve d’IA. La même vidéo divise donc sur son authenticité.
  • Une vidéo montrant des vagues apparaître à travers une fenêtre divise les commentaires entre IA et prise de vues réelle (fil 7, r/isthisAI, 0 point et 79 commentaires, 2026-09-07, https://www.reddit.com/r/isthisAI/comments/1w9cyub/). L’auteur relève l’invraisemblance d’une eau qui apparaît dans une pièce sans briser la fenêtre. u/RioReiser85 pense qu’il s’agit d’une prise de vues réelle mal interprétée du fait de la perspective, alors que u/bulbousEd juge le mouvement de l’écume à l’avant du bateau physiquement impossible et donc généré par IA.
Signaux
  • Ce qui progresse : l’inquiétude face à une IA qui ne paraît pas être de l’IA. L’ampleur de la réaction au fil 2 — 7 013 points et 1 009 commentaires — révèle une vive préoccupation devant des LLM capables de manipuler directement des outils GUI et même de falsifier une « preuve » de dessin à la main.
  • Ce qui est minimisé ou rejeté : le souhait de créer gratuitement de longues vidéos de haute qualité est régulièrement écarté par la communauté (fils 8 et 10). Les contraintes de matériel et de coût restent sévères selon le consensus de Reddit.
  • Élément surprenant : les sous-reddits spécialisés dans la génération d’images et de vidéos (r/generativeAI, r/aivideomaking, r/GoogleFlow) génèrent moins de ferveur et d’engagement que les espaces de vérification d’authenticité et de controverse (r/isthisAI, r/antiai, r/aiwars, r/pj_explained, r/NewRockstars, r/whenthe). Sur Reddit aujourd’hui, les « actualités » de la génération d’images et de vidéos IA sont davantage racontées comme une friction sociale autour de la question « est-ce de l’IA ? » que comme une évolution des modèles.
  • Signaux contradictoires : pour la même vidéo de fuite montrant Thor percuter un pilier, les commentaires de r/NewRockstars et r/pj_explained concluent exactement l’inverse : « ce n’est pas de l’IA » contre « c’est de l’IA » (fils 1/6). Le fil 7 oppose de même les partisans de la prise de vues réelle et ceux de l’IA, ce qui suggère que le jugement visuel des utilisateurs ordinaires n’est plus fiable.
Limites
  • La seule requête était « Image and Video Generation AI News ». Le worker n’a effectué aucune recherche alternative, par exemple « Stable Diffusion », « Midjourney », « Sora », « Kling » ou « génération d’images open source ». Il a donc recueilli très peu de publications permettant de comparer clairement les solutions fermées (Midjourney, DALL-E, Sora, Veo, Runway, etc.) et open source (Stable Diffusion, Flux, écosystème ComfyUI, etc.).
  • Les 12 fils collectés sont issus de 12 subreddits différents, un seul fil par subreddit ; aucune analyse approfondie de plusieurs fils du même espace n’a été possible.
  • Les fils 9 et 11 n’ont pas de corps de publication, seulement un titre et des commentaires, ce qui limite l’accès à l’information primaire sur l’intention de l’auteur.
  • Les fils 1 et 6 sont essentiellement la même publication repostée dans deux subreddits. Les compter comme deux cas indépendants ramène en pratique l’échantillon à 11 cas.
  • En raison de la nature de la collecte par navigateur, aucun accès supplémentaire à Reddit — recherche avec d’autres termes, dépliage de tous les commentaires des fils, etc. — n’a été effectué lors de cette exécution.

X

X — Actualités de l’IA de génération d’images et de vidéos

Comptes

Les 40 publications collectées viennent de 37 comptes. La plupart sont des cas isolés, devenus viraux ou restés discrets avec une seule publication. Parmi les comptes liés à l’IA de génération d’images ou de vidéos, seul @yu_ichi_suzuki (Yuichi Suzuki) avait plusieurs publications formant un fil.

Compte Nombre de publications Tendance
@yu_ichi_suzuki (Yuichi Suzuki) 2 Fil technique expliquant comment exécuter MiniMax H3 sur un RTX 5090 local (309 mentions J’aime au total). Format explicatif, non viral ponctuel
@xieenze_jr (Enze Xie) 1 Publication d’annonce d’un nouveau modèle par un chercheur de MiniMax (349 mentions J’aime, environ 85 000 vues)
@voxelphotonics 1 Démo d’affichage volumétrique de Duke Nukem 3D, hit viral avec 6 097 mentions J’aime et environ 297 000 vues
@synabreu 1 Modèle de ville 3D de Séoul créé avec GPT-6 Astra, 2 700 mentions J’aime pour une publication
@GulatiYajat (Yajat Gulati) 1 Création d’une ville 3D de Gurgaon avec GPT-6 Astra, 574 mentions J’aime
@luccacerf 1 Démo combinant Blender MCP, Astra et Tripo, 445 mentions J’aime
@He1s_Sammy 1 Long fil sur la transformation des vidéos IA pour enfants sans visage en activité commerciale, 388 mentions J’aime
@SD_Tutorial (Stable Diffusion Tutorials) 1 Compte d’explication technique de Sol-H3, mais réception limitée à 22 mentions J’aime
@Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox 1 chacun Comptes de taille moyenne discutant de Seedance 2.5, de la qualité et des limites des vidéos IA

À l’exception de @xieenze_jr, il ne s’agit pas des développeurs des outils mais d’utilisateurs publiant des démonstrations et essais. Le sujet est porté par deux niveaux : quelques grandes publications virales (@voxelphotonics, @synabreu) et des tutoriels partagés par des particuliers techniques (@yu_ichi_suzuki, @SD_Tutorial).

Publications
  1. MiniMax annonce « Sol-H3 », une génération vidéo plus rapide que la lecture en temps réel (#2 @xieenze_jr, 349 mentions J’aime, 62 reposts, 23 réponses, environ 85 000 vues, 2026-09-07, https://x.com/xieenze_jr/status/2097000082927399012). « Five seconds of world. 1.653 seconds to infer. » La publication annonce que huit NVIDIA B300 Blackwell peuvent générer cinq secondes de vidéo en 1344×768 en 1,653 seconde. Elle est à l’origine de la tendance X Explore no 1, « NVIDIA Speeds Up AI Video Generation Past Real-Time Playback ».
  2. L’explication technique ci-dessus est relayée (#3 @SD_Tutorial, 22 mentions J’aime, environ 2 100 vues, 2026-09-07, https://x.com/SD_Tutorial/status/2097061880175141224). Elle décrit « a high-performance video inference stack developed by NVIDIA Research that runs the MiniMax-H3 video generation model faster than real-time playback » et renvoie vers les pages Sol-Engine/Sol-H3 de nvlabs.github.io. Des comptes techniques ont suivi immédiatement, au-delà du compte officiel.
  3. Publication d’une procédure pour exécuter MiniMax H3 localement sur RTX 5090 (#4–5 @yu_ichi_suzuki, 295+14 mentions J’aime, environ 18 000+1 100 vues, 2026-09-07, https://x.com/yu_ichi_suzuki/status/2096819288997065192). « Générer localement avec MiniMax H3 une vidéo de plus de 2K de 15 secondes en environ neuf minutes (RTX 5090) ». Le créateur partage un workflow associant une LoRA distillée d’Alibaba pour sélectionner un résultat 480p, puis RTX Video Super Resolution pour le mettre à l’échelle en 2688×1536, avec des notes GitHub. Cela forme le pendant de l’annonce cloud (#1, #2) : un usage intensif de poids ouverts par un particulier.
  4. Génération d’une vidéo de mode avec Seedance 2.5 (#1 @Strength04_X, 68 mentions J’aime, 2 reposts, 35 réponses, environ 7 700 vues, 2026-09-06, https://x.com/Strength04_X/status/2096441159887274302). Publication du prompt complet utilisé pour créer avec « Seedance 2.5 on Dreamina_ai » une « 30-second photoreal cinematic fashion-travel music video ».
  5. Création d’un univers façon Toy Story avec Seedance 2.5 (#14 @atlas_remake, 3 mentions J’aime, environ 133 vues, 2026-09-07, https://x.com/atlas_remake/status/2096847522602139995). L’auteur souligne de façon positive que « Seedance 2.5 handles multiple animated characters/objects ».
  6. Les difficultés des vidéos IA, encore comparées à une machine à sous (#12 @Aiden_Tech_Ai, 1 mention J’aime, 2 reposts, 4 réponses, environ 494 vues, 2026-09-07, https://x.com/Aiden_Tech_Ai/status/2097020441470836791). « You prompt. You generate. Something is wrong. You generate again... » L’auteur pointe la faiblesse de cohérence dans les scènes complexes, impliquant plusieurs espaces, mouvements de caméra, placement des personnages et continuité. L’engagement est faible, mais le propos contraste avec l’évaluation optimiste du point #5.
  7. Duke Nukem 3D reproduit sur un affichage 3D volumétrique (#10 @voxelphotonics, 6 097 mentions J’aime, 921 reposts, 130 réponses, environ 297 000 vues, 2026-09-07, https://x.com/voxelphotonics/status/2096833425043005562). C’est la publication qui a généré l’un des plus grands engagements de toute cette période sur X. Il ne s’agit pas directement d’IA de génération d’images ou de vidéos, mais d’une démo de rendu et d’affichage qui a contribué à la tendance Explore no 3, « Duke Nukem 3D Brought to Life in True 3D Display ».
  8. GPT-6 « Astra » transforme l’ensemble de Séoul en ville 3D (#20 @synabreu, 2 700 mentions J’aime, 451 reposts, 81 réponses, environ 235 000 vues, 2026-09-06, https://x.com/synabreu/status/2096557555086725159). « For my first project created with GPT-6 Astra, I built the entire city of Seoul in 3D—a small revolution in digital geography! » La publication s’est largement diffusée comme exemple d’application de génération 3D conversationnelle.
  9. Recréation similaire de Gurgaon en ville 3D avec GPT-6 Astra (#22 @GulatiYajat, 574 mentions J’aime, 28 reposts, 53 réponses, environ 46 000 vues, 2026-09-06, https://x.com/GulatiYajat/status/2096659142534676684). « I saw everyone building all sorts of cool demos with Astra, so I decided to give it a shot. » Il s’agit d’un exemple concret de suiveur de la vague du point #8. Un site dédié, gurgaon-3d-atlas.cratorlabs-2435.chatgpt.site, a aussi été publié.
  10. Démo associant Blender MCP, Astra et Tripo (#21 @luccacerf, 445 mentions J’aime, 20 reposts, 11 réponses, environ 31 000 vues, 2026-09-07, https://x.com/luccacerf/status/2097047098281672782). « First time building a gUI with Blender MCP + Astra + Tripo This is insane. Html preview for AI is dead. » Un exemple de coordination de plusieurs outils IA via MCP.
  11. Les vidéos IA pour enfants sans visage deviennent une activité commerciale (#23 @He1s_Sammy, 388 mentions J’aime, 96 reposts, 17 réponses, environ 19 000 vues, 2026-09-06, https://x.com/He1s_Sammy/status/2096492880017736056). « FACELESS AI KIDS VIDEOS ARE BECOMING A SERIOUS CONTENT BUSINESS...a phone, laptop, or iPad is enough to start experimenting ». Publication très relayée autour de méthodes de revenus complémentaires via des vidéos génératives.
Signaux
  • Ce qui progresse : les usages consistant à demander à des agents conversationnels de créer des mondes 3D — villes 3D avec GPT-6 Astra, intégration Blender MCP — produisent le plus d’imitations et de suivis sur la période. Après avoir vu la publication de synabreu au point #8, GulatiYajat précise au point #9 qu’il l’a fait parce qu’il voyait tout le monde créer des démos avec Astra. Il ne s’agit donc pas seulement d’une actualité isolée, mais d’une chaîne d’imitations.
  • Ce qui progresse aussi : l’inférence vidéo plus rapide que le temps réel (Sol-H3, #2/#3) et son exécution par des particuliers sur GPU local (#3 de @yu_ichi_suzuki) apparaissent presque simultanément. Les annonces de solutions fermées et les usages de poids ouverts progressent en parallèle sur X, sans décalage notable.
  • Ce qui est minimisé ou divise les avis : la cohérence dans les vidéos IA avec plusieurs personnages ou espaces fait l’objet, à la même période, d’éloges (#5 : « handles multiple animated characters well ») et de critiques (#6 : « slot machine problem »). L’évaluation reste indécise.
  • Élément surprenant : parmi les neuf tendances Explore qui ont servi de point de départ aux 40 publications collectées, seules les trois premières concernaient directement l’IA de génération d’images ou de vidéos : NVIDIA/Sol-H3, le retour animé de la VTuber Veibae et l’affichage volumétrique de Duke Nukem 3D. Les six autres — Croatian, Building, $song, Harvey, Ukrainian, Democrats — étaient des tendances régionales sans rapport avec le sujet ; la tendance no 4 indiquait explicitement « Trending in Croatia ». La recherche sur « Building » a néanmoins livré un résultat fort et inattendu : les démos de villes 3D avec GPT-6 Astra (#8 à #10).
  • À propos de la VTuber Veibae : une recherche sur la tendance Explore no 2, « VTuber Veibae Teases Return with Sunflower Farm Animation », n’a remonté que des comptes sans rapport publiant des récapitulatifs de box-office nord-américain (@mediamanint et d’autres, publications répliquées). Aucune publication de Veibae ou concernant la réalisation de son animation n’a été collectée.
Limites
  • Parmi les trois principales tendances Explore, « VTuber Veibae Teases Return with Sunflower Farm Animation », potentiellement liée à l’IA de génération d’images ou de vidéos, n’a produit aucune publication pertinente. Les résultats #6 à #9 étaient tous des doublons sans rapport sur le box-office. Cette collecte ne permet pas d’établir si de l’IA a été utilisée pour l’animation de la VTuber.
  • Les six autres tendances Explore — Croatian, Building, $song, Harvey, Ukrainian, Democrats — étaient presque entièrement des tendances régionales ou d’actualité sans rapport avec l’IA de génération d’images et de vidéos. Parmi les 40 publications relevées, 29 (#6 à #9, #13, #15 à #19, #24 à #40) ont été exclues du rapport comme hors sujet.
  • Les requêtes se limitaient aux intitulés exacts des tendances. Aucune recherche n’a été menée sur des noms directement pertinents comme « Stable Diffusion », « Midjourney », « Sora », « Kling » ou « ComfyUI ». Les publications permettant de comparer explicitement les solutions fermées — Midjourney, Sora, Runway, Veo, etc. — et open source — Stable Diffusion, Flux, ComfyUI, etc. — sont donc presque absentes de cette collecte.
  • Explore est géographiquement lié au lieu depuis lequel la session semble être servie, autour de la Croatie, et ne représente donc pas les tendances mondiales de X.
  • La collecte a été arrêtée à 40 publications ; aucun approfondissement supplémentaire — autres publications des mêmes comptes, développement des réponses ou recherche par hashtags — n’a été effectué lors de cette exécution.

YouTube

YouTube — Dernières tendances de l’IA de génération d’images et de vidéos

Chaînes
  • 動画編集の中の人 (chaîne) — publie de nombreuses comparaisons d’usage réel d’IA de génération d’images.
  • AI大学【AI&ChatGPT最新情報】 (chaîne) — publie principalement des vidéos récapitulatives mensuelles des outils d’IA générative.
  • 【さき】のAIでええやん。 (chaîne) — explique les mises à jour liées à Google I/O et Gemini.
  • Qwen (officiel) (chaîne) — publie les annonces officielles de la série Qwen-Image.
  • AIOnTrend (chaîne) — propose des comparaisons côte à côte de modèles d’images open source.
  • Urban Decoders (chaîne) — explique l’architecture des modèles Flux.
  • SECourses (chaîne) — mène de vastes tests de génération d’images locale, notamment plus de 700 essais.
  • Woollyfern (chaîne) — suit régulièrement les mises à jour mensuelles de Midjourney.
  • 寺田部チャンネル (chaîne) — publie des retours pratiques sur la génération vidéo locale avec ComfyUI.
  • 東京大学 吉田幸 研究室 (chaîne) — propose des explications régulières sur les tendances des technologies d’IA générative, issues d’une université.

Le nombre d’abonnés n’a pas pu être récupéré, les pages de résultats et de vidéos YouTube étant rendues en JavaScript (voir Limits ci-dessous).

Vidéos
Solutions fermées
  1. 【ド課金して判明】2026年おすすめ画像生成AIはコレ!NanoBananaPro・Seedream4.0・Midjourney・AdobeFireflyを徹底比較します! — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — comparaison pratique, après abonnement payant, de Nano Banana Pro, Seedream 4.0, Midjourney et Adobe Firefly, avec une conclusion sur les meilleurs outils de 2026.
  2. 【2026年冬最新】ここ数か月で過去イチ進化した無料の人気動画生成AIツール6選!~Sora 2、Veo 3.1、Kling 2.6など~ — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — présente six outils gratuits de génération vidéo IA, dont Sora 2, Veo 3.1 et Kling 2.6, en soulignant l’ampleur de leurs progrès ces derniers mois.
  3. 【性能ランキング世界1位】xAIの動画生成AI「Grok Imagine」徹底解説! Sora/Veo級の映像を無料で作る方法! — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — affirme que Grok Imagine de xAI est premier dans les classements de performance et explique comment créer gratuitement des vidéos au niveau de Sora ou Veo.
  4. 【最新】GoogleのAI Geminiのモデルが大幅アップデート!動画生成Omniも発表されたGoogle I/O 2026を解説するで! — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — explique les importantes mises à jour de Gemini et le nouveau modèle de génération vidéo « Omni », annoncés lors de Google I/O 2026.
  5. Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More! — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — signale la sortie de Midjourney V8.2 et l’ajout de la personnalisation ainsi que de NIJI Style Creator ; épisode le plus récent d’un suivi mensuel allant de V8 Alpha en mars 2026 à V8.1 en avril, puis à l’aperçu V8.2 en juin et à la version finale en juillet.
Open source
  1. 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — chaîne officielle Qwen — https://www.youtube.com/watch?v=1tM7Wd0lEeI — vidéo d’annonce officielle de Qwen-Image-2.0 par l’équipe Alibaba Qwen, présenté comme un modèle de génération d’images open source de nouvelle génération.
  2. Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX - Presets Published — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — vérifie, sur plus de 700 tests, les aspects dans lesquels Qwen Image surpasse FLUX et publie des presets.
  3. Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro - Which AI Image Wins? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — compare les outils open source Flux 2 Klein, Qwen et Z Image Turbo à Nano Banana Pro, solution fermée, avec le même prompt.
  4. Flux.2 New Open Source King? Architecture FULL guide + Nano Banana Pro comparisons — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — explique l’architecture de Flux.2, publié par Black Forest Labs, et examine s’il pourrait devenir le nouveau roi open source en le comparant à Nano Banana Pro.
  5. Flux 2 Klein Just Dropped—This Image Editing Model Isn't Just About Speed!https://www.youtube.com/watch?v=JXgBe3twxbc — annonce la sortie rapide de Flux 2 Klein, modèle léger d’édition d’images de Black Forest Labs pouvant être exécuté localement.
  6. Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Modelshttps://www.youtube.com/watch?v=3BFDcO2Ysu4 — tutoriel récapitulant les mises à niveau de modèles open source de pointe, dont Wan 2.2 d’Alibaba, FLUX et Qwen Image.
  7. 【無料・ComfyUI】ローカル動画生成AIを使って長編動画を制作するのは簡単か?無茶苦茶大変です — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — compte rendu pratique sur la création de vidéos longues avec ComfyUI et des IA vidéo locales, avec un retour honnête : c’est extrêmement difficile.
Signaux
  • Le principal enjeu côté solutions fermées oppose prix et rapidité à qualité : plusieurs contenus de comparaison affirment que Nano Banana Pro gagne 63 % des tests de photoréalisme (vidéos 1 et 9), tandis que les solutions gratuites ou peu coûteuses, comme Grok Imagine (vidéo 3), se présentent de façon provocante comme des outils permettant de créer gratuitement des vidéos « au niveau de Sora/Veo ».
  • Midjourney continue d’améliorer la série V8 selon un rythme mensuel : de l’annonce de V8 en février 2026 à Alpha en mars, V8.1 en avril, l’aperçu V8.2 en juin puis V8.2 finale en juillet, la chaîne Woollyfern assure un suivi mensuel qui fait ressortir la vitesse de la cadence de mise à jour (vidéo 5).
  • L’annonce de « Omni », génération vidéo de Gemini, lors de Google I/O 2026 est traitée comme une importante actualité à part entière, y compris par une chaîne japonaise qui a publié une explication rapide (vidéo 4).
  • Le camp open source se dispute le leadership entre Qwen Image et FLUX : des chaînes d’analyse approfondie publient continuellement des vidéos évaluant « lequel est le meilleur », comme les plus de 700 tests de SECourses (vidéo 7) et l’explication d’architecture d’Urban Decoders (vidéo 9), ce qui témoigne d’un fort intérêt communautaire.
  • « Flux 2 Klein » de Black Forest Labs attire l’attention comme dérivé léger destiné à l’exécution locale, distinct de Flux.2 en taille réelle (vidéo 10).
  • Les modèles Alibaba Wan et Qwen Image sont traités comme les deux volets, vidéo et image, de l’open source, suffisamment étroitement liés pour être réunis dans un même tutoriel (vidéo 11).
  • La génération vidéo locale reste jugée difficile en pratique : une revue franche décrit la création de vidéos longues avec ComfyUI comme « extrêmement difficile » (vidéo 12). Au-delà de la qualité, la lourdeur opérationnelle demeure un défi de la génération vidéo open source.
Limites
  • Les pages de résultats YouTube (/results?search_query=...) et les pages watch sont rendues en JavaScript ; WebFetch n’a donc récupéré que du HTML statique, avec les liens de pied de page vers les conditions et droits d’auteur, sans liste de vidéos, vues, dates, descriptions ni commentaires. Cela contredit l’hypothèse du playbook selon laquelle le HTML de page contient le titre, la chaîne, les vues et la date de publication.
  • Une vérification alternative a combiné la recherche Web site:youtube.com, qui fournissait les titres, URL, résumés des moteurs et quelques dates, avec l’endpoint oembed de YouTube, qui fournissait en JSON le titre officiel, le nom de la chaîne et son URL. Toutefois, les vues, le nombre d’abonnés, le texte des descriptions et les commentaires n’ont pas pu être récupérés avec ces moyens et ne sont donc pas inclus ci-dessus.
  • Les recherches japonaises d’actualité ciblant « août 2026 » et « septembre 2026 » n’ont renvoyé aucune actualité spécifique à la génération d’images ou de vidéos IA ; elles mélangeaient des chaînes quotidiennes d’actualités IA générales, des informations hebdomadaires sur les entreprises IT et des actualités météo sans rapport. Aucune chaîne d’actualité spécialisée, publiée au cours de la semaine du 1er au 8 septembre, n’a été trouvée.
  • Reddit, X, Bluesky, Lemmy et Pinterest étaient hors du périmètre de cette étape et n’ont pas été étudiés, conformément à ce qu’indiquait brief.md.

Bluesky

Bluesky — Actualités de l’IA de génération d’images et de vidéos

Comptes
Identifiant Type Abonnés, etc. Note
@simonwillison.net Personne (blogueur technique IA reconnu, créateur de Datasette) Compare les capacités de génération d’images des nouveaux modèles avec son benchmark maison : demander à chacun de dessiner un pélican à vélo. La source la plus riche de cette collecte.
@404media.co Média (rédaction et plusieurs journalistes de 404 Media) Principalement consacré à la surveillance, mais publie aussi ponctuellement des enquêtes sur les médias générés par IA.
@aimod.social Opérateur de communauté (étiqueteur d’images soupçonnées d’être générées par IA) 2 555 abonnés, 94 publications Service d’étiquetage officiel Bluesky qui appose automatiquement une étiquette aux images suspectées d’être générées par IA. Ce n’est pas un média d’actualité mais une infrastructure.
@stablediffusion.bsky.social Personne (partage de prompts SDXL/Stable Diffusion) N’a plus publié depuis janvier 2025.
@bm63ai.bsky.social Personne (publications d’art ComfyUI/Flux/Midjourney) Publiait de l’art IA en continu jusqu’en avril 2025 ; sa dernière publication, en juin 2026, traite de création d’application par vibe coding avec Codex. Les publications d’art IA ont en pratique cessé.
@petapixel.bsky.social Média (média spécialisé dans la photographie) Traite de façon critique les fonctions d’IA générative d’Adobe, telles que Firefly et Lightroom, mais sa dernière publication remonte à février 2025 et ne fait pas partie de ce cycle d’actualité.
Publications
  • Nouveau benchmark du pélican à vélo avec GPT-6 Astra (@simonwillison.net, 2026-09-04, 202 mentions J’aime, 9 reposts, 18 réponses, https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c). « Got access to GPT-6 Astra. Want to see some pelicans? » L’auteur publie une image en grille comparant des illustrations SVG d’un pélican à vélo produites par GPT-6 Astra, GPT-5.6 Sol, Terra et Luna, chacun à trois niveaux de raisonnement (détails : static.simonwillison.net/static/2026/gpt-6-and-5.6-pelicans.html). Selon le texte alternatif, Astra produit des résultats soignés et cohérents, Sol des proportions variables, Terra une anatomie étrange, et Luna des poses plus simples et rigides. Une réponse estime qu’Astra est le premier modèle à avoir compris qu’un quadrupède fictif avait besoin d’un vélo tandem.
  • GPT-6 Astra manipule Blender pour générer une scène 3D de pélican (@simonwillison.net, 2026-09-05, 400 mentions J’aime, 30 reposts, https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s). L’auteur donne trois instructions successives : « Use the already install /Applications/Blender to render a scene of a pelican riding a bicycle », puis « add a background and a lot of flair », et enfin « make it a whole lot better ». Il publie le résultat produit en faisant dessiner une scène 3D dans Blender par l’intermédiaire d’un agent de programmation. Le même sujet — « GPT-6 Astra produit un rendu photoréaliste dans Blender » — a été abordé indépendamment dans r/DefendingAIArt sur Reddit, confirmant son caractère transversal.
  • Qwen 3.7 27B open source dessine localement un pélican (@simonwillison.net, 2026-08-14, 183 mentions J’aime, 14 reposts, https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z). « The new Qwen 3.7 27B, running as a 17GB GGUF in LM Studio on my M5 Max MacBook Pro, just drew me the best pelican riding a bicycle I've seen from any model that runs on my laptop. » Une des rares publications concrètes démontrant l’amélioration des capacités de génération d’images d’un modèle open source exécutable localement.
  • Un candidat au poste de gouverneur de New York attaque ses adversaires avec une fausse vidéo générée par IA (@404media.co, 2026-09-02, 124 mentions J’aime, 22 reposts, 7 réponses, https://bsky.app/profile/404media.co/post/3muka24vu4v2q). « The Republican Nominee for New York Governor Made a Creepy, AI-Generated Video of Mamdani and Hochul ». Une publication citant l’article ironise : nous vivons à une époque où l’on crée de fausses publicités au Viagra pour dénigrer un adversaire ; elle compte 194 mentions J’aime et 36 reposts (https://bsky.app/profile/404media.co/post/3muk7u6iepk2h), par une personne liée à 404 Media. Il s’agit d’un exemple d’utilisation de la génération vidéo IA dans la désinformation politique.
  • Le producteur de Cocomelon demande à ses artistes d’expérimenter avec l’IA (@404media.co, 2026-09-06, 84 mentions J’aime, 23 reposts, 21 réponses, https://bsky.app/profile/404media.co/post/3musx3wgdvc2n). « Moonbug Entertainment, which makes Cocomelon, Blippi, and other popular content for children, says it will begin using AI but will always have a 'human in the loop.' » C’est une annonce d’adoption de l’IA de génération d’images et de vidéos dans la production de contenus pour enfants, un cas d’usage majeur.
  • L’étiqueteur d’images IA suspectes aimod.social dépasse 2 500 abonnés (étude de profil, https://bsky.app/profile/aimod.social). Il se présente comme un « Labeler for flagging suspected AI imagery » et propose un manuel de critères d’évaluation ainsi qu’un mécanisme de recours. Ce n’est pas un article d’actualité, mais son existence montre qu’une demande communautaire s’est formée pour un système de détection et d’étiquetage automatisé des images générées par IA sur Bluesky.
  • Les anciens comptes de publication d’art IA restent largement silencieux (étude des fils de @stablediffusion.bsky.social et @bm63ai.bsky.social). stablediffusion.bsky.social n’a plus publié depuis le 22 janvier 2025, avec un prompt montrant « the liberty statue playing electric guitar » (#SDXL #StableDiffusion, 10 mentions J’aime). bm63ai.bsky.social a cessé les publications d’art IA après « Star Trek: The Muppet Generation » du 25 avril 2025 (#comfyui #midjourney #flux, 5 mentions J’aime) ; sa dernière publication, le 8 juin 2026, est passée à une application musicale créée avec un agent de programmation.
  • Critiques des fonctions d’IA générative d’Adobe, référence d’un cycle antérieur (@petapixel.bsky.social, 2025-02-12 et 2025-01-09, 7 et 33 mentions J’aime). « Adobe's newly-announced text-to-video tool is very much not ready to have a price tag attached to it », et une autre publication raconte qu’un photographe utilisant Generative Remove de Lightroom pour effacer un objet indésirable a vu apparaître à la place un logo Bitcoin. Ces publications précèdent le cycle d’actualité de septembre 2026, mais sont conservées comme exemples de la continuité d’un regard critique sur les outils commerciaux fermés.
Signaux
  • Ce qui progresse : les tâches de génération visuelle et vidéo de GPT-6 Astra — illustrations SVG de pélicans, manipulation de Blender pour rendre une scène 3D — ont été abordées séparément sur Reddit (r/DefendingAIArt, r/antiai) et Bluesky (@simonwillison.net), ce qui en fait le sujet transversal le plus important. Il faut toutefois noter qu’il ne s’agit pas précisément de génération par diffusion, mais d’un nouveau genre dans lequel un agent LLM utilise du code et des outils 3D pour créer des visuels.
  • Ce qui est minimisé ou rejeté : les sujets open source sont extrêmement rares ; seul un rapport d’exécution locale de Qwen 3.7 27B a été trouvé. Aucune publication annonçant FLUX, une nouvelle version de Stable Diffusion, Wan, HunyuanVideo ou d’autres modèles open source spécialisés n’a été trouvée sur Bluesky.
  • Élément surprenant : les comptes spécialisés dans l’art IA, actifs jusqu’au début de 2025 — stablediffusion.bsky.social et bm63ai.bsky.social — sont devenus silencieux, tandis qu’un service qui soupçonne et étiquette automatiquement les images IA, aimod.social, se maintient et progresse comme infrastructure communautaire. Le centre de gravité des discussions autour des images IA sur Bluesky pourrait s’être déplacé de la création vers la détection et la modération.
  • Signaux contradictoires : les actualités concrètes autour de la génération vidéo sont moins dominées par la concurrence de performances entre modèles que par une polémique d’usage — les abus dans la publicité politique liée à l’élection du gouverneur de New York. Sur Bluesky, l’IA vidéo est plus visible comme problème social que comme tendance technologique.
Limites
  • L’API publique de recherche Bluesky (app.bsky.feed.searchPosts) a systématiquement renvoyé HTTP 403 pour toutes les requêtes, en anglais comme en japonais — « image generation AI », « Stable Diffusion », « Midjourney », « Sora », « Veo », « Kling », etc. Elle était donc inutilisable. Au cours de la même session, app.bsky.actor.getProfile et app.bsky.feed.getAuthorFeed ont répondu normalement ; seul l’endpoint de recherche semble nécessiter une authentification ou être bloqué.
  • L’interface Web bsky.app/search est une SPA rendue côté client ; le texte des publications n’est pas présent dans le HTML et l’outil de récupération de pages ne pouvait donc pas lire les résultats de recherche effectifs.
  • Pour ces raisons, la procédure prévue par le playbook — recherche par mots-clés puis lecture des publications — n’a pas pu être appliquée. Elle a été remplacée par la récupération individuelle de l’historique de comptes connus trouvés par recherche Web, notamment simonwillison.net, 404media.co, petapixel.bsky.social, aimod.social, stablediffusion.bsky.social et bm63ai.bsky.social. L’échantillon est donc constitué de comptes, et non un substitut exhaustif à une recherche par mots-clés.
  • Les comptes envisagés pour OpenAI, Google DeepMind, Midjourney, Runway, Stability AI, Black Forest Labs, Krea, TechCrunch, The Verge, Ars Technica et Engadget — par exemple midjourney.com, runwayml.com, stability.ai, blackforestlabs.ai et krea.ai — n’existent pas sur Bluesky ou n’ont fourni aucune publication pertinente dans leur fil.
  • Le critère de complétion d’environ 20 publications analysées par plateforme n’a pas été atteint, faute d’accès à l’API de recherche. Seules les 8 publications de ce texte, plus une référence, ont pu être analysées. Les autres fils récupérés ne contenaient aucune publication pertinente ; notamment techcrunch.com, theverge.com, arstechnica.com, engadget.com et garymarcus.bsky.social, où une seule publication était disponible.
  • Aucune publication concrète sur des modèles open source de génération d’images ou de vidéos — FLUX, nouvelles versions de Stable Diffusion, Wan, HunyuanVideo, etc. — n’a été trouvée sur Bluesky. La méthode utilisée ne permet pas de distinguer l’absence réelle de discussion d’un manque de détection causé par l’impossibilité de rechercher.

Lemmy

Lemmy — Actualités de l’IA de génération d’images et de vidéos

Lemmy est un réseau social fédéré dont l’échelle représente une petite fraction de Reddit ; ici, un « buzz » se mesure non pas en centaines d’upvotes, mais souvent en dizaines. Pourtant, la collecte a fait ressortir des informations étonnamment denses. Les principales sources étaient !«メールアドレス» — pour ComfyUI et les sorties de modèles —, !ai_reddit — un bot qui republie les actualités de r/ArtificialIntelligence — ainsi que !technology et !techtakes, plus sarcastiques. Les recherches ont utilisé lemmy.world/api/v3/search avec différents mots-clés.

Communautés
  • !«メールアドレス» — 5 709 abonnés, dont 893 locaux. Hub d’information sur les nœuds ComfyUI personnalisés et les sorties de modèles. Des publications paraissent presque tous les jours.
  • !«メールアドレス» — 2 362 abonnés. Galerie de créations générées avec Stable Diffusion, Flux et Krea2.
  • !«メールアドレス» — consacré à l’art IA de style anime ; la fréquence de publication est presque aussi élevée que dans la communauté précédente, même si le nombre d’abonnés n’est pas public.
  • !«メールアドレス» — 87 904 abonnés. Republie des articles de grands médias technologiques ; la controverse Midjourney y a également fait parler d’elle.
  • !«メールアドレス» — 2 690 abonnés. Communauté sarcastique sur l’industrie de l’IA, très sévère envers les errements de Midjourney.
  • !«メールアドレス» — compte de republication RSS de r/ArtificialIntelligence. Le nombre d’abonnés n’a pas pu être récupéré via l’API, mais c’est la source la plus dense en actualités.
  • !«メールアドレス» — 8 154 abonnés. Communauté anti-IA où ont aussi circulé des articles critiquant les chaînes d’approvisionnement de l’IA générative.
Publications
Plutôt solutions fermées
  1. Midjourney se réoriente-t-il vers un échographe médical « Midjourney Medical » ? — 2026-06-18–19, sujet très animé dans !techtakes et !hackernews. The Register ironise sur un « spa médical esthétique à la lumière dorée », tandis que pivot-to-ai.com compare le pivot à Theranos sur le ton de la blague. Score de 40 à 58.
    https://lemmy.world/post/48384985 (article source : pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
  2. Midjourney demande aux studios hollywoodiens de révéler comment ils utilisent l’IA — article TechCrunch, score 73 dans !technology. Suite de l’actualité autour des litiges sur le droit d’auteur.
    https://lemmy.world/post/49069400
  3. Google publie Nano Banana 2 Lite — modèle léger de génération d’images de DeepMind. Publications dans !hackernews et depuis un média technologique suisse, itmagazine.ch, entre le 30 juin et le 2 juillet 2026.
    https://lemmy.world/post/48857780 (deepmind.google/models/gemini-image/flash-lite/)
  4. MAI-Image-2.5 de Microsoft rejoint Nano Banana 2 dans les benchmarks — via the-decoder.com, !ai_reddit, 2026-05-28.
    https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/
  5. Test comparatif approfondi de ByteDance Seedream 5.0 Pro — souligne sa force en édition et en génération itérative, !ai_reddit, 2026-07-10.
    https://www.reddit.com/gallery/1usc03q
  6. La fonction Earth AI de Google suspendue un jour après son lancement — Fortune rapporte que des utilisateurs ont perturbé des lieux réels en superposant de fausses images, !ai_reddit, 2026-08-07.
    https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/
  7. L’activité entreprise de Runway double, avec une NRR dépassant 300 % — croissance de Runway, génération vidéo IA, sur le marché B2B, !ai_reddit, 2026-08-30.
    https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says-enterprise-business-doubled-nrr-over/
  8. Amnesty International qualifie les principaux systèmes IA d’illégaux dès leur conception — contexte de pression réglementaire sur l’IA générative, !ai_reddit, 2026-06-24.
    https://reddit.com/r/ArtificialInteligence/comments/1ue64s2
  9. Pax Silica : l’armement des chaînes d’approvisionnement de l’IA — analyse de la guerre économique autour des semi-conducteurs et ressources de calcul IA entre les États-Unis et la Chine ; score 14 dans !fuck_ai, 2026-09-06, comme risque géopolitique pour les grandes entreprises technologiques de solutions fermées.
    https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare
  10. Demander à « Astra 6 max » de créer un art qui m’émeut — génération artistique philosophique et autoréférentielle à partir d’un modèle commercial fermé, !ai_reddit, 2026-09-05.
    https://i.redd.it/3h241pocalnh1.png
Plutôt open source
  1. Publication de LLaDA-Image — nouveau modèle associant un Diffusion Transformer de 6B à un module figé de compréhension vision-langage, fondé sur LLaDA2.0-Mini. Il atteint des scores SOTA de 53,53 en anglais et 53,38 en chinois dans Qwen-Image-Bench. Une version rapide, « LLaDA-Image-Turbo », génère en deux à quatre étapes ; les poids, le code d’entraînement et les recettes sont tous ouverts. !stable_diffusion, 2026-09-04.
    https://lemmy.dbzer0.com/post/74988021 (article : arxiv.org/abs/2609.03796, code : github.com/inclusionAI/LLaDA-Image)
  2. Sortie de Boogu-Image-0.1 — famille de modèles ouverts comprenant plusieurs variantes Base/Turbo/Edit, sous licence Apache-2.0 permettant l’usage commercial. Avec 10B paramètres, elle enregistre le meilleur score parmi les modèles open source dans Qwen-Image-Bench, 53,58. !stable_diffusion, 2026-06-17.
    https://boogu.org/ (article : arxiv.org/abs/2607.13125)
  3. ComfyUI-Ref2VA-VSA : nœud d’accélération d’inférence pour MiniMax H3 — améliore fortement la vitesse d’inférence en génération vidéo, !stable_diffusion, 2026-09-08.
    https://github.com/Kablex/ComfyUI-Ref2VA-VSA
  4. ComfyUI-AetherScale : upscaler vidéo natif pour GPU NVIDIA!stable_diffusion, 2026-09-05.
    https://github.com/vizart-vj/ComfyUI-AetherScale
  5. ComfyUI-VDN-H3 : attention hybride Video Delta Net — nœud d’efficacité pour les modèles de génération vidéo, !stable_diffusion, 2026-09-05.
    https://github.com/Saganaki22/ComfyUI-VDN-H3
  6. ComfyUI-Majoor-OmniCam : outil de mise en page et d’animation de caméra — nœud de contrôle du travail de caméra pour la génération vidéo et d’images, !stable_diffusion, 2026-09-04.
    https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam
  7. FastH3-Ref2V-Stream-Controller — outil de contrôle de flux pour la génération vidéo MiniMax H3, !stable_diffusion, 2026-09-04.
    https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller
  8. ComfyUI-InpaintCanvas : interface d’inpainting façon Krita!stable_diffusion, 2026-09-08.
    https://github.com/DenRakEiw/ComfyUI-InpaintCanvas
  9. ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — trois nœuds d’accélération et d’allègement pour modèles vidéo MiniMax H3 ont été publiés en succession rapide entre le 1er et le 2 septembre 2026. C’est un signe de l’activité très intense de l’écosystème open source de génération vidéo.
    https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE
  10. InterleaveThinker : recherche sur le renforcement de génération intercalée agentique — étude qui ajoute à des modèles de génération d’images existants une capacité de génération séquentielle texte↔image avec plusieurs agents, !stable_diffusion, 2026-06-12.
    https://arxiv.org/abs/2606.13679
  11. Vague de créations produites avec Flux/Krea2 turbo!stable_diffusion_art et !share_anime_art continuent de publier quotidiennement plusieurs créations d’art et d’anime générées par Flux et Krea2. Ce n’est pas une actualité ponctuelle, mais un signal continu que les modèles à poids ouverts sont utilisés au quotidien.
    https://lemmy.dbzer0.com/post/75150630 et de nombreux autres
Signaux
  • 🔥 Le principal sujet est l’errance de Midjourney. L’idée qu’une entreprise de génération d’images IA se lance dans les échographes médicaux a fait parler d’elle dans !techtakes comme dans !technology, dans une ambiance clairement négative, du type « mais qu’est-ce qu’ils font ? ». C’est de loin l’actualité qui obtient les scores les plus élevés parmi les solutions fermées, de 40 à 73.
  • 🛠️ Côté open source, cinq à six nœuds ComfyUI pour les modèles vidéo MiniMax H3 ont été publiés à la suite au cours de la même semaine. C’est le schéma classique d’une communauté de développeurs qui converge rapidement vers un modèle vidéo de base spécifique pour rivaliser sur l’optimisation. La présence de nombreux développeurs des régions sinophones, comme nazgut et lisitskyaa, donne aussi l’impression d’une dynamique mondiale.
  • 📊 Les passionnés de benchmarks utilisent Qwen-Image-Bench comme mesure commune. LLaDA-Image (53,53) et Boogu-Image-0.1 (53,58) s’affrontent avec le même benchmark, ce qui rend visible numériquement la compétition de performances entre projets open source.
  • 😤 Les sujets d’IA générative débordent hors des communautés techniques, au point que !fuck_ai, une communauté critique de l’IA, relaie des articles sur les risques géopolitiques des entreprises de solutions fermées.
  • 🤖 Lemmy ayant une audience plus réduite, le seuil d’un « buzz » n’a rien à voir avec Reddit ou X : même un score dans les 70 peut constituer une grande actualité. Les nombres doivent être lus de manière relative, et non absolue.
Limites
  • Lemmy est fédéré : les recherches diffèrent selon les instances. L’API de lemmy.world a surtout récupéré du contenu local à lemmy.world ou des publications fédérées depuis d’autres instances. Les interfaces de recherche de lemm.ee et lemmy.ml ont été testées individuellement, mais la collecte s’est limitée à l’API de lemmy.world faute de temps ; aucune couverture de toutes les instances n’a été possible.
  • Les recherches sur « Kling AI », « Stability AI », « Wan 2.2 » et « Runway Gen » ont renvoyé zéro résultat ou des résultats non pertinents, comme des actualités politiques. Sur Lemmy, les discussions sur les modèles vidéo chinois Kling et Wan, ou sur Stability AI pris isolément, sont presque absentes. Les conversations sur les modèles vidéo n’apparaissent que via MiniMax H3 dans la communauté de développeurs ComfyUI.
  • !ai_reddit est un bot de republication automatique de r/ArtificialIntelligence : son actualité provient en fait de Reddit et ne constitue pas une information primaire originale de Lemmy.
  • Le critère de complétion d’environ 20 publications analysées a été atteint — environ 20 sont listées dans ce rapport, en plus de nombreux doublons et résultats non pertinents vérifiés — mais le volume de publications de Lemmy est très inférieur à celui de Reddit ou X. En matière d’information primaire de qualité, la plateforme reste plus limitée que les autres.

Pinterest

Pinterest — Actualités de l’IA de génération d’images et de vidéos

Parmi les 50 épingles collectées (output/pinterest.pins.md / images/pinterest/manifest.json, sans segmentation par genre et à partir de la requête unique « Image and Video Generation AI News »), 30 images ont été ouvertes et vérifiées. L’analyse ci-dessous s’appuie sur leur contenu.

Thèmes visuels
  • Miniatures « actualité IA » façon clickbait : homme barbu au visage surpris et logos d’outils néon ([11]), sourire de type Sam Altman sur fond d’explosion ([19]), présentateur de nouvelles mi-humain mi-robot avec microphone « B » ([44]). Beaucoup reprennent directement la composition de miniatures YouTube. La majorité des épingles mènent vers des vidéos YouTube, et non vers des articles.
  • Infographies de classement « best of » de produits fermés : des listes dans des cadres néon répertoriant Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo AI, HeyGen, Synthesia, InVideo, Sora et Google Veo reviennent régulièrement [9, 27, 33]. Une version similaire pour les images réunit ChatGPT, Nano Banana, Ideogram, GenTube et Z-Image [36].
  • Représentations personnifiées d’IA sous forme de robots ou de présentateurs : robot blanc assis à un bureau de journal télévisé ([32]), images synthétiques de présentatrices ([38, 49]), robot aux côtés d’une infirmière ou d’un humain dans une scène médicale ([50]). Les métaphores d’une IA qui remplace des rôles humains — journaliste, médecin — sont plus fréquentes que les captures d’écran des outils eux-mêmes.
  • Images inquiétantes sur les deepfakes et l’authenticité : photo de chat portant le tampon « FAKE » avec un nombre de likes ([3]), quiz « Which is AI? » comparant deux images de montagnes ([10]), onde sonore associée à un détecteur indiquant « 97% likely AI generated » ([25, avec une image interne apparentée à [35]). La détection et le scepticisme forment une sous-thématique distincte de la génération elle-même.
  • Visuels IA génériques de type stock : images abstraites aux néons violet-bleu, silhouettes de cerveau, circuits et effets de particules, seulement accompagnées d’un titre ([2, 4, 5, 15, 20, 30]). Elles servent de remplissage « visuel IA » sans nom de produit ni capture d’écran spécifique.
  • Grilles de démonstration avant/après pour image-vers-vidéo : une photo ou vidéo de départ transformée en multiples styles — LEGO, origami, personnage couvert de fleurs, voiture jouet — ([7]), ou un schéma montrant une photo convertie en cinq étapes de timeline ([1, 6]). Ces épingles visualisent la fonctionnalité « une image vers une vidéo ».
  • Les produits cités sont réels, mais presque tous fermés : Veo 2/3 ([13, 24]), VASA-1 de Microsoft Research ([41]), Grok ([32]), Sora, ChatGPT et Nano Banana ([36]) sont abondamment nommés ; aucun modèle ni dépôt clairement open source n’apparaît dans les 30 éléments examinés.
  • Infographies promouvant une logique de pipeline IA : une image propose de créer automatiquement un vlog à partir d’un lien viral grâce à quatre agents, « Scout→Script→Generate→Animate » ([47]). Elle suggère une évolution de la génération vidéo depuis un outil isolé vers des workflows automatisés.
Épingles notables
  • [1] Image to Video AI: How It Works and Why It Matters — schéma le plus concret sur le plan technique : une image fixe passe par des curseurs d’intensité de mouvement, de cohérence temporelle et de contrôle visuel avant de devenir une timeline vidéo.
  • [7] (sans titre, grille de transformations LEGO/origami/fleurs) — grille avant/après 3×5 où des vidéos sources — une personne, une peluche panda, une Tesla — sont transformées en bois, origami, LEGO ou fleurs. Une des rares démonstrations montrant de vrais résultats générés.
  • [9] 10 FREE AI VIDEO TOOLS IN 2026 — liste de dix outils vidéo IA gratuits : Pictory, Runway ML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canva et Hyperwrite. Elle donne une vue d’ensemble des offres gratuites des acteurs fermés.
  • [24] (sans titre, image-vers-vidéo avec personnage monstre violet) — démo présentant trois vidéos de sortie plaçant une image d’entrée unique dans des arrière-plans très différents, notamment une salle de serveurs, des ruines sous-marines et une ville en bonbons. Le titre est lié à Veo 3.
  • [27] 5+ Best AI Video Generation Websites — compare Runway, Pika, Kling AI, Luma, Canva et Hailuo, et précise que les outils visent notamment YouTube Shorts, TikTok, les épingles vidéo Pinterest et les vidéos de présentation de produits. Pinterest lui-même est donc envisagé comme destination de diffusion pour les vidéos IA.
  • [36] Top AI Image Generation Tools — liste ChatGPT, Nano Banana, GenTube, Ideogram et Z-Image, une sélection d’outils de génération d’images en 2026. Des noms plus récents, comme Nano Banana et Z-Image, ont déjà pénétré les contenus SEO de Pinterest.
  • [39] The Latest AI Developments (triptyque façon breaking news) — seule épingle semblant relever véritablement de l’actualité, avec trois éléments précis : l’IA répond en premier aux appels 911 de La Nouvelle-Orléans, Meta publie gratuitement son modèle d’agent hors ligne Muse Glimmer, et le groupe nord-coréen Kimsuky automatise des documents de phishing avec sa pile IA interne.
  • [41] Microsoft Unveils VASA-1 — schéma de démonstration de Microsoft Research illustrant la génération en temps réel de visages parlants avec plusieurs personnes, à partir d’une image et d’un extrait audio, avec un signal optionnel de contrôle des expressions. Une des rares épingles provenant d’une annonce de recherche.
  • [16] AI Image Video: Best Quality vs Best Free — guide de décision opposant ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber et Synthesia à Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape, CapCut, etc. Il va jusqu’aux critères de choix, comme la lisibilité du texte, la disponibilité d’un GPU ou le besoin d’éditer du SVG.
  • [47] AI video creation just got crazy — proposition d’un pipeline automatisé où quatre agents, « Scout→Script→Generate→Animate », créent un vlog complet à partir d’un lien vers une vidéo virale ; une approche dépassant l’outil unique.
Signaux
  • Sur Pinterest, le domaine « Image and Video Generation AI » est dominé non par l’actualité urgente, mais par des infographies SEO ou affiliées de comparaison d’outils et de tutoriels. Les liens directs vers des sources primaires — annonces officielles, articles de recherche ou publications sociales — sont rares ; la plupart des épingles redirigent vers des blogs ou vidéos YouTube.
  • Les seuls événements d’actualité concrets identifiés sont les trois éléments de [39] — IA répondant aux appels 911, Meta Muse Glimmer et Kimsuky nord-coréen — ainsi que des épingles mentionnant les annonces de Veo 2/3, VASA-1 et Grok. Les sources primaires qui mériteraient l’appellation « dernière actualité » restent limitées, même à l’échelle de 20 éléments.
  • La présence des solutions fermées est écrasante : Runway, Pika, Kling AI, Luma, Canva, Hailuo, HeyGen, Synthesia, Sora, Veo, ChatGPT/Nano Banana et Ideogram reviennent continuellement. À l’inverse, aucun modèle ni projet open source n’a été observé dans les éléments examinés : aucune mention de Stable Diffusion, ComfyUI, Open-Sora ou équivalent. Pinterest est donc une source faible pour décrire les tendances open source.
  • Les images d’une IA qui remplace des rôles humains — présentateur, infirmière, opérateur du 911 — et celles qui invitent à douter de l’authenticité des contenus générés — tampon FAKE, « Which is AI? », détecteurs d’IA — apparaissent en quantité comparable. Elles placent l’impact social et les inquiétudes sur la fiabilité au même niveau que la technologie de génération elle-même.
  • Les démonstrations mettent surtout en avant des usages de transformation : animer une photo unique, changer le style d’une vidéo existante — en LEGO ou en origami, par exemple — plutôt que la création text-to-video entièrement depuis zéro.
Limites
  • Les 50 éléments précollectés ne sont pas segmentés par genre — le champ genre est vide pour chacun — et proviennent d’une requête unique. Ils n’ont donc pas été recherchés intentionnellement selon les deux axes solutions fermées/open source.
  • Faute de temps, seules 30 images sur 50 ont été ouvertes et vérifiées. Les éléments non vérifiés incluent les index 14, 15, 18, 21, 22, 26, 28, 29, 31, 37, 40, 42, 43, 45, 48 et d’autres. Leurs titres, tels qu’ils apparaissent dans pinterest.pins.md, recoupent généralement les thèmes déjà vus : comparaisons d’outils de synchronisation labiale, de montage vidéo ou de détection de contenu IA. Aucun indice d’un genre distinct susceptible de renverser les tendances ci-dessus n’a été observé.
  • Pinterest n’a pas été parcouru directement ; les conclusions sont basées, conformément au playbook, uniquement sur les images et titres précollectés par le worker. Les dates de publication et données d’engagement — likes ou sauvegardes — ne figurent ni dans le manifest ni dans la table des épingles. Il est donc impossible de savoir à quel moment un contenu a été publié ou diffusé.
  • Aucune mention significative de mouvements open source n’ayant été trouvée sur Pinterest, un futur rapport intégré devra indiquer explicitement que Pinterest ne peut pas servir de preuve pour les tendances open source.

Actions recommandées

  • Continuer à surveiller la génération visuelle agentique de GPT-6 Astra — manipulation de Blender et création de villes 3D — comme thème dédié lors des prochaines éditions.
  • Pour ne pas manquer les annonces open source, ajouter lors de la prochaine collecte transversale des requêtes sur des noms précis tels que « FLUX », « Stable Diffusion », « Qwen-Image », « Wan » et « ComfyUI ».
  • Pour Bluesky, partir du principe que l’API de recherche continuera à renvoyer des 403 et étoffer à l’avance une liste de comptes à surveiller.
  • Pinterest ne fournissant pas les dates de publication ni les données d’engagement, l’utiliser pour un suivi régulier de la notoriété des outils, mais pas pour comparer des actualités urgentes nécessitant une évaluation de fraîcheur.
  • La réalité et les modalités du supposé changement de cap de Midjourney vers les équipements médicaux restant incertaines, éviter les citations affirmatives tant qu’une source primaire, telle qu’une annonce officielle de Midjourney, n’est pas disponible.
  • Donner la priorité à !stable_diffusion sur Lemmy et aux chaînes YouTube de vérification pour suivre les évolutions open source.

Images collectées

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 Création d’images et de vidéos par IAPréoccupations liées aux contenus IA et aux réseaux sociauxConcept de création de contenu par IA avec icônes pour la génération de texte, d’images, de musique et de vidéos par intelligence artificielle — Parcourir 57 photos, vecteurs et vidéos de stockLa plateforme ultime de génération d’images et de vidéos par IA - The Data Scientist️ Image vers vidéo par IA – Animez vos photos avec l’IAGoogle annonce une vidéo d’ultra-haute qualité...Réussissez-le 🎥🎬 10 OUTILS VIDÉO IA GRATUITS EN 2026 🤯 Créez des vidéos sans logiciel coûteux !imageActualités IA : OpenAI a enfin publié ce que nous demandionsVeo 3 image-vers-vidéo : génération rapide et audio natif via l’API GeminiGoogle dévoile Veo 2 : outil avancé de génération vidéo IA, au réalisme et aux fonctions cinématographiques améliorésimageIntelligence artificielle : préservons notre...IA pour la génération d’images et de vidéosTop 10 des outils de synchronisation labiale (2026) – Les meilleurs logiciels IA pour des vidéos de synchronisation labiale réalistesMeilleurs générateurs vidéo IA de 2025GPT 5.2, éditeur vidéo en temps réel, vidéos IA stéréo, agents IA mobiles, contrôle du corps entier : ACTUALITÉS IAimageComment l’IA transforme le montage vidéoPourquoi la génération vidéo IA devient essentielle pour...Plus de 20 % de YouTube est désormais généré par IAGoogle annonce l’IA de génération vidéo « Veo 3 »,...‎🚨 L’IA devient terriblement convaincante.image5+ meilleurs sites de génération vidéo IA 2026 | Runway, Pika, Kling AI, Canva et plusOutils IA de montage vidéo — Ce que les créateurs utilisent réellement pour créer du contenu en 2026imageIntelligence artificielle : un outil pour libérer...Analyse d’images et de vidéos pilotée par IADécouvrez comment Grok révolutionne la vidéo...12 meilleurs générateurs vidéo IA en 2026 (gratuits et payants) | Google Veo, Sora, Runway et plusPaul Lafargue du groupe IDEC : l’impact de...Comment détecter gratuitement les images générées par IA en ligneoutils de génération d’images IA 🔥🔥Qu’est-ce qu’Imagvio AI et comment aide-t-il les créateurs...TotalYmage révolutionne les vidéos interactives...Les dernières évolutions de l’IA - L’IA répond aux appels 911, modèle hors ligne Metaoutils IAMicrosoft dévoile VASA-1, établissant de nouvelles références pour l’IA générative en génération vidéoL’avenir de la création vidéo : les meilleurs générateurs vidéo IA de 2026🔸Vidéos générées par IA : bonnes ou mauvaises ? Voici la vérité ! 🤖🎥Le récapitulatif sarcastique des actualités IA #8Je vais créer une vidéo explicative avec Synthesia, Sora AI, Kling AI, Runway AI et InVideoLe guide ultime pour exploiter Chat GPT en tant que...La création vidéo IA devient folle.Qu’est-ce que l’IA générative ? Guide technique complet - RCN GuideComment créer une chaîne d’actualités avec l’IA || Générateur de vidéos d’actualités IA || Synchronisation labiale IAIA

Note sur la qualité des données

Bluesky n’a pas atteint le critère de 20 publications, car l’API de recherche renvoyait constamment une erreur 403. Pinterest ne permettait pas d’évaluer la fraîcheur des données, faute de dates de publication et de métriques d’engagement. Reddit et X, limités à une seule requête, ne permettaient pas de comparer intentionnellement solutions fermées et open source ; les sujets open source se sont donc concentrés sur Lemmy et YouTube.

Galerie