Actualités de l’IA de génération d’images et de vidéos — 2026-09-09
Les deux leaders du closed source sont Google Nano Banana Pro et OpenAI GPT Image 2 ; Sora se dirige vers sa fin, tandis que l’open source — Qwen-Image, FLUX, Wan et HunyuanImage — se rapproche d’une qualité équivalente.
Récapitulatif des actualités de l’IA de génération d’images et de vidéos — 2026-09-09
J’ai tout rassemblé 🔥 En bref, côté closed source, Google Nano Banana Pro (Gemini 3 Pro Image) et OpenAI GPT Image 2 se disputent la première place. L’application autonome Sora semble en fin de vie, tandis que la vidéo se joue surtout entre Kling, Seedance et Veo — les acteurs chinois et Google. 😤 Côté open source, Qwen-Image, Z-Image, FLUX, Wan et HunyuanImage atteignent désormais un niveau où l’on se dit : « On peut faire tout ça gratuitement ?! » ComfyUI et les communautés de création locale restent très actives. 💪 En revanche, X a complètement raté sa collecte cette fois-ci ; je le signale donc franchement.
Toutes plateformes confondues
Constats côté closed source (10) 🏢
- Nano Banana Pro (Gemini 3 Pro Image) est réputé « écraser les autres modèles en génération d’images » et monopolise les discussions sur YouTube → https://www.youtube.com/watch?v=UV9GqinedQ8
- Arrivée de GPT Image 2 d’OpenAI : plus de 99 % de précision textuelle dans plus de 12 langues, jusqu’à 8 images en une requête en mode Thinking, et prise en charge 4K en cours → https://www.youtube.com/watch?v=blOlUnC75O4
- Google a entièrement arrêté Imagen le 17 août 2026 pour se concentrer sur la famille Nano Banana. La génération d’images closed source se recentre sur Google.
- OpenAI a arrêté l’application Sora le 26 avril ; l’API Sora doit également être supprimée le 24 septembre. La marque Sora est de fait proche de la fin → https://lemmy.world/post/44721138
- dahara1 sur Bluesky a déjà signalé que la version gratuite de Sora ne fonctionnait plus après épuisement des crédits → https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
- Grok Imagine Image 2.0 de xAI, sorti le 7 août, s’est placé juste derrière GPT Image 2 dans Arena, ouvrant une bataille à trois.
- Seedance 2.5 de ByteDance a ouvert son API au public le 7 août et devient une solution majeure aux côtés de Veo 3.1 et Kling 3.0.
- Des utilisateurs de Reddit ont comparé Seedance 2.5 et Wan 3.0 open weight avec le même prompt ; les avis sont très divisés → https://www.reddit.com/r/generativeAI/comments/1w60fip/
- Midjourney suscite des critiques après un virage surprenant de la génération d’images vers les scanners médicaux à ultrasons ; certains font un parallèle avec Theranos → Lemmy, via theregister.com.
- ByteDance et Hollywood, via la MPA, ont conclu un accord mondial sur la protection du droit d’auteur lié à l’IA ; les mesures de conformité se concrétisent → recherche Pinterest.
- Sur Reddit, une technique permettant de simuler une « vraie vidéo accélérée de dessin à la main » avec l’IA a déclenché une polémique de 7 088 points ; des appels à l’étiquetage obligatoire de l’IA se multiplient → https://www.reddit.com/r/antiai/comments/1w81kdd/
- Le seul compte luok.ai sur Bluesky a relayé, de décembre 2025 à février 2026, des modèles Kling, Runway, PixVerse, Vidu, Seedance et Niji : la poussée des acteurs chinois est particulièrement visible.
Constats côté open source (10) 🛠️
- Qwen-Image 2512 d’Alibaba, de type Apache, et Z-Image Turbo sont les deux grandes tendances, avec une prolifération de vidéos comparatives → https://www.youtube.com/watch?v=uAGH_yRZ2Gw
- Flux 2.0 est confronté à Qwen-Image 2512 et Z-Image dans un test de résistance de 15 critères → https://www.youtube.com/watch?v=54zvSiAWz2Y
- LTX-2.3 de Lightricks, 22 milliards de paramètres, synchronisation audio et 4K/50 fps, est jugé de qualité comparable aux modèles fermés → https://www.youtube.com/watch?v=qQXzlk134Sw
- Des vidéos pratiques affirment que Wan 2.5 d’Alibaba dépasse le Veo 3 closed source → https://www.youtube.com/watch?v=yvD8TxNsR4Q
- WanGP, un agent gratuit réunissant plusieurs modèles OSS — LTX-2.3, Qwen, Flux.2 Klein et Z-Image — marque l’essor des workflows unifiés → https://www.youtube.com/watch?v=h-k6xOEITx4
- HunyuanImage 3.0 de Tencent, un MoE de plus de 80B, reste une référence parmi les grands modèles d’images open source.
- FLUX 3 de Black Forest Labs prend en charge images et vidéos de 20 secondes avec audio, dans le cadre d’une sortie limitée → https://bfl.ai/blog/flux-3
- Une version légère de FLUX.2-klein-9b-kv-fp8 est disponible et le FLUX Creator Program a été lancé ; Martin Scorsese a même rejoint le projet comme conseiller.
- Les communautés Stable Diffusion de Lemmy, bien qu’autour de 5 000 membres, publient quotidiennement des créations ComfyUI, SDXL et Krea2 : l’usage réel demeure très solide.
- Simon Willison sur Bluesky a rapporté avoir exécuté Qwen 3.7 27B localement sur un MacBook M5 ; son modèle GGUF de 17 Go a produit son meilleur pélican à vélo, contribuant à une culture de benchmark de génération locale → https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
- Le modèle vidéo open source SkyReels V1, basé sur HunyuanVideo, ainsi que le workflow OSS tout-en-un Open Creative Studio continuent aussi d’être mis à jour régulièrement → https://bsky.app/profile/perilli.com/post/3mdddenkss22v
Point marquant toutes plateformes confondues : l’opposition closed source/open source revient constamment sur Reddit, YouTube et Lemmy : « fermé, simple mais censuré et coûteux » contre « ouvert, libre mais plus contraignant ». La méfiance envers les outils qui promettent « gratuit et illimité » est également unanime dans plusieurs communautés 🙅♂️. Pinterest fait exception : cette opposition y apparaît peu, la plateforme étant surtout centrée sur les présentations d’outils et les miniatures d’actualité.
Plateforme par plateforme
Reddit : 12 fils collectés. Un fil anti-IA totalisant 7 088 points est devenu plus visible que tous les sujets techniques réunis : la réaction contre les abus de l’IA est plus facilement perceptible que l’enthousiasme technique. Les subreddits clés comme r/StableDiffusion n’ont toutefois pas été couverts cette fois-ci.
X : ici, la collecte a été totalement ratée 😅 Les termes recherchés par le worker, tels que « Harvey » et « $LAPTOP », n’avaient aucun rapport avec le sujet ; parmi les 40 publications récupérées, aucune ne concernait la génération d’images ou de vidéos par IA. C’est la seule véritable lacune parmi les six plateformes prévues.
YouTube : les vidéos de revue et de comparaison sont riches. Côté fermé, la compétition oppose Google, OpenAI et xAI ; côté ouvert, Qwen-Image, FLUX, Wan, LTX-2.3, HunyuanImage et jusqu’aux workflows intégrés de WanGP sont bien couverts. Les vues et abonnements restent toutefois inaccessibles à cause du rendu JavaScript, empêchant toute comparaison chiffrée de fraîcheur.
Bluesky : l’API de recherche, searchPosts, a renvoyé 403 pour toutes les requêtes ; l’analyse s’est donc appuyée sur les fils de comptes connus. La couverture des acteurs vidéo fermés est conséquente via luok.ai, mais les discussions sur la vidéo open source sont faibles. SkyReels V1 est quasiment le seul exemple trouvé.
Lemmy : les actualités closed source les plus visibles concernent le virage médical de Midjourney et les sarcasmes autour de la fin de Sora. Côté ouvert, Black Forest Labs et FLUX dominent, avec des annonces concrètes à chaque trimestre.
Pinterest : les 50 épingles ont toutes été examinées. Les miniatures d’actualité avec visages de robots et néons, ainsi que les infographies de listes d’outils, dominent. Aucune des 50 images ne représente la culture open source auto-hébergée symbolisée par Stable Diffusion ou ComfyUI. Les métriques d’engagement sont généralement indisponibles.
À surveiller
- L’arrêt de l’API Sora d’OpenAI, prévu le 24 septembre 2026 — Lemmy https://lemmy.world/post/44721138
- L’évolution du classement Arena entre Grok Imagine Image 2.0 et GPT Image 2 — YouTube, comparaisons de type Marin Method.
- La bataille open source Qwen-Image / Z-Image / FLUX, et lequel deviendra le standard — YouTube https://www.youtube.com/watch?v=uAGH_yRZ2Gw
- La viabilité réelle de l’activité de scanners médicaux à ultrasons de Midjourney — Lemmy, via theregister.com.
- Les règles concrètes d’application de l’accord ByteDance × Hollywood sur le droit d’auteur — recherche Pinterest [24].
- L’adoption des agents OSS intégrés tels que WanGP — YouTube https://www.youtube.com/watch?v=h-k6xOEITx4
Recommandations
- Pour X, relancer la collecte avec des requêtes directement liées au sujet : « Midjourney », « Stable Diffusion », « Sora », « Nano Banana », « Qwen-Image », etc.
- Pour Reddit, inclure systématiquement à l’avenir les grands subreddits centraux : r/StableDiffusion, r/midjourney et r/comfyui.
- En remplacement de l’API de recherche Bluesky, placer les comptes clés identifiés — luok.ai, simonwillison.net, etc. — dans une liste de suivi récurrente.
- Pour illustrer l’opposition open/closed source, privilégier les commentaires de Reddit et Lemmy, généralement plus argumentés que Pinterest.
- Faire de la suppression de l’API Sora le 24 septembre et des suites du changement d’activité de Midjourney des priorités de la prochaine recherche.
Qualité des données
X n’a recueilli aucune publication liée à l’IA d’images ou de vidéos en raison de requêtes inadaptées : les données y sont donc pratiquement absentes. Bluesky et Pinterest n’ont pas permis d’obtenir les recherches API ou métriques d’engagement nécessaires, ce qui limite la validation quantitative de la diffusion des sujets. Sur YouTube, le contenu des vidéos et le nombre de vues sont également inaccessibles à cause du JavaScript ; l’analyse dépend donc des extraits de recherche Web. Reddit et Lemmy ont en revanche fourni un matériau globalement suffisant, tant en volume qu’en qualité.
Récapitulatif par plateforme
Reddit — Actualités de l’IA de génération d’images et de vidéos
Où
Les 12 fils collectés se répartissent sur 8 subreddits.
| Subreddit | Nombre de membres | Nombre de fils collectés |
|---|---|---|
| r/generativeAI | 151,605 | 4 |
| r/antiai | 319,039 | 1 |
| r/RemoteWorkers | 75,979 | 1 |
| r/Seedance_AI | 20,508 | 1 |
| r/freetoolsAI | 7,942 | 1 |
| r/aivideomaking | 6,614 | 2 |
| r/AItips101 | 1,153 | 1 |
| r/Unrouted_AI | 517 | 1 |
r/generativeAI, consacré à l’IA générative en général, arrive en tête avec quatre fils. En revanche, le fil qui écrase tous les autres en score et en commentaires est l’unique publication de r/antiai, hostile à la génération d’images par IA ; son engagement dépasse largement le total des autres fils.
Ce que disent les utilisateurs
- Les plateformes intégrées privilégiant l’absence de censure et la liberté gagnent du terrain : le fil 1 (r/AItips101, 81 points, 2026-09-07, https://www.reddit.com/r/AItips101/comments/1w9yftp/) présente « WildOwl.ai », un service sans abonnement et facturé à l’usage donnant accès à plus de 35 modèles, dont Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo et GPT Image. Dans les commentaires, u/reliablemicrophone84 estime que WildOwl résout bien le problème du choix entre modèles de pointe et liberté créative ; u/Clear-Assistance449 préfère toutefois l’abonnement illimité de Mage.space.
- Une forte méfiance envers le « gratuit et illimité » : les fils 2 (r/aivideomaking, 2 points, 22 commentaires, 2026-09-06, https://www.reddit.com/r/aivideomaking/comments/1w953eo/) et 5 (r/generativeAI, 1 point, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1wa4k88/) convergent : rien n’est vraiment gratuit et illimité. u/ai_art_is_art écrit dans le fil 5 : « Unlimited is a lie. You put $550 in, you get $200 out and you have to wait 24 hours between generations. »
- Une demande de vidéo de 45 secondes tourne à la dérision : dans le fil 4 (r/aivideomaking, 13 points, 22 commentaires, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/), une personne souhaite créer gratuitement une vidéo IA de 45 secondes depuis un téléphone ou un iPad. u/NewLifeWares souligne que 45 secondes exigent presque des ressources de datacenter et qu’un générateur gratuit de 5 secondes avec filigrane est déjà plus réaliste.
- La simulation par IA d’un dessin « réellement fait à la main » déclenche une énorme polémique : le fil 3 (r/antiai, 7 088 points, 1 023 commentaires, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/) porte sur la possibilité de faire contrôler souris et clavier à un LLM de niveau GPT-6 pour falsifier un véritable timelapse dans un logiciel de peinture. C’est de très loin le score le plus élevé de tous les fils collectés. u/Nayutantantan regrette que ces faux timelapses deviennent courants, tandis que u/Soggy_Supermarket100 réclame un filtrage IA dans chaque espace en ligne.
- Les deepfakes de célébrités réelles convergent vers le débat de la « responsabilité de l’utilisateur » : dans le fil 6 (r/Seedance_AI, 0 point, 22 commentaires, 2026-09-07, https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/), u/Jean_velvet explique que les décisions judiciaires récentes placent surtout la responsabilité sur l’utilisateur et sur la diffusion des contenus. u/Alchemist42 laisse entendre que les personnes concernées utilisent plutôt d’autres outils moins régulés.
- Affrontement de modèles closed source et open weight : le fil 10 (r/generativeAI, 110 points, 31 commentaires, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) compare Seedance 2.5, fermé et lié à ByteDance, à Wan 3.0, open weight et lié à Alibaba, avec le même prompt. u/SpecialistDragonfly9 juge Seedance très nettement supérieur, mais u/Positive-Key6640 rappelle que ce type de comparaison mesure surtout l’affinité d’un modèle avec un style de prompt précis.
- Le nouveau modèle d’images d’OpenAI fait discrètement parler de lui : le fil 7 (r/Unrouted_AI, 2 points, 6 commentaires, 2026-09-08, https://www.reddit.com/r/Unrouted_AI/comments/1waxp14/) partage le billet officiel d’OpenAI « introducing-chatgpt-images-2-5 ». u/Ok_Homework_1859 s’intéresse particulièrement à la fonction Sketch, qui permet de dessiner dans ChatGPT pour guider l’image.
- Frustration face aux restrictions sur les personnages protégés : dans le fil 11 (r/generativeAI, 2 points, 2 commentaires, 2026-09-08, https://www.reddit.com/r/generativeAI/comments/1waapc1/), un utilisateur regrette que Grok ne permette même pas de créer du fan art de personnages Disney pour un usage personnel. u/frighten propose PixelForge sur iOS comme alternative sans restrictions intégrées.
- Nostalgie et corrections autour de dix ans d’images générées par IA : le fil 9 (r/generativeAI, 15 points, 9 commentaires, 2026-09-06, https://www.reddit.com/r/generativeAI/comments/1w8gzt6/) retrace l’évolution de StackGAN en 2016 jusqu’aux images ChatGPT de 2026. u/noctalla signale que Google DeepDream, vers 2015, manque à cette chronologie.
- De nouveaux « petits boulots IA » apparaissent autour de la génération d’images : le fil 8 (r/RemoteWorkers, 169 points, 787 commentaires, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/) concerne une offre de revue à distance payée 30 $/heure pour vérifier des légendes générées par IA. Les 787 commentaires sont cependant surtout des répétitions demandant le lien « Images », avec peu de discussion concrète.
- Doutes sur la viabilité des outils de génération gratuits : le fil 12 (r/freetoolsAI, 40 points, 50 commentaires, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) présente aifreeforever.com, présenté comme gratuit, illimité et sans inscription. u/thecragmire demande comment le service peut être financé ; u/Relevant_Syllabub895 critique la sévérité des restrictions NSFW.
Signaux
- En hausse : les agrégateurs « sans censure et multi-modèles » comme WildOwl.ai, Venice, Mage.space et PixelForge sont explicitement cités dans plusieurs fils comme alternatives aux abonnements à un modèle unique. Les services vendant le choix des modèles et des filtres plus permissifs ressortent particulièrement.
- Argument rejeté : les services de génération vidéo ou d’images prétendant être « gratuits et illimités » sont accueillis avec scepticisme, voire rejetés, dans r/aivideomaking, r/generativeAI et r/freetoolsAI. Le coût matériel ou la facturation finit nécessairement par apparaître.
- Divergences d’opinion : la comparaison Seedance/Wan divise à la fois sur le meilleur modèle et sur la validité d’une comparaison fondée sur un seul prompt. Le fil 6 révèle aussi un désaccord entre partisans de la responsabilité de l’utilisateur et partisans d’une responsabilité accrue des services.
- Surprise : parmi les 12 fils collectés, le fil anti-IA, avec 7 088 points et 1 023 commentaires, obtient un engagement d’un ordre de grandeur supérieur aux sujets techniques. Il approche à lui seul le total de scores des autres fils, suggérant que les abus et la tromperie liés à l’IA sont plus visibles sur Reddit que l’enthousiasme pour la technique.
- Rapport open/closed source : l’opposition est surtout incarnée par Wan open weight contre Seedance fermé, ainsi que par le contraste entre la génération locale — ComfyUI, Civitai, Hugging Face — et les services cloud payants. Les modèles ouverts sont jugés plus libres mais plus exigeants ; les modèles fermés plus simples mais freinés par le coût et la censure.
Limites
- Seuls 12 fils ont été collectés, sous le seuil d’environ 20 demandé par brief.md. Une seule requête, « Image and Video Generation AI News », a été utilisée, sans recherches supplémentaires ciblant les sources fermées ou ouvertes.
- Les grands subreddits centraux tels que r/StableDiffusion, r/midjourney, r/aivideo et r/comfyui n’apparaissent pas du tout dans les résultats. Il s’agit d’une lacune de couverture qui empêche de présenter cette sélection comme représentative de Reddit dans son ensemble.
- Dans le fil 8, les principaux commentaires sont essentiellement des répétitions de demandes de lien « Images », ce qui fournit très peu de substance conversationnelle.
- L’agent n’a pas pu consulter directement Reddit ni ses pages de résultats, en raison d’un refus de WebFetch. L’analyse se limite donc aux informations précollectées dans
output/reddit.threads.mdet.json.
X
X — Actualités de l’IA de génération d’images et de vidéos
Préambule : les résultats collectés ne correspondent pas au thème
L’examen de output/x.posts.md montre que les termes effectivement recherchés par le worker étaient
« Harvey », « #Crypto », « #sweepstakes », « #Chance », « #giveaways », « Serbia »,
« $LAPTOP », « Arsenal », « Germans » et « Nazis ». Ils n’ont aucun lien avec la génération
d’images ou de vidéos par IA. Les 40 publications collectées, provenant de 39 comptes, ne contiennent
aucun résultat pertinent. De même, la liste Explore de X — géolocalisée depuis la Croatie — ne comporte
aucune tendance liée à l’IA.
| # | Tendance | Où |
|---|---|---|
| 1 | Harvey | Tendance en Croatie |
| 2 | #Crypto | Entreprises et finance · Tendance |
| 3 | #sweepstakes | Tendance en Croatie |
| 4 | #Chance | Tendance en Croatie |
| 5 | #giveaways | Tendance en Croatie |
| 6 | Serbia | Politique · Tendance |
| 7 | $LAPTOP | Tendance en Croatie |
| 8 | Arsenal | Sports · Tendance |
| 9 | Germans | Politique · Tendance |
| 10 | Nazis | Politique · Tendance |
Conformément à la règle 7, qui interdit l’invention de sources, les publications sans rapport ne seront pas présentées comme des constats thématiques. Les sections suivantes ne décrivent donc que les faits établis par la collecte.
Comptes
Les 39 comptes collectés appartiennent à des groupes sans rapport entre eux : fans de téléréalité romantique, traders crypto, comptes promotionnels de concours et cadeaux, débats politiques balkaniques, communautés de memecoins, supporters d’Arsenal et discussions autour du révisionnisme historique ou de l’antisémitisme. Aucun compte ne publiait sur l’IA de génération d’images ou de vidéos, ni ne signalait explicitement que son contenu avait été créé avec ces outils. Certaines publications portent la mention « has an image », mais sans mention de génération IA. Les plus grands engagements concernent @saintjupitr, 64 747 likes, et @Kwin8675309, 42 021 likes : dans les deux cas, il s’agit de publications politiques virales sans rapport avec le thème.
Publications
Aucune. Parmi les 40 publications, zéro ne correspond au sujet — IA de génération d’images et de vidéos, et tendances closed source/open source. Des publications individuelles, par exemple les débats politiques serbes #21–24, les messages de football liés à Arsenal #29–32 ou les débats historiques allemands et nazis #33–40, ont reçu un engagement important, mais ne sont pas comptabilisées comme résultats car elles ne concernent pas l’IA de génération visuelle.
Signaux
- Aucun signal haussier, baissier ou thématique n’a pu être détecté, faute de données pertinentes.
- Le seul constat possible est méthodologique : les résultats Explore étaient géolocalisés depuis la Croatie et les requêtes restaient figées sur des termes sans rapport avec le thème, tels que « Harvey » et « $LAPTOP ».
Limites
- Les requêtes ne correspondaient pas au sujet : les expressions « Found by searching “…” » consignées dans
output/x.posts.mdsont toutes sans lien avec l’IA visuelle. Aucune nouvelle recherche n’a été effectuée, conformément au playbook indiquant que le worker avait déjà collecté le matériel. Une nouvelle collecte avec des requêtes correctes — « AI image generation », « Midjourney », « Stable Diffusion », « Sora », « Veo », « オープンソース 画像生成AI », etc. — est nécessaire. - Parmi les 40 publications, aucune ne fournit de constat sur les tendances open source ou closed source de génération d’images et de vidéos. L’objectif d’analyser environ 20 publications par réseau n’a donc pas pu être atteint pour X.
- Explore ne contenait que des tendances générales croates, sans tendance IA.
- La session était valide et la collecte technique avait bien fonctionné ; le problème vient uniquement du choix des requêtes.
YouTube
YouTube — Dernières tendances de l’IA de génération d’images et de vidéos, closed source/open source
Chaînes
- AICodeKing — surtout des revues pratiques d’outils IA, dont un accès anticipé à Google Nano Banana Pro (Gemini 3 Pro Image). https://www.youtube.com/@AICodeKing
- Theo - t3.gg — chaîne de vulgarisation technique pour développeurs, avec une vidéo sur Nano Banana Pro. https://www.youtube.com/@t3dotgg
- ElevenLabs (officiel) — chaîne officielle de l’entreprise d’IA vocale ; elle explique aussi des actualités d’images générées par IA comme GPT Image 2. https://www.youtube.com/@Elevenlabs
- AIOnTrend — spécialisée dans les revues comparatives de modèles d’images open source tels que Qwen-Image 2512. https://www.youtube.com/@aiontrend
- BMF MEDIA — revues de modèles vidéo open source comme LTX-2.3. https://www.youtube.com/@BeerMoneyForum
- Marin Method — comparaisons côte à côte de modèles vidéo closed source, notamment Kling, Grok Imagine, Runway et Veo. https://www.youtube.com/@MarinMethod
- Jack Vs. AI — chaîne consacrée aux workflows pratiques, notamment autour de Wan 2.5. https://www.youtube.com/@JackVsAI
- Youri van Hofwegen — comparaisons et tests de modèles récents de génération vidéo tels que Seedance 2.0. https://www.youtube.com/@Yourivanhofwegen
- AI Late to Class — explications de workflows open source exécutés localement avec ComfyUI et WanGP. https://www.youtube.com/@ailatetoclass
- AI大学【AI&ChatGPT最新情報】 — chaîne japonaise expliquant notamment les comparaisons GPT Image 2 contre Nano Banana. https://www.youtube.com/@AIAIChatGPT-cj4sh
- Référence : Matt Wolfe (@mreflow) est une chaîne d’actualités IA d’environ 965 000 abonnés, qui publie des récapitulatifs hebdomadaires ; elle n’est pas un résultat direct de cette collecte, mais reste une grande chaîne représentative du secteur.
Vidéos
-
« Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN »
Chaîne : Theo - t3.gg|Publication : vers le 26 novembre 2025|https://www.youtube.com/watch?v=UV9GqinedQ8
→ Vidéo affirmant que Nano Banana Pro de Google, Gemini 3 Pro Image, surclasse les autres modèles de génération d’images. Un épisode emblématique de la pointe du closed source. -
« Nano Banana PRO (Gemini-3.0-Pro-Image): I GOT EARLY ACCESS... »
Chaîne : AICodeKing|https://www.youtube.com/watch?v=13AovEj4oDM
→ Revue en accès anticipé de Gemini 3 Pro Image, avec de nombreux exemples pratiques et un jugement très enthousiaste. -
« GPT Image 2 Is Here — Everything You NEED to Know »
Chaîne : ElevenLabs|Publication : 23 avril 2026|https://www.youtube.com/watch?v=blOlUnC75O4
→ Présentation de GPT Image 2, ou ChatGPT Images 2.0, d’OpenAI : précision textuelle de plus de 99 % dans plus de 12 langues, jusqu’à huit images par prompt en mode Thinking, et support 4K en API/bêta. -
【ナノバナナ超え】OpenAIの新しい画像生成AIモデル「GPT Image 2」とは?
Chaîne : AI大学【AI&ChatGPT最新情報】, en japonais|https://www.youtube.com/watch?v=ZrO7tv-uv1E
→ Présentation en japonais de GPT Image 2 par rapport à Nano Banana, couvrant les performances, l’utilisation et les cas d’usage. -
« Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison »
Chaîne : Marin Method|Publication : 10 mars 2026|https://www.youtube.com/watch?v=x5fMQvhKP60
→ Confrontation directe de quatre modèles vidéo closed source. Kling 3.0 y est jugé le meilleur dans l’ensemble, tandis que Grok Imagine se distingue en image-vers-vidéo. -
« Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 - Comparison »
Chaîne : Youri van Hofwegen|https://www.youtube.com/watch?v=vw_Jk2-phsA
→ Comparaison affirmant que Seedance 2.0 de ByteDance dépasse les principaux modèles fermés existants. -
« New Qwen Image 2512: Better Than Z-Image? (Open Source & Free) »
Chaîne : AIOnTrend|Publication : début janvier 2026|https://www.youtube.com/watch?v=uAGH_yRZ2Gw
→ Comparaison entre Qwen-Image 2512 d’Alibaba et Z-Image Turbo, en soulignant le caractère gratuit et la licence de type Apache. -
« Is Flux 2.0 DEAD? Qwen image 2512 & Z-Image vs. The King (15 Stress Tests) »
https://www.youtube.com/watch?v=54zvSiAWz2Y
→ FLUX de Black Forest Labs est comparé à Qwen-Image 2512 et Z-Image dans 15 tests ; la vidéo analyse une évolution de la hiérarchie open source. -
« LTX-2.3 Review: The Open-Source AI Video Model Built for Creators »
Chaîne : BMF MEDIA|Publication : environ un mois avant la recherche, vers août 2026|https://www.youtube.com/watch?v=qQXzlk134Sw
→ Revue de LTX-2.3 de Lightricks, 22B de paramètres, synchronisation audio et 4K/50 fps, du point de vue des créateurs. Publication récente, dans les 60 derniers jours. -
« WAN 2.5 CRUSHES VEO 3 (Higgsfield AI Workflow) »
Chaîne : Jack Vs. AI|https://www.youtube.com/watch?v=yvD8TxNsR4Q
→ Workflow pratique affirmant que Wan 2.5 open source d’Alibaba Tongyi dépasse Google Veo 3, modèle fermé. -
« This AI Agent Can Make Movies WanGP Deepy - Open source free Agent for LTX 2.3 Qwen Klein Z-Image »
Chaîne : AI Late to Class|https://www.youtube.com/watch?v=h-k6xOEITx4
→ Présente WanGP, un agent gratuit réunissant LTX-2.3, Qwen, Flux.2 Klein et Z-Image pour automatiser la création vidéo. Il illustre l’intégration grandissante de l’écosystème open source. -
« HunyuanImage 3.0 : Open Source Text To Image Model (Forget Nano Banana & Seedream 4) »
https://www.youtube.com/watch?v=32lhiZKhgOY
→ Présentation de HunyuanImage 3.0 de Tencent, modèle d’images open source de plus de 80 milliards de paramètres, en MoE avec 13 milliards actifs. Il est présenté comme comparable ou supérieur à Nano Banana ; sa première apparition date de septembre 2025, mais il reste une référence majeure.
Signaux
Évolutions côté closed source
- Google a entièrement arrêté la gamme Imagen le 17 août 2026 pour se recentrer sur Nano Banana, y compris Gemini 3 Pro Image. Les modèles Gemini deviennent le cœur de sa génération d’images fermée.
- OpenAI a fermé l’application Sora le 26 avril 2026 et prévoit de fermer l’API Sora le 24 septembre 2026. Sora, comme produit vidéo autonome, est donc pratiquement terminé ; les ressources semblent se déplacer vers GPT Image 2 et l’intégration à ChatGPT.
- GPT Image 2, sorti en avril 2026, se classe parmi les premiers dans Arena pour texte-vers-image et édition. Grok Imagine Image 2.0, publié le 7 août, arrive juste derrière ; la génération d’images fermée se joue désormais entre OpenAI, Google et xAI.
- Seedance 2.5 de ByteDance a ouvert son API au public le 7 août 2026 et s’impose rapidement aux côtés de Google Veo 3.1 et Kling 3.0.
- Les comparatifs de vidéo fermée tendent à établir une répartition : Kling 3.0 pour la polyvalence, Veo 3.1 pour l’esthétique et Runway Gen-4.5 pour la liberté créative.
Évolutions côté open source
- Qwen-Image 2512 d’Alibaba et Z-Image Turbo, qui tourne en huit étapes avec 16 Go de VRAM, sont les deux grandes tendances de l’image open source.
- FLUX.2 Klein de Black Forest Labs, 4B et compatible avec environ 13 Go de VRAM sur une RTX 3090, est souvent cité comme une option open source légère sous Apache 2.0.
- HunyuanImage 3.0 de Tencent, plus de 80B en MoE, reste une référence parmi les grands modèles ouverts.
- En vidéo, Wan 2.2/2.5 d’Alibaba Tongyi, diffusion MoE disponible aussi en version GGUF de 8 Go, et LTX-2.3 de Lightricks, 22B avec audio synchronisé et 4K/50 fps, sont jugés de qualité comparable au closed source par plusieurs chaînes.
- Les vidéos consacrées à ComfyUI, WanGP et aux agents/workflows qui regroupent plusieurs modèles ouverts se multiplient ; l’intérêt se déplace des modèles isolés vers les workflows intégrés.
- Les vidéos de tests partagent largement l’idée que l’écart de qualité entre open source et closed source se resserre et que de nombreuses équipes de création considèrent désormais d’abord les solutions ouvertes.
Limites
- Les pages de résultats et de vidéos YouTube sont rendues en JavaScript ; WebFetch n’a pas pu lire directement les vues, dates de publication ou abonnés. Les noms de chaînes ont pu être récupérés via l’API oEmbed de YouTube, mais pas les métriques d’audience.
- Les nombres de vues et d’abonnés sont donc indiqués comme inconnus ; seules les dates et informations contextuelles présentes dans les extraits de recherche Web sont utilisées.
- Le contenu des vidéos et les commentaires les plus populaires n’ont pas pu être lus directement. Les descriptions reposent sur les titres, extraits et résumés associés des résultats de recherche, et non sur des citations de vidéos.
- La vidéo HunyuanImage 3.0 date de septembre 2025, donc hors de la fenêtre recommandée de 60 jours ; elle est uniquement conservée comme point de référence continu pour les grands modèles d’images ouverts.
- Une seule chaîne japonaise, AI大学, a été trouvée ; la densité des discussions YouTube japonaises n’a pas pu être vérifiée au même niveau que celle de l’espace anglophone.
Bluesky
Bluesky — Dernières tendances de l’IA de génération d’images et de vidéos
Comptes
- Simon Willison @simonwillison.net — développeur IA reconnu. Il compare fréquemment les nouveaux modèles avec son image-benchmark d’un « pélican à vélo ». Plusieurs de ses publications obtiennent entre 100 et plus de 500 likes.
- Ethan Mollick @emollick.bsky.social — professeur à Wharton, Université de Pennsylvanie. Il publie souvent des expériences demandant à GPT-6 Astra, Fable 5.1 et autres modèles de générer des contenus 3D dans Blender.
- Alessandro Perilli @perilli.com — créateur d’Open Creative Studio, anciennement AP Workflow, un workflow open source tout-en-un pour ComfyUI produisant texte, images, vidéo et audio.
- luokai @luok.ai — compte relayant continuellement les mises à jour de modèles vidéo closed source : Kling, Runway, Vidu, PixVerse, Seedance, Niji, etc.
- dahara1 @dahara1.bsky.social — ingénieur japonais partageant son expérience avec les LLM et l’IA générative, y compris des outils de traduction automatique qu’il développe. Il suit notamment la fin de Sora et les comparaisons Nano Banana. Son compte reste modeste, avec 113 abonnés.
- Midjourney Experience Newsletter @midjourneynews.bsky.social — compte de fans/newsletter non officiel, pas le compte Midjourney. Il publie des expériences de prompts et des fragments d’actualité, avec peu d’engagement.
- Stable Diffusion online AI @stablediffusion.bsky.social — fil de partage d’images SD/Midjourney dont les dernières publications remontent à janvier-février 2025 ; il ne fonctionne plus comme source d’actualité.
- Résultat de la recherche de comptes officiels : aucun compte Bluesky officiel de Black Forest Labs, Runway, Stability AI ou Civitai n’a été confirmé. Le compte apparemment officiel
midjourney.bsky.socialne comporte aucune publication.
Publications
-
« Fin de Sora » — dahara1, 2026-04-28, 0 like/0 RP
https://bsky.app/profile/dahara1.bsky.social/post/3mkjnla6hnk2m
Commentaire indiquant à propos de l’arrêt du service vidéo Sora d’OpenAI qu’il ne semblait pas y avoir beaucoup d’attachement au produit. Les résultats Web confirment la fin de l’application et de l’API développeur autour de mars-avril 2026. -
La version gratuite de Sora ne génère plus après consommation des crédits — dahara1, 2026-04-04
https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
L’auteur rapporte qu’il reste un crédit mais qu’il est impossible de créer une vidéo, ce qui concorde avec les annonces de fermeture. -
Comparaison des filigranes entre Nano Banana gratuit et ChatGPT Images 2.0 — dahara1, 2026-05-04, 1 like
https://bsky.app/profile/dahara1.bsky.social/post/3mkztj6phrk2l
Il estime que ChatGPT Images 2.0, comme Nano Banana gratuit, ne pose pas de filigrane visible et est donc facile à utiliser. -
Seedance 2 écrase les autres modèles — luokai, 2026-02-10, 5 likes
https://bsky.app/profile/luok.ai/post/3mehseuzlls2r
Accompagné d’une vidéo originale réalisée en une journée, le message salue les performances de Seedance 2. -
Sortie de Niji 7 — luokai, 2026-01-10, 3 likes
https://bsky.app/profile/luok.ai/post/3mc2422hgck2m
Le modèle d’images orienté anime promet des yeux plus nets, une meilleure cohérence et une meilleure fidélité aux prompts. -
Runway Gen-4.5 — luokai, 2025-12-02, 4 likes/1 RP
https://bsky.app/profile/luok.ai/post/3m6xsakpud226
Présenté comme relevant le niveau en matière de mouvement, fidélité et contrôle des prompts, avec un accent sur le world modeling. -
Kling IMAGE O1 — luokai, 2025-12-03, 3 likes
https://bsky.app/profile/luok.ai/post/3m72caiexw225
Refonte complète de la génération d’images de Kling, présentée comme capable de tout recevoir, comprendre et générer. -
Kling VIDEO 2.6 — luokai, 2025-12-05, 2 likes
https://bsky.app/profile/luok.ai/post/3m7aio7hntk2f
Mise en avant d’une vidéo « story-first » avec synchronisation audio, lip-sync et cohérence des scènes. -
PixVerse V5.5 — luokai, 2025-12-02, 4 likes/2 RP
https://bsky.app/profile/luok.ai/post/3m6xrxnh47c27
Lancement d’une génération multi-plans en un clic et de l’ajout automatique d’effets sonores pour simplifier la production. -
Modèle d’images Vidu AI Q2 — luokai, 2025-12-02, 5 likes/2 RP
https://bsky.app/profile/luok.ai/post/3m6xrt43ll227
Promet « 4K en cinq secondes » et annonce une campagne de générations illimitées jusqu’au 31 décembre. -
SkyReels V1, modèle de base vidéo open source — luokai, 2025-02-18, 3 likes/1 RP
https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27
Présenté comme le premier modèle vidéo open source centré sur l’humain, fine-tuné depuis HunyuanVideo sur plus de 10 millions de vidéos, capable de reproduire 33 expressions et plus de 400 mouvements naturels. La publication a plus d’un an, mais c’est la seule mention claire d’un modèle vidéo ouvert trouvée sur ce compte. -
Open Creative Studio v13.0, workflow intégré open source pour ComfyUI — Alessandro Perilli, 2026-01-26, 0 like
https://bsky.app/profile/perilli.com/post/3mdddenkss22v
Présenté comme le workflow ComfyUI tout-en-un le plus complet, générant texte, images, vidéo, audio, musique, effets sonores et paroles, gratuitement et sans limites. -
Génération locale du pélican avec Qwen 3.7 27B — Simon Willison, 2026-08-14, 183 likes/14 RP
https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
Sur un MacBook Pro M5 Max, via LM Studio, Qwen 3.7 27B en GGUF de 17 Go a produit selon lui le meilleur pélican à vélo qu’il ait vu parmi les modèles tournant sur son ordinateur portable. -
Grille de comparaison des pélicans : GPT-6 Astra contre GPT-5.6 — Simon Willison, 2026-09-04, 202 likes/9 RP
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
Une grille de douze images compare GPT-6 Astra aux variantes Sol, Terra et Luna de GPT-5.6, prolongeant le benchmark visuel de modèles fermés. -
Génération 3D Blender par GPT-6 Astra : maquette architecturale — Ethan Mollick, 2026-09-05, 163 likes/17 RP
https://bsky.app/profile/emollick.bsky.social/post/3murua22igs2i
À partir d’un croquis et d’une description, le modèle aurait produit une maquette 3D et une visite commentée du cénotaphe de Boullée, projet du XVIIIe siècle jamais construit. L’auteur souligne aussi que la capacité des LLM fermés à matérialiser visuellement des idées devient un atout fort. -
« Midjourney fait partie de Meta.ai » — Midjourney Experience Newsletter, 2026-02-03, 1 like
https://bsky.app/profile/midjourneynews.bsky.social/post/3mdxymie7pi25
⚠️ Attention : cette publication provenant d’un compte non officiel simplifie probablement excessivement la situation. Les recherches Web indiquent qu’en août 2025 Meta a annoncé un partenariat de licence sur la technologie esthétique de Midjourney ; il ne s’agit pas d’une acquisition et Midjourney reste indépendant (TechCrunch, implicator.ai).
Signaux
- La vidéo closed source est en pleine bataille : entre décembre 2025 et février 2026, le seul fil de luok.ai recense au moins sept lancements ou nouvelles versions : Runway Gen-4.5, Kling IMAGE O1 et VIDEO 2.6, PixVerse V5.5, Vidu AI Q2, Seedance 2 et Niji 7. Les modèles chinois — Kling, Vidu, PixVerse, Seedance — ressortent particulièrement.
- Sora est en perte de vitesse et se dirige vers sa fin : les publications de dahara1 signalent que les crédits de la version gratuite ne fonctionnaient déjà plus en avril 2026, puis évoquent explicitement la fin de Sora. Cela concorde avec les annonces de fermeture de l’application et de l’API ; l’initiative vidéo semble se déplacer vers les modèles chinois et les fonctions intégrées dans les modèles généralistes de Google et OpenAI.
- La génération d’images devient une fonction benchmarkée des LLM : chez Simon Willison et Ethan Mollick, l’intérêt porte moins sur des outils autonomes que sur la comparaison régulière des capacités d’images et de 3D de LLM généralistes comme GPT-6 Astra, Claude Fable 5.1 ou Qwen 3.7/3.8 27B.
- La vidéo open source est peu visible sur Bluesky : dans les comptes et fils explorés, SkyReels V1 est le seul véritable modèle vidéo ouvert clairement identifié. Wan2.2, Qwen-Image et Z-Image n’ont pas été trouvés. Pour ComfyUI, l’activité se limite surtout aux annonces régulières d’Open Creative Studio.
- La relation Midjourney × Meta est facilement mal comprise : un compte non officiel a présenté une licence technologique comme une intégration de Midjourney à Meta.ai. C’est un exemple utile de la prudence nécessaire face aux informations condensées sur les réseaux sociaux.
Limites
- L’API officielle de recherche Bluesky,
app.bsky.feed.searchPosts, a renvoyé 403 Forbidden pour toutes les requêtes, alors quegetProfile,getAuthorFeedetgetPostThreadfonctionnaient. Il est probable que seul l’accès de recherche soit restreint. - La page Web
https://bsky.app/search?q=...est aussi rendue côté client et ne permet pas de récupérer les publications via fetch. - L’analyse a donc remplacé la recherche par mots-clés par la découverte de comptes via le Web, puis la lecture de leurs fils. Cette méthode dépend des comptes que les moteurs trouvent et peut biaiser la couverture, notamment contre la vidéo open source.
- Les recherches Web de publications Bluesky liées à Wan2.2, Qwen-Image, Z-Image et HunyuanVideo ont surtout retourné des articles arXiv ou des comptes sans rapport.
- Les comptes officiels de Black Forest Labs, Runway, Stability AI et Civitai n’ont pas pu être identifiés avec certitude.
- Le fil de
stablediffusion.bsky.socialest arrêté depuis janvier-février 2025 et ne peut pas servir de source d’actualité. - L’objectif d’environ 20 publications analysées par réseau a été approché par la lecture de plus de 100 publications provenant de six comptes, dont 16 ont été retenues comme pertinentes.
Lemmy
Lemmy — Dernières tendances de l’IA de génération d’images et de vidéos
Lemmy est un Fediverse distribué. L’étude s’est principalement appuyée sur l’API de recherche de lemmy.world (/api/v3/search) et sur lemmy.today, qui reflète les communautés de lemmy.dbzer0.com, ainsi que sur des recherches Web site:lemmy.world. Environ 25 publications ont été examinées.
Communautés
- !«メールアドレス» — environ 5 050 abonnés ; communauté centrale consacrée à l’image open source autour de Stable Diffusion.
- !«メールアドレス» — affichée sous le nom « Stable Diffusion Art » sur
lemmy.today, 2 362 abonnés ; plusieurs créations quotidiennes réalisées avec SDXL, ComfyUI et Krea2, souvent liées à civitai.com. - Stable Diffusion Anime, Stable Diffusion Abstraction, Stable Diffusion Witches, Stable Diffusion Furry, Stable Werewolves — communautés de
lemmy.dbzer0.comspécialisées par genre ; leurs effectifs sont privés, mais elles restent actives quotidiennement en septembre 2026. - c/«メールアドレス» — communauté technologique généraliste où circulent les grandes actualités closed source, telles que le scanner médical de Midjourney ou Sora.
- c/genart — 47 abonnés ; petite communauté déclarant soutenir les modèles génératifs open source et sous licences ouvertes.
- c/«メールアドレス» — communauté exprimant une hostilité à l’IA. Elle n’est pas dédiée aux images et vidéos, mais une publication sur le désir de sortir de la dépendance aux outils IA y a atteint 83 points.
- c/euroai — communauté de niche partageant des listes d’IA et de LLM open source européens, y compris des modèles de génération d’images.
Publications
Plutôt closed source
- « Midjourney pivots from AI image generation to body scanning medical spa » (2026-06-18, score 58, technology) https://lemmy.world/post/... via theregister.com — discussion sur le passage supposé de Midjourney de l’image à des scanners CT médicaux à ultrasons. The Register indique que la technologie paraît réelle, mais que les partenaires ne sont pas nommés.
- « Midjourney AI pivots to Theranos: Ultrasonic CT » (2026-06-19, score 40, techtakes) — via pivot-to-ai.com ; publication ironisant sur cette initiative en la comparant à Theranos.
- « I was wrong about the Midjourney ultrasound scanner » (2026-06-21, hackernews) https://twitter.com/MattZirwas/status/2068365802491834541 — un auteur initialement sceptique reconnaît avoir vérifié les faits et revient sur sa critique.
- « Midjourney wants Hollywood studios to reveal details of their AI usage » (2026-07-05, score 73, technology) — via techcrunch.com ; dans un litige avec trois studios, Midjourney demande la divulgation de leurs propres usages de l’IA.
- Réaction à l’arrêt de Sora d’OpenAI : « OpenAI: decides to shut down their AI slop video generating model Sora » https://lemmy.world/post/44721138 — moquerie autour de la fermeture de l’application Sora, annoncée le 24 mars 2026 et arrêtée le 26 avril, avec suppression de l’API Sora 2 prévue le 24 septembre.
- « OpenAI collapses media reality with Sora AI video generator » https://lemmy.world/post/12056737 — partage d’un article mettant en garde contre la perte de confiance envers les vidéos anonymes.
- « OpenAI's new Sora video generator to require copyright holders to opt out, WSJ reports » https://lemmy.world/post/36665644 — critiques d’une politique obligeant les détenteurs de droits à se retirer eux-mêmes.
- « Elon Musk maakt complete AI-film met zijn versie van The Odyssey » (2026-07-22, films) — via ad.nl ; Musk annonce vouloir réaliser un long métrage IA de L’Odyssée avec Grok Imagine.
- Partage d’une analyse des revenus de ChatGPT (2026-07-15, ai_reddit) — l’analyse attribue une grande partie des revenus de Grok/xAI aux contenus payants NSFW générés sous forme d’images ou de vidéos.
- « Video AI » — question sur le quota gratuit de génération vidéo d’Adobe Firefly ; Firefly ne propose que deux essais gratuits et Hailuo, Kling, Runway, Pixverse et Hunyuan sont comparés comme alternatives.
Plutôt open source
- « Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio » (2026-07-24, score 1, tech) https://bfl.ai/blog/flux-3 — sortie limitée de FLUX 3, capable de générer des images et des vidéos de 20 secondes avec audio.
- « FLUX.2-klein-9b-kv-fp8 optimized variant » (2026-03-14, score 8, stable_diffusion) — via huggingface.co ; variante légère de FLUX.2 avec cache KV.
- « Black Forest Labs Opening up the first FLUX Creator Program » (2026-05-06, score 3, stable_diffusion) — annonce de l’ouverture d’un programme pour créateurs.
- « Regisseur Martin Scorsese wordt adviseur bij AI-bedrijf » (2026-06-03, films) — via nu.nl ; Martin Scorsese devient conseiller de Black Forest Labs.
- « FLUX Chroma (The Perchance T2i model) » — il y a environ un an, communauté Perchance, huggingface.co(lodestones/Chroma) ; modèle dérivé utilisant NAG, Normalized Attentive Guidance, avec des commentaires positifs sur le lip-sync.
- Exemples de publications quotidiennes des communautés Stable Diffusion, du 6 au 9 septembre 2026, créées localement avec SDXL, ComfyUI ou Krea2 : « Erika - Mahouka Koukou No Rettousei » (score 16), « Colors in Quiet Water » (14), « Giant Wire Walker » (11), « Karin - Umi Monogatari » (13), toutes liées à civitai.com.
- « Opendream = NEW! Stable Diffusion Automatic1111/ComfyUI alternative that uses nondestructive layering like Gimp » https://lemmy.world/post/3243205 — présentation d’une interface OSS d’édition à calques non destructifs inspirée de GIMP.
- « Europäische KI- & LLM-Anbieter » (2026-02-15, euroai) — liste d’IA et de LLM open source européens promouvant souveraineté technologique et protection des données, y compris pour l’image.
- « Your Lemmy Crash Course to Free Open-Source AI » https://lemmy.world/post/76020 — guide d’introduction aux outils de génération locale : text-generation-webui, Automatic1111, ComfyUI avec Pinokio, etc.
Signaux
- Le principal sujet closed source est la controverse sur la transition médicale de Midjourney : les publications, avec des scores de 40 à 73, ont suscité des débats dans technology, hackernews et techtakes. Les réactions vont de l’accusation de projet proche d’une fraude, avec des parallèles à Theranos, aux corrections de sceptiques après vérification.
- OpenAI Sora sert régulièrement de symbole de « bouillie IA » : après la fermeture de l’application, la suppression annoncée de l’API Sora 2 le 24 septembre 2026 continue d’alimenter les discussions.
- Black Forest Labs et FLUX dominent le côté open source : FLUX 3, la version légère FLUX.2-klein, le Creator Program et l’arrivée de Scorsese comme conseiller fournissent des actualités concrètes à chaque trimestre.
- Les communautés de création quotidienne restent actives : Stable Diffusion Art, Anime et Abstraction, malgré seulement 2 000 à 5 000 abonnés, continuent à publier chaque jour des créations locales SDXL, ComfyUI et Krea2 ; elles témoignent d’un usage open source ancré dans la pratique.
- Le sentiment anti-IA est un signal non négligeable : une publication de c/fuck_ai sur le désir de sortir de la dépendance aux outils IA a atteint 83 points, plus que de nombreuses publications IA techniques.
- Les actualités closed source sont principalement des reprises et réactions à des articles de TechCrunch, The Register ou du WSJ. Les sources primaires se trouvent généralement hors de Lemmy.
Limites
- Lemmy reste de petite taille face à Reddit ; les discussions spécialisées sur la génération d’images et de vidéos sont peu nombreuses, et aucune communauté vidéo Sora/Veo/Kling/Runway particulièrement active n’a été trouvée.
- La recherche plein texte de
lemmy.worldest peu précise : des requêtes générales comme « AI image generation » remontent des contenus non pertinents. Les noms de modèles spécifiques, Sora, Midjourney et FLUX, améliorent les résultats. - Certaines pages, notamment
lemmy.world/post/44721138et une publication liée à DLSS 5, renvoyaient une erreur HTTP 500 ou ne pouvaient pas être lues. L’interprétation repose alors uniquement sur le titre et les extraits de recherche Web. - Les recherches portant sur Grok Imagine, Qwen Image, HunyuanVideo, Wan2.2, Nano Banana et Veo ont trouvé très peu de publications directes. Sur Lemmy, ces modèles semblent donc avoir une faible visibilité.
- Les recherches sur lemmy.ml et lemm.ee ont surtout renvoyé des doublons fédérés de
lemmy.world, sans élément nouveau notable.
Pinterest — Actualités de l’IA de génération d’images et de vidéos
Les 50 épingles collectées ont toutes été ouvertes et examinées visuellement. Elles n’étaient pas réparties par genre : elles proviennent toutes d’une seule requête, « Image and Video Generation AI News ».
Thèmes visuels (visual themes)
- Prolifération du modèle « visage de robot + alerte d’actualité » : des miniatures reprennent un gros plan de demi-visage de robot humanoïde blanc, associé à des textes néon rouges ou bleus comme « AI NEWS » ou « BREAKING NEWS ». On trouve notamment un robot au bureau d’un présentateur [22], des compositions mêlant visage de robot et YouTubeur étonné [29], ou une femme robot avec « THE FUTURE IS AI » [39]. La palette sombre bleu marine avec cyan, magenta et orange domine.
- Miniatures de réactions de YouTubeurs : plusieurs épingles reprennent des portraits de YouTubeurs masculins blancs au visage surpris ou sceptique, entourés de logos ronds à bord néon d’OpenAI, Google, Meta, Anthropic, Grok ou Notion [4, 18]. Elles semblent provenir de vidéos YouTube.
- Infographies de listes « les meilleurs outils » : ce sont les formats les plus fréquents : de longues infographies sombres, violettes ou noires, présentant des outils numérotés. Runway, Pika, Kling AI, Luma AI/Dream Machine, Canva AI et Hailuo AI reviennent systématiquement [9, 10, 27, 36, 50].
- Formats before/after et quiz comparatifs : des doubles photos de montagne « Which is AI? » [13] ou des grilles transformant une vidéo source en personnages de blocs de bois, origami, Lego ou fleurs [11] mettent en avant la difficulté à distinguer les contenus et la puissance de transformation des modèles.
- Collaboration robot-humain et médecine : plusieurs images montrent des robots blancs utilisant des hologrammes avec des soignants [3, 33] ou des illustrations de médecins accompagnés de robots [32], dans un registre plus apaisé de coexistence entre humains et IA.
- Esthétique technologique sombre et néon : un fond bleu foncé ou noir, parcouru de connexions cyan, magenta ou violettes et de particules lumineuses, est commun à environ 70 % des images. C’est clairement le style visuel standard des actualités technologiques sur Pinterest.
- Publicités de génération vidéo avec avatar et personnalité : des publicités de création de vidéos explicatives, façon Fiverr, emploient une image composite de Jeff Bezos [38] ; une démonstration photoréaliste officielle d’Amuse 3.0 d’AMD montre un vieux pêcheur [46]. Des visages connus et portraits réalistes servent de démonstration de qualité.
- Images sur la possibilité de reconnaître ou non l’IA : un robot regardant un smartphone avec un tampon « FAKE », des comparaisons avec des chats ou silhouettes masquées [3], et des outils de détection d’images IA [37] rendent visibles les préoccupations liées à la désinformation et à l’authenticité.
Épingles notables (notable pins)
- [11] Démonstration de transformation de matière dans le style Luma AI : une même vidéo source — personne, panda en peluche et voiture — est convertie en cinq versions : blocs de bois, origami, Lego et fleurs. C’est l’épingle qui montre le plus concrètement le pouvoir de transformation de texture des modèles vidéo.
- [24] Accord sur le droit d’auteur entre ByteDance et Hollywood : image d’article titrée « ByteDance and Hollywood reach global deal on AI copyright ». Elle indique un accord mondial de ByteDance avec la Motion Picture Association pour renforcer la protection de la propriété intellectuelle dans les outils IA d’images et de vidéos.
- [35] Récapitulatif de l’actualité IA du 12 août 2026 : trois informations : « Grok 4.6 drops », capable d’exécuter de nombreuses étapes autonomes et de s’auto-vérifier ; « Gemini hits 1 billion users », avec des données sur les utilisateurs et la génération d’images ; et le robot phone d’Honor, doté d’un bras en titane qui suit automatiquement le sujet. C’est une des rares épingles contenant dates et chiffres précis.
- [36] Classement « Best AI Video Generators of 2026 » : Google Veo 3.1, Runway Gen 4.5 et Kling 3.0 occupent les trois premières places, suivis d’Adobe Firefly, Seedance 1.5 Pro, Pika 2.5 et HeyGen. Les numéros de version en font une vue utile de la génération actuelle de modèles.
- [42] Vidu S1 de ShengShu Technology : visuel produit d’un modèle chinois de vidéo IA en temps réel, présenté comme « The World's Most Advanced Model for Real-Time AI Interaction ». Il rappelle que les acteurs ne sont pas uniquement occidentaux.
- [45] Article annonçant un nouvel outil d’images OpenAI : image titrée « OpenAI's Secret Image Generation Tool to Debut Soon », qui alimente l’attente autour d’un outil non annoncé.
- [25] Récapitulatif Google I/O 2026 : annonce Gemini 3.5 Flash, Gemini Omni et Gemini Spark, le virage vers la recherche IA, ainsi que la compétition Apple/Google autour des lunettes XR. L’épingle donne un aperçu de l’écosystème voisin, plutôt que de la seule génération d’images.
- [9] Infographie de comparaison « Just Nail It » : présente Runway, Pika, Kling AI, Luma AI, Canva AI et Hailuo AI selon leurs fonctions et utilisateurs cibles ; elle affirme aussi que 80 % du contenu en ligne comportera de la vidéo d’ici 2026.
- [8] Icônes de génération de contenu IA pour banques d’images : visuel de type Adobe Stock, « Ai Content Creation Concept », rassemblant les icônes de génération de texte, image, musique et vidéo. Il reflète davantage la demande de visuels de stock que l’actualité elle-même.
- [43] Frise historique de l’IA générative : une chronologie violette allant d’ELIZA dans les années 1950 à GPT dans les années 2020, plaçant l’engouement actuel dans une perspective historique.
Signaux (signals)
- L’opposition open source/closed source est difficile à lire à partir des images seules : les épingles Pinterest sont surtout des présentations d’outils, miniatures d’actualité et guides pratiques. Elles ne montrent presque aucun duel explicite, tel que Seedance contre Wan. Vidu S1 de ShengShu et Amuse 3.0 lié à AMD font partie des rares alternatives visibles aux grands outils fermés américains comme Veo, Sora ou Runway.
- Les comparatifs, listes et guides dominent ; les nouvelles immédiates sont minoritaires : parmi 50 épingles, seules [24], [25], [35] et [45] environ présentent des annonces ou dates concrètes. La majorité se compose de contenus evergreen, listes « Best AI Video Generators » et contenus à vocation d’affiliation, typiques de Pinterest.
- L’inquiétude sur l’authenticité est visible : les épingles [3], [22] et [37], avec tampons « FAKE », journalistes robots et outils de détection, suggèrent un intérêt sensible pour la vérification des contenus générés.
- Les générations de modèles se renouvellent très vite : Veo 3.1, Runway Gen 4.5, Kling 3.0 et Seedance 1.5 Pro apparaissent dans [36], tandis que [35] mentionne Grok 4.6 et Gemini. Les mises à jour trimestrielles semblent devenues la norme.
- Absence notable : aucune image sur les 50 ne symbolise la culture des modèles open weight locaux, comme Stable Diffusion, ComfyUI ou Hugging Face. Les résultats Pinterest favorisent fortement les outils commerciaux et SaaS.
Limites
- La collecte a été effectuée en amont par un navigateur headless ; l’agent n’a pas navigué directement sur Pinterest, conformément au playbook.
- Les 50 résultats ne sont pas séparés en catégories ; ils proviennent d’une requête unique, ce qui interdit une comparaison par genre.
- Cinq épingles — [5, 13, 15, 20, 24] — n’avaient pas de titre exploitable. Le contenu de [24] a toutefois pu être déduit de l’image de l’article.
- Les liens d’épingles
pinterest.com/pin/...sont présents, mais les pages de destination n’ont pas été ouvertes ; l’analyse repose donc sur les images et titres. Dates, likes et autres mesures d’engagement ne sont pas disponibles, sauf rares dates inscrites directement dans les visuels. - L’objectif d’au moins dix constats closed source et open source est difficile à satisfaire sur Pinterest seul : les résultats explicitement classables du côté ouvert sont rares, avec surtout Vidu [42] et Amuse 3.0 [46]. Les autres plateformes sont nécessaires pour combler ce manque.
Actions recommandées
- Relancer X avec des termes liés directement au sujet : Midjourney, Stable Diffusion, Sora, Nano Banana, Qwen-Image, etc.
- Inclure lors des prochaines recherches Reddit les grandes communautés r/StableDiffusion, r/midjourney et r/comfyui.
- Transformer les comptes Bluesky découverts en liste de suivi récurrente afin de contourner l’indisponibilité de la recherche.
- Suivre en priorité, lors de la prochaine recherche, la suppression de l’API Sora le 24 septembre 2026 et les suites du virage de Midjourney.
Images collectées


















































Note sur la qualité des données
X ne contient aucune publication pertinente en raison de requêtes inadaptées. Bluesky, Pinterest et YouTube n’ont pas permis d’accéder à certaines métriques d’engagement ou API de recherche, ce qui fragilise la validation quantitative de certains constats.



