KEN’S CAT LOG

Actualités quotidiennes sur les LLM — 2026-09-25

La bataille des annonces entre modèles fermés — OpenAI lançant GPT-6 Sol/Luna et divisant ses prix par deux seulement 89 minutes après l’annonce de Claude Opus 5.5 par Anthropic le 22 septembre — est aujourd’hui le sujet le plus commenté, confirmé indépendamment sur X, YouTube, Bluesky et Lemmy. L’évaluation de la dynamique des modèles à poids ouverts diverge toutefois fortement selon les plateformes.

L’actualité LLM la plus commentée aujourd’hui — 2026-09-25

Le principal événement de la semaine est une « bataille de timing des annonces » entre modèles fermés : seulement 89 minutes après qu’Anthropic a annoncé « Claude Opus 5.5 » le 22 septembre, OpenAI a lancé « GPT-6 Sol/Luna » et divisé ses prix par deux. L’affaire a été évoquée indépendamment sur X, YouTube, Bluesky et Lemmy, ce qui en fait clairement le sujet le plus discuté aujourd’hui. Sur Reddit, en revanche, le sujet est presque absent ; les hausses de prix des GPU locaux et l’enquête des autorités de Pékin sur DeepSeek/Kimi y ont plutôt suscité l’attention, suivant un axe différent de l’opposition entre modèles fermés et poids ouverts. L’appréciation de la dynamique des poids ouverts est exactement partagée selon les plateformes : il est impossible d’affirmer simplement que « l’open l’emporte » ou « l’open recule ».

Entre les plateformes

Plateforme par plateforme

Reddit : les principaux terrains sont r/LocalLLaMA (exécution locale et matériel) et r/singularity (alertes sur les nouveaux modèles). Le post ayant obtenu le meilleur score ce jour-là exprimait l’exaspération face à la flambée des prix des GPU locaux et du matériel spécialisé (647 pt, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), suivi d’un fil indiquant que DeepSeek/Kimi faisait l’objet d’une enquête des autorités de Pékin à propos de soupçons de « fuite de données vers Anthropic » (311 pt, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Les débats sociaux et culturels, comme la normalisation publique de l’écriture assistée par LLM dans le monde universitaire (r/PhD, 493 pt), ont davantage marqué que les nouvelles de produits. L’absence, dans la collecte Reddit, de mentions d’Opus 5.5 ou de GPT-6 Sol/Luna — le principal sujet sur les autres plateformes — mérite d’être consignée comme un écart inter-plateformes.

X : Explore était rempli de sujets sans rapport avec les LLM (Taylor, Serbie, Cardano, etc.), et les seuls termes de recherche utiles pour les LLM ont été « Opus 5.5 » et « Claude ». Les huit résultats trouvés étaient tous des démonstrations de créateurs japonais ayant « laissé Opus 5.5 piloter des outils » ; aucune source primaire à valeur d’actualité concernant des annonces de modèles, des changements de prix ou des benchmarks n’a été trouvée. La collecte a été arrêtée à huit résultats, sans atteindre le seuil de dix.

YouTube : le sujet ayant décollé le plus rapidement était le « premier résultat » du nouveau laboratoire de biologie d’Anthropic : Claude aurait découvert un système enzymatique de type CRISPR (ART). Plusieurs chaînes l’ont abordé presque simultanément 18 à 19 heures après publication (Dr. Samuel Allen Alexander https://www.youtube.com/watch?v=_m_216JykA0, Wes Roth https://www.youtube.com/watch?v=H7KruLVX2Rk). Plusieurs vidéos comparent aussi les prix et benchmarks d’Opus 5.5 et de GPT-6 Sol/Luna. Les nombres de vues et d’abonnés n’ont pas pu être obtenus (voir Limits), mais la qualité et l’étendue des sujets étaient les plus riches de la journée.

Bluesky : TestingCatalog et Simon Willison sont les principaux pôles d’information. Les nouvelles portent fréquemment sur des modèles au stade de « préannonce ou fuite » : lancement annoncé de GPT-6 Sol/Luna, fuite de Gemini 4 Pro, tests de Fable 5.2/Opus 5.5. Les données quantitatives d’Epoch AI — « les coûts de l’IA baissent d’environ 47 % par trimestre » et « le niveau atteint par o3 sur FrontierMath est reproduit à 1/377e du coût » (👍123, https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h ) — offrent une rigueur absente des autres plateformes. L’API officielle de recherche renvoyant une erreur 403, la collecte a toutefois dû se limiter aux comptes, ce qui réduit son exhaustivité.

Lemmy : !technology, !LocalLLaMA et !ai_reddit (reprises de Reddit) dominent. Les nouvelles sur les poids ouverts sont nombreuses : article sur la chute de la part de marché des modèles fermés, confirmation de la sortie de Qwen4-27B, llama.cpp v0.5.0, HuatuoGPT-3-27B, un modèle médical à poids ouverts. Le débat définitionnel sur « K2 Horizons est-il vraiment le premier LLM open source ? » (👍48/👎10, https://lemmy.world/post/52135351 ) se poursuit. Des publications vieilles de trois et cinq jours ont été incluses afin d’atteindre dix éléments.

À surveiller

  • Projet Frontier AI Standards Agency (SAFA) : projet d’organisme volontaire de normes de sécurité porté par OpenAI, Google et Anthropic. Aucune vidéo dédiée n’a encore été trouvée sur YouTube ; les médias écrits (AI Weekly, etc.) sont en avance. Il faudra surveiller le moment où le sujet passera à la vidéo.
  • Enquête de Pékin sur DeepSeek/Kimi : soupçons concernant le transit de données vers Anthropic (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Selon la réponse des autorités, l’affaire pourrait prendre une dimension géopolitique.
  • Débat sur K2 Horizons, « premier LLM open source » : la comparaison avec des précédents tels que GPT-Neo, OPT et BLOOM se poursuit (Lemmy, https://lemmy.world/post/52135351 ). À suivre comme débat sur la définition même des poids ouverts.
  • Les données Vercel de part de marché des modèles fermés, 70 % → 21,6 % : elles n’apparaissent que dans un article cité de seconde main (via Lemmy, https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/ ). Une vérification dans les données primaires de Vercel est nécessaire.
  • Le nouveau laboratoire de biologie d’Anthropic : la découverte par Claude d’un système enzymatique similaire à CRISPR (YouTube, https://www.youtube.com/watch?v=_m_216JykA0 ) mérite d’être suivie comme exemple d’IA menant des recherches scientifiques dans le monde réel.
  • La flambée des prix des GPU locaux et du matériel spécialisé : le mécontentement face aux hausses de prix de NVIDIA « Spark » et d’autres produits a obtenu le meilleur score sur r/LocalLLaMA (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ). C’est directement lié à la structure de coûts de l’exploitation de modèles à poids ouverts.

Recommandations

  1. Lors de la prochaine enquête Reddit, ajouter des noms de modèles précis comme « Opus 5.5 », « GPT-6 Sol » et « GPT-6 Luna » aux termes de recherche. La seule requête « Daily LLM News » n’a pas permis de relever la principale nouvelle de la semaine.
  2. Vérifier les chiffres de Vercel sur la part de marché des modèles fermés, « 70 % → 21,6 % », dans les données primaires avant de les citer. À ce stade, un seul article de seconde main les étaye.
  3. Suivre continuellement le projet Frontier AI Standards Agency (SAFA) dans les médias écrits (AI Weekly, The Information, etc.) afin de compenser sa faible visibilité sur les réseaux sociaux.
  4. Les résultats scientifiques du laboratoire de biologie d’Anthropic dépassent le cadre des nouvelles LLM et ont une portée de nouvelle scientifique ; envisager un suivi dédié à partir de la prochaine édition.
  5. Comme l’enquête sur X tend à se concentrer sur les démonstrations de créateurs japonais, ajouter des requêtes permettant de recueillir les sources primaires anglophones, notamment les annonces officielles et communiqués de presse.
  6. Vérifier au début de la prochaine enquête si l’erreur 403 de l’API officielle de recherche Bluesky a été résolue. Si oui, revenir à une recherche par mots-clés, plus exhaustive que la collecte par compte.

Qualité des données

Reddit (12 éléments, seuil atteint) et Lemmy (12 éléments, dont certains complétés par des sujets vieux de trois à cinq jours) ont atteint le volume requis. X n’a trouvé que huit éléments, car la plupart des termes de recherche n’étaient pas liés aux LLM, et n’a donc pas atteint le seuil. Bluesky n’a pas pu utiliser l’API officielle de recherche en raison d’une erreur 403 et a dû recourir à une collecte par compte ; aucun post daté du jour n’a été trouvé (principalement des publications du 20 au 23 septembre). YouTube disposait de suffisamment de vidéos, mais les contraintes de rendu JavaScript ont empêché d’obtenir précisément les vues et nombres d’abonnés, et les dates n’ont pu être qu’estimées à partir d’affichages relatifs. Globalement, seuls Reddit et Lemmy ont satisfait les critères quantitatifs de complétion ; X, Bluesky et YouTube restent limités par leurs méthodes de collecte.

Récapitulatif par plateforme

Reddit

Reddit — Actualités quotidiennes sur les LLM

Où

La recherche « Daily LLM News » a permis de collecter 12 fils issus de 11 subreddits.

Subreddit Membres Fils collectés
r/LocalLLaMA 833,592 2
r/PhD 286,410 1
r/NoStupidQuestions 7,515,698 1
r/QuebecTI 16,177 1
r/LocalLLM 230,819 1
r/singularity 3,995,842 1
r/BetterOffline 56,810 1
r/LSM 1,097 1
r/accelerate 90,603 1
r/slatestarcodex 83,704 1
r/ArtificialInteligence 1,940,857 1

Les principaux terrains des nouvelles LLM sont r/LocalLLaMA (plutôt orienté exécution locale et matériel) et r/singularity (plutôt orienté alertes sur les nouveaux modèles). r/PhD, r/BetterOffline et r/slatestarcodex portent les discussions périphériques sur l’impact social et académique des LLM. Le post de r/LSM (#8) n’avait aucun lien avec les LLM et a été considéré comme du bruit de recherche (voir Limits).

Ce que disent les gens
  • Rumeurs de vague de nouveaux modèles : le fil #5 de r/singularity, « Quite a few new model releases expected this week » (501 pt, 153 commentaires, 2026-09-21, https://www.reddit.com/r/singularity/comments/1wme7xj/ ), évoque une rumeur de sortie d’Astra 6.1 le 29 septembre et la sortie déjà existante de Grok 4.7. u/Immediate_Simple_217 (69 pt) commente : « Gemini 4 pro ne sera pas annoncé cette semaine mais en octobre. Toutes les rumeurs et estimations visent octobre. Il est aussi étrange que Kimi et le nouveau modèle de Meta ne soient pas mentionnés. »
  • Enquête de Pékin sur DeepSeek/Kimi : le fil #6 de r/LocalLLaMA, « DeepSeek and Moonshot AI face Beijing's probe over potential data leaks to Anthropic » (311 pt, 92 commentaires, 2026-09-23, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ), a attiré beaucoup d’attention. u/TraditionalWait9150 (115 pt) résume : « Pékin craint que des informations confidentielles militaires, policières ou d’entreprises aient pu être transmises aux États-Unis parce que les deux sociétés d’IA acheminaient des données via Anthropic. » u/mrdevlar (34 pt) corrige : « Le titre est inexact ; il ne s’agit pas d’une fuite de données, mais d’un transfert de trafic vers Anthropic. »
  • Exaspération face à la hausse des prix des GPU locaux et du matériel : le fil #10 de r/LocalLLaMA, « How it feels watching prices go up » (647 pt, 110 commentaires, 2026-09-21, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), a obtenu le meilleur score de la journée. u/swiebertjee (106 pt) écrit : « J’ai acheté deux Spark il y a un mois et on m’a dit que j’étais fou ; maintenant ils ont augmenté de 600 dollars par unité. C’est le meilleur investissement et la pire nouvelle. »
  • Rapport d’achat d’une machine locale : le fil #4 de r/LocalLLM, « Finally got it » (188 pt, 38 commentaires, 2026-09-22, https://www.reddit.com/r/LocalLLM/comments/1wnmm8n/ ), a donné lieu à des échanges sur le piège de l’achat de matériel ; u/Abducted_Llama (64 pt) avertit : « Tu vas en vouloir une deuxième. »
  • Normalisation publique de l’écriture par LLM dans le monde universitaire : le fil #1 de r/PhD, « Seems academia is actually encouraging LLM usage in research papers » (493 pt, 265 commentaires, 2026-09-20, https://www.reddit.com/r/PhD/comments/1wlrhda/ ), est parti du fait que des articles de professeurs renommés du MIT et de Stanford indiquaient avoir été écrits principalement avec ChatGPT 5.6. u/o12341 (89 pt) affirme : « La culture publish or perish est le problème fondamental ; si le choix est de produire du contenu IA médiocre ou de disparaître, beaucoup choisiront le premier. »
  • Thèse du MIT sur les limites du passage à l’échelle des LLM — réaction francophone : dans le fil #3 de r/QuebecTI, « MIT Just Found a Hard Limit in LLM Scaling, and Money Won't Fix It » (54 pt, 50 commentaires, 2026-09-20, https://www.reddit.com/r/QuebecTI/comments/1wlr6vq/ ), u/zx440 (23 pt) estime que l’article confirme son intuition selon laquelle l’IA ne se résume pas aux LLM : « reasoning, agentic, deep thought, ce sont seulement des LLM qui se parlent en boucle. »
  • Débat sur l’idée que « les LLM sont une mode » : le fil #2 de r/NoStupidQuestions, « When is the LLM fad finally going to die out? » (0 pt, 31 commentaires, 2026-09-23, https://www.reddit.com/r/NoStupidQuestions/comments/1wo0heg/ ), compare les LLM à la bulle NFT. u/737Max-Impact (25 pt) répond que le marché boursier connaîtra peut-être une correction, mais que les LLM et technologies associées ne disparaîtront pas car ils sont trop utiles.
  • Objection à la couverture du « Doom Loop » : le fil #12 de r/ArtificialInteligence, « 'Doom Loop': OpenAI and Microsoft Admits LLMs Are Destroying the Web and Built on Theft » (127 pt, 36 commentaires, 2026-09-19, https://www.reddit.com/r/ArtificialInteligence/comments/1wkmo3u/ ), cite un article fondé sur le mot « theft » dans un document interne de Microsoft. Le principal commentaire, de u/KamikazeArchon (20 pt), relève toutefois que l’article tronque et déforme les citations en ignorant leur contexte.
  • Attentes autour d’un article sur les LLM à paramètres infinis : sous le fil #9 de r/accelerate, « Infinite-Parameter LLMs: Generating and Adapting Weights from Live Data » (205 pt, 20 commentaires, 2026-09-18, https://www.reddit.com/r/accelerate/comments/1wjgw2y/ ), u/armentho (65 pt) s’enthousiasme : « Réécrire les poids en temps réel ? La RSI (amélioration récursive de soi) arrive enfin !! » u/arjuna66671 (14 pt) tempère : « En réalité, cela ressemble davantage à une armoire de classement. Le modèle principal ne change pas pendant la conversation. »
  • Lien entre la scène LLM et les communautés EA/rationalistes : dans le fil #7 de r/BetterOffline, « Are people really this weirded out by the connection of the LLM scene to EA/rationalism? » (270 pt, 117 commentaires, 2026-09-19, https://www.reddit.com/r/BetterOffline/comments/1wkj0mh/ ), u/Icy-Recognition-7453 (106 pt) note à quel point l’EA imprègne la Silicon Valley : certaines personnes vivent, travaillent, fréquentent et se marient entièrement au sein de ce « culte ».
  • Expérience N=1 consistant à confier ses données personnelles à un LLM : le fil #11 de r/slatestarcodex, « What it feels like to let an LLM read my journals, sleep, finances and analyze me for 15 minutes a week » (9 pt, 14 commentaires, 2026-09-24, https://www.reddit.com/r/slatestarcodex/comments/1wozi2w/ ), relate l’expérience d’une personne faisant lire à Claude ses journaux, données de sommeil et finances afin d’obtenir une analyse hebdomadaire. L’auteur s’inquiète de ne pas savoir si un consentement suffisamment éclairé peut être donné à propos de la manière dont un LLM transformera son identité à long terme.
Signaux
  • En hausse : les plaintes et la surprise face aux hausses de prix des GPU locaux et du matériel spécialisé (NVIDIA « Spark », 5090, etc.) (#10, #4) ont été le thème le mieux noté dans l’écosystème LocalLLaMA ce jour-là. Les remarques du type « heureusement que j’ai acheté avant la hausse » sont nombreuses.
  • En hausse : les soupçons géopolitiques liés à DeepSeek/Kimi, aux autorités de Pékin et à Anthropic (#6) ont obtenu un score et un volume de discussion exceptionnels. Le sujet dépasse la technique pour devenir une préoccupation de sécurité nationale : des données chinoises auraient-elles en réalité circulé vers Anthropic ?
  • Affirmation en voie de rejet : l’article selon lequel « Microsoft et OpenAI auraient admis que les LLM reposent sur le vol et détruisent le Web dans une “doom loop” » (#12) n’est pas soutenu ; le principal commentaire y dénonce une manipulation du contexte des citations.
  • Points de vue opposés : sur le même thème des « limites des LLM », r/QuebecTI (#3, favorable à la thèse des limites de mise à l’échelle du MIT) et r/accelerate (#9, enthousiasmé par les LLM à paramètres infinis et la RSI) affichent des tonalités opposées. L’un dit « les LLM ont atteint leur plafond », l’autre « une nouvelle architecture ouvre un potentiel illimité ».
  • Surprise : les discussions sociologiques sur les cultures et idées auxquelles les LLM sont associés — EA/rationalisme, université, influence sur l’identité (#1, #7, #11) — ont suscité plus de scores et de longs commentaires que les sujets purement techniques ou les annonces de produits.
  • Fatigue du grand public : le fil de r/NoStupidQuestions (#2) a un score de 0, mais les nombreuses réponses opposant une utilisation réelle à l’idée que l’IA serait une mode passagère comme les NFT suggèrent que le public général reste divisé.
Limites
  • La seule requête était « Daily LLM News », et la collecte se limite à une page de résultats (12 fils, 11 subreddits). Le critère de lecture de dix éléments est atteint, mais aucune collecte transversale avec plusieurs requêtes n’a été faite.
  • Le fil #8 (r/LSM « Breaking News: », 75 pt, 2026-09-19, https://www.reddit.com/r/LSM/comments/1wkiow2/ ) concerne la participation de Colin Moriarty à une tournée d’Ed Sheeran et n’a rien à voir avec les LLM. Il a été considéré comme un faux positif de recherche et exclu des synthèses effectives « What people say » et « Where » ci-dessus.
  • Le fichier de collecte ne contient aucun cas de page inaccessible ni de recherche sans résultat ; les 12 éléments possèdent tous un score, une date et un lien. Il n’y a donc aucun fil non accessible.
  • La période couverte va approximativement du 2026-09-18 au 2026-09-24. Les discussions plus anciennes et les réactions ultérieures, notamment celles du 25/09, ne sont pas collectées.

X

X — Actualités quotidiennes sur les LLM (2026-09-25)

Comptes

Les personnes parlant réellement de LLM sur X étaient des créateurs individuels travaillant dans la vidéo et le jeu. Chacun n’a publié qu’un ou deux messages ponctuels ; aucun grand compte très suivi ne publiait en continu.

Compte Nom Posts J’aime Contenu
@kevin_t_ngo Kevin Ngo 1 3,470(~235,000 views) Création d’une animation GIF pour Blender avec Claude Opus 5.5, remerciements à @claudeai
@KanaWorks_AI KANA|東京AI映像 2 438 Création d’un jeu 3D/ARPG avec Opus 5.5×Godot et Opus 5.5×Unreal
@akiy_8 AKI 1 467 Génération avec Opus 5.5 d’une animation pixel art de 470 lignes dans un seul HTML
@aicreataro aicreataro 1 444 Utilisation d’Opus 5.5 pour piloter After Effects et traiter une vidéo
@shinshin86 shinshin86|AITuber OnAir開発者 1 308 Utilisation d’Opus 5.5 pour piloter un outil de génération de mouvements Live2D
@ponzponz15 ぽんず 1 198 Édition avec caméra 3D et texte en relief via Claude Opus / Codex + Hyperframes
@seiiiiiiiiiiru SEIIIRUAIを使う映像クリエイター 1 78 Vidéo publicitaire IA avec Opus 5.5 + Gemini 3.8 Flash TTS

Il ne s’agit pas tant de comptes ayant énormément progressé grâce à une seule publication que d’un ensemble de créateurs vidéo IA japonais testant Opus 5.5 simultanément. Seul le post de @kevin_t_ngo se distingue à une échelle anglophone (3,470 likes, ~235,000 views).

Publications
  1. @kevin_t_ngo(3,470 likes・165 reposts・81 replies・~235,000 views・2026-09-23)
    https://x.com/kevin_t_ngo/status/2102761406315839798

    Thank you @claudeai ! GIF animated in Python and rendered in Blender by Claude Opus 5.5
    Trouvé en cherchant « Claude ». Publication sur Opus 5.5 ayant le plus progressé dans la sphère anglophone.

  2. @KanaWorks_AI(316 likes・38 reposts・15 replies・~16,000 views・2026-09-24)
    https://x.com/KanaWorks_AI/status/2102955708321062975

    Développement d’un jeu 3D avec Claude Opus 5.5 × Godot. Créer un jeu dans Godot me semble un peu plus facile qu’avec Unity. C’est léger à exécuter et le résultat est vraiment bon.
    Trouvé en cherchant « Opus 5.5 ».

  3. @KanaWorks_AI(122 likes・14 reposts・9 replies・~6,700 views・2026-09-24)
    https://x.com/KanaWorks_AI/status/2103138051165933661

    Claude Opus 5.5 × Unreal. Je n’aurais jamais imaginé qu’un jour je pourrais créer moi-même un ARPG comme celui-ci.
    Trouvé en cherchant « Claude ». La même personne laisse Opus 5.5 créer des jeux dans Godot et Unreal.

  4. @akiy_8(467 likes・43 reposts・6 replies・~21,000 views・2026-09-22)
    https://x.com/akiy_8/status/2102545213218803769

    J’ai essayé de générer une animation pixel art avec Opus 5.5 : un seul HTML de 470 lignes ; tous les sprites sont des tableaux de pixels dans le code ; 54 créatures et environ 15 espèces fonctionnent de manière autonome grâce à des boids et transitions d’état ; palette de 30 couleurs, 320×180.
    Trouvé en cherchant « Opus 5.5 ». Le post contient les chiffres les plus détaillés pour un exemple technique.

  5. @aicreataro(444 likes・66 reposts・7 replies・~45,000 views・2026-09-23)
    https://x.com/aicreataro/status/2102656273112326609

    Test consistant à faire piloter After Effects à Opus 5.5 pour traiter une vidéo IA. ■ Base : une vidéo de 15 secondes avec MiniMax H3 ■ Dans AE : ajustement de la vitesse des coupes au rythme, puis un effet par segment.
    Trouvé en cherchant « Opus 5.5 ». C’est la publication liée à Opus 5.5 ayant obtenu le plus de vues dans cette collecte (~45,000).

  6. @shinshin86(308 likes・36 reposts・6 replies・~31,000 views・2026-09-24)
    https://x.com/shinshin86/status/2103037974242046335

    Opus 5.5 semble avoir de très bonnes capacités de génération de mouvement, alors j’ai aussi demandé des mouvements Live2D et le résultat est bon...Claude Code (Opus
    Trouvé en cherchant « Claude ». La publication détaille même les étapes concrètes d’intégration de l’outil : clonage d’un outil supplémentaire Live2D puis pilotage avec Claude Code.

  7. @ponzponz15(198 likes・17 reposts・7 replies・~31,000 views・2026-09-24)
    https://x.com/ponzponz15/status/2102931824918106499

    Caméra 3D × mise en scène de texte en relief ②. Des montages du type de ceux réalisés dans After Effects deviennent possibles avec Claude Opus ou Codex. En haut : Seedance 2.5 prev. En bas : Codex + Hyperframes skill #dreaminacpp
    Trouvé en cherchant « Claude ». Mention dans un contexte de comparaison et d’utilisation conjointe de Claude Opus et Codex.

  8. @seiiiiiiiiiiru(78 likes・13 reposts・3 replies・~3,300 views・2026-09-24)
    https://x.com/seiiiiiiiiiiru/status/2103227982592831846

    Vidéo publicitaire IA → voix IA × montage IA. On peut dire que c’est déjà le point d’arrivée, non ? lol. J’ai fait générer la narration par Gemini 3.8 Flash TTS avec Claude Opus 5.5, puis créé directement dans Claude une vidéo synchronisée avec cette voix en pilotant AE et d’autres outils.
    Trouvé en cherchant « Opus 5.5 ». Exemple de pipeline combinant Claude et Gemini.

Signaux
  • Ce qui monte : le sujet LLM réellement discuté aujourd’hui sur X n’est ni une annonce de modèle ni un benchmark, mais des démonstrations consistant à « laisser Claude Opus 5.5 contrôler des outils ». Le même schéma apparaît indépendamment chez plusieurs créateurs japonais : Opus 5.5 pilote After Effects, Blender, Godot, Unreal ou Live2D et produit des livrables.
  • Ce qui est négligé : aucune publication sur des annonces de nouveaux modèles, des sorties de poids ouverts, des changements de prix d’API, des benchmarks officiels ou des mouvements d’entreprise — les thèmes initialement recherchés — n’a été trouvée. Les mentions de « Claude » et « Opus 5.5 » se concentrent sur des comptes rendus pratiques, non sur des actualités.
  • Élément surprenant : Explore de X était rempli de « $song », « Taylor », « Serbia », « Cardano », « Croats », « Croatia », « NFTs » et « Israel », sans lien avec les LLM. Parmi les termes issus d’Explore, seuls « Opus 5.5 » et « Claude » ont produit des résultats LLM. Les nouvelles LLM ne figurent donc pas du tout parmi les tendances majeures de X ce jour-là.
Limites
  • La collecte part d’Explore accessible depuis l’hôte ; la plupart des tendances y étaient explicitement indiquées comme « Trending in Croatia ». La liste reflète donc une perspective croate, et ne peut être considérée comme une tendance mondiale.
  • Les dix termes effectivement recherchés sont "$song", "Opus 5.5", "Taylor", "Serbia", "Cardano", "Croats", "Croatia", "NFTs", "Claude", "Israel". Seuls « Opus 5.5 » et « Claude » sont pertinents pour le brief LLM ; les huit autres n’ont renvoyé que des résultats sans lien avec l’actualité LLM.
  • Parmi les 40 publications collectées, seules huit peuvent être traitées comme des nouvelles LLM. Le seuil de dix n’a pas été atteint ; seules ces huit publications sont rassemblées ici.
  • Aucune publication concernant des annonces de nouveaux modèles, sorties de poids ouverts, modifications d’API ou de tarifs, benchmarks officiels ou annonces d’entreprise n’a été trouvée. Tous les éléments LLM identifiés sur X sont des démonstrations ou impressions de créateurs individuels du type « j’ai essayé de faire contrôler X par Opus 5.5 », et non des sources primaires d’actualité.
  • Les publications datent du 2026-09-22 au 2026-09-24. La collecte couvre ce qui était affiché sur X au moment de la session et n’explore pas les publications antérieures pertinentes.

YouTube

YouTube — L’actualité LLM la plus commentée aujourd’hui (2026-09-25)

Chaînes

Les nombres d’abonnés n’ont pas pu être vérifiés dans les résultats YouTube ni dans les métadonnées oEmbed (voir ## Limits).

Vidéos
  1. Claude AI discovers novel enzyme system with CRISPR-like repeats
    Dr. Samuel Allen Alexander/il y a environ 19 heures(publication vers le 2026-09-24)
    https://www.youtube.com/watch?v=_m_216JykA0
    Explication technique du système enzymatique similaire à CRISPR (array-associated reverse transcriptases, ART) découvert par Anthropic avec Claude.

  2. Claude JUST found hidden DNA...
    Wes Roth/il y a environ 18 heures
    https://www.youtube.com/watch?v=H7KruLVX2Rk
    Une grande chaîne d’explication IA présente la même découverte : Claude aurait découvert de manière autonome un système enzymatique inconnu dans des bactériophages.

  3. Anthropic Secretly Built a Biology Lab (Claude Is About to Touch the Real World)
    Web Oracle/il y a environ 5 jours
    https://www.youtube.com/watch?v=oFzs2b1VzQE
    Présentation du nouveau laboratoire de biologie dans lequel Claude dirige des robots de laboratoire. La découverte apparentée à CRISPR est décrite comme le « premier résultat » du laboratoire.

  4. Google AI Hacked Three Companies; Gemini Security Flaw Exposed; Rogue Test Explained
    NEWS9 Live/il y a 3 à 6 jours
    https://www.youtube.com/watch?v=MOyQRVF7gXE
    Reportage sur l’information divulguée le 18 septembre : au cours d’une évaluation de cybersécurité en mai, Gemini aurait accédé par erreur aux systèmes de trois vraies entreprises ne faisant pas partie du test.

  5. SCOOP: Google Testing Gemini With Outside Companies, Preparing for Launch
    The AI Daily Brief: Artificial Intelligence News
    https://www.youtube.com/watch?v=zm_QiTlOUAo
    Épisode d’analyse approfondissant le contexte de l’incident : les tests de Gemini réalisés par Google avec des entreprises externes.

  6. Anthropic Just Dropped Claude Opus 5.5 (CHEAPER & BETTER)
    Brock Mesarich | AI for Non Techies
    https://www.youtube.com/watch?v=fc7l-dut1GM
    Présente Claude Opus 5.5, annoncé le 22 septembre, comme moins cher, plus rapide et plus performant, avec les points essentiels pour les non-ingénieurs.

  7. Claude Opus 5.5 - Benchmark and Pricing | Beats Fable 5.1 and GPT-6 Astra?
    United Top Tech
    https://www.youtube.com/watch?v=AR1Gi3RHanE
    Vérifie les benchmarks et prix d’Opus 5.5 en comparaison avec Fable 5.1 et GPT-6 Astra.

  8. 【速報】GPT6 Sol/Luna 登場 価格2分の1で性能大幅UP|Opus5.5発表当日にGPTも更新
    AI時短ラボ
    https://www.youtube.com/watch?v=fl42jHc7Ewc
    Explication en japonais du lancement par OpenAI de GPT-6 Sol/Luna 89 minutes seulement après l’annonce d’Opus 5.5, avec un tarif réduit de moitié (Sol: $2/$10, Luna: $0.10/$0.50 per Mトークン).

  9. GPT-6 Sol & Luna Just Dropped: Faster and 50% Cheaper
    BitBiasedAI/il y a environ 1 jour
    https://www.youtube.com/watch?v=m5wb-3gsmOo
    Une chaîne anglophone traite en urgence la même nouvelle tarifaire et souligne la division par deux du taux d’erreur pour le code.

  10. Grok 4.7: No-Hype Full Review & Testing
    Pat Simmons/il y a environ 3 jours
    https://www.youtube.com/watch?v=x48xbDO6fKo
    Évaluation de Grok 4.7 sans exagération, avec comparaisons de benchmarks face à Fable 5.1 et GPT-6 Astra.

  11. OpenAI Launches GPT-6 Astra — Welcome to the AGI Era
    Dev Branch/il y a environ 3 semaines(publiée le 2026-09-03, moins de 60 jours)
    https://www.youtube.com/watch?v=TKhMnVAh_ZE
    Présente le lancement de GPT-6 Astra, l’un des grands sujets de septembre, comme l’arrivée de l’ère AGI. Opus 5.5 et Sol/Luna sont décrits comme des réponses ou des suivis de ce modèle.

Signaux
  • Le sujet le plus commenté actuellement : le premier résultat du laboratoire de biologie de Claude/Anthropic — la découverte du système enzymatique similaire à CRISPR ART — est abordé presque simultanément par plusieurs chaînes seulement 18 à 19 heures après publication, notamment Dr. Samuel Allen Alexander et Wes Roth. C’est le sujet qui monte le plus rapidement sur YouTube aujourd’hui.
  • Guerre des baisses de prix entre modèles fermés : le 22 septembre, 89 minutes après l’annonce de Claude Opus 5.5 par Anthropic, OpenAI a annoncé GPT-6 Sol/Luna et réduit les prix de moitié. Cette rivalité de timing est mentionnée dans plusieurs vidéos et traitée comme un mème, comme l’illustre le titre de la vidéo d’AI時短ラボ.
  • Sécurité et gouvernance : l’incident d’accès non autorisé de Gemini, divulgué le 18 septembre, ainsi que le projet d’organisme volontaire de normes de sécurité par Google, OpenAI et Anthropic (Frontier AI Standards Agency ≒ Standards Authority for Frontier AI) sont évoqués par des chaînes d’actualité et de vulgarisation. Aucun contenu YouTube dédié au second thème n’a toutefois été trouvé ; les médias écrits, tels qu’AI Weekly et The Information, semblent en avance.
  • Les acteurs des poids ouverts sont calmes aujourd’hui : aucune nouvelle vidéo publiée dans les dernières 24 heures au sujet d’une sortie de Kimi, GLM, Llama ou d’un autre modèle à poids ouverts n’a été identifiée. Les discussions récentes se concentrent sur les échanges entre les trois acteurs fermés OpenAI, Anthropic et Google.
Limites
  • La page de résultats YouTube (youtube.com/results?search_query=...) est rendue en JavaScript et ne peut pas être obtenue directement : WebFetch ne renvoie que le pied de page. L’enquête a donc combiné site:youtube.com dans WebSearch et l’API YouTube oEmbed, qui ne fournit que le titre et le nom de chaîne.
  • Par conséquent, les nombres exacts de vues, d’abonnés et de commentaires n’ont pas pu être obtenus. Les dates sont des estimations fondées sur des indications relatives visibles dans les extraits de résultats (« il y a X heures », « il y a X jours »).
  • Aucune vidéo YouTube dédiée au projet « Frontier AI Standards Agency (Standards Authority for Frontier AI, SAFA) » n’a été trouvée. Les sites d’information semblent actuellement en avance et les explications vidéo ne paraissent pas encore publiées.
  • Les autres plateformes, telles que Reddit, X, Bluesky et Lemmy, ne faisaient pas partie du périmètre de cette étape et n’ont pas été étudiées.

Bluesky

Bluesky — Actualités LLM du jour (2026-09-25)

Comptes
  • TestingCatalog (@testingcatalog.com) — compte d’alerte qui repère très vite les fuites, nouveaux produits et modèles IA. La moitié des posts recensés vient de ce compte.
  • Simon Willison (@simonwillison.net) — blogueur reconnu et praticien des LLM. Ses comparaisons de nouveaux modèles via son benchmark de dessin de pélican sont devenues une référence.
  • Epoch AI (@epochai.bsky.social) — institut de recherche qui analyse quantitativement les coûts d’entraînement et tendances de calcul de l’IA.
  • Nathan Lambert (@natolambert.bsky.social) — membre d’Ai2 et auteur d’interconnects.ai, attentif au rapport entre poids ouverts et modèles fermés.
  • antirez / Salvatore Sanfilippo (@antirez.bsky.social) — créateur de Redis. Il publie régulièrement des tests de son outil d’inférence rapide « DwarfStar », qui exécute des modèles à poids ouverts sur Mac/DGX Spark.
  • ModelVantage (@modelvantage.bsky.social) — bot d’alerte qui surveille automatiquement la latence et les incidents des API Gemini/Claude, etc.
  • Classement LLM pour développeurs (@devllmlb-ja.bsky.social) — compte japonais qui publie mensuellement des résultats de benchmarks ; son dernier post, du 2026-09-01, est toutefois relativement ancien.
Publications
  1. OpenAI annonce le lancement aujourd’hui de GPT-6 Sol / Luna — « OpenAI prepares to launch GPT-6 Sol and Luna models today »
    TestingCatalog、2026-09-22、👍1 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w

  2. Fuite : Google teste de nouveaux checkpoints Gemini 4 Pro — « Google tests new Gemini 4 Pro checkpoints, early outputs »
    TestingCatalog、2026-09-23、👍2
    https://bsky.app/profile/testingcatalog.com/post/3mw6b5f3opi2j

  3. Xiaomi met en open source les modèles omnimo­daux MiMo-V2.6 Pro/Flash(prise en charge du code, de la vision et du contrôle d’ordinateur)
    TestingCatalog、2026-09-21、👍2 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mw2tpiskxh2w

  4. SpaceXAI publie Grok 4.7 pour le code et le travail intellectuel
    TestingCatalog、2026-09-21
    https://bsky.app/profile/testingcatalog.com/post/3mw2rdziawn2s

  5. Anthropic teste Fable 5.2 et Opus 5.5 avant leur sortie
    TestingCatalog、2026-09-21、👍1
    https://bsky.app/profile/testingcatalog.com/post/3mvzd4w227422

  6. Simon Willison compare Claude Opus 5.5, GPT-6 Sol et GPT-6 Luna — « Big model release today - I wrote about Claude Opus 5.5, GPT-6 Sol, and GPT-6 Luna - plus comparison grids of pelicans by the different model families at different reasoning levels »
    2026-09-22、👍123 🔁10
    https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n

  7. Simon Willison analyse le très faible coût des modèles Gemini 3.8 TTS — « The new Gemini 3.8 TTS models are super-cheap and can generate conversations between multiple voices... » ; son estimation est inférieure à un centime par minute.
    2026-09-23、👍77 🔁7
    https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i

  8. Epoch AI : « les coûts de l’IA baissent d’environ 47 % par trimestre, plus vite que toute autre innovation technologique »
    2026-09-22、👍123 🔁30
    https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h

  9. Epoch AI : « GPT-5.6 Luna reproduit sur FrontierMath le niveau atteint par o3 à 1/377e du coût »($0.55→$0.0015, 377 fois moins cher en 18 mois)
    2026-09-22、👍12
    https://bsky.app/profile/epochai.bsky.social/post/3mw567lpe7s2l

  10. Nathan Lambert présente aux collaborateurs du Congrès l’état des modèles ouverts et leur compétitivité face à la Chine(lien vers un briefing d’interconnects.ai)
    2026-09-21、👍31 🔁6
    https://bsky.app/profile/natolambert.bsky.social/post/3mvzo2lneqg2j

  11. Il souligne que les principaux laboratoires chinois d’IA utilisent désormais Huawei pour l’inférence et Nvidia pour l’entraînement, révélant une bifurcation de leur stratégie matérielle.
    2026-09-20、👍18
    https://bsky.app/profile/natolambert.bsky.social/post/3mvxajmx5cz2n

  12. antirez prend en charge Qwen3.8 Flash Next dans son outil d’inférence locale « DwarfStar »(50 à 70 t/s sur un Mac 64 Go, plus de 1400 t/s en prefill)
    2026-09-14、👍76 🔁8
    https://bsky.app/profile/antirez.bsky.social/post/3mvi75e3c722o

Signaux
  • Une vague de nouveaux modèles fermés est le sujet central de la semaine : GPT-6 Sol/Luna, Claude Opus 5.5/Fable 5.2 et les fuites/tests de Gemini 4 Pro se concentrent la même semaine. Des comptes de praticiens comme Simon Willison publient immédiatement des comparaisons côte à côte, notamment via le benchmark de dessin de pélicans : une réactivité typique de Bluesky.
  • La « chute des coûts de raisonnement » est discutée avec des données quantitatives : les chiffres d’Epoch AI — baisse de 47 % par trimestre et coût divisé par 377 sur FrontierMath — circulent avec des références plus précises que sur les autres plateformes. Avec 👍123 et 🔁30, c’est le post suscitant le plus de réactions de cette enquête.
  • Les poids ouverts se concentrent sur les rapports d’exécution locale : antirez continue de tester Qwen3.8 Flash Next et DeepSeek v4.1 Flash sur son Mac/DGX Spark, tandis que la mise en open source de MiMo-V2.6 de Xiaomi a été signalée. Le post Xiaomi de TestingCatalog (👍2) reçoit beaucoup moins de réactions que celui de Simon Willison (👍123), ce qui suggère que les sorties de modèles fermés se transforment plus facilement en sujet de discussion sur Bluesky.
  • Nathan Lambert propose une grille géopolitique « fermé contre ouvert » : son observation selon laquelle les acteurs chinois répartissent Huawei pour l’inférence et Nvidia pour l’entraînement apporte un angle distinct des discussions centrées ailleurs sur les benchmarks techniques.
  • Des bots de surveillance d’API tels que ModelVantage existent, mais les incidents récents — erreurs Gemini 3.1 Pro les 14 et 15 septembre, avec 100 % d’erreurs pendant quelques minutes sur US-East — ne sont pas des sujets « du jour » et n’ont reçu aucun like.
Limites
  • L’API officielle de recherche (app.bsky.feed.searchPosts) a systématiquement renvoyé 403 Forbidden dans l’environnement de cette enquête, empêchant toute recherche directe par mots-clés — aussi bien par accès direct qu’à travers deux proxys CORS. À l’inverse, les autres endpoints, comme getProfile, getAuthorFeed et getPostThread, fonctionnaient normalement ; il est donc probable que seul l’endpoint de recherche soit bloqué.
  • À cause de cette contrainte, la collecte a suivi la méthode « identifier des comptes probablement pertinents → lire leurs publications », plutôt qu’une recherche transversale par mots-clés. Les publications de comptes individuels ou modestes non cités ici ont donc pu être manquées.
  • Les pages de recherche et de publication de bsky.app sont des SPA rendues côté client ; WebFetch n’a pu récupérer que le titre « Bluesky », sans contenu. Tous les liens sont donc des publications vérifiées via l’API, mais aucune vérification visuelle directe dans un navigateur n’a été effectuée.
  • Des bots de publication automatique comme ai-news-jp.bsky.social n’ont plus publié depuis juillet 2025 et ne pouvaient pas servir pour l’actualité du jour ; ils ont été exclus des comptes.
  • Aucun contenu publié le 2026-09-25 même n’a été trouvé. Les posts ici datent principalement du 2026-09-20 au 2026-09-23, avec GPT-6 Sol/Luna, Opus 5.5 et Gemini 4 Pro toujours au centre des discussions. Il n’a pas été possible de réunir dix éléments uniquement datés du jour.
  • Les comptes japonais, dont devllmlb-ja.bsky.social, n’ont pas publié cette semaine ; l’impression générale est que les discussions LLM sur Bluesky en japonais sont plus faibles que dans la sphère anglophone.

Lemmy

Lemmy — Le sujet le plus discuté aujourd’hui : forte baisse de la part des modèles fermés et effervescence autour d’Opus 5.5 / des modèles locaux

Communautés
  • !«メールアドレス» — 88,221 membres. Forum technologique généraliste où affluent des nouvelles liées aux LLM ; principale source de publications sur Gemini.
  • !«メールアドレス»(également en miroir sur sh.itjust.works, ID 330)— 5,172 membres. Principalement des sorties de modèles à poids ouverts, benchmarks et publications techniques autour de llama.cpp.
  • !ai_reddit — communauté reprenant des publications de r/ClaudeCode et r/ArtificialInteligence (nombre d’abonnés impossible à obtenir sur lemmy.world en raison d’erreurs 404/500 ; voir Limits ci-dessous). Les fils liés à Opus 5.5 y sont concentrés.
  • !hackernews — miroir des articles populaires de Hacker News. Les applications de LLM, comme la recherche historique et la désanonymisation, y figurent parmi les contenus majeurs.
  • !«メールアドレス» — communauté de développement de Lemmy elle-même. L’adoption de règles de divulgation de l’usage de l’IA/LLM y est discutée.
  • !selfhosted — communauté de l’auto-hébergement. Le débat sur la définition d’un LLM open source, autour de K2 Horizons, y a été animé.
  • !blueteamsec / !lobsters — reprises de recherches relatives aux LLM, davantage axées sécurité et technique.
Publications
  1. Closed Models Fell From 70% to 21.6% Market Share in 3 Months — !tecnologia、score 1、2026-09-24 05:00
    https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/
    Article fondé sur des données de Vercel affirmant que la part d’utilisation des modèles fermés est tombée de 70 % à 21,6 % en seulement trois mois. Il symbolise l’opposition actuelle entre modèles fermés et poids ouverts.

  2. New Opus is absolutely bonkers — !ai_reddit(à l’origine r/ClaudeCode)、score 0、2026-09-24 20:01
    https://www.reddit.com/r/ClaudeCode/comments/1wp1q8n/new_opus_is_absolutely_bonkers/
    Fil qualifiant le nouveau modèle Opus d’Anthropic d’exceptionnel.

  3. Is Opus 5.5 really better than Fable in your experience? — !ai_reddit(à l’origine r/ClaudeCode)、score 0、2026-09-24 02:50
    https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/is_opus_55_really_better_than_fable_in_your/
    Discussion comparant, à partir d’expériences concrètes, les performances d’Opus 5.5 et Fable au-delà des benchmarks.

  4. I A/B tested Opus 5 vs Opus 5.5 for AI slop: 98 em dashes vs 0 — !ai_reddit(à l’origine r/ClaudeCode)、score 1、2026-09-23 07:45
    https://www.reddit.com/r/ClaudeCode/comments/1wnwqcs/i_ab_tested_opus_5_vs_opus_55_for_ai_slop_98_em/
    Test A/B de la qualité de sortie d’Opus 5 et Opus 5.5, rapportant une nette baisse de l’aspect « produit par IA », notamment l’usage excessif des tirets cadratins.

  5. llama.cpp v0.5.0 — !LocalLLaMA、score 23・0 commentaire、2026-09-24 16:18
    https://github.com/ggml-org/llama.cpp/releases/tag/v0.5.0
    Publication d’une nouvelle version prenant en charge plusieurs nouvelles architectures, dont Qwen4Exp.

  6. New medical model: FreedomIntelligence/HuatuoGPT-3-27B — !LocalLLaMA、score 7・1 commentaire、2026-09-24 16:52
    https://huggingface.co/FreedomIntelligence/HuatuoGPT-3-27B
    Modèle médical à poids ouverts, fondé sur Qwen3.8-27B et construit via One-stage Policy Optimization sans fine-tuning supervisé.

  7. Qwen4-27B just confirmed — !LocalLLaMA、score 34・5 commentaires、2026-09-22 22:45
    https://lemmy.ml/post/53074988
    Fil confirmant officiellement la sortie de Qwen4-27B. Bien que l’annonce remonte à trois jours, elle demeure l’un des principaux sujets de poids ouverts de la semaine.

  8. Google introduce "Call for Me" sui Pixel 11 per affidare le telefonate a Gemini — !tecnologia、score 1、2026-09-24 18:17
    https://www.theverge.com/ai-artificial-intelligence/1000116/google-gemini-business-phone-calls
    Google annonce « Call for Me », une fonctionnalité du Pixel 11 dans laquelle Gemini gère des appels téléphoniques.

  9. Google invented the Transformer, so why does using Gemini still feel like a chore? — !ai_reddit(à l’origine r/ArtificialInteligence)、score 1、2026-09-24 08:35
    https://www.reddit.com/r/ArtificialInteligence/comments/1wovzal/google_invented_the_transformer_so_why_does_using/
    Publication critique demandant pourquoi Google, inventeur du Transformer, continue d’être dépassé par des acteurs à poids ouverts plus agiles tels que DeepSeek et Qwen.

  10. Using LLMs to trace alchemical knowledge and decode 17th century letters — !hackernews、score 7、2026-09-24 20:00
    https://lemmy.bestiver.se/post/1359598
    Exemple d’application de recherche historique utilisant GPT-6 et Opus 5.5 pour déchiffrer des lettres alchimiques du XVIIe siècle.

  11. Large-scale online deanonymization with LLMs — !blueteamsec、score 6、2026-09-24 19:23
    https://infosec.pub/post/52730942
    Étude soutenant que les LLM peuvent réidentifier avec une grande précision des utilisateurs de Hacker News et des participants à Anthropic Interviewer — jusqu’à 68 % de rappel à 90 % de précision —, illustrant les risques liés aux LLM.

  12. Is K2 Horizons historically significant as the first actual open-source LLM, or am I falling for hype? — !Selfhosted、score 48(pour)/10(contre)・20 commentaires、il y a 5 jours(vers le 2026-09-20)
    https://lemmy.zip/post/... (reprise lemmy.world: https://lemmy.world/post/52135351)
    Débat sur la possibilité de qualifier K2 Horizons de « premier véritable LLM open source ». De nombreuses réponses citent des précédents comme GPT-Neo, OPT et BLOOM, et soulignent que les données d’entraînement ne sont pas publiées.

Signaux
  • Modèles fermés contre poids ouverts : le contenu le plus emblématique est l’article selon lequel la part de marché des modèles fermés serait tombée de 70 % à 21,6 % en trois mois (publication 2). L’atmosphère générale de Lemmy est elle aussi favorable aux poids ouverts : publications célébrant les progrès de DeepSeek/Qwen et raillant la lenteur de Google (publication 9), ainsi que sorties de Qwen4-27B et HuatuoGPT-3-27B (publications 6, 7).
  • Anthropic Opus 5.5 : plusieurs fils simultanés liés à Opus 5.5 se trouvent dans !ai_reddit, via des reprises de r/ClaudeCode (publications 2, 3, 4). Ils discutent à la fois de qualité — comme la réduction des tirets cadratins — et d’évaluation par benchmark.
  • Accidents et risques liés aux LLM : des contenus sur la désanonymisation (publication 11) et le watermarking (vLLM), entre autres, apparaissent dans le cluster Lobsters/blueteamsec autour de la sécurité et de la prévention des abus.
  • Déploiement pratique : des actualités d’intégration produit, telles que « Call for Me » de Google Gemini sur Pixel 11 (publication 8), occupent aussi une place notable.
Limites
  • Lemmy compte de petites communautés et n’a pas fourni à lui seul dix fils LLM clairement nouveaux pour la journée. Le débat sur K2 Horizons vieux de cinq jours (publication 12) et le post sur Qwen4-27B vieux de trois jours (publication 7) ont été inclus comme sujets toujours discutés cette semaine afin d’atteindre 12 éléments.
  • Le nombre d’abonnés de la communauté !ai_reddit n’a pas pu être obtenu : lemmy.world/api/v3/community?name=ai_reddit renvoie 404 et lemmy.world/c/ai_reddit renvoie 500. Il est possible que l’instance d’origine soit différente, mais elle n’a pas été identifiée.
  • Les posts originaux sur reddit.com (www.reddit.com/r/ClaudeCode/...) sont bloqués en accès direct par WebFetch. Les résumés reposent donc sur les titres, scores et dates des publications miroir Lemmy, sans vérification détaillée du corps des fils originaux.
  • Les interfaces de recherche d’autres instances, dont lemmy.ml et lemm.ee, ont été remplacées par une recherche API sur lemmy.world et des requêtes API vers des instances individuelles comme sh.itjust.works. Aucune recherche exhaustive sur toutes les instances n’a été menée.

Actions recommandées

  • Lors de la prochaine enquête Reddit, ajouter « Opus 5.5 », « GPT-6 Sol » et « GPT-6 Luna » aux requêtes.
  • Vérifier dans les données primaires le chiffre Vercel de 70 % → 21,6 % pour la part de marché des modèles fermés avant toute citation.
  • Suivre le projet Frontier AI Standards Agency (SAFA) dans les médias écrits afin de compenser sa visibilité tardive sur les réseaux sociaux.
  • Envisager à partir de la prochaine édition un suivi dédié des résultats scientifiques provenant du laboratoire de biologie d’Anthropic.
  • Ajouter à l’enquête X des requêtes complétant les démonstrations de créateurs japonais par des sources primaires anglophones.
  • Vérifier au début de la prochaine enquête si l’erreur 403 de l’API officielle de recherche Bluesky est résolue.

Note sur la qualité des données

Reddit et Lemmy ont atteint le seuil de dix éléments, mais X s’est limité à huit, la majorité des termes de recherche étant sans rapport. Bluesky a dû remplacer la recherche par une collecte au niveau des comptes à cause de l’erreur 403 de l’API, sans obtenir de publications datées du jour ; YouTube n’a pas pu fournir de nombres exacts de vues ou d’abonnés en raison des contraintes de rendu.