KEN’S CAT LOG

Actualités quotidiennes des LLM — 2026-09-12

Le principal sujet du jour n’a pas été une annonce de modèle, mais le rapport de renseignement sur les menaces d’Anthropic (développement d’armes par les Houthis, surveillance de navires iraniens, utilisation de Claude par des hackers liés à la Russie pour attaquer l’Ukraine), qui a suscité de manière indépendante des réactions de premier plan sur X et Lemmy.

Actualités quotidiennes des LLM — 2026-09-12

Aujourd’hui, le sujet le plus discuté n’était pas tant l’annonce de nouveaux modèles que les abus et la fiabilité de l’IA. Sur X et Lemmy, le rapport de renseignement sur les menaces d’Anthropic — développement d’armes avec Claude Code par les Houthis, surveillance de navires américains par l’Iran et vol de technologies militaires ukrainiennes par des hackers liés à la Russie — s’est imposé indépendamment comme le principal sujet du jour. En parallèle, Reddit et Bluesky ont vu émerger simultanément des soupçons selon lesquels OpenAI aurait « volé » des résultats liés aux équations de Navier–Stokes des mathématiciens Buckmaster, Alpoge et d’autres, à partir de l’historique de sessions ChatGPT. YouTube, Bluesky et Lemmy ont également beaucoup parlé de nouveaux modèles tels que Claude Fable 5.1, GPT-6 Astra, Gemini 3.8 Flash, DeepSeek V4.1 Flash, GLM-5.3 et Fugu Max/Ultra v2 de Sakana AI, avec une opposition récurrente entre les acteurs fermés et les modèles à poids ouverts. Dans l’ensemble, les thèmes sont nets, mais certaines plateformes n’atteignent pas les critères de complétude en raison de limites de collecte et de recherche ; le niveau de confiance reste donc modéré.

À travers les plateformes

Plateforme par plateforme

Reddit(1er dans l’ordre de collecte): Douze fils issus de neuf subreddits ont été collectés à partir de l’unique requête « Daily LLM News », mais aucun fil ne signalait directement de nouvelles annonces de modèles ou de changements tarifaires : les discussions et l’ironie autour de nouvelles existantes dominaient. Les principaux foyers de débat étaient les soupçons de « vol » autour de Navier–Stokes chez OpenAI et la réaction à l’article du WSJ attaquant les poids ouverts. La période couverte, du 2026-09-06 au 10, s’étale sur cinq jours et n’est donc pas strictement limitée à « aujourd’hui », comme le demande le brief.

X(2e): La liste des tendances était basée sur une localisation de connexion identifiée comme croate ; parmi les dix requêtes collectées, seul « Anthropic » concernait réellement les LLM. Sur dix éléments, seulement six étaient directement pertinents pour le brief LLM — en dessous du critère de complétude de dix. Parmi ces six, le rapport de renseignement sur les menaces d’Anthropic, concernant les Houthis et l’Iran, a largement dominé la diffusion, tandis que le rapport sur les scénarios économiques et l’ouverture du code de Claude Code recevaient un accueil plus favorable.

YouTube: Le critère de dix éléments est atteint et les principales annonces de modèles de la semaine — Claude Fable 5.1, GPT-6 Astra, Gemini 3.8 Flash, DeepSeek V4.1 Flash, GLM-5.3, Muse Spark 1.3 et Sakana Fugu Ultra — sont presque toutes couvertes. Toutefois, les limites de rendu JavaScript empêchent d’obtenir des chiffres exacts de vues et d’abonnés, et les dates sont souvent déduites de formulations relatives.

Bluesky: L’API de recherche officielle renvoyait HTTP 403 ; douze éléments ont donc été collectés en remontant les fils de comptes identifiés via recherche web, notamment Ethan Mollick, TestingCatalog et Sakana AI. Les mentions J’aime et repartages ont pu être vérifiés pour dix d’entre eux. L’annonce Fugu Max/Ultra v2 de Sakana AI a constitué la prise de position la plus claire du camp des poids ouverts, mais l’échantillon est biaisé vers les comptes trouvés par hasard.

Lemmy: Douze éléments ont été collectés à travers plusieurs communautés, dont !technology, !localllama et !fosai. Les sujets sur les acteurs fermés se concentrent presque exclusivement sur la sécurité nationale et les abus, dans le contexte du rapport d’Anthropic ; les poids ouverts se concentrent sur les retours d’usage, comme la quantification de Qwen ou K2 Horizon dans LocalLLaMA. Il y a toutefois très peu de publications datées du jour même, 09-12 ; les plus récentes sont réparties du 09-04 au 11.

Les cinq plateformes explicitement demandées par le brief ont toutes été étudiées ; l’absence d’autres plateformes ne constitue pas une lacune.

À surveiller

Recommandations

  • Consulter le rapport de renseignement sur les menaces d’Anthropic dans sa version originale et vérifier les sources primaires des affirmations sur l’armement et la surveillance.
  • Remplacer, pour X, les requêtes dépendantes des tendances locales par une liste fixe mentionnant explicitement OpenAI, Google, Meta, xAI, Mistral et d’autres entreprises.
  • Pour Reddit, associer à « Daily LLM News » des requêtes incluant des noms de modèles et d’entreprises, afin de détecter les annonces de nouveaux modèles elles-mêmes.
  • Suivre en continu, lors des prochaines collectes, l’évolution de Sakana AI Fugu Max/Ultra v2 et d’OpenAI Astra.
  • Vérifier lors de la prochaine collecte si le problème HTTP 403 de l’API searchPosts de Bluesky est résolu ; si oui, revenir à la recherche directe.
  • Vérifier en priorité lors de la prochaine collecte si OpenAI a publié une déclaration officielle concernant la controverse Navier–Stokes.

Qualité des données

Sur X, la sélection des tendances n’était pas optimisée pour le brief LLM : seulement six des dix éléments du critère de complétude concernaient les LLM. Reddit et Lemmy atteignent le nombre d’éléments attendu, mais leurs périodes s’étendent au-delà d’« aujourd’hui » — cinq jours pour Reddit et du 09-04 au 11 pour Lemmy — et reflètent davantage l’accumulation de discussions sur des nouvelles existantes que des nouvelles propres à la journée. Bluesky n’a pas pu utiliser l’API de recherche officielle, bloquée par une erreur 403, et s’appuie sur une remontée indirecte de comptes, ce qui introduit un biais de couverture. YouTube atteint dix éléments, mais les restrictions liées au rendu JavaScript empêchent d’obtenir les données quantitatives telles que le nombre de vues et d’abonnés.

Récapitulatif par plateforme

Reddit

Reddit — Daily LLM News

Douze fils collectés dans neuf subreddits avec la requête « Daily LLM News ».

Subreddit Nombre de membres Nombre de fils collectés
r/NoStupidQuestions 7,480,942 3
r/singularity 3,970,329 2
r/ArtificialInteligence 1,924,916 1
r/artificial 1,336,553 1
r/LocalLLaMA 821,987 1
r/WritingWithAI 165,025 1
r/SillyTavernAI 128,146 1
r/BetterOffline 55,091 1
r/Maxcactus_TrailGuide 5,205 1

r/NoStupidQuestions et r/singularity comptent le plus de fils, mais leur contenu se concentre sur des discussions générales du type « qu’est-ce qu’un LLM ? ». À l’inverse, un seul fil issu du petit subreddit r/Maxcactus_TrailGuide, qui ne compte que 5 205 membres (#10), a connu une réaction virale exceptionnelle avec 2 213 points.

Ce que disent les gens
  • Les affirmations concernant le problème du prix du millénaire d’OpenAI (Navier–Stokes) et les soupçons associés de « vol d’idée » constituent le principal foyer de controverse. Dans le fil #5 (r/singularity, 209 pt/69 commentaires, 2026-09-10, https://www.reddit.com/r/singularity/comments/1wcnyay/), OpenAI aurait été signalé comme proche d’une résolution des équations de Navier-Stokes, tandis qu’OpenAI rejetait comme « impossible » l’allégation selon laquelle l’historique d’utilisation de Codex par les mathématiciens Tristan Buckmaster et d’autres, mentionné dans un article du NYT, aurait influencé le modèle. u/FateOfMuffins (61 pt) estime que cela « suggère que la date de coupure des données du dernier grand entraînement était le 3 juillet ».
  • Les réactions au même sujet divergent selon les subreddits. Dans le fil #6 de r/singularity, « "LLMs will never be smarter than Redditors" » (271 pt/159 commentaires, 2026-09-09, https://www.reddit.com/r/singularity/comments/1wbnhgt/), u/oilybolognese (201 pt) raille les sceptiques. Le fil #7 de r/SillyTavernAI (68 pt/57 commentaires, 2026-09-10, https://www.reddit.com/r/SillyTavernAI/comments/1wclha4/) arrive à la conclusion inverse. u/perthro_anon (140 pt) ironise : « Je crains qu’OpenAI vole le smut que j’ai écrit pour s’en attribuer le mérite », et la discussion évolue vers une défense des LLM locaux.
  • L’article du WSJ contre les poids ouverts, visant les modèles fermés, suscite une forte opposition dans r/LocalLLaMA. Le fil #12 (513 pt/236 commentaires, 2026-09-08, https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/) porte sur un éditorial du WSJ selon lequel « une IA à poids ouverts non régulée est une invitation au désastre », citant la prétendue capacité à répondre à des questions sur la synthèse du poliovirus. u/3169676 (557 pt, commentaire le mieux noté du fil) rétorque : « Seuls de riches milliardaires devraient pouvoir poser des questions à des modèles d’IA “régulés” ? » u/inotparanoid y voit également « un papier à charge destiné à protéger le cours des actions d’Anthropic ou d’OpenAI après leur IPO ».
  • La méfiance envers les récits de « démissionnaires » alertant sur la sécurité de l’IA apparaît dans deux fils. Le fil #4 (r/ArtificialInteligence, 0 pt/32 commentaires, 2026-09-09, https://www.reddit.com/r/ArtificialInteligence/comments/1wbu9c6/) aborde le départ du chercheur Anthropic Jacob Coxon, inquiet d’une « course au développement de systèmes incontrôlables ». u/MiloGoesToTheFatFarm le balaie en disant que cette personne n’était pas concepteur de modèles, mais faisait simplement un travail subalterne comme de la saisie de données. Le fil #9 (r/BetterOffline, 299 pt/167 commentaires, 2026-09-10, https://www.reddit.com/r/BetterOffline/comments/1wcxjv0/) porte sur un autre « catastrophiste de l’IA » invité par CNN. u/Smurfette2016 (208 pt) note : « Il n’avait travaillé que six semaines, son compte Twitter avait moins d’un mois et aucun abonné, mais une publication a fait 130 millions de vues : c’est manifestement orchestré. »
  • La réfutation de l’argument « ce n’est que de la prédiction du prochain token » revient dans plusieurs fils, avec une impression de sujet un peu usé. Dans le fil #1 (r/NoStupidQuestions, 1 285 pt/358 commentaires, 2026-09-10, https://www.reddit.com/r/NoStupidQuestions/comments/1wcsbr2/), u/skmchosen1 (16 pt, se présentant comme chercheur en IA) explique que la prédiction du prochain token est l’objectif du pré-entraînement, mais que le post-entraînement introduit d’autres objectifs, comme une récompense positive lorsqu’un problème mathématique est résolu. u/danderzei (62 pt) relance une discussion similaire dans le fil #3 de r/artificial (67 pt/221 commentaires, 2026-09-06, https://www.reddit.com/r/artificial/comments/1w8m8rw/).
  • L’idée d’un scientifique selon laquelle « les LLM sont un virus cognitif pour les humains » a connu une croissance inhabituelle malgré la petite taille du subreddit. Dans le fil #10 (r/Maxcactus_TrailGuide, 5 205 membres, 2 213 pt/180 commentaires, 2026-09-09, https://www.reddit.com/r/Maxcactus_TrailGuide/comments/1wbi2d7/), u/MF_D000M (58 pt) écrit : « Les LLM nous accélèrent vers l’aboutissement de l’idiocratie. » u/TurgorFervor compare cela à la religion, également décrite comme un virus.
  • Les utilisateurs professionnels expriment aussi des frustrations très concrètes concernant l’écriture avec les offres gratuites. Dans le fil #8 (r/WritingWithAI, 18 pt/35 commentaires, 2026-09-10, https://www.reddit.com/r/WritingWithAI/comments/1wcunsz/), l’auteur déplore que GPT Sol soit bon pour la recherche mais écrive de façon robotique, que les limites gratuites de Claude Sonnet soient trop strictes et que Gemini soit peu intelligent. u/whitemisandry (4 pt) indique utiliser Claude Opus 4.8, après lui avoir fourni de longues instructions système avant l’écriture.
  • À la question élémentaire « pourquoi les LLM deviennent-ils plus intelligents ? », l’explication par l’architecture globale est soutenue. Dans le fil #11 (r/NoStupidQuestions, 1 pt/9 commentaires, 2026-09-09, https://www.reddit.com/r/NoStupidQuestions/comments/1wbpr47/), u/Jolly-Rip5973 (2 pt) explique que les LLM seuls sont presque arrivés à un plafond, et que les progrès actuels viennent d’améliorations du système complet : harnais, appels d’outils et coopération entre plusieurs modèles.
Signaux
  • Tendance en hausse : méfiance et opposition envers les acteurs fermés, en particulier OpenAI. Plus que l’annonce d’un résultat digne d’un prix du millénaire, ce sont les soupçons de « vol d’idée » (#5, #7) et l’opposition à l’article anti-poids ouverts du WSJ (#12) qui concentrent l’attention de Reddit. Les poids ouverts sont défendus comme symbole de liberté d’expression et d’indépendance.
  • Tendance rejetée : les publications de « démissionnaires » alertant sur la sécurité de l’IA (#4, #9) obtiennent toutes deux un fort engagement, mais la majorité des commentaires écarte leurs accusations comme de la « publicité », des « relations publiques » ou quelque chose de « louche ». La lassitude et le cynisme envers le discours sur la sécurité sont forts.
  • Élément surprenant : un très petit subreddit de seulement 5 205 membres (#10) a enregistré 2 213 points, dépassant les scores de grands subreddits tels que r/singularity avec ses 3 970 329 membres. Il a probablement été rendu viral via r/all ou un mécanisme comparable, rompant aujourd’hui la corrélation entre taille de communauté et score.
  • Structure du conflit : face à la même actualité « Codex / prix du millénaire d’OpenAI », r/singularity (#5, #6) penche vers « OpenAI a raison, les sceptiques sont ridicules », tandis que r/SillyTavernAI (#7) penche vers « OpenAI a volé, il faut des LLM locaux » — une même nouvelle est donc interprétée de façon totalement opposée selon la communauté.
Limites
  • La recherche n’a utilisé qu’une seule requête, « Daily LLM News », sans noms de modèles ou d’entreprises spécifiques. Les douze fils collectés portent donc surtout sur des discussions, réactions et plaisanteries autour de nouvelles existantes, plutôt que sur des informations primaires telles que nouveaux modèles annoncés, baisses de prix ou benchmarks du jour. Aucun fil ne signalait directement une annonce de modèle ou un changement de prix d’API.
  • Les trois éléments issus de r/NoStupidQuestions (#1, #2, #11) sont des questions de débutants sur le fonctionnement général des LLM. Ils relèvent davantage de discussions permanentes que de l’actualité du jour ; hors leur date récente, ils offrent peu d’éléments spécifiques à cette journée.
  • Seuls six « Top comments » au maximum ont été fournis pour chaque fil, et la température de la suite des commentaires n’a donc pas pu être vérifiée. Par exemple, six commentaires sur 358 pour #1, et six sur 236 pour #12.
  • La période étudiée s’étend sur cinq jours, du 2026-09-06 au 2026-09-10, et ne se limite pas strictement à « aujourd’hui » (2026-09-12). La fenêtre de collecte du worker était peut-être plus large que celle prévue par le brief.

X

X — Peu de sujets liés aux LLM ; le cœur de l’actualité est le rapport d’Anthropic sur l’usage de Claude pour développer des armes

La page Explore de cette session était affichée comme issue d’un accès depuis la Croatie, comme l’indique la mention « Trending in Croatia ». Les dix principales tendances étaient « Yemen », « Saudi », « $song », « Charlie Kirk », « Britain », « Anthropic », « Apple », « Sony », « one ai os » et « Chelsea ». Il s’agit de tendances pour la Croatie, ou au moins pour le point de connexion de cette session, et non de tendances mondiales universelles. La collecte a consisté à rechercher ces dix termes ; les seuls sujets réellement liés aux LLM provenaient des publications trouvées via « Anthropic » et de publications liées au renseignement sur les menaces d’Anthropic repérées fortuitement avec « Yemen ».

Comptes

Les quarante comptes collectés n’ont contribué qu’avec une publication chacun, sans aucun compte ayant plusieurs publications. Parmi eux, les six comptes ayant publié sur un sujet lié aux LLM sont les suivants.

Compte Contenu publié
@tleilax___(Yet another commodity guy) Publication affirmant qu’un groupe basé au Yémen utilisait Claude Code pour développer des roquettes guidées, missiles balistiques et un projet de planeur hypersonique. 5 022 mentions J’aime
@IranTimes72(Ebrahim Zolfaghari) Publication indiquant que l’Iran a utilisé Claude AI pour surveiller des navires américains ; elle mentionne également qu’Anthropic a identifié un groupe basé au Yémen
@BrianRoemmele Longue publication raillant une personne ayant travaillé « six semaines » chez Anthropic et affirmant que « l’IA détruira l’humanité en dix ans »
@restitutorII(Restitutor Orientis) Présentation des trois scénarios économiques américains de 2030 figurant dans le rapport d’Anthropic, dont un scénario à +1,6 % de PIB
@walterkirn Courte publication ironique sur la même personne, affirmant que les médias généralistes l’ont élevée au rang du Dr Fauci
@claudecode84(Claude code研究ラボ、日本語アカウント) Présentation de l’ouverture complète par le dirigeant d’Anthropic de son propre environnement Claude Code. Environ 724 000 vues, le plus haut total parmi les publications liées aux LLM
Publications
  1. @tleilax___、2026-09-10(5 022 mentions J’aime, 359 repartages, 21 réponses, environ 264 000 vues, trouvé avec la recherche « Yemen »)

    "One Yemen-based group used multiple Claude Code instances while working on guided rockets, ballistic missiles and a hypersonic-glide project."
    Publication semblant citer le rapport de renseignement sur les menaces d’Anthropic. Elle affirme qu’un groupe basé au Yémen a utilisé plusieurs instances de Claude Code dans le cadre de travaux liés au développement d’armes ; c’est la publication liée aux LLM la plus diffusée.

  2. @IranTimes72、2026-09-11(238 mentions J’aime, 34 repartages, 8 réponses, environ 15 000 vues, trouvé avec la recherche « Yemen »)

    Iran used Claude AI to monitor U.S. warships in the Middle East and identify potential communications vulnerabilities. ... Anthropic also identified a Yemen-based [group]
    Cette publication évoque le même rapport Anthropic que le point 1. Elle affirme que l’Iran aurait combiné suivi de navires, images militaires et images satellites commerciales afin de les analyser avec Claude ; elle circule comme pendant de la première publication.

  3. @restitutorII、2026-09-10(458 mentions J’aime, 69 repartages, 41 réponses, environ 57 000 vues, trouvé avec la recherche « Anthropic »)

    Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI: 1- Modest scenario: AI has an impact comparable to the Internet. GDP +1.6%, few disruptions to employment. 2- Substantial scenario: AI can perform about...
    Présentation du rapport d’Anthropic sur les scénarios économiques, qui prévoit à trois niveaux l’impact de l’IA sur l’économie américaine de 2030. Outre les nouvelles d’abus militaires, l’analyse de l’impact économique d’Anthropic était aussi discutée le même jour.

  4. @claudecode84、2026-09-10(2 522 mentions J’aime, 263 repartages, 24 réponses, environ 724 000 vues, trouvé avec la recherche « Anthropic »)

    Anthropic最高責任者本人が自分の「Claude Code環境」を丸ごとオープンソース化しています
    Publication issue d’un compte japonais. En termes de vues, c’est la plus grande diffusion parmi les publications liées aux LLM. Elle affirme qu’un dirigeant d’Anthropic a rendu public l’ensemble de son environnement Claude Code, mais le texte ne permet pas de vérifier les détails ou un lien vers la source d’origine.

  5. @BrianRoemmele、2026-09-10(790 mentions J’aime, 187 repartages, 105 réponses, environ 99 000 vues, trouvé avec la recherche « Anthropic »)

    TEMU HARRY POTTER SAYS "AI WILL END ALL HUMAN LIFE IN 10 YEARS!" ... His SIX WEEKS at Anthropic...
    Publication raillant la déclaration d’une personne n’ayant passé que six semaines chez Anthropic, selon laquelle « l’IA détruira toute vie humaine en dix ans ». Avec 105 réponses et un fort engagement, elle rend visible le scepticisme et le rejet du discours sur la sécurité de l’IA.

  6. @walterkirn、2026-09-10(722 mentions J’aime, 91 repartages, 39 réponses, environ 28 000 vues, trouvé avec la recherche « Anthropic »)

    The mainstream media boosted this dude like he was, well, Dr Fauci or something. I implore you to see clearly how this works. And who works it.
    Publication semblant viser la même controverse que le point 5. Elle ne nomme personne, mais le contexte, la requête et la période concordent ; elle ironise sur la promotion de cette personne par les médias généralistes.

Signaux
  • Le sujet le plus discuté est l’usage militaire et de renseignement de Claude : le développement d’armes par un groupe basé au Yémen (1) et la surveillance de navires par l’Iran (2) semblent tous deux provenir du rapport de renseignement sur les menaces d’Anthropic. Ils ont été trouvés par hasard via la requête géopolitique « Yemen » et constituent le sujet LLM le plus diffusé de cette session.
  • Le rapport économique d’Anthropic (3) et l’ouverture de Claude Code (4) ont un ton favorable et descriptif, contrastant avec les nouvelles d’abus.
  • Les affirmations du type « l’IA détruira l’humanité en dix ans » suscitent surtout scepticisme et moquerie (5, 6). Le rejet de la mise en avant médiatique d’un ancien employé d’Anthropic, présent seulement six semaines, semble plus fort que le soutien à son propos.
  • Élément surprenant : aucune publication concernant les acteurs à poids ouverts — Llama, Qwen, DeepSeek ou Mistral — ne figurait dans cette collecte. Aucune publication concrète sur les benchmarks ou les changements de prix d’API n’a non plus été trouvée.
  • Parmi les quarante publications et dix requêtes collectées, seules six concernaient directement le brief LLM. Les autres portaient sur l’actualité générale du conflit yéménite et saoudien, les polémiques politiques autour du premier anniversaire de l’assassinat de Charlie Kirk, la diplomatie britannique et israélienne, les réactions à l’événement Apple, Sony et les jeux vidéo, ou des mèmes de football sur Chelsea ; elles n’avaient aucun lien avec les LLM.
Limites
  • Explore, la liste des tendances, était affichée selon la Croatie et ne représente pas les tendances mondiales. Puisqu’elle dépend du point de connexion de la session, sa composition aurait probablement été différente dans d’autres pays ou régions.
  • Le choix des requêtes n’était pas optimisé pour le brief LLM : les dix termes utilisés — « Yemen », « Saudi », « $song », « Charlie Kirk », « Britain », « Anthropic », « Apple », « Sony », « one ai os », « Chelsea » — étaient repris directement d’Explore, et « Anthropic » était le seul terme lié aux LLM. Aucune recherche n’a ciblé les activités d’autres entreprises telles qu’OpenAI, Google/Gemini, Meta AI, xAI/Grok ou Mistral ; la collecte ne couvre donc pas exhaustivement les acteurs fermés ni ceux à poids ouverts.
  • Le seuil de complétude de dix éléments n’est pas atteint : seuls six éléments liés aux LLM ont pu être rédigés sur quarante publications. Cette collecte ne comprend aucune publication sur des annonces de modèles, révisions tarifaires, benchmarks ou cas d’incident concrets.
  • La session a fonctionné normalement : aucune expiration de connexion ni échec de récupération de page n’a eu lieu. La lacune résulte du choix des requêtes, et non d’un problème de session.

YouTube

YouTube — Actualités LLM du jour (12 septembre 2026)

Chaînes
  • Anthropic(chaîne officielle)— a publié une vidéo d’annonce de Claude Fable 5.1.
  • ByteForward — chaîne de comparaisons et de vérifications entre modèles fermés et poids ouverts.
  • WorldofAI(@intheworldofai)— publie fréquemment des tests pratiques de nouveaux modèles et des récapitulatifs d’actualités IA.
  • AI WITH Rithesh — chaîne consacrée aux benchmarks et explications de prix des nouveaux modèles.
  • Prompt Engineering(@engineerprompt)— chaîne sur la conception de prompts et les explications de nouveaux modèles.
  • AI Coding Daily — chaîne de revues fondées sur des mesures de benchmarks de programmation.
  • RandomAI — chaîne d’analyses fondées sur des fuites et rumeurs.
  • TheAIGRID — chaîne d’explications rapides sur les annonces de nouveaux modèles.
  • AI時短ラボ — chaîne japonaise d’actualités IA rapides.

Les pages des chaînes étant rendues en JavaScript, il n’a pas été possible de vérifier directement le nombre d’abonnés ni d’obtenir des chiffres précis ; voir Limits pour plus de détails.

Vidéos
  1. Introducing Claude Fable 5.1 — Anthropic — 1er septembre 2026 — https://www.youtube.com/watch?v=ROF2Nv_KjOM
    Vidéo d’annonce officielle d’Anthropic. Elle présente Claude Fable 5.1 comme la dernière version de sa classe la plus performante et indique que son score Terminal-Bench-Science est passé de 24,7 à 52,6 entre Fable 5 et 5.1.

  2. GPT-6 Astra vs DeepSeek V4.1 Flash… Is It Even Close? — ByteForward — vers le 11 septembre 2026 (publiée un jour auparavant) — https://www.youtube.com/watch?v=YnFKMybL7gs
    Comparaison mesurée entre le GPT-6 Astra fermé et DeepSeek V4.1 Flash à poids ouverts. La vidéo cite un benchmark selon lequel V4.1 Flash atteint 98 % du score d’Astra sur une tâche de design pour 1,4 % de son coût.

  3. DeepSeek V4.1 Flash Is INSANELY GOOD! Fast, Cheap, Powerful! (Fully Tested) — WorldofAI — début septembre 2026 — https://www.youtube.com/watch?v=T2dnchLabZQ
    Test complet couvrant programmation, simulation 3D, fonctionnement d’agents et entrées image ; la vidéo salue une vitesse pouvant atteindre 427 tokens par seconde et un faible coût.

  4. GLM-5.3 Released: Everything You Need to Know About Z.ai's New Coding Model (Benchmarks, Price) — AI WITH Rithesh — mi-août 2026 — https://www.youtube.com/watch?v=4RFo47KJ4q4
    Explication des benchmarks et du prix du modèle à poids ouverts GLM-5.3 de Z.ai. La vidéo souligne que les performances ont été améliorées uniquement par l’entraînement en phase finale, tout en conservant le même modèle de base 743B.

  5. 【速報】GLM-5.3登場 コーディングとサイバー能力で最強クラス 期待のモデル!! — AI時短ラボ — mi-août 2026 — https://www.youtube.com/watch?v=Ca0PHSjrU8M
    Alerte rapide en japonais consacrée à GLM-5.3. Elle présente ses capacités en programmation et en tâches de cybersécurité comme étant « parmi les meilleures ».

  6. Gemini 3.8 Flash: The model no one expected! — Prompt Engineering — vers les 2–3 septembre 2026 — https://www.youtube.com/watch?v=UvrAYDgobSw
    Présente Gemini 3.8 Flash, lancé par Google le 2 septembre 2026, comme « le modèle que personne n’attendait », et affirme qu’il approche Claude Opus 5 dans l’offre gratuite.

  7. I Tested NEW Muse Spark 1.3 on Coding: Meta Joins Frontier LLMs? — AI Coding Daily — début septembre 2026 (publiée une semaine auparavant) — https://www.youtube.com/watch?v=lxljOqB1YUI
    Teste sur des tâches de programmation Muse Spark 1.3, un modèle de Meta destiné à devenir à poids ouverts, et examine si Meta a rattrapé le niveau frontière.

  8. OpenAI Astra Just Got Leaked and It's INSANE (Full Breakdown) — RandomAI — fin août 2026 (publiée deux semaines auparavant) — https://www.youtube.com/watch?v=2sh0_oV_r04
    Vidéo d’analyse réunissant des informations de fuite sur le prochain modèle Astra d’OpenAI. Il convient de noter qu’il s’agit de rumeurs antérieures à toute annonce officielle.

  9. DeepSeek V4.1 GA Soon, GPT-5.6 SOL Nerfed? HUGE Fable Update, US AI BAN Protests, & More! AI NEWS — WorldofAI — début septembre 2026 — https://www.youtube.com/watch?v=LgGJz528Boo
    Récapitulatif hebdomadaire d’actualités IA : perspective de sortie générale de DeepSeek V4.1, mise à jour de Fable, mouvements de protestation contre la régulation de l’IA aux États-Unis, etc.

  10. Sakana AI's New "Fugu Ultra" Beats Claude Fable 5 (Sakana Fugu) — TheAIGRID — fin juin 2026 — https://www.youtube.com/watch?v=FwA1bcpSGiM
    Présente la série de modèles orientés multi-agents « Fugu » de Sakana AI au Japon, notamment le premier Fugu Ultra, et examine l’affirmation selon laquelle il dépasserait Claude Fable 5. Aucune vidéo dédiée aux successeurs Fugu Ultra v2 / Fugu Max, sortis le 11 septembre, n’a encore été trouvée ; voir Limits.

Signaux
  • Camp fermé : Anthropic (Fable 5.1, 1/9), Google (Gemini 3.8 Flash, 2/9) et OpenAI (Astra, non annoncé et au stade des fuites) ont enchaîné les mouvements, et les vidéos de revue YouTube ont été publiées dans les jours suivant ces annonces.
  • Camp des poids ouverts : DeepSeek (V4.1 Flash), Z.ai (gamme GLM-5.3), Meta (Muse Spark 1.3) et Sakana AI (Fugu Max / Fugu Ultra v2) sont présentés sous l’angle « proche des modèles fermés à faible coût ». La comparaison coût-performance entre DeepSeek V4.1 Flash et Astra — 98 % du score pour 1,4 % du coût — est particulièrement souvent citée par les créateurs.
  • Une chaîne japonaise, AI時短ラボ, traite également rapidement de modèles chinois à poids ouverts tels que GLM-5.3 ; le décalage par rapport aux contenus anglophones semble limité à une ou deux semaines après l’annonce.
  • Fugu Max / Fugu Ultra v2 de Sakana AI, sortis le 11 septembre 2026, sont couverts par des sites d’actualités et des blogs, mais aucune vidéo YouTube explicative dédiée n’avait encore été trouvée au moment de cette enquête ; seules des vidéos sur le premier Fugu Ultra existent.
Limites
  • Les pages de résultats YouTube (youtube.com/results?...) et les pages vidéo (youtube.com/watch?...) étant rendues en JavaScript, WebFetch ne récupérait que le pied de page, et non le contenu principal, tel que les titres, noms de chaînes, nombres de vues ou dates de publication. Les informations ont donc été complétées à partir d’extraits de recherche web et de noembed.com, qui ne renvoie que le titre et le nom de la chaîne.
  • Pour cette raison, le nombre exact de vues et d’abonnés n’a pas pu être obtenu. Beaucoup de dates sont déduites d’expressions relatives telles que « il y a X jours/semaines », et la date exacte de publication de certaines vidéos reste inconnue.
  • Aucune vidéo YouTube dédiée au plus récent modèle Fugu Max / Fugu Ultra v2 de Sakana AI, sorti le 11 septembre, n’a encore été trouvée. Seuls des liens dans des articles de presse ou des playlists étaient disponibles, sans confirmation de l’existence d’une vidéo.
  • Le critère de dix éléments est atteint, mais l’un d’eux, Sakana Fugu Ultra, porte sur le modèle initial et non sur l’annonce elle-même de la dernière version v2.

Bluesky

Bluesky — Les annonces de modèles défilent comme des brèves automatisées ; la controverse Navier-Stokes et la déclaration de Sakana AI en faveur des poids ouverts ressortent

Note sur la méthode de collecte

L’API officielle de recherche plein texte de Bluesky (public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) et la recherche web (bsky.app/search) n’ont pas pu être utilisées depuis l’outil de récupération de cette session : la première renvoyait HTTP 403, et la seconde ne renvoyait qu’un contenu vide faute d’exécution JavaScript ; voir « Limits ». La collecte a donc consisté à identifier via recherche web des publications et comptes pertinents sur bsky.app, puis à lire, pour les identifiants trouvés, app.bsky.feed.getAuthorFeed, qui répondait bien avec un code 200, afin de vérifier le texte, la date, le nombre de mentions J’aime et le nombre de repartages.

Comptes
Compte Profil Lien
Ethan Mollick (@emollick.bsky.social) Professeur à Wharton ; publie presque quotidiennement de longs fils sur l’impact pratique des modèles de frontière https://bsky.app/profile/emollick.bsky.social
🚨 AI News | TestingCatalog (@testingcatalog.com) Compte d’actualités IA publiant les sorties de modèles et fonctionnalités sous forme de brèves d’une ligne https://bsky.app/profile/testingcatalog.com
Sakana AI (@sakanaai.bsky.social) Laboratoire de recherche basé à Tokyo, promouvant les poids ouverts et l’orchestration multi-agents https://bsky.app/profile/sakanaai.bsky.social
hardmaru / David Ha (@hardmaru.bsky.social) Cofondateur de Sakana AI, auteur du fil d’annonce officiel https://bsky.app/profile/hardmaru.bsky.social
Quantian (@quantian.bsky.social) Compte personnel dont la publication ironisant sur les soupçons Navier-Stokes liés à OpenAI a été très mentionnée https://bsky.app/profile/quantian.bsky.social
Zach Weinersmith (@zachweinersmith.bsky.social) Auteur de bandes dessinées scientifiques ; explique le déroulement de la controverse dans un fil https://bsky.app/profile/zachweinersmith.bsky.social
ardalis / Steve Smith (@ardalis.com) Développeur ; courte blague raillant Claude Opus https://bsky.app/profile/ardalis.com
Publications
  1. Sakana AI(@sakanaai.bsky.social)/2026-09-11T20:43Z/9 mentions J’aime, 1 repartage
    https://bsky.app/profile/sakanaai.bsky.social/post/3mvbglsna4k25

    「Fugu Max is live on Open Router! 🐡 Our learned multi-agent orchestration engine routes tasks across open-weights and specialized models for Pareto-frontier efficiency.」
    Annonce de la disponibilité de Fugu Max sur OpenRouter. Elle met en avant une stratégie d’orchestration associant modèles à poids ouverts et modèles spécialisés pour une allocation optimale.

  2. hardmaru(@hardmaru.bsky.social, cofondateur de Sakana AI)/2026-09-11T02:57Z/48 mentions J’aime, 5 repartages
    https://bsky.app/profile/hardmaru.bsky.social/post/3mv7kz2uplk2u

    「Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier. The AI industry has spent a decade optimizing along a single axis: build bigger, more expensive models.」
    Dans la suite du fil, il indique explicitement que « Fugu Ultra v2 does all of this without Fable 5, Fable 5.1, or GPT-6-Astra in its agent pool », présentant l’indépendance vis-à-vis des modèles de frontière d’Anthropic et OpenAI comme une force. C’est la prise de position la plus claire du jour en faveur du camp des poids ouverts.

  3. TestingCatalog(@testingcatalog.com)/2026-09-11T07:38Z/1 mention J’aime, 1 repartage
    https://bsky.app/profile/testingcatalog.com/post/3mva2p4ykhd2s

    「OpenAI launches ChatGPT for Financial Services」
    Brève annonçant que ChatGPT, intégrant GPT-6 Astra pour la recherche, la modélisation et la préparation de documents, est désormais proposé aux institutions financières.

  4. TestingCatalog(@testingcatalog.com)/2026-09-10T20:45Z/0 mention J’aime, 0 repartage
    https://bsky.app/profile/testingcatalog.com/post/3mv6waz3vpu2t

    「OpenAI launches GPT-Live-1 for full-duplex voice agents」
    Brève annonçant un nouveau modèle vocal full-duplex capable d’écouter et de parler simultanément.

  5. TestingCatalog(@testingcatalog.com)/2026-09-03T09:19Z/2 mentions J’aime, 0 repartage
    https://bsky.app/profile/testingcatalog.com/post/3mum4nfbitu2n

    「Google releases Gemini 3.8 Flash and Flash Cyber」
    Annonce simultanée de Gemini 3.8 Flash, destiné à la programmation, aux agents et au raisonnement multi-étapes, ainsi que de sa variante Flash Cyber, dédiée à la découverte et à la correction de vulnérabilités et limitée aux « trusted defenders ».

  6. TestingCatalog(@testingcatalog.com)/2026-09-02T00:00Z/2 mentions J’aime, 0 repartage
    https://bsky.app/profile/testingcatalog.com/post/3muimw7yugw2q

    「Anthropic launches Claude Fable 5.1 and Mythos 5.1」
    Annonce simultanée de Fable 5.1 pour le grand public et de Mythos 5.1, réservé aux « vetted defenders and scientists », avec réduction des coûts de cache et amélioration des performances.

  7. Ethan Mollick(@emollick.bsky.social)/2026-09-11T17:38Z/40 mentions J’aime, 6 repartages
    https://bsky.app/profile/emollick.bsky.social/post/3mvb4b7idf22v

    「Here's a automated forecasting system to estimate catastrophic risk from some major experts on forecasting. The models predicts the chance of an AI-generated mass catastrophe as 0.47% by 2030...」
    Présente un système automatisé estimant le risque de catastrophe majeure liée à l’IA à partir de méthodes de prévision d’experts. Dans une réponse, Mollick précise que ce chiffre suppose l’absence d’intervention politique.

  8. Ethan Mollick(@emollick.bsky.social)/2026-09-11T04:59Z/65 mentions J’aime, 2 repartages
    https://bsky.app/profile/emollick.bsky.social/post/3mv7rswik2s2v

    「Astra's turn: 'Make a game about Imminence...'」
    Démonstration d’un jeu créé par GPT-6 Astra. Elle est présentée en parallèle d’un jeu conçu la veille avec Claude Fable 5.1, dans une comparaison de leurs capacités créatives.

  9. Ethan Mollick(@emollick.bsky.social)/2026-09-10T17:32Z/117 mentions J’aime, 18 repartages
    https://bsky.app/profile/emollick.bsky.social/post/3mv6lhq5lyc2v

    「What you are seeing in math right now is a consequence of the [frontier models' capability jump]...」
    Partie d’un fil discutant de l’usage de l’IA par les mathématiciens et du sens de découvertes de preuves surhumaines par l’IA. Il se lit dans le même contexte que la controverse Navier-Stokes diffusée sur Reddit ; c’est la publication collectée ayant reçu le plus de mentions J’aime.

  10. Quantian(@quantian.bsky.social)/2026-09-08T07:13Z
    https://bsky.app/profile/quantian.bsky.social/post/3muyhwbcdys2x

    「Dancing very very VERY close to saying 'OpenAI stole our almost-complete proof of Navier-Stokes from internal access to our ChatGPT sessions because they were desperate to scoop Anthropic' which is absolutely 100% a believable thing OpenAI would do right now」
    Publication traitant du soupçon selon lequel OpenAI aurait « volé » les travaux dignes d’un prix du millénaire des mathématiciens Buckmaster, Alpoge et d’autres, depuis l’historique de sessions ChatGPT ; c’est le même sujet que le fil Reddit r/singularity publié le même jour.

  11. Zach Weinersmith(@zachweinersmith.bsky.social)/2026-09-08T09:45Z
    https://bsky.app/profile/zachweinersmith.bsky.social/post/3muyqfsvt6k2f

    「For anyone not following the drama, there's been apparently a big development in ai math, along with some accusations of very bad behavior by OpenAI. ... Buckmaster and Levent Alpoge made a big discovery on Navier-Stokes.」
    Début d’un fil explicatif résumant le déroulement de la controverse.

  12. ardalis / Steve Smith(@ardalis.com)/2026-09-10T12:35Z
    https://bsky.app/profile/ardalis.com/post/3mv62uanbkk2b

    「LOL #ai #claude opusfived.dev」
    Courte blague au contexte incertain, semblant railler quelque chose lié à Claude Opus. Au vu du domaine cible, « opusfived », il pourrait s’agir d’un mème concernant une nouvelle version d’Opus.

Signaux
  • Le discours sur les LLM sur Bluesky est dominé par l’analyse de praticiens et les comptes de brèves, et non par les controverses ou thèmes géopolitiques comme l’usage militaire de Claude vu sur X. Des comptes d’actualité tels que TestingCatalog énumèrent sobrement modèles et fonctionnalités, tandis que des praticiens comme Ethan Mollick discutent de l’expérience d’usage et de l’impact social : une structure à deux niveaux.
  • Sakana AI formule aujourd’hui la déclaration de position la plus claire du camp des poids ouverts. hardmaru, cofondateur de Sakana AI, affirme explicitement que Fugu Ultra v2 ne dépend ni de Fable 5, ni de Fable 5.1, ni de GPT-6-Astra, et met en avant l’orchestration multi-agents pour éviter l’enfermement dans les modèles fermés de frontière. C’est un exemple concret de l’opposition fermé / poids ouverts qui n’apparaissait pas dans les collectes X et Reddit.
  • Les soupçons Navier-Stokes / OpenAI sont évoqués à la fois sur Bluesky et Reddit autour du 2026-09-08. Des voix situées à l’intersection des mathématiques et de l’IA, telles que Quantian et Zach Weinersmith, relaient le même sujet indépendamment de la plateforme ; c’est le thème le mieux corroboré entre plateformes.
  • L’ampleur de l’engagement est plus d’un ordre de grandeur inférieure à celle de X. Le plus haut nombre de mentions J’aime observé ici est 117, pour Ethan Mollick (#9), contre plusieurs milliers sur X. Pour ce sujet, Bluesky semble être davantage un canal destiné aux techniciens et observateurs, privilégiant la qualité plutôt que le volume.
Limites
  • L’API officielle de recherche (app.bsky.feed.searchPosts) a constamment renvoyé HTTP 403 depuis l’outil de récupération de cette session, ce qui a empêché les recherches plein texte par mot-clé. app.bsky.actor.getProfile et app.bsky.feed.getAuthorFeed répondaient avec 200 sur le même domaine ; seul l’endpoint de recherche semble donc bloqué. La recherche web bsky.app/search et les pages embarquées ne renvoyaient aussi que du HTML antérieur à l’exécution JavaScript, sans liste lisible de publications.
  • Du fait de ces contraintes, la collecte repose sur une méthode indirecte : trouver via recherche web des liens bsky.app pertinents, puis remonter le fil des comptes identifiés. Il ne s’agit pas d’une couverture de toute la plateforme par mots-clés ; l’échantillon est biaisé vers les comptes découverts ainsi, comme Mollick, TestingCatalog et Sakana AI. Les comptes Bluesky parlant régulièrement de DeepSeek, Qwen, Llama, Mistral et d’autres modèles chinois ou de Meta n’ont pas été trouvés avec cette méthode.
  • Aucune publication datée d’« aujourd’hui », 2026-09-12, n’a été trouvée. La plus récente date du 2026-09-11, peut-être en raison d’un retard d’indexation des moteurs de recherche.
  • Douze publications ont été identifiées, avec mentions J’aime et repartages vérifiés pour dix d’entre elles ; pour les deux restantes, seul le texte a été obtenu via oEmbed et les compteurs n’ont pas pu être confirmés. Le seuil de dix éléments datés et accompagnés d’un lien est atteint, mais l’échantillon reste limité.

Lemmy

Lemmy — Le sujet le plus discuté aujourd’hui

Communautés
  • !«メールアドレス»(87 981 abonnés)— principal flux d’actualités technologiques généralistes. Aujourd’hui, le rapport de renseignement sur les menaces d’Anthropic y est l’un des sujets les mieux notés.
  • !«メールアドレス»(5 132 abonnés, 7 actifs quotidiens)— centre des discussions sur l’usage réel et les benchmarks des modèles à poids ouverts. La communauté est fédérée sur de nombreuses instances, dont lemmy.world, piefed.zip, lemmus.org, lemmy.ml, aussie.zone, lemmy.dbzer0.com et lemmy.zip.
  • !«メールアドレス»(4 820 abonnés)— communauté Free Open-Source AI, proposant des classements de LLM et des liens destinés aux développeurs.
  • !«メールアドレス»(51 abonnés, dont 1 local)— communauté bot qui republie automatiquement via RSS Reddit, notamment r/ArtificialIntelligence et r/ClaudeCode. Les scores sont presque toujours de 0 à 1, sans discussion propre à Lemmy.
  • !ukraine@(réseau lemmy.world) — communauté géopolitique dans laquelle des articles de sécurité sur les abus d’IA ont été publiés de manière croisée et sont devenus discutés.
Publications
  1. Users in Houthi-held Yemen tried to develop advanced weapons with AI, Anthropic says — !«メールアドレス», score 12, 2026-09-11. Publication croisée d’un article Yahoo Finance citant le rapport d’Anthropic. https://ca.finance.yahoo.com/news/users-houthi-held-yemen-tried-184240958.html
  2. Russia-linked hackers used Claude agents to target Ukraine and steal military drone technology, Anthropic report finds — !ukraine, score 15, 2026-09-11. Article de The Insider sur le rapport de menaces d’Anthropic. C’est l’un des meilleurs scores du jour parmi les contenus IA sur Lemmy. https://theins.press/en/news/297072
  3. Trump dismisses AI extinction risks as more than a dozen OpenAI, Anthropic insiders call for a slowdown — !ai_reddit (miroir d’un article CNBC), score 1, 2026-09-11. https://www.cnbc.com/amp/2026/09/11/trump-ai-extinction-risks.html
  4. Hawley Probe Into AI Breakout Called an Important Step, But 'Only a Start' — !pravda_news, score 1, 2026-09-11. Article de CommonDreams sur une enquête parlementaire concernant OpenAI. https://www.commondreams.org/news/josh-hawley-openai-investigation
  5. NanoFlare Fits Qwen 3.8 27B On An 8GB GPU — !«メールアドレス», score 2, 2026-09-09. Retour d’expérience sur la quantification et la réduction de l’utilisation mémoire. https://lemmy.world/post/51731499
  6. Benchmarking Qwen3.8 27B quantizations: 4-bit holds up, 1-bit collapses — !localllama, score 21 et 10 commentaires, 2026-09-08. Résultat de test indiquant que la quantification 4 bits est exploitable, alors que le 1 bit fait s’effondrer les performances. https://piefed.zip/c/«メールアドレス»/p/1805947
  7. K2 Horizon: Open-Source Model Family(d’IFM)— !localllama, score 65 et 24 commentaires (!fosai l’a aussi publié, score 8), 2026-09-04. Publication très appréciée d’une famille de six modèles, de 0,9B à 375B, sous Apache 2.0, avec points de contrôle intermédiaires et recette de construction des données d’entraînement. https://ifm.ai/blog/k2
  8. Qwen3.8-Flash-Next sounds like Claude and I hate it — !«メールアドレス», score 31 (4 votes négatifs) et 9 commentaires, 2026-08-30 (il y a 12 jours). Mécontentement face au nouveau modèle d’Alibaba, qui semble imiter le ton « cérémoniel et verbeux » de Claude. Les commentaires évoquent une répartition des usages : « Qwen pour le code, Gemma pour le reste ». https://lemmy.dbzer0.com/post/74741490
  9. Release v0.4.0 · ggml-org/llama.cpp — !«メールアドレス», score 28, 2026-09-04. Annonce de mise à jour du moteur d’inférence locale. https://lemmus.org/post/25155737
  10. zai-org/GLM-5.3 · Hugging Face (753b-a40b?) — !«メールアドレス», score 19, 2026-08-28. Discussion sur les poids de GLM-5.3. https://lemmus.org/post/24977768
  11. "All LLMs should be GPL" — !«メールアドレス», score 1 et 0 commentaire, 2026-09-11 (il y a 8 heures, repost de u/TrekCZ). L’affirmation soutient que les LLM entraînés sur du code GPL devraient être publiés sous GPL, mais ne reçoit aucune réaction sur Lemmy. https://lemmy.durstig.online/post/59438
  12. Market size of Open-Source models — !«メールアドレス», score 1 et 0 commentaire, 2026-09-11 (il y a 5 heures). Estimation, à partir des données HuggingFace, selon laquelle l’open source ne représente que 3,2 % des dépenses annuelles d’entraînement en IA — environ 250 millions de dollars pour les LLM textuels et les modèles de diffusion, plus 56 millions pour les adaptateurs. Évoque aussi un projet de place de marché GPU P2P. https://lemmy.durstig.online/post/59444 (lié : https://lemmy.durstig.online/post/59487)
Signaux
  • Les sujets sur les acteurs fermés sont dominés par la sécurité nationale et les abus : les publications IA les mieux notées aujourd’hui sur Lemmy ne portent pas sur de nouveaux modèles, mais sur le rapport de renseignement sur les menaces d’Anthropic, notamment les tentatives de développement d’armes par les Houthis et l’usage abusif de Claude par des hackers liés à la Russie. Les publications croisées dans des communautés généralistes comme !technology et !ukraine augmentent les scores.
  • LocalLLaMA est le foyer du camp des poids ouverts : les retours pratiques se poursuivent sur la quantification et l’usage à faible mémoire de Qwen3.8, Kimi K2/K3, GLM-5.3 et K2 Horizon d’IFM, de 0,9B à 375B sous Apache 2.0. Les sorties généreuses comme K2 Horizon, qui exposent jusqu’aux points de contrôle intermédiaires et aux recettes de données, reçoivent des scores particulièrement élevés (65).
  • Rejet de la « claudification » de Qwen : les habitants de LocalLLaMA manifestent une nette insatisfaction face à Qwen3.8-Flash-Next qui, malgré de bons benchmarks, commencerait à imiter le ton verbeux de Claude. Il est intéressant que le style de parole des modèles fermés devienne lui-même matière à plaisanterie et critique dans le milieu des poids ouverts.
  • Les discussions propres à Lemmy sont faibles : !ai_reddit sur durstig.online, avec 51 abonnés, est un bot de republication RSS de Reddit ; ses scores sont presque toujours de 0 ou 1 et les commentaires sont généralement absents. Les annonces majeures de modèles de la semaine — GPT-6 Astra, Claude Fable/Mythos 5.1, Gemini 3.8 Flash — ne semblent pratiquement pas faire l’objet de discussions primaires sur Lemmy.
Limites
  • Il n’a pas été possible de réunir strictement les dix publications les plus récentes dans un ordre chronologique unique. Douze éléments ont été sélectionnés à travers !localllama, pour les poids ouverts, et des republications croisées d’actualité généraliste, pour les acteurs fermés. L’API de recherche Lemmy ne renvoie que des résultats fragmentaires par mot-clé et ne permet pas d’obtenir un unique « top 10 Lemmy du jour ».
  • Presque aucune publication datée du jour même, 2026-09-12, n’a été trouvée. Les éléments les plus récents datent surtout du 2026-09-11, certains allant du 2026-09-04 au 08. Lemmy se met moins fréquemment à jour que les autres réseaux, vraisemblablement en raison de sa taille plus réduite.
  • Deux publications sur piefed.zip, le fil original K2 Horizon et un fil Kimi K3, renvoyaient HTTP 403 lors d’un accès direct ; le texte et les détails des commentaires n’ont pas pu être récupérés, et les informations des miroirs lemmy.world ont servi de remplacement.
  • Des recherches incluant lemmy.ml et lemm.ee ont été tentées, mais les résultats additionnels significatifs étaient déjà presque entièrement couverts par la recherche API de lemmy.world et les accès directs aux instances.
  • Aucune publication mentionnant directement les grandes annonces de modèles de la semaine, notamment GPT-6 Astra, Claude Fable/Mythos 5.1 et Gemini 3.8 Flash, n’a été trouvée sur Lemmy ; elles semblent principalement discutées sur d’autres réseaux.

Actions recommandées

  • Consulter le rapport de renseignement sur les menaces d’Anthropic dans sa version originale et vérifier les sources primaires des affirmations sur l’armement et la surveillance.
  • Remplacer, pour X, les requêtes dépendantes des tendances locales par une liste fixe mentionnant explicitement OpenAI, Google, Meta, xAI, Mistral et d’autres entreprises.
  • Pour Reddit, associer à « Daily LLM News » des requêtes incluant des noms de modèles et d’entreprises, afin de détecter les annonces de nouveaux modèles elles-mêmes.
  • Suivre en continu, lors des prochaines collectes, l’évolution de Sakana AI Fugu Max/Ultra v2 et d’OpenAI Astra.
  • Vérifier lors de la prochaine collecte si le problème HTTP 403 de l’API searchPosts de Bluesky est résolu ; si oui, revenir à la recherche directe.
  • Vérifier en priorité lors de la prochaine collecte si OpenAI a publié une déclaration officielle concernant la controverse Navier–Stokes.

Note sur la qualité des données

Les tendances de recherche X n’étaient pas optimisées pour le brief LLM : seuls six des dix éléments du critère de complétude étaient liés aux LLM. Reddit et Lemmy atteignent le nombre d’éléments demandé, mais la période étudiée est plus large et dispersée que « aujourd’hui ». Bluesky est biaisé par une collecte indirecte, car l’API de recherche officielle était bloquée par HTTP 403.