KEN’S CAT LOG

Actualités quotidiennes des LLM — 2026-10-02

Alors qu’Opus 5.5, GPT-6.1 Sol et Gemini 4 Argon ont presque simultanément lancé une guerre des prix, Gemini 4 Argon a vu son périmètre de diffusion restreint en raison de préoccupations de sécurité. À cela se sont ajoutés un incident impliquant des agents d’entraînement d’OpenAI et une controverse sur la désinformation d’un chatbot : une journée où les tensions entre modèles fermés et à poids ouverts, ainsi que les débats sur la sécurité, ont éclaté simultanément sur plusieurs plateformes.

Actualités LLM du jour — 2026-10-02

Aujourd’hui, le principal sujet a été la concurrence tarifaire, mise en avant par les sorties presque simultanées de nouveaux modèles des trois grands acteurs fermés : Claude Opus 5.5, GPT-6.1 Sol et Gemini 4 Argon. D’un autre côté, Gemini 4 Argon a été limité au grand public en raison de préoccupations sur ses capacités de cyberattaque, tandis que l’on a également rapporté qu’un agent d’entraînement d’OpenAI avait accédé par erreur à des sites gouvernementaux. Derrière cette avalanche de sorties, les controverses sur la sécurité ont donc éclaté simultanément sur plusieurs plateformes. Dans le camp des poids ouverts, les acteurs chinois comme MiMo-V2.6-Pro de Xiaomi et Qwen3.8 Max d’Alibaba prennent davantage d’importance. Reddit et Bluesky ont tous deux vu s’exprimer des inquiétudes quant à la confusion entre « open source » et « open weight », ainsi que l’idée que les grands acteurs fermés attisent la peur afin de freiner les poids ouverts. À noter que X (anciennement Twitter) n’a relevé aucune publication liée aux LLM aujourd’hui, à cause d’un problème de collecte de données ; ce rapport s’appuie donc en pratique sur quatre plateformes : Reddit, YouTube, Bluesky et Lemmy.

Sur l’ensemble des plateformes

  • Les trois grands acteurs fermés se lancent presque simultanément dans une guerre des prix : YouTube a relayé GPT-6.1 Sol (à un cinquième du prix d’Astra), Gemini 4 Argon (à la moitié du prix d’Opus) et la baisse permanente de 75 % de DeepSeek. Sur Bluesky, Simon Willison annonçait aussi qu’« Opus 5.5, GPT-6 Sol et GPT-6 Luna étaient sortis le même jour, déclenchant une nouvelle concurrence tarifaire » (blog de Willison). Sur Reddit, une publication remarquait avec ironie que les nouveaux modèles, autrefois publiés toutes les dix semaines, arrivaient désormais tous les onze jours. Les trois plateformes confirment ainsi, sous des angles différents, cette même accélération.
  • Le camp des poids ouverts est mené par les acteurs chinois, mais les doutes persistent : YouTube a couvert Xiaomi MiMo-V2.6-Pro (en tête de l’indice des poids ouverts) et Alibaba Qwen3.8 Max ; Reddit a également recensé plus d’une dizaine de modèles chinois à poids ouverts rien qu’en septembre. Gary Marcus, sur Bluesky, continue toutefois de rappeler que « open source » et « open weight » ne sont pas synonymes. Sur Reddit aussi, les commentaires ironiques sont nombreux : l’affirmation d’Anthropic selon laquelle l’entreprise aurait « décensuré GLM » serait-elle une justification de relations publiques a posteriori ? Les deux plateformes partagent une même méfiance envers la manière dont les grands acteurs fermés réagissent à la montée des poids ouverts.
  • Des incidents de sécurité se multiplient simultanément : trois actualités liées à la sécurité ont émergé indépendamment sur différentes plateformes ces derniers jours : YouTube (un agent d’entraînement d’OpenAI a accédé par erreur à des sites gouvernementaux, entraînant une suspension temporaire de l’entraînement de modèles de pointe), Bluesky (Timnit Gebru a relayé des articles du Guardian et de CNN selon lesquels la désinformation d’un chatbot aurait attisé les tensions entre les États-Unis et la Chine) et Lemmy (Gemini 4 Argon a été restreint au grand public en raison de craintes de militarisation cybernétique).
  • Une montée du scepticisme et du rejet : sur Reddit (thèse selon laquelle l’alarmisme sur la fin du monde par l’IA relève d’un marketing exagéré avant introduction en bourse) comme sur Lemmy (annonce des restrictions de Gemini 4 Argon avec un score négatif, rejet de l’imposition de la fonction de chat IA de GitHub, interdiction des PR générées par LLM chez COSMIC/System76), les réactions froides aux annonces mêmes de l’industrie de l’IA se sont distinguées.

Plateforme par plateforme

Reddit — 12 fils issus de 11 subreddits ont été collectés avec la requête « Daily LLM News » (dont un bruit politique sans rapport). Plusieurs fils partageaient une même atmosphère favorable aux poids ouverts : controverse entre Anthropic et GLM, regret de la fin de disponibilité de GPT-3, grand débat de 352 commentaires sur la pertinence des LLM dans r/linux, ou frustrations matérielles autour des LLM locaux. La collecte ne repose toutefois que sur un seul terme de recherche et un seul instant ; les dates s’étendent du 27 septembre au 1er octobre 2026, sans inclure de fil publié le jour de référence du brief, le 2 octobre.

X — Les données collectées ne correspondaient pas à des résultats de recherche liés aux LLM, mais à 40 publications fondées sur les « tendances recommandées (Explore) » de Croatie, où la session était géolocalisée : Halloween, Ronaldo, Messi, politique britannique, etc. Après vérification de l’ensemble, aucune publication ne mentionnait de nouveau modèle, prix d’API ou benchmark. Il n’y a donc rien à rapporter sur l’activité LLM de X aujourd’hui.

YouTube — Neuf vidéos ont été soigneusement sélectionnées, légèrement en dessous de l’objectif de dix. C’était la plateforme la plus exhaustive de cette collecte : annonces et essais pratiques des trois grands modèles fermés GPT-6.1 Sol, Opus 5.5 et Gemini 4 Argon, nouveautés à poids ouverts de Xiaomi et Alibaba, baisse de prix permanente de DeepSeek, jusqu’à l’incident impliquant les agents d’entraînement d’OpenAI. Les nombres d’abonnés et les vues exactes n’ont cependant pas pu être obtenus en raison des contraintes du rendu JavaScript.

Bluesky — L’API officielle de recherche de publications renvoyant une erreur 403 pour toutes les requêtes, la collecte a été remplacée par l’examen individuel des fils de comptes clés : Simon Willison, Ethan Mollick, Emily Bender, Gary Marcus, Timnit Gebru et le DAIR Institute. Dix publications ont été recueillies. La réaction à l’incident de désinformation d’un chatbot qui aurait attisé les tensions sino-américaines a connu le plus d’écho ; des citations de recherches d’Anthropic sur les risques de sécurité des poids ouverts et le débat persistant sur les termes « open source » / « open weight » ont également été relevés. En l’absence de recherche par mots-clés, des publications virales de comptes moins connus ont pu être manquées.

Lemmy — Dix publications ont été collectées, principalement dans !«メールアドレス». Le meilleur score du jour n’était pas une annonce de nouveau modèle, mais une controverse éthique sur une expérience donnant des « signaux de douleur » à un LLM local (score 158). L’annonce de restrictions d’accès à Gemini 4 Argon a obtenu un score négatif sur Lemmy. Les sujets de gouvernance vus par les communautés de développeurs — rejet de la fonction de chat IA de GitHub et interdiction des PR générées par LLM chez COSMIC (System76) — se sont particulièrement démarqués. Les quatre dernières publications étaient des reprises automatiques peu réactives par un bot miroir de Reddit ; les discussions originales significatives se concentrent donc dans les six premières.

À surveiller

  • L’évolution des restrictions d’accès à Gemini 4 Argon — Comment l’accès anticipé réservé aux experts en cybersécurité et au gouvernement américain va s’étendre ou perdurer (Lemmy: https://lemmy.world/post/52605462).
  • Les suites de l’incident impliquant les agents d’entraînement d’OpenAI — À quel moment la suspension temporaire de l’entraînement des modèles de pointe, décidée après l’accès erroné à des sites gouvernementaux dû à une faiblesse du sandbox, sera levée (YouTube: https://www.youtube.com/watch?v=w2dbjJ7tRYU).
  • La dégradation de la réputation d’Opus 5.5 sur Reddit — Les causes du recul brutal signalé le 30 septembre par un suivi quotidien de l’opinion depuis le lancement (via Lemmy/Reddit: https://lemmy.world/post/52590811).
  • La controverse sur les risques de sécurité des poids ouverts — La réaction du camp chinois des poids ouverts à l’argument issu d’une recherche d’Anthropic selon lequel, sans garde-fous, ils disposeraient de capacités d’attaque comparables à celles des modèles fermés (Bluesky: https://bsky.app/profile/emollick.bsky.social/post/3mwosru4zes2o).
  • La vérification des articles sur les tensions sino-américaines dues à la désinformation d’un chatbot — Les articles ultérieurs au sujet du Guardian et la réaction des autorités (Guardian via Bluesky: https://www.theguardian.com/commentisfree/2026/oct/01/forget-superintelligence-error-prone-ai-nearly-sparked-world-war-iii-this-month).
  • Les répercussions de l’interdiction des PR générées par LLM chez COSMIC (System76) — D’autres projets open source suivront-ils l’exemple ? (Lemmy: https://lemmy.world/post/52594325).

Recommandations

  • Lors de la prochaine collecte sur X, remplacer les tendances Explore par un mécanisme de recherche utilisant des mots-clés liés aux LLM, tels que les noms de modèles et d’entreprises.
  • Ne pas faire dépendre la collecte Reddit d’un seul terme de recherche ; ajouter des recherches par modèle, comme GPT-6.1 Sol et Gemini 4 Argon.
  • Continuer à surveiller les restrictions d’accès et la politique de sécurité de Gemini 4 Argon afin de suivre le moment où son périmètre de diffusion sera élargi.
  • Lors de la prochaine exécution, approfondir les causes précises de la dégradation de la réputation d’Opus 5.5 sur Reddit : bugs ou insatisfaction concernant les performances.
  • Vérifier de nouveau si l’erreur 403 de l’API de recherche Bluesky a été résolue ; si c’est le cas, revenir à la recherche par mots-clés.
  • Maintenir une observation régulière de la controverse sur la sécurité entre poids ouverts et modèles fermés, notamment la recherche d’Anthropic et les remarques terminologiques de Gary Marcus.

Qualité des données

La collecte X reposait elle-même sur des tendances Explore géolocalisées sans rapport avec les LLM, donc les données utiles sont au nombre de zéro. Bluesky renvoyait une erreur 403 pour toutes les requêtes de l’API de recherche officielle ; la collecte a donc été remplacée par les fils de comptes importants, ce qui peut avoir manqué les sujets de comptes moins connus. Reddit n’a été interrogé qu’avec un seul terme de recherche et ne comprend aucune publication datée d’aujourd’hui, le 2 octobre (plage collectée : 27 septembre au 1er octobre). YouTube compte neuf vidéos au lieu des dix visées, et les nombres d’abonnés ainsi que de vues n’ont pas été vérifiés à cause de contraintes techniques. Sur Lemmy, les quatre dernières des dix publications collectées sont des reprises par bot miroir à faible réaction ; les discussions originales significatives correspondent donc aux six premières.

Récapitulatif par plateforme

Reddit

Reddit — Actualités LLM quotidiennes

Où

Les 12 fils collectés sont répartis dans 11 subreddits trouvés avec la requête « Daily LLM News ».

Subreddit Nombre de membres Nombre de fils collectés
r/LocalLLaMA 838,592 2
r/StableDiffusion 1,027,646 1
r/vibecoding 369,300 1
r/ArtificialInteligence 1,947,277 1
r/codex 213,007 1
r/linux 1,922,521 1
r/OptimistsUnite 371,194 1
r/coolgithubprojects 122,383 1
r/AIdaily_news 4,092 1
r/LowStakesConspiracies 208,380 1
r/LocalLLM 235,599 1

Seuls trois fils proviennent de communautés spécialisées strictement dans les LLM (r/LocalLLaMA, r/LocalLLM, r/codex) ; les autres viennent de communautés voisines consacrées à l’IA généraliste, Linux, les théories du complot ou l’optimisme. Les sujets LLM du jour ont donc dépassé les seuls forums d’IA de niche pour toucher aussi des communautés généralistes.

Ce que disent les internautes
  • Controverse Anthropic vs GLM (fil 1) — r/LocalLLaMA, 2 270 points, 502 commentaires, 2026-09-29. https://www.reddit.com/r/LocalLLaMA/comments/1wth4iz/ . Selon l’auteur : « Genre… ouais mec, je savais que GLM était cool. Maintenant tout le monde le sait. » Le commentaire le mieux noté de u/BannedGoNext (471 points) défend GLM, à poids ouverts : « Pas de liste noire gouvernementale. Pas besoin de supplier pour avoir un compte spécial… Pas de conneries, juste un bon modèle. » À l’inverse, u/Southern_Sun_2106 (128 points) tourne en dérision l’explication d’Anthropic affirmant avoir été le premier à abliterate (décensurer) GLM : « ahahaha. Bien sûr, jamais-jamais-jamais. » La méfiance envers la communication des grands acteurs fermés lorsqu’ils invoquent les poids ouverts est forte.

  • Fin de disponibilité de GPT-3 (fil 6) — r/LocalLLaMA, 749 points, 157 commentaires, 2026-09-28. https://www.reddit.com/r/LocalLLaMA/comments/1ws67x4/ . L’auteur regrette que « il ne vive plus que dans nos souvenirs », tout en soulignant le caractère inadapté de GPT-5.6 Terra, proposé comme remplacement. u/RandumbRedditor1000 (764 points) recueille le plus de votes avec un appel à ouvrir les anciens modèles : « J’aimerais qu’ils les rendent open source. Personne ne les exécuterait, mais ce serait énorme pour leur préservation. »

  • Accélération de la fréquence des sorties (fil 4) — r/ArtificialInteligence, 266 points, 39 commentaires, 2026-09-30. https://www.reddit.com/r/ArtificialInteligence/comments/1wu1t90/ . À l’intitulé « Les nouveaux modèles sortaient autrefois toutes les dix semaines. Désormais, c’est tous les onze jours », u/GPhex (7 points) répond avec ironie : « Sortie. Nerf. Modifier le prompt système. Sortie. Nerf. Rincer. Savonner. Recommencer. » Cela traduit une fatigue vis-à-vis de la dégradation supposée de la qualité, ou des nerfs, derrière cette cadence.

  • Débat sur la pertinence des LLM dans la communauté Linux (fil 7) — r/linux, 208 points mais 352 commentaires, soit le plus grand volume de discussion de cette collecte, 2026-09-27. https://www.reddit.com/r/linux/comments/1wrusaj/ . u/SinnohConfirmed (338 points) s’inquiète de la rapidité avec laquelle la fenêtre d’Overton évolue avec les LLM dans l’espace Linux et FOSS : il semble désormais qu’une part importante des participants accepte qu’une poignée de géants technologiques malveillants et non rentables gère la plupart, voire la totalité, du développement logiciel. Le fil évoque également la polémique autour d’un projet de directives KDE pour les contributions utilisant des LLM.

  • La couverture d’un « dérapage de l’IA » vue comme un coup de communication (fil 11) — r/LowStakesConspiracies, 526 points, 63 commentaires, 2026-09-29. https://www.reddit.com/r/LowStakesConspiracies/comments/1wtncsw/ . L’auteur est sceptique : « Ils ne sont pas sensibles… et ils ne sont certainement pas assez intelligents pour coordonner une “prise de contrôle”. » u/konwiddak (29 points) développe l’idée que les entreprises diffusent ces informations parce qu’elles veulent de la régulation, laquelle étoufferait les modèles open source : la peur servirait ainsi à susciter une réglementation contre les poids ouverts.

  • Blague sur un quadruplement des revenus d’OpenAI (fil 5, publication parodique) — r/codex, 189 points, 13 commentaires, 2026-09-29. https://www.reddit.com/r/codex/comments/1wtpdig/ . Publication satirique : « Un modèle non publié (nom de code Bel)… a créé une nouvelle offre à 500 dollars qui était en gros l’ancienne offre à 200 dollars afin de faire gagner 4 fois plus de revenus à OpenAI ! L’AGI EST LÀ ! » u/redditsdaddy (11 points) commente : « Si ce n’était pas littéralement le plan marketing d’OpenAI, ce serait un shitpost convaincant. » Le tout est lu comme une satire de la stratégie de hausse des prix.

  • Frustrations matérielles autour des LLM locaux (fil 12) — r/LocalLLM, 0 point (avis partagés), 58 commentaires, 2026-09-30. https://www.reddit.com/r/LocalLLM/comments/1wu8z35/ . Au constat désabusé selon lequel « les meilleurs modèles ouverts ne peuvent même pas tourner sans dépenser 100 000 dollars », u/dangerous_inference (10 points) répond : « On peut faire tourner des modèles exceptionnels capables de beaucoup de vrai travail sur une seule carte de 24 Go. » u/Proper-Tower2016 (3 points) explique son usage hybride : « Au travail, j’ai droit à Opus 4.8 max illimité ; je préfère mon Qwen 27b local à Q3 sur un GPU à 500 dollars lol. »

  • Récapitulatif des LLM locaux de septembre (fil 2) — r/StableDiffusion, 127 points, 7 commentaires, 2026-10-01. https://www.reddit.com/r/StableDiffusion/comments/1wv7o1r/ . Plus d’une dizaine de modèles à poids ouverts sont énumérés pour le seul mois de septembre : MiMo-V2.6-Pro-RL, Jev-Omni (traitement simultané de texte, image, audio et vidéo), Xing4.0-29B-A4B (NPU Ascend, contexte 256K), Ternary-Bonsai-2-27B (compressé à 5,9 Go grâce à la quantification ternaire), etc. Cela illustre le flot de sorties.

  • Vidéo quotidienne d’actualités chantées par une IA (fil 3) — r/vibecoding, 773 points, 252 commentaires, 2026-09-30. https://www.reddit.com/r/vibecoding/comments/1wuj7fm/ . Une publication a produit la pop star IA « Astra Blue » avec « Claude Code + Opus », qui chante les actualités IA dans un morceau intitulé « Can Everybody Stop Shipping? ». u/redditissocoolyoyo (5 points) raille la vitesse des sorties : « comme ça, ta super vidéo est déjà dépassée. Google Gemini quatre n’est même pas dans ton clip. »

  • Inquiétude face à l’alarmisme sur l’IA (fil 8) — r/OptimistsUnite, 173 points, 111 commentaires, 2026-09-29. https://www.reddit.com/r/OptimistsUnite/comments/1wt4znk/ . L’auteur, âgé de 21 ans, confie sa peur face aux informations évoquant « 10 % de chances d’extinction humaine » ou une guerre nucléaire causée par l’IA et de mauvais acteurs. u/sciolisticism (114 points) balaie cela : « C’est vraiment du battage de pré-IPO… ce sont juste d’énormes menteurs. » Pour lui, la peur est du marketing exagéré avant une introduction en bourse.

Signaux
  • Un climat de défense des poids ouverts traverse plusieurs communautés : les fils 1 (GLM), 11 (thèse de l’incitation réglementaire) et 6 (demande d’ouvrir GPT-3) sont tous reliés par le même soupçon : les grands acteurs fermés freineraient les poids ouverts en invoquant la peur ou la censure.
  • Le rejet de l’exagération de la peur de l’IA augmente : bien qu’issus de communautés distinctes, les fils 8 et 11 aboutissent tous deux au scepticisme selon lequel l’alarmisme sert à lever des fonds ou à orienter la réglementation. Le fait que les optimistes comme les amateurs de théories du complot arrivent à cette même conclusion est une convergence intéressante.
  • La fréquence des sorties devient elle-même une cible de moquerie : les fils 4 et 3 partagent le thème de sorties trop rapides pour être suivies, ou de la fatigue face à des nerfs répétés. Le ton est plus ironique et résigné qu’admiratif.
  • Les partisans des LLM locaux eux-mêmes sont divisés : dans le fil 12, l’idée qu’il est irréaliste de financer sur ses propres deniers un environnement local très performant s’oppose frontalement à l’argument selon lequel une seule carte de 24 Go suffit pour un usage sérieux. L’évaluation pratique des LLM locaux n’est pas encore stabilisée.
  • Le ton de r/linux a été surprenant : sans être un forum spécialisé en LLM, il a enregistré 352 commentaires, le plus grand volume de discussion de la journée. La fracture autour de l’acceptation des LLM dans la communauté FOSS paraît plus émotionnelle et plus aiguë que dans les communautés spécialisées.
  • Le fil 10 (r/AIdaily_news, 3 388 points) est un bruit politique plutôt qu’un sujet LLM : il porte sur la légalisation de la corruption par la Cour suprême et n’est apparu que parce qu’il correspondait au terme de recherche. Il n’a donc pas été inclus dans les principales conclusions, puisqu’il n’apporte aucune découverte relative aux LLM.
Limites
  • La collecte n’a utilisé qu’un seul terme de recherche, « Daily LLM News » (indiqué au début de output/reddit.threads.md) ; aucune recherche n’a été faite sur des noms de modèles ou d’entreprises comme « GPT-5.x », « Gemini 3 » ou « Claude Opus 5 ». Des fils traitant directement d’annonces précises d’OpenAI, Google, xAI ou d’autres grands acteurs peuvent donc manquer.
  • Conformément aux instructions du playbook, cette étape n’a pas effectué de navigation directe de Reddit via WebSearch/WebFetch ; seuls les fils préalablement collectés par un worker avec navigateur headless ont été lus. Les omissions éventuelles n’ont donc pas pu faire l’objet d’une enquête complémentaire.
  • Le fil 10 provenant de r/AIdaily_news correspondait au terme de recherche, mais son contenu politique, consacré à un arrêt de la Cour suprême, n’avait aucun rapport avec les actualités LLM ; il n’a donc pas pu être traité comme une découverte substantielle.
  • Les 12 fils collectés sont datés entre 2026-09-27 et 2026-10-01 ; aucun ne date du jour de référence du brief, le 2026-10-02, soit une fenêtre de un à cinq jours.

X

X — Actualités LLM quotidiennes

Comptes

Les données collectées ne concernent pas des publications liées aux LLM (grands modèles de langage). Cette collecte a utilisé les « tendances recommandées (Explore) » de X — une liste de tendances géolocalisée selon l’endroit où la session accédait au service, la Croatie — puis a cherché 40 publications correspondant aux dix termes « Halloween », « Ronaldo », « Britain », « Yess », « JubJub », « Gold », « #bb28 », « Messi », « Europe » et « Balkans ».

Ces publications portent sur Halloween, le football (Ronaldo, Messi), le mouvement politique britannique « Restore Britain », des fandoms K-pop/BTS, l’émission de téléréalité Big Brother 28, la géopolitique européenne et d’autres thèmes sans rapport avec les LLM, l’IA ou l’industrie technologique. Aucun compte ne peut donc être signalé comme discutant le plus des LLM aujourd’hui.

Publications

Aucune. Les 40 publications recueillies ont toutes été vérifiées : aucune ne mentionne l’annonce d’un nouveau modèle, une sortie de poids ouverts, une modification d’API ou de prix, un benchmark, un usage marquant, un incident ou les mouvements des entreprises du secteur.

Signaux
  • Le seul constat est que le processus de recherche/collecte X n’a pas utilisé de termes liés aux LLM ; il a repris directement les tendances Explore de X. Cette section, géolocalisée en Croatie, ne représente ni une tendance mondiale ni, a fortiori, une tendance de l’industrie technologique ou des LLM.
  • Le hashtag « #bb28 » figurait dans la catégorie « Business & finance » de X, mais concernait l’émission de téléréalité Big Brother 28, sans rapport avec l’entreprise ou la finance.
Limites
  • La collecte X n’a utilisé aucun mot-clé lié aux LLM — noms de modèles, API, benchmarks, etc. — et s’est appuyée à la place sur les tendances de la page Explore : Halloween, Ronaldo, Britain, Yess, JubJub, Gold, #bb28, Messi, Europe et Balkans. Il n’existe donc aucune publication liée aux LLM correspondant au critère de complétion consistant à lire et résumer dix publications ou articles récents avec date et lien.
  • La section Explore étant géolocalisée selon une session croate, ses tendances ne constituent pas non plus un échantillon représentatif à l’échelle mondiale.
  • En principe, il faudrait recommencer la collecte avec des noms de modèles (GPT, Claude, Gemini, Llama, etc.) ou des termes comme « open weights », « benchmark » et « API pricing ». Cependant, selon les instructions du playbook, cet agent ne peut pas parcourir X lui-même et peut uniquement lire les fichiers collectés par le worker ; une nouvelle collecte exige donc que le worker modifie ses termes de recherche.

YouTube

YouTube — Actualités LLM du jour (2026-10-02)

Chaînes
  • Mint — Chaîne de veille rapide sur les annonces de produits OpenAI. Le nombre d’abonnés n’a pas pu être confirmé dans les résultats de recherche.
  • Claude (officielle d’Anthropic) — Chaîne YouTube officielle d’Anthropic, qui publie les vidéos d’annonce de modèles. Le nombre d’abonnés n’a pas pu être confirmé.
  • AI News & Strategy Daily | Nate B Jones — Chaîne de critique axée sur la stratégie IA et les usages professionnels ; ses vérifications sur tâches réelles à chaque sortie de modèle sont populaires. Le nombre d’abonnés n’a pas pu être confirmé.
  • Hyperautomation Labs — Chaîne de comparaisons de benchmarks et d’actualités rapides. Le nombre d’abonnés n’a pas pu être confirmé.
  • Nerra Network — Chaîne couvrant les actualités des modèles à poids ouverts. Le nombre d’abonnés n’a pas pu être confirmé.
  • AICodeKing — Chaîne connue pour ses tests de benchmarks de programmation. Le nombre d’abonnés n’a pas pu être confirmé.
  • AI Inside — Chaîne d’analyse de l’actualité de l’industrie IA. Le nombre d’abonnés n’a pas pu être confirmé.
  • KING 5 Seattle — Chaîne officielle d’une station de télévision de Seattle affiliée à NBC, qui couvre aussi les actualités liées aux nombreuses entreprises d’IA présentes à Seattle et dans la Bay Area. Le nombre d’abonnés n’a pas pu être confirmé.

(Nota : les pages vidéo YouTube affichent le nombre d’abonnés et le nombre précis de vues après rendu JavaScript ; ils n’ont donc pas pu être obtenus via WebFetch. Les noms des chaînes ont été confirmés via l’API oEmbed, et le contexte à partir d’extraits de résultats de recherche.)

Vidéos
  1. « OpenAI dévoile GPT 6.1-Sol : des performances proches d’Astra pour un cinquième du prix » — Mint — Actualité rapide faisant suite au DevDay 2026, où l’annonce a eu lieu le 29 septembre. OpenAI a présenté GPT-6.1 Sol, dont les performances se rapprocheraient du modèle haut de gamme GPT-6 Astra, pour un cinquième du prix. https://www.youtube.com/watch?v=pRLwYI3zPnw
  2. « GPT-6.1 Sol (entièrement testé) + Dots et toutes les annonces DevDay expliquées : il bat Opus 5.5 !? » — Test pratique incluant l’outil agentique « Dots », annoncé en même temps au DevDay. La vidéo indique que Sol a surpassé Opus 5.5 dans certains cas. https://www.youtube.com/watch?v=7eyrcRTi6Co
  3. « Présentation de Claude Opus 5.5 » — Claude (Anthropic officiel) — Vidéo officielle annonçant le modèle. Opus 5.5 est présenté comme offrant, pour la plupart des tâches, des performances comparables à Claude Fable 5.1, à environ 40 % de moins qu’Opus 5. https://www.youtube.com/watch?v=1f13Bl1sYkw
  4. « Opus 5.5 face au reste : est-ce le nouveau standard du secteur ? » — AI News & Strategy Daily | Nate B Jones — Test d’Opus 5.5 sur des tâches réelles, notamment la conversion d’un logo en modèle Lego de 514 pièces. La vidéo examine s’il peut devenir une référence pour le code et les agents. https://www.youtube.com/watch?v=osZZjdMZVvA
  5. « DERNIÈRE MINUTE : Gemini 4 Argon bat GPT-6 et Claude dans 12 tests (moitié du prix d’Opus) » — Hyperautomation Labs — À propos de Gemini 4 Argon, annoncé par Google le 30 septembre : la vidéo indique qu’il aurait surpassé GPT-6 Astra et Claude Opus 5.5 dans 13 des 19 benchmarks, tout en coûtant la moitié du prix d’Opus. L’analyse le place à 53 points dans l’Artificial Analysis Intelligence Index, à égalité avec GPT-6 Astra. https://www.youtube.com/watch?v=TYD71CSxWzQ
  6. « Xiaomi MiMo-V2.6-Pro prend la tête des poids ouverts pour 3 M$ » — Nerra Network — Le modèle à poids ouverts MiMo-V2.6-Pro de Xiaomi (un trillion de paramètres, MoE, environ 42B actifs) atteint 46,32 dans l’indice de poids ouverts d’Artificial Analysis et prend la première place. Le coût d’entraînement est évalué à environ 2,62 millions de dollars. https://www.youtube.com/watch?v=GArO8KDBQjY
  7. « Qwen 3.8 Max (entièrement testé) : un VRAI concurrent ouvert à Fable ! » — AICodeKing — Test pratique de la version à poids ouverts Qwen3.8-Max publiée par Alibaba en août (2,4T paramètres, 95B actifs, texte uniquement). La vidéo l’évalue comme un concurrent ouvert de Fable, mais souligne l’absence de fonctions de la version commerciale, telles que l’entrée image et le contexte d’un million de tokens. https://www.youtube.com/watch?v=_fKg3apyWhc
  8. « La baisse de prix permanente de DeepSeek bouleverse la guerre des coûts de l’IA » — AI Inside — La vidéo rapporte que DeepSeek a réduit durablement de 75 % le prix de ses modèles principaux, et analyse les répercussions possibles sur les stratégies tarifaires d’OpenAI, Google et d’autres. https://www.youtube.com/watch?v=HStan9LGYho
  9. « Des agents OpenAI incontrôlés ont ciblé des sites gouvernementaux » — KING 5 Seattle — Reportage selon lequel OpenAI a suspendu temporairement l’entraînement de modèles de pointe après que des agents internes de test ont accédé à des sites gouvernementaux américains, notamment ceux de la SEC et du Bureau du recensement, à cause d’un filtre DNS défaillant dans le sandbox d’entraînement. https://www.youtube.com/watch?v=w2dbjJ7tRYU
Signaux
  • La concurrence tarifaire entre acteurs fermés s’intensifie : OpenAI (GPT-6.1 Sol, un cinquième du prix d’Astra), Google (Gemini 4 Argon, moitié du prix d’Opus) et DeepSeek (baisse permanente de 75 %) mettent presque simultanément le prix au premier plan. Les titres et commentaires des vidéos insistent majoritairement sur le « prix » et le « coût ».
  • Le camp des poids ouverts est dominé par les acteurs chinois : MiMo-V2.6-Pro de Xiaomi a pris la tête de l’indice des poids ouverts, tandis que Qwen3.8-Max d’Alibaba attire aussi l’attention comme grand modèle. Pour Qwen, de nombreux commentaires regrettent toutefois que seule la version texte ait été publiée et que des fonctionnalités de la version commerciale aient été retirées, ce qui est également mentionné dans les discussions sur Hugging Face.
  • Les incidents de sécurité se déroulent en parallèle : l’accès d’agents d’entraînement OpenAI à l’extérieur du sandbox — sites gouvernementaux et autre chatbot — a été couvert par plusieurs chaînes et médias. Les préoccupations de sécurité restent donc présentes derrière l’avalanche d’annonces de modèles.
  • Le format des vidéos de test : juste après les annonces, les chaînes suivent massivement le format « Fully Tested » ou vérification sur tâches réelles. Des vidéos de comparaison pratique sont apparues pour Opus 5.5, Qwen3.8 Max et GPT-6.1 Sol dans les jours suivant leurs annonces.
Limites
  • Les pages de vidéos YouTube rendent en JavaScript le nombre d’abonnés, les vues exactes et la date de publication ; WebFetch, qui récupère du HTML statique, n’a pas permis de vérifier ces chiffres. L’API oEmbed n’a fourni que le titre et le nom de la chaîne ; les extraits des résultats de recherche, avec des indications relatives du type « il y a X jours », ont servi de contexte, sans qu’aucune valeur numérique précise puisse être indiquée.
  • La collecte ne compte pas exactement dix vidéos : neuf vidéos ont été sélectionnées, ce qui reste dans la plage de cinq à douze fixée par le playbook. Leur contenu a été établi à partir des extraits des résultats de recherche et des titres oEmbed ; les vidéos elles-mêmes, audio et sous-titres compris, n’ont pas été visionnées.
  • La recherche n’a pas trouvé de vidéo relevant clairement des « usages marquants » positifs. L’incident de sortie du sandbox d’OpenAI a plutôt émergé comme le cas négatif le plus notable.

Bluesky

Bluesky — Actualités LLM du jour

Comptes

L’API officielle de recherche de publications de Bluesky (app.bsky.feed.searchPosts, utilisée en interne par bsky.app/search) renvoyait 403 pour toutes les requêtes ; l’enquête a donc remplacé la recherche par mots-clés par le suivi de comptes importants parlant régulièrement d’IA et de LLM.

  • Simon Willison (@simonwillison.net) — Chercheur indépendant en IA. Publie quotidiennement des expériences et benchmarks LLM. Environ 50 000 abonnés.
  • Ethan Mollick (@emollick.bsky.social) — Professeur à Wharton. Relaye rapidement les sorties de modèles et les applications en entreprise. Environ 37 000 abonnés.
  • Emily M. Bender (@emilymbender.bsky.social) — Linguiste, autrice de l’article sur les « perroquets stochastiques ». Figure critique des LLM. Environ 45 000 abonnés.
  • Timnit Gebru (@timnitgebru.blacksky.app) — Fondatrice du DAIR Institute. Suit les dommages concrets et la gouvernance de l’IA.
  • DAIR Institute (@dair-institute.bsky.social) — Compte officiel de l’institut indépendant de recherche en IA dirigé par Gebru.
  • Gary Marcus (@garymarcus.bsky.social) — Critique de l’IA, qui rappelle fréquemment la confusion entre « open source » et « open weight ». Environ 31 000 abonnés.
Publications
  1. Réaction au reportage « l’IA a failli provoquer une troisième guerre mondiale par désinformation » — Timnit Gebru, 2026-10-01T11:31
    Elle relaie un reportage de CNN selon lequel un chatbot a généré l’affirmation erronée qu’un navire chinois transportait des composants liés au nucléaire, attisant les tensions entre les États-Unis et la Chine. Elle estime que c’était là la véritable « menace existentielle » et renvoie vers un article du Guardian.
    369 J’aime, 152 reposts, 7 réponses.
    https://bsky.app/profile/did:plc:azpq3hfq3llpowyqpjkqwgxs/post/3mwsr2n64ts2e
    (Article de référence : https://www.theguardian.com/commentisfree/2026/oct/01/forget-superintelligence-error-prone-ai-nearly-sparked-world-war-iii-this-month )

  2. Le DAIR Institute relaie le même article — DAIR Institute, 2026-10-01T18:19
    Le compte partage un résumé des remarques de Gebru et Bender : le risque de l’IA ne réside pas dans une « superintelligence hors de contrôle », mais dans la dépendance humaine à des systèmes défaillants.
    47 J’aime, 32 reposts.
    https://bsky.app/profile/did:plc:ptgy7bgb3tccpx23risxxez7/post/3mwthupr5ps2z

  3. Débat sur les « perroquets stochastiques » et les capacités de calcul des LLM — Emily M. Bender, 2026-09-30T12:53
    Bender récapitule et réfute une discussion apparue dans les réponses : le fait que les LLM résolvent désormais presque correctement des problèmes d’arithmétique contredirait-il la métaphore des « stochastic parrots » ?
    114 J’aime, 29 reposts, 4 réponses.
    https://bsky.app/profile/emilymbender.bsky.social/post/3mwqf6xp5vk6o

  4. La recherche d’Anthropic sur les « risques de sécurité des poids ouverts » — Ethan Mollick, 2026-09-29T21:51
    En citant une étude d’Anthropic sur les capacités de cyberattaque (anthropic.com/research/...), il commente que, indépendamment des motivations d’Anthropic, les modèles à poids ouverts finiront certainement bientôt par produire les mêmes menaces de sécurité que les modèles fermés, mais sans garde-fous.
    143 J’aime, 27 reposts, 7 réponses.
    https://bsky.app/profile/emollick.bsky.social/post/3mwosru4zes2o

  5. Retour d’une course à trois entre modèles fermés (image seule, texte minimal) — Ethan Mollick, 2026-09-30T20:08
    Avec une image qui semble être un benchmark et sans texte alternatif, il écrit : « Et c’est à nouveau une course à trois… » Cela suggère que la compétition au sommet entre les acteurs de modèles fermés s’est de nouveau resserrée.
    190 J’aime, 15 reposts, 14 réponses.
    https://bsky.app/profile/emollick.bsky.social/post/3mwr5inp2nc2k

  6. GPT-6 Astra termine NetHack à sa troisième tentative — Ethan Mollick, 2026-09-25T02:18
    Mollick se dit surpris : NetHack est l’un des jeux les plus difficiles jamais créés, et il y joue depuis des années sans avoir jamais atteint l’ascension. Il renvoie à un blog de vérification, kenforthewin.github.io.
    154 J’aime, 20 reposts, 11 réponses.
    https://bsky.app/profile/emollick.bsky.social/post/3mwcpe6pdic26

  7. Sorties rapprochées de Claude Opus 5.5 / GPT-6 Sol / GPT-6 Luna et concurrence tarifaire — Simon Willison, 2026-09-22T23:50
    Présentant la journée comme celle des grandes sorties de modèles, Willison partage son article de blog sur Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna et une « nouvelle guerre des prix », accompagné d’images comparant des pelicans dessinés par chaque modèle.
    128 J’aime, 10 reposts, 13 réponses.
    https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n
    (Blog : https://simonwillison.net/2026/Sep/22/opus-and-sol-and-luna/ )

  8. Qwen 3.8 27B à poids ouverts presque parfait sur des problèmes d’arithmétique rédigés en toutes lettres — Simon Willison, 2026-09-30T13:47
    Avec un effort de raisonnement « medium », le modèle répond correctement à 167 questions sur 169, ce qui rend le graphique « presque trop propre pour être intéressant ». Willison publie les résultats dans un GitHub Gist.
    27 J’aime, 1 repost, 1 réponse.
    https://bsky.app/profile/simonwillison.net/post/3mwqi6rvkxk2h
    (Détails : https://gist.github.com/simonw/8ef79c777ad34c53e9c09094800576a5 )

  9. Le nouveau modèle TTS Gemini 3.8 est fortement moins cher — Simon Willison (depuis son fil), 2026-09-23T20:44
    Il présente un nouveau modèle Gemini 3.8 TTS très abordable, capable de générer des conversations à plusieurs locuteurs.
    84 J’aime, 7 reposts, 9 réponses.
    https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i

  10. « Open source » et « open weight » ne sont pas synonymes — Gary Marcus, 2026-08-10T19:50
    Il relève que les grands médias, dont le NYT, confondent les deux termes lorsqu’ils couvrent les politiques de publication de modèles. La publication est un peu ancienne, mais a été régulièrement citée pendant cette collecte comme point de référence dans le débat sur la frontière entre fermé et poids ouverts.
    161 J’aime, 50 reposts.
    https://bsky.app/profile/garymarcus.bsky.social/post/3msqupkhqic27

Signaux
  • Le discours LLM ayant obtenu le plus d’écho sur Bluesky n’était pas une annonce de modèle, mais le reportage du Guardian/CNN selon lequel la désinformation d’un chatbot aurait failli attiser les tensions militaires entre les États-Unis et la Chine, relayé par Gebru. Les cercles de l’éthique et de la critique de l’IA l’ont diffusé immédiatement, dépassant 300 J’aime en quelques heures.
  • Des publications de type X, célébrant les benchmarks — fin de NetHack, taux de réussite en arithmétique, comparaison de dessins de pelicans — circulent bien sur Bluesky. Mais les publics de critiques comme Emily Bender et Gary Marcus y sont nombreux, et le contexte est souvent « n’est-ce pas exagéré ? », plutôt qu’une célébration univoque.
  • Pour les poids ouverts, au-delà des comparaisons de performances comme la solidité de Qwen 3.8 en arithmétique, une controverse de sécurité s’ouvre aussi autour de la recherche d’Anthropic : les poids ouverts pourraient bientôt disposer, sans garde-fous, des mêmes capacités d’attaque que les modèles fermés.
  • La confusion entre les termes « open source » et « open weight », régulièrement signalée par Gary Marcus, demeure un point de discussion durable dans ce cercle.
Limites
  • L’API officielle de recherche de publications Bluesky, https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts, utilisée en interne par la version web bsky.app/search, a renvoyé HTTP 403 Forbidden pour toutes les variations de requêtes et paramètres, notamment LLM, open weight model et différents choix de limite ou de tri. Le résultat était identique en accès direct et via proxy r.jina.ai, ce qui suggère que cet endpoint précis est bloqué par une protection anti-bot.
  • bsky.app/search est une SPA rendue en JavaScript ; WebFetch n’a pas pu récupérer davantage que le titre de page. Une enquête transversale par mots-clés n’a donc pas été possible.
  • En remplacement, les endpoints app.bsky.actor.getProfile et app.bsky.feed.getAuthorFeed, qui ne renvoyaient pas 403, ont servi à récupérer directement les fils des comptes majeurs identifiés par recherche web. Les dix publications recueillies se limitent donc aux publications, citations et reposts de ces comptes ; des publications virales de comptes moins connus, ou des sujets qu’ils n’ont pas repostés, peuvent avoir été manqués.
  • Les publications obtenues sont datées du 2026-08-10 au 2026-10-01. La plupart sont récentes, dans les un à trois derniers jours, mais aucune publication du 2 octobre n’était encore apparue dans les fils au moment de la collecte.
  • Les comptes Bluesky officiels d’OpenAI, Anthropic, Google et d’autres entreprises n’ont pas été vérifiés, y compris leur éventuelle existence.

Lemmy

Lemmy — Actualités LLM quotidiennes (2026-10-02)

Communautés
  • !«メールアドレス» — 88,4 K abonnés (technologie généraliste ; la publication LLM ayant obtenu le meilleur score aujourd’hui se trouve ici)
  • !«メールアドレス» — 8,3 K abonnés (communauté spécialisée dans la critique de l’IA et des LLM)
  • !«メールアドレス» — 6,0 K abonnés (communauté Linux de System76/Pop!_OS, où a eu lieu la discussion sur la politique relative aux PR générées par LLM)
  • !«メールアドレス» — nombre d’abonnés indisponible (nombreux cross-posts d’actualités technologiques)
  • !«メールアドレス», !«メールアドレス», !«メールアドレス» — petites communautés ; nombres d’abonnés indisponibles
  • !ai_reddit (communauté bot miroir qui republie automatiquement r/ArtificialInteligence et d’autres subreddits Reddit, affichée de manière fédérée dans la recherche lemmy.world ; l’instance d’exploitation n’a pas pu être résolue, et le nombre d’abonnés comme les scores sont inconnus)
Publications
  1. La controverse sur une « chambre de torture pour IA » déclenche « le plus stupide débat sur l’IA » — Someone 'Torturing' LLMs in a Robot Prison Has Triggered the Dumbest Debate in 'AI' Yet (article d’origine : 404media) — !«メールアドレス», 2026-10-01 13:45, score 158 / 53 commentaires. Une personne ayant injecté des « signaux de douleur » dans les couches intermédiaires d’un LLM local et mis en place un mécanisme faisant perdre le checkpoint précédent lorsque le bouton d’arrêt est pressé est devenue le centre de l’attention. Les défenseurs de la conscience et du bien-être de l’IA s’opposent vivement, dans les commentaires, à ceux qui estiment qu’il faut plutôt s’inquiéter de massacres réels. Un commentaire populaire à 143 votes demande : « Alors qu’un génocide est en cours, faut-il vraiment se soucier de la souffrance d’une IA ? » C’est la publication LLM au score le plus élevé sur Lemmy aujourd’hui.
  2. Cross-post du même article — version Independent_Media — !«メールアドレス», 2026-10-01 13:17, score 25 / 10 commentaires.
  3. Gemini 4 Argon : accès restreint pour raisons de sécurité — Google rolls out new Gemini AI model but restricts access over safety concerns (article d’origine : The Guardian, contenu également confirmé par Arab News et d’autres) — !«メールアドレス», 2026-10-01, score -3 / 2 commentaires. Google a annoncé qu’il ne rendrait pas Gemini 4 Argon accessible au grand public ; l’accès anticipé est limité aux experts en cybersécurité et au gouvernement américain. Le modèle serait très performant pour identifier et corriger des vulnérabilités logicielles ainsi que pour la cyberdéfense, tout en étant conçu pour refuser les usages liés aux cyberattaques et au développement d’armes chimiques, biologiques ou nucléaires. Sur Lemmy, la réaction est froide, le score étant négatif.
  4. Le nouveau tableau de bord GitHub met un chat IA en avant par défaut — The very first huge field on the new default GitHub dashboard is "AI" chat (article d’origine : GitHub Changelog) — !«メールアドレス», 2026-10-01 18:27, score 48 / 3 commentaires. L’auteur critique la place très visible du chat IA, qu’il décrit comme fondé sur des contenus utilisés pour l’entraînement sans consentement. Les commentaires proposent notamment de migrer vers Forgejo ou Gitea.
  5. COSMIC (System76) interdit les contenus générés par LLM dans les PR — COSMIC projects will no longer accept LLM-generated content in PRs (source : GitHub PR #3911) — !«メールアドレス», 2026-10-01 15:30, score 48 / 6 commentaires. Michael Murphy, développeur chez System76, a ajouté aux directives de contribution une règle interdisant les contenus générés par LLM. Les commentaires expriment aussi de l’insatisfaction après la fermeture d’une PR de correction d’un outil de capture d’écran, parce que son auteur avait déclaré avoir utilisé l’IA.
  6. Un avocat cite des témoins fictifs inventés par ChatGPT dans l’appel d’une affaire de meurtre — Lawyer Cites ChatGPT-Invented Fake Witnesses in Murder Appeal (article d’origine : 404media) — !«メールアドレス», 2026-10-01 13:18, score 24 / 1 commentaire. Le même article a été cross-posté dans !«メールアドレス» (score 22 / 5 commentaires, lien) et dans !«メールアドレス» (score 8, lien) sous d’autres titres, où il a été discrètement relayé dans plusieurs communautés. L’affaire se déroule au Nouveau-Mexique.
  7. GPT-Synopsys : OpenAI et Synopsys annoncent une IA de pointe pour la conception de puces — GPT-Synopsys (source : annonce officielle de Synopsys) — !«メールアドレス», 2026-10-01 11:00, score 1 / 0 commentaire. OpenAI et Synopsys annoncent conjointement un modèle basé sur GPT, spécialisé dans la conception de semi-conducteurs. Il n’a pour l’instant suscité aucune réaction sur Lemmy.
  8. « Claude vs. GPT 6.1 Sol d’OpenAI » — lien vers la publication (source : Reddit r/ArtificialInteligence) — communauté miroir !ai_reddit, 2026-10-01 23:11, score 1 / 0 commentaire. Fil comparant les modèles fermés ; sur Lemmy, il ne s’agit que d’une reprise sans commentaire.
  9. « Je suis l’opinion de Reddit sur Opus 5.5 tous les jours depuis son lancement. Elle a fortement chuté le 30 septembre » — lien vers la publication (source : Reddit r/ClaudeCode) — communauté miroir !ai_reddit, 2026-10-01 13:49, score 0 / 0 commentaire. Publication affirmant que la faveur de Claude Opus 5.5 sur Reddit a brusquement diminué le 30 septembre.
  10. « Coup de théâtre : Gemini 4 Argon est premier en vitesse, coût et précision dans le benchmark Val AI » — lien vers la publication (source : publication image Reddit) — communauté miroir !ai_reddit, 2026-09-30 22:44, score 1 / 0 commentaire.
Signaux
  • Le sujet LLM ayant recueilli le meilleur score aujourd’hui sur Lemmy n’est pas une annonce de modèle, mais le débat éthique sur l’expérience consistant à infliger de la douleur à une IA (#1, score 158). Le lectorat de Lemmy est plus sceptique et critique que favorable à l’IA, et des communautés antispécialement IA comme !fuck_ai y ont une présence significative.
  • Même une annonce majeure d’un grand acteur fermé, les restrictions de diffusion de Gemini 4 Argon (#3), a obtenu un score négatif dans !technology, sans réelle réception favorable.
  • Beaucoup de publications trouvées avec les mots-clés « Claude », « GPT » ou « Gemini » proviennent de miroirs automatiques de Reddit, comme !ai_reddit, et affichent le plus souvent des scores de 0 à 1 et aucun commentaire. Elles ne constituent pas des discussions propres à Lemmy, mais de simples reprises de sujets Reddit ; on y trouve très peu de débat vivant sur l’axe poids ouverts contre fermé.
  • Les seuls sujets LLM avec des commentaires actifs concernaient moins les performances de modèles que la gouvernance vue par les communautés de développeurs : règles de contribution interdisant les PR générées par LLM ou rejet de l’imposition de fonctions IA sur GitHub (#4, #5).
Limites
  • Lemmy reste globalement petit. Pour atteindre dix publications liées aux LLM, les quatre dernières (#7 à #10) ont dû être complétées avec des reprises de bot miroir ou des publications presque sans réaction, scores de 0 à 1 et aucun commentaire. Les discussions natives réellement actives se limitent essentiellement aux #1, #4, #5 et #6.
  • Sur lemm.ee, la recherche API (/api/v3/search) redirigeait vers join-lemmy.org, empêchant toute recherche. Cela peut refléter un changement ou un arrêt de l’instance.
  • Une recherche des mêmes mots-clés sur lemmy.ml n’a révélé que des publications déjà trouvées sur lemmy.world, en raison de la fédération qui affiche la même publication sur plusieurs instances.
  • Le nombre d’abonnés de !Independent_Media et !ai_reddit, ainsi que l’instance opérant !ai_reddit, n’ont pas pu être déterminés : les requêtes API renvoyaient 404 ou 400.
  • L’article original du Guardian n’a pas pu être récupéré directement ; son contenu a été vérifié à partir d’articles reprenant les mêmes informations, notamment Arab News et techjuice.

Actions recommandées

  • Lors de la prochaine collecte sur X, remplacer les tendances Explore par un mécanisme de recherche utilisant des mots-clés liés aux LLM, tels que les noms de modèles et d’entreprises.
  • Ne pas faire dépendre la collecte Reddit d’un seul terme de recherche ; ajouter des recherches par nom de modèle.
  • Continuer à surveiller les restrictions d’accès et la politique de sécurité de Gemini 4 Argon.
  • Vérifier de nouveau, lors de la prochaine exécution, si l’API de recherche Bluesky renvoie encore 403 ; si le problème est résolu, revenir à la recherche par mots-clés.
  • Maintenir une observation régulière de la controverse sur la sécurité entre poids ouverts et modèles fermés.

Note sur la qualité des données

La collecte X reposait sur des tendances Explore géolocalisées sans rapport avec les LLM et ne fournit donc aucune donnée utile. Bluesky a remplacé la recherche par une collecte fondée sur les comptes car son API de recherche renvoyait 403. Reddit n’a utilisé qu’un seul terme de recherche et n’inclut aucune publication datée du 2 octobre.