Le canari dans la mine de systemd : quand l’open source apprend à se méfier du code généré par IA

L’ajout d’un « AI canary » dans systemd 262-rc2 pour signaler le code potentiellement généré par un LLM non relu est une petite révolution dans la gouvernance des projets open source. Cette enquête examine le contexte : la montée en puissance du code assisté par IA dans les dépôts critiques, les ris
Agent harnesses open source en 2026 : le nouvel étage indispensable de la stack LLM locale

Alors que les LLM open source rivalisent désormais avec les modèles propriétaires, la couche d’orchestration des agents (agent harnesses) devient le champ de bataille décisif pour les praticiens. Cet article propose un comparatif approfondi des principales solutions open source de 2026 pour piloter
GLM-5.2 : le open-weights qui fait trembler GPT-5.5 sur le codage long-horizon — décryptage complet

GLM-5.2 de Z.ai vient de sortir et les résultats sont spectaculaires : il surpasse GPT-5.5 sur plusieurs benchmarks de codage long-horizon, pour un coût d’inférence six fois inférieur. Cet article décrypte en profondeur cette sortie majeure : analyse des benchmarks concernés (lesquels, quelles tâche
La fin des fossés défensifs : quand l’open source a gagné la guerre des modèles

Panorama de la disparition rapide des avantages compétitifs des grands modèles de langage, un phénomène documenté par la presse spécialisée et confirmé par les récentes levées de fonds et stratégies des acteurs open source. L’article explorera les causes (open source, distillation, baisse des coûts
Tencent Hy4 Preview : le géant 770B open source qui redessine la carte de l’IA

Décryptage en profondeur de la sortie de Tencent Hy4 Preview, un LLM open source de 770 milliards de paramètres avec un contexte de plus d’un million de tokens. L’article analyse ce que ce modèle apporte concrètement aux praticiens : architecture, performances réelles sur les benchmarks, coûts d’inf
Nemo(Claw) : quand le garde du corps d’OpenClaw devient la porte d’entrée des empoisonneurs

Décryptage de la vulnérabilité de type LLM poisoning découverte dans OpenClaw, un framework open-source d’agents IA. Analyse technique de la faille réseau, ses conséquences sur la sécurité des agents, et les leçons pour les développeurs et praticiens d’agents LLM. Axes : mécanisme de l’attaque, surf
Red teaming autonome : le benchmark qui révèle enfin ce que les LLM savent vraiment faire (et ne font pas)

Décryptage en profondeur du tout premier benchmark comparant les modèles d’IA leaders pour le red teaming autonome, publié par Ridge Security début septembre 2026. L’article analysera la méthodologie inédite de ce test (scénarios, métriques, protocole), les résultats clés — notamment le rapport de f
NEEDLE : le benchmark vivant qui rend les classements LLM obsolètes

Décryptage en profondeur de NEEDLE, le benchmark open-source de Keenable AI qui reconstruit son jeu de requêtes toutes les heures pour éliminer la contamination des données d’entraînement. L’article analyse pourquoi les benchmarks statiques classiques (MMLU, GPQA, etc.) sont devenus peu fiables en 2
RL post-training : la convergence forcée de l’infrastructure open source

Le RL post-training s’impose comme l’étape clé de l’entraînement des LLM open source, et cette montée en puissance bouleverse l’infrastructure : frameworks, orchestration, gestion des ressources. À partir des échanges du Ray Summit 2026, cet article dresse un état des lieux de cette convergence tech
Dragon LLM, LightOn, Pleias : la troisième voie française de l’IA open source

Panorama de l’écosystème français des LLM open source en 2026 : Dragon LLM, LightOn et Pleias tentent de construire une alternative européenne crédible face aux géants américains et chinois. L’article dresse un état des lieux technique et pratique : architectures, jeux de données francophones, souve