Open source
-
Recherche
ExecCritic montre qu’un mauvais test généré peut dégrader un agent de programmation
ExecCritic montre que des tests générés peuvent aider ou nuire à la réparation et propose de les qualifier et de les figer avant de guider l’agent.
-
Recherche
Une étude montre comment une mémoire révoquée peut redevenir active chez un agent
Une étude de cinq systèmes de mémoire persistante décrit comment des données invalidées peuvent réapparaître et être transformées par l'agent en nouveaux enregistrements.
-
Entreprises
La levée de 3 Md€ de Mistral renforce ses moyens de calcul, pas sa preuve de souveraineté
La série D de 3 Md€ de Mistral finance davantage de calcul et d'infrastructure. Elle ne constitue pas, à elle seule, une preuve de supériorité technique ou de souveraineté en IA.
-
Open source
SwarmLLM répartit un modèle de 27 milliards de paramètres entre plusieurs navigateurs
SwarmLLM v0.2.0 distribue les couches d'un modèle 27B entre navigateurs avec WebGPU et WebRTC, avec des contraintes de réseau et de confiance entre pairs.
-
Recherche
Le cache de préfixe peut rendre les agents quantifiés difficiles à reproduire
Une étude de reproductibilité montre que l’état du cache peut modifier la trajectoire d’un agent même à température zéro, avec un effet accru par la quantification.
-
Agents
OpenClaw active par défaut l’accès aux sessions entre agents
OpenClaw 2026.9.2 élargit par défaut la visibilité des sessions dans un Gateway et impose de réexaminer la frontière de confiance des déploiements multi-agents.
-
Recherche
Les mises à jour de hooks peuvent créer une voie d’exécution hors du contrôle direct du modèle
L’étude HookPry montre pourquoi les hooks exécutables exigent réautorisation, moindre privilège et provenance d’exécution dans les plateformes d’agents.
-
Nouveaux produits
NVIDIA PAIR répartit l’inférence locale entre plusieurs machines
PAIR distribue des requêtes d’IA locales entre plusieurs PC et Mac, sans mutualiser la mémoire GPU ni répartir un même modèle entre machines.
-
Open source
Soup 0.74 corrige un chargement fp32 qui gonflait la mémoire des entraînements LoRA
Soup 0.74.0 corrige un chargement fp32 inutile, publie une forte baisse mémoire sur H100 et durcit plusieurs contrôles de sécurité.
-
Recherche
DRACO répartit le signal d'entraînement entre les étapes d'un agent
IBM publie DRACO, une méthode qui redistribue la récompense entre les étapes d'un agent et rend le comportement du juge critique pour la reproductibilité.