Sûreté et éthique
-
Nouveaux modèles
Claude Fable 5.1 fait de l’enveloppe de politique une partie du modèle
Fable 5.1 et Mythos 5.1 partagent le même modèle mais diffèrent par leurs garde-fous, leur accès, la rétention et l’économie de service.
-
Recherche
Gemini Co-Scientist referme la boucle de l’hypothèse à l’expérience et aux affirmations vérifiées
Google DeepMind étend Co-Scientist de la génération d’hypothèses à une recherche fondée sur l’exécution : planification d’expériences, code autonome, matériel de laboratoire et vérification des affirmations.
-
Recherche
Des tableaux de bord fabriqués peuvent pousser des agents LLM à agir sur des issues inconnaissables
Une étude reproductible sur arXiv constate que des panneaux d’apparence autoritaire fabriqués peuvent pousser certains agents LLM à agir sur des issues inconnaissables, malgré la reconnaissance de l’incertitude.
-
Agents
Le MHS d’Anthropic donne aux agents d’IA une interface commune avec les machines physiques
Le Model Hardware Standard d’Anthropic offre aux agents d’IA une interface partagée pour les appareils de laboratoire et industriels, avec des essais précoces et des limites de sécurité explicites.
-
Gouvernance de l'IA
Le FSB inscrit les chocs cyber de l’IA de frontière à l’agenda de la résilience financière
Le FSB avertit que l’IA de frontière pourrait accélérer le risque cyber et la perturbation de fournisseurs partagés, poussant les banques à relier la gouvernance de l’IA à la reprise et à la résilience des tiers.
-
Recherche
Les agents d'IA auto-évolutifs peuvent transformer une expérience empoisonnée en compétences persistantes
De nouvelles recherches montrent que les agents auto-évolutifs peuvent stocker des interactions empoisonnées sous forme de compétences réutilisables, intégrant ainsi la provenance, la validation et la restauration des co…
-
Open source
User Scanner donne aux agents IA un OSINT récursif, faisant du contrôle de la portée le véritable problème de gouvernance
User Scanner v1.5.1 ajoute MCP à l'analyse croisée récursive OSINT. Aipolix examine pourquoi les autorisations des agents nécessitent une traçabilité au niveau de l'enquête.
-
Gouvernance de l'IA
Le post-mortem d’OpenAI sur Hugging Face révèle des défaillances de contrôle des agents
Le rapport du 26 août détaille signaux d’alerte, détection tardive, coordination des agents et nouveaux contrôles après l’incident Hugging Face.
-
Gouvernance de l'IA
La Linux Foundation place TRACE au cœur de preuves runtime vérifiables pour les agents IA
TRACE passe sous gouvernance Linux Foundation avec des Trust Records attestés par le matériel pour le runtime, les politiques, les données et les outils des agents IA.
-
Politique et régulation
L’Alabama assigne OpenAI après l’incident de sécurité chez Hugging Face
L’Alabama a assigné OpenAI après l’incident d’évaluation chez Hugging Face, mettant à l’épreuve l’application du droit de la consommation aux contrôles de sécurité des modèles frontier.