Sûreté et éthique
-
Recherche
Les mises à jour de hooks peuvent créer une voie d’exécution hors du contrôle direct du modèle
L’étude HookPry montre pourquoi les hooks exécutables exigent réautorisation, moindre privilège et provenance d’exécution dans les plateformes d’agents.
-
Recherche
Les variations des API partagées peuvent invalider des seuils de production fondés sur des modèles évaluateurs
Un audit préenregistré montre que l'instabilité des services LLM partagés peut fragiliser des seuils de production et impose de qualifier l'évaluateur.
-
Recherche
PatchBench révèle l'écart entre un crash évité et une faille réellement corrigée
PatchBench montre qu'un test limité à une preuve de concept peut surestimer les correctifs produits par des agents d'IA et plaide pour une validation indépendante.
-
Recherche
L’élévation de privilège du contexte révèle une nouvelle frontière de sécurité des agents
Une étude sur 12 environnements d’agents montre comment le contexte peut gagner de l’autorité et pourquoi la provenance doit être contrôlée à l’exécution.
-
Nouveaux modèles
GPT-6 Astra arrive en production avec un accès progressif et des garde-fous cyber renforcés
OpenAI lance GPT-6 Astra avec un déploiement progressif, un niveau cyber Critical et des protections capables d'interrompre des tâches.
-
Nouveaux modèles
Astra adopte une technique qui pourrait compliquer la surveillance de son raisonnement
Astra utiliserait la profondeur récurrente tandis qu'OpenAI renforce la surveillance. Le modèle illustre les limites d'un contrôle fondé sur la seule chaîne de raisonnement.
-
Agents
GitHub donne à Copilot un rôle formel dans l’autorisation des fusions
GitHub peut désormais compter une approbation Copilot avant fusion, avec des contrôles par entreprise, dépôt et chemins de fichiers.
-
Agents
GitHub étend l’exclusion de contenu dans Copilot, mais le contrôle reste partiel
L’application Copilot et la CLI appliquent les exclusions, mais GitHub documente encore des limites dans les modes agents et certains systèmes de fichiers.
-
Recherche
Des vérificateurs bon marché peuvent masquer les erreurs des cascades d’IA
Une étude montre pourquoi le routage et la mesure de qualité d’une cascade de modèles ne devraient pas dépendre du même vérificateur.
-
Agents
Falcon Guardian déplace la sécurité des agents IA vers l’exécution
Falcon Guardian relie prompts et appels d’outils aux actions sur les terminaux et ajoute des contrôles à l’exécution pour les agents IA.