Nouvelles fonctionnalités et innovations
-
Nouveaux modèles
AMALIA publie un modèle de portugais européen à 9 milliards de paramètres, fenêtre 32K et voie locale
Le projet AMALIA publie un modèle ouvert de portugais européen de 9 milliards de paramètres, avec fenêtre 32K, entraînement SFT et DPO, ressources d’évaluation publiques et mise à disposition locale via vLLM.
-
Nouveaux modèles
Pipecat lance PhoneLLM, un modèle à 3.5B paramètres actifs pour les agents vocaux
PhoneLLM Alpha 1 est un modèle ouvert de 30B en mélange d’experts, avec 3.5B paramètres actifs, conçu pour les agents vocaux téléphoniques et évalué avec le nouveau PhoneBench.
-
Agents
OpenAI fixe à novembre la fin de ses modèles dans Cursor
Après le rachat de Cursor par SpaceX, OpenAI met fin au contrat d’approvisionnement de modèles, avec une date de coupure proposée au 12 novembre 2026 pour les équipes de développement.
-
Recherche
Gemini Co-Scientist referme la boucle de l’hypothèse à l’expérience et aux affirmations vérifiées
Google DeepMind étend Co-Scientist de la génération d’hypothèses à une recherche fondée sur l’exécution : planification d’expériences, code autonome, matériel de laboratoire et vérification des affirmations.
-
Agents
Le MHS d’Anthropic donne aux agents d’IA une interface commune avec les machines physiques
Le Model Hardware Standard d’Anthropic offre aux agents d’IA une interface partagée pour les appareils de laboratoire et industriels, avec des essais précoces et des limites de sécurité explicites.
-
Recherche
openJiuwen fait du harnais d’agent de codage une couche système mesurable
openJiuwen propose un harnais d’agent de codage composable et adaptatif à l’exécution, et montre pourquoi des audits de référence à modèle apparié comptent pour l’ingénierie d’agents.
-
Infrastructure et puces
EuroHPC verrouille 387.8 millions d’euros pour la capacité publique de LUMI-AI
LUMI-AI ajoutera une capacité publique de calcul d’IA fondée sur AMD pour les start-up, PME et chercheurs européens, avec une architecture multi-locataires et un accès par API prévus pour 2027.
-
Agents
Broadcom déplace l'autorisation de l'agent IA dans un plan de contrôle externe
AgentMinder déplace l'autorisation des agents d'IA d'entreprise en dehors de l'environnement d'exécution, intégrant ainsi l'identité, la provenance de la mission et le contexte politique à la limite de sécurité.
-
Open source
Strix transforme les agents IA en pentesters autonomes, mais son benchmark à 96% a besoin de contexte
Strix utilise des agents d'IA autonomes pour valider les vulnérabilités avec les PoC. Aipolix examine son architecture, l'intégration de l'agent de codage et sa revendication XBEN à 96%.
-
Open source
User Scanner donne aux agents IA un OSINT récursif, faisant du contrôle de la portée le véritable problème de gouvernance
User Scanner v1.5.1 ajoute MCP à l'analyse croisée récursive OSINT. Aipolix examine pourquoi les autorisations des agents nécessitent une traçabilité au niveau de l'enquête.