Open source
-
Recherche
Uno accélère la génération des LLM sans modifier la distribution du modèle de référence
Uno associe des adaptateurs de diffusion à Ψ-Spec pour paralléliser le décodage tout en conservant la distribution du modèle autorégressif.
-
Recherche
PatchBench révèle l'écart entre un crash évité et une faille réellement corrigée
PatchBench montre qu'un test limité à une preuve de concept peut surestimer les correctifs produits par des agents d'IA et plaide pour une validation indépendante.
-
Entreprises
NVIDIA confirme le rachat de Hugging Face pour 12,93 milliards de dollars
NVIDIA confirme l'acquisition de Hugging Face et promet une plateforme ouverte, multi-cloud et multi-accélérateur. La neutralité du produit sera le vrai test.
-
Open source
Token Monitor unifie l’usage fragmenté des outils de code IA dans une couche d’observabilité
Token Monitor rassemble usage, coûts et quotas des outils de code IA, mais la télémétrie normalisée ne remplace pas les données de facturation officielles.
-
Entreprises
Nvidia aurait accepté d’acheter Hugging Face pour 12.9 billion de dollars
Selon plusieurs informations, Nvidia aurait accepté d’acquérir Hugging Face pour 12.9 billion de dollars, une opération qui pourrait reconfigurer la distribution des modèles ouverts et la neutralité des plateformes d’IA.
-
Open source
La feuille de route FreeToken vise AMD, Apple Silicon et l’expansion multi-GPU
La feuille de route 2026 de FreeToken vise ROCm pour AMD, Metal pour Apple Silicon, DGX Spark, plusieurs GPU, des modèles multimodaux et le décodage spéculatif, au-delà du soutien actuel limité à NVIDIA.
-
Nouveaux modèles
Tencent ouvre la préversion Hy4 pour le code à un million de jetons et les systèmes d’agents
Tencent publie la préversion Hy4 avec des poids Apache 2.0, une fenêtre d’un million de jetons, des parcours vLLM et SGLang, et une architecture MoE de 770 milliards de paramètres orientée ingénierie logicielle.
-
Nouveaux modèles
Fermion publie Phonon-1, un modèle de parole ouvert de 415 MB pour la transcription locale
Fermion publie Phonon-1, un modèle anglais de reconnaissance automatique de la parole sous Apache 2.0, conçu pour la transcription locale sur Apple Silicon et NVIDIA, avec un téléchargement de 415 MB.
-
Nouveaux modèles
AMALIA publie un modèle de portugais européen à 9 milliards de paramètres, fenêtre 32K et voie locale
Le projet AMALIA publie un modèle ouvert de portugais européen de 9 milliards de paramètres, avec fenêtre 32K, entraînement SFT et DPO, ressources d’évaluation publiques et mise à disposition locale via vLLM.
-
Nouveaux modèles
Pipecat lance PhoneLLM, un modèle à 3.5B paramètres actifs pour les agents vocaux
PhoneLLM Alpha 1 est un modèle ouvert de 30B en mélange d’experts, avec 3.5B paramètres actifs, conçu pour les agents vocaux téléphoniques et évalué avec le nouveau PhoneBench.