Open source
-
FreeToken exécute des modèles MoE géants sur des GPU grand public
FreeToken combine exécution CPU-GPU adaptative et cache sémantique pour servir des modèles MoE de 35B à 753B sur du matériel local.
-
Les modèles chinois prennent les trois premières places d’OpenRouter
DeepSeek, Tencent et Xiaomi dominent les volumes hebdomadaires OpenRouter, signalant un changement majeur dans l’usage réel des développeurs.
-
Le système de prompts GPT Image 2 dépasse 11 000 étoiles et devient un Agent Skill
awesome-gpt-image-2 évolue vers un système Prompt-as-Code et un Agent Skill, signe d'une demande pour une infrastructure de prompts d'image réutilisable.
-
Ant Ling ouvre six checkpoints Ling 3.0 pour entraîner des LLM sur mesure
Ant Ling publie six checkpoints Ling 3.0 répartis entre deux tailles et trois étapes d’entraînement pour le préentraînement continu et la spécialisation.
-
Qwen3.8-Max renforce la compétition des modèles open-weight
Qwen présente Qwen3.8-Max comme un nouveau niveau pour le code et le cowork, avec l'ouverture des poids d'un modèle Qwen-Max.
-
Nvidia paie 6 Md$ pour licencier la Model Factory de Poolside
Nvidia aurait conclu une licence de 6 milliards de dollars pour Model Factory, avec 1 milliard d’investissement et des offres à 109 employés.