NVIDIA et Microsoft ont présenté le 7 octobre une nouvelle génération de PC Windows conçus pour faire fonctionner des modèles d'IA volumineux et des agents persistants directement sur l'appareil. La plateforme RTX Spark associe un processeur Grace à un GPU Blackwell RTX. Les précommandes des portables ont commencé, pour une commercialisation prévue le 16 octobre, tandis que les petits ordinateurs de bureau sont attendus en novembre. Les deux groupes ont aussi montré un aperçu de DGX Station pour Windows.

RTX Spark combine jusqu'à 20 cœurs CPU Grace et 6 144 cœurs GPU, avec une liaison annoncée à 600 Go/s. NVIDIA évoque jusqu'à 128 Go de mémoire unifiée et un pétaflop de calcul FP4. Ces valeurs correspondent aux configurations maximales et à un format numérique de faible précision; elles ne garantissent ni la même capacité sur tous les modèles ni un débit d'inférence particulier. L'objectif est de traiter des données et des modèles localement plutôt que de recourir systématiquement au cloud.

Le Surface Laptop Ultra de Microsoft figure parmi les premiers produits, aux côtés de machines Acer, ASUS, Dell, HP, Lenovo, MSI et Gigabyte. Selon The Verge, les prix américains commencent à 2 599 dollars et montent jusqu'à environ 5 900 dollars. La version d'entrée de gamme ne dispose pas des 128 Go mis en avant pour la plateforme. PCWorld confirme que cette première vague vise avant tout le haut de gamme.

Côté logiciel, Microsoft annonce la disponibilité générale de Microsoft Execution Containers, ou MXC, un mécanisme Windows permettant d'exécuter durablement des agents sous le contrôle du système d'exploitation. NVIDIA met en avant l'association de CUDA, de la puissance locale et de cette isolation. Mais l'exécution sur un PC n'est pas automatiquement moins chère ou plus sûre qu'un service distant: la consommation, les permissions et les usages restent déterminants.

NVIDIA a également dévoilé une préversion de DGX Station pour Windows. Équipé d'un GB300 Grace Blackwell Ultra, ce système promet 748 Go de mémoire cohérente et jusqu'à 20 pétaflops FP4. NVIDIA estime qu'il pourrait accueillir localement des modèles approchant le billion de paramètres. Il ne s'agit pas encore d'une disponibilité générale, et pouvoir charger un modèle ne signifie pas obtenir une latence exploitable.

Cette annonce fait de l'IA locale une catégorie matérielle Windows à part entière. Les questions ouvertes portent sur le prix, les performances soutenues des portables, la compatibilité logicielle et la protection des agents ayant accès aux fichiers. Les journalistes indépendants confirment les produits et leurs prix, pas l'ensemble des projections de performance des fabricants.

Références