A NVIDIA e a Microsoft apresentaram a 7 de outubro uma nova geração de computadores Windows preparados para executar modelos de IA e agentes persistentes no próprio equipamento. A plataforma central chama-se RTX Spark e combina um processador Grace com uma GPU Blackwell RTX. As pré-encomendas dos portáteis abriram no evento, com disponibilidade prevista para 16 de outubro; os desktops compactos deverão chegar em novembro. Foi ainda apresentada uma versão preliminar de DGX Station para Windows.

RTX Spark integra até 20 núcleos de CPU Grace e uma GPU com até 6 144 núcleos, com ligação de 600 GB/s entre componentes. A NVIDIA anuncia até 128 GB de memória unificada e um petaflop de cálculo FP4. Estes valores são máximos da plataforma e não representam a configuração de todos os portáteis, nem garantem uma determinada velocidade de inferência. A proposta é permitir executar modelos grandes sem enviar necessariamente os dados para a cloud.

O Surface Laptop Ultra é um dos primeiros equipamentos anunciados, juntamente com propostas de Acer, ASUS, Dell, HP, Lenovo, MSI e Gigabyte. Segundo o The Verge, o preço norte-americano começa nos 2 599 dólares e as versões superiores aproximam-se dos 5 900 dólares. O modelo base não inclui os 128 GB anunciados como máximo. A PCWorld confirmou que a primeira geração é claramente orientada para o segmento premium.

No software, a Microsoft anunciou a disponibilidade geral de Microsoft Execution Containers, ou MXC, para executar agentes de forma persistente sob controlos do sistema operativo. A combinação de aceleração local, ferramentas CUDA e isolamento pretende tornar o computador pessoal uma plataforma para agentes. Isso não demonstra, por si só, que a execução local seja sempre mais barata ou segura; tudo depende do modelo, dos acessos e da carga de trabalho.

Para necessidades maiores, a NVIDIA mostrou uma pré-visualização de DGX Station para Windows, com GB300 Grace Blackwell Ultra, 748 GB de memória coerente e até 20 petaflops FP4. A empresa afirma que esta classe de equipamento poderá suportar modelos próximos de um bilião de parâmetros, mas trata-se de uma pré-visualização, não de disponibilidade geral. Carregar um modelo também não equivale a executá-lo com latência adequada.

A iniciativa aproxima a IA local do mercado Windows, mas persistem dúvidas sobre preços, desempenho sustentado em portáteis, compatibilidade e segurança de agentes com acesso contínuo a ficheiros e aplicações. As especificações e projeções vêm dos fabricantes; a cobertura independente confirma os lançamentos, não todas as promessas de desempenho.

Referências