Infraestrutura e chips
-
Novos produtos
NVIDIA PAIR distribui pedidos de IA entre vários computadores locais
O PAIR distribui pedidos locais de IA por vários PC e Mac, mas não agrega memória gráfica nem reparte um único modelo por várias máquinas.
-
Código aberto
Soup 0.74 corrige carregamento em fp32 que aumentava a memória no treino LoRA
O Soup 0.74.0 corrige carregamento fp32 desnecessário, reporta uma forte redução de memória num H100 e reforça controlos de segurança.
-
Investigação
Uno acelera a geração em LLM sem alterar a distribuição do modelo de referência
O Uno combina adaptadores de difusão com Ψ-Spec para paralelizar a descodificação mantendo a distribuição do modelo autorregressivo.
-
Agentes
Catalyst 3.0 dá aos agentes acesso controlado à infraestrutura cloud
A Zoho liga agentes de programação ao Catalyst através de MCP, com permissões dedicadas, registos de ferramentas e alterações reversíveis.
-
Código aberto
O plano de rumo do FreeToken aponta para AMD, Apple Silicon e expansão multi-GPU
O plano de rumo 2026 do FreeToken visa ROCm para AMD, Metal para Apple Silicon, DGX Spark, vários GPU, modelos multimodais e descodificação especulativa, para além do apoio actual limitado à NVIDIA.
-
Infraestrutura e chips
A EuroHPC fecha 387.8 milhões de euros para a capacidade pública do LUMI-AI
O LUMI-AI acrescentará capacidade pública de computação de IA com aceleradores AMD para startups, PME e investigadores europeus, com arquitectura de vários inquilinos e acesso por API previstos para 2027.
-
Novos produtos
Perplexity leva o agente Computer para hardware NVIDIA local
Portable Computer executa modelos, orquestração, pesquisa local e ferramentas sandboxed no NVIDIA DGX Spark com escalada cloud opcional.
-
Infraestrutura e chips
OpenAI coloca o chip de inferência Jalapeño no mapa dos benchmarks
Os primeiros benchmarks do Jalapeño mostram ganhos de performance por watt e latência face aos atuais sistemas Nvidia Blackwell.
-
Código aberto
FreeToken executa modelos MoE gigantes em GPUs de consumo
FreeToken usa execução CPU-GPU adaptativa e caching semântico para servir modelos MoE de 35B a 753B em hardware local.
-
Os centros de dados de IA estão a aproximar-se da energia, não apenas dos utilizadores
Os dados da JLL sugerem que novos projetos europeus de hiperescala estão mais longe dos grandes polos, enquanto a energia, o terreno e o acesso à rede redefinem a geografia da infraestrutura de IA.