Novas funcionalidades e inovações tecnológicas
-
Código aberto
FreeToken executa modelos MoE gigantes em GPUs de consumo
FreeToken usa execução CPU-GPU adaptativa e caching semântico para servir modelos MoE de 35B a 753B em hardware local.
-
Novos modelos
Qwen3.8-Max acelera a competição entre modelos open-weight
A Qwen apresenta o Qwen3.8-Max como novo patamar para programação e cowork, com pesos abertos num modelo da classe Qwen-Max.
-
Infraestrutura e chips
NVIDIA coloca Groq 3 LPX em produção para acelerar inferência de agentes
A NVIDIA colocou o Groq 3 LPX em produção com Vera Rubin para reduzir decode latency em agentes intensivos em tokens, com a Nebius como primeiro adotante cloud.
-
Investigação
Inherent treina Faraday 27B para replicar investigação
A Inherent treina o Faraday no Replica com coding agents para reproduzir resultados científicos, com ressalvas importantes no benchmark.
-
Infraestrutura e chips
Waymo revela chip de IA personalizado de 5 nm para os seus robotáxis
A Waymo revela um ASIC personalizado de 5 nm para processamento de sensores em robotáxis e uma arquitetura edge AI com silício especializado e comercial.
-
Novos modelos
Ant Ling abre seis checkpoints Ling 3.0 para treino de LLMs personalizados
A Ant Ling publica seis checkpoints Ling 3.0 em dois tamanhos e três fases de treino para pré-treino continuado e especialização de LLMs.