Código aberto
-
Investigação
Uno acelera a geração em LLM sem alterar a distribuição do modelo de referência
O Uno combina adaptadores de difusão com Ψ-Spec para paralelizar a descodificação mantendo a distribuição do modelo autorregressivo.
-
Investigação
PatchBench mostra por que um crash evitado não prova que a vulnerabilidade foi corrigida
O PatchBench mostra que uma única prova de conceito pode sobrevalorizar correções de vulnerabilidades produzidas por agentes e exige validação independente.
-
Negócios
NVIDIA confirma acordo para comprar a Hugging Face por 12,93 mil milhões de dólares
A NVIDIA confirma a compra da Hugging Face e promete uma plataforma aberta, multi-cloud e compatível com vários aceleradores. A neutralidade será o teste real.
-
Código aberto
Token Monitor reúne a utilização fragmentada de ferramentas de código com IA numa camada de observabilidade
O Token Monitor agrega utilização, custos e quotas de ferramentas de código com IA, mas a telemetria normalizada não substitui a faturação oficial.
-
Negócios
A Nvidia terá acordado comprar a Hugging Face por 12.9 billion dólares
Vários relatos apontam para um acordo da Nvidia para adquirir a Hugging Face por 12.9 billion dólares, negócio que poderia reconfigurar a distribuição de modelos abertos e a neutralidade das plataformas de IA.
-
Código aberto
O plano de rumo do FreeToken aponta para AMD, Apple Silicon e expansão multi-GPU
O plano de rumo 2026 do FreeToken visa ROCm para AMD, Metal para Apple Silicon, DGX Spark, vários GPU, modelos multimodais e descodificação especulativa, para além do apoio actual limitado à NVIDIA.
-
Novos modelos
A Tencent abre o Hy4 preview para programação de um milhão de tokens e sistemas de agentes
A Tencent publica o Hy4 preview com pesos Apache 2.0, janela de 1 milhão de tokens, percursos vLLM e SGLang e uma arquitectura MoE de 770 mil milhões de parâmetros vocacionada para engenharia de software.
-
Novos modelos
A Fermion lança o Phonon-1, um modelo de fala aberto de 415 MB para transcrição local
A Fermion publica o Phonon-1, um modelo inglês de reconhecimento de fala sob Apache 2.0, pensado para transcrição local em Apple Silicon e NVIDIA, com descarregamento de 415 MB.
-
Novos modelos
AMALIA disponibiliza modelo de português europeu com 9 mil milhões de parâmetros, janela 32K e via local
O projecto AMALIA publica um modelo aberto de português europeu com 9 mil milhões de parâmetros, janela 32K, treino SFT e DPO, recursos públicos de avaliação e disponibilização local com vLLM.
-
Novos modelos
A Pipecat lança o PhoneLLM, um modelo com 3.5B parâmetros ativos para agentes de voz
O PhoneLLM Alpha 1 é um modelo aberto de 30B do tipo mistura de especialistas, com 3.5B parâmetros ativos, feito para agentes de voz telefónicos e avaliado com o novo PhoneBench.