Investigação
Uno acelera a geração em LLM sem alterar a distribuição do modelo de referência
O Uno combina adaptadores de difusão com Ψ-Spec para paralelizar a descodificação mantendo a distribuição do modelo autorregressivo.
O Uno combina adaptadores de difusão com Ψ-Spec para paralelizar a descodificação mantendo a distribuição do modelo autorregressivo.