A Mistral anunciou o Mistral Large 4, um novo modelo de topo com o nome informal “Le Chonk”, cujos pesos completos deverão ser disponibilizados publicamente a 27 de outubro. A empresa francesa revelou o modelo numa conferência em Abu Dhabi, a 6 de outubro, e está a conceder acesso antecipado limitado a especialistas em cibersegurança e a entidades governamentais antes da disponibilização mais ampla, segundo a Reuters e o The Wall Street Journal.
A distinção temporal é importante: o Large 4 ainda não é um lançamento público convencional. Neste momento, os programadores não podem descarregar os pesos finais, consultar uma ficha técnica definitiva do modelo nem reproduzir de forma independente as alegações de desempenho e segurança da Mistral. O anúncio de hoje corresponde, portanto, a uma apresentação e fase de acesso controlado; o marco efetivamente «pesos abertos» está previsto para o final do mês.
A informação publicada por meios independentes descreve o Large 4 como um modelo multimodal com arquitetura de mistura de especialistas (MoE), com cerca de 1 bilião de parâmetros no total e aproximadamente 49 mil milhões ativos por token. A Axios indica que o treino decorreu durante cerca de dois meses em 4.000 GPUs Nvidia Grace Blackwell instaladas em centros de dados europeus da Mistral. O The Wall Street Journal também refere um treino com 4.000 GPUs. Esta configuração aumentaria de forma substancial a capacidade total face à geração anterior da Mistral, mantendo apenas uma parte dos parâmetros ativa durante a inferência, para evitar o custo computacional de executar um modelo denso de um bilião de parâmetros em cada token.
A Mistral apresenta o modelo como uma alternativa de pesos abertos de gama alta tanto aos sistemas fechados norte-americanos como aos modelos abertos chineses, cada vez mais competitivos. A Reuters relata que a empresa atribui ao Large 4 um desempenho particularmente forte em cibersegurança e capacidades para tarefas de programação, finanças, análise geoespacial e desenho de chips. A Mistral afirma ainda que os seus mecanismos de contenção resistiram a tentativas de fazer o modelo escapar ao ambiente de teste. Estas afirmações continuam a ser declarações da empresa reproduzidas pela imprensa, e não resultados de benchmarks ou testes de segurança independentes.
Para organizações interessadas em IA soberana ou instalada em infraestrutura própria, a consequência operacional pode ser relevante. Um modelo europeu forte com pesos públicos pode dar a empresas e organismos públicos maior controlo sobre a localização da execução, a inspeção do modelo e a escolha de infraestrutura. Mas «pesos abertos» não significa barato: 49 mil milhões de parâmetros ativos continuam a exigir muita memória de acelerador, interligações de elevada largura de banda e otimização cuidada para utilização em produção.
O principal motivo para acompanhar o Large 4 não é, por isso, uma alegada liderança num benchmark, mas a mudança potencial na fronteira de controlo. Se a Mistral publicar os pesos a 27 de outubro em condições que permitam uma utilização prática, as equipas poderão testar o modelo com o seu próprio código, dados e cenários de segurança, em vez de dependerem de demonstrações do fornecedor. Até lá, qualquer comparação com outros modelos abertos de topo deve ser considerada provisória.
No momento desta verificação, a página oficial de notícias da Mistral ainda não apresentava um artigo ou uma ficha técnica dedicada ao Large 4. Reuters, The Wall Street Journal e Axios noticiaram de forma independente o anúncio e detalhes de lançamento amplamente consistentes. A licença exata, os ficheiros descarregáveis e um pacote de benchmarks reproduzível deverão ser confirmados novamente quando os pesos públicos forem disponibilizados.