Investigação
-
Investigação
Painéis fabricados podem levar agentes LLM a agir sobre resultados incognoscíveis
Um estudo reproduzível no arXiv conclui que painéis de aparência autoritária fabricados podem empurrar alguns agentes LLM a agir sobre resultados incognoscíveis, apesar de reconhecerem a incerteza.
-
Investigação
A openJiuwen transforma o arnês do agente de programação numa camada de sistemas mensurável
A openJiuwen propõe um arnês componível e adaptativo em tempo de execução para agentes de programação e mostra por que auditorias de referência com modelo emparelhado importam para a engenharia de agentes.
-
Investigação
Agentes de IA em autoevolução podem transformar experiências envenenadas em habilidades persistentes
Uma nova pesquisa mostra que agentes de autoevolução podem armazenar interações envenenadas como habilidades reutilizáveis, tornando a proveniência, validação e reversão de habilidades parte do limite de segurança.
-
Investigação
AdaptRubric cria critérios de sucesso específicos para cada tarefa de agentes GUI
O AdaptRubric cria rubricas específicas por tarefa para agentes GUI e reporta ganhos em F1 e no sucesso após reinforcement learning.
-
Investigação
Recuris melhora agentes de longo horizonte ao fazer evoluir a memória
O Recuris mantém o LLM base congelado e evolui Working Memory e Experiential Memory, com ganhos reportados em benchmarks de agentes de longo horizonte.
-
Código aberto
FreeToken executa modelos MoE gigantes em GPUs de consumo
FreeToken usa execução CPU-GPU adaptativa e caching semântico para servir modelos MoE de 35B a 753B em hardware local.
-
Investigação
Inherent treina Faraday 27B para replicar investigação
A Inherent treina o Faraday no Replica com coding agents para reproduzir resultados científicos, com ressalvas importantes no benchmark.
-
Novos modelos
Ant Ling abre seis checkpoints Ling 3.0 para treino de LLMs personalizados
A Ant Ling publica seis checkpoints Ling 3.0 em dois tamanhos e três fases de treino para pré-treino continuado e especialização de LLMs.
-
Investigação
OpenAI anuncia dez avanços em matemática e informática teórica
A OpenAI publicou dez avanços de investigação em matemática e informática teórica. Os resultados abrangem áreas como geometria, criptografia e complexidade computacional. Fonte OpenAI Research — Ten advances in mathemati…