Agentes
-
Novos modelos
Gemini 3.8 Live mantém o trabalho ativo depois de uma resposta falada
O Gemini 3.8 Live Extended Thinking acrescenta raciocínio em segundo plano e ferramentas assíncronas, exigindo novo controlo do estado da interação.
-
Novos modelos
Jev troca a geração livre por decisões tipificadas dentro do software
O Jev da TypeSafe AI foi criado para decisões estruturadas rápidas; as alegações de velocidade, custo e calibração ainda precisam de validação independente.
-
Agentes
Grok Bot Galaxy leva agentes persistentes ao trabalho real, sem provar ainda a sua fiabilidade
O Grok Bot Galaxy mostra agentes persistentes em processos reais de várias equipas. Aipolix analisa o que o evento demonstra e o que ainda não permite concluir.
-
Agentes
Copilot passa a privilegiar custo ou qualidade, mas Efficiency não é um teto de despesa
O Copilot Auto passa a ter Efficiency, Balance e Intelligence, mas o custo continua a depender do modelo efetivamente selecionado.
-
Agentes
Copado dá acesso ao pipeline via MCP local, mas mantém aprovações obrigatórias
O Agentia Headless liga agentes ao ciclo de entrega via MCP e CLI, mantendo aprovações, controlos de qualidade e estado oficial fora do modelo.
-
Investigação
K-Bench mostra que a desaprendizagem de um agente pode esconder fugas fora da resposta final
O K-Bench mostra que testes à resposta final podem falhar dados ainda presentes na recuperação, ferramentas e estado de execução.
-
Investigação
Benchmark TAM expõe limites do GPT-5 na execução de procedimentos longos e regulados
No TAM, configurações GPT-5 atingiram 1% de correspondência exata em ICD e 15,5% nos cálculos de pena.
-
Agentes
Agente de dados da OpenAI leva análise empresarial ao ChatGPT Work, mas sem referência pública de precisão
O agente de dados da OpenAI respeita permissões empresariais e cria painéis, mas sem teste público de precisão a governação semântica e a avaliação continuam essenciais.
-
🧾 Código criado por agentes de IA: como provar a sua origem? (7/10)
Como provar a origem do código gerado por agentes: assinaturas, versões de prompts e modelos, autoria estruturada e provas entre serviços e fornecedores.
-
🛑 Sem contenção, a governação de IA falha quando mais importa (6/10)
Paragem independente, raio de impacto, rollback, canários comportamentais e recuperação: as capacidades necessárias para conter agentes de IA.