Agentes
-
Investigação
GuardedAct separa a proposta da IA da autorização para agir em produção
GuardedAct avalia uma arquitetura em que correções propostas por um LLM passam por simulação e controlo de risco antes de serem executadas.
-
Agentes
Atlassian automatiza no Jira o percurso do backlog até ao pedido de integração, com aprovação humana
A Atlassian leva circuitos persistentes de agentes ao Jira, com controlos de contexto, normas, revisão automática e decisão humana na integração.
-
Novos modelos
GPT-Live-1 chega à API e separa a conversa do trabalho delegado
O GPT-Live-1 leva voz full duplex à API e delega raciocínio, exigindo controlo explícito de cancelamento, permissões e custo por tarefa.
-
Investigação
DeFiFlowBench mostra que um fluxo de agente correto pode executar uma transação insegura
O DeFiFlowBench mostra que um fluxo DeFi aparentemente válido pode executar uma transação insegura e defende limites externos no momento da execução.
-
Investigação
EBL-Core separa a aprovação de um agente da autoridade efetiva para executar
O EBL-Core propõe revalidar ação, políticas, provas e contexto quando um agente de IA exerce autoridade de alto risco, e não apenas quando recebe aprovação.
-
Investigação
Agentes ultrapassam limites quando as regras de autorização desaparecem do contexto
Um estudo da Tencent Zhuque associa falhas de controlo à perda de regras de autorização durante a gestão do contexto, não à compactação por si só.
-
Agentes
OpenAI passa a disponibilizar o mecanismo de agentes do Codex como serviço gerido
A Agents API separa a coordenação gerida do Codex do ambiente onde o agente executa tarefas, alterando a fronteira de responsabilidade da infraestrutura.
-
Agentes
Relatório da Anthropic mostra IA integrada em ciclos operacionais de ataque
O relatório da Anthropic de setembro de 2026 descreve Claude em operações maliciosas de várias etapas e reforça a necessidade de proteger todo o ciclo dos agentes.
-
Agentes
GitHub permite entregar até 25 correções de Code Quality ao Copilot de uma só vez
O GitHub permite atribuir até 25 ocorrências Code Quality ao Copilot, tornando revisão, integração e consumo de créditos pontos de controlo centrais.
-
Indústria
Red Hat AI 3.5 leva a governação para a infraestrutura, mas nem tudo está pronto para produção
O Red Hat AI 3.5 torna o EvalHub GA e reforça identidade e recursos, mas algumas funções de observabilidade continuam em Technology Preview.