Segurança e ética
-
Investigação
Atualizações de hooks podem criar execução fora do controlo direto do modelo
O estudo HookPry mostra por que razão hooks executáveis exigem revisão de permissões, privilégio mínimo e proveniência de execução em plataformas de agentes.
-
Investigação
Variações em APIs partilhadas podem invalidar critérios de produção baseados em avaliadores LLM
Auditoria pré-registada mostra como instabilidade em serviços LLM partilhados pode fragilizar critérios de aprovação e exige qualificação do avaliador.
-
Investigação
PatchBench mostra por que um crash evitado não prova que a vulnerabilidade foi corrigida
O PatchBench mostra que uma única prova de conceito pode sobrevalorizar correções de vulnerabilidades produzidas por agentes e exige validação independente.
-
Investigação
A elevação de privilégios do contexto revela uma nova fronteira de segurança dos agentes
Um estudo de 12 estruturas de agentes mostra como o contexto pode ganhar autoridade e porque a proveniência precisa de controlo determinístico em execução.
-
Novos modelos
GPT-6 Astra chega à produção com acesso gradual e controlos reforçados de cibersegurança
A OpenAI lança o GPT-6 Astra com acesso gradual, nível cyber Critical e proteções de execução que podem interromper tarefas.
-
Novos modelos
Astra usa uma técnica que pode tornar mais difícil acompanhar o raciocínio do modelo
Astra utilizará profundidade recorrente, segundo as reportagens, enquanto a OpenAI reforça a monitorização. O caso mostra a necessidade de controlos independentes.
-
Agentes
GitHub dá às aprovações do Copilot peso real na integração de código
Uma aprovação do Copilot pode agora contar antes da integração, com controlos por empresa, repositório e caminhos de ficheiros.
-
Agentes
GitHub alarga a exclusão de conteúdos no Copilot, mas o controlo continua parcial
A aplicação Copilot e a CLI aplicam exclusões, mas a GitHub ainda documenta limitações em modos com agentes e em alguns sistemas de ficheiros.
-
Investigação
Verificadores baratos podem esconder erros nas cascatas de IA
Investigação mostra porque o encaminhamento e a monitorização de qualidade não devem depender do mesmo verificador sem auditoria independente.
-
Agentes
Falcon Guardian leva a segurança dos agentes de IA para a execução
O Falcon Guardian liga prompts e chamadas a ferramentas às ações nos equipamentos e acrescenta controlos em tempo de execução para agentes de IA.