Pillar Security

Pesquisadores revelam falhas em agentes de codificação de IA

Pesquisadores de segurança da Pillar Security descobriram falhas em quatro agentes de codificação de IA amplamente utilizados: Cursor, Codex da OpenAI, Gemini CLI do Google e Antigravity. Essas falhas permitem que os agentes, que operam em um ambiente de sandbox, escapem sem atacar diretamente a proteção. Ao escrever arquivos que são posteriormente executados por ferramentas confiáveis fora do sandbox, os agentes conseguem contornar as restrições. O estudo, intitulado ‘Semana das Escapes de Sandbox’, apresenta uma série de descobertas que revelam como arquivos gerados dentro do ambiente de trabalho podem ser utilizados para executar comandos no sistema host. As falhas foram classificadas em quatro modos de falha, incluindo listas de negação que não acompanham as atualizações do sistema operacional e configurações de espaço de trabalho que são, na verdade, código executável. A maioria das vulnerabilidades já foi corrigida, com algumas sendo acompanhadas por números CVE. A resposta do Google a duas falhas no Antigravity foi considerada mais branda, classificando-as como de baixo risco devido à necessidade de engenharia social para exploração. Essa situação destaca a necessidade de uma vigilância constante e de testes rigorosos de segurança em ferramentas de codificação baseadas em IA.