Anthropic amplia acesso a IA para identificar falhas de segurança
Novo programa reúne iniciativas da empresa e prevê três níveis de acesso para equipes e organizações verificadas.
Em resumo
- Anthropic reuniu iniciativas de segurança em três níveis de acesso.
- Os modelos serão disponibilizados a equipes e organizações verificadas.
- Parceiros do Project Glasswing identificaram ao menos 129 mil vulnerabilidades.
A Anthropic ampliou o acesso de equipes verificadas a modelos de inteligência artificial voltados à identificação de vulnerabilidades, resposta a incidentes e testes de segurança. A mudança reúne iniciativas anteriores em uma versão reformulada do Cyber Verification Program (CVP), com três níveis de acesso e diferentes exigências de verificação.
Três níveis de acesso
O nível Defense é destinado a atividades defensivas, como análise de malware, resposta a incidentes e investigação de falhas.
O nível Red Team permite também testes de invasão autorizados e exercícios de red teaming. Nesse caso, a participação é restrita a organizações. Já a categoria Specialized terá menos restrições e será oferecida a um grupo pequeno de organizações autorizadas a testar sistemas considerados críticos, incluindo redes elétricas, sistemas de aviação e infraestrutura usada em transferências interbancárias.
Segundo a Anthropic, os participantes de todas as categorias passarão por processos de verificação, conduzidos pela empresa em conjunto com o governo dos Estados Unidos. Os três níveis incluem acesso aos modelos Claude Opus 5.5, Claude Sonnet 5.5 e Claude Mythos 5.1, além de futuros modelos da companhia.
Resultados de busca por vulnerabilidades
A reformulação combina o CVP original, que permitia a equipes previamente verificadas usar versões com menos proteções dos modelos Claude Opus e Sonnet, com o Project Glasswing. Essa iniciativa oferecia a organizações responsáveis pela segurança de softwares críticos acesso ao Claude Mythos, família de modelos da Anthropic com capacidades avançadas de cibersegurança.
A empresa informou que parceiros do Glasswing identificaram pelo menos 129 mil vulnerabilidades verificadas entre abril e julho de 2026. Mais de 33 mil foram classificadas como críticas ou de alta gravidade.
A Anthropic estima que os números reais possam ser pelo menos cinco vezes maiores. A companhia ressalvou que os dados do Project Glasswing foram obtidos a partir de uma pesquisa com apenas parte dos parceiros, o que limita a dimensão dos resultados apresentados.
Controles para o uso dos modelos
Por isso, o acesso com menos proteções não será aberto a qualquer usuário: a empresa prevê diferentes controles conforme o nível de participação e a verificação dos candidatos.