A Anthropic está expandindo um programa que permite que especialistas em cibersegurança verificados testem seus modelos de inteligência artificial mais poderosos com menos restrições de segurança. Isso ocorre após a iniciativa Project Glasswing ajudar a descobrir mais de cem mil vulnerabilidades em software este ano.
Parceiros no âmbito do Glasswing, um programa focado na segurança do software mais crítico do mundo, descobriram pelo menos 129.000 vulnerabilidades confirmadas entre abril e julho. Além disso, a varredura própria de código aberto da Anthropic identificou mais 5.500 vulnerabilidades entre abril e outubro.
Mais de 33.000 dessas vulnerabilidades foram classificadas como críticas ou de alta severidade. A Anthropic observa que esses números provavelmente estão subestimados e espera que o dano real seja pelo menos cinco vezes maior, visto que os dados foram obtidos através de uma pesquisa com um número limitado de parceiros.
O Programa de Verificação Cibernética (Cyber Verification Program, CVP) atualizado, anunciado na terça-feira, combina dois programas que a Anthropic conduziu nos últimos seis meses. O primeiro, Glasswing, fornecia às organizações que trabalham na segurança de software crítico acesso ao Claude Mythos — a linha de modelos mais resiliente ciberneticamente da Anthropic. O segundo, o CVP original, concedia a equipes de segurança verificadas restrições reduzidas nos modelos Claude Opus e Sonnet.
Anteriormente, em abril, a apresentação do Claude Mythos Preview levantou preocupações de que a IA pudesse invadir software antes que ele fosse protegido. O novo programa inclui três níveis, cada um com seus próprios requisitos de verificação e medidas de controle de segurança. Todos os três níveis garantem acesso aos modelos Claude Opus 5.5, Sonnet 5.5, Mythos 5.1 e futuros modelos.
O nível Defense é destinado a tarefas como análise de malware e resposta a incidentes. Equipes de segurança, operadores de infraestrutura crítica, desenvolvedores de código aberto e pesquisadores com experiência em relatar vulnerabilidades podem se inscrever. O nível Red Team prevê testes de penetração autorizados e a realização de 'red teams', mas apenas organizações podem se inscrever. O nível Especializado tem as menores restrições e é reservado para um pequeno grupo de organizações autorizadas a testar sistemas críticos de segurança, como redes de energia, sistemas de aviação e infraestrutura de transferências interbancárias. A Anthropic realiza uma verificação de cada participante em conjunto com o governo dos EUA, e os participantes existentes do Glasswing migram para este nível.

