Anthropic reduz filtros do Claude para pesquisadores de cibersegurança
A empresa reformulou seu programa de verificação e liberou modelos como Claude Opus 5.5 e Mythos 5.1 para análise de malware, testes de invasão e busca por falhas críticas.
Por que importa. Equipes de segurança de software ganham acesso direto a modelos potentes sem bloqueios padrão de recusa, acelerando a auditoria de código e a correção de vulnerabilidades antes que atacantes as explorem.
A Anthropic anunciou a expansão do Cyber Verification Program (CVP), iniciativa que concede a profissionais e organizações verificadas acesso a modelos de inteligência artificial com travas de segurança reduzidas. O objetivo é permitir tarefas defensivas avançadas, como análise de malware, engenharia reversa de falhas e resposta a incidentes, atividades habitualmente bloqueadas nas versões públicas do Claude.
A nova versão do programa unifica duas frentes anteriores da companhia: o Project Glasswing, voltado a softwares críticos com a linha Claude Mythos, e o CVP original, que atendia equipes corporativas com versões menos restritivas do Claude Opus e do Claude Sonnet. Agora, os participantes aprovados podem utilizar modelos como Opus 5.5, Sonnet 5.5 e Mythos 5.1 sob uma estrutura comum de governança.
Três níveis de acesso e verificação estatal
O programa foi dividido em três categorias com exigências progressivas. O nível Defense contempla empresas, governos, universidades, operadores de infraestrutura, mantenedores de código aberto e pesquisadores independentes para atuação estritamente defensiva. O nível Red Team autoriza apenas organizações a conduzirem simulações de ataques e testes de intrusão autorizados.
Já o nível Specialized é reservado a sistemas de alta sensibilidade, como redes elétricas, controle de tráfego aéreo e infraestrutura bancária. Segundo a Anthropic, os candidatos desse grupo passam por triagem conduzida em conjunto com o governo dos Estados Unidos para mitigar riscos de desvio de uso da tecnologia.
Milhares de falhas identificadas em testes prévios
Os dados colhidos no Project Glasswing serviram de base para a abertura do programa. Entre abril e julho de 2026, parceiros da iniciativa identificaram ao menos 129 mil vulnerabilidades confirmadas, das quais mais de 33 mil foram categorizadas como de gravidade alta ou crítica. A própria Anthropic descobriu outras 5,5 mil falhas em varreduras de código aberto.
A desenvolvedora avalia que o impacto prático pode ser pelo menos cinco vezes superior, já que os números refletem apenas um recorte dos participantes. Relatos citados pela empresa apontam que o uso da IA acelerou em meses o trabalho rotineiro de auditoria e correção em bases de código complexas.
Fontes
- The Decoder: Anthropic gives more security teams access to Claude with fewer safety restrictions
- Olhar Digital: Anthropic libera IA mais poderosa para equipes que caçam falhas antes de hackers
Reportagem produzida pela redação do Flipters com apoio de inteligência artificial, a partir das fontes acima. Como trabalhamos.
