Programa reformulado expande testes com menos restrições em inteligência artificial após identificar milhares de falhas.

A Anthropic decidiu ampliar nesta terça-feira um programa estratégico que permite a profissionais de segurança digital testarem seus modelos de inteligência artificial mais avançados com menos barreiras de proteção, buscando reforçar a segurança de softwares críticos globalmente.

A iniciativa ocorre após o sucesso do chamado Projeto Glasswing, que ajudou parceiros credenciados a identificarem mais de 100 mil vulnerabilidades de software ao longo deste ano, revelando a eficácia da colaboração entre humanos e IA na identificação antecipada de falhas cibernéticas.

A expansão do programa visa acelerar a correção de códigos vulneráveis em setores essenciais, conforme informação divulgada por money, consolidando uma nova abordagem para o desenvolvimento seguro de tecnologias de inteligência artificial no mercado tecnológico atual.

Ampliação do programa de verificação cibernética

O novo Programa de Verificação Cibernética (CVP) unifica duas iniciativas anteriores da Anthropic, oferecendo acesso controlado aos modelos Claude Opus, Sonnet e Mythos para organizações dedicadas à proteção de infraestruturas críticas e mantenedores de código aberto.

Durante o período entre abril e julho, os parceiros envolvidos identificaram pelo menos 129 mil vulnerabilidades confirmadas, enquanto a varredura automatizada da própria empresa encontrou mais 5.500 falhas em códigos abertos, demonstrando a escala do problema tecnológico.

Níveis de segurança e restrições de acesso

O programa reformulado conta com três níveis distintos de verificação, sendo o nível Defesa voltado para resposta a incidentes, o nível Red Team focado em simulações de ataques, e o nível Specialized reservado para testar sistemas vitais como redes de energia e aviação.

A empresa avalia cada membro participante em conjunto com o governo dos Estados Unidos, garantindo que o acesso a modelos potentes como o Claude Mythos 5.1 ocorra sob rigorosos critérios de segurança e conformidade institucional rigorosa.

Impacto estimado e subestimação de falhas

Das mais de 33.000 falhas já classificadas como críticas ou de alta gravidade, a Anthropic ressalta que os números atuais estão subestimados, projetando que o impacto real seja pelo menos cinco vezes maior devido à amostragem limitada de parceiros.

Essa disparidade reforça a necessidade urgente de expansão contínua das ferramentas de inteligência artificial para o monitoramento preventivo de ameaças em larga escala, ajudando empresas do setor a antecipar riscos cibernéticos complexos.

Perguntas Frequentes

O que é o Programa de Verificação Cibernética da Anthropic?

É uma iniciativa reformulada que permite a profissionais de segurança credenciados testar modelos avançados de inteligência artificial com menos restrições para identificar vulnerabilidades de software.

Quantas vulnerabilidades foram encontradas pelos parceiros do projeto?

Os parceiros identificaram pelo menos 129 mil vulnerabilidades confirmadas entre abril e julho, além de mais 5.500 falhas encontradas pela varredura automatizada da própria empresa.

Quais modelos de IA estão disponíveis no novo programa?

O programa inclui acesso aos modelos Claude Opus 5.5, Sonnet 5.5, Mythos 5.1 e versões futuras, divididos em três níveis de segurança chamados Defesa, Red Team e Specialized.