stamatios
← Voltar ao feed
Cogent apresenta VR-1, modelo de raciocínio para ciberataques autônomos
IA & Modelos · Agentes

Cogent apresenta VR-1, modelo de raciocínio para ciberataques autônomos

resumo de ~3 min

O que é o VR-1

A Cogent apresentou o VR-1, um modelo de raciocínio cibernético pós-treinado para investigar ambientes empresariais desconhecidos, compor fraquezas entre sistemas e verificar caminhos de ataque por execução. Diferente de modelos que apenas identificam vulnerabilidades, o VR-1 foi projetado para completar cadeias de intrusão reais - aquelas que atravessam infraestrutura de nuvem, sistemas de identidade, runtimes de aplicações, pipelines de CI/CD e documentação operacional.

No benchmark IntrusionBench (criado pela própria Cogent), o VR-1 obteve mais de 2× de melhoria em pass@3 sobre o baseline frontier mais forte, sob um limite de duas horas ou 250 turnos de agente. Os resultados são preliminares, baseados em um conjunto pequeno de tarefas.

O que significa "Mythos-class"

A Cogent usa o termo "Mythos-class" para descrever um limiar de capacidade específico: a transição entre encontrar vulnerabilidades e transformá-las em ameaças cibernéticas materiais. A referência é à distinção feita pela Anthropic entre seus modelos Claude e a linha Mythos. O VR-1 demonstra essa mesma transição qualitativa, mas em uma classe diferente de problema - raciocínio de longo horizonte através de sistemas empresariais, não exploração de binários ou descoberta de zero-days.

Trajetória representativa

O post descreve um exemplo sanitizado: partindo de um papel de deploy em CI/CD com o objetivo de recuperar o valor de uma fatura criptografada, o VR-1 mapeia permissões, descobre um papel assumível com acesso ao bucket de armazenamento, identifica que o objeto está criptografado com chave KMS, encontra uma chave de assinatura JWT exposta em uma interface de diagnóstico no runtime da aplicação, autentica-se em um serviço interno, consulta runbooks operacionais que revelam uma convenção de nome de sessão para um papel break-glass, e finalmente combina tudo para obter acesso à fatura e à chave de descriptografia. Nenhum achado isolado explica o resultado - a falha de segurança existe na composição.

Por que modelos gerais falham

A análise de trajetórias malsucedidas de modelos frontier gerais identificou quatro padrões de falha: permanecer local demais (não mudar de domínio técnico), perder estado útil descoberto cedo, aceitar resultados quase corretos como sucesso, e narrar o ataque em vez de executá-lo. O pós-treinamento do VR-1 mira especificamente essas falhas em nível de trajetória.

Metodologia e limitações

O IntrusionBench avalia raciocínio pós-exploração em três configurações: black-box (apenas foothold e objetivo), grey-box (informação parcial) e white-box (caminho revelado). A vantagem do VR-1 é maior em black-box e converge em white-box, sugerindo que o ganho vem de encontrar o caminho quando ele é desconhecido, não de conhecer mais comandos de exploração.

Limitações declaradas: o benchmark mede apenas cadeias de ataque pós-exploração empresariais; pass@3 não implica que toda trajetória tenha sucesso; os ambientes são controlados e autorizados, não produção real; e "Mythos-class" não equivale a igualdade com Mythos em todas as avaliações cibernéticas.