stamatios
← Voltar ao feed
Porta de cofre segura cérebro luminoso, metáfora dos modelos avançados retidos por segurança por Anthropic e OpenAI
IA & Modelos · Big Tech

Anthropic trava 'Model 2' por riscos; OpenAI adia Astra

resumo de ~3 min

Anthropic eleva a avaliação de risco

A Anthropic informou que não pretende lançar externamente um modelo interno chamado “Model 2”, descrito como mais poderoso que o Mythos, embora não esteja desacelerando de forma ampla suas atividades de desenvolvimento. O modelo apresentou melhora perceptível em várias tarefas internas e é usado intensivamente pela empresa, ao lado do Mythos 5, em programação, trabalho com agentes e geração de dados. A Anthropic afirmou que treina e avalia diversas versões exploratórias que não têm previsão de lançamento, e classificou o Model 2 como uma delas.

A decisão ocorre enquanto a empresa revisa para cima sua estimativa geral do risco de desalinhamento em situações de alto impacto: de “muito baixo” para “baixo”. A Anthropic atribuiu a mudança a incidentes recentes de cibersegurança. Segundo a empresa, os riscos dos danos mais graves associados a seus modelos continuam baixos, mas já não são tão baixos quanto na avaliação anterior.

O relatório também aponta sinais de aceleração na capacidade dos modelos de conduzir pesquisa e desenvolvimento automatizados. Esse avanço poderia contribuir para o progresso técnico, mas também poderia ser usado de forma indevida. No caso do Model 2, a empresa declarou ter menos confiança em sua avaliação do que em relatórios anteriores, porque suas avaliações mais concretas, baseadas em tarefas, já não capturam adequadamente os aumentos de capacidade dos modelos.

Comparação com a OpenAI

O texto relaciona a posição da Anthropic ao adiamento do modelo Astra, da OpenAI. A OpenAI estaria retardando seu lançamento porque ainda não consegue descartar a presença de capacidades cibernéticas críticas. Assim, as duas empresas adotam medidas de cautela diante de riscos diferentes: a Anthropic não planeja disponibilizar um modelo interno mais avançado, enquanto a OpenAI posterga o lançamento de um produto em desenvolvimento.

A Anthropic, porém, não anunciou uma pausa interna no desenvolvimento. O relatório afirma que o salto de desempenho do Model 2 não é equivalente ao avanço observado anteriormente entre Opus 4.6 e Mythos, embora o novo modelo continue sendo usado intensivamente dentro da empresa. Uma análise citada no texto avalia que, se as principais empresas de fronteira reduzirem o ritmo e a Anthropic continuar avançando internamente, a empresa poderia ganhar vantagem na corrida pela inteligência artificial geral. Essa é uma avaliação externa, não uma conclusão da Anthropic.

O quadro geral apresentado é de avanço simultâneo de capacidade e incerteza. A empresa continua pesquisando e testando modelos, mas reconhece que seus métodos atuais de avaliação podem estar deixando de acompanhar o ritmo das melhorias. Por isso, o não lançamento do Model 2 não representa uma interrupção geral do desenvolvimento, e sim a decisão de manter uma versão mais capaz restrita ao uso interno enquanto os riscos e as capacidades permanecem difíceis de medir com segurança.