Modelos de IA

Anthropic apresenta Claude Fable 5.1 e Mythos 5.1 com acesso restrito

A Anthropic apresentou Claude Fable 5.1 e Claude Mythos 5.1 para programação, trabalho de conhecimento e pesquisa científica, com novos preços e salvaguardas.

Publicado Atualizado
AnthropicClaudeModelos de IA

A Anthropic apresentou em 1º de setembro o Claude Fable 5.1 e o Claude Mythos 5.1, posicionando os modelos como uma grande atualização para programação, trabalho de conhecimento, tarefas agênticas de longa duração e pesquisa científica. As duas versões usam o mesmo modelo subjacente, mas chegam com diferentes níveis de salvaguardas. O Fable 5.1 está disponível de forma geral, enquanto o Mythos 5.1 fica limitado a programas de acesso confiável, com proteções projetadas para cibersegurança avançada e ciências da vida.

O anúncio combina mudanças de desempenho, preço e segurança. A Anthropic disse que o Fable 5.1 custará cerca de 25% menos que o Fable 5 em cargas típicas cobradas por token, graças à redução no preço de leituras de cache. Em trabalhos altamente agênticos, a economia pode frequentemente chegar a aproximadamente 45%. Essa mudança é relevante porque modelos de fronteira são cada vez mais usados em tarefas longas que leem grandes repositórios, documentos e saídas de ferramentas ao longo de muitas etapas. Custos menores de cache podem fazer a diferença entre usar um modelo avançado apenas na revisão final e usá-lo como o sistema principal que conduz o trabalho da pesquisa à implementação.

A Anthropic também apresentou o Fable 5.1 como avanço de desempenho. A empresa relatou resultados superiores aos do Fable 5 em benchmarks como Terminal-Bench-Science, Terminal-Bench, Humanity’s Last Exam, OSWorld, AutomationBench e CursorBench. Também citou feedback de parceiros de acesso antecipado, incluindo Jane Street, Cognition, Millennium, MongoDB, Red Hat, Rakuten, Block, Ramp, Canva, Hebbia e Plaid. Os exemplos destacam comportamento prático de agentes: encontrar a causa raiz de falhas raras de software, construir protótipos durante execuções de vários dias, revisar mudanças complexas de código e identificar novas direções de pesquisa. O ponto da Anthropic não é apenas que o modelo pontua melhor, mas que consegue sustentar trabalhos longos com raciocínio, comunicação e execução melhores.

A parte científica do lançamento chama atenção. A Anthropic disse que o modelo contribuiu para tarefas como desenho de ligantes de proteínas, análise computacional e otimização de desempenho de modelos biológicos. Em um exemplo, o Claude Fable 5.1 treinou uma rede neural para criar um mapa de elevação de maior resolução de cerca de um terço de Vênus, usando imagens de radar da missão Magellan da NASA e cartografia anterior. Segundo a empresa, o novo mapa melhora o detalhe de 10 a 20 quilômetros para dois a três quilômetros e estima alturas com até 25% mais precisão. Em biologia computacional, o Mythos 5.1 acelerou sete modelos abertos de deep learning em até 2,5 vezes com kernels GPU personalizados e cache de resultados intermediários, reduzindo custos estimados de GPU em algumas análises genômicas entre 30% e 60%.

Essas capacidades vêm com controles mais rígidos. A Anthropic afirmou que o Mythos 5.1 tem as capacidades cibernéticas mais fortes entre os modelos que já lançou, embora permaneça em uma categoria de menor risco no Frontier Compliance Framework da companhia. A empresa também descreveu testes de riscos químicos e biológicos, resistência a prompt injection e comportamento de alinhamento. O Mythos 5.1 manterá salvaguardas que restringem acesso a capacidades de biologia de pesquisa, e a Anthropic disse que um programa de acesso para trabalhos avançados de biologia foi desenvolvido com o governo dos Estados Unidos. Para o Fable 5.1, as salvaguardas de cibersegurança ficam mais precisas, permitindo identificar vulnerabilidades para defesa e redirecionando tarefas mais arriscadas de duplo uso, como geração de exploits e testes de penetração, para modelos Opus.

O lançamento também se liga ao Enterprise Frontier Safeguards, nova abordagem da Anthropic para oferecer a clientes empresariais monitoramento mais forte e privacidade semelhante a zero retenção de dados. Clientes elegíveis poderão usar Fable 5.1 e Fable 5 com zero retenção até que o EFS seja implantado em fases neste outono. No conjunto, a notícia mostra que empresas de modelos de fronteira estão reunindo capacidade, custo e governança em uma só decisão de produto. O Fable 5.1 pretende tornar o trabalho agêntico avançado mais barato e útil; o Mythos 5.1 mostra que as capacidades mais sensíveis serão cada vez mais distribuídas por acesso controlado, não por lançamento amplo.