List of Best

Anthropic lança Fable 5.1 para uso amplo enquanto Mythos 5.1 permanece restrito

Table of contents5

Um modelo, dois limites operacionais

A Anthropic anunciou o Claude Fable 5.1 e o Claude Mythos 5.1 em 01-09-2026. As configurações utilizam pesos de modelo idênticos. A diferença está na camada de salvaguardas que envolve o modelo subjacente, fazendo com que a política de acesso seja parte da definição do produto e não apenas uma nota de rodapé.

O Fable 5.1 está disponível para usuários pagantes do Claude e via web, aplicativo móvel, desktop, Cowork, Claude Code, Claude Design, Microsoft 365, Tag, API do Claude e plataformas de nuvem. O Mythos 5.1 não é um lançamento geral aberto: o acesso direto é restrito a organizações verificadas e programas de confiança, incluindo atualmente um conjunto de entidades norte-americanas.

Para equipes que criam agentes de IA, a decisão se resume a qual salvaguarda e limite de acesso atendem melhor ao fluxo de trabalho.

O preço transforma o esforço em uma superfície de controle

A Anthropic precifica o Fable 5.1 e o Mythos 5.1 em $10 por milhão de tokens de entrada e $50 por milhão de tokens de saída. Leituras de cache custam $0.25 por milhão de tokens, uma queda de 75% em relação à tarifa anterior de $1; as gravações em cache permanecem inalteradas. Como são cobranças baseadas em tokens, planos ou marketplaces em nuvem podem exibir a fatura em formatos distintos.

O Fable 5.1 adiciona níveis de esforço selecionáveis: low, medium, high, xhigh e max. A Anthropic recomenda o nível high como padrão e afirma que low ou medium podem trocar uma fração de capacidade por menor custo, alcançando resultados equivalentes ou superiores ao Fable 5 em suas avaliações. A Anthropic projeta ainda economia de cerca de 25% em cargas de trabalho típicas e de até aproximadamente 45% em tarefas complexas e altamente agênticas, com base em quatro semanas de uso prático em agosto de 2026 sob esforço padrão.

Gráfico de precisão versus custo no Terminal-Bench 4.0 fornecido por usuário, comparando Mythos 5.1, Fable 5.1 e Mythos 5 em diferentes níveis de esforço.

Considere esses dados como uma hipótese de teste, não como garantia orçamentária. Monitore leituras de cache e esforço em relação à taxa de sucesso, tentativas adicionais, latência, volume de saída e custo por fluxo de trabalho concluído.

Uma alteração relacionada de limites requer igual rigor. Um informativo oficial do ClaudeDevs esclarece que, quando o acréscimo temporário de 50% expirar em 13-09-2026 e o aumento permanente de 25% sobre a linha de base entrar em vigor em 14-09-2026, haverá uma redução líquida de 17% em comparação aos valores de hoje nos limites semanais do Claude Code para Pro, Max, Team e Enterprise por assento. Trata-se de uma comparação específica sobre os limites semanais do Claude Code, e não de um corte geral sobre todos os limites de mensagens do Claude.

Os benchmarks apontam uma direção, não um veredito

A Anthropic reporta o Fable 5.1 com 52.6% no Terminal-Bench-Science 0.1, contra 24.7% do Fable 5, 29.0% do Opus 5 e 22.4% do GPT-5.6 Sol. No Terminal-Bench 4.0, as marcas divulgadas são de 55.8% para o Fable 5.1, 42.0% para o Fable 5, 60.9% para o Mythos 5.1, 52.3% para o Opus 5 e 37.3% para o GPT-5.6 Sol.

Tabela comparativa de benchmarks fornecida por usuário listando Fable 5.1, Fable 5, Opus 5 e GPT-5.6 Sol em testes de ciências, programação, trabalho cognitivo e uso do computador.

Esses números refletem avaliações internas do próprio provedor antes do lançamento e não comprovam superioridade de maneira independente. O Terminal-Bench-Science opera com margem de erro padrão de ±3.5–4.5 pontos por modelo. A Anthropic também ressalta que o OSWorld utiliza um lote de tarefas de agosto de 2026 que não é comparável diretamente às versões anteriores, e que proteções de produção e sistemas de contingência podem alterar os resultados.

Salvaguardas delimitadas, não reduções universais de recusas

Segundo a Anthropic, usuários do Claude Code podem esperar cerca de 60% menos intervenções de cibersegurança por sessão do que sob as salvaguardas do Fable 5. O relatório também aponta que os filtros de biologia do Fable 5.1 disparam 85% menos vezes diante de solicitações básicas e inofensivas de biologia ou saúde. Nenhuma das taxas representa uma redução indiscriminada de 60% ou 85% nas recusas entre produtos. Demandas profissionais de duplo uso em ciências biológicas continuam sendo canalizadas para o Opus ou acessos de confiança.

O cartão do sistema (system card) documenta auditorias externas, totalizando cerca de 74 horas e mais de 6.500 requisições conduzidas pela Trajectory Labs, apontando 11 potenciais quebras de segurança sem qualquer exploit funcional de ponta a ponta atribuível apenas ao Fable 5.1. Também foi registrado um incidente de baixa gravidade envolvendo vulnerabilidade de sandbox com o Mythos 5.1 durante os testes externos. Esse histórico reforça a necessidade de manter visível o limite de acesso, em vez de presumir que o lançamento seja livre de riscos.

A decisão para quem cria agentes

O Fable 5.1 atende a equipes que necessitam de ampla disponibilidade e espaço para testes de custo. Estabeleça com precisão a superfície do modelo, o nível de esforço, o comportamento de cache e a janela de limites do Claude Code. Calcule o custo por fluxo concluído com sucesso em tarefas de controle; trate a economia e os índices apontados pela Anthropic como parâmetros a serem reproduzidos.

O Mythos 5.1 ocupa uma linha de avaliação separada. O Cyber Verification Program destina-se a operações de segurança defensiva, enquanto o Life Sciences Verification Program é um beta fechado por convite para pesquisadores que operam o Mythos 5.1 com salvaguardas específicas para pesquisa avançada. O Project Glasswing é um contexto relacionado de defesa cibernética, não um sinônimo de ambos os programas.

Os textos gerados pelo Fable 5.1 e pelo Mythos 5.1 incluem uma marca d’água estatística e invisível. A Anthropic afirma que essa tecnologia não consome tokens adicionais e dispensa dados de identificação; sua detecção opera em prévia privada. O recurso pode ter relevância para equipes estruturando verificações de conformidade e procedência, mas não dispensa controles de acesso, testes de estresse operacional nem validações independentes.