A Anthropic lançou o Claude Opus 5 em 24 de julho de 2026 com preços idênticos aos do Opus 4.8 e desempenho próximo ao do Fable 5. Por token, o Opus 5 custa exatamente a metade: US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída, contra US$ 10 e US$ 50 do Fable 5.

Se você usa Claude para programação, análise ou automação, este artigo responde o que mudou de verdade, quando o Opus 5 resolve e quando ainda vale pagar o dobro pelo Fable 5.

O que é o Claude Opus 5

O Opus 5 é o novo modelo padrão do Claude Max e a opção mais capaz disponível no Claude Pro. Ele ocupa o espaço entre o Sonnet 5 (mais barato) e o Fable 5 (mais autônomo), com foco em tarefas de longa duração: programação, trabalho corporativo e fluxos de agentes.

O que mudou no comportamento: o modelo faz perguntas antes de executar, questiona instruções mal definidas e revisa o próprio trabalho em vez de travar diante de um bloqueio. Isso reduz retrabalho em tarefas complexas e diminui o consumo total de tokens em situações de raciocínio intenso.

Preços reais: Opus 5 vs Fable 5 vs Sonnet 5

A tabela abaixo reúne os preços dos três modelos principais da Anthropic disponíveis via API em julho de 2026:

ModeloEntrada (US$/1M tokens)Saída (US$/1M tokens)Batch entradaBatch saída
Sonnet 5US$ 2,00 *US$ 10,00 *US$ 1,00US$ 5,00
Opus 5US$ 5,00US$ 25,00US$ 2,50US$ 12,50
Fable 5US$ 10,00US$ 50,00

O Sonnet 5 tem reajuste confirmado para US$ 3,00/US$ 15,00 a partir de 1 de setembro de 2026.

Atenção: a diferença de 50% é sobre o preço por token, não sobre o custo total da tarefa. Se o Opus 5 precisar de mais tokens para resolver o mesmo problema que o Fable 5, a economia real pode ser menor. O custo final depende do tipo de tarefa, do nível de esforço configurado e do número de chamadas de ferramentas.

Cache de prompts e modo rápido

Tokens armazenados em cache custam US$ 0,50 por milhão, uma redução de 90% em relação à leitura normal. Para fluxos com contexto longo e reutilizável, como assistentes com instruções fixas ou pipelines com system prompts extensos, o custo efetivo cai de forma expressiva.

O modo rápido (Fast mode) está disponível em prévia apenas na API do Claude e custa cerca de 2,5 vezes o valor padrão. Ele prioriza velocidade de resposta para aplicações que precisam de latência baixa.

LER  Claude agora aprende tarefas só de assistir você trabalhar, sem precisar de prompt nenhum

Especificações técnicas do Claude Opus 5

  • Janela de contexto: 1 milhão de tokens (padrão e máximo, sem cobrança extra por contexto longo)
  • Saída máxima: 128 mil tokens via API padrão; até 300 mil tokens via Batch API
  • Velocidade: 47 tokens por segundo
  • Latência inicial (TTFT): 2,8 segundos
  • Corte de conhecimento: maio de 2026
  • Identificador na API: claude-opus-5
  • Raciocínio (thinking): ativado por padrão
  • Níveis de esforço: baixo, médio, alto e máximo

A janela de 1 milhão de tokens não tem cobrança extra por contexto longo. O preço por token de entrada é o mesmo para um prompt de 10 mil ou de 900 mil tokens, o que diferencia o Opus 5 de concorrentes que aplicam tarifas maiores acima de determinado limite.

O teto absoluto de custo em uma única requisição via Messages API é US$ 8,20: 1 milhão de tokens de entrada (US$ 5,00) mais 128 mil tokens de saída (US$ 3,20). Nenhuma chamada única ultrapassa esse valor.

O que melhorou em relação ao Opus 4.8

O preço é idêntico ao do Opus 4.8, mas o desempenho avançou. A Anthropic divulgou resultados de clientes que apontam:

  • Ganho de 8% no desempenho geral sobre o Opus 4.8 (empresa Box)
  • Melhora de 11% em análise de dados
  • Avanço de 17% em due diligence
  • Redução de 26% no consumo de tokens em raciocínio máximo (parceiro jurídico não identificado)

Esses dados foram produzidos por clientes da Anthropic e não passaram por auditoria independente. Nos benchmarks externos, o Opus 5 registrou 43,3% no Frontier-Bench SOTA e 30,2% no ARC-AGI-3.

Dois recursos novos em fase beta

Mid-conversation tool changes

Permite adicionar ou remover ferramentas disponíveis durante uma conversa em andamento sem invalidar o cache de prompt. Útil para fluxos de agentes que precisam adaptar as ferramentas conforme o estado da tarefa avança, sem pagar pelo recálculo do cache.

Automatic fallbacks

Quando um pedido é bloqueado pelos filtros de segurança, o sistema pode redirecionar automaticamente para outro modelo em vez de retornar erro, se a configuração estiver ativada. Reduz interrupções em pipelines automáticos sem exigir tratamento manual da exceção.

LER  Veo 3: a revolucionária ia do google para geração de vídeos realistas

Como o Opus 5 funciona nos planos Claude

  • Claude Max: Opus 5 é o modelo padrão
  • Claude Pro: Opus 5 é a opção de maior capacidade disponível
  • O modelo está incluído no plano, sem consumo de créditos extras para uso padrão

O Fable 5 está disponível no Claude Max e em planos específicos, mas consome créditos adicionais para projetos autônomos de longa duração. Quem usa Claude Pro e precisa do teto máximo de capacidade, o Opus 5 passa a ser a escolha padrão.

Onde o Opus 5 está disponível

O acesso já está ativo nas seguintes plataformas:

  • API da Anthropic (identificador: claude-opus-5)
  • Amazon Bedrock
  • Google Cloud
  • Microsoft Foundry
  • claude.ai
  • Claude Code
  • Cowork

Onde o Fable 5 ainda tem vantagem

O Opus 5 não supera o Fable 5 em todos os cenários. O Fable 5 mantém desempenho superior em:

  • Projetos autônomos que rodam por horas sem supervisão humana
  • Tarefas com raciocínio em cadeia de altíssima complexidade
  • Fluxos que exigem o teto absoluto de capacidade dentro da linha acessível da Anthropic

Acima do Fable 5 existe o Claude Mythos Preview, disponível apenas para organizações selecionadas no âmbito do Projeto Glasswing. Não está acessível ao público geral.

Quando usar o Opus 5 e quando usar o Fable 5

A escolha depende do tipo de trabalho:

  • Opus 5: programação, análise de dados, redação longa, fluxos de agentes moderados e qualquer tarefa que precise de alta capacidade com custo controlado
  • Fable 5: projetos que exigem raciocínio autônomo prolongado, decisões críticas de complexidade extrema ou quando o Opus 5 não entregar o resultado esperado nos seus próprios testes
  • Sonnet 5: alto volume com tarefas que não exigem raciocínio profundo. Custa 40% do Opus 5 até setembro de 2026 e sobe para US$ 3,00/US$ 15,00 após esse período

Antes de definir qual modelo usar por padrão em produção, rode os dois nos seus próprios casos de uso. A diferença de desempenho varia bastante conforme o tipo de tarefa, e o custo total depende do consumo real de tokens em cada fluxo.

Comparação atualizada dos modelos da Anthropic
A Anthropic atualiza preços e disponibilidade com frequência. A tabela oficial com todos os modelos disponíveis na API fica em docs.anthropic.com/en/docs/about-claude/models/overview . Antes de definir orçamento, consulte diretamente a fonte.

Fonte: Anthropic

Deixe um comentário