Claude Opus 5: metade do preço do Fable 5 com janela de 1 milhão de tokens

Última atualização em 9 de agosto de 2026 às 21:41A Anthropic lançou o Claude Opus 5 em 24 de julho de 2026 com preços idênticos ...

Leia mais

Foto do autor

Por Jhonny Almeida

Última atualização em 9 de agosto de 2026 às 21:41

A Anthropic lançou o Claude Opus 5 em 24 de julho de 2026 com preços idênticos aos do Opus 4.8 e desempenho próximo ao do Fable 5. Por token, o Opus 5 custa exatamente a metade: US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída, contra US$ 10 e US$ 50 do Fable 5.

Se você usa Claude para programação, análise ou automação, este artigo responde o que mudou de verdade, quando o Opus 5 resolve e quando ainda vale pagar o dobro pelo Fable 5.

O que é o Claude Opus 5

O Opus 5 é o novo modelo padrão do Claude Max e a opção mais capaz disponível no Claude Pro. Ele ocupa o espaço entre o Sonnet 5 (mais barato) e o Fable 5 (mais autônomo), com foco em tarefas de longa duração: programação, trabalho corporativo e fluxos de agentes.

O que mudou no comportamento: o modelo faz perguntas antes de executar, questiona instruções mal definidas e revisa o próprio trabalho em vez de travar diante de um bloqueio. Isso reduz retrabalho em tarefas complexas e diminui o consumo total de tokens em situações de raciocínio intenso.

Preços reais: Opus 5 vs Fable 5 vs Sonnet 5

A tabela abaixo reúne os preços dos três modelos principais da Anthropic disponíveis via API em julho de 2026:

ModeloEntrada (US$/1M tokens)Saída (US$/1M tokens)Batch entradaBatch saída
Sonnet 5US$ 2,00 *US$ 10,00 *US$ 1,00US$ 5,00
Opus 5US$ 5,00US$ 25,00US$ 2,50US$ 12,50
Fable 5US$ 10,00US$ 50,00

O Sonnet 5 tem reajuste confirmado para US$ 3,00/US$ 15,00 a partir de 1 de setembro de 2026.

Atenção: a diferença de 50% é sobre o preço por token, não sobre o custo total da tarefa. Se o Opus 5 precisar de mais tokens para resolver o mesmo problema que o Fable 5, a economia real pode ser menor. O custo final depende do tipo de tarefa, do nível de esforço configurado e do número de chamadas de ferramentas.

Cache de prompts e modo rápido

Tokens armazenados em cache custam US$ 0,50 por milhão, uma redução de 90% em relação à leitura normal. Para fluxos com contexto longo e reutilizável, como assistentes com instruções fixas ou pipelines com system prompts extensos, o custo efetivo cai de forma expressiva.

LER  Grok 4.1: A atualização revolucionária da xAI que chegou e a surpresa que mudou tudo

O modo rápido (Fast mode) está disponível em prévia apenas na API do Claude e custa cerca de 2,5 vezes o valor padrão. Ele prioriza velocidade de resposta para aplicações que precisam de latência baixa.

Especificações técnicas do Claude Opus 5

  • Janela de contexto: 1 milhão de tokens (padrão e máximo, sem cobrança extra por contexto longo)
  • Saída máxima: 128 mil tokens via API padrão; até 300 mil tokens via Batch API
  • Velocidade: 47 tokens por segundo
  • Latência inicial (TTFT): 2,8 segundos
  • Corte de conhecimento: maio de 2026
  • Identificador na API: claude-opus-5
  • Raciocínio (thinking): ativado por padrão
  • Níveis de esforço: baixo, médio, alto e máximo

A janela de 1 milhão de tokens não tem cobrança extra por contexto longo. O preço por token de entrada é o mesmo para um prompt de 10 mil ou de 900 mil tokens, o que diferencia o Opus 5 de concorrentes que aplicam tarifas maiores acima de determinado limite.

O teto absoluto de custo em uma única requisição via Messages API é US$ 8,20: 1 milhão de tokens de entrada (US$ 5,00) mais 128 mil tokens de saída (US$ 3,20). Nenhuma chamada única ultrapassa esse valor.

O que melhorou em relação ao Opus 4.8

O preço é idêntico ao do Opus 4.8, mas o desempenho avançou. A Anthropic divulgou resultados de clientes que apontam:

  • Ganho de 8% no desempenho geral sobre o Opus 4.8 (empresa Box)
  • Melhora de 11% em análise de dados
  • Avanço de 17% em due diligence
  • Redução de 26% no consumo de tokens em raciocínio máximo (parceiro jurídico não identificado)

Esses dados foram produzidos por clientes da Anthropic e não passaram por auditoria independente. Nos benchmarks externos, o Opus 5 registrou 43,3% no Frontier-Bench SOTA e 30,2% no ARC-AGI-3.

Dois recursos novos em fase beta

Mid-conversation tool changes

Permite adicionar ou remover ferramentas disponíveis durante uma conversa em andamento sem invalidar o cache de prompt. Útil para fluxos de agentes que precisam adaptar as ferramentas conforme o estado da tarefa avança, sem pagar pelo recálculo do cache.

Automatic fallbacks

Quando um pedido é bloqueado pelos filtros de segurança, o sistema pode redirecionar automaticamente para outro modelo em vez de retornar erro, se a configuração estiver ativada. Reduz interrupções em pipelines automáticos sem exigir tratamento manual da exceção.

LER  MeDo da Baidu: a ferramenta que vai revolucionar o no-code

Como o Opus 5 funciona nos planos Claude

  • Claude Max: Opus 5 é o modelo padrão
  • Claude Pro: Opus 5 é a opção de maior capacidade disponível
  • O modelo está incluído no plano, sem consumo de créditos extras para uso padrão

O Fable 5 está disponível no Claude Max e em planos específicos, mas consome créditos adicionais para projetos autônomos de longa duração. Quem usa Claude Pro e precisa do teto máximo de capacidade, o Opus 5 passa a ser a escolha padrão.

Onde o Opus 5 está disponível

O acesso já está ativo nas seguintes plataformas:

  • API da Anthropic (identificador: claude-opus-5)
  • Amazon Bedrock
  • Google Cloud
  • Microsoft Foundry
  • claude.ai
  • Claude Code
  • Cowork

Onde o Fable 5 ainda tem vantagem

O Opus 5 não supera o Fable 5 em todos os cenários. O Fable 5 mantém desempenho superior em:

  • Projetos autônomos que rodam por horas sem supervisão humana
  • Tarefas com raciocínio em cadeia de altíssima complexidade
  • Fluxos que exigem o teto absoluto de capacidade dentro da linha acessível da Anthropic

Acima do Fable 5 existe o Claude Mythos Preview, disponível apenas para organizações selecionadas no âmbito do Projeto Glasswing. Não está acessível ao público geral.

Quando usar o Opus 5 e quando usar o Fable 5

A escolha depende do tipo de trabalho:

  • Opus 5: programação, análise de dados, redação longa, fluxos de agentes moderados e qualquer tarefa que precise de alta capacidade com custo controlado
  • Fable 5: projetos que exigem raciocínio autônomo prolongado, decisões críticas de complexidade extrema ou quando o Opus 5 não entregar o resultado esperado nos seus próprios testes
  • Sonnet 5: alto volume com tarefas que não exigem raciocínio profundo. Custa 40% do Opus 5 até setembro de 2026 e sobe para US$ 3,00/US$ 15,00 após esse período

Antes de definir qual modelo usar por padrão em produção, rode os dois nos seus próprios casos de uso. A diferença de desempenho varia bastante conforme o tipo de tarefa, e o custo total depende do consumo real de tokens em cada fluxo.

Comparação atualizada dos modelos da Anthropic
A Anthropic atualiza preços e disponibilidade com frequência. A tabela oficial com todos os modelos disponíveis na API fica em docs.anthropic.com/en/docs/about-claude/models/overview . Antes de definir orçamento, consulte diretamente a fonte.

Fonte: Anthropic

Deixe um comentário