A Anthropic lançou o Claude Opus 5 em 24 de julho de 2026 com preços idênticos aos do Opus 4.8 e desempenho próximo ao do Fable 5. Por token, o Opus 5 custa exatamente a metade: US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída, contra US$ 10 e US$ 50 do Fable 5.
Se você usa Claude para programação, análise ou automação, este artigo responde o que mudou de verdade, quando o Opus 5 resolve e quando ainda vale pagar o dobro pelo Fable 5.
O que é o Claude Opus 5
O Opus 5 é o novo modelo padrão do Claude Max e a opção mais capaz disponível no Claude Pro. Ele ocupa o espaço entre o Sonnet 5 (mais barato) e o Fable 5 (mais autônomo), com foco em tarefas de longa duração: programação, trabalho corporativo e fluxos de agentes.
O que mudou no comportamento: o modelo faz perguntas antes de executar, questiona instruções mal definidas e revisa o próprio trabalho em vez de travar diante de um bloqueio. Isso reduz retrabalho em tarefas complexas e diminui o consumo total de tokens em situações de raciocínio intenso.
Preços reais: Opus 5 vs Fable 5 vs Sonnet 5
A tabela abaixo reúne os preços dos três modelos principais da Anthropic disponíveis via API em julho de 2026:
| Modelo | Entrada (US$/1M tokens) | Saída (US$/1M tokens) | Batch entrada | Batch saída |
|---|---|---|---|---|
| Sonnet 5 | US$ 2,00 * | US$ 10,00 * | US$ 1,00 | US$ 5,00 |
| Opus 5 | US$ 5,00 | US$ 25,00 | US$ 2,50 | US$ 12,50 |
| Fable 5 | US$ 10,00 | US$ 50,00 | — | — |
O Sonnet 5 tem reajuste confirmado para US$ 3,00/US$ 15,00 a partir de 1 de setembro de 2026.
Atenção: a diferença de 50% é sobre o preço por token, não sobre o custo total da tarefa. Se o Opus 5 precisar de mais tokens para resolver o mesmo problema que o Fable 5, a economia real pode ser menor. O custo final depende do tipo de tarefa, do nível de esforço configurado e do número de chamadas de ferramentas.
Cache de prompts e modo rápido
Tokens armazenados em cache custam US$ 0,50 por milhão, uma redução de 90% em relação à leitura normal. Para fluxos com contexto longo e reutilizável, como assistentes com instruções fixas ou pipelines com system prompts extensos, o custo efetivo cai de forma expressiva.
O modo rápido (Fast mode) está disponível em prévia apenas na API do Claude e custa cerca de 2,5 vezes o valor padrão. Ele prioriza velocidade de resposta para aplicações que precisam de latência baixa.
Especificações técnicas do Claude Opus 5
- Janela de contexto: 1 milhão de tokens (padrão e máximo, sem cobrança extra por contexto longo)
- Saída máxima: 128 mil tokens via API padrão; até 300 mil tokens via Batch API
- Velocidade: 47 tokens por segundo
- Latência inicial (TTFT): 2,8 segundos
- Corte de conhecimento: maio de 2026
- Identificador na API:
claude-opus-5 - Raciocínio (thinking): ativado por padrão
- Níveis de esforço: baixo, médio, alto e máximo
A janela de 1 milhão de tokens não tem cobrança extra por contexto longo. O preço por token de entrada é o mesmo para um prompt de 10 mil ou de 900 mil tokens, o que diferencia o Opus 5 de concorrentes que aplicam tarifas maiores acima de determinado limite.
O teto absoluto de custo em uma única requisição via Messages API é US$ 8,20: 1 milhão de tokens de entrada (US$ 5,00) mais 128 mil tokens de saída (US$ 3,20). Nenhuma chamada única ultrapassa esse valor.
O que melhorou em relação ao Opus 4.8
O preço é idêntico ao do Opus 4.8, mas o desempenho avançou. A Anthropic divulgou resultados de clientes que apontam:
- Ganho de 8% no desempenho geral sobre o Opus 4.8 (empresa Box)
- Melhora de 11% em análise de dados
- Avanço de 17% em due diligence
- Redução de 26% no consumo de tokens em raciocínio máximo (parceiro jurídico não identificado)
Esses dados foram produzidos por clientes da Anthropic e não passaram por auditoria independente. Nos benchmarks externos, o Opus 5 registrou 43,3% no Frontier-Bench SOTA e 30,2% no ARC-AGI-3.
Dois recursos novos em fase beta
Mid-conversation tool changes
Permite adicionar ou remover ferramentas disponíveis durante uma conversa em andamento sem invalidar o cache de prompt. Útil para fluxos de agentes que precisam adaptar as ferramentas conforme o estado da tarefa avança, sem pagar pelo recálculo do cache.
Automatic fallbacks
Quando um pedido é bloqueado pelos filtros de segurança, o sistema pode redirecionar automaticamente para outro modelo em vez de retornar erro, se a configuração estiver ativada. Reduz interrupções em pipelines automáticos sem exigir tratamento manual da exceção.
Como o Opus 5 funciona nos planos Claude
- Claude Max: Opus 5 é o modelo padrão
- Claude Pro: Opus 5 é a opção de maior capacidade disponível
- O modelo está incluído no plano, sem consumo de créditos extras para uso padrão
O Fable 5 está disponível no Claude Max e em planos específicos, mas consome créditos adicionais para projetos autônomos de longa duração. Quem usa Claude Pro e precisa do teto máximo de capacidade, o Opus 5 passa a ser a escolha padrão.
Onde o Opus 5 está disponível
O acesso já está ativo nas seguintes plataformas:
- API da Anthropic (identificador:
claude-opus-5) - Amazon Bedrock
- Google Cloud
- Microsoft Foundry
- claude.ai
- Claude Code
- Cowork
Onde o Fable 5 ainda tem vantagem
O Opus 5 não supera o Fable 5 em todos os cenários. O Fable 5 mantém desempenho superior em:
- Projetos autônomos que rodam por horas sem supervisão humana
- Tarefas com raciocínio em cadeia de altíssima complexidade
- Fluxos que exigem o teto absoluto de capacidade dentro da linha acessível da Anthropic
Acima do Fable 5 existe o Claude Mythos Preview, disponível apenas para organizações selecionadas no âmbito do Projeto Glasswing. Não está acessível ao público geral.
Quando usar o Opus 5 e quando usar o Fable 5
A escolha depende do tipo de trabalho:
- Opus 5: programação, análise de dados, redação longa, fluxos de agentes moderados e qualquer tarefa que precise de alta capacidade com custo controlado
- Fable 5: projetos que exigem raciocínio autônomo prolongado, decisões críticas de complexidade extrema ou quando o Opus 5 não entregar o resultado esperado nos seus próprios testes
- Sonnet 5: alto volume com tarefas que não exigem raciocínio profundo. Custa 40% do Opus 5 até setembro de 2026 e sobe para US$ 3,00/US$ 15,00 após esse período
Antes de definir qual modelo usar por padrão em produção, rode os dois nos seus próprios casos de uso. A diferença de desempenho varia bastante conforme o tipo de tarefa, e o custo total depende do consumo real de tokens em cada fluxo.
Comparação atualizada dos modelos da Anthropic
A Anthropic atualiza preços e disponibilidade com frequência. A tabela oficial com todos os modelos disponíveis na API fica em docs.anthropic.com/en/docs/about-claude/models/overview . Antes de definir orçamento, consulte diretamente a fonte.
Fonte: Anthropic

Com olhar atento às tendências de IA, segurança digital e ao mercado de dispositivos móveis, Jhonny Almeida transforma temas complexos em conteúdos claros e práticos. É responsável pela curadoria e pela precisão técnica dos artigos do Em Dia News, garantindo ao leitor informações sempre atualizadas e relevantes.
