Claude Opus 5: Inteligência de Topo a Preço de Meio

Anthropic lança Claude Opus 5: mesma faixa de preço do Opus 4.8, performance de Fable
A Anthropic lançou o Claude Opus 5 em 24 de julho de 2026. A notícia não é o benchmark. O novo modelo flagship da Anthropic empata ou supera o Fable 5 em coding agentivo e knowledge work, custa cerca de um terço do preço (US$ 5 por milhão de tokens de entrada, US$ 25 por milhão de saída), e estreou como número 1 no Artificial Analysis Intelligence Index. A curva preço-inteligência do mercado enterprise acaba de se comprimir, e a conta de quem roteia milhões de tokens por mês mudou.
O que aconteceu
O Claude Opus 5 está disponível desde 24 de julho de 2026 em todas as plataformas da Anthropic: apps Claude, Claude Code e API, com o mesmo preço do Opus 4.8. A Anthropic descreve o Claude Opus 5 como um modelo com inteligência próxima à do Fable 5 por cerca de um terço do custo. A afirmação não é marketing. Os números sustentam.
No Frontier-Bench v0.1, o Claude Opus 5 supera todos os outros modelos e mais que dobra a performance do Opus 4.8, com custo menor por tarefa. No CursorBench 3.2, fica a 0,5 ponto percentual do pico do Fable 5, entregando esse resultado pela metade do custo por tarefa. No ARC-AGI-3, avaliação de resolução de problemas inéditos, alcançou 30,2%. O score é três vezes a pontuação do segundo colocado. No GDPval-AA, novo estado da arte. No Zapier AutomationBench, a taxa de aprovação do Claude Opus 5 é aproximadamente 1,5 vez a do próximo melhor modelo para o mesmo custo por tarefa. No OSWorld 2.0, benchmark de computer use, o Claude Opus 5 supera todos os modelos em qualquer faixa de custo. Ultrapassa o melhor resultado do Fable 5 por cerca de um terço do custo.
Mais um dado. A Olimpíada Internacional de Matemática de 2026 (IMO 2026): o Claude Opus 5 acertou 42 de 42 questões, segundo a Anthropic. O threshold para medalha de ouro era 29.
Em ciências da vida, o Claude Opus 5 supera o Opus 4.8 em todas as avaliações internas da Anthropic. Química orgânica: +10,2 pontos percentuais. Predição de função de proteína a partir de sequência: +7,7 pontos percentuais.
A Anthropic também anunciou dois recursos beta. Mudanças de ferramenta no meio da conversa preservam o cache de prompt no Claude Platform. Fallbacks automáticos na API permitem que requisições bloqueadas pelos classificadores de segurança do Claude Opus 5 sejam roteadas automaticamente para outro modelo.
Quanto a alinhamento, o Claude Opus 5 registrou 2,3 no score de comportamento desalinhado da auditoria comportamental automatizada da Anthropic. É o valor mais baixo entre todos os modelos recentes da companhia. Em cibersegurança, o Claude Opus 5 empata com o Mythos 5 na identificação de vulnerabilidades, mas fica muito atrás na escrita de exploits. No benchmark OSS-Fuzz da Anthropic, o Claude Opus 5 encontra bugs com eficácia comparável ao Mythos 5 e produz exploits com eficácia materialmente inferior.
O Claude Opus 5 não exige retenção de dados para acesso geral, mesma política dos modelos Opus anteriores.
Por que isso importa
O mercado de modelos de IA está dividido em duas prateleiras desde que o Fable 5 estabeleceu o teto de preço. A prateleira de cima cobra US$ 15 a US$ 25 por milhão de tokens de entrada e entrega performance de fronteira. A prateleira de baixo cobra US$ 2 a US$ 5 e entrega performance competitiva, com gap visível em tarefas complexas. O Claude Opus 5 colapsa essa divisão.
Com US$ 5 de entrada e US$ 25 de saída, o Claude Opus 5 entrega performance que, em múltiplos benchmarks independentes, empata ou supera modelos que custam o triplo. O custo por tarefa no Artificial Analysis Intelligence Index coloca o Claude Opus 5 na faixa mais atraente do gráfico de dispersão: alta inteligência, baixo custo por unidade de trabalho.
A implicação para o CFO é direta. Uma operação que gasta US$ 100 mil por mês em tokens com um modelo de fronteira pode, com a migração para o Claude Opus 5, cortar a conta de inferência em até dois terços sem perda mensurável de qualidade em coding, knowledge work e tarefas agentivas. A matemática é simples, mas exige que o CFO avalie modelos por custo por tarefa, não por score técnico. O Benchmark de LLMs para CFOs detalha o método. Para o CTO, o cálculo é mais fino. O Claude Opus 5 fica atrás do Mythos 5 em cibersegurança ofensiva e atrás do Fable 5 em tarefas de pesquisa biológica de longa duração. Vence, porém, nas dimensões que respondem pela maior parte do volume de tokens em produção: coding, automação, knowledge work e computer use.
O precedente importa. A Anthropic repetiu com o Claude Opus 5 a estratégia que fez do Claude Sonnet o modelo mais adotado em produção: precificar um modelo de alta inteligência na faixa do mid-tier e mudar a pergunta do comprador. É a mesma dinâmica que analisamos na guerra pelo share de tokens entre DeepSeek V4 e os modelos estabelecidos: o preço comprime, o volume migra, e quem não recalcula a regra de roteamento paga mais pelo mesmo trabalho. A pergunta do comprador não é mais "qual modelo é o mais inteligente". A pergunta é "qual modelo entrega a inteligência que meu caso de uso exige pelo menor custo". O Claude Opus 5 reposiciona a régua dessa pergunta.
O que muda na prática
A tabela abaixo mostra as mudanças concretas que o Claude Opus 5 introduz em sete dimensões críticas para quem roda IA em produção: preço, performance, custo por tarefa, capacidade de raciocínio inédito, computer use, roteamento de segurança e gerenciamento de cache. Em cada linha, o regime anterior à esquerda, o novo regime à direita.
| Dimensão | Antes do Claude Opus 5 | Depois do Claude Opus 5 |
|---|---|---|
| Preço de entrada no tier de inteligência de fronteira | US$ 15 a US$ 25 por milhão de tokens (preço Fable) | US$ 5 por milhão de tokens, mesma faixa do Opus 4.8 |
| Performance em coding agentivo (Frontier-Bench, CursorBench) | Fable 5 como teto isolado | Claude Opus 5 empata ou fica a 0,5 pp do Fable 5 |
| Custo por tarefa para knowledge work de alta complexidade | Dominado por modelos de US$ 15+ de entrada | Claude Opus 5 lidera o GDPval-AA com custo inferior |
| ARC-AGI-3 (problemas inéditos) | Segundo colocado na faixa de ~10% | Claude Opus 5 a 30,2%, três vezes o segundo |
| Computer use (OSWorld 2.0) | Fable 5 com o melhor resultado absoluto | Claude Opus 5 supera Fable 5 por ~1/3 do custo |
| Roteamento de safety (API) | Requisição bloqueada = falha | Fallback automático para outro modelo (beta) |
| Mudança de ferramenta no meio da conversa | Invalidava o cache de prompt | Cache preservado (beta) |
O que fazer agora
O lançamento do Claude Opus 5 muda a conta de custo e a estratégia de roteamento de qualquer time que opere modelos de fronteira em produção. Abaixo, três decisões que o lançamento aciona imediatamente, com o contexto que justifica cada uma.
-
Recalcule o custo por tarefa, não o custo por token. O preço de tabela do Claude Opus 5 é idêntico ao do Opus 4.8, mas o Claude Opus 5 gera menos tokens para resolver a mesma tarefa em múltiplos cenários (a própria Anthropic reporta 26% menos tokens em média em relação ao Opus 4.8 em relação ao Opus 4.8 em uso jurídico, e um cliente reportou um sétimo dos tokens de reasoning com latência inferior à metade). Migrar do Opus 4.8 para o Claude Opus 5 mantém o preço por token e reduz o custo por tarefa. Migrar de um modelo de fronteira mais caro reduz ambos.
-
Teste o Claude Opus 5 no seu benchmark interno antes de decidir. Os benchmarks públicos mostram empate ou vitória do Claude Opus 5 contra o Fable 5 em coding, knowledge work e automação. O seu caso de uso pode estar na faixa em que o Fable 5 ainda lidera, ou na faixa em que o Claude Opus 5 lidera com folga. A única resposta correta é testar com as suas tarefas, no seu domínio, com a sua definição de sucesso. O CTO da Box reportou ganhos de 11% em análise de dados e 17% em due diligence com o Claude Opus 5 sobre o Opus 4.8. O seu número será diferente.
-
Se o Claude Opus 5 vencer o teste, recalcule o modelo de roteamento. Times que operam um gateway de IA podem adicionar o Claude Opus 5 ao pool de modelos e configurar regras de roteamento que priorizem o Claude Opus 5 para coding, knowledge work e automação, reservando o modelo de fronteira mais caro para as tarefas em que a diferença de performance justifica o custo. A migração não exige reescrever integração: o Claude Opus 5 expõe a mesma API do Opus 4.8.
-
Para times no Brasil, inclua o spread cambial e os encargos de importação na conta. O preço de US$ 5 por milhão de tokens de entrada é o preço de tabela em dólar. A remessa internacional, o spread cambial e os encargos de importação elevam o custo efetivo em até 55% para empresas brasileiras que contratam diretamente. Um gateway com faturamento local em real e nota fiscal elimina essa sobrecamada, e a diferença percentual é a mesma independentemente do preço de tabela do modelo. Com o Claude Opus 5 a US$ 5, o custo total desembolsado no modelo direto fica em torno de US$ 7,75 por milhão de tokens. Com faturamento local, fica em US$ 5.
Perguntas frequentes
O Claude Opus 5 substitui o Fable 5?
Em coding, knowledge work, automação e computer use, o Claude Opus 5 empata ou supera o Fable 5 por metade do preço. Em cibersegurança ofensiva, o Mythos 5 permanece à frente. Em tarefas de pesquisa biológica autônoma de longa duração, o Fable 5 ainda lidera. A resposta depende do caso de uso, e a recomendação é testar com as suas tarefas antes de substituir.
O preço do Claude Opus 5 é o mesmo do Opus 4.8. O que mudou economicamente?
O preço por token não mudou. O que mudou é a inteligência por token. O Claude Opus 5 resolve as mesmas tarefas que o Opus 4.8 com menos tokens, menos chamadas de ferramenta e menos tempo. O custo por tarefa caiu porque o modelo é mais eficiente, não porque o preço de tabela baixou.
O Claude Opus 5 exige retenção de dados?
Não. A política é a mesma dos Opus anteriores. O Claude Opus 5 não tem requisitos de retenção de dados para acesso geral.
O ARC-AGI-3 a 30,2% é um resultado relevante para uso empresarial?
O ARC-AGI-3 mede a capacidade de resolver problemas que o modelo nunca viu antes, sem depender de memorização. Para uso empresarial, um score alto no ARC-AGI-3 sinaliza que o Claude Opus 5 generaliza melhor em situações inéditas. Exatamente o tipo de situação que aparece quando um agente encontra uma edge case em produção ou quando um analista pede uma análise que não tem paralelo nos dados de treino. É relevante. Três vezes o score do segundo colocado é uma diferença que merece atenção.
O que esperar
O Claude Opus 5 chega três dias depois de uma sequência de lançamentos de fronteira que colocaram seis laboratórios acima de 50 no Artificial Analysis Intelligence Index. A diferença do Claude Opus 5 para os demais lançamentos da quinzena está na dimensão em que compete. Não compete só na inteligência. Compete na dimensão que o comprador empresarial prioriza: inteligência por dólar.
A Anthropic construiu o Claude Opus 5 como um modelo que roda no Claude Max como default e no Claude Pro como o modelo mais forte disponível. Não é um modelo de vitrine. É um modelo de volume, posicionado para ser o cavalo de batalha de times que rodam agentes, revisam código e automatizam workflows.
Para times que já usam o Nexforce Router, o Claude Opus 5 entra no pool de modelos disponíveis e pode ser testado em paralelo com o modelo atual sem alterar uma linha de código. O ranking em tempo real do Router atualiza a posição do Claude Opus 5 conforme os benchmarks independentes evoluem, e a regra de roteamento pode ser ajustada para direcionar coding e knowledge work ao Claude Opus 5 enquanto mantém o modelo de fronteira mais caro para as tarefas em que a diferença se paga. O faturamento em real elimina a sobrecamada cambial que encarece o custo por token para empresas brasileiras. Para o CTO que está recalculando o custo por tarefa depois do dia 24 de julho, o Claude Opus 5 é a primeira variável a inserir na planilha.
Referências e Leitura Complementar
- Anthropic, "Introducing Claude Opus 5", 24 de julho de 2026. Fonte primária.
- Artificial Analysis, "Claude Opus 5: the new leader in agentic knowledge work", 24 de julho de 2026.
- Artificial Analysis, "Opus 5: Fable 5 level intelligence at a lower cost per task", 24 de julho de 2026.
- Artificial Analysis Intelligence Index v4.1, leitura de 27 de julho de 2026.
- Anthropic, "Claude Opus 5 System Card", julho de 2026.

Acelere a eficiênciaoperacional do seu negócio
Nós desenhamos a tecnologia do amanhã para impulsionar a escala do negócio
Falar com Especialista