Todos os modelos

Claude Opus 5

O modelo Opus principal da Anthropic, lançado em 24 de julho de 2026 — inteligência próxima da fronteira pela metade do preço do Claude Fable 5, com raciocínio ativado por padrão e toda a escala de effort, de low a max.

1M tokens · Text / Vision / Code · Prompt cache

O Claude Opus 5 é o atual modelo Opus principal da Anthropic, lançado em 24 de julho de 2026 como sucessor do Opus 4.8. Ele chega perto da inteligência de fronteira do Claude Fable 5 pela metade do preço e, em várias avaliações de programação e trabalho de conhecimento — Frontier-Bench v0.1 e GDPval-AA v2 entre elas —, fica à frente do Fable 5. O preço continua o mesmo do Opus 4.8: US$ 5 de entrada e US$ 25 de saída por milhão de tokens. Ou seja, é uma troca direta para agentes que já rodam no nível Opus.

Vale conhecer as mudanças de comportamento antes de migrar. O raciocínio vem ativado por padrão, enquanto o Opus 4.8 só raciocinava se você pedisse; o effort cobre toda a escala de low a max; e a cadeia de pensamento bruta nunca é devolvida. Na VM0 ele tem multiplicador de créditos ×2, o mesmo do Opus 4.8, e faz parte do catálogo de modelos integrados para novas organizações.

O que é o Claude Opus 5?

Lançado em 24 de julho de 2026 · O nível principal Opus da Anthropic: abaixo do Fable 5 no teto absoluto, à frente dele em várias avaliações agênticas e de trabalho de conhecimento, pela metade do preço por token. A escolha padrão na VM0 para trabalho agêntico exigente.

A Anthropic lançou o Claude Opus 5 em 24 de julho de 2026 na API Claude, nos apps Claude, na Amazon Bedrock, no Google Cloud e no Microsoft Foundry; a VM0 o adicionou como modelo integrado em 25 de julho de 2026. Ele sucede o Opus 4.8 com preço idêntico e praticamente dobra sua pontuação no Frontier-Bench v0.1, que é a promessa central: bem mais capacidade pelo mesmo custo por token.

O posicionamento é o de cavalo de batalha para programação agêntica e trabalho de conhecimento corporativo — funcionalidades que atravessam vários arquivos, refatorações grandes, execuções autônomas longas e entregas de ponta a ponta — e não o de teto absoluto de capacidade. O Fable 5 continua liderando o conjunto mais difícil do SWE-bench Pro e a amplitude factual; o Opus 5 vence no custo por tarefa concluída, que é o número que aparece na fatura quando o tráfego de agentes cresce.

Dois comportamentos da API mudaram em relação ao Opus 4.8. O raciocínio vem ativado por padrão, então uma requisição sem configuração agora raciocina antes de responder, e desativá-lo só é permitido com effort high ou menor. O prompt mínimo cacheável também caiu para 512 tokens, de modo que prompts de sistema curtos que antes não podiam ser armazenados em cache agora podem. O Opus 5 também traz salvaguardas reforçadas de cibersegurança: requisições em áreas proibidas ou de alto risco podem voltar como recusa.

O que se destaca no Claude Opus 5

Principais recursos de arquitetura e capacidade.

O Opus 5 tem janela de contexto de 1 milhão de tokens — o máximo também é o padrão — e até 128 mil tokens de saída, com corte de conhecimento em maio de 2026. O raciocínio vem ativado por padrão e a profundidade é definida pelos níveis de effort low, medium, high, xhigh e max; a cadeia de pensamento bruta nunca é exposta, apenas um resumo legível. Não há suporte a prefill da mensagem do assistente, e parâmetros de amostragem (temperature, top_p, top_k) são rejeitados — conduza o comportamento pelo prompt. As entradas cobrem texto, visão em alta resolução e código.

Especificações em resumo

FamíliaGeração Claude 5
ModalidadesTexto, visão, código
Janela de contexto1 milhão de tokens (padrão e máximo)
Saída máximaAté 128 mil tokens
Corte de conhecimentoMaio de 2026
RaciocínioAtivado por padrão; effort low / medium / high / xhigh / max
Cache de promptsCompatível (mínimo de 512 tokens)
Preço de tabela do fornecedorUS$ 5 de entrada / US$ 25 de saída por milhão

Benchmarks do Claude Opus 5

Pontuações informadas pelo fornecedor, com base no material de lançamento da Anthropic. Rastreadores independentes publicam números diferentes para os mesmos benchmarks conforme o conjunto de dados, o nível de effort e o scaffold do agente — trate os números de destaque como dependentes da configuração.

Frontier-Bench v0.1estado da arte no lançamento; à frente do Fable 5 (33,7%) e do GPT 5.6 Sol (34,4%)
43,3%
SWE-bench Verifiedsupera por pouco os 95,0% do Fable 5; o conjunto está perto da saturação na fronteira
96,0%
SWE-bench Proo conjunto de programação mais difícil — o Fable 5 ainda lidera com 80,3%
79,2%
GDPval-AA v2ranking de trabalho de conhecimento; à frente dos 1.747 do Fable 5
1.861 Elo
Humanity's Last Exam (sem ferramentas)raciocínio de nível especialista; um pouco atrás dos 56,5% do Fable 5
56,3%

Preços do Claude Opus 5

Preço de tabela do provedor, por 1M de tokens.

Entrada$5.00
Saída$25.00
Leitura de cache$0.50
Escrita de cache$6.25

Como o Claude Opus 5 se comporta na prática

Comportamento observado em execuções de agentes em produção.

Custo por tarefa concluída

A razão mais clara para escolher o Opus 5 em vez do Fable 5: resultados comparáveis em trabalho agêntico por cerca de metade do preço por token. No AutomationBench da Zapier, a taxa de acerto fica em torno de 1,5 vez a do próximo melhor modelo para o mesmo custo por tarefa e, mesmo no nível de effort mais baixo, ele conclui mais tarefas do que qualquer outro modelo.

Raciocínio ativado por padrão

Ao contrário do Opus 4.8, uma requisição que omite o parâmetro de raciocínio pensa antes de responder. Planeje isso: max_tokens limita raciocínio e resposta em conjunto, então um limite calibrado para cargas sem raciocínio pode truncar a saída. Desativar o raciocínio só é permitido com effort high ou menor.

O effort é a principal alavanca de custo

low e medium são surpreendentemente bons neste modelo e muitas vezes igualam o que os carros-chefes anteriores entregavam nos ajustes máximos. Comece em highxhigh para as execuções de programação e agênticas mais difíceis — e depois vá descendo, mantendo o nível mais barato que suas avaliações ainda aceitem.

Verifica o próprio trabalho

O Opus 5 confere a própria saída sem que você peça, então instruções de verificação herdadas de modelos antigos tendem a gerar passagens redundantes. Ele também escreve respostas mais longas por padrão: uma instrução curta de concisão funciona melhor do que baixar o effort.

Melhores tarefas de agente para o Claude Opus 5

A funcionalidade multiarquivo que sai em uma única execução

Passe a especificação completa logo de início e deixe rodar. Os ganhos do Opus 5 sobre o Opus 4.8 são maiores em engenharia difícil e de várias etapas — refatorações grandes, funcionalidades de ponta a ponta — e menores em edições de um único turno, então aponte-o para o topo da sua faixa de dificuldade.

O agente noturno que você pode deixar rodando

É nas execuções autônomas longas que a diferença de preço se acumula. Com qualidade próxima à do Fable e metade do custo por token, um agente noturno de triagem, migração ou pesquisa custa cerca de metade por tarefa concluída.

O fluxo de trabalho que precisa terminar, não só responder

Tarefas de várias etapas com ferramentas e um estado final real: abrir tickets, atualizar planilhas, conciliar registros. Os resultados de AutomationBench e OSWorld da Anthropic apontam para a mesma coisa: ele conclui tarefas de ponta a ponta que outros modelos largam no meio.

Quando dispensar o Claude Opus 5

Deixe o Opus 5 de fora em trabalhos de alto volume, sensíveis à latência ou simples: o Sonnet 5 cobre laços de agente rotineiros pela metade do multiplicador e o GPT 5.6 Luna sai ainda mais barato. Prefira o Fable 5 quando a tarefa estiver no teto da sua faixa de dificuldade ou depender de programação difícil no estilo SWE-bench Pro e de ampla memória factual. Pesquisa de segurança e outros domínios de alto risco podem acionar as salvaguardas do Opus 5 e retornar uma recusa.

Claude Opus 5 vs outros modelos

Claude Opus 5 vs Claude Fable 5

O Fable 5 tem o teto mais alto; o Opus 5 é o melhor negócio. O Opus 5 lidera no Frontier-Bench (43,3% contra 33,7%), no GDPval-AA v2 e no SWE-bench Verified, enquanto o Fable 5 mantém o SWE-bench Pro e a amplitude factual. O Opus 5 custa metade (US$ 5/US$ 25 contra US$ 10/US$ 50) e tem multiplicador ×2 na VM0 contra o ×4 do Fable 5 — mande as etapas mais difíceis para o Fable 5 e todo o resto para cá.

Claude Opus 5 vs Claude Opus 4.8

Mesmo preço, mesmo nível e capacidade bem maior: o Opus 5 praticamente dobra a pontuação do Opus 4.8 no Frontier-Bench e soma sete pontos no SWE-bench Verified. Migrar é trocar o ID do modelo e reajustar os prompts — o raciocínio agora vem ativado por padrão, então revise max_tokens e remova instruções do tipo “verifique seu trabalho”, que hoje só provocam passagens redundantes.

Claude Opus 5 vs Claude Sonnet 5

O Sonnet 5 (×1) é o padrão econômico para laços de agente rotineiros; o Opus 5 (×2) é para onde você promove uma tarefa quando ela deixa de terminar de forma confiável. O padrão mais comum é o Opus 5 orquestrando e o Sonnet 5 executando o trabalho em paralelo.

Claude Opus 5 vs GPT 5.6 Sol

Ambos são modelos agênticos de primeira linha. O Opus 5 supera o Sol no Frontier-Bench (43,3% contra 34,4%); o Sol lidera no DeepSWE v1.1 (72,7% contra 68,8%). Na VM0 isso é uma decisão de roteamento, não de compra — rode o mesmo agente nos dois e compare.

Conclusão: você deveria usar o Claude Opus 5?

O carro-chefe padrão na VM0. O Opus 5 chega perto o bastante do teto do Fable 5 para que o preço decida na maior parte do trabalho agêntico, e substitui sem atrito qualquer carga que já rode no Opus 4.8. Mantenha o Sonnet 5 para os laços rotineiros e reserve o Fable 5 para as poucas tarefas que realmente precisam do topo da faixa.

Perguntas frequentes

Quando o Claude Opus 5 foi lançado?

A Anthropic lançou o Opus 5 em 24 de julho de 2026 na API Claude e nos apps Claude, além da Amazon Bedrock, do Google Cloud e do Microsoft Foundry. A VM0 o adicionou como modelo integrado em 25 de julho de 2026 (ID do modelo claude-opus-5).

Quanto custa o Claude Opus 5?

US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de saída — sem mudança em relação ao Opus 4.8 e exatamente metade dos US$ 10/US$ 50 do Claude Fable 5. Leituras de cache custam US$ 0,50 por milhão. Na VM0 ele tem multiplicador de créditos ×2.

O Claude Opus 5 é melhor que o Claude Fable 5?

Em várias avaliações, sim: o Opus 5 supera o Fable 5 no Frontier-Bench v0.1, no GDPval-AA v2 e no SWE-bench Verified. O Fable 5 ainda lidera o conjunto mais difícil do SWE-bench Pro e a amplitude factual, e continua sendo o teto mais alto para o raciocínio mais difícil. Para a maior parte do trabalho agêntico, o Opus 5 vence no custo por tarefa concluída.

O raciocínio vem ativado por padrão no Claude Opus 5?

Sim. Uma requisição que omite o parâmetro de raciocínio pensa antes de responder — uma mudança em relação ao Opus 4.8, em que o raciocínio ficava desligado a menos que fosse solicitado. A profundidade é controlada pelo effort (low até max) e a desativação só é possível com effort high ou menor. A cadeia de pensamento bruta nunca é devolvida, apenas um resumo legível.

O que muda ao migrar do Opus 4.8?

O ID do modelo e, depois, o ajuste dos prompts. Com o raciocínio ativado por padrão, max_tokens passa a cobrir o raciocínio além da resposta; instruções de verificação devem ser removidas em vez de reescritas, já que o Opus 5 se autoverifica; e as respostas ficam mais longas por padrão, então acrescente uma instrução explícita de concisão se o tamanho importar.

Alternativas

Usando o Claude Opus 5 na VM0

Duas formas de acessar o Claude Opus 5 na VM0

A VM0 suporta o Claude Opus 5 como um modelo Built-in cobrado em créditos VM0 e via bring-your-own com uma Anthropic API key. O caminho Built-in usa o roteamento Gerenciado da VM0 e o multiplicador de créditos explicado abaixo; o caminho bring-your-own cobra você diretamente com o fornecedor upstream e pula totalmente a conversão de créditos da VM0.

A recomendação da VM0

A VM0 posiciona o Claude Opus 5 como um modelo de agente central, recomendado ao lado do Claude Opus 4.7, do Claude Opus 4.6 e do Claude Sonnet 4.6 para os passos que determinam o resultado de fato de uma execução de agente. São os modelos que escolheríamos para o papel de orquestrador, para agentes que tocam em código e para qualquer passo em que uma resposta errada sai cara.

Créditos e o multiplicador ×2

Todo modelo Built-in na VM0 é precificado como um múltiplo do Claude Sonnet 4.6, que fica na linha de base de ×1 crédito. O Claude Opus 5 cobra a ×2 créditos. O multiplicador é o que aparece na sua fatura da VM0; o preço de tabela do fornecedor na tabela de preços acima é o que o provedor upstream cobra antes de a VM0 convertê-lo em créditos.

O Claude Opus 5 cobra a ×2, o que significa que um passo aqui custa 2× os créditos de um passo equivalente no Sonnet 4.6 (a linha de base de ×1). É um tier premium na VM0, então o padrão custo-efetivo é usar por padrão um modelo mais barato e rotear para o Claude Opus 5 apenas os passos que de fato precisam da profundidade extra de raciocínio.

Disponível na VM0 desde July 25, 2026.