Claude Opus 5
Le modèle Opus phare d'Anthropic, sorti le 24 juillet 2026 : une intelligence proche de la frontière pour la moitié du prix de Claude Fable 5, avec le raisonnement activé par défaut et toute l'échelle d'effort, de low à max.
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 5 est le modèle Opus phare actuel d'Anthropic, sorti le 24 juillet 2026 en successeur d'Opus 4.8. Il s'approche de l'intelligence de frontière de Claude Fable 5 pour la moitié du prix et, sur plusieurs évaluations de codage et de travail de connaissance — dont Frontier-Bench v0.1 et GDPval-AA v2 —, il le devance carrément. Le tarif reste celui d'Opus 4.8, 5 $ en entrée et 25 $ en sortie par million de tokens : c'est donc un remplacement direct pour les agents déjà en place sur le palier Opus.
Quelques changements de comportement méritent d'être connus avant de basculer. Le raisonnement est activé par défaut, là où Opus 4.8 ne raisonnait que sur demande ; l'effort couvre toute l'échelle de low à max ; et la chaîne de pensée brute n'est jamais renvoyée. Sur VM0, le multiplicateur de crédits est de ×2, comme pour Opus 4.8, et le modèle fait partie de la sélection intégrée pour les nouvelles organisations.
Qu'est-ce que Claude Opus 5 ?
Sorti le 24 juillet 2026 · Le palier phare Opus d'Anthropic : en dessous de Fable 5 en plafond absolu, devant lui sur plusieurs évaluations agentiques et de travail de connaissance, pour moitié moins cher par token. Le choix par défaut sur VM0 pour le travail agentique exigeant.
Anthropic a publié Claude Opus 5 le 24 juillet 2026 sur l'API Claude, les applications Claude, Amazon Bedrock, Google Cloud et Microsoft Foundry ; VM0 l'a ajouté comme modèle intégré le 25 juillet 2026. Il succède à Opus 4.8 à tarif identique et double presque son score Frontier-Bench v0.1, ce qui résume l'argument principal : nettement plus de capacité pour le même coût par token.
Il est positionné comme le cheval de bataille du codage agentique et du travail de connaissance en entreprise — fonctionnalités multi-fichiers, refactorisations importantes, longues exécutions autonomes et livrables de bout en bout — plutôt que comme le plafond absolu de capacité. Fable 5 reste en tête sur le jeu plus difficile SWE-bench Pro et sur l'étendue factuelle ; Opus 5 l'emporte sur le coût par tâche terminée, le chiffre qui apparaît sur la facture dès que le trafic agentique augmente.
Deux comportements de l'API changent par rapport à Opus 4.8. Le raisonnement est activé par défaut : une requête qui ne configure rien raisonne désormais avant de répondre, et il n'est possible de le désactiver qu'à un effort high ou inférieur. Le prompt minimal mis en cache passe par ailleurs à 512 tokens, si bien que des prompts système courts, jusqu'ici non cachables, le deviennent. Opus 5 embarque aussi des garde-fous de cybersécurité renforcés : les requêtes dans des domaines interdits ou à haut risque peuvent revenir sous forme de refus.
Ce qui distingue Claude Opus 5
Principales caractéristiques d'architecture et de capacités.
Opus 5 dispose d'une fenêtre de contexte d'un million de tokens — le maximum est aussi la valeur par défaut — et de 128K tokens de sortie au maximum, avec une date de coupure des connaissances en mai 2026. Le raisonnement est activé par défaut et sa profondeur se règle via les niveaux d'effort low, medium, high, xhigh et max ; la chaîne de pensée brute n'est jamais exposée, seulement un résumé lisible. Le préremplissage du message assistant n'est pas pris en charge et les paramètres d'échantillonnage (temperature, top_p, top_k) sont rejetés : orientez le comportement par le prompt. Les entrées couvrent le texte, la vision haute résolution et le code.
Spécifications en un coup d'œil
Benchmarks de Claude Opus 5
Scores communiqués par le fournisseur, issus des documents de lancement d'Anthropic. Les observateurs tiers publient des chiffres différents pour les mêmes benchmarks selon le jeu de données, le niveau d'effort et l'échafaudage de l'agent : considérez ces valeurs comme dépendantes de la configuration.
Tarification de Claude Opus 5
Prix catalogue fournisseur, par million de tokens.
Comment Claude Opus 5 se comporte en pratique
Comportement observé lors d'exécutions d'agents en production.
Coût par tâche terminée
La raison la plus nette de préférer Opus 5 à Fable 5 : des résultats comparables sur le travail agentique pour environ la moitié du prix par token. Sur AutomationBench de Zapier, son taux de réussite est d'environ 1,5 fois celui du meilleur modèle suivant à coût par tâche égal, et même à son niveau d'effort le plus bas il termine plus de tâches que n'importe quel autre modèle.
Raisonnement activé par défaut
Contrairement à Opus 4.8, une requête qui omet le paramètre de raisonnement réfléchit avant de répondre. Prévoyez-le : max_tokens plafonne le raisonnement et la réponse ensemble, donc une limite calibrée pour une charge sans raisonnement peut tronquer la sortie. Le raisonnement ne peut être désactivé qu'à un effort high ou inférieur.
L'effort est le principal levier de coût
low et medium sont exceptionnellement solides sur ce modèle et atteignent souvent ce que les modèles phares précédents produisaient à leur réglage maximal. Commencez à high — xhigh pour les exécutions de codage et agentiques les plus difficiles — puis descendez et conservez le niveau le moins cher que vos évaluations acceptent encore.
Il vérifie son propre travail
Opus 5 contrôle sa sortie sans qu'on le lui demande : les consignes de vérification héritées de modèles plus anciens produisent donc des passes redondantes. Il rédige aussi des réponses plus longues par défaut ; une courte consigne de concision est plus efficace que de baisser l'effort.
Meilleures tâches d'agent pour Claude Opus 5
La fonctionnalité multi-fichiers qui aboutit en une seule exécution
Donnez-lui la spécification complète d'emblée et laissez-le travailler. Les gains d'Opus 5 sur Opus 4.8 sont les plus nets sur l'ingénierie difficile en plusieurs étapes — grosses refactorisations, fonctionnalités de bout en bout — et les plus faibles sur les modifications en un seul tour : visez donc le haut de votre échelle de difficulté.
L'agent de nuit que vous pouvez laisser tourner
C'est sur les longues exécutions autonomes que l'écart de prix se cumule. Avec une qualité proche de Fable et la moitié du coût par token, un agent nocturne de triage, de migration ou de recherche coûte environ deux fois moins par tâche terminée.
Le processus métier qui doit aboutir, pas seulement répondre
Des tâches en plusieurs étapes avec des outils et un véritable état final : créer des tickets, mettre à jour des tableurs, rapprocher des enregistrements. Les résultats AutomationBench et OSWorld d'Anthropic pointent la même chose : il mène à terme des tâches de bout en bout que d'autres modèles abandonnent à mi-parcours.
Quand éviter Claude Opus 5
Passez votre chemin pour du travail à fort volume, sensible à la latence ou simple : Sonnet 5 couvre les boucles d'agent routinières pour la moitié du multiplicateur, et GPT 5.6 Luna coûte encore moins cher. Préférez Fable 5 lorsqu'une tâche se situe au plafond de votre échelle de difficulté ou repose sur du codage difficile façon SWE-bench Pro et une large mémoire factuelle. La recherche en sécurité et d'autres domaines à haut risque peuvent déclencher les garde-fous d'Opus 5 et provoquer un refus.
Claude Opus 5 vs autres modèles
Claude Opus 5 vs Claude Fable 5
Fable 5 offre le plafond le plus haut ; Opus 5 offre le meilleur rapport qualité-prix. Opus 5 mène sur Frontier-Bench (43,3 % contre 33,7 %), GDPval-AA v2 et SWE-bench Verified, tandis que Fable 5 conserve SWE-bench Pro et l'étendue factuelle. Opus 5 coûte deux fois moins (5 $/25 $ contre 10 $/50 $) et affiche un multiplicateur VM0 de ×2 face au ×4 de Fable 5 : envoyez les étapes les plus difficiles à Fable 5 et tout le reste ici.
Claude Opus 5 vs Claude Opus 4.8
Même prix, même palier, capacité nettement supérieure : Opus 5 double presque le score Frontier-Bench d'Opus 4.8 et ajoute sept points sur SWE-bench Verified. La migration se résume à changer l'identifiant du modèle puis à réajuster les prompts — le raisonnement étant désormais activé par défaut, revérifiez max_tokens et supprimez les consignes du type « vérifie ton travail », qui ne créent plus que des passes redondantes.
Claude Opus 5 vs Claude Sonnet 5
Sonnet 5 (×1) est le choix économique par défaut pour les boucles d'agent routinières ; Opus 5 (×2) est le palier auquel on promeut une tâche quand elle cesse d'aboutir de façon fiable. Le schéma habituel : Opus 5 orchestre, Sonnet 5 exécute le travail en parallèle.
Claude Opus 5 vs GPT 5.6 Sol
Les deux sont des modèles agentiques de premier plan. Opus 5 devance Sol sur Frontier-Bench (43,3 % contre 34,4 %) ; Sol mène sur DeepSWE v1.1 (72,7 % contre 68,8 %). Sur VM0, c'est une décision de routage et non d'achat : faites tourner le même agent sur les deux et comparez.
En résumé : devriez-vous utiliser Claude Opus 5 ?
Le modèle phare par défaut sur VM0. Opus 5 se rapproche suffisamment du plafond de Fable 5 pour que le prix tranche sur la plupart des travaux agentiques, et il remplace sans friction tout ce qui tourne déjà sur Opus 4.8. Gardez Sonnet 5 pour les boucles routinières et réservez Fable 5 aux rares tâches qui exigent réellement le haut du panier.
Questions fréquentes
Quand Claude Opus 5 est-il sorti ?
Anthropic a publié Opus 5 le 24 juillet 2026 sur l'API Claude et les applications Claude, ainsi que sur Amazon Bedrock, Google Cloud et Microsoft Foundry. VM0 l'a ajouté comme modèle intégré le 25 juillet 2026 (identifiant claude-opus-5).
Combien coûte Claude Opus 5 ?
5 $ par million de tokens en entrée et 25 $ par million en sortie — inchangé par rapport à Opus 4.8 et exactement la moitié des 10 $/50 $ de Claude Fable 5. Les lectures de cache coûtent 0,50 $ par million. Sur VM0, le multiplicateur de crédits est de ×2.
Claude Opus 5 est-il meilleur que Claude Fable 5 ?
Sur plusieurs évaluations, oui : Opus 5 devance Fable 5 sur Frontier-Bench v0.1, GDPval-AA v2 et SWE-bench Verified. Fable 5 reste en tête sur le jeu plus difficile SWE-bench Pro et sur l'étendue factuelle, et conserve le plafond le plus haut pour le raisonnement le plus ardu. Pour l'essentiel du travail agentique, Opus 5 l'emporte sur le coût par tâche terminée.
Le raisonnement est-il activé par défaut sur Claude Opus 5 ?
Oui. Une requête qui omet le paramètre de raisonnement réfléchit avant de répondre — un changement par rapport à Opus 4.8, où le raisonnement était désactivé sauf demande explicite. La profondeur se règle avec l'effort (low à max) et la désactivation n'est possible qu'à un effort high ou inférieur. La chaîne de pensée brute n'est jamais renvoyée, seulement un résumé lisible.
Qu'est-ce qui change lors d'une migration depuis Opus 4.8 ?
L'identifiant du modèle, puis l'ajustement des prompts. Le raisonnement étant activé par défaut, max_tokens couvre désormais le raisonnement en plus de la réponse ; les consignes de vérification doivent être supprimées plutôt que réécrites, puisque Opus 5 se vérifie lui-même ; et les réponses sont plus longues par défaut, alors ajoutez une consigne de concision explicite si la longueur compte.
Alternatives
Utiliser Claude Opus 5 sur VM0
Deux façons d'accéder à Claude Opus 5 sur VM0
VM0 prend en charge Claude Opus 5 comme modèle Built-in facturé en crédits VM0, et via le bring-your-own avec une Anthropic API key. La voie Built-in utilise le routage VM0 Managed et le multiplicateur de crédits expliqué ci-dessous ; la voie bring-your-own vous facture directement auprès du fournisseur en amont et contourne entièrement la conversion en crédits VM0.
La recommandation de VM0
VM0 positionne Claude Opus 5 comme un modèle d'agent central, recommandé aux côtés de Claude Opus 4.7, Claude Opus 4.6 et Claude Sonnet 4.6 pour les étapes qui déterminent le résultat réel d'une exécution d'agent. Ce sont les modèles que nous choisirions pour le rôle d'orchestrateur, pour les agents touchant au code, et pour toute étape où une mauvaise réponse coûte cher.
Les crédits et le multiplicateur ×2
Chaque modèle Built-in sur VM0 est tarifé comme un multiple de Claude Sonnet 4.6, qui se situe à la référence de crédits ×1. Claude Opus 5 est facturé à ×2 crédits. Le multiplicateur est ce qui apparaît sur votre facture VM0 ; le prix catalogue du fournisseur dans le tableau de tarification ci-dessus est ce que le fournisseur en amont facture avant que VM0 ne le convertisse en crédits.
Claude Opus 5 est facturé à ×2, ce qui signifie qu'une étape ici coûte 2× les crédits d'une étape équivalente sur Sonnet 4.6 (la référence ×1). C'est un palier premium sur VM0, donc le pattern le plus économique est de choisir par défaut un modèle moins cher et de n'acheminer vers Claude Opus 5 que les étapes qui ont réellement besoin de cette profondeur de raisonnement supplémentaire.
Disponible sur VM0 depuis le July 25, 2026.