सभी models

Claude Opus 5

Anthropic का प्रमुख Opus मॉडल, 24 जुलाई 2026 को जारी — Claude Fable 5 की आधी कीमत पर फ्रंटियर के करीब की क्षमता, थिंकिंग डिफ़ॉल्ट रूप से चालू और low से max तक पूरी effort रेंज।

1M tokens · Text / Vision / Code · Prompt cache

Claude Opus 5 Anthropic का मौजूदा प्रमुख Opus मॉडल है, जो Opus 4.8 के उत्तराधिकारी के रूप में 24 जुलाई 2026 को जारी हुआ। यह Claude Fable 5 की फ्रंटियर क्षमता के करीब आधी कीमत पर पहुँचता है, और कोडिंग तथा नॉलेज वर्क के कई मूल्यांकनों में — जिनमें Frontier-Bench v0.1 और GDPval-AA v2 शामिल हैं — Fable 5 से आगे भी निकल जाता है। कीमत Opus 4.8 जैसी ही है: प्रति 10 लाख टोकन $5 इनपुट और $25 आउटपुट। यानी Opus स्तर पर पहले से चल रहे एजेंट सीधे इस पर शिफ्ट किए जा सकते हैं।

स्विच करने से पहले व्यवहार में हुए बदलाव जान लेना ज़रूरी है। थिंकिंग अब डिफ़ॉल्ट रूप से चालू है, जबकि Opus 4.8 तब तक नहीं सोचता था जब तक आप न कहें; effort low से max तक पूरी रेंज में उपलब्ध है; और कच्ची विचार शृंखला कभी लौटाई नहीं जाती। VM0 पर इसका क्रेडिट गुणक ×2 है, यानी Opus 4.8 जितना ही, और यह नई संस्थाओं के लिए इनबिल्ट मॉडल सूची का हिस्सा है।

Claude Opus 5 क्या है?

24 जुलाई 2026 को जारी · Anthropic का प्रमुख Opus स्तर — निरपेक्ष सीमा में Fable 5 से नीचे, कई एजेंटिक और नॉलेज-वर्क मूल्यांकनों में उससे आगे, और टोकन कीमत आधी। VM0 पर कठिन एजेंट काम के लिए डिफ़ॉल्ट विकल्प।

Anthropic ने Claude Opus 5 को 24 जुलाई 2026 को Claude API, Claude ऐप्स, Amazon Bedrock, Google Cloud और Microsoft Foundry पर जारी किया; VM0 ने इसे 25 जुलाई 2026 को इनबिल्ट मॉडल के रूप में जोड़ा। यह उसी कीमत पर Opus 4.8 की जगह लेता है और उसके Frontier-Bench v0.1 स्कोर को लगभग दोगुना कर देता है — यही मुख्य दावा है: प्रति टोकन उतनी ही लागत पर काफी ज़्यादा क्षमता।

इसकी स्थिति क्षमता की निरपेक्ष सीमा की नहीं, बल्कि एजेंटिक कोडिंग और एंटरप्राइज़ नॉलेज वर्क के वर्कहॉर्स की है — कई फ़ाइलों में फैले फीचर, बड़े रिफैक्टर, लंबे स्वायत्त रन और शुरू से अंत तक तैयार डिलिवरेबल। कठिन SWE-bench Pro सेट और तथ्यात्मक विस्तार में Fable 5 अब भी आगे है; प्रति पूर्ण कार्य लागत में Opus 5 जीतता है — और एजेंट ट्रैफ़िक बढ़ने पर यही आंकड़ा बिल में दिखता है।

Opus 4.8 की तुलना में API के दो व्यवहार बदले हैं। थिंकिंग डिफ़ॉल्ट रूप से चालू है, इसलिए बिना किसी कॉन्फ़िगरेशन वाली रिक्वेस्ट भी उत्तर देने से पहले तर्क करती है, और इसे बंद करना केवल high या उससे कम effort पर संभव है। कैश होने योग्य न्यूनतम प्रॉम्प्ट भी घटकर 512 टोकन रह गया है, इसलिए जो छोटे सिस्टम प्रॉम्प्ट पहले कैश नहीं होते थे, अब होते हैं। Opus 5 के साथ साइबर सुरक्षा के कड़े सुरक्षा उपाय भी आते हैं: प्रतिबंधित या उच्च-जोखिम क्षेत्रों की रिक्वेस्ट अस्वीकृति के रूप में लौट सकती है।

Claude Opus 5 में क्या उल्लेखनीय है

मुख्य architecture और capability विशेषताएँ।

Opus 5 का कॉन्टेक्स्ट विंडो 10 लाख टोकन का है — अधिकतम मान ही डिफ़ॉल्ट है — और आउटपुट अधिकतम 128K टोकन, ज्ञान की कट-ऑफ़ मई 2026। थिंकिंग डिफ़ॉल्ट रूप से चालू है और तर्क की गहराई effort स्तरों low, medium, high, xhigh और max से तय होती है; कच्ची विचार शृंखला कभी उजागर नहीं होती, केवल पठनीय सारांश मिलता है। असिस्टेंट संदेश का प्रीफ़िल समर्थित नहीं है और सैंपलिंग पैरामीटर (temperature, top_p, top_k) अस्वीकार कर दिए जाते हैं — व्यवहार प्रॉम्प्ट से नियंत्रित करें। इनपुट में टेक्स्ट, हाई-रेज़ॉल्यूशन विज़न और कोड शामिल हैं।

एक नज़र में specs

फ़ैमिलीClaude 5 पीढ़ी
मोडैलिटीटेक्स्ट, विज़न, कोड
कॉन्टेक्स्ट विंडो10 लाख टोकन (डिफ़ॉल्ट और अधिकतम)
अधिकतम आउटपुट128K टोकन तक
ज्ञान कट-ऑफ़मई 2026
थिंकिंगडिफ़ॉल्ट रूप से चालू; effort low / medium / high / xhigh / max
प्रॉम्प्ट कैशिंगसमर्थित (न्यूनतम 512 टोकन)
वेंडर सूची मूल्यप्रति 10 लाख $5 इनपुट / $25 आउटपुट

Claude Opus 5 benchmarks

Anthropic की लॉन्च सामग्री से लिए गए वेंडर-रिपोर्टेड स्कोर। डेटासेट, effort सेटिंग और एजेंट स्कैफ़ोल्ड के आधार पर तीसरे पक्ष के ट्रैकर उन्हीं बेंचमार्क के लिए अलग आंकड़े देते हैं, इसलिए इन्हें कॉन्फ़िगरेशन पर निर्भर मानकर पढ़ें।

Frontier-Bench v0.1लॉन्च के समय सर्वश्रेष्ठ; Fable 5 (33.7%) और GPT 5.6 Sol (34.4%) से आगे
43.3%
SWE-bench VerifiedFable 5 के 95.0% से थोड़ा आगे; फ्रंटियर पर यह सेट संतृप्ति के करीब है
96.0%
SWE-bench Proकठिन कोडिंग सेट — 80.3% के साथ Fable 5 अब भी आगे
79.2%
GDPval-AA v2नॉलेज-वर्क लीडरबोर्ड; Fable 5 के 1,747 से आगे
1,861 Elo
Humanity's Last Exam (बिना टूल)विशेषज्ञ स्तर का तर्क; Fable 5 के 56.5% से मामूली पीछे
56.3%

Claude Opus 5 pricing

Provider सूची मूल्य, प्रति 1M tokens।

Input$5.00
Output$25.00
Cache read$0.50
Cache write$6.25

Claude Opus 5 व्यवहार में कैसा प्रदर्शन करता है

Production agent runs से देखा गया व्यवहार।

प्रति पूर्ण कार्य लागत

Fable 5 की जगह Opus 5 चुनने की सबसे स्पष्ट वजह: एजेंटिक काम में तुलनीय नतीजे, लगभग आधी टोकन कीमत पर। Zapier के AutomationBench पर समान प्रति-कार्य लागत पर इसकी पास दर अगले सर्वश्रेष्ठ मॉडल से करीब 1.5 गुना है, और सबसे कम effort सेटिंग पर भी यह किसी भी अन्य मॉडल से ज़्यादा कार्य पूरे करता है।

डिफ़ॉल्ट रूप से चालू थिंकिंग

Opus 4.8 के उलट, thinking पैरामीटर छोड़ देने वाली रिक्वेस्ट भी उत्तर से पहले सोचती है। इसका हिसाब रखें: max_tokens थिंकिंग और उत्तर दोनों पर एक साथ सीमा लगाता है, इसलिए बिना-थिंकिंग वाले वर्कलोड के लिए तय की गई सीमा आउटपुट काट सकती है। थिंकिंग बंद करना केवल high या उससे कम effort पर संभव है।

लागत का मुख्य नियंत्रण effort है

इस मॉडल पर low और medium असामान्य रूप से मज़बूत हैं और अक्सर वही देते हैं जो पिछले प्रमुख मॉडल अपनी सर्वोच्च सेटिंग पर देते थे। high से शुरू करें — सबसे कठिन कोडिंग और एजेंटिक रन के लिए xhigh — फिर नीचे उतरते हुए वह सबसे सस्ता स्तर चुनें जिसे आपके मूल्यांकन स्वीकार करते हों।

अपना काम खुद जाँचता है

Opus 5 बिना कहे अपना आउटपुट जाँचता है, इसलिए पुराने मॉडलों से लाए गए सत्यापन निर्देश अक्सर दोहराव वाला काम पैदा करते हैं। यह डिफ़ॉल्ट रूप से लंबे उत्तर भी लिखता है; effort घटाने के बजाय संक्षिप्त लिखने का छोटा निर्देश ज़्यादा कारगर रहता है।

Claude Opus 5 के लिए सर्वश्रेष्ठ agent tasks

एक ही रन में पूरा होने वाला मल्टी-फ़ाइल फीचर

पूरा स्पेसिफ़िकेशन पहले ही दे दें और इसे चलने दें। Opus 4.8 की तुलना में Opus 5 की बढ़त कठिन, बहु-चरणीय इंजीनियरिंग काम में सबसे ज़्यादा है — बड़े रिफैक्टर, शुरू से अंत तक फीचर — और सिंगल-टर्न एडिट में सबसे कम। इसलिए इसे अपनी कठिनाई सीमा के ऊपरी सिरे पर लगाएँ।

रातभर चलने देने लायक एजेंट

लंबे स्वायत्त रन में ही कीमत का अंतर जुड़ता जाता है। Fable जैसी गुणवत्ता और आधी टोकन लागत पर, रात में चलने वाला ट्रायाज, माइग्रेशन या रिसर्च एजेंट प्रति पूर्ण कार्य लगभग आधी लागत लेता है।

वह वर्कफ़्लो जिसे पूरा होना है, सिर्फ़ जवाब नहीं देना

टूल के साथ बहु-चरणीय कार्य जिनका असली अंतिम बिंदु हो — टिकट बनाना, स्प्रेडशीट अपडेट करना, रिकॉर्ड मिलाना। Anthropic के AutomationBench और OSWorld नतीजे एक ही बात कहते हैं: यह उन कार्यों को अंत तक पूरा करता है जिन्हें दूसरे मॉडल बीच में छोड़ देते हैं।

Claude Opus 5 को कब छोड़ें

उच्च मात्रा, कम विलंबता वाले या सीधे-सादे कामों के लिए Opus 5 ज़रूरी नहीं — नियमित एजेंट लूप आधे गुणक वाला Sonnet 5 संभाल लेता है और GPT 5.6 Luna उससे भी सस्ता है। जब कोई कार्य आपकी कठिनाई सीमा के शीर्ष पर हो या SWE-bench Pro जैसी कठिन कोडिंग और व्यापक तथ्यात्मक स्मृति पर निर्भर हो, तो Fable 5 चुनें। सुरक्षा शोध और अन्य उच्च-जोखिम क्षेत्रों में Opus 5 के सुरक्षा उपाय सक्रिय होकर अस्वीकृति लौटा सकते हैं।

Claude Opus 5 बनाम अन्य models

Claude Opus 5 बनाम Claude Fable 5

ऊँची सीमा Fable 5 की है; बेहतर सौदा Opus 5 है। Opus 5 Frontier-Bench (43.3% बनाम 33.7%), GDPval-AA v2 और SWE-bench Verified में आगे है, जबकि Fable 5 SWE-bench Pro और तथ्यात्मक विस्तार में आगे बना रहता है। Opus 5 की कीमत आधी है ($5/$25 बनाम $10/$50) और VM0 गुणक Fable 5 के ×4 के मुकाबले ×2 — सबसे कठिन चरण Fable 5 को भेजें और बाकी सब यहीं चलाएँ।

Claude Opus 5 बनाम Claude Opus 4.8

कीमत वही, स्तर वही, क्षमता स्पष्ट रूप से अधिक: Opus 5 ने Opus 4.8 के Frontier-Bench स्कोर को लगभग दोगुना किया और SWE-bench Verified में सात अंक जोड़े। माइग्रेशन में मॉडल आईडी बदलना और प्रॉम्प्ट दोबारा ट्यून करना है — थिंकिंग अब डिफ़ॉल्ट रूप से चालू है, इसलिए max_tokens फिर से जाँचें और “अपने काम की पुष्टि करो” जैसे निर्देश हटा दें, जो अब सिर्फ़ दोहराव पैदा करते हैं।

Claude Opus 5 बनाम Claude Sonnet 5

नियमित एजेंट लूप के लिए किफ़ायती डिफ़ॉल्ट Sonnet 5 (×1) है; जब कोई कार्य भरोसे के साथ पूरा होना बंद कर दे, तब उसे Opus 5 (×2) पर चढ़ाया जाता है। आम पैटर्न यही है कि Opus 5 ऑर्केस्ट्रेशन करे और Sonnet 5 समानांतर काम संभाले।

Claude Opus 5 बनाम GPT 5.6 Sol

दोनों शीर्ष श्रेणी के एजेंटिक मॉडल हैं। Frontier-Bench पर Opus 5 आगे है (43.3% बनाम 34.4%); DeepSWE v1.1 पर Sol आगे है (72.7% बनाम 68.8%)। VM0 पर यह खरीद का नहीं, रूटिंग का फ़ैसला है — एक ही एजेंट दोनों पर चलाकर तुलना करें।

निष्कर्ष: क्या आपको Claude Opus 5 इस्तेमाल करना चाहिए?

VM0 पर डिफ़ॉल्ट प्रमुख मॉडल। Opus 5 Fable 5 की सीमा के इतने करीब पहुँच जाता है कि ज़्यादातर एजेंटिक काम में कीमत ही निर्णायक बन जाती है, और Opus 4.8 पर पहले से चल रही किसी भी चीज़ के लिए यह सीधा प्रतिस्थापन है। नियमित लूप Sonnet 5 पर रखें और Fable 5 उन गिने-चुने कार्यों के लिए बचाकर रखें जिन्हें वाकई शीर्ष क्षमता चाहिए।

अक्सर पूछे जाने वाले सवाल

Claude Opus 5 कब जारी हुआ?

Anthropic ने Opus 5 को 24 जुलाई 2026 को Claude API और Claude ऐप्स के साथ-साथ Amazon Bedrock, Google Cloud और Microsoft Foundry पर जारी किया। VM0 ने इसे 25 जुलाई 2026 को इनबिल्ट मॉडल के रूप में जोड़ा (मॉडल आईडी claude-opus-5)।

Claude Opus 5 की कीमत कितनी है?

प्रति 10 लाख इनपुट टोकन $5 और प्रति 10 लाख आउटपुट टोकन $25 — Opus 4.8 जितनी ही और Claude Fable 5 के $10/$50 की ठीक आधी। कैश रीड प्रति 10 लाख $0.50 है। VM0 पर इसका क्रेडिट गुणक ×2 है।

क्या Claude Opus 5, Claude Fable 5 से बेहतर है?

कई मूल्यांकनों में हाँ: Opus 5 Frontier-Bench v0.1, GDPval-AA v2 और SWE-bench Verified में Fable 5 से आगे है। Fable 5 कठिन SWE-bench Pro सेट और तथ्यात्मक विस्तार में अब भी आगे है और सबसे कठिन तर्क के लिए ऊँची सीमा बना हुआ है। ज़्यादातर एजेंटिक काम में प्रति पूर्ण कार्य लागत के हिसाब से Opus 5 जीतता है।

क्या Claude Opus 5 में थिंकिंग डिफ़ॉल्ट रूप से चालू है?

हाँ। thinking पैरामीटर छोड़ने वाली रिक्वेस्ट भी उत्तर से पहले तर्क करती है — यह Opus 4.8 से बदलाव है, जहाँ माँगे बिना थिंकिंग बंद रहती थी। गहराई effort (low से max) से नियंत्रित होती है, और थिंकिंग केवल high या उससे कम effort पर बंद की जा सकती है। कच्ची विचार शृंखला कभी नहीं लौटाई जाती, केवल पठनीय सारांश मिलता है।

Opus 4.8 से माइग्रेट करते समय क्या बदलता है?

मॉडल आईडी, और उसके बाद प्रॉम्प्ट ट्यूनिंग। थिंकिंग डिफ़ॉल्ट रूप से चालू होने का मतलब है कि max_tokens अब उत्तर के साथ तर्क को भी कवर करता है; सत्यापन निर्देशों को दोबारा लिखने के बजाय हटा देना चाहिए, क्योंकि Opus 5 खुद जाँच करता है; और उत्तर डिफ़ॉल्ट रूप से लंबे होते हैं, इसलिए लंबाई मायने रखती हो तो संक्षिप्तता का स्पष्ट निर्देश जोड़ें।

विकल्प

VM0 पर Claude Opus 5 का उपयोग

VM0 पर Claude Opus 5 तक पहुँचने के दो तरीके

VM0, Claude Opus 5 को VM0 credits में बिल किए जाने वाले एक Built-in model के रूप में, और Anthropic API key के साथ bring-your-own के ज़रिए समर्थन करता है। Built-in रास्ता VM0 Managed routing और नीचे समझाए गए credit multiplier का उपयोग करता है; bring-your-own रास्ता आपको सीधे upstream vendor के साथ बिल करता है और VM0 credit conversion को पूरी तरह छोड़ देता है।

VM0 की सिफ़ारिश

VM0, Claude Opus 5 को एक core agent model के रूप में रखता है, जिसकी सिफ़ारिश Claude Opus 4.7, Claude Opus 4.6, और Claude Sonnet 4.6 के साथ उन steps के लिए की जाती है जो किसी agent run के असली परिणाम को संचालित करते हैं। ये वे models हैं जिन्हें हम orchestrator भूमिका के लिए, code-touching agents के लिए, और किसी भी ऐसे step के लिए चुनेंगे जहाँ गलत जवाब महंगा पड़ता है।

Credits और ×2 multiplier

VM0 पर हर Built-in model की कीमत Claude Sonnet 4.6 के एक गुणक के रूप में तय की जाती है, जो ×1 credit baseline पर है। Claude Opus 5, ×2 credits पर बिल करता है। Multiplier ही वह है जो आपके VM0 invoice पर दिखता है; ऊपर pricing table में vendor सूची मूल्य वह है जो VM0 द्वारा इसे credits में बदलने से पहले upstream provider वसूलता है।

Claude Opus 5, ×2 पर बिल करता है, जिसका मतलब है कि यहाँ एक step की लागत Sonnet 4.6 (×1 baseline) पर समकक्ष step के 2× credits है। यह VM0 पर एक premium tier है, इसलिए लागत-प्रभावी तरीका यह है कि डिफ़ॉल्ट रूप से एक सस्ता model इस्तेमाल करें और केवल उन्हीं steps को Claude Opus 5 पर भेजें जिन्हें वास्तव में अतिरिक्त reasoning गहराई की ज़रूरत है।

July 25, 2026 से VM0 पर उपलब्ध।