चार हाई-प्रोफाइल आर्टिफिशियल इंटेलिजेंस (AI) लैब्स ने जुलाई 2026 में तीन सप्ताह के भीतर फ्रंटियर लैंग्वेज मॉडल जारी किए, और इन सिस्टमों द्वारा बिना मानवीय हस्तक्षेप के जो हासिल किया जा सकता है, और पहले की तकनीकों के बीच का अंतर काफी कम हो गया है।
एआई दिग्गजों ने तीन हफ्तों में 4 फ्रंटियर मॉडल जारी किए, क्योंकि यह दौड़ ओवरड्राइव में प्रवेश कर गई है।

मुख्य निष्कर्ष
- xAI ने 8 जुलाई को Grok 4.5 को प्रति मिलियन टोकन पर $2/$6 की कीमत पर लॉन्च किया, जो Opus 4.8 की कीमत से 60% से अधिक कम है।
- एन्थ्रॉपिक ने 24 जुलाई को क्लॉड मैक्स सब्सक्रिप्शन पर नया डिफ़ॉल्ट मॉडल के रूप में क्लॉड ओपस 5 जारी किया।
- मूनशॉट एआई ने किमी K3 प्रकाशित किया, जो 2.8 ट्रिलियन पैरामीटर वाला इसका सबसे बड़ा मॉडल है।
xAI का ग्रोक 4.5, एंथ्रॉपिक का क्लॉड ओपस 5, OpenAI का GPT-5.6 परिवार, और Moonshot AI का किमी K3, प्रत्येक एक ही समस्या को लक्षित करते हैं: एक AI सिस्टम को कई-घंटे के कार्य को, शोध से लेकर कोडिंग और संरचित रिपोर्टिंग तक, योजना से भटकने के बिना पूरा करने में सक्षम बनाना।
ग्रोक् 4.5 वास्तविक डेवलपर सत्रों पर प्रशिक्षित होता है
xAI ने 8 जुलाई को ग्रोक 4.5 जारी किया। यह मॉडल 1.5 ट्रिलियन पैरामीटर वाले बेस पर चलता है और इसे आंशिक रूप से कर्सर (Cursor) के वास्तविक उपयोग डेटा पर प्रशिक्षित किया गया है, जो एक कोडिंग प्लेटफॉर्म है जिसे SpaceXAI ने इस साल की शुरुआत में अधिग्रहित किया था। कीमत 2 मिलियन इनपुट टोकन के लिए $2 और 2 मिलियन आउटपुट टोकन के लिए $6 है, जिसमें 500,000 टोकन की कॉन्टेक्स्ट विंडो है।

एलन मस्क ने ग्रोक 4.5 को एक ओपस-क्लास मॉडल के रूप में बताया जो तेज़ी से और कम लागत पर चलता है। स्वतंत्र ट्रैकर्स इसे आर्टिफिशियल एनालिसिस इंटेलिजेंस इंडेक्स पर चौथे स्थान पर रखते हैं, जो हर ओपन वेट मॉडल से आगे है, और इसकी कीमत क्लॉड ओपस 4.8 और जीपीटी-5.5 से 60% से अधिक कम है। टर्मिनल-बेंच 2.1 पर, एक परीक्षण जो यह स्कोर करता है कि कोई मॉडल कमांड-लाइन इंजीनियरिंग कार्य कितनी अच्छी तरह से पूरा करता है, ग्रोक 4.5 ने 83.3% अंक प्राप्त किए।
बड़ी बदलाव टोकन दक्षता है। xAI का कहना है कि इस मॉडल को तुलनीय कार्यों के लिए Opus 4.8 की तुलना में लगभग पांचवां हिस्सा आउटपुट टोकन की आवश्यकता होती है, जिससे लंबे एजेंट सत्र चलाने की लागत कम हो जाती है।
क्लॉड ओपस 5 ने कीमत को स्थिर रखा
एन्थ्रॉपिक ने 24 जुलाई को क्लॉड ओपस 5 जारी किया, इसे एक ऐसे मॉडल के रूप में पेश किया जो कंपनी की सबसे सक्षम रिलीज़, क्लॉड फेबल 5 के प्रदर्शन के करीब पहुंचता है, और यह फेबल की $10 इनपुट और $50 आउटपुट की कीमत का आधा है। Opus 5 में भी अपने पूर्ववर्ती, Opus 4.8, जैसी ही $5 इनपुट और $25 आउटपुट की कीमत है।

यह मॉडल 1 मिलियन टोकन की कॉन्टेक्स्ट विंडो, 128,000 अधिकतम आउटपुट टोकन, और एक समायोज्य रीजनिंग प्रयास सेटिंग के साथ आता है, जो कम से लेकर एक नए xhigh मोड तक होती है। एन्थ्रॉपिक का कहना है कि ओपस 5 ने दो कोडिंग और ज्ञान कार्य मूल्यांकनों, फ्रंटियर-बेंच और जीडीपीवैल-एए पर नए मानक स्थापित किए हैं, हालांकि यह साइबर सुरक्षा कार्यों में प्रतिबंधित क्लॉड मायथोस 5 मॉडल से पीछे है। ओपस 5 अब क्लॉड मैक्स पर डिफ़ॉल्ट मॉडल और क्लॉड प्रो पर सबसे मजबूत विकल्प है।
ओपनएआई ने GPT-5.6 को तीन स्तरों में विभाजित किया
ओपनएआई ने फ्रंटियर मॉडल सुरक्षा समीक्षा से जुड़े एक कार्यकारी आदेश के बाद, अमेरिकी सरकार द्वारा जांची गई लगभग 20 संगठनों तक सीमित दो सप्ताह के पूर्वावलोकन के बाद, 9 जुलाई को GPT-5.6 को सामान्य उपलब्धता में लाया। यह परिवार तीन स्तरों में आता है: सोल, इसका प्रमुख मॉडल, जिसकी कीमत प्रति मिलियन टोकन इनपुट पर $5 और आउटपुट पर $30 है; टेरा, एक मध्य-स्तरीय मॉडल, जिसकी कीमत $2.50 और $15 है, जिसे OpenAI का कहना है कि यह आधी लागत पर GPT-5.5 के बराबर है; और लूना, एक तेज़, कम लागत वाला स्तर, जिसकी कीमत $1 और $6 है।

OpenAI की रिपोर्ट है कि सोल आर्टिफिशियल एनालिसिस कोडिंग एजेंट इंडेक्स में सबसे आगे है और टर्मिनल-बेंच 2.1 पर 88.8% अंक प्राप्त करता है, जो इसके नए अल्ट्रा मोड में चार उप-एजेंटों को समानांतर रूप से चलाने पर 91.9% तक बढ़ जाता है। तीनों स्तरों को साइबर और जैविक दुरुपयोग की संभावना के लिए OpenAI की उच्चतम आंतरिक जोखिम रेटिंग प्राप्त है, जिसने सरकारी-पर्यवेक्षित पूर्वावलोकन के दौरान अतिरिक्त समीक्षा को ट्रिगर किया।
किमी K3 ओपन वेट मॉडल को सीमा की ओर धकेलता है
मूनशॉट एआई ने 16 जुलाई को किमी K3 जारी किया, जो 896 कुल विशेषज्ञों और प्रति कार्य 16 सक्रिय विशेषज्ञों वाला 2.8 ट्रिलियन पैरामीटर का मिक्स्चर ऑफ एक्सपर्ट्स मॉडल है। इस मॉडल में 1 मिलियन टोकन की कॉन्टेक्स्ट विंडो और नेटिव मल्टीमोडल इनपुट है, और इसकी एपीआई कीमत प्रति मिलियन टोकन इनपुट के लिए $3 और आउटपुट के लिए $15 है। मूनशॉट ने 27 जुलाई तक पूर्ण ओपन वेट्स प्रकाशित करने की प्रतिबद्धता जताई है।

K3 अब तक जारी किया गया सबसे बड़ा ओपन-वेट मॉडल है, जो पिछली सबसे बड़ी व्यापक रूप से उपयोग की जाने वाली ओपन मॉडल से लगभग 75% बड़ा है। स्वतंत्र ट्रैकर्स वर्तमान फ्रंटियर सिस्टम में K3 को चौथे स्थान पर रखते हैं, जो Claude Fable 5 और GPT-5.6 Sol के बाद लेकिन Claude Opus 4.8 से आगे है।
पुराने मॉडलों के साथ अंतर क्यों मायने रखता है
200,000 टोकन से कम की संदर्भ विंडो (context windows) के कारण डेवलपर्स को पहले बड़े कोडबेस या रिसर्च पैकेट को टुकड़ों में तोड़ना पड़ता था। इस समूह का हर मॉडल अब 500,000 टोकन या उससे अधिक पर चलता है, जिनमें से चार में से तीन 1 मिलियन (दस लाख) पर हैं, जिससे एक ही सत्र में पूरी रिपॉजिटरी या प्राथमिक स्रोत दस्तावेज़ों का एक ढेर रखा जा सकता है।
एजेंट की विश्वसनीयता में भी सुधार हुआ है। 2023 और 2024 की अवधि के सिस्टम कुछ टूल कॉल्स के बाद अक्सर अपना प्लान खो देते थे। इस महीने जारी किए गए मॉडल दर्जनों समन्वित चरणों को बनाए रखने और टूल कॉल के खराब डेटा लौटाने पर रुकने के बजाय, उससे उबरने के लिए बनाए गए हैं।
डेवलपर्स के लिए, इसका व्यावहारिक प्रभाव किसी भी एक बेंचमार्क पर उच्च सीमा के बजाय प्रति पूरा कार्य कम लागत है। Opus 5 में प्रयास नियंत्रण, GPT-5.6 में स्तरित मूल्य निर्धारण, और Grok 4.5 के पीछे के दक्षता दावे एक ही लक्ष्य की ओर इशारा करते हैं: टीमों को यह चुनने देना कि किसी कार्य के लिए कितनी कंप्यूटिंग शक्ति की आवश्यकता है, बजाय इसके कि हर अनुरोध के लिए प्रमुख कीमतें चुकानी पड़ें।
उद्यमों और नीति निर्माताओं के लिए, GPT-5.6 का सरकारी-नियंत्रित रोलआउट इस बात का संकेत देता है कि अब सबसे बड़े मॉडलों के रिलीज़ शेड्यूल में निगरानी अंतर्निहित है, न कि बाद में जोड़ी गई है। जून में एंथ्रोपिक द्वारा फेबल और मिथोस की पहुंच पर सरकार द्वारा निर्देशित अस्थायी रोक इसी पैटर्न का एक पिछला संस्करण था।
यह लेख AI का उपयोग करके अंग्रेज़ी से अनुवादित किया गया था। मूल अंग्रेज़ी संस्करण आधिकारिक स्रोत है; स्वचालित अनुवादों में अशुद्धियाँ हो सकती हैं, विशेष रूप से कानूनी और नियामक शब्दावली में।

















