
OpenAI और Anthropic ने कीमतें घटाईं, DeepSeek का उपयोग बढ़ा
GPT-6 Sol/Luna के लिए 50% लागत में कटौती की योजना बनाई गई है और Opus 5.5 लगभग 40% सस्ता है, जबकि DeepSeek V4.1 Flash ने 172% साप्ताहिक उपयोग में वृद्धि दर्ज की है।
एक नई सप्ताह-आधारित रिलीज़ चक्र प्रमुख AI मॉडलों की लागत को कम कर रहा है, जिसमें OpenAI और Anthropic पुराने स्तरों को केवल छूट देने के बजाय तेज़ मूल्य कटौती का प्रचार कर रहे हैं। OpenRouter से प्रारंभिक उपयोग डेटा, जहाँ DeepSeek का V4.1 Flash "इस सप्ताह" 172% की वृद्धि के साथ नंबर 1 पर है, यह दर्शाता है कि प्रति-टोकन मूल्य में कमी मांग को बढ़ा रही है, भले ही प्रयोगशालाएँ मार्जिन दबाव का सामना कर रही हों।
मुख्य निष्कर्ष
- OpenAI ने GPT-6 को जारी करने की योजना बनाई।सोलऔर मंगलवार को GPT-6 लूना के लिए शीर्ष व्यावसायिक ग्राहकों की लागत पिछले संस्करणों की तुलना में 50% कम कर दी गई।
- Anthropic ने मंगलवार को Opus 5.5 के लिए लक्षित किया, यह कहते हुए कि इसे चलाने की लागत Opus 5 की तुलना में लगभग 40% कम है जबकि "शीर्ष बुद्धिमत्ता" को बनाए रखा जाता है।
- xAI ने सोमवार को Grok 4.7 जारी किया और इसे मूल्य-प्रदर्शन पर विपणन किया, लेकिन प्रतिस्पर्धी लॉन्च ने 24 घंटों के भीतर उस मूल्य लाभ को काफी हद तक संकुचित कर दिया।
- DeepSeek का V4.1 Flash OpenRouter की लीडरबोर्ड पर नंबर 1 पर रहा और “इस सप्ताह” उपयोग में 172% की वृद्धि दर्ज की।
फ्लैगशिप मॉडल तेजी से सस्ते हो रहे हैं: GPT-6 सोल/लूना, ओपस 5.5, और ग्रोक 4.7
इस सप्ताह की AI रिलीज़ की गति को एक शुद्ध क्षमता की दौड़ के रूप में कम और एक मूल्य सूची के पुनर्लेखन के रूप में अधिक विपणन किया जा रहा है। OpenAI ने मंगलवार को GPT-6 Sol और GPT-6 Luna जारी करने की योजना बनाई, जो समान मॉडलों के पिछले संस्करणों की तुलना में शीर्ष व्यावसायिक ग्राहकों के लिए लागत को 50% कम कर रहा है।
Anthropic ने Opus 5.5 को उसी दिन जारी करने की योजना बनाई और कहा कि इसे चलाना Opus 5 की तुलना में लगभग 40% कम खर्चीला है, जबकि उच्चतम बुद्धिमत्ता बनाए रखी जाती है। सामान्य धागा नवीनतम "फ्लैगशिप" स्तर पर स्पष्ट लागत संकुचन है, न कि केवल नए लॉन्च के बाद पुराने मॉडलों पर कीमतें कम करने का सामान्य पैटर्न।
xAI का कदम गति निर्धारित करता है। एलोन मस्क की xAI ने सोमवार को Grok 4.7 जारी किया, जो मॉडल को मूल्य-प्रदर्शन के चारों ओर स्थापित करता है, और प्रतिस्पर्धात्मक प्रतिक्रिया तुरंत आई। 24 घंटों के भीतर, नए विकल्पों ने Grok 4.7 के मूल्य लाभ को काफी हद तक कम कर दिया, यह एक तेज़ याद दिलाने वाला संकेत है कि अग्रणी मॉडलों में मूल्य निर्धारण शक्ति एक ही समाचार चक्र में समाप्त हो सकती है।
प्रति-टोकन लागत, समझाया गया: क्यों मूल्य में कटौती कुल AI खर्च को बढ़ा सकती है
इस लड़ाई में महत्वपूर्ण इकाई टोकन है। प्रति-टोकन लागत वह मूल्य है जो एक प्रदाता एक पाठ की इकाई को संसाधित या उत्पन्न करने के लिए चार्ज करता है, और यह विभिन्न मॉडलों के बीच संचालन लागत की तुलना करने का सबसे सरल तरीका है जब बाकी सब कुछ बदल रहा हो।
प्रति-टोकन कीमतों में कटौती का मतलब स्वचालित रूप से यह नहीं है कि बाजार AI पर कम खर्च करता है। तंत्र सीधा है: जब एक मॉडल को कॉल करना सस्ता हो जाता है, तो डेवलपर्स अधिक फीचर्स भेजते हैं जो पहले बहुत महंगे थे, उपयोगकर्ता लंबे सत्र चलाते हैं, और कंपनियाँ "उच्च मूल्य" संकेतों के लिए इसे आरक्षित करने के बजाय मॉडल के माध्यम से अधिक कार्यप्रवाह चलाती हैं। इससे कुल टोकन मात्रा इतनी बढ़ सकती है कि कुल खर्च बढ़ता रहे, भले ही प्रति टोकन की कीमत गिरती हो।
यह गतिशीलता जेवन्स के विरोधाभास के पीछे की अंतर्दृष्टि है, यह आर्थिक विचार है कि जब किसी संसाधन का उपयोग करना सस्ता हो जाता है, तो कुल उपभोग घटने के बजाय बढ़ सकता है। इस मामले में, "संसाधन" अनुमान है, और दांव यह है कि कम कीमतें नए उपयोग को इतना खोलती हैं कि कंप्यूट मीटर चलता रहे।
पैकेट में बिक्री पक्ष का ढांचा उस मात्रा की कहानी की ओर झुकता है। सिटाडेल सिक्योरिटीज ने ग्राहकों को बताया कि प्रति-टोकन लागत में गिरावट अतिरिक्त उपयोग को बढ़ावा दे रही है और समग्र एआई खर्च बढ़ रहा है, जिसे उसने तर्क किया कि यह एआई प्रयोग के पीछे कंप्यूटिंग शक्ति प्रदान करने वाले एआई प्रयोगशालाओं या कंपनियों के लिए अंततः उच्च लाभ की ओर इशारा करता है। मॉर्गन स्टेनली ने एक समान मांग-पक्ष का मामला बनाया, चीनी प्रदाताओं से प्रतिस्पर्धा को ढालते हुए।तेजAI के लिए क्योंकि सस्ता एक्सेस अधिक ग्राहकों को आकर्षित कर सकता है और कंप्यूटिंग की कुल मांग बढ़ा सकता है।
अडॉप्शन प्रूफ प्वाइंट: DeepSeek V4.1 फ्लैश ने OpenRouter को पीछे छोड़ दिया क्योंकि उपयोग में 172% की वृद्धि हुई।
पैकेट में सबसे साफ डेटा बिंदु एक बेंचमार्क स्कोर नहीं है। यह एक लीडरबोर्ड और एक उपयोग स्पाइक है।
DeepSeek का V4.1 Flash OpenRouter के लीडरबोर्ड पर नंबर 1 पर रैंक किया गया और इस सप्ताह में उपयोग में 172% की वृद्धि दर्ज की। OpenRouter एक एग्रीगेटर है जो कई मॉडलों के बीच अनुरोधों को रूट करता है और रैंकिंग प्रकाशित करता है जिसका उपयोग व्यापारी और निर्माता अपनाने की गति के लिए एक मोटे प्रॉक्सी के रूप में करते हैं।
DeepSeek वह उदाहरण भी है जिसका उपयोग पैकेट incumbents पर ओपन-वेट दबाव को परिभाषित करने के लिए करता है। एक ओपन-वेट मॉडल वह है जहां प्रशिक्षित पैरामीटर उपलब्ध कराए जाते हैं ताकि अन्य इसे चलाने या फाइन-ट्यून करने में सक्षम हों, जो अक्सर पूरी तरह से बंद प्रस्तावों की तुलना में सस्ती या अधिक लचीली तैनाती को सक्षम करता है। पैकेट नोट करता है कि DeepSeek ने कहा कि V4.1 Flash अपने पूर्व प्रमुख पर कई बेंचमार्क पर तकनीकी अपडेट के माध्यम से बेहतर है जो इसे कम चार्ज करने की अनुमति देते हैं, हालांकि बेंचमार्क सूट और परिणाम यहाँ प्रदान नहीं किए गए हैं।
बड़ा बिंदु प्रतिस्पर्धात्मक है, न कि वैचारिक। जब ओपन-वेट प्रदाता व्यापक रूप से देखी जाने वाली रैंकिंग में चढ़ते हैं जबकि कीमत को कम करते हैं, तो वे बंद प्रयोगशालाओं को लागत पर प्रतिक्रिया देने के लिए मजबूर करते हैं, और इस सप्ताह की प्रमुख मूल्य निर्धारण भाषा उस प्रतिक्रिया की तरह पढ़ती है।
व्यापारियों के लिए पुष्टि चेकलिस्ट: उपयोग-से-राजस्व, मूल्य निर्धारण फर्श, और लीडरबोर्ड शेयर
पहला पुष्टि बिंदु यह है कि क्या मूल्य कटौती वास्तविक हैं केवल उस स्थान पर जो मायने रखता है: रिलीज के बाद की मूल्य निर्धारण पृष्ठ और उद्यम शर्तें। OpenAI का शीर्ष व्यवसाय ग्राहकों के लिए 50% की कमी और Anthropic का Opus 5.5 के लिए ~40% कम रन लागत बड़े आंकड़े हैं, लेकिन पैकेट में $/token के सटीक आंकड़े या यह नहीं बताया गया है कि कौन से ग्राहक और उपयोग स्तर योग्य हैं।
दूसरा यह है कि क्या OpenRouter की रैंकिंग और उपयोग प्रवृत्तियाँ अगले एक से दो सप्ताह में DeepSeek V4.1 Flash को नंबर 1 पर या उसके निकट बनाए रखती हैं, या क्या लीडरबोर्ड मंगलवार की प्रमुख रिलीज के बाद वापस लौटता है। एक सप्ताह का स्पाइक नवाचार, प्रोत्साहन, या रूटिंग डिफ़ॉल्ट हो सकता है। स्थायी शेयर एक अलग दावा है।
तीसरा उपयोग-से-राजस्व पुल है। पैकेट OpenAI और Anthropic पर मार्जिन दबाव को चिह्नित करता है क्योंकि मूल्य युद्ध तेज होता है, और यह अभी भी अनसुलझा है कि क्या उच्च टोकन मात्रा स्थायी राजस्व वृद्धि में परिवर्तित होती है जब प्रति-टोकन मूल्य निर्धारण संकुचित हो रहा है।
अंत में, देखें कि पुनर्मूल्यांकन कितनी तेजी से फैलता है। Grok 4.7 का लाभ 24 घंटों के भीतर प्रतिस्पर्धा में खो जाना एक टेम्पलेट है। यदि वही तेज पुनर्मूल्यांकन अधिक “फ्लैश” या छोटे वेरिएंट पर हिट करता है, तो बाजार संभवतः उस मूल्य निर्धारण फर्श की ओर बढ़ रहा है जिसे सबसे सस्ती कंप्यूट और सबसे अच्छी वितरण करने वाला सेट करता है, न कि जो कोई एकल प्रमुख लॉन्च जीतता है।
मेरी राय: मूल्य युद्ध प्रयोगशालाओं के लिए एक मार्जिन कहानी और कंप्यूट के लिए एक मात्रा कहानी की तरह दिखता है।
यह तय करने वाला हिस्सा यह नहीं है कि कौन सा मॉडल "सर्वश्रेष्ठ" है, बल्कि यह है कि क्या सस्ती अनुमानित लागत कार्यभार को इतना बढ़ाती है कि कुल खर्च बढ़ता रहे। पैकेट का ठोस प्रमाण संकीर्ण है लेकिन दिशा में संगत है: DeepSeek का V4.1 Flash OpenRouter पर 172% साप्ताहिक उपयोग वृद्धि के साथ नंबर 1 पर बैठा है, यह जिवन्स-पैराडॉक्स मांग का असली रूप है, यहां तक कि मंगलवार के प्रमुख कटौती से पहले।
सच्ची परीक्षा यह है कि क्या लॉन्च के बाद की मूल्य निर्धारण पृष्ठ और उद्यम शर्तें घोषित 50% और ~40% कटौतियों की पुष्टि करती हैं और क्या नए प्रमुख उत्पादों के आने के बाद लीडरबोर्ड शेयर बना रहता है। यदि ये दो बातें मेल खाती हैं, तो सेटअप संरचनात्मक दिखने लगता है: प्रयोगशालाएँ मार्जिन युद्ध लड़ती हैं जबकि कंप्यूट मांग मात्रा पर ऊँची रहती है।