
Nvidia ने Nemotron 3.5 Lightning को ओपन-सोर्स किया
यह मॉडल डाउनलोड, उपयोग और संशोधित करने के लिए स्वतंत्र है, और एजेंट-शैली की अनुमान के लिए लक्षित NeMo Switchyard रूटिंग के साथ आता है।
एनवीडिया ने 11 अगस्त को नेमोट्रॉन 3.5 लाइटनिंग जारी किया, जिसे एक ओपन-सोर्स एआई मॉडल के रूप में वर्णित किया गया है जो "हल्का" है और एक लैपटॉप या डेस्कटॉप पर एकल जीपीयू पर चल सकता है। कंपनी इस रिलीज को "फ्री एआई" के रूप में पेश कर रही है जो अनुमान के उपयोग का विस्तार करता है जबकि अभी भी जीपीयू की मांग को बनाए रखता है।
मुख्य निष्कर्ष
- नेमोट्रॉन 3.5 लाइटनिंग एनवीडिया का नया जारी किया गया ओपन-सोर्स मॉडल है, जिसे "हल्का" बताया गया है और इसे लैपटॉप या डेस्कटॉप सेटअप में एकल जीपीयू पर चलाने के लिए डिज़ाइन किया गया है।
- एनवीडिया कंपनियों को बिना अनुमति या भुगतान के मॉडल डाउनलोड, उपयोग और संशोधित करने की अनुमति दे रहा है, इसे स्थानीय अनुमान के लिए एक बिना रुकावट वाला प्रवेश द्वार के रूप में स्थापित कर रहा है।
- कंपनी ने कहा कि उसने छोटे लाइटनिंग मॉडल को बड़े नेमोट्रॉन मॉडलों के समान क्षमताएँ देने के लिए डिस्टिलेशन का उपयोग किया।
- वितरण हगिंगफेस और एनवीडिया की वेबसाइट के लिए निर्धारित है, जिसे नेमो स्विचयार्ड सॉफ़्टवेयर के साथ जोड़ा गया है जो किसी दिए गए कार्य के लिए "सबसे सस्ता और सबसे उपयुक्त" मॉडल का चयन करता है।
नेमोट्रॉन 3.5 लाइटनिंग: एनवीडिया का सिंगल-जीपीयू, संशोधित करने के लिए स्वतंत्र ओपन मॉडल
एनवीडिया ने 11 अगस्त को नेमोट्रॉन 3.5 लाइटनिंग जारी किया, इसे "हल्का" ओपन-सोर्स एआई मॉडल के रूप में वर्णित किया गया है जो एक लैपटॉप या डेस्कटॉप पर एकल जीपीयू पर चल सकता है। स्थिति स्पष्ट है: स्थानीय, एकल-मशीन अनुमान, न कि केवल क्लाउड, पे-पर-कॉलएपीआईस्थिति।
व्यावसायिक शर्तें तंत्र का दूसरा आधा हिस्सा हैं। Nvidia ने कहा कि मॉडल कंपनियों के लिए डाउनलोड, उपयोग और संशोधित करने के लिए मुफ्त है "बिना अनुमति लिए या Nvidia को भुगतान किए," जो दो सामान्य बाधाओं को हटा देता है जो अपनाने में देरी करती हैं: लाइसेंसिंग वार्ता और प्रति-टोकन मूल्य निर्धारण।
एनविडिया ने रिलीज को एक विशेष निर्माण तकनीक से भी जोड़ा। कंपनी के प्रतिनिधियों ने कहा कि डिस्टिलेशन का उपयोग नेमोट्रॉन 3.5 लाइटनिंग को बड़े नेमोट्रॉन मॉडलों के "समान क्षमताएँ" देने के लिए किया गया, यह एक दावा है जो महत्वपूर्ण है क्योंकि यह मॉडल कच्चे पैमाने के बजाय दक्षता पर बेचा जा रहा है।
‘फ्री एआई’ एक GPU मांग रणनीति के रूप में—और यह क्रिप्टो कंप्यूट नैरेटिव्स के लिए क्यों महत्वपूर्ण है
Nvidia का सिद्धांत है कि ओपन वितरण हार्डवेयर की मांग को कम नहीं करता, बल्कि इसे बढ़ाता है। कंपनी का तर्क सीधा है: यहां तक कि "मुफ्त" मॉडल भी कहीं न कहीं चलाने की आवश्यकता होती है, और अनुमान के सीमांत लागत को कम करना स्वामित्व वाले विकल्पों की तुलना में कुल उपयोग को बढ़ा सकता है।
सीईओ जेनसेन हुआंग ने इस ढांचे के बारे में असामान्य रूप से स्पष्टता दिखाई है। जुलाई में एक साक्षात्कार में, उन्होंने कहा: "फ्री एआई हार्डवेयर के लिए शानदार होना चाहिए। फ्री एआई चिप्स के लिए शानदार होना चाहिए।" यह एक सिंगल-जीपीयू मॉडल के पीछे का दांव है जो एक डेवलपर वर्कस्टेशन, एक छोटे उद्यम सर्वर, या बैकग्राउंड कार्यों को चलाने वाले एक समर्पित बॉक्स पर जीवित रह सकता है।
क्रिप्टो ट्रेडर्स के लिए, प्रासंगिकता एक मॉडल के बेंचमार्क स्कोर के बारे में कम है और इसके बजाय यह उस मांग के आकार के बारे में है जो यह दर्शाता है। यदि स्थानीय इनफेरेंस इतना सस्ता हो जाता है कि यह हमेशा चालू रह सके, तो कंप्यूट मांग बर्स्टी, केंद्रीकृत API कॉल से स्थायी कार्यभार की ओर स्थानांतरित हो जाती है जो अधिकतर बुनियादी ढांचे के खर्च की तरह दिखती है। उस कथा का बाजारों पर GPU की कमी, DePIN कंप्यूट नेटवर्क, और “ पर मूल्य निर्धारण के तरीके पर डाउनस्ट्रीम प्रभाव पड़ता है।एआई एजेंट"टोकन कहानियाँ जो समय-समय पर संकेतों के बजाय निरंतर अनुमान पर निर्भर करती हैं।"
पकड़ यह है कि उद्धृत रिलीज विवरण इनमें से किसी की भी मात्रा नहीं बताते हैं। कोई भी प्रकट किए गए पैरामीटर की गिनती नहीं है, कोई प्रकाशित बेंचमार्क नहीं हैं, और न ही कोई अपनाने के मापदंड हैं, इसलिए "फ्री AI अधिक GPUs को चलाता है" की कहानी अभी भी एक रणनीतिक दावा है न कि एक मापी गई परिणाम।
वितरण, एजेंट, और नेमो स्विचयार्ड: हमेशा-ऑन अनुमान के लिए घर्षण को कम करना
Nvidia Nemotron 3.5 Lightning को उन चैनलों के माध्यम से आगे बढ़ा रहा है जो मॉडलों को संचालन में लाते हैं, केवल घोषित नहीं करते। कंपनी ने कहा कि यह मॉडल HuggingFace और Nvidia की अपनी वेबसाइट पर उपलब्ध होगा, जो उन डेवलपर्स के लिए व्यावहारिक मार्ग है जो वजन खींचना, फाइन-ट्यून करना और प्रबंधित सेवा की प्रतीक्षा किए बिना तैनात करना चाहते हैं।
उत्पाद का ढांचा एजेंटों की ओर भी झुकता है। Nvidia ने कहा कि यह मॉडल विशेष रूप से AI एजेंटों के लिए विकसित किया गया था, जिसका अर्थ है ऐसे प्रोग्राम जो पृष्ठभूमि में स्वायत्त रूप से चल सकते हैं। यह महत्वपूर्ण है क्योंकि एजेंट डिजाइन द्वारा अनुमान-भारी होते हैं: वे लगातार काम करते हैं, उपकरणों को कॉल करते हैं, और वे कई छोटे आउटपुट उत्पन्न करते हैं जहाँ प्रति कार्य लागत हावी होती है।
मॉडल के साथ, Nvidia ने NeMo Switchyard सॉफ़्टवेयर जारी किया है जो उसने कहा कि किसी दिए गए कार्य के लिए "सबसे सस्ता और सबसे उपयुक्त" AI मॉडल निर्धारित कर सकता है। यांत्रिक रूप से, यह एक रूटिंग परत है: हर अनुरोध को उपलब्ध सबसे बड़े मॉडल पर डिफ़ॉल्ट करने के बजाय, कार्य की अनुमति होने पर कार्यभार को छोटे या सस्ते मॉडलों की ओर मोड़ा जा सकता है।
यह रूटिंग कहानी Nvidia के लिए दो तरह से कटती है। यदि Switchyard एक मेनू के पार अनुकूलित करता है जो अभी भी Nvidia GPUs पर सबसे अच्छा चलता है, तो यह कुल अनुमान मात्रा बढ़ा सकता है और कार्यभार को Nvidia के स्टैक पर स्थिर रख सकता है। यदि यह एक तटस्थ ब्रोकर बन जाता है जो सस्ते विकल्पों के लिए Nvidia हार्डवेयर से दूर रूट करता है, तो यह एक दरार बन जाता है जिसका उपयोग प्रतिस्पर्धी कर सकते हैं। अंश यह निर्दिष्ट नहीं करता कि Switchyard अपना निर्णय कैसे लेता है या यह किस मॉडल सेट को रूट कर सकता है।
Nvidia के लिए निगरानी करने के लिए संकेत Nemotron 3.5 Lightning मॉडल को ओपन-सोर्स करने के लिए
पहला मान्यता बिंदु तकनीकी प्रकटीकरण है। चाहे Nvidia बेंचमार्क, पैरामीटर गिनती, या तृतीय-पक्ष मूल्यांकन प्रकाशित करता है, यह तय करेगा कि व्यापारी "एकल GPU" और "समान क्षमताएँ" के दावों को कितनी गंभीरता से ले सकते हैं, विशेष रूप से एजेंट-शैली के कार्यभार के लिए जहाँ विलंबता और उपकरण-उपयोग विश्वसनीयता महत्वपूर्ण हैं।
दूसरा अपनाना है जो तैनाती की तरह दिखता है न कि छेड़छाड़। Nvidia ने कहा कि CrowdStrike, CodeRabbit, और Harvey ने मॉडल का परीक्षण और अनुकूलन किया, जो एक प्रारंभिक उद्यम संकेत है, लेकिन बाजार दोहराने योग्य पैटर्न देखना चाहेगा: HuggingFace की खींच, अधिक नामित उत्पादन उपयोग के मामले, और सबूत कि कंपनियाँ वास्तव में उत्पादों के भीतर Lightning भेज रही हैं।
नीति वह ओवरहैंग है जो पूरे ओपन-मॉडल व्यापार को जल्दी से पुनर्मूल्यांकन कर सकती है। यह रिलीज एक वाशिंगटन बहस के भीतर आती है जो चीन के मूनशॉट AI द्वारा Kimi K3 की घोषणा के बाद तेज हो गई, और राजनेताओं ने बौद्धिक संपदा चोरी के संभावित वेक्टर के रूप में आसवन के बारे में चिंताएँ उठाईं। अमेरिका के किसी भी नए बयान या ओपन-वेट रिलीज या आसवन के चारों ओर प्रस्तावित प्रतिबंधों का महत्व एक मार्केटिंग चक्र से अधिक होगा, क्योंकि वे व्यावहारिक रूप से "संशोधन के लिए स्वतंत्र" का अर्थ बदल सकते हैं।
अंत में, देखें कि NeMo Switchyard कैसे विकसित होता है। अपडेट जो स्पष्ट करते हैं कि "सबसे सस्ता/सबसे उपयुक्त" रूटिंग कैसे निर्धारित की जाती है, और क्या डिफ़ॉल्ट कार्यभार को Nvidia GPUs की ओर धकेलते हैं, व्यापारी को बताएंगे कि यह एक डेवलपर सुविधा है या अनुमान खर्च के लिए एक जानबूझकर नियंत्रण स्तर है।
मेरी राय: ओपन मॉडल एक प्रतिस्पर्धात्मक मोर्चा बन रहे हैं, न कि एक चैरिटी कदम।
यह कहानी का वह हिस्सा है जो यह तय करता है कि क्या Nemotron 3.5 Lightning "ओपन-सोर्स" है सबसे सख्त लाइसेंसिंग अर्थ में, यह है कि क्या Nvidia ओपन वेट्स को प्रति दिन अधिक इनफेरेंस मिनटों में बदल सकता है। एक सिंगल-GPU मॉडल जिसे संशोधित करने के लिए स्वतंत्र है, एक वॉल्यूम प्ले है, और हुआंग की यह लाइन कि "फ्री एआई चिप्स के लिए शानदार होनी चाहिए" Nvidia द्वारा दी गई इरादे की सबसे स्पष्ट घोषणा है।
वास्तविक परीक्षण यह है कि क्या रूटिंग लेयर आदत बन जाती है। यदि NeMo Switchyard एजेंट वर्कलोड के सामने बैठता है और लगातार उन मॉडलों का चयन करता है जो Nvidia GPUs पर कुशलता से चलते हैं, तो ओपन रिलीज एक वितरण रणनीति की तरह दिखने लगती है जो मांग को बढ़ाती है न कि एक बार का पीआर इशारा।