A dimly lit data center with rows of servers
AI

Nvidia समर्थित Reflection GPU सर्वर लॉक करने के बाद मॉडल…

स्टार्टअप ने डेटा-संवेदनशील संस्थानों के लिए "एआई फैक्ट्री" का प्रस्ताव देते हुए नेबियस और स्पेसएक्स के साथ बड़े एनवीडिया सर्वर-भाड़े के सौदे किए।

Elliot Marsh द्वारा5 मिनट का पठन

Nvidia द्वारा समर्थित स्टार्टअप Reflection जल्द ही एक शक्तिशाली ओपन-वेट AI मॉडल जारी करने की तैयारी कर रहा है, जबकि Nebius और SpaceX के साथ बड़े किराए के सौदों के माध्यम से Nvidia AI सर्वर क्षमता सुरक्षित कर रहा है। यह संयोजन उन संस्थानों को लक्षित करता है जो अपने डेटा पर स्वामित्व वाले AI स्टैक चलाना चाहते हैं बिना केवल बंद-मॉडल APIs पर निर्भर किए।

रिफ्लेक्शन ओपन-वेट लॉन्च के करीब पहुंचता है क्योंकि यह एनविडिया सर्वर क्षमता को लॉक करता है।

Reflection, एक Nvidia-समर्थित स्टार्टअप, जल्द ही एक “शक्तिशाली” ओपन-वेट AI सिस्टम जारी करने की तैयारी कर रहा है, जिसे प्रमुख अमेरिकी प्रयोगशालाओं के बंद फ्रंटियर मॉडलों के उपयोग के लिए एक सस्ती वैकल्पिक के रूप में रखा जा रहा है जब इसे Nvidia GPUs के साथ जोड़ा जाता है। “ओपन-वेट” का मतलब है कि मॉडल के वेट डाउनलोड करने और चलाने या आंतरिक रूप से अनुकूलित करने के लिए उपलब्ध हैं, न कि केवल एक होस्टेड के माध्यम से सुलभ।एपीआई

यह बताता है कि Reflection वास्तविक तैनाती मात्रा के लिए योजना बना रहा है, जो कि मार्केटिंग नहीं, बल्कि कंप्यूटिंग है। हाल के हफ्तों में, कंपनी ने Nebius और SpaceX के साथ "विशाल" सौदे किए हैं ताकि Nvidia AI सर्वर किराए पर लिए जा सकें, प्रभावी रूप से GPU क्षमता को आरक्षित किया जा सके जिसे वह प्रशिक्षण, फाइन-ट्यूनिंग, और इनफेरेंस के लिए ग्राहकों के ऑनलाइन आने पर उपयोग कर सके। शर्तें सार्वजनिक नहीं की गईं, और Reflection के एक प्रवक्ता ने टिप्पणी करने से इनकार कर दिया।

सूत्रों का मानना है कि पहले Reflection मॉडल का लॉन्च के समय सबसे उन्नत अमेरिकी बंद मॉडलों के पीछे होना अपेक्षित है, लेकिन यह शीर्ष चीनी ओपन-वेट मॉडलों के साथ प्रतिस्पर्धी होगा। यह मध्यवर्ती स्थिति महत्वपूर्ण है क्योंकि मॉडल को संचालन में उपयोगी होने के लिए अग्रणी होने की आवश्यकता नहीं है। यदि यह "पर्याप्त सक्षम" है, तो संस्थाएं इसे उच्च गुणवत्ता वाले आंतरिक डेटा के साथ मिलाकर विशेष प्रणाली बना सकती हैं जो संकीर्ण, डोमेन-विशिष्ट कार्यप्रवाहों में अधिक महंगे अग्रणी सेटअप को चुनौती देती हैं।

"एआई फैक्ट्री" पिच: स्थानीयकृत मॉडल, स्वामित्व डेटा, और ट्रेडिंग फर्मों को क्यों परवाह है

Reflection का मुख्य उत्पाद ढांचा "AI फैक्टरी" है, जो संस्थानों के लिए स्थानीयकृत AI पारिस्थितिकी तंत्र स्थापित करने के लिए एक पैकेज्ड दृष्टिकोण है। यांत्रिक रूप से, कार्यप्रवाह सीधा है: एक संस्था अपने स्वामित्व वाले डेटा को लेती है, Reflection के मॉडल लागू करती है, और उस स्टैक को चलाती है जिसे वह नियंत्रित करती है। मुद्दा केवल अनुकूलन का नहीं है। यह संवेदनशील डेटा को संस्था की परिधि के भीतर रखना है जबकि आधुनिक मॉडल क्षमता प्राप्त करना है।

इसलिएहेज फंडऔर ट्रेडिंग फर्म पिच में दिखाई देती हैं। ये दुकानें पहले से ही "उच्च सुरक्षा डेटा" पर बैठी हैं, और कई संरचनात्मक रूप से इसे तीसरे पक्ष के एपीआई में भेजने के लिए एलर्जी होती हैं, यहां तक कि उद्यम शर्तों के तहत भी। एक ओपन-वेट मॉडल तैनाती सतह क्षेत्र को बदलता है। विक्रेता के होस्ट किए गए मॉडल को प्रॉम्प्ट और संदर्भ भेजने के बजाय, एक फर्म आंतरिक रूप से अनुमान चला सकती है, निजी कॉर्पोरा पर फाइन-ट्यून कर सकती है, और पूरी पाइपलाइन को उपकरण कर सकती है, जिसमें लॉगिंग और एक्सेस नियंत्रण शामिल हैं, ताकि आंतरिक अनुपालन से मेल खा सके।

कंप्यूट लॉक-अप तंत्र का दूसरा आधा हिस्सा है। केवल ओपन-वेट बोतल गर्दन को हल नहीं करता है यदि आप बड़े पैमाने पर जीपीयू को विश्वसनीय रूप से स्रोत नहीं कर सकते, विशेष रूप से लेटेंसी-संवेदनशील अनुमान या बार-बार फाइन-ट्यूनिंग चक्रों के लिए। नेबियस और स्पेसएक्स के माध्यम से एनवीडिया एआई सर्वर किराए पर लेकर, रिफ्लेक्शन उन दो बाधाओं को बंडल करने की कोशिश कर रहा है जो संस्थाएं वास्तव में महसूस करती हैं: मॉडल पहुंच और कंप्यूट पहुंच। वह संयोजन "इन्फ्रास्ट्रक्चर उत्पाद" के करीब है बजाय एक मॉडल ड्रॉप के।

रिफ्लेक्शन ने पहले ही एक संप्रभु एआई संदर्भ में एआई फैक्ट्री अवधारणा का परीक्षण करना शुरू कर दिया है, दक्षिण कोरिया में शिनसेगाए ग्रुप के साथ एक संप्रभु एआई फैक्ट्री साझेदारी की घोषणा की है। इस फ्रेमिंग में "संप्रभु एआई" का मतलब डेटा और नियंत्रण को एक विशेष देश या संस्था के भीतर रखना है सुरक्षा और शासन कारणों से, जो स्पष्ट रूप से यह बताता है कि पश्चिमी उद्यमों और सरकारी उपयोगकर्ताओं ने अत्यधिक सक्षम चीनी ओपन-वेट मॉडलों को तैनात करने में संकोच क्यों किया है।

बेंचमार्क, लाइसेंसिंग, और पश्चिमी ओपन-वेट लहर: रिलीज में क्या मॉनिटर करना है

तत्काल अज्ञात यह है कि बेंचमार्क शर्तों में "प्रतिस्पर्धात्मक" का क्या अर्थ है। रिफ्लेक्शन ने तकनीकी बेंचमार्क, पैरामीटर गिनती, हार्डवेयर आवश्यकताओं, या तीसरे पक्ष के मूल्यांकन प्रकाशित नहीं किए हैं जो बाजार को इसे प्रमुख चीनी ओपन-वेट मॉडलों या शीर्ष अमेरिकी बंद फ्रंटियर मॉडलों के खिलाफ सटीक रूप से रखने की अनुमति देंगे।

लाइसेंसिंग उद्यम अपनाने के लिए दूसरा गेटिंग आइटम है। "ओपन-वेट" अभी भी व्यावहारिक रूप से महत्वपूर्ण प्रतिबंधों के साथ आ सकता है, जिसमें वाणिज्यिक उपयोग, पुनर्वितरण, और फाइन-ट्यूनिंग अधिकारों पर सीमाएं शामिल हैं। उन संस्थाओं के लिए जो आंतरिक रूप से तैनात करना चाहती हैं, एक अनुमत वाणिज्यिक लाइसेंस और एक अधिक प्रतिबंधात्मक शोध-शैली लाइसेंस के बीच का अंतर एक पायलट और उत्पादन के बीच का अंतर है।

कंप्यूट तीसरा चर है जो यह तय करेगा कि एआई फैक्ट्री पिच वास्तविक है या नहीं। नेबियस और स्पेसएक्स सर्वर-भाड़े के सौदों को "विशाल" के रूप में वर्णित किया गया है, लेकिन बिना प्रकट क्षमता, अवधि, या मूल्य निर्धारण के, इसे समर्थित अनुमान थ्रूपुट या प्रशिक्षण पैमाने में अनुवाद करना कठिन है। ये विवरण भी संकेत देंगे कि क्या रिफ्लेक्शन जीपीयू के लिए एक दोहराने योग्य आपूर्ति चैनल बना रहा है या बस लॉन्च से पहले दुर्लभ क्षमता को पकड़ रहा है।

रिफ्लेक्शन की रिलीज भी पश्चिमी खिलाड़ियों से अन्य ओपन-वेट मॉडल रिलीज के समान महीने में आने की उम्मीद है, जो मूल्य निर्धारण, लाइसेंसिंग, और उद्यम पैकेजिंग पर प्रतिस्पर्धात्मक दबाव जोड़ता है। यदि एक तंग विंडो में कई विश्वसनीय पश्चिमी ओपन-वेट विकल्प आते हैं, तो विभाजनकर्ता कच्चे मॉडल गुणवत्ता से तैनाती एर्गोनॉमिक्स, समर्थन, और गारंटीकृत कंप्यूट में बदल सकता है।

मेरी राय: कंप्यूट एक्सेस असली खाई है—जब तक मॉडल स्पेक्स अन्यथा साबित नहीं होते

वह भाग जो यह तय करता है कि संस्थानों के लिए Reflection महत्वपूर्ण है या नहीं, वह "open-weight" लेबल नहीं है, बल्कि यह है कि क्या कंपनी वास्तविक सीमाओं के तहत एक उपयोगी स्टैक प्रदान कर सकती है: ऐसा लाइसेंस जो आंतरिक तैनाती की अनुमति देता है, और पर्याप्त Nvidia क्षमता जो बिना लाइन में खड़े हुए फाइन-ट्यूनिंग और इनफेरेंस का समर्थन कर सके। Nebius और SpaceX के किराए ऐसे लगते हैं जैसे open-weight को कुछ ऐसा बनाने का प्रयास किया जा रहा है जिसे खरीदारी वास्तव में खरीद सके।

जो सीमा महत्वपूर्ण है वह सरल है: यदि बेंचमार्क और तीसरे पक्ष के मूल्यांकन मॉडल को लगभग उसी स्थान पर रखते हैं जहां स्रोतों की अपेक्षा होती है, और लाइसेंस उद्यम-हितैषी है, तो Reflection उन पश्चिमी दुकानों से मांग जीत सकता है जो गैर-चीनी open-weight सिस्टम चाहती हैं, भले ही यह अग्रणी न हो। यदि या तो मॉडल उस बैंड के तहत प्रदर्शन करता है या लाइसेंस और कंप्यूट शर्तें बहुत कड़ी हैं, तो AI फैक्ट्री का पिच "बस एक और मॉडल फ़ाइल" में वापस गिर जाता है।

स्रोत