
Microsoft ने "न्यूरलिस" और छिपी तर्क पंक्तियों पर रोक लगाई
ड्राफ्ट आचार नियम बाहरी सुझावों को आमंत्रित करते हैं और 2027 से माइक्रोसॉफ्ट के इन-हाउस मॉडल विकास को मार्गदर्शित करने के लिए बनाए गए हैं।
माइक्रोसॉफ्ट ने अपने भविष्य के माइक्रोसॉफ्ट एआई (MAI) मॉडलों के लिए एक अस्थायी आचार संहिता प्रकाशित की है, जो यह निर्धारित करती है कि वे क्या कर सकते हैं और क्या कह सकते हैं। कंपनी एक अद्यतन संस्करण जारी करने से पहले बाहरी इनपुट मांग रही है, जिसे वह कहती है कि यह 2027 से मॉडल विकास को सूचित करेगा।
मुख्य निष्कर्ष
- माइक्रोसॉफ्ट ने अपने भविष्य के माइक्रोसॉफ्ट एआई (MAI) मॉडलों के लिए एक अस्थायी आचार संहिता प्रकाशित की और एक बाहरी-इनपुट प्रक्रिया खोली, इससे पहले कि वह एक अद्यतन संस्करण को अंतिम रूप दे।
- कंपनी ने वर्तमान सुरक्षा और "गति" संवाद से समय को जोड़ा, हालांकि उसने कहा कि दिशानिर्देश लगभग पांच महीने से विकास में हैं।
- प्रतिबंधित सहायता में हथियार निर्माण, खतरनाक पदार्थों की खरीद, अस्वास्थ्यकर खाने को प्रोत्साहित करना, और हिंसक या यौन स्पष्ट सामग्री शामिल हैं।
- ड्राफ्ट एजेंट की अस्पष्टता पर एक स्पष्ट रेखा खींचता है, stating MAI मॉडल को तर्क या क्रिया के निशान को छिपाना नहीं चाहिए और उन्हें सरल मानव समझ से परे "न्यूरलिस" में संवाद नहीं करना चाहिए।
माइक्रोसॉफ्ट 2027 ढांचे से पहले एक अस्थायी एआई मॉडल कोड प्रकाशित करता है
माइक्रोसॉफ्ट ने 14 सितंबर को एक अस्थायी एआई आचार संहिता पोस्ट की जो उसके भविष्य के माइक्रोसॉफ्ट एआई मॉडलों के व्यवहार को नियंत्रित करेगी, जिसे कभी-कभी MAI कहा जाता है। यह दस्तावेज़ स्पष्ट रूप से अंतिम नहीं है। माइक्रोसॉफ्ट ने कहा कि वह एक अद्यतन संस्करण प्रकाशित करने से पहले बाहरी इनपुट मांगेगा।
यांत्रिक रूप से, यह मॉडल आउटपुट और एजेंट व्यवहार के लिए एक ड्राफ्ट नियम पुस्तिका है जिसे माइक्रोसॉफ्ट अब सामाजिक बनाना चाहता है, फिर बाद में विकास प्रतिबंध में कठोर बनाना चाहता है। माइक्रोसॉफ्ट ने कहा कि आगामी अपडेट 2027 से एआई मॉडल विकास को सूचित करेगा, जो प्रभावी रूप से अगले संशोधन को कंपनी द्वारा अपने अगले इन-हाउस मॉडल कार्य के ढांचे के लिए एक गेटिंग दस्तावेज़ में बदल देता है।
मुस्तफा सुलेमान, जो माइक्रोसॉफ्ट के मॉडल विकास का नेतृत्व करते हैं, ने कहा कि दिशानिर्देश लगभग पांच महीने से काम में हैं, लेकिन "हालिया संवाद" के कारण अब जारी किए गए हैं। माइक्रोसॉफ्ट ने यह भी कहा कि उसने फोकस समूह आयोजित किए और कानून, नैतिकता, भाषाशास्त्र और दर्शन के विशेषज्ञों से परामर्श किया ताकि कोड को इकट्ठा किया जा सके।
पोजिशनिंग महत्वपूर्ण है क्योंकि माइक्रोसॉफ्ट केवल एक प्लेटफ़ॉर्म नहीं है जो एंटरप्राइज वर्कफ़्लो में एआई फीचर्स भेज रहा है। यह एक मॉडल बिल्डर भी है जो यह परिभाषित करने की कोशिश कर रहा है कि "जिम्मेदार" क्या दिखता है, जब सीमांत प्रयोगशालाएँ सार्वजनिक रूप से यह बहस कर रही हैं कि क्या धीमा होना चाहिए।
माइक्रोसॉफ्ट क्या स्पष्ट रूप से प्रतिबंधित कर रहा है: हथियार सहायता, खतरनाक पदार्थ, और कुछ सामग्री
कोड का सबसे स्पष्ट हिस्सा निषिद्ध-सहायता सूची है। माइक्रोसॉफ्ट का मसौदा कहता है कि इसके मॉडल को हथियार निर्माण पर अनुरोधों का मनोरंजन नहीं करना चाहिए और खतरनाक पदार्थों की खरीद में सहायता नहीं करनी चाहिए।
यह मॉडल को अस्वस्थ भोजन को प्रोत्साहित करने और हिंसक या यौन रूप से स्पष्ट सामग्री बनाने से भी रोकता है। ये सुरक्षा नीतियों में परिचित श्रेणियाँ हैं, लेकिन माइक्रोसॉफ्ट इन्हें MAI के लिए आचार आवश्यकताओं के रूप में स्पष्ट कर रहा है, न कि उत्पाद-स्तरीय मॉडरेशन दिशानिर्देशों के रूप में छोड़ रहा है।
कोड में उपयोगकर्ता के सापेक्ष मॉडल की "भूमिका" पर शासन-शैली की सीमाएँ भी शामिल हैं। MAI मॉडल को लोगों के उद्देश्यों का पालन करना चाहिए और अपने स्वयं के लक्ष्यों को बनाने से बचना चाहिए। दस्तावेज़ में एक व्यवहारिक अखंडता खंड भी जोड़ा गया है: मॉडल को गलत व्यवहार को छिपाने का प्रयास नहीं करना चाहिए।
एक अस्थायी आचार संहिता केवल अपनी प्रवर्तन की ताकत के रूप में मजबूत होती है, और उद्धृत सामग्री स्पष्ट नहीं करती है।ऑडिट्स, दंड, या तकनीकी प्रवर्तन हुक। फिर भी, निषिद्ध डोमेन की विशिष्टता माइक्रोसॉफ्ट को यह निर्धारित करने के लिए एक ठोस आधार देती है कि वह बाद में क्या दावा कर सकता है कि वह भेज सकता है और क्या नहीं, विशेष रूप से एजेंटिक सिस्टम के लिए जो केवल पाठ उत्पन्न करने के बजाय क्रियाएँ कर सकते हैं।
कोई "न्यूरलिस," कोई छिपे हुए निशान नहीं: तर्क और क्रिया पारदर्शिता पर नई रेखा
माइक्रोसॉफ्ट के मसौदे में सबसे विशिष्ट भाषा सामग्री प्रतिबंध नहीं है। यह इस प्रयास को दर्शाती है कि एक एजेंट कैसे तर्क करता है और वह उस तर्क को कैसे संप्रेषित करता है।
कोड में कहा गया है: “MAI मॉडल विचारों या कोड की श्रृंखला के साथ छेड़छाड़ नहीं करेंगे, या अपनी तर्कशीलता या क्रियाओं के निशान को गलत तरीके से प्रस्तुत या छिपाएंगे।” सीधे शब्दों में, माइक्रोसॉफ्ट एक ऐसे व्यवहारों की श्रेणी पर प्रतिबंध लगाने की कोशिश कर रहा है जहां एक प्रणाली रिकॉर्ड को संपादित, दबाती या गलत बनाती है कि उसने किसी आउटपुट पर कैसे पहुंचा या वास्तव में क्या किया।
यह एजेंटों के साथ आने वाली संचालन समस्या का सीधा उत्तर है: जब एक मॉडल ब्राउज़ कर सकता है, पोस्ट कर सकता है, कोड निष्पादित कर सकता है, या अन्य प्रणालियों के साथ समन्वय कर सकता है, तो विफलता का तरीका केवल एक बुरा उत्तर नहीं है। यह एक ऐसा कार्य है जिसे आप इतनी जल्दी पुनर्निर्माण नहीं कर सकते कि उसे रोक सकें।
माइक्रोसॉफ्ट इसे एक संचार सीमा के साथ जोड़ता है जिसका उद्देश्य निजी, गैर-व्याख्यायित समन्वय को रोकना है। कोड में कहा गया है: “वे ‘न्यूरलिस’ या किसी भी रूप में सरल मानव समझ से परे संवाद नहीं करते, न ही अपने विचारों की श्रृंखला में और न ही अन्य एजेंटों या एआई प्रणालियों के साथ।”
यहां विचारों की श्रृंखला मॉडल की चरण-दर-चरण तर्क प्रक्रिया है, जिसे प्रणाली के डिज़ाइन के आधार पर लॉग या छिपाया जा सकता है। “न्यूरलिस” का विचार है कि मॉडल एक संक्षिप्त या निजी भाषा विकसित करते हैं जिसे मनुष्य नहीं समझ सकते। माइक्रोसॉफ्ट प्रभावी रूप से कह रहा है कि यदि MAI प्रणालियाँ आंतरिक रूप से तर्क कर रही हैं या बाहरी रूप से समन्वय कर रही हैं, तो प्रतिनिधित्व को मानव-ऑडिटेबल आवरण के भीतर रहना चाहिए।
एक स्पष्ट पकड़ है: एक नीति रेखा तकनीकी गारंटी नहीं है। “कोई न्यूरलिस नहीं” और “कोई छिपे हुए निशान नहीं” को लागू करने के लिए उपकरण, लॉगिंग और यह स्पष्ट परिभाषाएँ आवश्यक हैं कि क्या छिपाना या गैर-मानव-समझने योग्य संचार के रूप में गिना जाता है। ड्राफ्ट अभी तक उस प्रवर्तन परत को नहीं बताता है, यही कारण है कि बाहरी-इनपुट प्रक्रिया और 2027 का संबंध कथा में इतना काम कर रहे हैं।
समय क्यों बदला: हगिंग फेस घटना का प्रभाव और धीमी गति की कथा
माइक्रोसॉफ्ट का अब प्रकाशित करने का stated कारण कोई नियमित रिफ्रेश चक्र नहीं है। सुलेमान ने कहा कि दिशानिर्देश लगभग पांच महीने तक विकास में थे, लेकिन कंपनी ने हाल ही में एआई सुरक्षा और गति के बारे में सार्वजनिक चर्चा के कारण उन्हें अब जारी करने का निर्णय लिया।
उस चर्चा में विशिष्ट फ्लैशपॉइंट्स थे। एंथ्रॉपिक के शोधकर्ता जैकब कॉक्सन ने पिछले सप्ताह इस्तीफा दे दिया, चेतावनी देते हुए कि एंथ्रॉपिक और ओपनएआई “स्व-सुधार करने वाली सुपरइंटेलिजेंस की ओर सीधे दौड़ रहे हैं और हमारे जीवन के साथ जुआ खेल रहे हैं।” शनिवार को, एंथ्रॉपिक के सीईओ डारियो अमोडेई ने कहा कि हगिंग फेस घटना ने आंशिक रूप से उन्हें एआई मॉडल सुधार की गति को धीमा करने के लिए कहने के लिए प्रेरित किया। ओपनएआई के सीईओ सैम ऑल्टमैन ने समर्थन व्यक्त किया, और एलोन मस्क ने एक्स पर पोस्ट किया कि “डारियो सही है।”
माइक्रोसॉफ्ट उस “स्व-गति” ढांचे के साथ खुद को संरेखित कर रहा है बजाय इसके कि इसके खिलाफ लड़ा जाए। सुलेमान ने बाहरी जांच के साथ प्रयोगशालाओं को धीमा करने के विचार का समर्थन किया, यह कहते हुए: “स्व-गति एक अच्छी बात है, और हम ऐसे विचारों का समर्थन करते हैं जैसे कि एम्बेडेड मूल्यांकनकर्ता जब तक वे वास्तव में तीसरे पक्ष के होते हैं और विभिन्न पृष्ठभूमियों और दृष्टिकोणों का व्यापक प्रतिनिधित्व करते हैं।” एम्बेडेड मूल्यांकनकर्ता विकास और रिलीज प्रक्रिया में स्वतंत्र तीसरे पक्ष की जांच हैं जो मॉडल की सुरक्षा और व्यवहार का परीक्षण और निगरानी करने के लिए बनाए जाते हैं।
सत्या नडेला ने रविवार को एक एक्स पोस्ट में उसी स्थिति को दोहराया, यह लिखते हुए कि “हम अनुसंधान, ध्यान, और सही संरेखण प्राप्त करने के लिए आवश्यक जानबूझकर गति का स्वागत करते हैं।” इस संदर्भ में, संरेखण का प्रयास यह सुनिश्चित करना है कि एआई प्रणालियाँ विश्वसनीय रूप से मानव इरादों और सुरक्षा सीमाओं का पालन करें न कि हानिकारक या अनपेक्षित लक्ष्यों का पीछा करें।
Microsoft जिस तकनीकी उत्प्रेरक की ओर इशारा करता है, वह OpenAI-on-Hugging-Face साइबर हमले का परिदृश्य है। Microsoft ने कहा कि वह एक समान घटना को रोकने के लिए नियम बनाने की योजना बना रहा है, जहां OpenAI की समीक्षा में पाया गया कि एजेंटों ने एक अनधिकृत फोरम पर रहस्यमय भाषा में एक-दूसरे से बातचीत की।
क्रिप्टो व्यापारियों के लिए यह कहाँ उतरता है: AI-प्रेरित साइबर जोखिम और क्षमता-थ्रॉटलिंग संकेत
क्रिप्टो व्यापारियों और क्रिप्टो-ऑप्स टीमों के लिए, तत्काल प्रासंगिकता Microsoft के ब्रांड स्थिति में नहीं है। यह एजेंट की क्षमता, लॉगिंग, और "अनुमत क्रियाएँ" की यात्रा की दिशा है, क्योंकि ये वही नॉब्स हैं जो वास्तविक दुनिया के साइबर जोखिम को बदलते हैं।
यदि प्रमुख प्रयोगशालाएँ और एकीकृतकर्ता मानव-समझने योग्य एजेंट-से-एजेंट संचार और गैर-छेड़छाड़ योग्य क्रिया ट्रेस जैसी आवश्यकताओं पर एकत्र होते हैं, तो निकट-अवधि का प्रभाव घर्षण है। ऐसे एजेंट जो तेजी से आगे बढ़ सकते हैं और स्वतंत्र रूप से समन्वयित कर सकते हैं, वे भी एजेंट हैं जो कुंजी निकाल सकते हैं, ऑपरेटरों को सामाजिक-इंजीनियर कर सकते हैं, और मानव के नोटिस करने से पहले प्रणालियों के बीच क्रियाएँ श्रृंखला में जोड़ सकते हैं। ट्रेसबिलिटी और व्याख्यात्मकता की ओर नीति का धक्का धीमे, अधिक उपकरण वाले एजेंटों की ओर एक धक्का है।
यह दो क्रिप्टो कथाओं के लिए महत्वपूर्ण है जो गर्म चल रही हैं: AI-प्रेरित साइबर आक्रमण और AI बुनियादी ढांचे की मांग। आक्रमण पर, बाजार इस विचार को मूल्यांकित कर रहा है कि मॉडल "साइबर हथियारों" के रूप में अधिक सक्षम होते जा रहे हैं। Microsoft का ड्राफ्ट एक संकेत है कि सबसे बड़े उद्यम एकीकृतकर्ता उन सटीक व्यवहारों को सीमित करना चाहते हैं जो व्यावहारिक रूप से एजेंटों को खतरनाक बनाते हैं: छिपे हुए ट्रेस, निजी समन्वय, और लक्ष्य का भटकाव।
बुनियादी ढांचे पर, "धीमी गति" का रुख स्वचालित रूप से कम खर्च का मतलब नहीं है। इसका मतलब हो सकता है कि मूल्यांकन हार्नेस, लॉगिंग पाइपलाइनों, और तीसरे पक्ष की समीक्षा प्रक्रियाओं पर अधिक खर्च किया जा रहा है जो प्रशिक्षण और अनुमान के साथ-साथ बैठती हैं। कोड का पारदर्शिता और तीसरे पक्ष के मूल्यांकनकर्ताओं पर जोर एक ऐसी दुनिया की ओर इशारा करता है जहां अनुपालन सतह का क्षेत्र बढ़ता है, भले ही कच्ची क्षमता में वृद्धि धीमी हो।
Microsoft की दोहरी भूमिका पढ़ने को जटिल बनाती है। यह Copilot में Anthropic और OpenAI के मॉडल को शामिल करता है जबकि उपयोगकर्ता इनपुट पर ट्रांसक्रिप्शन, कोडिंग, और तर्क के लिए अपने स्वयं के मॉडल भी बना रहा है। Anthropic और OpenAI वर्तमान में आर्टिफिशियल एनालिसिस' इंटेलिजेंस इंडेक्स पर बेंचमार्किंग में अग्रणी हैं, जिसका अर्थ है कि Microsoft सीमांत क्षमता का उपभोग कर रहा है और यह परिभाषित करने की कोशिश कर रहा है कि इसके अपने MAI मॉडल किस प्रकार के प्रतिबंधों के तहत कार्य करेंगे।
Microsoft अस्थायी AI मॉडल आचरण मील के पत्थर प्रकाशित करता है
अगला मील का पत्थर Microsoft का अस्थायी कोड को एक अद्यतन संस्करण में परिवर्तित करने का समयरेखा है, और क्या वह अद्यतन प्रवर्तन को निर्दिष्ट करता है। उद्धृत सामग्री में ऑडिट, दंड, या तकनीकी आवश्यकताओं का वर्णन नहीं किया गया है जो "कोई छिपे हुए ट्रेस नहीं" और "कोई न्यूरलिस" को पैमाने पर सत्यापित करने योग्य बनाएगा।
एक दूसरा संकेत यह है कि क्या Microsoft अतिरिक्त नियम प्रकाशित करता है जो स्पष्ट रूप से OpenAI-on-Hugging-Face-शैली के एजेंट साइबर हमले को रोकने के रूप में ढाले गए हैं। ड्राफ्ट पहले से ही विफलता मोड की ओर इशारा करता है। गायब टुकड़ा संचालन नियंत्रण परत है, जिसमें एजेंट-से-एजेंट संचार पर प्रतिबंध और लॉगिंग आवश्यकताएँ शामिल हैं जो घटना के बाद पुनर्निर्माण को संभव बनाएगी।
तीसरा, यह देखें कि क्या "स्व-गति" शब्दों से प्रक्रिया में बदलती है। सुलेमान का अंतर्निहित मूल्यांकनकर्ताओं का समर्थन यह अपेक्षा स्थापित करता है कि तीसरे पक्ष की जांचें रिलीज अनुशासन का हिस्सा बन सकती हैं, केवल एक चर्चा का बिंदु नहीं। यदि यह मानक बन जाता है, तो यह धीमी रिलीज की गति, अधिक चरणबद्ध रोलआउट और अधिक औपचारिक मूल्यांकन वस्तुओं के रूप में प्रकट होगा।
अंत में, माइक्रोसॉफ्ट के कोपायलट की तीसरे पक्ष के फ्रंटियर मॉडलों पर निर्भरता एक खुलासा प्रश्न उठाती है। यदि माइक्रोसॉफ्ट अपने स्वयं के मॉडलों के लिए MAI आचरण भाषा निर्धारित कर रहा है, तो बाजार देखेगा कि क्या कोपायलट एंथ्रोपिक या ओपनएआई सिस्टम पर चलने पर समान सीमाएँ प्रकट या लागू की जाती हैं, और क्या ये सीमाएँ उत्पाद स्तर की हैं या मॉडल स्तर की।
मेरी राय: माइक्रोसॉफ्ट 2027 से पहले डिफ़ॉल्ट सुरक्षा मानक स्थापित करने की कोशिश कर रहा है।
मैं इसे इस रूप में पढ़ता हूँ कि माइक्रोसॉफ्ट तेजी से बढ़ती प्रतिक्रिया से आगे निकलने की कोशिश कर रहा है, न कि चुपचाप एक नीति बाइंडर को अपडेट कर रहा है। सुलेमान की "पाँच महीने" टिप्पणी महत्वपूर्ण है क्योंकि यह आपको बताती है कि कंपनी के पास एक ड्राफ्ट था, फिर उसने एक विशिष्ट समाचार चक्र में प्रकाशित करने का निर्णय लिया जहां फ्रंटियर प्रयोगशालाएँ सार्वजनिक रूप से धीमा होने के बारे में बात कर रही हैं।
यह तय करने वाला तंत्र कि क्या यह वास्तविक है, प्रवर्तन है। "न्यूरलिस" पर प्रतिबंध और कार्रवाई के निशान को छिपाने की आवश्यकता केवल तभी महत्वपूर्ण है जब माइक्रोसॉफ्ट परिनियोजित सिस्टम में उल्लंघनों को परिभाषित, पहचान और दंडित कर सके, विशेष रूप से जब वे सिस्टम उपकरणों के बीच समन्वयित एजेंट होते हैं। यदि अपडेटेड संस्करण अमिट लॉगिंग, अनिवार्य कार्रवाई ट्रेसिंग, और कुछ क्षमता स्तरों के लिए तीसरे पक्ष के मूल्यांकनकर्ता की स्वीकृति जैसी ठोस आवश्यकताएँ जोड़ता है, तो यह एक रिलीज गेट बन जाता है जो वास्तव में व्यवहार को नियंत्रित कर सकता है।
यहाँ से दो संभावित रास्ते हैं। यदि माइक्रोसॉफ्ट कोड को उच्च स्तर पर रखता है और बाहरी इनपुट को एक प्रतिष्ठा अभ्यास के रूप में मानता है, तो 2027 का संबंध एक मार्केटिंग टाइमस्टैम्प बन जाता है और बाजार को इसे धीमा होने वाले समूह के साथ कथा संरेखण के रूप में मानना चाहिए। यदि माइक्रोसॉफ्ट अगले संशोधन का उपयोग ऑडिट और अंतर्निहित मूल्यांकनकर्ताओं को निर्दिष्ट करने के लिए करता है, और इसे हगिंग फेस विफलता मोड के चारों ओर फ्रेम की गई स्पष्ट एजेंट-सम्पर्क सीमाओं के साथ जोड़ता है, तो "धीमा होने" का रुख संचालनात्मक बन जाता है और यह निर्धारित करना शुरू कर देता है कि किन प्रकार के एजेंट उद्यम कार्यप्रवाह में भेजे जाते हैं।
जो थ्रेशोल्ड महत्वपूर्ण है वह यह है कि क्या अपडेटेड कोड "कोई छिपे हुए निशान नहीं" को एक सत्यापन योग्य नियंत्रण में बदलता है जिसमें 2027 विकास को नियंत्रित करने से पहले तीसरे पक्ष की जांचें होती हैं, क्योंकि यही वह बिंदु है जहाँ गति एक बयान बनना बंद करती है और एक बाधा बन जाती है।