
Google ने Gemini 4 Argon साइबर सुरक्षा भागीदारों को दिया
सीमा मॉडल अमेरिकी सरकार की पूर्व-रिलीज़ मूल्यांकन द्वारा नियंत्रित है, जिसमें अभी तक कोई सार्वजनिक लॉन्च तिथि या नामित भागीदार नहीं हैं।
एलेफ़बेट ने जेमिनी 4 आर्गन का अनावरण किया और एक चरणबद्ध रोलआउट शुरू किया जो व्यापक डेवलपर रिलीज़ के बजाय चयनित साइबर सुरक्षा भागीदारों के साथ शुरू होता है। गूगल अमेरिका सरकार की प्री-रिलीज़ सुरक्षा मूल्यांकन भी चला रहा है, आक्रामक बेंचमार्क दावों को जानबूझकर सीमित पहुँच पथ के साथ जोड़ते हुए।
गूगल ने जेमिनी 4 आर्गन का रोलआउट शुरू कर दिया है, जिसे वह अब तक का सबसे उन्नत AI मॉडल बताता है, जिसमें "कोडिंग, साइबर सुरक्षा, और जटिल पेशेवर कार्यों में प्रमुख सुधार" शामिल हैं। पहले की पहुँच सीमित है: आर्गन एक चयनित सेट के "विश्वसनीय साइबर सुरक्षा भागीदारों" के लिए चरणबद्ध रिलीज़ के पहले चरण के रूप में जा रहा है, जिसमें व्यापक उपलब्धता को स्पष्ट रूप से एक बाद के कदम के रूप में फ्रेम किया गया है।
यह चरणबद्ध रोलआउट महत्वपूर्ण है क्योंकि यह एक वितरण विकल्प है, न कि केवल एक मार्केटिंग लाइन। गूगल ने प्रारंभिक भागीदारों का नाम नहीं लिया या यह स्पष्ट नहीं किया कि किसी संगठन को "विश्वसनीय" के रूप में क्या योग्य बनाता है, और न ही उसने सार्वजनिक लॉन्च की तारीख या बाद के चरणों के लिए विस्तृत कार्यक्रम प्रकाशित किया।
कंपनी आर्गन को अपनी खुद की संचालन में पहले से उपयोगी के रूप में भी प्रस्तुत कर रही है। गूगल ने कहा कि मॉडल का आंतरिक रूप से अपने डेटा केंद्रों में मेमोरी को ऑप्टिमाइज़ करने के लिए उपयोग किया जा रहा है, "सैकड़ों टेराबाइट मेमोरी" को बिना अतिरिक्त हार्डवेयर खरीदे मुक्त कर रहा है। उसने यह भी कहा कि क्वांटम कंप्यूटिंग शोधकर्ताओं ने इस मॉडल का उपयोग किया है।
बेंचमार्क पोजिशनिंग: जहां गूगल कहता है कि आर्गन GPT-6 एस्ट्रा, ग्रोक 4.7, और एंथ्रोपिक को मात देता है या उनके बराबर है।
गूगल का आर्गन के लिए प्रदर्शन पिच व्यापक और प्रतिस्पर्धात्मक है। कंपनी ने कहा कि आर्गन "वास्तविक दुनिया के सॉफ़्टवेयर इंजीनियरिंग में एक नया रिकॉर्ड स्थापित करता है," "साइबर सुरक्षा में पहले स्थान पर है," और "एक और बेंचमार्क का नेतृत्व करता है" जो वित्त, कानूनी, और अन्य पेशेवर कार्यों में प्रदर्शन को मापता है।
सामने से तुलना में, गूगल ने कहा कि आर्गन साइबर सुरक्षा बेंचमार्क पर OpenAI के GPT-6 एस्ट्रा और ग्रोक 4.7 के साथ बराबरी पर है। उसने यह भी कहा कि आर्गन Vals इंडेक्स पर GPT-6 एस्ट्रा और हाल के एंथ्रोपिक मॉडलों से आगे है, जो एक बेंचमार्क इंडेक्स है जिसे गूगल ने पेशेवर कार्यों में प्रदर्शन को मापने के रूप में संदर्भित किया, बिना प्रदान की गई जानकारी में इसकी पद्धति को परिभाषित किए।
व्यापारियों के लिए पकड़ यह है कि क्या स्पष्ट नहीं है। गूगल ने "वास्तविक दुनिया के सॉफ़्टवेयर इंजीनियरिंग" रिकॉर्ड दावे के पीछे बेंचमार्क नाम या स्कोरिंग विवरण निर्दिष्ट नहीं किया, और उसने क्रॉस-पेशेवर तुलना के लिए उपयोग किए गए "एक और बेंचमार्क" की पहचान नहीं की। बिना उन मूलभूत तत्वों के, दावे को दोहराने योग्य हार्नेस या तीसरे पक्ष की नकल के लिए मैप करना कठिन है।
गूगल ने आर्गन को अपने जेमिनी 3.8 फ्लैश साइबर मॉडल से एक महत्वपूर्ण साइबर सुरक्षा कदम के रूप में भी प्रस्तुत किया जो सितंबर में पहले जारी किया गया था, जिसमें कमजोरियों की खोज में बेहतर प्रदर्शन शामिल है। यह एक साइबर-केंद्रित मॉडल लाइन के लिए एक तेज़ पुनरावृत्ति गति है, और यह अपेक्षाएँ स्थापित करता है कि "फ्रंटियर" रिलीज़ को सुरक्षा क्षमता के आधार पर अधिक से अधिक उचित ठहराया जा सकता है न कि सामान्य चैट प्रदर्शन के आधार पर।
सार्वजनिक पहुँच से पहले सुरक्षा गेटकीपिंग: अमेरिका सरकार के मूल्यांकन और प्रॉम्प्ट-इंजेक्शन सुरक्षा उपाय।
गूगल ने आर्गन की सार्वजनिक उपलब्धता को सुरक्षा प्रक्रिया से जोड़ा है, न कि केवल मॉडल की तैयारी से। कंपनी ने कहा कि यह व्यापक लॉन्च से पहले प्री-रिलीज़ सुरक्षा मूल्यांकन पर अमेरिकी सरकार के साथ काम करेगी, और इसे विश्वास बनाने के लिए विशेष रूप से चरणबद्ध रिलीज़ योजना के रूप में वर्णित किया, जबकि एक रक्षा-प्रबल मॉडल को रक्षकों के हाथों में लाने के लिए।
“इस तरह से रोलआउट शुरू करने से हमें अधिक विश्वास मिलता है, लेकिन यह हमें एक ऐसा मॉडल देने में भी सक्षम बनाता है जो साइबर रक्षा में प्रशिक्षित और मजबूत है, जिसे रक्षकों के हाथों में जल्द से जल्द लाया जा सके,” तुलसी डोशी, गूगल के जेमिनी मॉडल उत्पाद प्रमुख ने कहा।
गूगल ने यह भी कहा कि यह सार्वजनिक रूप से लॉन्च करने से पहले चार प्रमुख साइबर सुरक्षा क्षेत्रों में सुरक्षा उपायों को बढ़ाने पर विचार कर रहा है, और इसने स्पष्ट रूप से दुरुपयोग और प्रॉम्प्ट इंजेक्शन का नाम लिया। प्रॉम्प्ट इंजेक्शन वह तकनीक है जहां एक हमलावर एआई सिस्टम को नियमों की अनदेखी करने या संवेदनशील जानकारी प्रकट करने के लिए इनपुट को तैयार करता है, और यह एक ऐसा विफलता मोड है जो तब सबसे अधिक महत्वपूर्ण होता है जब मॉडल को ऐसे उपकरणों में एम्बेड किया जाता है जो कोड, क्रेडेंशियल्स या वर्कफ़्लोज़ को छू सकते हैं।
दो निकट-अवधि के मील के पत्थर रोलआउट पथ को मूल्य निर्धारण में आसान बनाएंगे: गूगल द्वारा प्रारंभिक साइबर सुरक्षा भागीदारों का नामकरण या पहले समूह से परे पहुंच का विस्तार करना, और गूगल द्वारा या तो एक सार्वजनिक लॉन्च तिथि प्रकाशित करना या अमेरिकी सरकार के प्री-रिलीज़ मूल्यांकन के बाद एक स्पष्ट चरणबद्ध कार्यक्रम। तीसरा है प्रकटीकरण: “रिकॉर्ड” और क्रॉस-प्रोफेशनल दावों के पीछे के अनिर्दिष्ट बेंचमार्क पर अधिक विवरण, साथ ही किसी भी तीसरे पक्ष की पुष्टि।
मेरी राय: क्यों साइबर-प्रथम रिलीज़ क्रिप्टो व्यापारियों के लिए बेंचमार्क से अधिक महत्वपूर्ण है।
वह भाग जो यह तय करता है कि क्या यह एक वास्तविक बाजार इनपुट है, वह वल्स इंडेक्स लाइन आइटम नहीं है, यह वितरण गेट है। एक साइबर-भागीदार-प्रथम रोलआउट का मतलब है कि गूगल आर्गन को एक क्षमता के रूप में देख रहा है जिसे नियंत्रित एक्सपोज़र और वास्तविक दुनिया के प्रतिकूल परीक्षण की आवश्यकता है, और अनाम-भागीदार विवरण यह बताता है कि यह एक बंद पायलट के करीब है न कि एक चमकदार प्लेटफ़ॉर्म क्षण।
जो सीमा महत्वपूर्ण है वह यह है कि क्या अमेरिकी सरकार के प्री-रिलीज़ सुरक्षा मूल्यांकन एक ठोस समयरेखा और शिप करने योग्य नियंत्रणों में बदलते हैं, विशेष रूप से दुरुपयोग और प्रॉम्प्ट इंजेक्शन के आसपास। यदि गूगल भागीदारों का नाम लेना शुरू करता है, बेंचमार्क हार्नेस विवरण प्रकाशित करता है, और “चरणों” से तिथियों की ओर बढ़ता है, तो आर्गन एक सीमा प्रदर्शन की कहानी बनना बंद कर देता है और वास्तव में सुरक्षा खर्च और एआई अवसंरचना स्थिति को बदलने वाला एक परिचालन उत्प्रेरक बन जाता है।