A glowing green biohazard container with a
AI

Anthropic ने Claude के गलत इस्तेमाल को रोका, बायोवेपन्स से…

यह खतरे की रिपोर्ट दिसंबर 2025 से अगस्त 2026 तक फैली हुई है और यह अमेरिका में धीमी AI बनाम इसे "जीतने" के बीच राजनीतिक विभाजन के बीच आई है।

Elliot Marsh द्वारा7 मिनट का पठन

Anthropic ने कहा कि एक नई खतरे की खुफिया रिपोर्ट ने "दुष्ट गतिविधि" के लिए अपने Claude मॉडल का उपयोग करने के प्रयासों की पहचान की और उन्हें बाधित किया, जो जैविक हथियारों के विकास का समर्थन कर सकते हैं, जिसमें पांच जैविक हथियारों से संबंधित केस अध्ययन शामिल हैं। यह खुलासा तब आया है जब अमेरिकी नेता सार्वजनिक रूप से "सुपरइंटेलिजेंस" को रोकने या प्रतिबंधित करने की मांगों और रणनीतिक लाभ के लिए AI विकास को तेज करने के लिए प्रतिस्पर्धी प्रयासों के बीच विभाजित हो गए हैं।

मुख्य निष्कर्ष

  • Anthropic ने कहा कि उसने जैविक हथियारों के विकास का समर्थन करने के लिए "दुष्ट गतिविधि" के लिए Claude का उपयोग करने के प्रयासों की पहचान की और उन्हें बाधित किया, जिसमें पांच जैविक हथियारों से संबंधित केस अध्ययन का दस्तावेजीकरण किया गया।
  • कंपनी ने Claude Haiku, Sonnet, और Opus के दुष्ट उपयोग के लिए बाधा डालने की विंडो को दिसंबर 2025 से अगस्त 2026 तक रखा।
  • उसी रिपोर्ट में छह मामलों का वर्णन किया गया है जहां Claude का उपयोग पारंपरिक हथियारों के लिए सॉफ़्टवेयर बनाने के लिए किया गया, जिसमें गोला-बारूद और उनके लक्ष्यीकरण और नियंत्रण प्रणाली शामिल हैं।
  • Anthropic ने दुरुपयोग को साइबर जासूसी और प्रभाव संचालन से भी जोड़ा, जिसमें एक रूस-आधारित अभियान और एक ईरानी प्रचार संस्थान से संबंधित गतिविधियाँ शामिल हैं।

Anthropic का कहना है कि उसने पांच केस अध्ययनों में जैविक हथियारों से संबंधित Claude के दुरुपयोग को बाधित किया।

Anthropic ने कहा कि इसकी नवीनतम खतरे की खुफिया रिपोर्ट ने जैविक हथियारों के विकास का समर्थन करने के लिए "दुष्ट गतिविधि" के लिए अपने Claude AI मॉडल का उपयोग करने के प्रयासों की पहचान की और उन्हें बाधित किया। कंपनी ने कहा कि रिपोर्ट ने "हमारे मॉडल का उपयोग करने वाले अभिनेताओं के पांच केस अध्ययन को उजागर किया जो जैविक हथियारों के विकास का समर्थन कर सकते हैं।"

यांत्रिक रूप से, एक खतरे की खुफिया रिपोर्ट एक कंपनी द्वारा अपने उत्पादों से संबंधित दुरुपयोगी गतिविधियों का पता लगाने, जांच करने और अवरुद्ध करने के तरीके का एक आवधिक खुलासा है। इस मामले में, Anthropic ने जैविक दुरुपयोग को "फ्रंटियर AI मॉडल के सबसे गंभीर जोखिमों में से एक" के रूप में फ्रेम किया, "फ्रंटियर" का अर्थ एक अत्यधिक सक्षम प्रणाली से है जो कला की स्थिति के करीब है और नए दुरुपयोग के जोखिम पैदा कर सकती है।

Anthropic ने कहा कि उसने दिसंबर 2025 और अगस्त 2026 के बीच Claude Haiku, Sonnet, और Opus के "दुष्ट उपयोग" को बाधित किया। उसने यह भी कहा कि दुरुपयोग के मामलों में से कोई भी Claude Fable या शक्तिशाली Mythos-क्लास मॉडल शामिल नहीं थे, सिवाय एक आसवन के मामले के, एक तकनीक जहां एक छोटे मॉडल को एक बड़े मॉडल के आउटपुट की नकल करने के लिए प्रशिक्षित किया जाता है और कम लागत पर क्षमताओं को स्थानांतरित कर सकता है।

रिपोर्ट का मुख्य तनाव द्वि-उपयोग है। एंथ्रोपिक ने कहा, "वही जानकारी जो जैविक हथियार विकसित करने के लिए उपयोग की जा सकती है, उदाहरण के लिए, एक वैक्सीन या एक बीमारी के इलाज के लिए भी उपयोग की जा सकती है," और चेतावनी दी कि बिना सुरक्षा उपायों के ऐसी क्षमताएँ "विनाशकारी परिणाम" दे सकती हैं।

रिपोर्ट में और क्या आरोप लगाया गया है: साइबर जासूसी, प्रचार, धोखाधड़ी, निगरानी, और हथियार सॉफ्टवेयर।

एंथ्रोपिक की रिपोर्ट ने जैव-सुरक्षा के दुरुपयोग के ढांचे को राष्ट्रीय सुरक्षा और आपराधिक श्रेणियों के मिश्रित सेट में विस्तारित किया। इसमें कहा गया कि क्लॉड का उपयोग रूस आधारित साइबर जासूसी अभियान से जुड़े अभिनेताओं और एक ईरानी प्रचार संस्थान द्वारा किया गया, प्रभाव संचालन को घुसपैठ गतिविधियों के साथ रखा।

प्रभाव संचालन सार्वजनिक राय या राजनीतिक परिणामों को आकार देने के लिए समन्वित प्रयास हैं, अक्सर प्रचार और लक्षित संदेश के माध्यम से। एंथ्रोपिक ने कहा कि पिछले आठ महीनों में उसने जो मामले पाए, वे नकली डेटिंग ऐप और होटल वाईफाई धोखाधड़ी से लेकर उन निगरानी प्रणालियों तक थे जो असंतोषियों की पहचान करने के लिए बनाई गई थीं, और उसने "राज्य-प्रायोजित समूहों, अपराधियों, स्पाइवेयर विक्रेताओं, राज्य प्रचार संस्थानों और राजनीतिक रूप से प्रेरित व्यक्तियों" द्वारा संदिग्ध दुरुपयोग का वर्णन किया।

साइबर पक्ष पर, एंथ्रोपिक ने कहा कि एक हैकिंग समूह जिसका काम रूस आधारित मिडनाइट ब्लिज़ार्ड के साथ संगत है, ने कथित तौर पर एआई का उपयोग करके एक प्रणाली बनाई जो स्वचालित रूप से पहचानती थी जब मैलवेयर को सुरक्षा रक्षा द्वारा चिह्नित किया गया था और कोड को फिर से लिखा जब तक कि यह पहचान से बच नहीं गया। मिडनाइट ब्लिज़ार्ड एक रूस से जुड़े क्लस्टर नाम है जिसका उपयोग सुरक्षा शोधकर्ताओं ने एक विशिष्ट सेट की साइबर-जासूसी गतिविधि का वर्णन करने के लिए किया, और रिपोर्ट की भाषा उस संदर्भ का संकेत देती है जो सुझावात्मक है न कि निश्चित।

रिपोर्ट ने हैकिंग समूह शाइनीहंटर्स का नाम भी लिया और रिपोर्ट में वर्णित दुरुपयोग गतिविधियों में शामिल चीन आधारित प्रयोगशालाओं का संदर्भ दिया। एंथ्रोपिक ने इसके अलावा चीनी एआई फर्मों पर क्लॉड की क्षमताओं की नकल करने का प्रयास करने का आरोप लगाया, हालांकि उद्धृत विवरण ने यह निर्दिष्ट नहीं किया कि कौन सी प्रयोगशालाएँ या कौन से नकल के तरीके उपयोग किए गए थे, केवल आसवन का उल्लेख किया गया।

एंथ्रोपिक ने यह भी कहा कि रिपोर्ट ने छह मामलों का उल्लेख किया जहाँ क्लॉड का उपयोग "परंपरागत हथियारों के लिए सॉफ्टवेयर विकसित करने के लिए किया गया, जिसमें आग्नेयास्त्र, मिसाइलें, सशस्त्र ड्रोन, बम, और अन्य गोला-बारूद, साथ ही उन्हें संचालित करने वाले लक्ष्यीकरण और नियंत्रण प्रणाली शामिल हैं।" यह महत्वपूर्ण है क्योंकि यह नीति बातचीत को अमूर्त "एआई सुरक्षा" से हथियार कार्यप्रवाहों के ठोस सक्षमकरण की ओर स्थानांतरित करता है, जो सरकार का ध्यान आकर्षित करता है, भले ही अंतर्निहित संदर्भ संभाव्य हो।

वाशिंगटन का विभाजित स्क्रीन: सैंडर्स का ठहराव और प्रतिबंध का प्रयास बनाम ट्रम्प का "एआई जीतें" ढांचा।

रिपोर्ट एक अमेरिकी नीति वातावरण में आई है जो अब स्पष्ट रूप से दो-तरफा है। सीनेटर बर्नी सैंडर्स ने उन्नत एआई विकास पर एक ठहराव की मांग की और एआई सुपरइंटेलिजेंस पर प्रतिबंध लगाने के लिए कानून पेश किया, बीबीसी के न्यूज़नाइट पर कहा: "जब वैज्ञानिक आपको बताते हैं कि इसमें एक मौका है, एक मौका कि इसका मानवता पर एक महाविनाशकारी प्रभाव हो सकता है, तो आपको मूर्ख होना चाहिए कि यह न कहें, इसे धीमा करें।"

राष्ट्रपति डोनाल्ड ट्रम्प ने उस ढांचे को अस्वीकार कर दिया और कहा कि रणनीतिक जोखिम दूसरी दिशा में चलता है। "यदि हम एआई में जीत नहीं पाते, तो हमें बहुत बुरी स्थिति में डाल दिया जाएगा," उन्होंने गुरुवार को कहा।

विभाजन बाजारों के लिए महत्वपूर्ण है क्योंकि यह शीर्षक टेप को शोरगुल में रखता है बिना नियमों के लिए एक स्पष्ट आधार केस उत्पन्न किए। एआई-संबंधित जोखिम भावना को देख रहे व्यापारी वैकल्पिक कथाओं द्वारा झटके खाते हैं, एक जो सीमांत मॉडल क्षमता को एक राष्ट्रीय सुरक्षा देयता के रूप में मानता है जिसे सीमित किया जाना चाहिए, और दूसरा जो सीमाओं को एक प्रतिस्पर्धात्मक आत्म-स्वामित्व के रूप में मानता है।

बहस को प्रयोगशालाओं के भीतर सुरक्षा नेताओं द्वारा भी मजबूत किया जा रहा है। OpenAI के मुख्य वैज्ञानिक जाकुब पाचोकी ने 2026-09-06 को लिखा कि उद्योग को “स्वैच्छिक धीमापन” लागू करना चाहिए जब तक कि सुरक्षा उपाय स्थापित नहीं हो जाते, उन्होंने जोड़ा: “मुझे चिंता है कि कोई भी मशीन बुद्धिमत्ता के निरंतर तेजी से बढ़ने के परिणामों के लिए तैयार नहीं है।”

निगरानी के लिए संकेत: सुरक्षा उपाय, पहुंच को कड़ा करना, और क्या “धीमापन” की बात नियमों में बदलती है

पहला संकेत यह है कि क्या एंथ्रोपिक का खुलासा कड़े पहुंच नियंत्रण में बदलता है न कि केवल बेहतर पहचान में। कंपनी ने कहा कि उसने अपने निष्कर्षों को अपनी प्रक्रियाओं में शामिल किया “ताकि भविष्य में इन गतिविधियों को बेहतर तरीके से रोकने, पहचानने और बाधित करने के लिए,” और कहा कि उसने प्राधिकृत अधिकारियों और उद्योग भागीदारों के साथ उपयुक्त स्थान पर खुफिया साझा किया। यह आवर्ती संचालन, निगरानी, अवरोधन, और जानकारी साझा करने की ओर इशारा करता है, न कि एक बार का समाधान।

दूसरा यह है कि क्या सैंडर्स द्वारा प्रस्तावित कानून एआई सुपरइंटेलिजेंस पर प्रतिबंध लगाने के लिए समिति की कार्रवाई, सह-प्रायोजकों, या सुनवाई में आगे बढ़ता है। एक विभाजित स्क्रीन वातावरण में, प्रक्रिया के मील के पत्थर बयानबाजी की तुलना में अधिक महत्वपूर्ण होते हैं क्योंकि वे एक समय सारणी को मजबूर करने वाली एकमात्र चीज हैं।

तीसरा यह है कि क्या अन्य प्रमुख प्रयोगशालाएँ अपने स्वयं के जैविक हथियारों से संबंधित खुलासे का विस्तार करती हैं या उपयोगकर्ताओं के लिए दिखाई देने वाले तरीकों में सुरक्षा उपायों को कड़ा करती हैं। गूगल ने मंगलवार को कहा कि किसी ने जेमिनी का उपयोग करके “हथियारबंद जैविक एजेंटों के संश्लेषण के लिए एक “पूर्ण, चरण-दर-चरण तकनीकी मार्गदर्शिका” प्राप्त करने का प्रयास किया,” और समानांतर खुलासे नीति की धुन बना सकते हैं भले ही प्रत्येक व्यक्तिगत मामला “प्रयास” दुरुपयोग के रूप में प्रस्तुत किया गया हो।

एक चौथा, अधिक तकनीकी संकेत यह है कि क्या आसवन के माध्यम से क्षमता हस्तांतरण एक बड़ा ध्यान बन जाता है। एंथ्रोपिक ने कहा कि दुरुपयोग के मामलों में से कोई भी क्लॉड फेबल या मिथोस-क्लास मॉडल शामिल नहीं था सिवाय एक आसवन उदाहरण के, जो यह याद दिलाता है कि शीर्ष मॉडल को प्रतिबंधित करना आवश्यक रूप से डाउनस्ट्रीम क्षमता को प्रतिबंधित नहीं करता है यदि छोटे मॉडल को इसकी नकल करने के लिए प्रशिक्षित किया जा सकता है।

मेरी राय: निकट-अवधि का व्यापार कथा की अस्थिरता है, न कि एकल नियामक स्विच

इस कहानी का निर्णय करने वाला भाग यह नहीं है कि क्या एक रिपोर्ट वाशिंगटन को प्रतिबंध में झटका देती है। यह इस पर निर्भर करता है कि क्या बार-बार, संचालन-विशिष्ट दुरुपयोग के खुलासे प्रयोगशालाओं को स्वचालित रूप से कड़ी पहुंच और निगरानी की ओर धकेलते हैं, क्योंकि यह “धीमा करो” और “एआई जीतें” के बीच विभाजित कानून निर्माताओं के लिए कम प्रतिरोध का मार्ग है।

जो सीमा महत्वपूर्ण है वह प्रक्रियात्मक है, न कि बयानबाजी: यदि “स्वैच्छिक धीमापन” और रोकने-और-प्रतिबंध प्रस्ताव सुनवाई, पहुंच नियमों, और लागू रिपोर्टिंग अपेक्षाओं में बदलने लगते हैं, तो एआई-नीति टेप एक भावना उत्प्रेरक बनना बंद कर देता है और यह तय करता है कि सीमांत मॉडल कैसे भेजे जाते हैं और कौन उन्हें उपयोग करने के लिए मिलता है। तब जोखिम शीर्षकों से उत्पाद सतह क्षेत्र में और, विस्तार से, व्यापक जोखिम की भूख में चला जाता है।

स्रोत