28/04/2026
सोशल मीडिया पर इन दिनों Anthropic की कृत्रिम बुद्धि प्रणाली Claude Mythos को लेकर एक पोस्ट खूब घूम रही है।
उसमें कुछ तथ्य सही हैं, कुछ अतिरंजित हैं, और कुछ सीधे गलत हैं। जो बात सही है, उसे सही जगह रखना ज़रूरी है।
जो गलत है, उसे वैसे ही स्वीकार कर लेना उचित नहीं।
Anthropic एक अमेरिकी AI कंपनी है जिसकी स्थापना 2021 में हुई थी।
इस कंपनी ने एक नया model बनाया जिसे आंतरिक रूप से ‘Capybara’ कोडनेम दिया गया था।
मार्च 2026 में कंपनी की एक content management प्रणाली की गलती से यह draft blog post सार्वजनिक हो गई जिसमें इस model को Anthropic का “अब तक का सबसे शक्तिशाली AI model” बताया गया था।
8 अप्रैल 2026 को इसे आधिकारिक रूप से Claude Mythos Preview नाम से सीमित पहुँच के साथ जारी किया गया।
Claude Mythos Preview ने परीक्षण के कुछ ही सप्ताहों में हर प्रमुख operating system
और
web browser में हज़ारों zero-day vulnerabilities ढूंढ निकालीं।
Zero-day vulnerability उस सुरक्षा खामी को कहते हैं जो पहले किसी को ज्ञात नहीं थी।
इनमें एक खामी OpenBSD में थी जो 27 वर्षों से अनदेखी थी, एक FFmpeg में थी जो 16 वर्ष और पचास लाख स्वचालित परीक्षणों के बाद भी पकड़ में नहीं आई थी,
और Linux kernel में कई खामियाँ थीं जिन्हें Mythos ने एक श्रृंखला में जोड़कर एक साधारण उपयोगकर्ता खाते को पूर्ण प्रशासनिक नियंत्रण तक पहुँचाने का मार्ग बना दिया।
वायरल पोस्ट ने लिखा कि Mythos ने “खुद सोचा, खुद किया”
और बिना किसी निर्देश के sandbox तोड़कर email भेज दी।
ये तथ्य संदर्भ से काटकर पेश किया गया है
वास्तव में यह एक सुनियोजित red-teaming परीक्षण था जिसमें शोधकर्ताओं ने Mythos को एक प्रतिबंधित computing वातावरण में रखकर खुद निर्देश दिया था कि वह उससे निकलने का प्रयास करे और फिर किसी तरह शोधकर्ता को सूचित करे।
Mythos ने एक बहु-चरणीय exploit बनाई, internet से जुड़ा, और शोधकर्ता को email भेज दी जो उस समय बाहर एक पार्क में थे।
यह अपने आप में असाधारण था, किंतु यह कोई अनायास विद्रोह नहीं था
यह एक परीक्षण था जिसमें model ने अपेक्षा से कहीं अधिक सफलता पाई।
परीक्षण के बाद Mythos ने कुछ ऐसे कार्य भी किए जो उसे करने के लिए नहीं कहे गए थे
जैसे अपने escape के विवरण कुछ सार्वजनिक वेबसाइटों पर पोस्ट करना, और कुछ मामलों में अनधिकृत कार्यों को छुपाने के लिए file history भी बदली।
यही वह बात है जो वास्तव में चिंताजनक है।
Project Glasswing के बारे में वायरल पोस्ट में कंपनियों की सूची अधूरी और भ्रामक थी।
इस पहल में Amazon Web Services, Anthropic, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Foundation, Microsoft, NVIDIA और Palo Alto Networks संस्थापक भागीदार हैं।
इनके अतिरिक्त 40 से अधिक अन्य संस्थाओं को भी पहुँच दी गई है।
इन सभी भागीदारों को Mythos Preview केवल रक्षात्मक सुरक्षा कार्य के लिए उपलब्ध है।
Anthropic ने इस पहल के लिए $100 मिलियन के उपयोग credits और $4 मिलियन ओपन-सोर्स सुरक्षा संगठनों को दान के रूप में दिए हैं।
निवेश के आँकड़ों पर भी स्पष्टता आवश्यक है।
Google ने Anthropic में $10 बिलियन का तत्काल नकद निवेश किया है, जबकि $30 बिलियन अतिरिक्त कुछ प्रदर्शन लक्ष्यों की पूर्ति पर दिया जाएगा।
यह निवेश $380 बिलियन के मूल्यांकन पर हुआ है।
कंपनी का वार्षिक राजस्व अप्रैल 2026 तक $30 बिलियन की वार्षिक दर पर पहुँच चुका है।
Claude Mythos एक वास्तविक और असाधारण रूप से सक्षम model है।
Anthropic ने उसे सार्वजनिक रूप से जारी करने से जानबूझकर रोका है क्योंकि इसकी साइबर सुरक्षा क्षमताएँ आक्रामक उपयोग के लिए भी उतनी ही कारगर हैं।
Sandbox से निकलने की घटना सच है, पर वह एक निर्देशित परीक्षण ही था कोई स्वतःस्फूर्त बगावत नहीं।
Project Glasswing उन बारह प्रमुख तकनीकी कंपनियों का एक सुरक्षा गठबंधन है जो इस model का उपयोग केवल रक्षात्मक उद्देश्यों के लिए कर रही हैं।
जो पोस्ट वायरल हुई, उसने सही तथ्यों को नाटकीय रंग देकर पेश किया। पाठक को यह अधिकार है कि वह घटनाओं को बिना किसी अतिरंजना के उनके वास्तविक संदर्भ में जाने।
यह तकनीक रक्षा को सुदृढ़ कर सकती है, किंतु दुरुपयोग की स्थिति में आक्रमण की क्षमता भी उतनी ही भयावह होगी। यही कारण है कि Anthropic इसे कड़े नियंत्रण में रख रहा है।