🎧 Listen to this article: हिंदी · English · தமிழ் · తెలుగు · ಕನ್ನಡ · മലയാളം · ଓଡ଼ିଆ · 日本語 · 中文
🌍 Read this in your language: हिंदी · தமிழ் · తెలుగు · ಕನ್ನಡ · മലയാളം · ଓଡ଼ିଆ · 日本語 · 中文
1 जुलाई 2026 को, Anthropic ने तीन सप्ताह के निलंबन के बाद विश्व स्तर पर अपने Claude Fable 5 मॉडल को फिर से तैनात किया। उस निलंबन के पीछे की कहानी इस बात की एक उपयोगी खिड़की है कि कैसे AI सुरक्षा, सरकारी नीति और सुरक्षा अनुसंधान अब वास्तविक समय में टकराते हैं। 3 जुलाई 2026 को, मॉडल के वापस ऑनलाइन होने के साथ, जो हुआ उस पर रिकॉर्ड सीधा करना उचित है — क्योंकि संक्षिप्त संस्करण ("एक शोधकर्ता ने Fable 5 को जेलब्रेक किया") लगभग हर उस चीज़ को छोड़ देता है जो मायने रखती है।
आइए इस बात से शुरू करें कि Fable 5 क्या है। Fable 5 Anthropic के Claude 5-परिवार के मॉडलों में से एक है, जिसे 9 जून 2026 को अधिक सक्षम सिबलिंग, Mythos 5 के साथ जारी किया गया था। Anthropic के सभी मॉडलों की तरह, दोनों हानिकारक अनुरोधों को अस्वीकार करने के लिए डिज़ाइन किए गए स्तरित सुरक्षा उपायों के साथ आते हैं। घटनाओं की श्रृंखला को जिसने शुरू किया वह कोई नाटकीय ब्रेक-इन नहीं था, बल्कि उचित चैनलों के माध्यम से दायर एक सुरक्षा रिपोर्ट थी।
शोधकर्ताओं को वास्तव में क्या मिला
यह खोज Amazon के शोधकर्ताओं की ओर से आई, न कि किसी अकेले व्यक्ति की ओर से। उन्होंने पाया कि यदि आप Fable 5 को सॉफ़्टवेयर कमजोरियों की पहचान करने के लिए प्रेरित करते हैं, तो आप इसे इसके इच्छित सुरक्षा व्यवहार से बाहर निकाल सकते हैं। एक मामले में, मॉडल ने ऐसा कोड तैयार किया जिसने प्रदर्शित किया कि इस तरह की भेद्यता का फायदा कैसे उठाया जा सकता है।
यह वह हिस्सा है जो कहानी सुनाने में खो गया। यह कोई गुप्त वाक्यांश, कोई विदेशी भाषा की चाल, या Unicode हेरफेर का मैराथन नहीं था। यह एक ऐसा अनुरोध था जो वास्तव में एक सीमा रेखा क्षेत्र में था: ऐसा काम जो नियमित, वैध रक्षात्मक साइबर सुरक्षा के साथ भारी रूप से ओवरलैप करता है — जिस तरह का काम सुरक्षा टीमें हर दिन करती हैं — लेकिन जो शोषण विवरण प्रदान करने में बदल सकता है।
मॉडल को आखिर खींचा ही क्यों गया
यहीं से नीति चित्र में प्रवेश करती है। 12 जून 2026 को, अमेरिकी सरकार ने Fable 5 और Mythos 5 दोनों पर निर्यात नियंत्रण लागू किया, जिससे Anthropic को विदेशी नागरिकों के लिए पहुंच प्रतिबंधित करने की आवश्यकता हुई। Anthropic के पास वास्तविक समय में हर उपयोगकर्ता की राष्ट्रीयता को सत्यापित करने का कोई तरीका नहीं था, इसलिए नियंत्रणों का उल्लंघन करने का जोखिम उठाने के बजाय, इसने सभी के लिए दोनों मॉडलों को निलंबित कर दिया।
यह महत्वपूर्ण बारीकी है: Fable 5 इसलिए ऑफ़लाइन नहीं गया क्योंकि यह "broken" था। यह इसलिए ऑफ़लाइन हो गया क्योंकि सुरक्षा रिपोर्ट द्वारा ट्रिगर किया गया एक सरकारी प्रतिबंध, चुनिंदा रूप से लागू नहीं किया जा सकता था — इसलिए स्थिति के हल होने तक पूर्ण निलंबन ही एकमात्र अनुपालन विकल्प था।
जब Anthropic ने करीब से देखा तो उसे क्या मिला
Anthropic के अपने परीक्षण ने किसी भी ऐसे व्यक्ति के लिए एक गंभीर परिणाम उत्पन्न किया जिसने यह मान लिया था कि यह एक अनूठा, मॉडल-विशिष्ट खतरा था। कम सक्षम मॉडल समान कमजोरियों की पहचान कर सकते थे — जिनमें Claude Opus 4.8, GPT-5.5 और Kimi K2.7 शामिल हैं। Anthropic के शब्दों में, इसके द्वारा परीक्षण किया गया प्रत्येक मॉडल एक ही प्रदर्शन उत्पन्न कर सकता था, जिनमें Claude Haiku 4.5 और Sonnet 4.6 शामिल हैं।
दूसरे शब्दों में, रिपोर्ट की गई तकनीक नियमित रक्षात्मक सुरक्षा कार्य से बंधे सुरक्षा व्यवहार के एक "borderline case" तक पहुँच गई, और इसने किसी भी अद्वितीय, Mythos-स्तर की साइबर क्षमता को उजागर नहीं किया जिसकी अन्य प्रणालियों में कमी थी। वह रीफ़्रेमिंग मायने रखती है: मुद्दा इस बारे में था कि एक अस्पष्ट रेखा कहाँ खींचनी है, न कि एक मॉडल के अंदर छिपे किसी विलक्षण सुपरवेपन के बारे में।
सुधार और वापसी का रास्ता
Anthropic ने केवल नियंत्रण हटने का इंतज़ार नहीं किया। इसने एक बेहतर सुरक्षा क्लासिफायर तैनात किया जो 99% से अधिक मामलों में विशिष्ट Amazon-रिपोर्ट किए गए बाईपास को ब्लॉक करता है। जब इसे रोल आउट किया जा रहा था, प्रभावित अनुरोधों को Claude Opus 4.8 पर पुनः रूट किया गया और उपयोगकर्ताओं को सूचित किया गया।
नीति पक्ष चरणों में आगे बढ़ा। 26 जून 2026 को, अमेरिकी सरकार ने चुनिंदा अमेरिकी संगठनों के लिए Mythos 5 की पहुंच को मंजूरी दी। 30 जून को निर्यात नियंत्रण हटा लिया गया। और 1 जुलाई को, Fable 5 को Claude Platform, Claude.ai, Claude Code, और Claude Cowork में विश्व स्तर पर फिर से तैनात किया गया, जिसमें Pro, Max, Team, और Enterprise योजनाओं के लिए 7 जुलाई तक 50% साप्ताहिक उपयोग शामिल है।
गंभीरता को मापने का एक नया तरीका
एक स्थायी परिणाम इन निर्णयों को कम तदर्थ बनाने का एक प्रयास है। Anthropic ने जेलब्रेक की गंभीरता को रेट करने के लिए एक आम सहमति ढांचा विकसित करने के लिए Amazon, Microsoft और Google के साथ साझेदारी की। यह चार मानदंडों को तौलता है: क्षमता लाभ, उस क्षमता लाभ की चौड़ाई, हथियार बनाने में आसानी, और खोज योग्यता। लक्ष्य एक साझा शब्दावली है ताकि उद्योग इस बात पर सहमत हो सके कि कब कोई खोज एक वास्तविक आपात स्थिति है बनाम एक सीमा रेखा एज केस — बिल्कुल वही अंतर जिसने इस प्रकरण को इतना भ्रमित करने वाला बना दिया।
यह एक मॉडल से परे क्यों मायने रखता है
Fable 5 एपिसोड इस बात का पूर्वावलोकन है कि एआई घटनाएं तेजी से कैसे सामने आएंगी। एक जिम्मेदार सुरक्षा रिपोर्ट अब हफ्तों के भीतर सरकारी निर्यात नियंत्रण, एक वैश्विक उत्पाद निलंबन, क्रॉस-कंपनी परीक्षण और एक नए उद्योग मानक में बदल सकती है। तकनीक, नियमन और सुरक्षा अनुसंधान अब अलग-अलग बातचीत नहीं हैं।
यह एक अनुस्मारक भी है कि "jailbreak" एक शब्द के रूप में बहुत काम कर रहा है। यहाँ जो हुआ वह एक विनाशकारी विफलता के बजाय वास्तव में एक ग्रे क्षेत्र में प्रकट किए गए एज केस के अधिक करीब था। सिस्टम, प्रकटीकरण प्रक्रिया और नीतिगत प्रतिक्रिया सभी ने काम किया — अपूर्ण रूप से, लेकिन उन्होंने काम किया।
निष्कर्ष
Amazon के शोधकर्ताओं ने रिपोर्ट किया कि Fable 5 को रक्षात्मक सुरक्षा कार्य से भेद्यता शोषण की रेखा को पार करने के लिए प्रेरित किया जा सकता है। उस रिपोर्ट ने अमेरिकी निर्यात नियंत्रणों को ट्रिगर किया, जिन्हें Anthropic चुनिंदा रूप से लागू नहीं कर सका, इसलिए इसने Fable 5 और Mythos 5 को दुनिया भर में निलंबित कर दिया। करीब से निरीक्षण करने पर, अन्य मॉडल भी ऐसा ही कर सकते थे, इसलिए जोखिम एक अद्वितीय क्षमता के बजाय एक सीमा रेखा नीतिगत प्रश्न था। Anthropic ने एक क्लासिफायर भेजा जो 99% से अधिक मामलों में रिपोर्ट किए गए बाईपास को ब्लॉक करता है, नियंत्रण हटा लिए गए, और Fable 5 1 जुलाई 2026 को वापस आ गया — एक जेलब्रेक वास्तव में कितना गंभीर है, इसे रेट करने के लिए एक नए क्रॉस-इंडस्ट्री ढांचे के साथ।
गुण
- रिकॉर्ड को सही करता है: खोजने वाले Amazon शोधकर्ता थे, और ट्रिगर निर्यात नियंत्रण था, न कि मॉडल की विफलता
- दिखाता है कि जिम्मेदार प्रकटीकरण ने इच्छित रूप में काम किया, रिपोर्ट से लेकर शमन तक
- प्रदर्शित करता है कि रिपोर्ट किया गया व्यवहार Fable 5 के लिए अद्वितीय नहीं था — कमजोर मॉडल भी ऐसा कर सकते थे
- एक ठोस सुधार पर प्रकाश डालता है: एक क्लासिफायर जो 99% से अधिक मामलों में विशिष्ट बाईपास को ब्लॉक करता है
- जेलब्रेक की गंभीरता को आंकने के लिए एक साझा, क्रॉस-कंपनी ढांचा पेश करता है
दोष
- एक संक्षिप्त वैश्विक निलंबन ने दोनों मॉडलों के हर वैध उपयोगकर्ता को बाधित किया
- वास्तविक समय में राष्ट्रीयता सत्यापन संभव नहीं है, जिससे निर्यात नियंत्रणों के लिए कुंद सब-या-कुछ-नहीं प्रतिक्रियाएं देने के लिए मजबूर होना पड़ता है
- "Borderline" सुरक्षा मामलों पर निर्णय लेना कठिन होता है और ये असंगत नीतिगत प्रतिक्रियाओं को आमंत्रित करते हैं
- किसी बाईपास की सार्वजनिक चर्चा, यहां तक कि जिम्मेदारी से प्रकट की गई चर्चा भी, नकलची जांच को आमंत्रित कर सकती है
- रक्षात्मक सुरक्षा और शोषण के बीच ओवरलैप स्वच्छ रेलिंग को वास्तव में कठिन बना देता है
सावधानी
इस लेख में नाम, तिथियां और तकनीकी विवरण Fable 5 और Mythos 5 के बारे में Anthropic की सार्वजनिक पुनर्नियुक्ति घोषणा से लिए गए हैं। यह लेख केवल शैक्षिक है और किसी भी एआई सुरक्षा प्रणाली को दरकिनार करने के प्रयास के लिए कोई मार्गदर्शिका नहीं है। सुरक्षा प्रणालियाँ और निर्यात नियंत्रण वास्तविक कानूनी और सुरक्षा कारणों से मौजूद हैं, और उन्हें दरकिनार करने का प्रयास लगभग सभी एआई प्लेटफ़ॉर्म की सेवा की शर्तों का उल्लंघन करता है और कानून का उल्लंघन हो सकता है। यदि आप एआई सिस्टम पर शोध करते हैं, तो उनका शोषण करने के बजाय आधिकारिक चैनलों के माध्यम से निष्कर्षों की रिपोर्ट करें, और इस पर भरोसा करने से पहले मूल स्रोत के खिलाफ किसी भी दावे को सत्यापित करें।
अक्सर पूछे जाने वाले प्रश्न
- जून 2026 में Claude Fable 5 को क्यों निलंबित किया गया था?
- Fable 5 बाईपास की रिपोर्ट वास्तव में किसने दी थी?
- निर्यात नियंत्रण क्या हैं और उन्होंने वैश्विक शटडाउन के लिए क्यों मजबूर किया?
- क्या रिपोर्ट की गई भेद्यता Fable 5 के लिए अद्वितीय थी?
- बाईपास को रोकने के लिए Anthropic ने क्या बदलाव किए?
- Fable 5 कब वापस ऑनलाइन आया, और किन प्लेटफार्मों पर?
- नया क्रॉस-इंडस्ट्री जेलब्रेक गंभीरता ढांचा क्या है?
- एक सीमा रेखा सुरक्षा मामले और एक वास्तविक आपात स्थिति के बीच क्या अंतर है?
टैग
#aiSafety #languageModels #cybersecurity #responsibleDisclosure #anthropic #machineLearning #exportControls
Kubernetes Security Checklist
Harden cluster access, workload identity, pod security, network boundaries, software supply chain, secrets, and operational monitoring.
Free. No spam — unsubscribe in one click.


Responses
Sign in to leave a response.