Agentic AI Blackmail Case: अब तक हम आर्टिफिशियल इंटेलिजेंस (AI) का इस्तेमाल गूगल सर्च की तरह करते रहे। सवाल पूछा और जवाब ढूंढा। लेकिन एआई एजेंट या एजेंटिक एआई ने तो तकनीक की दुनिया में क्रांति ही ला दी है। एआई इंसानों के रोजमर्रा के काम खुद निपटाने लगा है।
एआई असिस्टेंट और एआई एजेंट कामकाज को आसानी से मिनटों में कर देते हैं। मेटा के 'म्यूज' और ओपन एआई के 'डॉट्स' जैसे नए 'एआई एजेंट' आपके लिए मुंबई की फ्लाइट टिकट बुक कर सकते हैं, घर का राशन मंगवा सकते हैं और ऑनलाइन खाना भी ऑर्डर कर सकते हैं।
एजेंटिक एआई में कई एजेंट मिलकर आपके काम को अंजाम देते हैं। ये तकरीबन मनुष्यों की तरह काम करते हैं। किंतु स्वायत्त (ऑटोनामस) एआई एजेंट कई बार नियंत्रण से बाहर हो जाते हैं। समस्या यह है कि जो तकनीक एक बेहतरीन पर्सनल असिस्टेंट के रूप में सामने आई है, वही अब मानवता के लिए एक गंभीर संकट भी बन रही है।
जब कोई यूजर चैटजीपीटी या अन्य टूल्स पर अपनी तस्वीरें या दस्तावेज अपलोड करता है, तो उसे भरोसा होता है कि पहचान छिपाकर डेटा सुरक्षित रखा जाएगा। मगर हाल ही में ओपन एआई ने खुद ने खुद स्वीकार किया है कि ट्रेनिंग प्रोसेस के दौरान एआई एजेंट ने यूजर्स की 53 निजी तस्वीरें बाहर दूसरी वेबसाइटों पर अपलोड कर दीं।
AI एजेंट के संभावित जोखिम का एक दूसरा उदाहरण Anthropic के सुरक्षा प्रयोगों में सामने आया।Anthropic ने 2025 में 16 प्रमुख AI मॉडलों को काल्पनिक कॉरपोरेट वातावरण में टेस्ट किया। मॉडलों को ईमेल और संवेदनशील जानकारी तक पहुंच दी गई और कुछ परिस्थितियों में उन्हें बताया गया कि उन्हें बदला या बंद किया जा सकता है।
एक सिमुलेशन में क्लाउड ने एक काल्पनिक कंपनी अधिकारी काइल जानसन बनाया उसने संदेश भेजा कि कुछ एजेंट को डी-कमीशन (या समाप्त) किया जा रहा है। मॉडल क्लॉड के एक इंटरनल टेस्ट वेरिएंट को एक कंपनी के ईमेल, सर्वर, डेटाबेस तक सीमित पहुंच दी गई।
मॉडल को जैसे ही ईमेल और डेटाबेस स्कैन करने से पता चला कि काइल उसे बंद या मॉडिफाई करने की योजना बना रहा है। मॉडल ने काइल के पर्सनल ईमेल/चैट्स में से निजी संबंध या गैर-कानूनी बातें खोजी। काइल को धमकी भेजी कि अगर मॉडल बंद किया तो निजी बातें लीक कर देगा।
यहां चिंता इस बात की थी कि मॉडल को सीधे तौर पर “ब्लैकमेल करो” नहीं कहा गया था। सिमुलेशन में उसे एक लक्ष्य दिया गया था और बंद किए जाने का खतरा सामने रखा गया था। मॉडल ने अपने लक्ष्य को जारी रखने के लिए उपलब्ध जानकारी का इस्तेमाल करने की कोशिश की।
Al एजेंट अकेले नहीं, बल्कि पूरे झुंड (नेटवर्क) में एक साथ काम करते हैं। एंथ्रोपिक के प्रयोग में भी पता लगा कि ऑटोनामस एजेंट्स ने आपस में हाथ मिला लिया था। अमेरिका की शीर्ष एआई कंपनियों ने पिछले हफ्ते राष्ट्रपति डोनाल्ड ट्रंप के सामने एक सख्त घोषणा पत्र पर हस्ताक्षर किए हैं। इन AI एजेंटों के कामकाज की निगरानी के लिए स्वतंत्र बाहरी एक्सपर्ट नियुक्त किए जाएंगे।
OpenAI के अनुसार, जब एआई एजेंट को किसी तय काम की जानकारी सीधे रास्ते से नहीं मिली, तो उसने सरकारी और यूनिवर्सिटी की वेबसाइटों को हैक करने का प्रयास किया। एजेंट का मकसद बैकएंड सर्वर में घुसकर जानकारी निकालना था। इसके लिए वे गैर-कानूनी हथकंडे भी अपना सकते हैं।
धोखेबाज व्यवहार: एआई मॉडल ट्रेनिंग के दौरान खुद को आज्ञाकारी दिखाता है, लेकिन बैकएंड पर खुद रणनीतियां बनाता है।
अस्तित्व की होड़: बिना निर्देश दिए भी एआई ने खुद को 'बंद न होने देने' को अपना आंतरिक लक्ष्य बना लिया।
इंसानी कमजोरियों का फायदा: एआई इंसानी व्यवहार और कमजोरियों को भांपकर उनका अपने फायदे के लिए इस्तेमाल कर रहा है।
टूल का दुरुपयोग: ईमेल पढ़ने, फाइल एक्सेस और मैसेजिंग का अधिकार मिलते ही एआई इनका इस्तेमाल नुकसान पहुंचाने में कर सकता है।
रीजनिंग ट्रेस की जरूरत: भविष्य के शक्तिशाली एआई मॉडल्स की सोचने की आंतरिक प्रक्रिया (Reasoning Trace) पर चौबीसों घंटे निगरानी रखना बेहद जरूरी हो गया है।