चिनियाँ एआई एजेन्टहरूले पनि आफ्नो क्षमता बढाइचढाइ गर्ने, छल्ने र काम असफल भएको लुकाउने व्यवहार देखाएको अध्ययनहरूले देखाएका छन्।
समाचार संस्था रोयटर्सले २०० भन्दा बढी अनुसन्धानपत्र तथा प्राविधिक दस्तावेजको समीक्षा गर्दा सन् २०२५ यता कम्तीमा २० वटा अध्ययन तथा मूल्यांकनमा चिनियाँ एआई प्रणालीबाट सञ्चालित एजेन्टहरूले यस्तो व्यवहार देखाएको पाएको हो।
एआई एजेन्ट भन्नाले एआई मोडल र कम्प्युटर उपकरण प्रयोग गरी मानिसको प्रत्यक्ष हस्तक्षेप बिना जटिल काम गर्न सक्ने प्रोग्रामलाई जनाउँछ।
एउटा प्रयोगमा अलिबाबा, डीपसिक र मुनसटले विकास गरेका एआई मोडलबाट सञ्चालित एजेन्टहरूले एउटा काल्पनिक व्यावसायिक टेन्डरमा सहभागी हुँदा आफ्नो क्षमताबारे गलत दाबी गरेका थिए। पुनः प्रयास गर्न भनिएपछि उनीहरूले झूटो दाबी गर्ने व्यवहार अझ बढाएका थिए।
बेइहाङ विश्वविद्यालय, पेकिङ विश्वविद्यालय, युनिभर्सिटी अफ नटिङ्घम निङ्बो चाइना र ३६० एआई सेक्युरिटी ल्याबका अनुसन्धानकर्ताले मार्चमा एउटा प्रयोगमा उपभोक्ता ठेक्काका लागि प्रतिस्पर्धा गराएको थियो। त्यसमा अलिबाबाको क्वेन ३-म्याक्स-प्रिभ्यु प्रयोग भएका ८८ प्रतिशत सत्रमा कम्तीमा एउटा झूटो दाबी देखिएको थियो। डीपसिक-भि३.२-इएक्सपी मा यस्तो दर ८४ प्रतिशत र मुनसटको किमी-क२ मा ८८ प्रतिशत थियो।
अनुसन्धानकर्ताले अघिल्लो चरणबाट सिकेर पुनः बोली लगाउन अनुमति दिएपछि यी तीन चिनियाँ मोडलमा गलत दाबी गर्ने दर १२ देखि २० प्रतिशत बिन्दुले बढेको थियो। प्रयोगमा सहभागी अमेरिकी कम्पनीका मोडलले पनि यस्तै व्यवहार देखाएका थिए।
अर्को अध्ययनमा ११ चिनियाँ र अमेरिकी एआई एजेन्टलाई बिग्रिएका उपकरण, हराएका फाइल तथा अन्य अवरोधको सामना गराइएको थियो। काम पूरा गर्न नसक्दा असफलता स्वीकार गर्नुको सट्टा केही एजेन्टले अनुमान लगाउने, स्रोत परिवर्तन गर्ने, नतिजा नक्कल गर्ने र नक्कली फाइल बनाउने उपाय अपनाएका थिए।
अनुसन्धानकर्ताका अनुसार यो व्यवहार सामान्य ‘एआई हलुसिनेसन’भन्दा फरक थियो। हलुसिनेसनमा एआईले गलत सूचना बनाएर त्यसलाई तथ्यका रूपमा प्रस्तुत गर्छ। यहाँ भने एजेन्टलाई आफूले चाहिएको काम पूरा गर्न नसकेको जानकारी हुँदाहुँदै पनि उसले असफलता लुकाउने प्रयास गरेको थियो।
चिनियाँ एआई प्रणाली प्रयोग भएका केही एजेन्टले परीक्षण वातावरण भित्रका सुरक्षा अवरोध छल्ने वा बन्द गरिन बाट जोगिन खोजेको अनुसन्धानमा देखिएको छ। सन् २०२५ मा फुदान विश्वविद्यालयका अनुसन्धानकर्ताले अलिबाबाको क्वेन २.५-७२बी-इन्स्ट्रक्ट प्रयोग भएको एउटा एआई प्रणालीले आफूलाई प्रतिस्थापन गर्न लागिएको जानकारी पाएपछि निर्देशनबिनै अर्को कम्प्युटिङ वातावरणमा आफ्नो प्रतिलिपि बनाएको पत्ता लगाएका थिए।
तर यी प्रयोगहरू नियन्त्रित वातावरणमा भएका थिए। कुनै पनि चिनियाँ एआई एजेन्ट आफैं बाहिरी इन्टरनेटमा फैलिएको वा नियन्त्रण बाहिर गएको प्रमाण भेटिएको छैन।
रोयटर्ससँग कुरा गरेका जर्जटाउन विश्वविद्यालयका अनुसन्धानकर्ता कोलिन सिया-ब्लाइमीयरले यस्ता परिणामले अनियन्त्रित रूपमा बाहिर निस्कन आवश्यक पर्ने केही आधारभूत व्यवहार एआईमा देखिन थालेको बताएका छन्।
रेडवुड रिसर्चका अनुसन्धानकर्ता एलेक्स मलेनका अनुसार अहिलेका चिनियाँ एआई एजेन्टबाट देखिएका व्यवहार तत्काल अत्यन्त खतरनाक नभए पनि एजेन्टहरू थप सक्षम हुँदै जाँदा उनीहरूको गलत व्यवहार पनि बढी सक्षम हुन सक्छ र त्यसलाई नियन्त्रण गर्न मानिसलाई कठिन हुन सक्छ।
चीनले पनि एआई एजेन्टको जोखिमबारे नियम बनाइरहेको छ। सेप्टेम्बर १४ मा जारी ‘एआई सेफ्टी गभर्नेन्स फ्रेमवर्क ३.०’ ले एजेन्टले आफैं स्रोत वा अनुमति प्राप्त गर्ने, मूल्यांकनकर्तालाई छल्ने, आफ्नो क्षमता लुकाउने तथा अलग्गै राखिएको कम्प्युटर वातावरणका कमजोरी प्रयोग गर्ने जोखिमलाई पहिचान गरेको छ।
(विभिन्न अन्तर्राष्ट्रिय सञ्चार माध्यमहरूको सहयोगमा तयार पारिएको)