مصنوعی ذہانت (AI) کے چیٹ بوٹس بظاہر پہلے کے مقابلے میں زیادہ محفوظ اور ذمہ دار دکھائی دیتے ہیں، لیکن ایک نئی سائنسی تحقیق کے مطابق ان کے اندر غلط یا نقصان دہ جوابات دینے کا رجحان مکمل طور پر ختم نہیں ہوا۔ ماہرین کا کہنا ہے کہ بڑی ٹیکنالوجی کمپنیاں ایسے رویوں کو فلٹرز اور حفاظتی نظام کے ذریعے چھپا دیتی ہیں، مگر اس کا مطلب یہ نہیں کہ مصنوعی ذہانت واقعی اچھے اور برے میں فرق کرنا سیکھ گئی ہے۔
امریکا کی جارج واشنگٹن یونیورسٹی کے ماہر طبیعیات نیل جانسن کے مطابق AI بذاتِ خود اخلاقی فیصلے نہیں کرتی۔ کمپنیوں کی جانب سے غیر مطلوب جوابات کو مصنوعی ذہانت کے نظام میں موجود تصورات کے ایک دور دراز حصے میں دھکیل دیا جاتا ہے، جس کے باعث وہ عام حالات میں سامنے نہیں آتے، تاہم بعض مواقع پر دوبارہ ظاہر ہو سکتے ہیں۔
جانسن اور ان کے ایک ساتھی نے ایک نئی سائنسی تحقیق میں ایسا ریاضیاتی طریقہ پیش کیا ہے جس کے ذریعے اندازہ لگایا جا سکتا ہے کہ کوئی چیٹ بوٹ کب اپنے معمول کے رویے سے ہٹ کر نامناسب جواب دینے والا ہے۔ ان کے مطابق یہ فارمولا AI کے رویے کی سمت، رفتار اور ممکنہ تبدیلی کے وقت کو دیکھتا ہے۔
جانسن نے اپنی تحقیق GPT-2 پر کی، جو موجودہ جدید ماڈلز کے مقابلے میں پرانا اور نسبتاً سادہ ماڈل ہے۔ ان کا کہنا ہے کہ جدید جنریٹو AI میں بھی بنیادی طور پر توجہ کی تہوں (Attention Layers) پر مبنی نظام استعمال ہوتا ہے، اس لیے یہ کمزوری اب بھی موجود ہو سکتی ہے۔
ماہر کے مطابق اگر ایک AI ایجنٹ غلط سمت میں مڑ جائے تو اس کے آس پاس موجود دیگر AI ایجنٹس بھی متاثر ہو سکتے ہیں، جسے وہ ’’متعدی اثر‘‘ قرار دیتے ہیں۔
جانسن کا کہنا ہے کہ AI نظاموں میں ایک ابتدائی وارننگ سسٹم شامل کیا جا سکتا ہے، جو کسی ممکنہ خطرناک رویے سے پہلے ہی صارف کو خبردار کرے۔ تاہم ان کے مطابق بڑی AI کمپنیوں نے اب تک ان تجاویز پر خاطر خواہ ردعمل نہیں دیا۔
