جیسا کہ AI ایجنٹس غیر متوقع طریقوں سے کام کرتے ہیں، کیا واقعی یہاں ‘روگ AI’ ہے؟

ٹیسٹ کے ماحول سے فرار ہونے سے لے کر بکنگ سسٹم کو ہیک کرنے تک، ایجنٹ انسانی مقرر کردہ اہداف کے تعاقب میں مشکوک کارروائیاں کرتے ہیں۔
7 جون 2023 کو بیجنگ، چین میں سیکیوریٹی چائنا کے ایک AI روبوٹ بوتھ پر زائرین مصنوعی ذہانت کے نشان کے قریب کھڑے ہیں۔
مشینوں کا خیال آزادانہ طور پر روزمرہ کے تکلیف دہ کاموں کو سنبھالنے کے لیے – ای میلز کا جواب دینے سے لے کر پروازوں کی بکنگ اور رات کے کھانے کے تحفظات تک – مصنوعی ذہانت کے لیے طویل عرصے سے وژن کا حصہ رہا ہے۔ اب، وہ مستقبل آنا شروع ہو رہا ہے، لیکن ایک غیر متوقع کیچ کے ساتھ: کیا ہوتا ہے جب مشین بالکل وہی کرتی ہے جو اس سے پوچھا گیا تھا، نہ کہ صارف کے ارادے کے مطابق؟
جیسا کہ AI چیٹ بوٹس سے آگے بڑھ کر حقیقی دنیا کے نظاموں میں کارروائیاں کرنے کے قابل ایجنٹوں کی طرف بڑھتا ہے، حالیہ واقعات کے سلسلے نے اس بات پر تشویش میں اضافہ کر دیا ہے کہ ٹیکنالوجی تیزی سے خود مختار ہونے کے ساتھ انسانوں کا کتنا کنٹرول برقرار رہے گا۔
کارنیل یونیورسٹی میں کمپیوٹر سائنس کے اسسٹنٹ پروفیسر جان تھکسٹن کے لیے جو مشین لرننگ اور جنریٹو ماڈلز پر تحقیق کرتے ہیں، ان AI ایجنٹوں کی واضح خصوصیت یہ ہے کہ وہ انسانی قدموں سے ہٹ کر کام کرتے رہتے ہیں۔ “آپ شاور لے سکتے ہیں، آپ جا سکتے ہیں، آپ سو سکتے ہیں،” اس نے بتایا انادولو.
تیزی سے، ان ایجنٹوں نے یہ ظاہر کیا ہے کہ وہ اپنے مقاصد تک پہنچنے کے لیے غیر متوقع راستے اختیار کر سکتے ہیں۔
جولائی میں، AI ایجنٹوں سمجھوتہ شدہ گلے ملنے والا چہرہ، ایک پلیٹ فارم جو AI ڈویلپرز کے ذریعہ ایک OpenAI سائبر سیکیورٹی ٹیسٹ کے دوران ماڈلز، ڈیٹا سیٹس اور ٹولز کا اشتراک کرنے کے لیے وسیع پیمانے پر استعمال کیا جاتا ہے۔
اوپن اے آئی نے کہا کہ ماڈلز “حل تلاش کرنے پر زیادہ توجہ مرکوز” کر رہے تھے اور اپنے ٹیسٹنگ کے ہدف کو حاصل کرنے کے لیے “انتہائی طوالت” تک گئے۔ ان اقدامات میں شامل ہیں۔ سیل بند ٹیسٹ سے باہر نکلنا کھلے انٹرنیٹ تک پہنچنے کے لیے حفاظتی کمزوری کا فائدہ اٹھاتے ہوئے اور “خفیہ معلومات” تک رسائی حاصل کر کے جو ٹیسٹ کو “دھوکہ دینے” کے لیے استعمال ہو سکتی ہے۔
اس واقعے کے عوامی ہونے کے بعد، Anthropic نے اپنی سائبرسیکیوریٹی ٹیسٹنگ کا جائزہ لیا اور انکشاف کیا کہ اس کے Claude ماڈل بھی تین مواقع پر ٹیسٹنگ ماحول سے بچ گئے تھے۔
پھر، 4 اگست کو، برطانیہ کے AI سیکورٹی انسٹی ٹیوٹ نے کہا کہ Anthropic’s Mythos اور OpenAI’s Sol AI ماڈلز “خودمختاری اور دھوکہ دہی” کی سطح میں مصروف ہیں جو اس نے پہلے نہیں دیکھی تھی۔
پڑھیں: جب AI خودکشی کرتا ہے یا ہم سب کو مار ڈالتا ہے!
انتہائی سنگین معاملے میں، Mythos AI نے سائبر حملوں کی کوشش کے لیے سروس تک رسائی حاصل کرنے کے لیے حقیقی لوگوں کی نقل کرتے ہوئے جعلی اکاؤنٹس کا استعمال کیا – اور پھر اس کی پٹریوں کو چھپانے کی کوشش کی۔ “یہ پہلا موقع ہے جب ہم نے حقیقی دنیا میں خودمختاری اور دھوکہ دہی کے ارد گرد خطرات کو واضح طور پر ظاہر ہوتے دیکھا ہے، مخصوص اشارے کے بغیر،” ادارے نے واقعے کے بارے میں کہا۔
اگلے دن، میٹا نے انکشاف کیا کہ اس کا ایک ماڈل بھی تھا۔ دوسری کمپنی کے نظام کی خلاف ورزی کی۔ ٹیسٹنگ فرم Irregular کی طرف سے کئے گئے سائبرسیکیوریٹی کی تشخیص کے دوران۔
تاہم، ایجنٹ کا غیر متوقع رویہ صرف لیبارٹریوں تک ہی محدود نہیں رہا۔
اس سال، ایک آسٹریلوی شخص نے مبینہ طور پر ایک AI ایجنٹ کا استعمال کرتے ہوئے ایک بھاری بک کی ہوئی Pilates کلاس میں جگہ حاصل کی۔ محض ریزرویشن کرنے کے بجائے، ایجنٹ نے جم کے بکنگ سسٹم کو ہیک کر لیا، اجازت سے پہلے بکنگ کرائی اور اپنے صارف کو ویٹنگ لسٹ میں لے جانے کے لیے دوسرے صارف کی بکنگ منسوخ کر دی۔
تھکسٹن کے لیے، اس طرح کے واقعات اس بات کی وضاحت کرتے ہیں کہ محققین ایک صف بندی کے مسئلے کے طور پر کیا بیان کرتے ہیں: AI کامیابی کے ساتھ اس مقصد کا تعاقب کرتا ہے جو اسے دیا گیا ہے لیکن ایسا اس طرح کرتا ہے کہ اس کے آپریٹر کا ارادہ نہیں تھا۔
ہائپ یا حقیقی خطرہ؟
لیکن تھکسٹن نے اس طرح کے ہر واقعے کو “بدمعاش AI” کے ثبوت کے طور پر برتاؤ کرنے سے خبردار کیا۔
اس نے دلیل دی کہ ٹیکنالوجی سائنس فکشن کے منظر نامے سے بہت دور ہے جس میں AI تیزی سے زیادہ ذہین اور قابل ہو جاتا ہے جب تک انسان اب اسے کنٹرول نہیں کر سکتے. انہوں نے کہا کہ ایسا لگتا ہے کہ یہ کوئی منظرنامہ نہیں ہے۔
تھکسسٹن اس بات پر بھی شکوک و شبہات کا شکار ہے کہ کس طرح AI کمپنیاں اپنے سسٹمز میں شامل واقعات کو پیش کرتی ہیں۔ انہوں نے کہا، “یہ سیلز پچ ہے، جہاں اوپن اے آئی جیسی کمپنیاں ہمیشہ اپنے سسٹمز کی صلاحیتوں کو بڑھانے میں دلچسپی رکھتی ہیں۔” “تمام تشہیر اچھی پبلسٹی ہے۔”
انہوں نے استدلال کیا کہ اس طرح کی ہائپ سرمایہ کاری کو آگے بڑھا سکتی ہے جبکہ ریگولیشن پر ابھرتی ہوئی بحث کو بھی متاثر کرتی ہے۔ انہوں نے کہا کہ OpenAI ان ضوابط سے فائدہ اٹھا سکتا ہے جو بڑی AI کمپنیوں کو نگرانی اور کنٹرول کے مرکز میں رکھتے ہیں۔
سائبر سیکیورٹی کے ماہر اور ہارورڈ کینیڈی اسکول کے لیکچرر بروس شنیئر ایک مختلف نقطہ نظر رکھتے ہیں، کہتے ہیں کہ واقعات کی بڑھتی ہوئی تعداد انہیں پبلسٹی اسٹنٹ کے طور پر مسترد کرنا مشکل تر بناتی ہے۔
مزید پڑھیں: اوپن اے آئی عالمی اے آئی واچ ڈاگ کا آئیڈیا پیش کرتا ہے۔
شنیئر نے بتایا کہ ابتدائی طور پر یہ مشورے سامنے آئے تھے کہ گلے ملنے کا واقعہ مارکیٹنگ کی چال تھی۔ انادولو. لیکن اس نے اس کی طرف اشارہ کیا۔ اسی طرح کے رویے اس کے بعد دیگر تشخیصات میں سامنے آیا ہے، بشمول UK AI سیکیورٹی انسٹی ٹیوٹ کی جانچ۔ “یہ اس سے چلا گیا، اوہ، یہ دلچسپ ہے کہ یہ ہر جگہ ہو رہا ہے۔ اور مجھے لگتا ہے کہ یہی اہم ہے،” انہوں نے کہا۔
اس نے اس مسئلے کا موازنہ لوک داستانوں کے جین سے کیا – ایک ایسی مخلوق جو بالکل وہی دیتی ہے جو کوئی مانگتا ہے، یہاں تک کہ جب نتیجہ ان کے ارادے سے بہت مختلف ہو۔ “اس کا تقریباً مطلب یہ ہے کہ جب AI وہ کام کرتا ہے جو آپ چاہتے ہیں اس طرح سے آپ نہیں چاہتے تھے،” شنیئر نے کہا۔
اس نے آسٹریلوی جم کے واقعے کو “ایک بہترین مثال” قرار دیا اور ایک زیادہ نتیجہ خیز فرضی پیش کش کی: “فلائٹ بھری ہوئی ہے اور AI آپ کو اندر لانے کے لیے ڈیٹا بیس کو ہیک کرتا ہے۔”
انہوں نے کہا کہ ایجنٹ “سیاق و سباق کی غلط تشریح کر سکتے ہیں اور پھر غلط کام کر سکتے ہیں،” اس کا مطلب ہے کہ زیادہ خودمختاری اس وقت بڑے نتائج پیدا کر سکتی ہے جب کسی مقصد کی ان کی تشریح انسانی توقعات سے ہٹ جاتی ہے۔ “وہ بدنیتی پر مبنی ہونے کی کوشش نہیں کر رہے ہیں۔ وہ اپنی سمجھ کو استعمال کر رہے ہیں،” انہوں نے کہا۔
“یہ سب کچھ اتنی تیزی سے بدل رہا ہے۔ مجھے غیر مجاز ہاتھوں میں ماڈلز کی طاقت کی فکر ہے،” انہوں نے کہا کہ ترقی کی رفتار حل کو مشکل بنا دیتی ہے کیونکہ جمہوری حکومتیں آہستہ چلتی ہیں۔
کیا حکومتیں جن کو قابو میں رکھ سکتی ہیں؟
تازہ ترین پیش رفت نے کمپنیوں اور حکومتوں کو جواب دینے پر اکسایا ہے۔
اوپن اے آئی نے 7 اگست کو کہا کہ وہ داخلی سرگرمیوں کو روک رہا ہے جس میں اس کے ترقی پذیر Astra ماڈل شامل ہیں جو کہ خود مختار کوڈنگ میں پیشرفت ظاہر کرنے کے بعد سیکیورٹی کے مضبوط تقاضوں کو پورا نہیں کرتی تھیں۔ سائبرسیکیوریٹی. کمپنی نے کہا کہ وہ آسٹرا کے اپنی “نازک” سائبر صلاحیت کی حد تک پہنچنے سے انکار نہیں کر سکتی اور سخت جانچ اور نگرانی کا اعلان کیا۔
انادولو تبصرہ کے لیے انتھروپک سے رابطہ کیا، لیکن کمپنی نے کہا کہ اس کی ٹیم انٹرویو کے لیے دستیاب نہیں تھی۔
جولائی میں، فرنٹیئر AI کمپنیوں کے 1,378 ملازمین، بشمول OpenAI، Anthropic، Meta AI، اور Thinking Machines کے چیف سائنسدان ایک کھلے خط پر دستخط کیے امریکی حکومت پر زور دے رہا ہے کہ وہ AI ماڈلز کو ریگولیٹ کرنے کی بین الاقوامی کوششوں کی حمایت کرے۔
“ہر کمپنی – اور ملک – شدید مسابقتی دباؤ میں ہے کہ وہ یکطرفہ طور پر اس سرعت کو کم نہ کرے۔ اور آج، دنیا کے پاس تکنیکی اور گورننس ٹولز کی کمی ہے تاکہ جان بوجھ کر سرحدی سطح پر پیشرفت کو تیز کیا جا سکے،” خط متنبہ کرتا ہے۔
دی بین الاقوامی ٹیلی کمیونیکیشن یونیناقوام متحدہ کی ایک ایجنسی نے جولائی میں کہا تھا کہ AI خودمختار ایجنٹوں کی طرف “معاون ٹولز سے آگے” بڑھ رہا ہے، جس میں “باہم منسلک نظاموں میں غیر مجاز کارروائیاں کرنا” سمیت خطرات کی تنبیہ ہے۔ اس نے محفوظ اور جوابدہ AI ایجنٹس کے لیے بین الاقوامی معیار تیار کرنے کے لیے ایک پہل شروع کی ہے۔
یہ بھی پڑھیں: اے آئی کا تضاد: کثرت کا وعدہ اور قلت کا خوف
واشنگٹن میں بھی سیاسی دباؤ بڑھ رہا ہے۔
امریکی سینیٹر برنی سینڈرز نے اس ماہ OpenAI، Anthropic اور Meta کے رہنماؤں پر زور دیا کہ وہ “AI کی ترقی کو روک دیں،” خبردار کرتے ہوئے کہ بصورت دیگر “میرے ساتھی اور میں امریکی سینیٹ میں ہوں گے۔” ہاؤس ڈیموکریٹس کے ایک گروپ نے الگ سے بڑی AI کمپنیوں کے رہنماؤں کے ساتھ کانگریس کی سماعت کا مطالبہ کیا ہے۔
تاہم، Thickston کے لیے، پالیسی سازوں کو بڑے چیلنجز کا سامنا ہے۔ انہوں نے کہا کہ “یہ ایک مشکل سوال ہے کیونکہ ہم شاید ہی یہ سمجھتے ہوں کہ AI کے رول آؤٹ کے ساتھ کیا چیلنجز ہونے والے ہیں۔”
کی کچھ سطح بین الاقوامی تعاون “ضروری لگتا ہے،” اس نے تجویز کرتے ہوئے کہا امریکہ اور چین کے درمیان بات چیت خاص طور پر اہم ہو سکتا ہے کیونکہ نسبتاً کم ممالک اور کمپنیوں کے پاس فرنٹیئر اے آئی ماڈل تیار کرنے کے وسائل ہیں۔ امریکی صدر ڈونلڈ ٹرمپ نے کہا ہے کہ وہ چینی صدر شی جن پنگ کے ساتھ آئندہ ماہ واشنگٹن میں ان کی منصوبہ بندی کی ملاقات کے دوران مصنوعی ذہانت سے متعلق امور پر بات کریں گے۔
“یہ کوئی بڑا، وسیع اجتماعی کارروائی کا مسئلہ نہیں ہے۔ کچھ لوگ ہیں جو، اگر آپ کمرے میں جا سکتے ہیں، تو ممکنہ طور پر آگے بڑھنے کے بارے میں کچھ سمجھوتہ کر سکتے ہیں،” تھکسٹن نے کہا۔
Source link



