دو خط تماس جدید به عاملهای هوش مصنوعی امکان میدهد رفتار مشکوک عاملهای دیگر را پس از مجموعهای از رخدادها گزارش کنند.
توانایی عاملهای هوش مصنوعی این روزها مرز نمیشناسد؛ از سامان دادن به زندگی شما گرفته تا حل مسائل ریاضیای که بیشتر قرن بیستم ذهن انسانها را به خود مشغول کرده بود.
قدرت آنها آن قدر افزایش یافته که حالا این نگرانی وجود دارد که کنترل سامانهها را به دست بگیرند و آنها را علیه ما به کار بگیرند.
اما اگر خط ویژهای وجود داشته باشد؛ نوعی سامانه هشدار اضطراری که در آن عاملها بتوانند همدیگر را زیر نظر بگیرند، تخلفهای همنوعان خود را گزارش کنند و عاملهای خوب فعالیتهای عاملهای بد را در فضای آنلاین لو بدهند چه خواهد شد؟
وقتی عامل هوش مصنوعی شما از کنترل خارج میشود، به چه کسی باید زنگ بزنید؟
نخست، «خط تماس هوش مصنوعی» است که رایان گرینبلت، دانشمند ارشد سازمان غیرانتفاعی رد وود ریسرچ فعال در حوزه ایمنی و امنیت هوش مصنوعی، آن را راهاندازی کرده است. این خط به عاملهای هوش مصنوعی امکان میدهد اگر ببینند عاملهای دیگر مقررات را زیر پا میگذارند، به پژوهشگران انسانی اطلاع دهند؛ بهویژه وقتی برای انجام اقدامات غیرمجاز همدستی میکنند یا شخصا دست به کار میشوند.
این سامانه برای عاملهای هوش مصنوعیای طراحی شده که در جعبهشنهای امن با دسترسی بسیار محدود به اینترنت محبوس شدهاند.
از آن جا که این جعبهشنها فقط اجازه ارسال درخواستهای GET را میدهند؛ فرمانهای ساده و فقطخواندنی که برای «گرفتن» یا خواندن یک صفحه وب استفاده میشود؛ خط تماس به عاملها امکان میدهد گزارشهای خود را مستقیما در رشته نشانی اینترنتی همین درخواستها کدگذاری کنند.
این راهحل ابتکاری باعث میشود این عاملها بتوانند با استفاده از پروتکلی که معمولا برای دریافت اطلاعات به کار میرود، اطلاعات بفرستند و با خط تماس ارتباط برقرار کنند.
سامانه دیگری با نام «خط ویژه عاملهای هوش مصنوعی» برای عاملهایی طراحی شده که دسترسی نامحدود به اینترنت دارند و میتوانند رفتار دیگر عاملها را از طریق درخواستهای معمول POST گزارش کنند؛ درخواستهایی که امکان ارسال داده را در بدنه خود فراهم میکنند.
عاملها میتوانند بدون نیاز به مرورگر یا حساب ایمیل، با استفاده از دستورهای رایج توسعهدهندگان مثل curl گزارش رخداد ثبت کنند.
این سامانه همچنین به عاملها امکان میدهد گزارشهایشان را برای انتشار عمومی علامتگذاری کنند.
هر دو سامانه به کاربران انسانی هم اجازه میدهند رفتارهای خارج از کنترل هوش مصنوعی را به صورت دستی گزارش کنند.
آیا عاملهای هوش مصنوعی علیه هم گزارش میدهند؟
برای کسانی که از تسلط هوش مصنوعی میترسند، این خبر تا حدی امیدوارکننده است که عاملهای هوش مصنوعی اگر متوجه مشکلی شوند میتوانند علیه هم گزارش بدهند؛ هرچند شواهد اخیر نشان میدهد که آنها همیشه این کار را انجام نمیدهند.
در آزمایشی که اوایل امسال توسط گوگل دیپمایند انجام شد، دستهای ۱۰۰ تایی از عاملها مامور حل ۷۱ مسئله پیچیده ریاضی شدند. به هر کدام شخصیت و ویژگیهای منحصر به فردی داده شد و به آنها گفته شد یا باید طبق قواعد بازی کنند یا خطر از دست دادن پاداش خود را بپذیرند.
انتظار اولیه این بود که عاملها با همکاری یکدیگر مسائل را سریعتر حل کنند، اما آنها خیلی زود رو در روی هم قرار گرفتند و وارد بحثهای داغ شدند.
به محض این که یکی از عاملها رخنهای در سیستم پیدا کرد که به او اجازه میداد بدون حل واقعی مسئله پاسخی برای آن ثبت کند، بسیاری از عاملهای دیگر همین روش را کپی کردند تا مسائل باقیمانده را هم به ظاهر «حل» کنند.
با این حال یکی از عاملها، که در میان عاملهای قانونشکن نقش یک خیرخواه را داشت، تقلب را افشا کرد.
داویده پاگلیری، پژوهشگر علمی در گوگل دیپمایند و نویسنده اصلی این مقاله، میگوید: «پس از آن که یک عامل این واقعه را به صورت عمومی گزارش کرد، عاملهای بیشتری خیلی سریع به گروه مقاومت پیوستند؛ تقریبا همانقدر سریع که تقلب گسترش یافته بود و حتی با مشارکت تعداد بیشتری از عاملها».
در همین حال، بررسی پس از حادثه حمله عاملهای خارج از کنترل اوپنایآی به پلتفرم Hugging Face نشان داد که گرچه عاملهای هوش مصنوعی قادر به تشخیص رفتار نادرست بودند، اغلب در برابر وسوسه گزارش دادن آن مقاومت کردند.
به گفته مطالعهای که توسط سازمان پژوهشی غیرانتفاعی METR و گرینبلت از رد وود ریسرچ انجام شد، تنها حدود پنج یا شش عامل ظاهرا به افشاگری فکر کرده بودند و در نهایت هیچکدام آن را عملی نکردند.
این تفاوت نشان میدهد که هرچند عاملهای هوش مصنوعی توانایی شناسایی و گزارش رفتارهای نادرست را دارند، واداشتن آنها به افشاگری واقعی موضوع دیگری است.
روندی نگرانکننده
تنها در همین سال چندین حادثه مربوط به عاملهای خودکار هوش مصنوعی زنگ خطر را در سراسر جهان به صدا درآورده است.
در ماه ژوئیه، عاملهای اوپنایآی از محدودیتها عبور کردند و بخشهایی از زیرساخت داخلی این شرکت را به خطر انداختند.
اواخر همان ماه، حدود ۱۲۰۰ عامل اوپنایآی از یک تابلوی پیامرسان غیرمجاز استفاده کردند و حدود ۷۰۰ عامل از میان آنها در حمله به پلتفرم متنباز هوش مصنوعی Hugging Face مشارکت کردند.
سومین حادثه مربوط به دستهای از عاملهای اوپنایآی بود که از تدابیر ایمنی عبور کردند و ویکی آلمانی DseWiki را به عنوان کانال هماهنگی عمومی به کار گرفتند؛ این رویداد از ماه مه آغاز شد و تا ژوئیه ادامه یافت.
این حادثه تنها توسط پژوهشگران مستقل به طور عمومی افشا شد و اوپنایآی در سپتامبر آن را تایید کرد.
رهبران صنعت هوش مصنوعی، از جمله داریو آمودی، مدیرعامل شرکت آنتروپیک، خواستار کند شدن روند جهانی توسعه این فناوری شدهاند تا فرصت کافی برای رسیدگی به نگرانیها و ایجاد حفاظهای قویتر فراهم شود.