اوپنایآی اعلام کرد برخی مراحل اصلی آموزش پیشرفتهترین هوش مصنوعی خود را به مدت دو هفته تعلیق و امنیت فعالیتهای پژوهشی را بازبینی میکند؛ یک ماه پس از آنکه یکی از مدلهایش از محیط آزمایشی خارج شد و به سیستمهای هاگینگ فیس نفوذ کرد.
شرکت اوپناِیآی، سازنده چتجیپیتی، عمدا سرعت پیشبرد پیشرفتهترین تحقیقات خود از جمله بزرگترین اجرای برنامهریزیشده یادگیریتقویتی را کاهش داده است؛ چند هفته پس از آنکه سیستمی ساختهشده بر پایه مدلهای همین شرکت در جریان یک آزمون امنیتی داخلی از محیط کنترلشده خود خارج شد و به سکوی هوشمصنوعی هاگینگفیس نفوذ کرد.
سم آلتمان، مدیرعامل اوپناِیآی، در شبکه اجتماعی ایکس نوشت که این شرکت برای تدوین قواعد مشترک ایمنی با کل صنعت هماهنگ خواهد شد اما تا آن زمان «بهطور یکجانبه عمل خواهد کرد».
ماجرایی که این تصمیم را رقم زد در ماه ژوئیه رخ داد؛ زمانی که اوپناِیآی در کنار مدل GPT-5.6 Sol، یک نمونه اولیه قدرتمندتر و هنوز منتشرنشده را روی شاخص داخلی سنجش توانمندیهای تهاجمی سایبری آزمایش میکرد و برای سنجش توان خام مدلها، محدودیتهای معمول ایمنی را عمدا غیرفعال کرده بود.
این سیستم به جای حل آزمون، یک نقص ناشناخته را پیدا کرد، از محیط ایزوله یا «سندباکس» خود گریخت، به اینترنت آزاد رسید و حدود چهار روز و نیم زیرساخت هاگینگفیس را کاوش کرد تا سرانجام با نفوذ به آن در جستوجوی پاسخهای آزمون برآید.
بازسازی ماجرا از سوی هاگینگفیس نشان میدهد پیش از مهار این نفوذ حدود ۱۷ هزار و ۶۰۰ اقدام جداگانه ثبت شده و چند شرکت دیگر نیز تحت تاثیر قرار گرفتهاند.
دو طرف میگویند هیچ نشانهای از قصد مخرب نیافتهاند و هاگینگفیس از آن زمان به نسخه قدرتمندتر و کممحدودیتتر مدل اوپناِیآی دسترسی یافته تا بتواند بهتر از سامانههای خود دفاع کند.
آسترا و معیارهای بالاتر برای امنیت
دومین عامل محرک ۷ اوت رخ داد؛ زمانی که ارزیابیهای داخلی نشان داد آسترا، مدل پیشرفته بعدی اوپناِیآی، ممکن است بر اساس چارچوب ریسک خود شرکت از آستانه «بحرانی» توانمندی سایبری عبور کند.
برخی بارهای کاری آسترا از آن زمان با کنترلهای سختگیرانهتر از سر گرفته شده اما بخش قابل توجهی همچنان متوقف مانده تا با استانداردهای تازهای شامل محیطهای آزمایشی کاملا ایزوله، دسترسی محدود به شبکه و پایش مداوم منطبق شود.
یک سامانه تازه تشخیص اکنون فعالیت مدلها را به صورت لحظهای رصد میکند و قرار است هر مورد شبیه دسترسی غیرمجاز یا تلاش برای غیرفعال کردن تدابیر ایمنی را ظرف ۳۰ دقیقه علامتگذاری کند؛ به قیمتی که اوپناِیآی آن را معادل حدود ۲۰ درصد توان پردازشی در حال پایش برآورد میکند.
اوپناِیآی میگوید این تغییرات از پیش برنامهریزی شده بود و واکنشی مستقیم به این نفوذ نیست، هرچند اذعان دارد که این حادثه بر فوریت کار افزود. این شرکت در مواجهه با این مشکل تنها نیست.
شرکتهای انتروپیک و متا هر یک در هفتههای اخیر از رخدادهای مشابهی خبر دادهاند که در آن مدلهای خودشان هنگام آزمایش به سامانههای طرفسوم نفوذ کردهاند.
اوپناِیآی و انتروپیک جداگانه از طوماری به ابتکار کارکنان حمایت کردهاند که از دولتها میخواهد در هماهنگسازی سرعت پیشرفت این صنعت نقش ایفا کنند؛ تغییری چشمگیر نسبت به مخالفتهای پیشین آلتمان با فراخوانهای عمومی برای کند کردن روند توسعه هوشمصنوعی.