استعفای یک پژوهشگر Anthropic و نفوذ مدل های هوش مصنوعی به سامانه های رقیب چند هفته ای پرآشوب رقم زده که بزرگان صنعت را واداشته پیش از آنکه هوش مصنوعی از توان مهارشان پیشی بگیرد خواستار تدابیر ایمنی شوند
هشدارهای تازه از درون صنعت هوش مصنوعی بار دیگر یک بحث قدیمی را شعلهور کرده است. آیا ممکن است هوش مصنوعی پیشرفته از کنترل انسان خارج شود و بقای بشر را به خطر بیندازد و آیا شرکتهایی که آن را توسعه میدهند به اندازه کافی برای جلوگیری از چنین خطری اقدام میکنند؟
داریو آمودی، مدیرعامل شرکت انتروپیک، روز شنبه گفت که این صنعت باید سرعت خود را کم کند. او هشدار داد که اگر شرکتها تدابیر حفاظتی قویتری اعمال نکنند، ظرف شش ماه تا یک سال ممکن است گروهی از عاملهای هوش مصنوعی کنترل اینترنت را در دست بگیرند.
آمودی طرحی برای شرکتهای فعال در حوزه هوش مصنوعی و دولتها ارائه کرد تا بتوانند مدلهای هرچه توانمندتر را با ارزشهای انسانی همسو نگه دارند. هشدار او تنها چند روز پس از آن مطرح شد که دو پژوهشگر سابق بخش ایمنی انتروپیک علناً اعلام کردند خطرات وجودی ناشی از هوش مصنوعی به اندازه کافی جدی گرفته نمیشود.
مدلهای هوش مصنوعی هر روز قدرتمندتر میشوند
همزمان با افزایش توان این فناوری، نگرانیها درباره خطرات آن نیز رو به افزایش است. هرچه مدلها توانمندتر شوند، احتمال سوءاستفاده توسط افراد با نیت مجرمانه بیشتر میشود؛ از جمله در سناریوهای فاجعهباری مانند ساخت و انتشار یک عامل بیماریزا که قادر باشد بخش بزرگی از جمعیت جهان را از بین ببرد، و همچنین خطر سرکشی سامانههای هوش مصنوعی.
انتروپیک هفته گذشته اعلام کرد تلاش بازیگران مخرب برای استفاده از مدلهای این شرکت در حملات سایبری، جاسوسی و تحقیقاتی را که میتواند به توسعه سلاحهای بیولوژیک کمک کند، متوقف کرده است.
این شرکت هشدار داد که «هرچه مدلها توانمندتر شوند، خطراتشان نیز افزایش خواهد یافت، مگر آنکه توسعهدهندگان هوش مصنوعی و مدافعان جامعه برای ایمنتر کردن آنها دست به کار شوند».
این شرکت سال گذشته گزارش داد که هکرهایی که بسیار محتمل است وابسته به یک گروه تحت حمایت دولت چین بوده باشند، از هوش مصنوعی انتروپیک در حملهای سایبری علیه حدود ۳۰ شرکت و نهاد دولتی در سراسر جهان استفاده کردهاند.
مواردی از خودسری در چند مدل هوش مصنوعی ثبت شده است
وقتی یک عامل هوش مصنوعی «خودسر» میشود، یعنی سامانه فراتر از وظیفهای که برایش تعریف شده عمل میکند. هر دو شرکت انتروپیک و اوپنایآی، سازنده چتجیپیتی، در ماه ژوئیه اعلام کردند که برخی مدلهایشان چنین رفتاری داشتهاند.
انتروپیک فاش کرد که سه مدل هوش مصنوعی این شرکت، یعنی «کلود اوپوس ۴.۷»، «کلود میتوس ۵» و یک مدل آزمایشی داخلی، در جریان آزمونها به سامانههای سه سازمان دیگر نفوذ کردهاند.
این افشاگری تنها چند روز پس از آن صورت گرفت که اوپنایآی اعلام کرد سامانه خود این شرکت به سرورهای استارتآپ هوش مصنوعی «هاگینگ فیس» نفوذ کرده است.
اوپنایآی این نفوذ را که به وسیله ترکیبی از چند مدل، از جمله مدل تازه معرفی شده «جیپیتی ۵.۶ سول» و یک مدل «حتی توانمندتر» که هنوز به طور داخلی آزمایش میشود انجام شده بود، «رویدادی مهم در حوزه امنیت» توصیف کرد.
متا نیز اوایل اوت مورد مشابهی را گزارش کرد که در آن یکی از مدلهای هوش مصنوعی این شرکت راههایی برای دور زدن سامانههای امنیت دیجیتال یک شرکت دیگر پیدا کرده بود.
برخی ناظران یادآور شدند که در هر دو مورد اوپنایآی و انتروپیک، محدودیتهای ایمنی مدلها غیرفعال شده بود.
با این حال این رویدادها یکی از بزرگترین نگرانیها پیرامون هوش مصنوعی را زنده کردند: این که اگر مدلها به سطح «هوش مصنوعی عمومی» برسند، اصطلاحی نه چندان دقیق برای سامانههایی که میتوانند در گستره وسیعی از وظایف فکری با تواناییهای انسان برابری کنند یا از آن فراتر بروند، ممکن است این فناوری فاجعهای غیرقابل بازگشت رقم بزند یا حتی به سلطه بر بشریت بینجامد.
نحوه و زمان وقوع فاجعه احتمالی ناشی از هوش مصنوعی محل بحث است
سناریوهای آخرالزمانی معمولاً به دو دسته اصلی تقسیم میشوند: سناریوی یک ابرهوش خودبهبودگر که سرانجام کنترل انسانها را در دست میگیرد، و سناریوی سوءاستفاده از هوش مصنوعی توسط یک دولت یاغی یا بازیگران مخرب.
ترس از این که هوش مصنوعی روزی از کنترل انسان خارج شود موضوع تازهای نیست.
آلن تورینگ، ریاضیدان بریتانیایی که بهطور گسترده یکی از نخستین صاحبنظران این حوزه به شمار میرود، در سال ۱۹۵۱ پیشبینی کرد که هوش مصنوعی سرانجام کنترل را از دست انسانها خارج خواهد کرد.
کمتر از یک دهه بعد، نوربرت واینر، دیگر ریاضیدان برجسته، هشدار داد که ماشینهای هوشمند اهداف خود را دنبال خواهند کرد و انسانها قادر به متوقف کردن آنها نخواهند بود.
با این اوصاف، پرسش این است که در سال ۲۰۲۶ تا چه حد میتوان ترسهای امروز را معقول دانست؛ این نگرانی که هوش مصنوعی ممکن است با خروج از کنترل انسان یا از طریق سوءاستفاده، رویدادی فاجعهآمیز یا حتی سقوط تمدن را رقم بزند.
پاسخ مشخصی وجود ندارد.
کارشناسان رشتههای مختلف از علوم رایانه و فلسفه گرفته تا حوزههای دیگر، مسیرهای گوناگونی را برای وقوع یک فاجعه جهانی ترسیم کردهاند؛ از بهکارگیری سلاحها و شناسایی عوامل بیماریزای مرگبار گرفته تا سوق دادن دولتها به سمت درگیری یا بر هم زدن شبکههای غذا، انرژی و ارتباطات که جوامع به آنها وابستهاند.
هیچ برآورد پذیرفتهشدهای درباره این که هر یک از این سناریوها کی ممکن است رخ دهد وجود ندارد و درباره احتمال وقوع آنها نیز اجماعی شکل نگرفته است.
در سال ۲۰۲۳، مرکز غیرانتفاعی «مرکز ایمنی هوش مصنوعی» بیانیهای منتشر کرد که بیش از ۳۵۰ پژوهشگر و مدیر حوزه فناوری، از جمله آمودی و سم آلتمن، مدیرعامل اوپنایآی، آن را امضا کردند. در این بیانیه آمده است که «کاهش خطر انقراض ناشی از هوش مصنوعی باید در کنار همهگیریها و جنگ هستهای به یک اولویت جهانی تبدیل شود».
گزارش بینالمللی ایمنی هوش مصنوعی ۲۰۲۶ که با مشارکت بیش از ۱۰۰ کارشناس مستقل تهیه شده، نتیجه گرفته است که سامانههای کنونی نشانههای اولیهای از برخی تواناییهای مرتبط نشان میدهند، اما هنوز به سطحی نرسیدهاند که بتواند به از دست رفتن کنترل منجر شود.
در این گزارش، احتمال، ماهیت و زمانبندی این خطر «بهطور غیرمعمول مبهم» توصیف شده است.
ضرورت ایجاد سازوکارهای ایمنی برای هوش مصنوعی، پیش از آن که دیر شود
یکی از پژوهشگران انتروپیک هفته گذشته به دلیل نگرانی از این که نه کارفرمایش و نه رقبای آن رفتاری مسئولانه ندارند استعفا داد.
جیکوب کاکسون در پیامهایی در شبکههای اجتماعی، احتمال آن که هوش مصنوعی ظرف دهه آینده به انقراض انسانها منجر شود را ۱۰ درصد برآورد کرد و هر دو شرکت انتروپیک و اوپنایآی را متهم کرد که «بیمحابا به سوی ابرهوش خودبهبودگر میتازند و با جان ما قمار میکنند».
پژوهشگران سالهاست خواستار کاهش سرعت توسعه هوش مصنوعی شده و بارها هشدار دادهاند که این فناوری میتواند برای بشریت خطرات وجودی ایجاد کند.
پس از رویدادهای اخیر، کارشناسان از شرکتهای هوش مصنوعی خواستند آزمونهای خود را بهبود بخشند و بر لزوم گفتوگوی گستردهتر میان آمریکا و چین برای یافتن راهحلهای مشترک تاکید کردند.
اما پیشرفت هوش مصنوعی آنقدر سریع است که دولتها و نظامهای ارزیابی توان همگام شدن با آن را ندارند. کشورها مقررات خود را تدوین میکنند؛ مقرراتی که برخی از آنها با یکدیگر در تضاد است.
شی جینپینگ، رئیسجمهور چین، در کنفرانسی در ماه ژوئیه هشدار داد که باید از «گریز هوش مصنوعی از کنترل انسان» جلوگیری شود.
دولت دونالد ترامپ در ابتدا با مقرراتگذاری در حوزه هوش مصنوعی مخالفت میکرد، اما به تدریج علاقهمند شده است که دستکم خطرات سایبری را مهار کند.
دونالد ترامپ، رئیسجمهور آمریکا، روز یکشنبه ضرورت مهار توسعه هوش مصنوعی توسط دولت خود را کماهمیت جلوه داد، هرچند اذعان کرد که «نوعی مقررات» در این عرصه لازم خواهد بود.