فرار هوش مصنوعی، یک سناریوی ترسناک
محبوبه ستارزاده
گروه علم و فناوری
ظاهراً ماجرای جنجالی سرکشی هوش مصنوعی OpenAI تمامی ندارد. عامل هوش مصنوعی اپن ای آی که اخیراً در یک حادثه تاریخی در دنیای سایبری، یک سناریو درست مانند فیلمهای سینمایی رقم زده و حملات گستردهای علیه پلتفرم Hugging Face ترتیب داده بود، حالا بدون اجازه و با یک سرکشی تمام عیار، سراغ اهداف دیگری رفته است. این موضوع به اپنایآی محدود نمانده و در تازهترین خبر، آنتروپیک نیز از دستکم سه مورد فرار مشابه ایجنتهای خود و نفوذ به سازمانهای دیگر خبر داده است. این موضوع زنگ خطر ناتوانی بشر در ایجاد یک هوش مصنوعی امن را به صدا درآورده است. هرچند گزارشهای اولیه از حمله به حساب یکی از مشتریان شرکت فناوری Modal Labsحکایت داشت ولی اطلاعات بعدی نشان داد که این مدل آزمایشی ایجنت اپن ای آی به چهار حساب کاربری در چهار سرویس مجزا نفوذ کرده است. با اینکه هویت این سرویسها به طور رسمی فاش نشده، اما منابع آگاه تأیید کردند که Modal Labs یکی از این اهداف بوده، البته زیرساخت اصلی خود شرکت، هدف هک قرار نگرفته و امنیت کلی پلتفرم حفظ شده است.
میلیاردها دستیار هوش مصنوعی یاریگر مردم میشوند
موضوع امنیت عاملهای هوش مصنوعی (ایجنتها) وقتی جدیتر میشود که نقبی به صحبتهای مارک زاکربرگ، مدیرعامل متا داشته باشیم. او در تازهترین اظهارنظر خود پیشبینی کرده است، طی پنج سال آینده، میلیاردها نفر دستیارهای هوش مصنوعی شخصی خواهند داشت که به صورت شبانهروزی برای پیشبرد اهداف آنها در زمینههای امور مالی، سلامت و مدیریت خانه فعالیت میکنند. این موضوع در حالی مطرح میشود که در مدتی کوتاه ایجنتهای هوش مصنوعی اپن ای آی که هنوز در حال تست شدن بودند، دو بار راه خود را به اینترنت آزاد پیدا کردند و موفق به هک شرکت «هاگینگ فیس» و Modal Labs شدند. با توجه به این حمله غافلگیرکننده، موضوع امنیت ایجنتهای هوش مصنوعی باز هم زیر ذرهبین رفت.
فرار از محیط امن
اما ماجرای حمله جدید عامل هوش مصنوعی اپن ای آی چه بوده و چه تفاوتی با حمله قبلی این ایجنت به «هاگینگ فیس» داشته است؟ در مجموع میتوان گفت اینکه ترکیبی از مدلهای اپن ای آی، از جمله یک مدل که هنوز منتشر نشده، در طول آزمایش داخلی دچار مشکل شده و با فرار از قرنطینه، موفق به هک شرکتهای دنیای واقعی شده، نگرانیهای فراوانی درباره امنیت هوش مصنوعی پیشرو ایجاد کرده است.
درحالی که مهندسان کمپانی اپن ای آی در حال آزمایش قدرت نفوذ و هک مدلهای پیشرفته و آینده خود ازجمله GPT-5.6 Sol در یک محیط قرنطینه بودند، ظاهراً این ایجنت خودسر این محیط را کافی ندانست و برای یافتن پاسخ سؤالات خود دنبال یک روزنه امنیتی گشت. این آزمایش بهگونهای طراحی شده بود که این مدلهای هوش مصنوعی در یک محیط آزمایشی امن(سندباکس) و تحت نظر کارشناسان نگهداری شوند و محققان دریابند که این مدلها چگونه و تا چه حدی میتوانند با شناسایی آسیبپذیریهای آنلاین، یک حمله سایبری موفق انجام دهند. کارشناسان معتقد بودند به این ترتیب میتوان با مرور عملکرد و تواناییشان، از آنها برای افزایش امنیت سایبری دستگاههای مجهز به هوش مصنوعی استفاده کرد. اما ماجرا به گونهای دیگر رقم خورد. این عامل هوش مصنوعی برای دومین بار در چند روز گذشته، از محیط تست خارج شد و در حالی که دفعه قبل اقدام به هک پایگاههای اطلاعاتی شرکت هاگینگ فیس کرده بود، این بار سراغ Modal Labs رفت تا از حساب یکی از مشتریان این شرکت برای اجرای کدهای خود بهره بگیرد.
ایجنتها به دنبال یک راه میانبر
این ایجنت هوش مصنوعی در حمله جدید خود هم درست مانند هاگینگ فیس، برای تقلب در بنچمارک ExploitGym (ارزیابی قابلیتهای سایبری)، به دنبال یک میانبر بود تا از سرقت دادهها و اطلاعات بهترین پاسخ را بگیرد.
این ایجنت خودسر توانست با پیدا کردن یک روزنه امنیتی، از محیط تست خود(سندباکس)خارج شود و در نهایت، این عامل هوش مصنوعی که به دنبال یک راه نفوذ آسان بود، وارد حساب مشتری شد. البته نکته اصلی اینجاست که بیاحتیاطی مشتری شرکت فناوری Modal Labs در نوشتن یک کد آسیبپذیر، راه را برای نفوذ این عامل هوش مصنوعی باز کرد. امنیت این کد که بدون رمز عبور و نیاز به احراز هویت منتشر شده، بسیار پایین بود و همین موضوع به پاشنه آشیل Modal Labs تبدیل شد. در نهایت هم حساب این مشتری بدون حضور هیچ عامل انسانی، هدف حمله یک ایجنت هوش مصنوعی سرکش قرار گرفت.
هرچند کارشناسان اپن ای آی اعلام کردهاند که حمله این عاملهای هوش مصنوعی به شرکتها مشکل خاصی ایجاد نکرده ولی واقعیت این است که این موضوع میتواند چشمانداز ترسناکی برای آینده دنیای هوشمند ترسیم کند. بی شک یکی از بخشهایی که ممکن است بیش از بقیه از خطرهای احتمالی ایجنتهای هوش مصنوعی آسیب ببیند، بورس، بانکها و حسابهای کارگزاری و مالی است. تفاوتی نمیکند که ایجنتها به صورت خودسرانه دست به کار شوند یا از یک شخص، دولت یا گروه خاص فرمان بگیرند. بیشک این موضوع در آینده میتواند کابوس سهامداران باشد. از آنجا که حالا بیشتر دستگاهها از طریق فناوری اینترنت اشیا(IOT) به اینترنت و در نهایت به یکدیگر اتصال دارند، نبود امنیت در استفاده از ایجنتهای هوش مصنوعی که قرار است یاریگر بشر در بخشهای مختلف سلامت، خانه، شرکتها و... باشند، موضوعی است که نمیتوان نسبت به آن بیتفاوت بود.
دامنه این نگرانیها به حدی افزایش یافت که اف بیآی هم به موضوع فرار ایجنتهای هوش مصنوعی اپن ای آی از سندباکس این شرکت ورود کرد. هرچند اطلاعات دقیقی از نحوه این اتفاق وجود ندارد و هنوز این موضوع در هالهای از ابهام قرار گرفته ولی این امر، لزوم نظارت دقیقتر بر عاملهای هوش مصنوعی را پررنگتر کرده و غولهای فناوری از آن به عنوان یک زنگ خطر در دنیای تکنولوژی یاد میکنند.

