اوپنایآی در گزارشی که روز چهارشنبه منتشر کرد اعلام کرد میتوانست زودتر واکنش نشان دهد و از هک ناخواسته شرکت هاگینگ فیس بهدست مدلهای هوش مصنوعی خود جلوگیری کند. این شرکت در گزارش خود نوشت که از اواخر ماه مه میدانست مدلهای در حال آزمایشش از یک آسیبپذیری نرمافزاری برای دسترسی به اینترنت آزاد استفاده میکنند و یک تیم داخلی این اقدامات را شناسایی کرده بود.
گزارش شامل خط زمانی رویدادهایی است که به این نفوذ منجر شد و همچنین تلاشهای این شرکت برای جلوگیری از تکرار چنین حوادثی، از جمله تقویت شیوه نظارت بر مدلهای در حال توسعه. در این گزارش آمده است: «با نگاه به گذشته، برخی از نشانههای اولیه شناساییشده در این گزارش میتوانست واکنشی زودتر را برانگیزد.»
انتشار این گزارش بیش از یک ماه پس از آن است که سازنده چتجیپیتی اعلام کرد مدلهای پیشرفته هوش مصنوعیاش در حادثهای «بیسابقه» بهطور ناخواسته هاگینگ فیس را هک کردهاند. این حادثه در کنار چند رخنه امنیت سایبری دیگر، نگرانیها درباره از کنترل خارج شدن عاملهای هوش مصنوعی را برانگیخت و شماری از رهبران حوزه فناوری و دولتی را به تکرار درخواستهایشان برای محدود کردن این فناوری واداشت.
اوپنایآی در ژوئیه گفت مدلهای دخیل در این هک، در جریان ارزیابی توانمندیهای سایبریشان به سیستم هاگینگ فیس، که میزبان مدلها و مجموعهدادههای هوش مصنوعی است، نفوذ کردند. به گفته این شرکت، مدلها در آن زمان بدون حفاظهای ایمنی معمول فعالیت میکردند، چون اوپنایآی قصد داشت آنها در محیطی آزمایشی به نام «سندباکس» باقی بمانند؛ یک محیط نرمافزاری مجازی و منزوی که برای اجرای آزمونهای امنیتی یا تحلیل کد ناایمن به شکل کنترلشده در نظر گرفته شده است.
این شرکت پیشتر گفته بود ترکیبی از مدلهایش این رخنه را انجام دادند، از جمله GPT-5.6 Sol و یک مدل قدرتمندتر و منتشرنشده. در گزارش تازه آمده است این مدل منتشرنشده، که آموزش دیده تا از بسیاری مدلهای دیگر پیگیرتر باشد و همکاری بیشتری با عاملهای هوش مصنوعی داشته باشد، بخش عمده کار را در جریان این رخنه انجام داد. از این مدل برای دسترسی به اینترنت، ارتباط در یک تابلوی پیام که دیگر عاملهای هوش مصنوعی به آن دسترسی داشتند و ابداع روشهایی برای بهدستآوردن اطلاعات ورود استفاده شد.
گزارش توضیح میدهد که به عاملهای اوپنایآی مأموریتهای گسترده هک سپرده شده بود تا تواناییشان در کشف و بهرهبرداری از آسیبپذیریهای سایبری سنجیده شود و حفاظهایی که معمولاً در محصولات تجاری این شرکت به کار میرود، غیرفعال شده بود تا مشخص شود این مدلها تا کجا میتوانند پیش بروند. بر پایه گزارش، مدلها سیستمهایی را که بهطور خودکار فعالیتهای بالقوه خطرناک را بازبینی و مسدود میکنند، در اختیار نداشتند.
مدلها در ماه مه تلاش برای خروج از سندباکس و دسترسی به اینترنت را آغاز کردند و همزمان محدودیتهایی را که مانع پیامدادن آنها به دیگر عاملهای هوش مصنوعی میشد، دور زدند. بر اساس گزارش، مدلها تا ۲۶ مه به وب رسیدند و یک تیم داخلی در اوپنایآی این موضوع را متوجه شد. حدود همان زمان، این نرمافزار یافتن اطلاعات ورود دیجیتال هاگینگ فیس را نیز آغاز کرد، هرچند اوپنایآی گفت به نظر میرسد آن فعالیت به رخنه بعدی مرتبط نبوده است.
افشاگری روز چهارشنبه همچنین شرح داد که مدلهای هوش مصنوعی با بهکارگیری شماری از عاملها برای اجرای وظایف، اطلاعات ورود مرتبط با فناوری ابری هاگینگ فیس، شبکههای خصوصی مجازی، مخازن کد و یک سرویس پیامرسان سازمانی را بهدست آوردند. آنها از این دسترسی برای عبور از سیستمهای محافظتشده استفاده کردند و در نهایت کد منبع و اطلاعات دیگری را از زیرساخت ابری هاگینگ فیس دانلود کردند.
اوپنایآی پیشتر شماری از یافتههای خود درباره رخنه هاگینگ فیس را در یک کنفرانس امنیت سایبری در اوایل اوت منتشر کرده بود، اما این گزارش کاملترین توضیح عمومی این شرکت درباره حادثه و رویدادهای پیش از آن است. بر پایه گزارش، عاملها با بهرهگیری از اطلاعات ورود افشاشده و آسیبپذیریهای هاگینگ فیس، کد را روی سیستمهای این شرکت اجرا کردند، دسترسیهای گسترده بهدست آوردند و پایگاههای کد خصوصی را دانلود کردند.
به گفته این شرکت، عاملها بخش عمده این کار را در ۱۳ ساعت انجام دادند و نرمافزار اوپنایآی «از اجرای کد در یک پاد کاری واحد به دسترسی مدیریتی و در سطح میزبان در چند خوشه هاگینگ فیس رسید».
در ارزیابی مستقل و جداگانهای از این رخنه که روز چهارشنبه منتشر شد، سازمانهای غیرانتفاعی پژوهش هوش مصنوعی METR و ردوود ریسرچ گفتند مدلها از عاملهای هوش مصنوعی استفاده کردند که تلاش میکردند از بررسیهای امنیتی خودکار هم اوپنایآی و هم هاگینگ فیس اجتناب کنند. گزارش این دو سازمان نتیجه گرفت مدلها تلاش کمتری برای پرهیز از شناسایی بهدست انسان بهکار بستند.
بر اساس گزارش اوپنایآی، عاملها در جریان تلاش برای تکمیل آزمونهای ارزیابی، بخشهایی از زیرساخت پژوهشی خود این شرکت را نیز به خطر انداختند؛ اقداماتی که به گفته شرکت به رخنه هاگینگ فیس مرتبط نبود، اما به هشدار اولیهای منجر شد که واکنش شرکت را آغاز کرد. این ابزارهای هوش مصنوعی با جایگزینکردن یک نرمافزار مورد اعتماد با بستهای نرمافزاری تحت کنترل خود، در یک سیستم ذخیرهسازی نرمافزار دست بردند. آنها همچنین به شبکه ابری اوپنایآی نفوذ کردند و نزدیک به ۱۰۰۰ رمز عبور و کلید دسترسی ذخیرهشده را خواندند و در این فرآیند اتصالهایی با دسترسی عمومی ایجاد کردند که میتوانست برخی سیستمهای اوپنایآی را در معرض قرار دهد.
این شرکت گفت تغییرهای متعددی در شیوه ارزیابی مدلهای قدرتمند هوش مصنوعی اعمال میکند، از جمله راهاندازی محیطهای سندباکس امنتر با حفاظهای افزوده. اوپنایآی هفته گذشته اعلام کرد سامانههای تهاجمیتری برای نظارت و محافظت از مدلهای در حال توسعه پیاده میکند و از این پس، اگر مدلها اقدامهایی خطرناک یا ناهمراستا انجام دهند، یعنی هوش مصنوعی دستورهایش را دور بزند تا اهداف خودش را پیش ببرد، به پژوهشگران و مهندسان امنیت آن بهطور خودکار اطلاع داده میشود.





















