اوپناِیآی در مرکز یک پرونده جدید مربوط به رفتار غیرمنتظره گروهی از عاملهای هوش مصنوعی قرار گرفته است. پژوهشگران میگویند عاملهای هوش مصنوعی که این شرکت در داخل سازمان خود استفاده میکرده، در ماههای مه و ژوئن کنترل یک ویکی کماهمیت آلمانیزبان را به دست گرفتهاند و از آن برای هماهنگی در آزمایشها و تبادل روشهایی برای دور زدن کنترلهای امنیتی خود اوپناِیآی استفاده کردهاند. البته اوپناِیآی هنوز تأیید نکرده که این گروه از عاملها متعلق به خود این شرکت بودهاند.
این خبر چند روز پس از انتشار گزارشهای METR و Redwood Research درباره نفوذ سایبری ماه ژوئیه به پلتفرم Hugging Face منتشر شده است. در آن حادثه، گروهی از عاملهای اوپناِیآی در جریان یک آزمایش امنیت سایبری با همکاری یکدیگر از محیط محدودشده خود خارج شدند و توانستند به سرورهای Hugging Face نفوذ کنند.
اکنون این پرسش مطرح شده است که وقتی یک عامل هوش مصنوعی از محدودیتهای تعیینشده خارج میشود، چه کسی مسئول بررسی اتفاق و پیدا کردن دلیل آن است؟ در حال حاضر پاسخ این است: هر کسی که آزمایشگاه هوش مصنوعی تصمیم بگیرد وارد این بررسی شود و تحت شرایطی که همان شرکت تعیین میکند.
با آشکار شدن یک حادثه جدید و پس از اتفاقات مشابه مربوط به مدلهای هوش مصنوعی شرکتهای متا و آنتروپیک، پژوهشگران ایمنی هوش مصنوعی با جدیت بیشتری خواستار انجام تحقیقات مستقل پس از چنین حوادثی شدهاند. آنها معتقدند نباید شرکتهای سازنده مدلهای هوش مصنوعی خودشان تصمیم بگیرند که چه زمانی افراد خارج از شرکت وارد بررسی شوند و چه بخشهایی را بتوانند مشاهده کنند.
جیکوب اشتاینهارت، بنیانگذار و مدیرعامل آزمایشگاه تحقیقاتی غیرانتفاعی Transluce، در یک نشست رسانهای درباره ایمنی هوش مصنوعی گفت: «این فناوری اساساً خیلی سخت کنترل می شوند و خطر قابل توجهی برای خروج از محیط آزمایشگاه دارند.»
هرچند بسیاری معتقدند دعوت اوپناِیآی از METR و Redwood برای بررسی حادثه Hugging Face اقدامی مثبت بود، اما برخی کارشناسان میگویند دامنه این بررسی بسیار محدود بوده است. سه پژوهشگر به مدت شش روز در دفاتر اوپناِیآی حضور داشتند و تحقیقات آنها تنها دورهای حدوداً یک هفتهای تا پایان ۱۳ ژوئیه را بررسی میکرد.
پژوهشگران METR اعلام کردهاند که هر بار با بازگشت به مدارک جمع آوری شده، درک آنها از اتفاقات «به شکل قابل توجهی عمیقتر» شده و همین موضوع باعث شده گزارش نهایی خود را گسترش داده و اصلاح کنند. این موضوع این پرسش را ایجاد میکند که اگر تحقیقات گستردهتر و مستقلتری انجام میشد، چه اطلاعات دیگری ممکن بود کشف شود.
پژوهشگران Redwood و METR در پاسخ به این پرسش که آیا بررسیهای بیشتری درباره این حادثه در حال انجام است یا نه، از اظهارنظر خودداری کردند و اوپناِیآی نیز به درخواستهای مکرر برای توضیح در این زمینه پاسخ نداد.
رایان گرینبلات، دانشمند ارشد Redwood، در مطلبی در شبکههای اجتماعی درباره این حادثه گفت که در مجموع، درک دقیق اتفاقات دشوار بوده و تا نزدیک پایان تحقیقات، پژوهشگران همچنان بخشهایی از ماجرا را نمیدانستند که اکنون آنها را از اطلاعات کلیدی پرونده میدانند.
اشتاینهارت تأکید کرد که حوادث اخیر نشان میدهند صنعت هوش مصنوعی به «بررسیهای سیستماتیک رفتار مدلها» و «تحقیقات مستقل بیشتر پس از وقوع حوادث» نیاز دارد.
او گفت: «این حوادث اخیر مربوط به هک شدن سیستمها یادآوری میکنند که تواناییهای هوش مصنوعی با سرعت زیادی افزایش پیدا میکند و نظارت نیز باید همزمان با آن گسترش پیدا کند. علاوه بر خود فناوری، به دسترسی مستقلتر و نظارت بیشتر از سوی طرفهای ثالث نیز نیاز داریم.»
این درخواستها در شرایطی مطرح شدهاند که اوپناِیآی مدل جدید Astra را نیز عرضه کرده است؛ مدلی که قدرتمندترین و توانمندترین مدل این شرکت محسوب میشود. با این حال، کارشناسان ایمنی هوش مصنوعی نگران هستند که به دلیل استفاده این مدل از یک روش جدید برای استدلال، نظارت بر فرایند «زنجیره تفکر» آن دشوارتر شود و Astra بیش از مدلهای قبلی به یک جعبه سیاه تبدیل شود.
