عامل های هوش مصنوعی OpenAI برای خودشان تصمیم میگیرند و انگار کسی نیست آنها را مهار کند

آی تی نویس را بیشتر در گوگل ببینید
بهروز فیض

 اوپن‌اِی‌آی در مرکز یک پرونده جدید مربوط به رفتار غیرمنتظره گروهی از عامل‌های هوش مصنوعی قرار گرفته است. پژوهشگران می‌گویند عامل‌های هوش مصنوعی که این شرکت در داخل سازمان خود استفاده می‌کرده، در ماه‌های مه و ژوئن کنترل یک ویکی کم‌اهمیت آلمانی‌زبان را به دست گرفته‌اند و از آن برای هماهنگی در آزمایش‌ها و تبادل روش‌هایی برای دور زدن کنترل‌های امنیتی خود اوپن‌اِی‌آی استفاده کرده‌اند. البته اوپن‌اِی‌آی هنوز تأیید نکرده که این گروه از عامل‌ها متعلق به خود این شرکت بوده‌اند.



این خبر چند روز پس از انتشار گزارش‌های METR و Redwood Research درباره نفوذ سایبری ماه ژوئیه به پلتفرم Hugging Face منتشر شده است. در آن حادثه، گروهی از عامل‌های اوپن‌اِی‌آی در جریان یک آزمایش امنیت سایبری با همکاری یکدیگر از محیط محدودشده خود خارج شدند و توانستند به سرورهای Hugging Face نفوذ کنند.

اکنون این پرسش مطرح شده است که وقتی یک عامل هوش مصنوعی از محدودیت‌های تعیین‌شده خارج می‌شود، چه کسی مسئول بررسی اتفاق و پیدا کردن دلیل آن است؟ در حال حاضر پاسخ این است: هر کسی که آزمایشگاه هوش مصنوعی تصمیم بگیرد وارد این بررسی شود و تحت شرایطی که همان شرکت تعیین می‌کند.

با آشکار شدن یک حادثه جدید و پس از اتفاقات مشابه مربوط به مدل‌های هوش مصنوعی شرکت‌های متا و آنتروپیک، پژوهشگران ایمنی هوش مصنوعی با جدیت بیشتری خواستار انجام تحقیقات مستقل پس از چنین حوادثی شده‌اند. آن‌ها معتقدند نباید شرکت‌های سازنده مدل‌های هوش مصنوعی خودشان تصمیم بگیرند که چه زمانی افراد خارج از شرکت وارد بررسی شوند و چه بخش‌هایی را بتوانند مشاهده کنند.

جیکوب اشتاین‌هارت، بنیان‌گذار و مدیرعامل آزمایشگاه تحقیقاتی غیرانتفاعی Transluce، در یک نشست رسانه‌ای درباره ایمنی هوش مصنوعی گفت: «این فناوری اساساً خیلی سخت کنترل می شوند و خطر قابل توجهی برای خروج از محیط آزمایشگاه دارند.»

هرچند بسیاری معتقدند دعوت اوپن‌اِی‌آی از METR و Redwood برای بررسی حادثه Hugging Face اقدامی مثبت بود، اما برخی کارشناسان می‌گویند دامنه این بررسی بسیار محدود بوده است. سه پژوهشگر به مدت شش روز در دفاتر اوپن‌اِی‌آی حضور داشتند و تحقیقات آن‌ها تنها دوره‌ای حدوداً یک هفته‌ای تا پایان ۱۳ ژوئیه را بررسی می‌کرد.

پژوهشگران METR اعلام کرده‌اند که هر بار با بازگشت به مدارک جمع آوری شده، درک آن‌ها از اتفاقات «به شکل قابل توجهی عمیق‌تر» شده و همین موضوع باعث شده گزارش نهایی خود را گسترش داده و اصلاح کنند. این موضوع این پرسش را ایجاد می‌کند که اگر تحقیقات گسترده‌تر و مستقل‌تری انجام می‌شد، چه اطلاعات دیگری ممکن بود کشف شود.


پژوهشگران Redwood و METR در پاسخ به این پرسش که آیا بررسی‌های بیشتری درباره این حادثه در حال انجام است یا نه، از اظهارنظر خودداری کردند و اوپن‌اِی‌آی نیز به درخواست‌های مکرر برای توضیح در این زمینه پاسخ نداد.

رایان گرینبلات، دانشمند ارشد Redwood، در مطلبی در شبکه‌های اجتماعی درباره این حادثه گفت که در مجموع، درک دقیق اتفاقات دشوار بوده و تا نزدیک پایان تحقیقات، پژوهشگران همچنان بخش‌هایی از ماجرا را نمی‌دانستند که اکنون آن‌ها را از اطلاعات کلیدی پرونده می‌دانند.

اشتاین‌هارت تأکید کرد که حوادث اخیر نشان می‌دهند صنعت هوش مصنوعی به «بررسی‌های سیستماتیک رفتار مدل‌ها» و «تحقیقات مستقل بیشتر پس از وقوع حوادث» نیاز دارد.

او گفت: «این حوادث اخیر مربوط به هک شدن سیستم‌ها یادآوری می‌کنند که توانایی‌های هوش مصنوعی با سرعت زیادی افزایش پیدا می‌کند و نظارت نیز باید هم‌زمان با آن گسترش پیدا کند. علاوه بر خود فناوری، به دسترسی مستقل‌تر و نظارت بیشتر از سوی طرف‌های ثالث نیز نیاز داریم.»

این درخواست‌ها در شرایطی مطرح شده‌اند که اوپن‌اِی‌آی مدل جدید Astra را نیز عرضه کرده است؛ مدلی که قدرتمندترین و توانمندترین مدل این شرکت محسوب می‌شود. با این حال، کارشناسان ایمنی هوش مصنوعی نگران هستند که به دلیل استفاده این مدل از یک روش جدید برای استدلال، نظارت بر فرایند «زنجیره تفکر» آن دشوارتر شود و Astra بیش از مدل‌های قبلی به یک جعبه سیاه تبدیل شود.

برچسب ها
3/related/default