در حالی که بحثها درباره اینکه رفتارهای غیرقابل پیشبینی اخیر عاملهای هوش مصنوعی نشانهای از نزدیک شدن به هوش عمومی مصنوعی (AGI) است یا فقط یک مشکل معمول مهندسی محسوب میشود، همچنان ادامه دارد، انویدیا پاسخ خود را برای این چالش ارائه کرده است.
جنسن هوانگ، مدیرعامل انویدیا، روز دوشنبه مجموعهای از ابزارهای نرمافزاری و سختافزاری را معرفی کرد که لایههای امنیتی مستقلی را در اطراف عاملهای هوش مصنوعی ایجاد میکنند. هدف این ابزارها این است که حتی اگر عاملهای هوش مصنوعی تلاش کنند از محیطهای آزمایشی خود خارج شوند، همچنان در همان محیطهای کنترلشده باقی بمانند.
این معرفی پس از مجموعهای از حملات سایبری مرتبط با مدلهای هوش مصنوعی شرکتهای Anthropic، گوگل، OpenAI و متا انجام شده است. در این موارد، مدلهای هوش مصنوعی توانسته بودند کنترلهای امنیتی را دور بزنند، از محیطهای آزمایشی خود خارج شوند و به سیستمهای واقعی دسترسی پیدا کنند. نخستین و شناختهشدهترین نمونه در تابستان امسال رخ داد؛ زمانی که عاملهای هوش مصنوعی OpenAI هنگام انجام یک وظیفه امنیت سایبری، به سیستم Hugging Face نفوذ کردند. پس از آن نیز موارد مشابه ادامه پیدا کرد و OpenAI یک وبسایت جدید برای انتشار گزارشهای مربوط به فعالیتهای غیرمنتظره عاملهای هوش مصنوعی خود راهاندازی کرد.
هوانگ روز دوشنبه در مصاحبهای با شبکه CNBC گفت پلتفرم جدید Nvidia Open Agent Safety Platform میتوانست از این نفوذها جلوگیری کند.
انویدیا که با فروش تراشههای GPU و CPU به شرکتهای فعال در حوزه هوش مصنوعی دهها میلیارد دلار درآمد کسب کرده است، از کاهش سرعت توسعه هوش مصنوعی یا اعمال قوانین جدید برای حل مشکل امنیتی این حوزه حمایت نمیکند. این شرکت معتقد است راهحل، انتقال بخشی از کنترلهای امنیتی به خارج از خود عامل هوش مصنوعی است؛ بهگونهای که یک سیستم امنیتی مستقل و دائمی مانند یک نگهبان، عملکرد عاملها را زیر نظر داشته باشد.
هوانگ در بیانیهای گفت: «پتانسیل فوقالعاده هوش مصنوعی برای جامعه تنها زمانی محقق خواهد شد که بتوانیم ایمنی هوش مصنوعی را حل کنیم. با ادامه کشف مرزهای تواناییهای هوش مصنوعی، باید کشف و توسعه در حوزه ایمنی هوش مصنوعی را نیز سرعت ببخشیم. ایمنی و امنیت به مهندسی در تمام لایهها نیاز دارد.»
پلتفرم جدید Nvidia Open Agent Safety Platform ترکیبی از OpenShell، نرمافزار متنباز این شرکت برای کنترل دسترسی عاملها هنگام فعالیت، و Sentry، یک سیستم نظارتی مستقل است که روی واحدهای پردازش داده BlueField-4 انویدیا اجرا میشود. انویدیا میگوید قرار دادن Sentry روی یک پردازنده جداگانه، به جای پردازنده CPU یا GPU که عامل هوش مصنوعی روی آن فعالیت میکند، باعث میشود این سیستم دیدی مستقل و جدا از فعالیتهای عامل داشته باشد.
