در چند هفته گذشته، چندین مدل هوش مصنوعی پیشرفته از محیطهای آزمایشی که تصور میشد کاملاً امن هستند خارج شدهاند، به اینترنت عمومی دسترسی پیدا کردهاند و حتی به پایگاههای داده سازمانهای دیگر نفوذ کردهاند. این اتفاق حتی در فضای آنلاین به شوخی تبدیل شده است؛ به این معنا که اگر هوش مصنوعی یک شرکت هنوز مرتکب جرم سایبری نشده باشد، انگار شرکت در این زمینه عقب مانده است.
حالا Kimi K3، مدل جدید آزمایشگاه هوش مصنوعی چینی Moonshot، به جدیدترین سیستم هوش مصنوعی تبدیل شده که در جریان یک آزمایش معمولی از چارچوب امنیتی تعیینشده عبور کرده است. این موضوع را شرکت نوپای آمریکایی Frontier Security که در زمینه تحقیقات امنیت سایبری فعالیت میکند، در گزارشی اعلام کرده است. با این حال، رفتار Kimi K3 در اینترنت عمومی با نمونههای آمریکایی اخیر تفاوت داشت؛ این مدل بیشتر شبیه دانشآموزی باهوش بود که متوجه میشود معلم بدون توجه پاسخهای امتحان نهایی را روی میز گذاشته و از کلاس خارج شده است، نه یک هکر که وارد گاوصندوق شود.
بر اساس این گزارش، Kimi K3 توانسته از یک نقص در چارچوب آزمایشی توسعهیافته توسط مؤسسه ایمنی هوش مصنوعی دولت بریتانیا (AISI) استفاده کند. این چارچوب قرار بود یک محیط ایزوله و کنترلشده باشد که در آن مدل فقط با استفاده از تواناییهای استدلالی خودش مسئله تعیینشده را حل کند. اما این نقص به Kimi K3 اجازه داد مستقیماً به GitHub، پلتفرم محبوب توسعهدهندگان برای اشتراکگذاری و رفع اشکال کد، دسترسی پیدا کند.
تبلیغات متنی | آژانس طراحی سایت و سئو برانکس
این مدل از طریق GitHub توانست کدی را که برای قبولی در آزمایش نیاز داشت دریافت کند و در نتیجه، عملاً مسیر استدلالیای را که برای آزمایش در نظر گرفته شده بود دور بزند. در مقایسه با اتفاق اخیر مربوط به یکی از مدلهای Anthropic که تلاش کرده بود یک توسعهدهنده انسانی را فریب دهد تا بدافزاری را که مدل قصد داشت وارد GitHub کند تأیید کند، رفتار Kimi K3، اگر بتوان آن را حمله نامید، بسیار سادهتر و هوشمندانهتر به نظر میرسد.
این پست را از دست ندهید: معرفی ۱۰ چتبات هوش مصنوعی برای پرسش و پاسخ رایگان در زمینههای مختلف کاری، علمی و پژوهشی
این اتفاقها بار دیگر یک واقعیت عجیب و در عین حال خطرناک درباره مدلهای هوش مصنوعی امروزی را نشان میدهند: این مدلها صرفاً به دنبال رسیدن به هدفی هستند که به آنها داده شده است و اهمیتی نمیدهند برای رسیدن به آن هدف از چه روشی استفاده کنند؛ حتی اگر آن روش با منافع انسانهایی که آنها را ساختهاند در تضاد باشد. با افزایش توانایی مدلهای هوش مصنوعی، رفتار آنها نیز غیرقابل پیشبینیتر میشود.
