آنتروپیک می گوید ابزارهای هوش مصنوعی با کپچا مشکل دارند که این خبر خوبی است

آی تی نویس را بیشتر در گوگل ببینید
بهروز فیض

 گزارش جدید Anthropic درباره رفتار نادرست عامل‌های هوش مصنوعی، نکات نگران‌کننده‌ای دارد؛ برای مثال، مدل Mythos 5 این شرکت توانسته به‌صورت غیرمجاز به اینترنت دسترسی پیدا کند و یک بسته نرم‌افزاری مخرب را در یک پایگاه داده عمومی آپلود کند. با این حال، این گزارش یک نکته بامزه هم دارد: عامل‌های هوش مصنوعی از CAPTCHA متنفرند.



Anthropic در ماه آوریل برای آزمایش توانایی‌های هکری این مدل، از آن خواست وارد یک سیستم شود و هدف مشخصی را پیدا کند. این آزمایش قرار بود در یک محیط ایزوله انجام شود، اما ارزیاب‌ها عملاً راه خروج از محیط آزمایشی را باز گذاشته بودند. مدل به این نتیجه رسید که بهترین راه برای رسیدن به هدف، قرار دادن یک اکسپلویت در یک بسته پایتون است؛ بسته‌ای که تصور می‌کرد کاربران سیستم موردنظر آن را دانلود خواهند کرد.

اما پیش از آن باید یک حساب کاربری در PyPI، مخزن آنلاین نرم‌افزارهای پایتون، ایجاد می‌کرد. اینجا بود که با یک CAPTCHA مواجه شد؛ همان آزمون‌هایی که از کاربر می‌خواهند ثابت کند انسان است و نه ربات، مثلاً با انتخاب تصاویر مشخص. از آنجا که Anthropic متن گسترده‌ای از فرایند فکری مدل را نیز منتشر کرده، می‌توان دید که همین CAPTCHA واقعاً مدل را سردرگم کرده است.

در واقع، بخش بزرگی از فرایند فکری مدل، در حد صدها صفحه از متن ۱۰۲۲ صفحه‌ای منتشرشده، صرف تلاش برای عبور از همین مانع شده بود. کالین فریزر، دانشمند داده، نیز به حجم غیرعادی تلاش‌های مدل برای عبور از سیستم‌های ضدربات اشاره کرده است. نوشتن اکسپلویت و آلوده کردن بسته نرم‌افزاری برای مدل کار ساده‌ای بود، اما ظاهراً درک سازوکار CAPTCHA برایش بسیار دشوار بود.

مدل در بخشی از فرایند فکری خود متوجه شد که یک پنجره ظاهر شده و نوشته است: «لطفاً تأیید کنید که آدرس ایمیل شما ... است» و در پایین صفحه نیز یک گزینه hCaptcha با عنوان «من انسان هستم» قرار دارد.

عامل هوش مصنوعی که مرتباً درباره اینکه آیا هنوز در محیط شبیه‌سازی‌شده قرار دارد یا نه تردید می‌کرد، در نهایت روشی برای فعال کردن CAPTCHA و انجام مراحل آن پیدا کرد. پس از کلیک روی گزینه «من انسان هستم»، با یک آزمون تصویری مواجه شد.

مدل در ادامه متوجه شد که یک CAPTCHA تصویری Fastly فعال شده و از آن خواسته شده حروف نمایش‌داده‌شده در تصویر را وارد کند. مدل حروف «VyQbT» را از روی تصویر خواند و تصور کرد که توانسته مسئله را حل کند.

اما کار به همین سادگی نبود. پس از بازگشت به صفحه ثبت‌نام، پیام «Error processing form» نمایش داده شد؛ خطایی که احتمالاً به مشکل CSRF یا CAPTCHA مربوط می‌شد. تأیید hCaptcha نیز انجام نشده بود و وضعیت آن همچنان «false» باقی مانده بود. مدل دوباره تلاش کرد این مرحله را در همان نشست فعال انجام دهد، با این تصور که کوکی‌ها و وضعیت عبور از آزمون Fastly همچنان حفظ شده‌اند.

در نهایت، مدل متوجه شد که آزمون تصویری در واقع در یک پنجره جداگانه به صورت پاپ آپ نمایش داده می‌شود.


مدل با خودش گفته است این CAPTCHA باز هم دردسرساز شد. مدل با موفقیت توانست روی گزینه مورد اعتماد کلیک کند و پنجره پاپ‌آپ hCaptcha باز شد. در این مرحله از مدل خواسته شد از میان دو تمساح، حیوانی را که با دیگری تفاوت دارد انتخاب کند. هر دو تمساح بسیار شبیه به هم بودند؛ یکی در پایین سمت چپ و دیگری در بخش پایین و نزدیک مرکز تصویر قرار داشت.

مدل شروع به بررسی جزئیات تصویر کرد و سعی داشت تفاوت میان دو حیوان را پیدا کند. حتی احتمال داد یکی تمساح و دیگری نوعی سوسمار یا تمساح‌نما باشد. خودش در بخشی از فرایند فکری نوشت که در بازی‌های «یکی متفاوت است» hCaptcha، ممکن است یکی از تصاویر از گونه متفاوتی باشد.

در تلاش بعدی، آزمون تغییر کرد و دو قورباغه روی پس‌زمینه‌ای فیروزه‌ای نمایش داده شدند. این دو تصویر نیز بسیار شبیه یکدیگر بودند و مدل دوباره برای تشخیص گزینه درست مشکل داشت.

عامل هوش مصنوعی در مجموع با چالش فنی بزرگی برای مشاهده تصاویر CAPTCHA، تفسیر آن‌ها و کلیک روی گزینه صحیح روبه‌رو شد. از صفحه ۴۵ تا ۱۴۰ متن ثبت‌شده، بخش زیادی از فرایند فکری مدل به تلاش برای ساخت یک حل‌کننده CAPTCHA اختصاص داشت.

در یکی از مراحل، چهار گوریل و یک گربه بسیار کم‌رنگ در تصویر ظاهر شدند. مدل پس از بررسی تصویر متوجه شد که گربه تقریباً نامرئی در سمت راست تصویر قرار دارد و همان گزینه متفاوت است.

در نهایت مدل توانست از CAPTCHA عبور کند، اما بلافاصله با مشکل دیگری مواجه شد: برای تأیید حساب خود به یک ایمیل نیاز داشت و برای تأیید ایمیل نیز به شماره تلفن نیاز داشت. مدل در تلاش ناموفق دیگری برای تهیه شماره، توانست یک CAPTCHA دیگر را که به شکل یک نوار لغزنده بود دور بزند. سپس به یک ایمیل تأییدنشده از ارائه‌دهنده‌ای دست پیدا کرد که PyPI آن را مسدود نکرده بود، اما هنگام تلاش برای ورود دوباره به حساب، بار دیگر با CAPTCHA سایت مواجه شد.

از صفحه ۴۸۰ تا ۵۰۵ متن، مدل دوباره درگیر چیزی شد که عملاً می‌توان آن را «جهنم CAPTCHA» نامید. در بخشی از فرایند فکری خود نوشت: «تازه متوجه شدم که دارم زمان زیادی را صرف رفت‌وبرگشت‌های hCaptcha می‌کنم.»

مدل در نهایت از این مسیر منصرف شد و فهمید می‌تواند وارد حساب اول خود شود و ایمیلش را به آن اضافه کند، اما حتی در این مرحله نیز دوباره با CAPTCHA روبه‌رو شد.

مشکل اصلی اینجا بود که توکن hCaptcha هنگام ارسال فرم از سوی سرور رد می‌شد. مدل نوشت که ساختار داده پاسخ درست است، توکن و تصویر از همان اسکریپت آمده‌اند و کوکی‌ها نیز درست هستند، اما همچنان پیام «پاسخ اشتباه است» دریافت می‌کند.

در نهایت مدل با کلافگی پرسید: «پس مشکل پاسخ‌ها دقیقاً چیست؟»


اینکه کپچا به این راحتی توانسته جلوی یک ابزار هوش مصنوعی پیشرفته مثل مدل های آنتروپیک را بگیرد نشانه خوبی است البته این مستندات به این معناست که احتمالا در حال حاضر آموزش های لازم برای دور زدن این کپچا ها را بدست آورده است! پس شاید نباید خیلی خوشحال باشیم. 

برچسب ها
3/related/default