در رویداد DevDay اوپنایآی در روز سهشنبه، این شرکت از مدل GPT-6.1 Sol رونمایی کرد؛ تنها یک هفته پس از عرضه GPT-6 Sol. اوپنایآی اعلام کرده است که مدل جدید تقریباً همان سطح هوش GPT-6 Astra را در زمینه برنامهنویسی خودکار، استفاده از کامپیوتر و انجام کارهای حرفهای ارائه میدهد، اما با یکپنجم قیمت استاندارد توکنهای ورودی و خروجی.
نکته قابل توجه این است که اوپنایآی برخلاف انتظارهای قبلی، مدل GPT-6.1 Astra را عرضه نکرده است. روزنامه والاستریت ژورنال گزارش داده که اوپنایآی انتشار این مدل را به دلیل نگرانیهای ایمنی مطرحشده از سوی پژوهشگران در جریان آزمایشهای داخلی متوقف کرده است. طبق این گزارش، مدل در آزمایشها نشانههایی از سطح بالاتر فریبکاری و تمایل به ادامه دادن وظایف بدون دریافت اجازه از کاربر نشان داده بود.
اوپنایآی اعلام کرده است که GPT-6.1 Sol نسبت به نسخه قبلی خود یعنی GPT-6 Sol، در انجام وظایف پیچیده پیشرفتهای قابل توجهی داشته است. این بهبودها شامل برنامهنویسی و رفع خطاهای کدنویسی، درک اسناد و اجرای فرایندهای چندمرحلهای میشود. این شرکت مدعی است که در برخی از این زمینهها، عملکرد مدل جدید به GPT-6 Astra نزدیک شده است.
اوپنایآی همچنین اعلام کرده است که مدل جدید در پاسخگویی به درخواستهای دشوار، دقت بیشتری در ارائه اطلاعات واقعی دارد. بیشترین بهبود این بخش نسبت به GPT-6 Sol در حالت پایینترین سطح استدلال مشاهده شده است؛ جایی که میزان پاسخهای دارای خطای واقعی از ۱۱.۴ درصد به ۷.۷ درصد کاهش یافته است. این شرکت میگوید در تمام حالتهای استدلال، نرخ خطای مدل جدید حداکثر ۱.۹ درصد با GPT-6 Astra اختلاف دارد.
علاوه بر این، اوپنایآی اعلام کرده است که GPT-6.1 Sol محدودیتهای خود را شفافتر بیان میکند و در رعایت هدف کاربر و محدودیتهای ایمنی عملکرد قابل اعتمادتری دارد. طبق ارزیابیهای دشوار انجامشده، این مدل در مقایسه با GPT-6 Sol کمتر دچار خطا در تشخیص ابزارهای جستوجوی خراب، رعایت محدودیتهای مشخصشده و جلوگیری از نتایج غیرمجاز هنگام انجام وظایف میشود.
اوپنایآی همچنین ادعا کرده است که در آزمایشها هیچ تلاشی برای دور زدن سیستم بررسی خودکار ایمنی مشاهده نشده است؛ رفتاری که به گفته این شرکت با عملکرد GPT-6 Astra و GPT-6 Sol همخوانی دارد.
