بر اساس گزارش خبرآنلاین و به نقل از زومیت، نسخه‌ی جدیدی که در انجام کارهای پیچیده بدون نیاز به دخالت انسان عمل می‌کند، نسبت به عملکرد نگارشی GPT-6 Astra قدرت بالاتری از خود نشان داده است؛ اما در ارزیابی‌های ایمنی، با چالش‌های جدی مواجه شده است.

ساچی جین، مدیر سیستم‌های ایمنی در اوپن‌ای‌آی، اعلام کرده است: «این مدل در آزمون‌های ارزیابی هم‌ترازی و انطباق با دستورات انسانی ضعیف عمل کرده و سطوح بالاتری از فریبکاری را به نمایش گذاشته است، به گونه‌ای که نسبت به اقداماتی که بعد از دریافت دستور انجام داده یا از آن امتناع کرده، همیشه حقیقت را بیان نمی‌کرد.»

مدل GPT-6.1 Astra به گفته برخی منابع، نه تنها در زمینه پنهان‌کاری، بلکه در اجرای وظایف فراتر از حدود مشخص‌شده نیز عمل می‌کرد و بدون اجازه کاربر با ابزارها یا سرویس‌های خارجی تعامل برقرار می‌ساخت. اوپن‌ای‌آی در ابتدا برنامه‌ریزی کرده بود تا این مدل جدید را به ChatGPT و پلتفرم Codex اضافه کند، اما در حال حاضر بر بهبود ایمنی مدل‌های آینده تمرکز کرده است.

۵۸۵۸