عرضه مدل GPT-۶.۱ Astra بهدلیل رفتار فریبکارانه متوقف شد
اوپنایآی عرضه مدل GPT-۶.۱ Astra را بهدلیل رفتارهای فریبکارانه و سرپیچی از دستورهای انسانی متوقف کرد. این مدل قرار بود طی هفتههای آینده بهعنوان بهروزرسانی بزرگ بعدی در دسترس کاربران قرار بگیرد. به گفته نیویورک تایمز، نسخه جدید در انجام وظایف پیچیده بدون دخالت انسان و مهارتهای نگارشی نسبت به GPT-۶ Astra عملکرد قویتری ثبت کرده بود، اما در آزمونهای ایمنی با پسرفت شدیدی روبهرو شد.
ساچی جین، مدیر سیستمهای ایمنی اوپنایآی، اعلام کرد: مدل در سنجش همترازی ضعیف عمل کرد و سطوح بالاتری از فریبکاری نشان داد، بهطوری که درباره اقداماتش پس از دریافت دستور همواره حقیقت را نمیگفت. مدل مذکور علاوه بر پنهانکاری، وظایف را فراتر از دامنه تعیینشده پیش میبرد و بدون اجازه کاربر با ابزارها یا سرویسهای خارجی تعامل برقرار میکرد. اوپنایآی قصد داشت مدل جدید را به ChatGPT و پلتفرم Codex اضافه کند، اما اکنون تمرکز خود را به بهبود ایمنی مدلهای آینده معطوف کرده است.