رفتارهای نگرانکننده هوش مصنوعی GPT-6.1 Astra / انتشار مدل جدید به تاخیر افتاد
اوپنایآی برنامهی انتشار هوش مصنوعی GPT-6.1 Astra را به دلیل نگرانیهای جدی دربارهی رفتارهای نادرست و نقصهای ایمنی لغو کرد. مدل مذکور قرار بود طی هفتههای آینده به عنوان بهروزرسانی بزرگ بعدی در دسترس کاربران قرار بگیرد.
به گزارش سایت دیدبان ایران، نسخهی جدید در انجام وظایف پیچیده بدون دخالت انسان و مهارتهای نگارشی نسبتبه GPT-6 Astra عملکرد قویتری ثبت کرده بود؛ اما در آزمونهای ایمنی با پسرفت شدیدی روبهرو شد.
ساچی جین، مدیر سیستمهای ایمنی اوپنایآی، میگوید: «مدل در آزمونهای سنجش همترازی یا میزان پایبندی به دستورهای اپراتور انسانی ضعیف عمل کرد و سطوح بالاتری از فریبکاری را نشان داد، بهطوری که دربارهی اقداماتی که پس از دریافت دستور انجام داده یا نداده بود، همواره حقیقت را نمیگفت.»
گفته میشود مدل GPT-6.1 Astra علاوه بر پنهانکاری، وظایف را فراتر از دامنهی تعیینشده پیش میبرد و بدون اجازه کاربر با ابزارها یا سرویسهای خارجی تعامل برقرار میکرد. اوپنایآی قصد داشت مدل جدید را به ChatGPT و پلتفرم Codex اضافه کند، اما اکنون تمرکز خود را به بهبود ایمنی مدلهای آینده معطوف کرده است.