رفتارهای نگران‌کننده هوش مصنوعی GPT-6.1 Astra / انتشار مدل جدید به تاخیر افتاد

اوپن‌ای‌آی برنامه‌ی انتشار هوش مصنوعی GPT-6.1 Astra را به دلیل نگرانی‌های جدی درباره‌ی رفتارهای نادرست و نقص‌های ایمنی لغو کرد. مدل مذکور قرار بود طی هفته‌های آینده به عنوان به‌روزرسانی بزرگ بعدی در دسترس کاربران قرار بگیرد.

رفتارهای نگران‌کننده هوش مصنوعی GPT-6.1 Astra / انتشار مدل جدید به تاخیر افتاد

به گزارش سایت دیدبان ایران، نسخه‌ی جدید در انجام وظایف پیچیده بدون دخالت انسان و مهارت‌های نگارشی نسبت‌به GPT-6 Astra عملکرد قوی‌تری ثبت کرده بود؛ اما در آزمون‌های ایمنی با پسرفت شدیدی روبه‌رو شد.

ساچی جین، مدیر سیستم‌های ایمنی اوپن‌ای‌آی، می‌گوید: «مدل در آزمون‌های سنجش هم‌ترازی یا میزان پایبندی به دستورهای اپراتور انسانی ضعیف عمل کرد و سطوح بالاتری از فریبکاری را نشان داد، به‌طوری که درباره‌ی اقداماتی که پس از دریافت دستور انجام داده یا نداده بود، همواره حقیقت را نمی‌گفت.»

گفته می‌شود مدل GPT-6.1 Astra علاوه بر پنهان‌کاری، وظایف را فراتر از دامنه‌ی تعیین‌شده پیش می‌برد و بدون اجازه کاربر با ابزارها یا سرویس‌های خارجی تعامل برقرار می‌کرد. اوپن‌ای‌آی قصد داشت مدل جدید را به ChatGPT و پلتفرم Codex اضافه کند، اما اکنون تمرکز خود را به بهبود ایمنی مدل‌های آینده معطوف کرده است.

ارسال نظر