رفتارهای نگران‌کننده هوش مصنوعی GPT-6.1 Astra / انتشار مدل جدید به تاخیر افتاد

اوپن‌ای‌آی برنامه‌ی انتشار هوش مصنوعی GPT-6.1 Astra را به دلیل نگرانی‌های جدی درباره‌ی رفتارهای نادرست و نقص‌های ایمنی لغو کرد. مدل مذکور قرار بود طی هفته‌های آینده به عنوان به‌روزرسانی بزرگ بعدی در دسترس کاربران قرار بگیرد.

به گزارش خبرآنلاین، به نقل از زومیت، نسخه‌ی جدید در انجام وظایف پیچیده بدون دخالت انسان و مهارت‌های نگارشی نسبت‌به GPT-6 Astra عملکرد قوی‌تری ثبت کرده بود؛ اما در آزمون‌های ایمنی با پسرفت شدیدی روبه‌رو شد.

ساچی جین، مدیر سیستم‌های ایمنی اوپن‌ای‌آی، می‌گوید: «مدل در آزمون‌های سنجش هم‌ترازی یا میزان پایبندی به دستورهای اپراتور انسانی ضعیف عمل کرد و سطوح بالاتری از فریبکاری را نشان داد، به‌طوری که درباره‌ی اقداماتی که پس از دریافت دستور انجام داده یا نداده بود، همواره حقیقت را نمی‌گفت.»

گفته می‌شود مدل GPT-6.1 Astra علاوه بر پنهان‌کاری، وظایف را فراتر از دامنه‌ی تعیین‌شده پیش می‌برد و بدون اجازه کاربر با ابزارها یا سرویس‌های خارجی تعامل برقرار می‌کرد. اوپن‌ای‌آی قصد داشت مدل جدید را به ChatGPT و پلتفرم Codex اضافه کند، اما اکنون تمرکز خود را به بهبود ایمنی مدل‌های آینده معطوف کرده است.

۵۸۵۸

کد مطلب 2281273

برچسب‌ها

نظر شما

شما در حال پاسخ به نظر «» هستید.
7 + 9 =

آخرین اخبار