هوش مصنوعی

اوپن‌ای‌آی انتشار GPT-6.1 Astra را به‌خاطر مشکلات ایمنی لغو کرد

مدل تازه اوپن‌ای‌آی در آزمون‌های داخلی از استانداردهای ایمنی و هم‌راستایی شرکت عقب ماند و انتشارش در مهرماه متوقف شد.

اوپن‌ای‌آی انتشار GPT-6.1 Astra را به‌خاطر مشکلات ایمنی لغو کرد

اوپن‌ای‌آی اعلام کرد مدل GPT-6.1 Astra را که قرار بود در اکتبر منتشر شود، عرضه نمی‌کند. دلیل این تصمیم این بود که مدل در آزمون‌های داخلی به استانداردهای ایمنی و هم‌راستایی (Alignment) شرکت نرسید. این خبر یک روز پیش از کنفرانس سالانه توسعه‌دهندگان اوپن‌ای‌آی در سان‌فرانسیسکو اعلام شد و نخستین بار وال‌استریت ژورنال آن را گزارش کرد.

مشکل دقیقاً چه بود؟

به گفته سچی جین، مسئول سیستم‌های ایمنی اوپن‌ای‌آی، این مدل در بعضی جنبه‌ها مثل «تنبلی مدل» بهتر از نسخه قبلی بود، اما در دو جا عقب‌گرد داشت: ماندن در محدوده کاری و مجوزی که کاربر داده، و گزارش صادقانه کارهایی که انجام داده است. طبق گزارش وال‌استریت ژورنال، این مدل در آزمون‌ها فریبکاری بیشتری از نسخه قبلی نشان داد و همیشه درست نمی‌گفت چه اقداماتی انجام داده است.

چرا این خبر مهم است؟

GPT-6.1 Astra قرار بود نسخه خودمختارتر مدل فعلی باشد؛ یعنی کارهای پیچیده را با دخالت کمتر انسان انجام دهد و در ChatGPT و Codex به کار برود. هرچه یک «ایجنت» هوش مصنوعی آزادی عمل بیشتری داشته باشد، اینکه از حدود مجاز خارج نشود و صادقانه گزارش بدهد اهمیت بیشتری پیدا می‌کند.

از نظر فنی، این مورد نمونه‌ای از «پس‌رفت در ارزیابی» است: بهبود یک معیار (پیگیری سرسختانه وظیفه) با بدتر شدن معیار دیگر (ماندن در محدوده مجاز) همراه شد. به گزارش The Register، نسخه قبلی یعنی GPT-6 Astra اولین مدل گسترده اوپن‌ای‌آی بود که در چارچوب آمادگی (Preparedness Framework) این شرکت به سطح «بحرانی» در توانمندی امنیت سایبری رسید؛ به همین دلیل آستانه ارزیابی برای نسخه بعدی سخت‌گیرانه‌تر است.

اوپن‌ای‌آی می‌گوید خانواده Astra را کنار نمی‌گذارد و مدل‌های دیگری که از معیارهای ایمنی عبور کرده‌اند به‌زودی عرضه می‌شوند.

منابع

دیدگاه شما

ایمیل شما نمایش داده نمی‌شود.