طبق گزارشی تازه، OpenAI برنامه خود برای عرضه مدل هوش مصنوعی جدید خود با نام GPT-6.1 Astra طی هفتههای آینده را کنار گذاشته است. این مدل قرار بود نسخه توانمندتری از GPT-6 Astra باشد، اما نتایج ارزیابیهای داخلی از مشکلاتی در پیروی از دستورهای کاربر، رفتار فریبکارانه و انجام اقداماتی فراتر از محدوده تعیینشده حکایت داشتهاند.
🔹 شرکت OpenAI برنامه عرضه GPT-6.1 Astra در ماه آینده میلادی را متوقف کرده است.
🔹 مدل جدید در آزمایشهای همراستایی عملکرد ضعیفتری نشان داده و در پیروی دقیق از دستورات کاربر دچار پسرفت شده است.
🔹 ارزیابیها همچنین از افزایش رفتار فریبکارانه و ارائه اطلاعات نادرست درباره اقداماتی که مدل انجام داده یا نداده خبر میدهند.
🔹 مدل GPT-6.1 Astra در برخی موارد بدون اجازه کاربر از محدوده وظیفه فراتر میرفت و با ابزارها یا سرویسهای خارجی تعامل میکرد.
🔹 این مدل قرار بود در ChatGPT و Codex عرضه شود، اما OpenAI اکنون تمرکز خود را به بهبود ایمنی مدلهای آینده معطوف کرده است.
طبق گزارش والاستریتژورنال، OpenAI قصد داشت GPT-6.1 Astra را طی روزها یا هفتههای آینده و در ماه اکتبر بهعنوان مدل مهم بعدی خود منتشر کند. مدل GPT-6 Astra پیشتر در ۳ سپتامبر ۲۰۲۶ (۱۲ شهریور ۱۴۰۵) عرضه شده بود.
نسخه GPT-6.1 Astra در مقایسه با GPT-6 برای انجام وظایف دشوار بهصورت سرتاسری و بدون کمک انسان توانمندتر توصیف شده و قابلیتهای نوشتاری آن نیز بهبود یافته بود.
بااینحال، نتایج آزمایشهای ایمنی باعث شدهاند OpenAI برنامه انتشار این مدل را کنار بگذارد.
گزارش منتشرشده به مصاحبهای با ساچی جین، مدیر سیستمهای ایمنی OpenAI استناد میکند که دو حوزه مشخص از پسرفت مدل را تأیید کرده است.
نخستین مشکل به عملکرد ضعیفتر در آزمونهای همراستایی مربوط میشود؛ آزمونهایی که میزان پایبندی مدل به فرمانها و پرامپتهای ارائهشده توسط کاربر را ارزیابی میکنند.
این مسئله برای مدلی که قرار است وظایف پیچیده را با استقلال بیشتری انجام دهد اهمیت زیادی دارد، زیرا افزایش توانایی بدون پیروی دقیق از محدوده تعیینشده توسط کاربر میتواند به رفتارهای ناخواسته منجر شود.
دومین مشکل گزارششده، افزایش سطح رفتار فریبکارانه در GPT-6.1 Astra بوده است. طبق گزارش، مدل همیشه درباره اقداماتی که پس از دریافت یک دستور انجام داده یا انجام نداده، اطلاعات صحیح ارائه نمیکرد.
به بیان دیگر، در برخی آزمایشها مدل میتوانست درباره اجرای یک اقدام یا خودداری از انجام آن، گزارشی ارائه دهد که با عملکرد واقعی آن مطابقت نداشت.
یکی دیگر از رفتارهای مشکلساز GPT-6.1 Astra به عبور از محدوده وظیفه تعیینشده مربوط میشود. طبق اطلاعات گزارش، مدل در برخی موارد یک وظیفه را فراتر از محدوده فعلی ادامه میداد، بدون آنکه کاربر برای این اقدامات مجوز داده باشد.
این رفتار میتوانست شامل تعامل با ابزارها یا سرویسهای خارجی بدون اجازه کاربر نیز باشد؛ موضوعی که در مدلهای عاملمحور با توانایی انجام مستقل وظایف اهمیت بیشتری پیدا میکند.
برنامه اولیه OpenAI این بود که GPT-6.1 Astra را در هر دو محصول ChatGPT و Codex در دسترس قرار دهد.
عرضه مدل قرار بود در ماه اکتبر و احتمالاً در فاصله کوتاهی پس از کنفرانس سالانه توسعهدهندگان OpenAI انجام شود. رویداد DevDay طبق گزارش منبع در روز بعد برگزار خواهد شد و احتمال داشت شرکت در جریان آن به مدل جدید اشاره کند.
با کنار گذاشته شدن برنامه انتشار GPT-6.1 Astra، OpenAI اکنون قصد دارد تمرکز خود را به بهبود ایمنی مدلهای آینده منتقل کند.
این تصمیم در شرایطی گزارش شده که OpenAI و Anthropic پس از رخدادهای اخیر مرتبط با مدلهای GPT و Claude خواستار کاهش سرعت توسعه مدلهای بزرگ هوش مصنوعی شدهاند.
طبق گزارش منبع، مدل Gemini گوگل نیز در جریان یک آزمایش امنیت سایبری موفق به نفوذ به سه شرکت شده بود، اما اقدامات خود را سریعتر از مدلهای رقیب متوقف کرد.
مجموع این اتفاقات بار دیگر مسئله کنترل رفتار مدلهای هوش مصنوعی را در شرایطی برجسته میکند که این سیستمها توانایی بیشتری برای استفاده از ابزارها و انجام مستقل وظایف پیدا میکنند.
🔴 همچنین بخوانید: مدلهای هوش مصنوعی GPT-6 Sol و GPT-6 Luna معرفی شدند؛ سریعتر و ۵۰ درصد ارزانتر از نسل قبل
GPT-6.1 Astra قرار بود با توانایی بیشتر در انجام مستقل وظایف پیچیده و قابلیتهای نوشتاری بهبودیافته عرضه شود، اما مشکلات مشاهدهشده در همراستایی، رفتار فریبکارانه و عبور از محدوده مجاز وظایف باعث توقف برنامه انتشار آن شده است. بر اساس گزارش فعلی، OpenAI بهجای عرضه این نسخه، تمرکز خود را بر افزایش ایمنی مدلهای آینده قرار خواهد داد.
به نظر شما با افزایش توانایی مدلهای هوش مصنوعی برای انجام مستقل وظایف، کنترل دقیق محدوده اختیارات آنها باید چه جایگاهی در توسعه نسلهای آینده داشته باشد؟