تحقیقات جدید 404 Media درباره پروژهای موسوم به Project Lily نشان میدهد صدها نیروی قراردادی برای ارزیابی پاسخهای ChatGPT به بخشی از مکالمات واقعی کاربران دسترسی دارند؛ مکالماتی که ممکن است حاوی اطلاعات شخصی و حساس باشند. OpenAI نیز در اسناد رسمی خود تأیید میکند که تعداد محدودی از کارکنان مجاز و ارائهدهندگان خدمات مورداعتماد میتوانند در شرایط مشخص، ازجمله برای بهبود عملکرد مدل، به محتوای کاربران دسترسی داشته باشند؛ مگر اینکه کاربر از مشارکت در بهبود مدل انصراف داده باشد.
🔷 تحقیقات 404 Media میگوید صدها پیمانکار در پروژهای موسوم به Project Lily بخشی از مکالمات واقعی ChatGPT را برای ارزیابی و بهبود پاسخهای مدل بررسی میکنند.
🔷 این مکالمات بدون نام کاربری در اختیار ارزیابان قرار میگیرند، اما طبق گزارش ممکن است همچنان شامل اطلاعات شخصی و حساس باشند.
🔷 اسناد رسمی OpenAI نیز امکان دسترسی محدود کارکنان مجاز و ارائهدهندگان خدمات مورداعتماد به محتوا برای بهبود مدل را تأیید میکنند.
🔷 کاربران شخصی میتوانند گزینه Improve the model for everyone را غیرفعال کنند تا مکالمات جدیدشان برای بهبود مدلها استفاده نشود.
🔷 قابلیت Temporary Chat نیز تا زمانی که موقت باقی بماند برای بهبود مدلها استفاده نمیشود.
گزارش 404 Media که در ۱۴ سپتامبر ۲۰۲۶ منتشر شده، براساس اسناد داخلی، دستورالعملهای کاری، کانالهای Slack و نمونههایی از پرامپتهای واقعی کاربران تهیه شده است. این رسانه میگوید صدها پیمانکار برای بررسی حجم زیادی از پرامپتهای واقعی کاربران به کار گرفته شدهاند.
طبق این گزارش، فرایند ارزیابی شامل خواندن درخواست واقعی کاربر، خلاصهکردن آنچه ارزیاب تصور میکند کاربر از ChatGPT میخواهد و سپس امتیازدهی و نقد پاسخهای تولیدشده توسط مدل است. یکی از اهداف این ارزیابیها، کاهش رفتارهای بیشازحد انسانگونه و چاپلوسانه در پاسخهای ChatGPT عنوان شده است.
براساس تحقیقات 404 Media، داشبورد مورد استفاده ارزیابان نام کاربری صاحب مکالمه را نمایش نمیدهد. بااینحال، محتوای خود گفتوگو ممکن است شامل جزئیات حساس و شخصی باشد. OpenAI نیز در راهنمای رسمی خود توصیه میکند کاربران اطلاعات حساسی را که نمیخواهند مورد بررسی یا استفاده قرار گیرد، وارد سرویس نکنند.
404 Media میگوید حتی نمونههایی را مشاهده کرده که در آنها کاربران صراحتاً از ChatGPT خواسته بودند محتوای مکالمه را خصوصی نگه دارد؛ موضوعی که از دید این رسانه نشان میدهد برخی کاربران احتمال بررسی انسانی مکالمات را در نظر نداشتهاند.
در بخش پرسشهای متداول مربوط به استفاده از دادهها، OpenAI توضیح میدهد که تعداد محدودی از کارکنان مجاز این شرکت و ارائهدهندگان خدمات مورداعتماد که مشمول تعهدات امنیتی و محرمانگی هستند، در شرایط مشخص میتوانند به محتوای کاربران دسترسی داشته باشند.
دلایل اعلامشده شامل بررسی سوءاستفاده یا رخداد امنیتی، ارائه پشتیبانی و رفع مشکلات محصول، رسیدگی به مسائل حقوقی و بهبود عملکرد مدل است. در مورد استفاده برای بهبود عملکرد مدل، این دسترسی در صورتی مطرح میشود که کاربر از آن انصراف نداده باشد. OpenAI همچنین میگوید دسترسیها تحت کنترلهای فنی، برمبنای نیاز و برای افراد مجاز انجام میشوند و دسترسی به محتوای کاربران ثبت و نظارت میشود.
کاربران سرویسهای شخصی ChatGPT میتوانند از بخش Settings > Data Controls گزینه Improve the model for everyone را غیرفعال کنند. OpenAI میگوید پس از انصراف، مکالمات جدید کاربر برای بهبود و آموزش مدلهای این شرکت استفاده نخواهند شد. این تنظیم در سطح حساب اعمال میشود و میان دستگاهها همگام است.
خاموشکردن این گزینه به معنی حذف تاریخچه مکالمات نیست و کاربران میتوانند تاریخچه خود را حفظ کنند، درحالیکه استفاده از مکالمات جدید برای بهبود مدل را متوقف کردهاند.
راه دیگر، استفاده از Temporary Chat است. طبق مستندات OpenAI، تا زمانی که یک گفتوگوی موقت در همین وضعیت باقی بماند، برای بهبود مدلها استفاده نمیشود. اگر کاربر بعداً آن را ذخیره کند، مکالمه به یک چت عادی تبدیل میشود و از آن مرحله تنظیمات سطح حساب برای بهبود مدل روی آن اعمال خواهد شد.
OpenAI همچنین اعلام کرده است که ممکن است نسخهای از Temporary Chat را برای برخی اهداف ایمنی تا ۳۰ روز نگه دارد.
بخش دیگری از گزارش به نحوه اطلاعرسانی OpenAI اختصاص دارد. 404 Media استدلال میکند که توضیح مربوط به دسترسی انسانی در صفحات FAQ به اندازه کافی برجسته نیست و ممکن است کاربران از گستره این فرایند آگاه نباشند. این ارزیابی، دیدگاه 404 Media درباره شیوه اطلاعرسانی شرکت است.
در مقابل، اسناد رسمی OpenAI صراحتاً میگویند کارکنان مجاز و ارائهدهندگان خدمات مورداعتماد ممکن است برای اهداف مشخص به محتوای کاربران دسترسی داشته باشند و به کاربران توصیه میکنند اطلاعات حساسی را که نمیخواهند بررسی یا استفاده شود، وارد نکنند.
براساس گزارش 404 Media، استفاده از ارزیاب انسانی به OpenAI محدود نمیشود. Anthropic نیز به این رسانه تأیید کرده که از بررسی انسانی برای بهبود پاسخهای Claude و مدلهای آینده استفاده میکند؛ این موضوع برای کاربرانی اعمال میشود که گزینه Help improve our AI models را در تنظیمات حریم خصوصی فعال کردهاند. Anthropic همچنین گفته است پیش از بررسی انسانی، شناسههای حساب مانند آدرس ایمیل را از مکالمات حذف میکند.
در همین گزارش به گوگل نیز اشاره شده است؛ Gemini به کاربران اطلاع میدهد که برخی گفتوگوهای ذخیرهشده ممکن است توسط انسانها برای بهبود هوش مصنوعی گوگل بررسی شوند.
گزارش Project Lily جزئیات تازهای درباره نقش ارزیابان انسانی در بهبود ChatGPT ارائه میکند. در کنار یافتههای 404 Media، مستندات رسمی OpenAI نیز دسترسی محدود افراد مجاز و ارائهدهندگان خدمات به محتوای کاربران را تحت شرایط مشخص تأیید میکنند. کاربران سرویس شخصی ChatGPT که نمیخواهند مکالمات جدیدشان برای بهبود مدل استفاده شود، میتوانند گزینه Improve the model for everyone را غیرفعال کنند یا برای مکالمات موردنظر از Temporary Chat استفاده کنند.
به نظر شما سرویسهای هوش مصنوعی باید امکان بررسی انسانی مکالمات برای بهبود مدل را هنگام شروع استفاده، واضحتر و برجستهتر به کاربران توضیح دهند؟