بر اساس گزارش تحقیقی 404 Media، OpenAI صدها کارگر قراردادی را استخدام کرده که مکالمات واقعی کاربران ChatGPT را میخوانند تا پاسخهای چتبات را بهبود ببخشند. این رسانه به اسناد داخلی درزکرده دست یافته و با منابع دیگری هم گفتگو کرده است.
این مرورگرها پاسخهای ChatGPT را در مقیاسی از یک تا هفت امتیازدهی میکنند و وظیفه دارند رفتارهای تملقآمیز و انساننمای بیش از حد مدل را کاهش دهند. یکی از مرورگرها به 404 Media گفت فکر نمیکند کاربران بدانند انسانهایی در حال خواندن گفتگوهایشان هستند. محتوای بررسیشده هم این را تأیید میکند: برخی گفتگوها شامل کاربرانی بود که صراحتاً از ChatGPT خواسته بودند محتوای گفتگو خصوصی بماند. پرامپتها ناشناسسازی میشوند اما همچنان ممکن است حاوی دادههای شخصی حساس باشند. OpenAI از فیلتر حریم خصوصی استفاده میکند اما خودش اعتراف کرده که ممکن است اشتباه کند.
به گزارش 404 Media، این کارگران قراردادی از طریق شرکت Crossing Hurdles (با شعار «اتصال متخصصان ماهر به آینده کار هوش مصنوعی») جذب و توسط شرکت آموزش هوش مصنوعی Mercor حقوق میگیرند. یکی از مرورگرهای مستقر در آمریکای شمالی گفته بیش از ۵۰ دلار در ساعت درآمد دارد.
کاربران میتوانند تنظیم «بهبود مدل برای همه» (Improve the model for everyone) را خاموش کنند — تنظیمی که بهطور پیشفرض روشن است — تا گفتگوهایشان برای آموزش مدل استفاده نشود و در نتیجه به دست انسانها نیفتد. این تنظیم فقط روی گفتگوهای جدید اثر میگذارد. OpenAI حالت چت موقت (Temporary Chat) را هم ارائه میدهد که طبق ادعای شرکت، داده ورودی آن برای آموزش مدل استفاده نمیشود.
وقتی 404 Media پرسید کجا به کاربران بهصراحت درباره بازبینی انسانی گفته میشود، OpenAI ابتدا پاسخی نداد. در صفحه سؤالات متداول، این شرکت توضیح میدهد که پرسنل مجاز و ارائهدهندگان خدمات ممکن است برای بهبود عملکرد مدل داده کاربران را ببینند و به کاربران توصیه میکند اطلاعات حساس وارد نکنند. این اطلاعیه دستکم از سال ۲۰۲۳ آنلاین بوده و در طول سالها فقط کمی تغییر کرده است.
404 Media استدلال میکند این افشاگری آنقدر پنهان و مبهم است که نمیتواند کاربران را از میزان واقعی بازبینی انسانی آگاه کند. عبارت «بهبود مدل برای همه» بیشتر شبیه یک مشارکت دوستانه اجتماعی خوانده میشود تا رضایت برای خواندن گفتگوهای شما توسط انسان. اما این چهارچوببندی مبهم احتمالاً عمدی است؛ اگر OpenAI رضایت صریح میخواست، احتمالاً نرخ انصراف بسیار بالا میشد.
با این حال، برای آزمایشگاههای هوش مصنوعی این نوع بازخورد انسانی بخش کلیدی بهبود مدلهاست و این رویه گسترده است. آنتروپیک به 404 Media تأیید کرد که از مرورگرهای انسانی برای بررسی پاسخهای کلود و بهبود مدلهای آینده استفاده میکند؛ این کار شامل کاربرانی میشود که گزینه «کمک به بهبود مدلهای هوش مصنوعی ما» را در تنظیمات حریم خصوصی روشن کردهاند. آنتروپیک هم گفتگوها را پیش از بازبینی انسانی ناشناس میکند و جزئیات حساب مثل آدرس ایمیل را حذف میکند. گوگل هم مرورگرهای انسانی به کار میگیرد و در جمنای ذکر کرده که انسانها ممکن است چتهای ذخیرهشده را بررسی کنند.