با داغ شدن مناقشات جهانی پیرامون امکان خودکارسازی کامل پژوهشهای هوش مصنوعی و خود-بهبودبخشی بازگشتی مدلها (Recursive Self-Improvement)، یک تیم پژوهشی از دانشگاه فودان چین با انتشار مقالهای جامع، نتایج ارزیابی تجربی تعامل میان متخصصان انسانی و ایجنتهای هوش مصنوعی را منتشر کرده است. این پژوهش بر اساس تحلیل بیش از ۷۰۰ لاگ کاری از ۵۶ مهندس و دانشمند داده در فرایند توسعه مدل پیشرفته Atria Dawn Preview با ۷۴۴ میلیارد پارامتر انجام شده است.
نتایج این تحلیل میدانی، دیدگاههای رایج درباره استقلال کامل ایجنتها را با چالشهای اساسی روبهرو ساخته و نکات تحلیلی مهمی را آشکار کرده است:
۱. تسهیل وظایف فراتر از توان انسانی، نه حذف نیروی متخصص: هوش مصنوعی در ۹۶.۵ درصد از کل وظایف پروژه مشارکت فعال داشته است. در طول چهار هفته، نسبت گامهای اجرایی ایجنت به دستورات انسانی از ۱۱ به ۲۸.۵ برابر افزایش یافت. با این حال، محققان تاکید میکنند که این رشد به معنای استقلال تصمیمگیری نیست؛ بلکه نشاندهنده عمق مراحل اجرایی بر اساس هر ورودی انسانی است. حدود یکسوم از کل تسکهای تکمیلشده (۱۵۱ تسک از ۴۵۵ مورد)، کارهایی بودند که پژوهشگران انجام آنها را بدون کمک هوش مصنوعی از نظر محدودیت زمانی و مهندسی اساساً غیرممکن ارزیابی کرده بودند.
۲. الگوی غالب: پیشنهاد از هوش مصنوعی، تصمیمگیری نهایی با انسان: در فرایند تعیین معماری مدل و تنظیم هایپرپارامترها، متداولترین شیوه کاری (۵۵.۴ درصد موارد) بر پایه پیشنهاد گزینهها از سوی مدل و انتخاب نهایی توسط انسان شکل گرفت. در مجموع، انسانها ۸۵.۵ درصد از تصمیمات متدولوژی و پارامتری را شخصاً اتخاذ کردند و در ۹۳.۴ درصد مواقع، تعیین اهداف و دامنه پروژه کاملاً در اختیار انسان بود. سهم ایجنتها در اتخاذ تصمیمات سرنوشتساز در تمام مراحل پروژهها تکرقمی باقی ماند.
۳. انسان در جایگاه ارائهدهنده زمینه (Context) و تفکر انتقادی: در مواجهه با خطاها و بنبستهای کدنویسی، در ۷۶ درصد مواقع مداخله انسانی مسیر را باز کرد. این مداخله عمدتاً شامل تزریق اطلاعات تکمیلی و شفافسازی خواستهها (۳۵.۲ درصد) یا تشخیص ریشه مشکل و تغییر مسیر راهبردی (۳۴.۷ درصد) بود و انسانها به ندرت (تنها در ۳.۲ درصد مواقع) اقدام به ویرایش مستقیم کدها کردند. در واقع پس از دریافت بازخورد انسانی، هوش مصنوعی در ۷۵.۴ درصد مواقع اصلاحات کدی را خودکار انجام داد.
پژوهشگران در پایان هشدار میدهند که خطر اصلی در استقرار ایجنتها، تبدیل شدن انسان به یک تاییدکننده صوری (Rubber-Stamping) در برابر زنجیرههای پیچیدهای از خروجیهای ماشینی است. با این حال، شواهد نشان میدهد تفکر مفهومی، ارزیابی کیفی و قضاوت راهبردی انسان همچنان هسته اصلی و غیرقابلجایگزین توسعه فناوری به شمار میرود.