اوپن‌ای‌آی و مایکروسافت می‌دانستند وب را به «حلقه مرگ» می‌برند
هوش مصنوعی جهان ترجمه‌شده مدل‌ها و چیپ‌ها

اوپن‌ای‌آی و مایکروسافت می‌دانستند وب را به «حلقه مرگ» می‌برند

۲۸ شهریور ۱۴۰۵ ⏱ ۴ دقیقه مطالعه 👁 ۰ بازدید ✍️ تحریریه رشدینو
✈️ اشتراک در تلگرام 💬 واتساپ 𝕏 توییتر
خلاصه خبر پاسخ سریع در یک نگاه

اسناد تازه‌افشاشده دادگاه در پرونده نیویورک‌تایمز علیه اوپن‌ای‌آی و مایکروسافت نشان می‌دهد خود این شرکت‌ها هشدار داده بودند که استراتژی محتوای هوش مصنوعی‌شان یک «حلقه مرگ» به راه انداخته که به وب آسیب می‌زند و آن را «بزرگ‌ترین سرقت نیروی کار تاریخ» خوانده بودند.

اسناد دادگاهی که به‌تازگی در پرونده نیویورک‌تایمز علیه اوپن‌ای‌آی و مایکروسافت از حالت محرمانه خارج شده‌اند، ویران‌کننده‌اند. مستندات خود این شرکت‌ها هشدار داده بودند که در حال آغاز یک «حلقه مرگ» (doom loop) هستند که به وب آسیب می‌زند، استخراج داده برای آموزش مدل‌ها را «بزرگ‌ترین سرقت نیروی کار در تاریخ بشر» توصیف کرده بودند و نوشته بودند این کار «تمسخر کامل ایده استفاده منصفانه» است.

بسیاری از تکان‌دهنده‌ترین نقل‌قول‌های این سند از برنت هکت، مدیر علوم کاربردی مایکروسافت، است؛ هرچند شرکت تلاش کرده از ادعاهای او فاصله بگیرد. الکس هاورک، سخنگوی مایکروسافت، به The Verge گفت: «این اظهارنظرها بازتاب دیدگاه شخصی یک کارمند است، تحلیل حقوقی نیست و دیدگاه‌های شرکت را نمایندگی نمی‌کند.» در پرونده‌ای جداگانه، جوردن اوسدان، مدیر کل استراتژی و عملیات داده در مایکروسافت AI، نقش هکت را تقابلی خواند و گفت او «دیدگاه‌های واگرا، دانشگاهی و آینده‌نگر درباره نحوه کار اکوسیستم‌های داده برای هوش مصنوعی دارد و در مایکروسافت استخدام شده تا دیدگاه‌های نامتقارن، آینده‌نگر و دانشگاهی بیاورد... و او کسی نیست که به‌طور خاص درباره دیدگاه‌های نظری‌اش درباره تأثیر بالقوه هوش مصنوعی بر تولیدکنندگان محتوا از مایکروسافت سخن بگوید.»

اما فارغ از اینکه مایکروسافت بخواهد این حرف‌ها را مال خود کند یا نه، روشن است که این پیش‌بینی محقق شده: «گوگل زیرو» واقعی است و هوش مصنوعی در حال خوردن وب است. در پرونده ۹۲ صفحه‌ای نیویورک‌تایمز اظهارات عجیب زیادی از چهره‌های مختلف از جمله ساتیا نادلا، سم آلتمن و دیگر کارکنان اوپن‌ای‌آی وجود دارد. مهم‌ترین‌ها:

«یک سرقت حیرت‌انگیز»

مقدمه سند، هکت و رئیس چت‌جی‌پی‌تی در اوپن‌ای‌آی (احتمالاً نیک ترلی) را طوری نقل می‌کند که نشان می‌دهد شرکت‌ها می‌دانستند یک «تهدید وجودی» برای ناشرانی مثل نیویورک‌تایمز هستند. هکت برداشت داده توسط چت‌جی‌پی‌تی و کوپایلوت را «بزرگ‌ترین سرقت نیروی کار در تاریخ بشر» می‌نامد و می‌گوید دفاع مایکروسافت «تمسخر کامل ایده استفاده منصفانه» است.

یک «حلقه مرگ»

ساتیا نادلا اعتراف می‌کند چت‌بات‌ها عملاً جای جست‌وجو را گرفته و نیاز به رفتن مستقیم به سراغ منبع اطلاعات را حذف کرده‌اند. اما محکم‌تر از آن، یک سند داخلی مایکروسافت است: «استراتژی محتوای هوش مصنوعی ما یک “حلقه مرگ” به راه انداخته که هم‌زمان به عملکرد مدل‌هایمان و کل وب آسیب می‌زند: بسیار غیرعادی است که یک محصول نهایی پایه‌های اقتصادی تأمین‌کنندگان حیاتی خود را تهدید کند، اما این وضعیتی است که ما برای کسب‌وکار مدل زبانی بزرگ خود نسبت به “زنجیره تأمین محتوا” ساخته‌ایم.»

«این حتی یک عدد واقعی هم نیست»

فریب ادعای نیت خیرخواهانه اوپن‌ای‌آی یا مایکروسافت را نخورید. گرگ براکمن، هم‌بنیان‌گذار اوپن‌ای‌آی، بیشتر به «گزیلین‌ها»ی دلاری علاقه دارد که ممکن است از هوش مصنوعی تجاری به دست آورد.

«پی‌وال شم‌وال»

با اینکه نادلا بعدها گفته «هر محتوایی که پشت پی‌وال است باید لایسنس شود»، یکی از نمایندگان اوپن‌ای‌آی اعتراف کرد از هیچ تلاشی برای شناسایی یا حذف محتوای پی‌وال از داده آموزش «بی‌خبر» است.

«به‌شکل دیوانه‌واری در بازتولید خوب»

در داخل، به‌نظر می‌رسد اوپن‌ای‌آی خوب می‌دانست چت‌جی‌پی‌تی تمایل دارد مطالب دارای حق نشر را «کلمه‌به‌کلمه» بازتولید کند. با اینکه می‌دانستند «جلوگیری از حفظ‌شدن (memorization)» برای «کمینه‌کردن نقض حق نشر» مهم است، کارکنان اعتراف کردند GPT-4 «حجم عظیمی داده را حفظ کرده و بنابراین به‌شکل دیوانه‌واری در بازتولید خوب خواهد بود». این پرونده سپس نمونه‌های متعددی نقل می‌کند که چت‌جی‌پی‌تی در پاسخ به پرسش‌ها رشته‌های بلندی از متن را مستقیم از مقالات نیویورک‌تایمز، مرکوری نیوز، دنور پست، لایف‌هکر و یوروگیمر بیرون داده است.

«همه کارشان را جارو کردن»

مایکروسافت می‌دانست استخراج یک‌جای اینترنت چطور دیده می‌شود و اعتراف کرد «تقریباً هیچ‌کس قصد نداشت محتوایی که تولید می‌کند به این شکل استفاده شود و بابت آن هم غرامت نمی‌گیرد».

«جایگزینی برای نیروی کار آدم‌ها»

جک کلارک، مدیر سیاست‌گذاری اوپن‌ای‌آی، خط را روی دیوار می‌دید و گفت این شرکت «سیستم‌هایی می‌سازد که جایگزین کار آدم‌هایی می‌شوند که “فرهنگ” جامعه را تعریف می‌کنند». اسناد داخلی چت‌جی‌پی‌تی را «کیوسک روزنامه‌های امروزی» توصیف کرده‌اند. نیک ترلی، از اوپن‌ای‌آی، بعدها گفته وقتی پاسخ را از چت‌بات می‌گیرید، «دلیل خوبی برای کلیک کردن» روی لینک منبع وجود ندارد.

نابود کردن زنجیره تأمین خودشان

مایکروسافت اعتراف کرده «مدل‌های زبانی بزرگ محصولی هستند که زنجیره تأمین خودشان را نابود می‌کنند»، چون در بسیاری موارد جایگزین داده آموزشی خودشان هستند.

اوپن‌ای‌آی می‌داند ترافیک ارجاعی را می‌کشد

کارشناسان رسانه و اقتصاد خود اوپن‌ای‌آی، افت ترافیک ارجاعی سایت‌هایی مثل نیویورک‌تایمز را مستقیم به خلاصه‌های هوش مصنوعی مثل AI Overviews گوگل نسبت داده‌اند و گمانه زده‌اند ارجاع‌های جست‌وجو ممکن است تا ۶۰ درصد کاهش یافته باشد.

سخنگوی مایکروسافت هشدار داد که «شهادت ساتیا و موضع مایکروسافت در این پرونده کاملاً سازگارند. او درباره اصول کلی و تغییرات در حال وقوع در نحوه یافتن و مصرف اطلاعات صحبت کرد. این مشاهدات را نباید با نتیجه‌گیری درباره پرسش‌های حق نشر پیش روی دادگاه اشتباه گرفت.»

اما بر اساس این سند تازه‌افشاشده، روشن است که هم مایکروسافت و هم اوپن‌ای‌آی می‌دانستند صنعت نشر و «میلیون‌ها نفر» شاغل در آن را جبران‌ناپذیر آسیب می‌زنند و در نهایت به محصول خودشان هم صدمه می‌زنند، اما با این حال در تعقیب «گزیلین‌ها»ی دلار پیش رفتند؛ حلقه مرگ هرچه بادا باد.

منبع: theverge.com ←
# مدل‌ها و چیپ‌ها
🔗 اخبار مرتبط

بخوانید