اوپنایآی روز دوشنبه در یک پست وبلاگی اعلام کرد بهمنظور انطباق با قانون هوش مصنوعی اتحادیه اروپا (EU AI Act)، یک واترمارک نامرئی به متنهای تولیدشده توسط ChatGPT و Codex در اتحادیه اروپا اضافه خواهد کرد. قوانین شفافیت قانون هوش مصنوعی اتحادیه اروپا که از ۲ اوت لازمالاجرا شده، شرکتهای هوش مصنوعی را ملزم میکند محتوای تولیدشده توسط هوش مصنوعی را به گونهای علامتگذاری کنند که سایر سیستمها بتوانند آن را شناسایی کنند.
اوپنایآی گفت این واترمارک طی هفتههای آینده برای کاربران واجد شرایط ChatGPT و Codex در تمام پلنها عرضه میشود، اما فقط در اتحادیه اروپا. توسعهدهندگانی که از API اوپنایآی در هر نقطه از جهان استفاده میکنند، میتوانند از امروز این ویژگی را برای مدلهای منتخب فعال کنند؛ اما بهصورت پیشفرض خاموش است. اوپنایآی تأکید کرد واترمارکگذاری متن را در زمان عرضه بهعنوان گزینه پیشفرض جهانی در نظر نمیگیرد.
واترمارک یک نماد واقعی نیست، بلکه با شکلدهی ظریف به انتخاب کلمات مدل کار میکند و الگویی برجای میگذارد که خواننده آن را نمیبیند اما یک ابزار شناسایی میتواند تشخیص دهد. از آنجا که این الگو در خود واژهها زندگی میکند، با کپی و جایگذاری متن همراه میشود و به آن میچسبد. اوپنایآی گفت واترمارک کاربر را شناسایی نمیکند و با روشن بودن آن تغییری معنادار در عملکرد مدلهایش مشاهده نکرده است.
اوپنایآی همزمان با این اعلامیه، گزارش فنی روش خود را با نام textGrain منتشر کرد. این گزارش که با همکاری پژوهشگران دانشگاه پنسیلوانیا و دانشگاه ییل نوشته شده، مثالی از استفاده از یک کلید مخفی برای مرتبسازی پیشبینیهای کلمه بعدی بهمنظور تکمیل جمله را شرح میدهد. با اضافه شدن صدها مورد از این انحرافهای ظریف، ابزار شناسایی میتواند محتوای تولیدشده توسط هوش مصنوعی را تنها با استفاده از متن و کلید تشخیص دهد.
آیا واترمارک با ویرایش قابل حذف است؟ آزمایشهای اوپنایآی نشان میدهد بله. در یک آزمایش، جایگزینی ۱۰ درصد از کلمات با مترادفها، نرخ تشخیص را از حدود ۹۲ درصد به ۶۶ درصد کاهش داد. این شرکت همچنین گفت شناسایی متنهای کوتاه، پاسخهای ریاضی و متنهای ترجمهشده دشوارتر است.
اوپنایآی درباره این محدودیتها گفت: «این محدودیتها در تصمیم ما برای ارائه دسترسی اولیه به ابزار شناسایی فقط به پژوهشگران تأییدشده و سازمانهای متخصص نقش داشتند؛ افرادی که میتوانند به ما در ارزیابی قابلیت اطمینان و کاربردهای مسئولانه کمک کنند.» این شرکت همچنین هشدار داد که نبود واترمارک «اثبات نمیکند متن توسط انسان نوشته شده است»؛ چراکه متن ممکن است خیلی کوتاه باشد، بیش از حد ویرایش شده باشد یا از هوش مصنوعی شرکت دیگری آمده باشد. اوپنایآی افزود: «واترمارکها میتوانند نشان دهند که یک سیستم اوپنایآی بخشی از متن را تولید یا پردازش کرده، اما نه اینکه چقدر قضاوت، ویرایش یا خلاقیت انسانی در آن دخیل بوده است.»
این اعلامیه دو ماه پس از آن منتشر میشود که آنتروپیک اعلام کرد متنهای تولیدی Claude را واترمارک میکند؛ اقدامی که در سراسر جهان اعمال میشود و واکنش منفی برخی کاربران Claude را برانگیخت؛ کاربرانی که استدلال میکردند «دستورالعملها، زمینه و تصمیمها» را آنها فراهم کردهاند و Claude فقط «ابزار» بوده است.
اوپنایآی در گذشته نیز یک واترمارک متنی ساخته بود اما از انتشار آن خودداری کرده بود؛ تا حدی به دلیل نگرانی از اینکه کاربران به سمت رقبایی که واترمارک ندارند مهاجرت کنند؛ موضوعی که والاستریت ژورنال در سال ۲۰۲۴ گزارش کرده بود. آنتروپیک، گوگل، متا، مایکروسافت و اوپنایآی از جمله شرکتهایی هستند که متعهد به پیروی از کد رفتار اتحادیه اروپا در مورد محتوای تولیدشده توسط هوش مصنوعی شدهاند.