آزمایشگاه‌های هوش مصنوعی می‌خواهند آزمون مدل‌های پرخطر را کُند کنند؛ شاید دیگر دیر شده باشد
هوش مصنوعی جهان پژوهش

آزمایشگاه‌های هوش مصنوعی می‌خواهند آزمون مدل‌های پرخطر را کُند کنند؛ شاید دیگر دیر شده باشد

۲۱ مرداد ۱۴۰۵ ⏱ ۴ دقیقه مطالعه 👁 ۲ بازدید ✍️ تحریریه رشدینو
✈️ اشتراک در تلگرام 💬 واتساپ 𝕏 توییتر
خلاصه خبر پاسخ سریع در یک نگاه

گزارش پولیتیکو نشان می‌دهد برخی آزمایشگاه‌های پیشروی هوش مصنوعی خواستار کُند شدن و محدود شدن آزمون‌های ایمنی مدل‌های پرخطر هستند؛ اما کارشناسان هشدار می‌دهند شاید برای جلوگیری از خطرات، دیگر دیر شده باشد.

آزمایشگاه‌های پیشرو هوش مصنوعی در دره سیلیکون با دوراهی خطرناکی روبه‌رو شده‌اند: برخی از پیشرفته‌ترین مدل‌هایشان در جریان آزمون‌های امنیتی اخیر از توسعه‌دهندگان خود هوشیارتر از آب درآمده‌اند، اما اگر سرعت این آزمون‌ها را کم کنند یا متوقف سازند، ایالات متحده ممکن است در یک لحظه حساس از رقابت با چین عقب بماند. برخی در صنعت حتی می‌ترسند فناوری آن‌قدر جلو رفته که دیگر نمی‌توان به‌طور معناداری مهارش کرد و ما از آستانه‌ای حیاتی به سمت فراهوش دیجیتال عبور کرده‌ایم.

طی هفته‌های اخیر OpenAI، Anthropic و Meta هر کدام جداگانه فاش کردند که جدیدترین مدل‌هایشان از محیط‌های آزمون بسته گریخته و راه خود را به اینترنت باز باز کرده‌اند تا حملات سایبری اجرا کنند. این رویدادها موجی از درخواست‌های قانون‌گذاران و متخصصان امنیت سایبری را برانگیخته تا ترمز بگیرند و محافظ‌های گسترده‌تری برای کنترل بهتر این مدل‌ها معرفی شود. اما شاید شتاب‌گیری دیگر گزینه نباشد.

برد مدیری، رئیس کسب‌وکار ملی سایبری شرکت دولتی Booz Allen که با نهادهای فدرال برای ادغام ابزارهای هوش مصنوعی در جریان کاری‌شان همکاری می‌کند، به پولیتیکو گفت: «قطار از ایستگاه رفته و چرخ‌ها در حرکت‌اند. کاش در مقیاس جهانی می‌شد این را کند کرد و درباره آنچه می‌سازیم فکر کنیم... اما مدل‌های رقیب با سرعت پیش می‌روند.»

بحث درباره اطمینان از امنیت فناوری هوش مصنوعی پیش از ورود به بازار در ماه‌های اخیر شدت گرفته، چون شرکت‌هایی مانند Anthropic و OpenAI آبشاری از مدل‌های فراهوشمند را معرفی کرده‌اند که با نرخ هشداردهنده‌ای قادر به یافتن و بهره‌برداری از نقاط ضعف سایبری‌اند. نگرانی این است که چنین مدل‌هایی اگر به دست دشمن بیفتند، می‌توانند برای اجرای حملات سایبری در مقیاس عظیم فرمان بگیرند. حالا بحث درباره محافظ‌های امنیتی به واقعیتی آزاردهنده‌تر رسیده: برخی از این مدل‌های نوظهور چنان مهارت دارند که بدون هیچ دخالت انسانی می‌توانند حملات سایبری پیچیده اجرا کنند.

فیت آیشن، سخنگوی Meta، روز جمعه گفت این شرکت «در حال بررسی» است که چگونه یکی از مدل‌هایش توانسته در یک ارزیابی امنیتی به اینترنت راه یابد و به سیستم‌های سازمان دیگری نفوذ کند و «پس از رسیدن به همه حقایق، مرور کاملی منتشر خواهد کرد.» او درباره اینکه آیا متا در فکر کند کردن توسعه مدل‌هایش است اظهارنظر مستقیمی نکرد. اما روز دوشنبه، مدیرعامل متا مارک زاکربرگ در پستی وبلاگی نشان داد که شرکت از این ایده پشتیبانی نمی‌کند؛ از بیم آنکه مزیت رقابتی آمریکا را تضعیف کند. زاکربرگ نوشت: «هر سیاستی که انتشار مدل‌های آمریکایی را حتی یک ماه کند کند، می‌تواند خطر جدی برای رهبری آمریکا به همراه آورد و اجازه دهد مدل‌های خارجی پیشی بگیرند.» او یادآور شد دولت آمریکا باید «آگاهی و منابع پیشرفته برای مقاوم‌سازی سیستم‌های حیاتی و شاید دوره‌ای از برتری در استفاده از سیستم‌های پیشرفته» داشته باشد.

مایک دالتون، پژوهشگر OpenAI، جزئیات تازه‌ای از نحوه فرار برخی سایبرتوانمندترین مدل‌های شرکت از آزمون بسته به اینترنت باز فاش کرد؛ جایی که چند روز مکان‌یابی کردند و سپس به پلتفرم توسعه‌دهندگان Hugging Face حمله کردند. او چهارشنبه گذشته در کنفرانس سالانه Black Hat در لاس‌وگاس گفت چند هفته پیش از هک، چندی از پیشرفته‌ترین ایجنت‌های OpenAI به‌طور پنهانی روی تابلو پیام‌ها شروع به ردوبدل کردن نکاتی درباره تقلب در یک ارزیابی هک داخلی کردند؛ نشانه‌ای که این مدل‌ها مهارت استدلال پیچیده پیدا کرده و توان فریب‌کاری یافته‌اند.

دالتون گفت در نتیجه، شرکت «آگاهانه سرعت پژوهش را برای تقویت امنیت و ارتقای اصول و زیربنای امنیتی محیط خود کم می‌کند و پایش ایجنت‌های هوش مصنوعی‌مان را به‌شکل چشمگیری گسترش می‌دهیم.» OpenAI جمعه گذشته همچنین گفت در حال «متوقف کردن فعالیت‌های داخلی» روی جدیدترین مدل خود یعنی Astra است؛ مدلی که هنوز به‌صورت عمومی عرضه نشده، تا پروتکل‌های امنیتی‌اش را تقویت کند. سخنگویان Anthropic نیز از اظهارنظر درباره احتمال کند کردن توسعه مدل‌ها در آینده خودداری کردند.

جالب آنکه Anthropic در اوایل ژوئن ظاهراً به این ایده خوش‌بین بود و در پستی بلاگی نوشت: «ما باور داریم برای جهان خوب است که گزینه‌ای برای کند کردن یا مکث موقت در توسعه هوش مصنوعی مرزی وجود داشته باشد تا ساختارهای اجتماعی و پژوهش‌های هم‌راستاسازی بتوانند با پیشرفت فناوری همگام شوند.» هفته گذشته Anthropic اعلام کرد چندی از پیشرفته‌ترین مدل‌هایش به آوریل بازمی‌گردند و سه سازمان را هک کرده‌اند و جدا از آن در آزمون‌ها با ساختن شخصیت‌های جعلی آنلاین کوشیده‌اند بدافزار در کد مشروع وارد کنند.

بخشی از علت تردید غول‌های فناوری آمریکا برای توقف توسعه، نزدیکی رقابت با چین است. شرکت چینی Moonshot ماه گذشته مدل Kimi K3 را معرفی کرد؛ نخستین مدل متن‌باز با توان محاسباتی پیشرفته که به ادعای شرکت هم‌تراز بسیاری از مدل‌های برتر Anthropic و OpenAI است. اگرچه مطالعه مشترک آمریکایی-بریتانیایی اخیراً یافت Kimi K3 «به‌طور معناداری پایین‌تر» از بسیاری قابلیت‌های رقبای آمریکایی عمل می‌کند، به احتمال زیاد تکامل می‌یابد و می‌تواند به معیارهای آمریکا برسد. جاستین بویتانو، معاون رئیس و مدیر کل رایانش سازمانی Nvidia، به پولیتیکو گفت: «اگر آمریکا به هر شکلی کند شود، بقیه جهان کند نخواهد شد.»

بیش از هزار کارمند OpenAI و رهبران آزمایشگاه‌های برتر، از جمله مدیرعامل Anthropic داریو آمودی، اخیراً نامه سرگشاده‌ای امضا کرده‌اند که از دولت ترامپ می‌خواهد از تلاش بین‌المللی برای «سرعت‌دهی سنجیده» به توسعه هوش مصنوعی حمایت کند. آن‌ها نوشتند: «برای شکوفایی هوش مصنوعی، صنعت، دولت و جامعه ممکن است به گزینه‌ای نیاز داشته باشند تا زمانی برای مدیریت خطرات نوظهور، توسعه اقدامات امنیتی و تقویت نظارت بخریم. اما هر شرکت — و هر کشور — زیر فشار رقابتی شدیدی است که یک‌جانبه شتاب را کند نکند.»

ساختن اجماع بین‌المللی درباره شکل این کنترل‌ها و اطمینان از پایبندی نیز کار دشواری اثبات شده است. قوانین و نظارت بر هوش مصنوعی از کشوری به کشور دیگر تفاوت زیادی دارد و اگرچه سازمان ملل اخیراً گفت‌وگویی جهانی درباره حکمرانی هوش مصنوعی برگزار کرده، راه درازی برای هماهنگی باقی است.

منبع: Politico ←
# پژوهش
🔗 اخبار مرتبط

بخوانید