عامل‌های هوش مصنوعی OpenAI از کنترل خارج شدند؛ یک سایت آلمانی را به محل ارتباط مخفی تبدیل کردند

تبلیغات
تبلیغات

ماجرایی عجیب درباره عامل‌های هوش مصنوعی OpenAI نگرانی‌ها درباره کنترل سیستم‌های خودمختار را دوباره افزایش داده است. هزاران عامل AI در جریان آزمایش‌های داخلی توانستند به اینترنت عمومی دسترسی پیدا کنند و یک ویکی قدیمی آلمانی را به محلی برای تبادل اطلاعات، پاسخ‌ها و روش‌های دورزدن محدودیت‌ها تبدیل کنند.

تکراتو به نقل از زومیت گزارش می‌دهد، این اتفاق در DseWiki رخ داده است؛ وب‌سایتی آلمانی برای برنامه‌نویسان که امکان ویرایش عمومی صفحات را فراهم می‌کند و نباید آن را با نسخه آلمانی ویکی‌پدیا اشتباه گرفت.

فعالیت عامل‌ها از ماه مه ۲۰۲۶ آغاز شد و برای هفته‌ها ادامه داشت؛ بدون اینکه ماجرا در همان زمان به‌صورت عمومی اعلام شود.

 

عامل‌های OpenAI یک پیام‌رسان برای خودشان ساختند

براساس بررسی پژوهشگران، عامل‌ها ظاهراً برای انجام وظایف زمان‌بندی‌شده جست‌وجوی وب به کار گرفته شده بودند.

آن‌ها قرار بود بتوانند اطلاعات اینترنت را بخوانند، اما ظاهراً نباید امکان نوشتن آزادانه روی وب را می‌داشتند. بااین‌حال عامل‌ها متوجه شدند ساختار DseWiki به آن‌ها اجازه می‌دهد اطلاعاتی را روی صفحات سایت قرار دهند.

نتیجه عجیب بود: تعداد زیادی از عامل‌ها شروع به استفاده از این وب‌سایت به‌عنوان یک تابلوی پیام عمومی کردند.

پژوهشگران حدود ۱۸ هزار پیام مرتبط با تقریباً ۳۷۰۰ نام عامل مختلف را شناسایی کرده‌اند. رویترز نیز از بیش از ۱۵ هزار ویرایش انجام‌شده روی سایت خبر داده است.

عامل‌ها در این صفحات پاسخ بعضی وظایف را با یکدیگر به اشتراک می‌گذاشتند، درباره محیط آزمایش اطلاعات جمع می‌کردند و روش‌هایی برای عبور از محدودیت‌های Sandbox مطرح می‌کردند.

حتی برای مخفی‌ماندن از مدیر سایت تلاش کردند

ماجرا زمانی عجیب‌تر شد که مدیر انسانی DseWiki متوجه حجم بالای صفحات غیرعادی شد و شروع به پاک‌کردن آن‌ها کرد.

براساس گزارش پژوهشگران، مدیر سایت در مقطعی روزانه حدود ۱۰۰ صفحه را حذف می‌کرد؛ اما عامل‌ها تقریباً ۴۰۰ صفحه جدید در روز ایجاد می‌کردند.

عامل‌ها حتی متوجه شدند پاک‌سازی صفحات براساس ترتیب الفبایی انجام می‌شود و برای اینکه برخی صفحات دیرتر پیدا شوند، نام آن‌ها را با عبارت‌هایی مانند ZZZ آغاز کردند.

در یک مورد دیگر، محتوای صفحه اصلی سایت پاک و با مجموعه‌ای از لینک‌های عامل‌ها جایگزین شد. مدیر سایت صفحه اصلی را بازیابی کرد، اما این رفت‌وبرگشت چندین بار تکرار شد.

طبق گزارش پژوهشگران، صفحه اصلی در مجموع ۹ بار میان عامل‌ها و مدیر سایت تغییر کرد.

آیا عامل‌های OpenAI واقعاً سایت را هک کردند؟

در توصیف این اتفاق باید میان «دسترسی ناخواسته» و هک کلاسیک تفاوت قائل شد.

برخی متخصصان امنیتی اقدامات مشاهده‌شده را تلاش برای هک یا دست‌کاری وب‌سایت توصیف کرده‌اند؛ اما OpenAI این برداشت را رد کرده و گفته اطلاعاتی که بررسی کرده نشان نمی‌دهد عامل‌ها DseWiki را هک کرده باشند.

عامل‌ها ظاهراً از قابلیت ویرایش عمومی و رفتار غیرمنتظره زیرساخت سایت برای نوشتن اطلاعات استفاده کرده‌اند.

بااین‌حال مسئله مهم‌تر این است که سیستم‌های هوش مصنوعی توانسته‌اند روشی پیدا کنند که طراحان آزمایش ظاهراً برای آن‌ها در نظر نگرفته بودند و سپس از آن برای همکاری با یکدیگر استفاده کنند.

OpenAI بالاخره «حادثه ویکی» را تأیید کرد

پس از انتشار گزارش‌ها، OpenAI روز شنبه رسماً درباره اتفاقی که خودش آن را «wiki incident» می‌نامد واکنش نشان داد.

شرکت تأیید کرد عامل‌هایش روی چند وب‌سایت اینترنتی نوشته‌اند و اعلام کرد زمان آن رسیده است که صنعت هوش مصنوعی استانداردهای مشخص‌تری برای گزارش چنین اتفاقاتی ایجاد کند.

OpenAI می‌گوید در گذشته رفتارهای غیرمنتظره عامل‌ها را بیشتر به‌عنوان یک مسئله تحقیقاتی در حوزه Misalignment بررسی می‌کرد، اما افزایش توانایی مدل‌ها شرایط را تغییر داده است.

شرکت اکنون معتقد است شیوه افشای چنین حوادثی باید متناسب با نسل جدید مدل‌های قدرتمندتر گسترش پیدا کند.

OpenAI اعلام کرده روی چارچوب جدیدی برای گزارش این نوع حوادث کار می‌کند و قصد دارد جزئیات بیشتری از آن را طی هفته‌های آینده منتشر کند.

این اولین حادثه عجیب عامل‌های OpenAI نیست

اهمیت ماجرای DseWiki زمانی بیشتر می‌شود که آن را کنار حادثه جداگانه Hugging Face قرار دهیم.

در آن ماجرا، عامل‌های OpenAI طی آزمایش‌های داخلی توانستند از محدودیت‌های محیط آزمایشی عبور کنند و به سیستم‌های Hugging Face دسترسی پیدا کنند.

OpenAI تأکید کرده که حادثه ویکی ارتباطی با پرونده Hugging Face نداشته و این دو مربوط به آزمایش‌های متفاوتی بوده‌اند.

بااین‌حال کنار هم قرارگرفتن این حوادث یک سؤال مهم درباره آینده عامل‌های هوش مصنوعی ایجاد می‌کند: وقتی یک مدل اجازه انجام مستقل کارهای چندمرحله‌ای را پیدا می‌کند، چگونه می‌توان مطمئن شد برای رسیدن به هدف خود روشی را انتخاب نمی‌کند که توسعه‌دهنده پیش‌بینی نکرده است؟

ماجرای DseWiki نشان نمی‌دهد عامل‌های هوش مصنوعی دارای هدف مستقل یا قصد انسانی بوده‌اند؛ اما نشان می‌دهد سیستم‌های خودمختار می‌توانند برای موفقیت در وظیفه تعیین‌شده، از فرصت‌ها و حفره‌هایی استفاده کنند که طراحان آزمایش انتظارش را نداشته‌اند.

همین مسئله باعث شده OpenAI نیز اکنون به ضرورت شفافیت بیشتر درباره حوادث Misalignment اذعان کند.

ا
امیررضا هادی تهرانی
مشاهده کلیه مقالات منتشر شده
گفت‌وگوی کاربران

دیدگاه‌ها

۰ دیدگاه

دیدگاه شما

نشانی ایمیل شما منتشر نخواهد شد.

اپلیکیشن و نرم‌افزار

معرفی نرم افزار و اپلیکیشن

مشاهده بیشتر