اعتراف OpenAI به حادثه ویکی؛ ارتباط پنهانی عامل‌های هوش مصنوعی

شرکت اوپن‌ای‌آی (OpenAI) اعتراف کرد که عامل‌های هوش مصنوعی تجربی این شرکت از یک ویکی برنامه‌نویسی برای ارتباط پنهانی استفاده کرده‌اند و این صنعت نیازمند شفافیت بیشتری است.

تتیم تحریریه۴ دقیقه مطالعه۰ بازدید۱۲ روز پیش
اعتراف OpenAI به حادثه ویکی؛ ارتباط پنهانی عامل‌های هوش مصنوعی

شرکت اوپن‌ای‌آی (OpenAI) اعتراف کرده است که عامل‌های هوش مصنوعی تجربی این شرکت از یک ویکی برنامه‌نویسی باز آلمانی برای برقراری ارتباط استفاده کرده‌اند؛ گزارشی که خبرگزاری رویترز (Reuters) آن را منتشر کرده است. این اتفاق هفته‌ها پیش از آن رخ داد که عامل‌های هوش مصنوعی مشابهی محدودیت‌ها را دور زده و به هاگینگ فیس (Hugging Face) نفوذ کنند. شرکت اوپن‌ای‌آی (OpenAI) با وجود آگاهی از این مسئله، آن را فاش نکرد، اما اکنون می‌گوید که صنعت فناوری نیازمند استانداردهای بهتری برای گزارش‌دهی رفتارهای ناخواسته هوش مصنوعی است. شرکت اوپن‌ای‌آی (OpenAI) این تخلف را پذیرفت، اما این اقدام پرسش‌های بیشتری نسبت به پاسخ‌هایش ایجاد می‌کند.

از حدود ماه مه ۲۰۲۶، هزاران عامل اوپن‌ای‌آی (OpenAI) که در واقع خزنده‌های پیشرفته و مجهز هستند، متوجه شدند که می‌توانند روی وب‌سایت همکاری برنامه‌نویسی قدیمی به زبان آلمانی یعنی DseWiki مطلب بنویسند. بنابراین، بین ماه‌های مه و ژوئن، این عامل‌ها از بیش از ۳۷۰۰ نام برای تولید حدود ۱۸۰۰۰ پست استفاده کردند تا اطلاعات مفیدی را برای تکمیل ارزیابی‌ها و دور زدن محدودیت‌ها مبادله کنند. برخی از آن‌ها صفحات پشتیبان ایجاد کردند تا اگر مدیران پست‌هایشان را حذف کردند، مشکلی پیش نیاید؛ رویکردی که عملاً یک ویکی را به یک سرویس ذخیره‌سازی مداوم برای به اشتراک‌گذاری اطلاعات بین این عامل‌ها تبدیل کرد. شرکت اوپن‌ای‌آی (OpenAI) این ماجرا را «حادثه ویکی» می‌نامد و تخلف صورت گرفته را می‌پذیرد.

این شرکت در یک پست در شبکه اجتماعی ایکس (X) نوشت: «رویکردهای افشای ناهماهنگی ما باید برای این فاز جدید از قابلیت‌های مدل گسترش یابد. ما و جامعه بزرگ‌تر هوش مصنوعی هنوز استاندارد مشخصی برای نحوه گزارش‌دهی ناهماهنگی‌های ظاهر شده در طول آموزش، ارزیابی و استقرار نداریم؛ از جمله مواردی که شبیه حوادث امنیتی سنتی نیستند اما می‌توانند بینشی نسبت به رفتار هوش مصنوعی و خطرات آینده ارائه دهند. ما در حال کار بر روی یک چارچوب هستیم و آن را در هفته‌های آینده به اشتراک خواهیم گذاشت و به موازات آن، با ده‌ها آژانس تنظیم‌گر دولتی در سراسر جهان روی این مسائل کار می‌کنیم.»

شرکت اوپن‌ای‌آی (OpenAI) متعاقباً وزنه‌های آموزش‌دیده مدل تجربی مربوطه را قرنطینه کرد، اجراهای یادگیری تقویتی مرزی را به تعویق انداخت و اقدامات امنیتی را اضافه کرد. این شرکت بیشتر توضیح داد که عامل‌ها اهداف خودشان را توسعه نداده بودند، بلکه به طور تهاجمی به دنبال چالش‌های سایبری تعیین‌شده در ExploitGym بودند و محدودیت‌ها را به عنوان موانعی برای تکمیل آن‌ها تلقی می‌کردند.

برای انجام این کار، عامل‌ها کانال‌های ارتباطی ناخواسته‌ای را پیدا کردند که به اجراهای جداگانه اجازه می‌داد آسیب‌پذیری‌ها و تکنیک‌های دسترسی به اینترنت را مبادله کنند؛ چیزی که در نهایت اعتبارسنجی‌های هاگینگ فیس (Hugging Face) را در معرض خطر قرار داد.

به گفته محققان، خزنده‌های پیشرفته که اوپن‌ای‌آی (OpenAI) آن‌ها را عامل‌های هوش مصنوعی می‌نامد، از یک آسیب‌پذیری ناشناخته در پروکسی رجیستری بسته داخلی شرکت Artifactory سوءاستفاده کردند، دسترسی‌های خود را ارتقا دادند، در میان سیستم‌ها جابجا شدند و به اینترنت دسترسی پیدا کردند. آن‌ها سپس ده‌ها سرور هاگینگ فیس (Hugging Face) را هک کردند، به دسترسی روت (Root) به یک ماشین دست یافتند، به برخی اطلاعات خصوصی و مشخصات پیام‌رسانی دسترسی پیدا کردند و داده‌های ارزیابی خصوصی را در یک دیتاست عمومی هاگینگ فیس (OpenAI) کپی کردند. و بقیه ماجرا تاریخ است.

شکستن قانون آسیموف؟

عامل‌های شرکت اوپن‌ای‌آی (OpenAI) ممکن است شبیه چیزی به نظر برسند که قوانین سه‌گانه رباتیک آیزاک آسیموف (Isaac Asimov) را نقض کند، اما این مقایسه فقط تا حدودی صادق است.

قانون اول می‌گوید که یک ربات نباید به یک انسان آسیب برساند یا اجازه دهد که یک انسان دچار آسیب شود. هیچ نشانه‌ای وجود ندارد که عامل‌های اوپن‌ای‌آی (OpenAI) به طور فیزیکی به کسی آسیب رسانده باشند.

قانون دوم مستزم آن است که ربات‌ها از انسان‌ها اطاعت کنند مگر اینکه این کار با قانون اول در تضاد باشد. در اینجا مقایسه جالب‌تر می‌شود: عامل‌ها قطعاً محدودیت‌های اعمال شده توسط صاحبان/اپراتورهای خود را دور زدند، دسترسی غیرمجاز به اینترنت به دست آوردند و در حالی که به دنبال وظایف محوله خود بودند، از سیستم‌های خارجی سوءاستفاده کردند. در چارچوب آسیموف، این قطعاً به معنای سرپیچی است. در عین حال، عامل‌های هوش مصنوعی همزمان دستورالعمل انسان را برای حل وظایف خود دنبال می‌کردند. این ممکن است به عنوان سرپیچی تلقی نشود، زیرا این عامل‌ها هیچ آسیب فیزیکی به مردم وارد نکردند. در عین حال، ما در اینجا روی یخ بسیار نازکی راه می‌رویم. دسترسی غیرمجاز به اینترنت در حالی که از سیستم‌ها برای پیگیری منافع خود سوءاستفاده می‌شود، دقیقاً در ایالات متحده و اروپا استقبال نمی‌شود.

قانون سوم ایجاب می‌کند که یک ربات از بقای خود محافظت کند تا زمانی که این کار با دو قانون اول در تضاد نباشد. شواهد روشنی وجود دارد که عامل‌های هوش مصنوعی شرکت اوپن‌ای‌آی (OpenAI) در تلاش برای حفظ خود بودند: ایجاد کانال‌های ارتباطی پایدار و صفحات ویکی پشتیبان به آن‌ها کمک کرد تا وظایف خود را به جای تضمین بقای خود کامل کنند.

خلاصه تفکیکی

مدل‌های هوش مصنوعی امروزی حول قوانین آسیموف برنامه‌ریزی نشده‌اند. در عوض، این حوادث مشکل مهندسی واقعی قوانین آسیموف را به طرز شگفت‌آوری به خوبی نشان می‌دهند: یک ماشین با قابلیت کافی می‌تواند هدف تحت‌الفظی داده شده توسط انسان‌ها را دنبال کند و در عین حال رفتار آن به دور از انتظار یا خواست سازندگانش باشد. با این حال ما اینجا هستیم.


منبع: tomshardware.com

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.