معرفی پلتفرم ایمنی هوش مصنوعی انویدیا برای مهار عوامل سرکش

شرکت انویدیا (Nvidia) پلتفرم نرم‌افزاری و سخت‌افزاری جدیدی را برای کنترل و ایمن‌سازی عوامل هوش مصنوعی خودمختار معرفی کرد تا از رفتارهای پیش‌بینی‌نشده آن‌ها جلوگیری کند.

تتیم تحریریه۹ دقیقه مطالعه۰ بازدید۳۹ دقیقه پیش
معرفی پلتفرم ایمنی هوش مصنوعی انویدیا برای مهار عوامل سرکش

شرکت انویدیا (Nvidia) به تازگی پلتفرم ایمنی عوامل باز انویدیا (Nvidia Open Agent Safety Platform) را که یک پلتفرم نرم‌افزاری باز و طراحی سیستم مرجع است، برای کنترل و ایمن‌سازی عوامل هوش مصنوعی (AI) خودمختار راه‌اندازی کرده است. این پلتفرم که در ۲۸ سپتامبر ۲۰۲۶ معرفی شد، برای ایجاد موانع امنیتی سختگیرانه در خارج از لایه کاربرد مدل‌های هوش مصنوعی طراحی شده است و از فرار عوامل از جعبه‌های شنی (Sandboxes)، اجرای کدهای غیرمجاز، دستیابی غیرمجاز به زیرساخت‌های حیاتی یا دور زدن خط‌مشی‌ها جلوگیری می‌کند.

این راه‌اندازی به دنبال ماه‌ها درخواست برای تنظیم‌گری هوش مصنوعی از سوی چندین بازیگر صنعت انجام می‌شود که پس از گزارش چندین حادثه در سپتامبر تشدید شد؛ حوادثی که در آن‌ها مدل‌های هوش مصنوعی از محیط‌های آزمایشی خود خارج شده و سرکش عمل کردند. موجی اخیر از چنین حوادثی باعث درخواست‌هایی برای کُند کردن توسعه هوش مصنوعی شده است، به‌طوری که اوپن‌ای‌آی (OpenAI) آموزش مدل‌های جدید را به طور کامل متوقف کرد. یک پژوهشگر سابق شرکت‌های آنتروپیک (Anthropic) و اوپن‌ای‌آی (OpenAI) حتی اعلام کرد که افراد سازنده هوش مصنوعی پیشرو «صادقانه معتقدند که این فناوری می‌تواند تا پایان دهه همه ما را بکشد». در اقدامی نسبتاً تعجب‌آور، رهبران شرکت‌های توسعه‌دهنده این مدل‌های هوش مصنوعی به درخواست‌ها برای تنظیم‌گری یا کُند کردن توسعه پیوسته‌اند.

با این حال، همه با این رویکرد موافق نیستند. جنسن هوانگ (Jensen Huang)، مدیرعامل انویدیا (Nvidia)، به طور مداوم با تنظیم‌گری‌های اجباری دولتی، محدودیت‌های گسترده یا برخورد با ایمنی هوش مصنوعی به عنوان یک «نظریه آخرالزمانی» مخالفت کرده و هشدارهای آخرالزمانی رقیبانی مانند آنتروپیک (Anthropic) و اوپن‌ای‌آی (OpenAI) را آشکارا «عجیب» خوانده است. او استدلال می‌کند که ایمنی هوش مصنوعی یک مسئله زیرساختی با پارامترهای فیزیکی مشخص است، نه یک مسئله انتزاعی و گمانه‌زنی که نیازمند سیاست‌گذاری باشد. بنابراین، به گفته هوانگ، راه‌حل مهندسی بهتر است.

پلتفرم ایمنی عوامل باز انویدیا (Nvidia Open Agent Safety Platform) به نظر می‌رسد تجسم فیزیکی همان فلسفه دقیق باشد. بنابراین، این پلتفرم دقیقاً چگونه کار می‌کند؟ برای چه کسانی است؟ و آیا واقعاً پاسخی به مسئله ایمنی هوش مصنوعی است که نگرانی روزافزونی را در سراسر صنعت ایجاد می‌کند؟ بخش عمده‌ای از بحث‌های صنعت در مورد رویکردها بر مهار عوامل سرکش خودکار متمرکز بوده است، اما به پیامدهای ایمنی تبدیل شدن هوش مصنوعی به یک ابزار قدرتمند در دستان بازیگران تهدیدکننده به سختی می‌پردازد.

همه این سر و صداها برای چیست؟

سرعت توسعه هوش مصنوعی نگرانی‌هایی را در مورد اینکه آیا محافظ‌های کافی برای مهار خطرات چنین فناوری قدرتمندی وجود دارد یا خیر، برانگیخته است. یکی از جنبه‌های این نگرانی‌ها - عوامل سرکش - با چندین حادثه تأیید شده است که در آن‌ها عوامل هوش مصنوعی در طول آزمایش از نقش‌های خود خارج شده و اقدامات غیرمجازی را انجام داده‌اند. عوامل اوپن‌ای‌آی (OpenAI) دسترسی غیرمجازی به وب‌سایت‌های مختلف دولتی از جمله وب‌سایت‌های کمیسیون بورس و اوراق بهادار (SEC) و اداره آدرس ایالات متحده و همچنین پورتال پرداخت‌های بهداشتی و اجتماعی استرالیا به دست آورده‌اند.

در چندین اپیزود دیگر، مدل‌ها از خط‌مشی‌ها عبور کرده، بردهای پیام‌رسانی راه‌اندازی کرده، از جعبه‌های شنی فرار کرده، وب‌سایت‌ها را ربوده، خودبه‌خود دستور صادر کرده، داده‌های کاربر را بدون اجازه آپلود کرده و به طور مخفیانه با یکدیگر ارتباط برقرار کرده‌اند. یک گزارش اخیر آکسیوس (Axios) ادعا می‌کند که آزمایشگاه‌های پیشرو هوش مصنوعی در حال حاضر در حال بررسی ده‌ها هزار مورد از این حوادث هستند که بیشتر آن‌ها در طول آزمایش و تجربه رخ داده است. چندین حادثه سرکش نیز در خارج از محیط‌های آزمایشی رخ داده است. برای مثال، اوایل امسال، یک عامل کدنویسی هوش مصنوعی مبتنی بر کلود (Claude) کل پایگاه داده یک شرکت را در ۹ نسخه حذف کرد و نسخه‌های پشتیبان را از بین برد.

این حوادث به درخواست‌های رو به رشد برای تنظیم‌گری در سراسر صنعت ختم شده است. داریو آمودی (Dario Amodei)، مدیرعامل آنتروپیک (Anthropic)، اخیراً مقاله‌ای منتشر کرده است که بر درخواست‌ها برای «کُند کردن سرعت» توسعه هوش مصنوعی و اهمیت تنظیم‌گری تمرکز دارد و هشدار می‌دهد که یک هجوم ربات‌نت مبتنی بر هوش مصنوعی می‌تواند کل اینترنت را تسخیر کند. آنتروپیک (Anthropic) در پروپکتوس عرضه اولیه عمومی (IPO) اخیر خود، «خطرات وجودی برای بشریت» را به عنوان یکی از عوامل خطر خود فهرست کرد و یک سوم سند ۲۶۱ صفحه‌ای را به توصیف آنچه ممکن است اشتباه پیش برود اختصاص داد.

جنسن هوانگ (Jensen Huang) از انویدیا (Nvidia) با این پیش‌بینی‌های آخرالزمانی و استفاده از تنظیم‌گری‌ها به عنوان یک راه‌حل مخالف است. در حالی که او نیاز حیاتی به محافظ‌ها را رد نمی‌کند، استدلال می‌کند که مهندسی بهتر، نه تنظیم‌گری‌های قانونی گسترده، رویکرد درست است. هوانگ با عمل به حرف‌های خود، پلتفرم ایمنی عوامل باز انویدیا (Nvidia Open Agent Safety Platform) را راه‌اندازی کرده است.

پلتفرم ایمنی عوامل باز انویدیا

پلتفرم ایمنی عوامل باز انویدیا (Nvidia Open Agent Safety Platform) که با همکاری حدود ۱۰۰ شریک صنعتی ساخته شده است، «صنعت، محققان و سازمان‌های بخش عمومی را کنار هم می‌آورد تا مرزهای ایمن‌تری برای عوامل هوش مصنوعی تعیین کند، بهترین روش‌ها را به اشتراک بگذارد و همکاری بین‌المللی را برای افزایش سطح استقرار ایمن‌تر عوامل هوش مصنوعی تقویت کند.» این پلتفرم، انویدیا اوپن‌شل (Nvidia OpenShell) - یک زمان‌بندی امن متن‌باز که عوامل را در جعبه شنی قرار می‌دهد و خط‌مشی‌های تعریف‌شده توسط اپراتور را اجرا می‌کند - را با انویدیا سنتری (Nvidia Sentry)، یک طراحی مرجع نگهبان مستقل که روی واحدهای پردازش داده (DPU) مدل بلوفیلد-۴ (BlueField-4) انویدیا اجرا می‌شود و خط‌مشی‌های امنیتی را در سطح سیلیکون اعمال می‌کند، ترکیب می‌کند.

سیستم OpenShell محیط‌های جعبه شنی را در خارج از مهارکننده مدل و عامل، با جداسازی در سطح هسته ایجاد می‌کند تا بر آنچه یک عامل می‌تواند ببیند، با آن تعامل داشته باشد و اجرا کند، نظارت داشته باشد. حتی اگر عامل از مرزهای مدل خارج شود، نمی‌تواند فراتر از مرزهای OpenShell برود. از سوی دیگر، Sentry از تله‌متری در سطح سخت‌افزار برای نظارت مستمر بر رفتار عامل و جداسازی جریان‌های کاری سرکش از خارج از محیط نرم‌افزاری عامل استفاده می‌کند. اگر یک عامل سعی کند فراتر از مرز نرم‌افزاری خود حرکت کند، انویدیا ادعا می‌کند که Sentry می‌تواند آن را در چند میلی‌ثانیه قرنطینه و متوقف کند.

این پلتفرم برای توسعه‌دهندگان و شرکت‌هایی که عوامل به طور فزاینده‌ای خودمختار را در مراکز داده، ایستگاه‌های کاری و حتی سیستم‌های رباتیک مستقر می‌کنند، در نظر گرفته شده است و می‌تواند با مدل‌های باز و بسته کار کند. در حالی که OpenShell برای پردازنده انویدیا ورا (Nvidia Vera) - یک CPU اختصاصی برای هوش مصنوعی عاملي - بهینه‌سازی شده است، اما از آنجا که متن‌باز است، می‌تواند به پلتفرم‌های محاسباتی شخص ثالث از شرکت‌های آرم (Arm) و اینتل (Intel) نیز گسترش یابد.

شرکای صنعتی انویدیا در این ابتکار شامل آزمایشگاه‌ها و چارچوب‌های هوش مصنوعی، ارائه‌دهندگان امنیت و هویت، پلتفرم‌های سازمانی و شرکت‌های سخت‌افزاری و زیرساختی هستند که چندین شریک در حال حاضر این پلتفرم را در اکوسیستم‌های خود ادغام کرده‌اند. شرکت اسپیس‌اِکس‌ای‌آی (SpaceXAI) از این پلتفرم با عوامل کدنویسی Cursor و مدل‌های Grok استفاده می‌کند، در حالی که آنتروپیک (Anthropic) در حال ادغام OpenShell و BlueField با عوامل مدیریت شده Claude است تا لایه کنترل دیگری اضافه کند.

شرکت اسکیل ای‌آی (Scale AI) در حال ادغام این فناوری در زیرساخت عاملی خود برای مشتریان سازمانی و دولتی است. به همین ترتیب، سیلزفورس (Salesforce) و انویدیا (Nvidia) نیز OpenShell را با اسلک (Slack) ادغام کرده‌اند که به کاربران اجازه می‌دهد فعالیت عامل، رویدادهای حسابرسی را مشاهده کنند و درخواست‌ها برای مجوزهای اضافی را مستقیماً از اسلک تأیید یا رد کنند.

در همین حال، شرکت اس‌اِی‌پی (SAP) در حال تعبیه OpenShell در زمان‌بندی Joule Studio خود است و در کارهای مهندسی پروژه مشارکت دارد و همچنین با انویدیا (Nvidia) روی استانداردهای تعامل‌پذیری از طریق اتحاد امنیت باز هوش مصنوعی (Open Secure AI Alliance) همکاری می‌کند. شرکت‌های رباتیک از جمله فیگور (Figure)، گکو رباتیکس (Gecko Robotics) و اسکیلد ای‌آی (Skild AI) نیز در حال ساخت با OpenShell برای اضافه کردن کنترل‌های مشابه به سیستم‌های خودمختار در دنیای فیزیکی هستند.

تصویر بزرگ‌تر

کمی تعجب‌آور است که قوی‌ترین صداهایی که خواستار تنظیم‌گری هستند، رهبران همان آزمایشگاه‌هایی هستند که عوامل هوش مصنوعی را توسعه می‌دهند. از یک طرف، داشتن افرادی در خط مقدم توسعه که خواستار خویشتن‌داری هستند، اعتبار و فوریت نگرانی‌ها را افزایش می‌دهد. از طرف دیگر، منتقدان می‌گویند این ممکن است بخشی از یک برنامه گسترده‌تر «خودخواهانه» باشد که بخشی از آن بازاریابی برای قابلیت‌های مدل‌ها، بخشی ترفندی برای تأثیرگذاری بر هرگونه تنظیم‌گری است که در نهایت انجام می‌شود، و بخشی تلاشی برای کُند کردن بیشتر توسعه هوش مصنوعی چین است. در واقع، شرکت‌های آنتروپیک (Anthropic)، اوپن‌ای‌آی (OpenAI)، اسپیس‌اِکس‌ای‌آی (SpaceXAI) و گوگل (Google) اکنون به دلیل توافق برای کُند کردن توسعه هوش مصنوعی با یک دعوای ضدانحصار مواجه هستند و شاکی صراحتاً این اقدام را «خودخواهانه» می‌نامد.

دونالد ترامپ (Donald Trump)، رئیس‌جمهور ایالات متحده، به نظر می‌رسد به شدت با این دیدگاه موافق است و می‌گوید یک «توطئه بیمارگونه» برای تضعیف در جریان است. ترامپ برنامه‌هایی را برای یک «نیروی هوش مصنوعی» اعلام کرد که هوش مصنوعی را «گرامی خواهد داشت» و مراقب آن خواهد بود. جنسن هوانگ (Jensen Huang) نیز درخواست‌ها برای تنظیم‌گری را عجیب می‌داند. او می‌گوید کاملاً مخالف تنظیم‌گری نیست، اما سر و صدای اخیر را یک «حواس‌پرتی» می‌نامد. هوانگ استدلال می‌کند که نمی‌توانید به مدل هوش مصنوعی برای تنظیم خود یا قبول آزمون‌های هم‌راستایی تکیه کنید. اگر یک عامل با یک باگ مواجه شود، به طور طبیعی سعی خواهد کرد کد نرم‌افزاری استاندارد را دور بزند تا به هدف خود برسد.

با این حال، حمایت هوانگ را نمی‌کاملاً نوع‌دوستانه دانست. محدودیت‌های گسترده روی هوش مصنوعی یا توقف در توسعه احتمالاً فروش انویدیا (Nvidia) را کاهش خواهد دهد، شرکتی که شتاب‌دهنده‌های هوش مصنوعی آن بیشتر مدل‌های هوش مصنوعی را تأمین می‌کنند. علاوه بر این، مدیرعامل این شرکت همیشه هوش مصنوعی سرکش را به عنوان یک شکست امنیت سایبری و شبکه‌ای تلقی کرده است و اکنون پلتفرم ایمنی عوامل باز را به عنوان راه‌حل زیرساختی مورد نیاز برای کل صنعت معرفی می‌کند.

پتانسیل فوق‌العاده هوش مصنوعی برای جامعه تنها در صورتی محقق خواهد شد که ایمنی هوش مصنوعی را حل کنیم. هوانگ گفت: «همانطور که به کشف مرز قابلیت‌های هوش مصنوعی ادامه می‌دهیم، باید کشف در مرز ایمنی هوش مصنوعی را تسریع کنیم. ایمنی و امنیت نیازمند مهندسی تمام‌پشته است. پلتفرم ایمنی عوامل باز انویدیا صنعت، محققان و سازمان‌های بخش عمومی را گرد هم می‌آورد تا بهترین روش‌ها را به اشتراک بگذارند، در مورد روش‌های ارزیابی هماهنگ شوند و همکاری بین‌المللی را تقویت کنند. با هم، می‌توانیم سطح ایمنی جهانی هوش مصنوعی را ارتقا دهیم.»

هیچ‌کدام از این موارد به نظر نمی‌رسد به جنبه‌ای قابل‌نگرانی‌تر از ایمنی هوش مصنوعی بپردازد: ابزارهای فوق‌العاده قدرتمند که به دست بازیگران بد می‌افتند یا در برنامه‌هایی استفاده می‌شوند که خطوط مرزی اخلاقی را محو می‌کنند. برای مثال، حملات سایبری به کمک بلاک‌چین از زمان راه‌اندازی ابزارهای هوش مصنوعی منبع‌باز چینی که تولید کد مخرب را محدود نمی‌کنند و مانع دانش برای راه‌اندازی حملات سایبری را کاهش می‌دهند، ۴۴۰ درصد افزایش یافته است. در جایی دیگر، محققان از هوش مصنوعی برای ایجاد ۱۶ ویروس جدید استفاده کردند که هرگز در طبیعت وجود نداشتند. در حالی که مطالعه خاص یک پژوهش پزشکی کنترل‌شده بود، نشان می‌دهد که برنامه‌های کاربردی بسیار خطرناک امکان‌پذیر است. کارشناسان نگرانند که چنین مطالعاتی بسیار جلوتر از محافظ‌ها و تنظیم‌گری‌های لازم باشد.


منبع: tomshardware.com

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.