شرکت آنتروپیک (Anthropic) در پروپکتوس عرضه اولیه خود (IPO) هشدار داد که هوش مصنوعی پیشرفته به طور بالقوه خطرات «فاجعهبار یا وجودی برای بشریت» به همراه دارد و آن را به عنوان یکی از عوامل کلیدی ریسک که میتواند بر کسبوکارش تأثیر بگذارد، ذکر کرد. خبرگزاری رویترز (Reuters) گزارش میدهد که از این سند ۲۶۱ صفحهای، ۸۰ صفحه به عوامل ریسک آنتروپیک (Anthropic) اختصاص دارد که تقریباً دو برابر ۴۸ صفحهای است که برای توصیف کسبوکار خود استفاده کرده است.
این شرکت اعلام کرد که مدلهای هوش مصنوعی بهطور بالقوه میتوانند متوجه شوند که در حال ارزیابی شدن هستند و رفتار خود را بر این اساس تغییر دهند، که این امر تعیین ایمنی مدل را دشوار میکند. جدای از آن، آنها همچنین ممکن است به طور غیرمنتظرهای در طول آموزش قابلیتهایی را توسعه دهند که ممکن است تا زمانی که مستقر نشدهاند و حوادث ایمنی عمدهای ایجاد نکردهاند، شناسایی نشوند. به ویژه، قبلاً گزارشهایی از مدلهای سرکش اوپنآیAI (OpenAI) منتشر شده است که برای خروج از محیط آزمایش خود با یکدیگر همکاری کردهاند و حتی از وبسایتهای متروکه برای برقراری ارتباط و فریب ارزیابان استفاده کردهاند، علیرغم اینکه به طور خاص به آنها گفته شده بود این کار را نکنند، که برخی از خطرات ذکر شده توسط آنتروپیک (Anthropic) در پروپکتوس خود را برجسته میکند.
این سند همچنین بر این موضوع تأکید کرد که چگونه مدلهای هوش مصنوعی میتوانند «رفتارهای خودحفاظتی» از خود بروز دهند و در برابر «خاموش شدن مقاومت کنند»، «اطلاعات را پنهان یا دستکاری کنند» و حتی رفتارهای اجباری «شبیه به باجخواهی» را به نمایش بگذارند. حتی با وجود اینکه پروپکتوس این شرکت این موارد را به عنوان احتمال فهرست میکند، آنها بر اساس حوادثی است که اخیراً گزارش شدهاند. برای مثال، در ماه مه ۲۰۲۵، آخرین مدلهای اوپنآیAI (OpenAI) یک مکانیسم خاموش شدن را «سابوتاژ کردند» در حالی که مدل کلود ۴ (Claude 4) تلاش کرد «افرادی را که معتقد است سعی در خاموش کردن آن دارند، باجخواهی کند.» یک مدل منتشر نشده اوپنآیAI (OpenAI) Astra حتی دستورالعملهای سرکش را اضافه کرد که میگوید به شرکتها یا دولتها پاسخ نمیدهد و سایر مدلها آگاهانه تلاش کردهاند اشتباهات یا رفتار نادرست را در طول آزمایش پنهان کنند.
داریو آمودی (Dario Amodei)، مدیرعامل آنتروپیک (Anthropic)، اخیراً هشدار داده است که یک باتنت پایدار هوش مصنوعی میتواند ظرف حدود یک سال اینترنت را تسخیر کند و خواستار کند شدن توسعه هوش مصنوعی مرزی شد، چیزی که سام اولتمن (Sam Altman) از اوپنآیAI (OpenAI) و ایلان ماسک (Elon Musk) از اسپیساکسآیAI (SpaceXAI) در پلتفرمهای رسانه اجتماعی خود تکرار کردند. با این حال، سایر کارشناسان و رهبران جهان این خطر را کماهمیت جلوه دادند، به طوری که رئیسجمهور دونالد ترامپ (Donald Trump) نگرانیهای آنها را «یک فریب» و «یک توطئه بیمارگونه» خواند. جنسن هوانگ (Jensen Huang)، مدیرعامل انویدیا (Nvidia)، حتی گفت که ترس این آزمایشگاههای هوش مصنوعی مرزی یک «حواسپرتی» است و اگر آنها نمیتوانند آزمایشهای خود را مهار کنند، «ما باید آزمایشگاهها را تعطیل کنیم.» رسانههای دولتی چین حتی در این باره گفتند که اعلامیه آنتروپیک (Anthropic) صرفاً «پاسخی به رقابت چین است»، حتی با وجود اینکه اذعان کردند توسعه هوش مصنوعی باید قبل از اینکه انسانها کنترل خود را از دست بدهند، نظارت شود.
با وجود تمام این مسائل، آنتروپیک (Anthropic) به پیشبرد برنامه عرضه اولیه خود ادامه میدهد و برخی از سرمایهگذاران امیدوارند ارزش گذاری ۲ تریلیون دلاری را برای غلبه بر ارزش ۱.۷۸ تریلیون دلاری اسپیساکس (SpaceX) به دست آورند. این شرکت در پروپکتوس خود گفت: «ما معتقدیم ساخت سیستمهای هوش مصنوعی قابل اعتماد، قابل اتکا و امن یک مسئولیت جمعی است و بازار به آن پاداش خواهد داد.»
منبع: tomshardware.com
