پیودیپای (PewDiePie)، یوتیوبر محبوب، از آژاکس (Ajax)، «مدل هوش مصنوعی بدون سانسور» خود که برای اجرا در خانه ساخته شده است، پرده برداشت و در یک ویدیوی جدید گفت که شرکت اوپنایآی (OpenAI) در طول ساخت آن، او را دو بار مسدود کرده است. بر اساس ایمیل اوپنایآی (OpenAI) که او نشان میدهد، یکی از مسدودسازیها صراحتاً به دلیل «تقطیر» (distillation)، یعنی عمل استفاده از خروجیها یا استدلال یک مدل برای آموزش مدل دیگر، انجام شده است. مدل آژاکس (Ajax) برای فضای کاری هوش مصنوعی خودمیزبان او به نام اودیسه (Odysseus)، به عنوان یک عامل و دستیار خودمختار و همیشه روشن ساخته شده است.
این راهاندازی مشابه اوپنکلاو (OpenClaw) و هرمس ایجنت (Hermes Agent) از شرکت نوس ریسرچ (Nous Research) است. مدل آژاکس (Ajax)، که یک مدل تنظیمشدهی Qwen3.5-9B است، به فضای کاری قدرت میدهد تا «کارهای روزمره از جستجو تا مرور وب، ایمیل و تقویم شما» را انجام دهد و این کار را به گفتهی صفحه آژاکس (Ajax) «کاملاً به صورت خصوصی» انجام میدهد. این صفحه میگوید که امتناعهای مدل برای یک «تجربه هوش مصنوعی آزادتر و کمتر محدود شده» حذف شدهاند و از کاربران میخواهد که مسئولانه از آن استفاده کنند. این ویدیو نسخهی اول را با استفاده از مدل علیبابا (Alibaba) به عنوان پیگیری راهاندازی فضای کاری خود در ماه مه اعلام کرد.
این خالق محتوا در پاسخ به مسدودسازیها اظهار داشت که میخواهد «فقط مقدار کمی تقطیر کند» تا مدل خود را بهبود بخشد. شرکتهای پیشروی هوش مصنوعی مانند اوپنایآی (OpenAI) و آنتروپیک (Anthropic) اطمینان حاصل میکنند که استدلال خود را به روشهای متعددی از جمله رمزگذاری و تلاش برای جلوگیری از تقطیر پنهان کنند؛ چنین کمپینی که اوپنایآی (OpenAI) اخیراً آن را به بازیگران مرتبط با مونشات ایآی (Moonshot AI) نسبت داده است، به عنوان یک تهدید دیده میشود.
حساب کاربری پیودیپای (PewDiePie) یک بار بازگردانده شد، اگرچه در مسدودسازی دوم، که پس از اجرای مجدد مدل «برای ایجاد دادههای اولیه من» رخ داد، او پرسید: «چگونه اصلاً متوجه شدند؟» این ایمیل هیچ نمونهی خاصی ارائه نمیدهد. او افزود: «آنها سخت تلاش کردند تا تمام دادههای ما را بدزدند تا ماشینهای هوش مصنوعی خود را بسازند»، و این پیشنهاد را مطرح کرد که او احساس میکند مقداری تقطیر ممکن است تفاوتی با نحوهی آموزش مدلها نداشته باشد.
او برای «بدون سانسور کردن» مدل خود، بر روی ابلیشن خودکار (automatic abliteration) از طریق ابزار متنباز هریتیک (Heretic) اتکا کرد؛ جایی که شما دستوراتی را که مدل از پیگیریشان امتناع میکند کشف کرده و امتناع را حذف میکنید، ترجیحاً بدون اینکه با حذف بیش از حد، «آسیب مغزی» به مدل وارد کنید. او تصمیم گرفت خط قرمز را آسیب رساندن به دیگران یا خود تعیین کند. به گفتهی وکیلش، او گفت که این مدل «برای ارائه دستورالعملهای خطرناک قابل اجرا طراحی نشده است.» او از سلاحهای هستهای به عنوان یک مثال استفاده میکند، اما مشخص نیست که محدودیتهای واقعی چه میتوانند باشند.
این خالق محتوا «به شدت باور دارد» به مدلهای کوچکی که «برای یک مهار مشخص» آموزش دیدهاند، و آنها را به عنوان جایگزینی برای مدلهای «یک تریلیون پارامتری»، با اشاره به اندازههای شایعهشدهی پیشرو، پیشنهاد کرد. او گفت: «من فکر میکنم تلاش برای تحریک آن جانور غولپیکر» فقط برای کارهای ساده منطقی نیست. علاقهی او همچنان به تحقیق و ارائه یک مدل قابل استفاده معطوف است که این به معنای مدلهای کوچکتر نیز هست. او با درخواستی از طرفداران پیگیری کرد تا دادههای آموزشی را به عنوان جایگزینی برتر برای جمعآوری مستقیم آنها از کاربران اودیسه (Odysseus) اهدا کنند، যদিও او میگوید هیچکس هیچ دادهای ارسال نکرده است.
او گفت که برنامهریزی کرده است دو روز دیگر یادگیری تقویتی (reinforcement learning) را قبل از اجرای مجدد مرحلهی رفع سانسور، کوانتش (quantizing) و بنچمارک انجام دهد. او افزود: «صبر کنم تا نسخهی بعدی آژاکس (Ajax) و اودیسه (Odysseus) را منتشر کنم»، و اشاره کرد که اودیسه (Odysseus) نیز «بهروزرسانی بزرگی دریافت کرده است.» قرارداد نامگذاری منطقی به نظر میرسد، زیرا آژاکس (Ajax) رقیب اودیسه (Odysseus) در اسطورهشناسی کلاسیک بود، اگرچه او به شوخی بیان میکند که نام آن از یک محصول پاککننده گرفته شده است. قابلیتهای مدلها و مهارهای متنباز راه را برای کاربران هموار میکند تا از هوش بدون سانسور و کمتر محدود شده روی سختافزار خود استفاده کنند، که هدفی مهم در حفظ آزادی این فناوری است.
منبع: tomshardware.com
