شرکت شیائومی (Xiaomi) در ادامه توسعه اکوسیستم هوش مصنوعی خود و گسترش طیف مدلهای زبانی بزرگ (LLMs) در حوزههای متن، کد و صوت، از یک دستگاه سختافزاری جدید و انقلابی با نام مینیپسی AI Cube پردهبرداری کرد. این محصول که در جریان کنفرانس ارتباطات فناوری تراشه XRING معرفی شد، به عنوان یک نمونه اولیه (Prototype) طراحی شده است تا قدرت پردازش هوش مصنوعی را مستقیماً به روی میز کاربران بیاورد و نیاز به سرورهای ابری را به حداقل برساند.
قلب تپینده این مینیپس مجهز به سه تراشه اختصاصی توسعهیافته توسط شیائومی (Xiaomi) یعنی تراشههای XRING O3، XRING O100 و XRING D100 است. تراشه اصلی AI SoC یعنی XRING O3 دارای معماری ۱۰ هستهای تماماً بزرگ (All-Big-Core)، پردازنده گرافیکی ۱۶ هستهای G2-Ultra NX و یک واحد پردازش عصبی (NPU) با توان ۲۰۰ ترافلاپس است. همچنین تراشه شتابدهنده هوش مصنوعی XRING O100 با فناوری پشتهسازی سهبعدی و پهنای باند حافظه ۱.۲۲ ترابایت بر ثانیه به همراه تراشه XRING D100 با لیتوگرافی ۳ نانومتری و پشتیبانی از ۱۶۰ گیگابایت حافظه، قدرت پردازشی بینظیری را ارائه میدهند. بدنه این دستگاه نیز از آلومینیوم درجهی هوافضا با برشهای دقیق CNC ساخته شده و قادر است توان مصرفی مداوم تا ۱۵۰ وات را مدیریت کند.
حرکت شیائومی (Xiaomi) در ساخت سختافزارهای انحصاری برای اجرای محلی هوش مصنوعی، یادآور تلاشهای سایر غولهای فناوری برای استقلال سختافزاری و کاهش وابستگی به تراشههای آمریکایی یا تایوانی است. پیشتر شرکتهای مختلفی راهکارهای پردازش محلی هوش مصنوعی را ارائه داده بودند، اما ورود جدی شیائومی با تراشههای اختصاصی نشاندهنده تغییر پارادایم صنعت به سمت پردازش لبه (Edge AI) و افزایش امنیت حریم خصوصی کاربران است که پردازش دادهها را بدون نیاز به ارسال به ابر امکانپذیر میکند.
قابلیت اصلی این سختافزار پیشرفته، اجرای محلی مدلهای زبانی بزرگ (LLMs) از پارامترهای ۳B تا ۱۲۰۰B است که به کاربران اجازه میدهد بسته به نیاز خود بین حالتهای کاری سریع و کند جابهجا شوند. این ویژگی دستگاه را در رقابت مستقیم با محصولاتی نظیر Tiiny AI Pocket Lab قرار میدهد. با این حال، از آنجا که AI Cube در حال حاضر یک نمونه اولیه است، شیائومی (Xiaomi) هنوز قیمت نهایی و تاریخ عرضه تجاری آن را اعلام نکرده است.
توسعه و معرفی چنین دستگاههایی تاثیر عمیقی بر آینده بازار رایانههای شخصی و گجتهای هوشمند خواهد گذاشت. با فراگیر شدن اجرای محلی هوش مصنوعی، توسعهدهندگان، پژوهشگران و حتی کاربران عادی میتوانند ابزارهای هوش مصنوعی پیشرفته را بدون نگرانی از تاخیر شبکه یا هزینههای سرورهای ابری به صورت کاملاً آفلاین اجرا کنند و این امر تحولی بزرگ در شیوه تعامل انسان و رایانه ایجاد خواهد کرد.
