شرکت هوش مصنوعی چینی دیپسیک (DeepSeek) ابزارهای برنامهنویسی متنباری را با همکاری شرکت هوآوی (Huawei) برای تراشههای هوش مصنوعی اسند (Ascend AI chips) این شرکت عرضه کرده است؛ اقدامی که بخشی از تلاشها برای کاهش وابستگی به اکوسیستم نرمافزاری و سختافزاری انوییدیا (Nvidia) به شمار میرود. بر اساس گزارش ۳۰ سپتامبر رویترز، این انتشار شامل کتابخانههای متنباز برای محاسبات هوش مصنوعی و ارتباط تراشه با تراشه، و همچنین پشتیبانی اسند از زبان برنامهنویسی سطح بالای تایللنگ (TileLang) است.
دیپسیک (DeepSeek) میگوید این ابزارها — که هوآوی (Huawei) در طول توسعه آنها پشتیبانی کامل را ارائه کرده است — با هدف سادهسازی برنامهنویسی و در عین حال توانمندسازی توسعهدهندگان برای بهرهبرداری کامل از عملکرد سختافزار طراحی شدهاند. این دو شرکت همچنین برای بهینهسازی محاسبات و ارتباطات روی یک سیستم سوپرنود ساختهشده پیرامون ۱۲۸ تراشه اسند ۹۵۰ (Ascend 950 chips) با یکدیگر همکاری کردند. این کار به دو نیاز اصلی برای اجرای بارهای کاری بزرگ هوش مصنوعی در چندین شتابدهنده پاسخ میدهد: انجام کارآمد محاسبات روی هر تراشه و جابجایی سریع دادهها بین آنها برای مشغول نگه داشتن پردازندهها.
کتابخانههای منتشر شده شامل دیپجیئیامام-اسند (DeepGEMM-Ascend) است که ضرب ماتریس و سایر محاسبات مورد استفاده در مدلهای دیپسیک (DeepSeek) را مدیریت میکند. این کتابخانه از عملیاتهای BF16، FP8 و FP4 پشتیبانی میکند و از همان رابطهای برنامهنویسی کتابخانه موجود دیپسیک (DeepSeek) یعنی DeepGEMM استفاده میکند و به توسعهدهندگان اجازه میدهد هنگام انتقال به اسند (Ascend)، رابطهای برنامهنویسی کاربردی (APIs) آشنا را حفظ کنند. در همین حال، دیپئیپی-اسند (DeepEP-Ascend) ارتباطات مربوط به آموزش و استنتاج، از جمله مسیریابی دادهها به کارشناسان مختلف در مدلهای ترکیبی از کارشناسان و ترکیب خروجیهای آنها را مدیریت میکند. هر دو کتابخانه روی سختافزار اسند ۹۵۰ (Ascend 950) توسعه یافته و آزمایش شدهاند.
تایللنگ (TileLang) لایه برنامهنویسی سطح بالاتری را برای نوشتن هستههای بهینهشده فراهم میکند. دیپسیک (DeepSeek) آن را به عنوان ارائهدهنده «یک مدل برنامهنویسی سادهتر» نسبت به CUDA شرکت انوییدیا (Nvidia) توصیف کرد که هدف آن بهبود بهرهوری توسعه و سادهسازی کد است. این زبان در حال حاضر از انوییدیا (Nvidia) و سایر سختافزارها پشتیبانی میکند و آداپتورهای قبلی برای پردازندههای اسند (Ascend) شرکت هوآوی (Huawei) در دسترس هستند. بهروزرسانی ۳۰ سپتامبر پشتیبانی بومی را برای اسند ۹۵۰ (Ascend 950)، از جمله تولید کد، زمانبندی خودکار و همگامسازی اضافه میکند.
این ابزارها بر اساس پلتفرم نرمافزاری موجود هوآوی (Huawei) یعنی CANN ساخته شدهاند که زیرساخت زیربنایی را برای اجرای بارهای کاری هوش مصنوعی روی اسند (Ascend) فراهم میکند. پلتفرم CUDA شرکت انوییدیا (Nvidia) مدتهاست که محیط برنامهنویسی بالغ و کتابخانههای بهینهشدهای را برای پردازندههای گرافیکی (GPUs) خود در اختیار توسعهدهندگان قرار داده است و اکوسیستم نرمافزاری را به بخش عمدهای از مزیت این شرکت در محاسبات هوش مصنوعی تبدیل کرده است. در حالی که انتشار دیپسیک (DeepSeek) ابزارهای اضافی را برای بهینهسازی بارهای کاری روی سختافزار هوآوی (Huawei) در اختیار توسعهدهندگان قرار میدهد، پشتیبانی تایللنگ (TileLang) از پلتفرمهای چندگانه تضمین میکند که این زبان برای پردازندههای گرافیکی انوییدیا (Nvidia) نیز مفید باقی بماند.
این اعلامیه دو هفته پس از آن منتشر شد که هوآوی (Huawei) نسل بعدی پردازندههای هوش مصنوعی و سیستمهای سوپرنود خود را رونمایی کرد. هوآوی (Huawei) اعلام کرد که انتظار دارد سیستمهای هوش مصنوعی آن در سال ۲۰۲۷ به طور گسترده برای آموزش مدل مورد استفاده قرار گیرند. این شرکتها پیش از این روی مدل وی ۴ (V4) شرکت دیپسیک (DeepSeek) — که در ماه آوریل در قالب پیشنمایش با پشتیبانی از تراشههای اسند (Ascend) شرکت هوآوی (Huawei) منتشر شد — همکاری کرده بودند. هوآوی (Huawei) اعلام کرد که سوپرنودهای اسند ۹۵۰ (Ascend 950) مدلهای V4 را به طور کامل پشتیبانی میکنند و تراشههای آن برای بخشی از آموزش مدل سبکتر V4-Flash استفاده شده است.
منبع: tomshardware.com
