جزئیات نقشه راه هوش مصنوعی هواوی و سرعت‌بخشیدن به واحدهای پردازش عصبی (NPU) آسند

شرکت هواوی نقشه راه سخت‌افزار هوش مصنوعی خود را با افزودن شتاب‌دهنده‌های جدید بروزرسانی کرد و نسل بعدی واحدهای پردازش عصبی آسند (Ascend NPU) را جلو انداخت.

تتیم تحریریه۶ دقیقه مطالعه۰ بازدید۱۹ ساعت پیش
جزئیات نقشه راه هوش مصنوعی هواوی و سرعت‌بخشیدن به واحدهای پردازش عصبی (NPU) آسند

شرکت هواوی (Huawei) نقشه راه سخت‌افزار هوش مصنوعی (AI) خود را با افزودن شتاب‌دهنده‌های جدید و پردازنده‌های پشتیبان و همچنین جلو انداختن شتاب‌دهنده‌های نسل بعدی آسند ۹۶۰ (Ascend 960) در رویداد سالانه هواوی کانکت (Huawei Connect) بروزرسانی کرده است. به‌طور خاص، این شرکت نقشه راه آسند ۹۶۰ (Ascend 960) را تسریع بخشید، مشخصات آسند ۹۷۰ (Ascend 970) و ۹۸۰ (980) را فاش کرد، معماری پریوم (Peerium) خود را بر اساس یونیفایدباس (UnifiedBus) معرفی نمود و سبد زیرساخت هوش مصنوعی یکپارچه عمودی خود را گسترش داد.

شرکت هواوی (Huawei) در حال حاضر در میانه گذار از معماری‌های SIMD است که تقریباً یک دهه با شتاب‌دهنده‌های آسند (Ascend) (یا واحدهای پردازش عصبی، آن‌گونه که این شرکت ترجیح می‌دهد آن‌ها را بنامد) استفاده کرده است، به سمت معماری‌های کاملاً جدید SIMD+SIMT که پردازش مبتنی بر بردار و موازی‌سازی در سطح ترد را برای بهبود بهره‌وری سخت‌افزار و عملکرد در بارهای کاری مختلف هوش مصنوعی دور هم جمع می‌کنند (SIMD برای عملیات موازی داده‌ها و SIMT برای بارهای کاری سنگین از نظر انشعاب).

اولین واحدهای پردازش عصبی آسند (Ascend NPU) که معماری جدید هواوی (Huawei) را اتخاذ می‌کنند، آسند 950PR (Ascend 950PR) برای پیش‌پر و توصیف، و همچنین آسند 950DT (Ascend 950DT) برای رمزگشایی و آموزش هستند. هواوی (Huawei) در این رویداد گفت که پلتفرم آسند ۹۵۰ (Ascend 950) در حال محبوبیت است زیرا سیستم‌های اتلس 950 سوپرپاد (Atlas 950 SuperPoD) از پیش در کاربرد تجاری در مقیاس بزرگ قرار دارند، هرچند که جزئیات بیشتری ارائه نکرد. این شرکت اعلام کرد که آزمایش‌های آسند 950DT (Ascend 950DT) با تمرکز بر آموزش «نتایج خوبی» به همراه داشته است و انتظار دارد تعداد زیادی از توسعه‌دهندگان هوش مصنوعی چینی سال آینده آموزش مدل‌ها را روی سیستم‌های مبتنی بر 950DT آغاز کنند. در همین حال، هواوی (Huawei) اذعان کرد که ظرفیت تولید این شرکت برای برآورده کردن تقاضای داخلی همچنان ناکافی است.

در واقع، در سپتامبر ۲۰۲۵، هواوی (Huawei) حداکثر پیکربندی اتلس 950 سوپرپاد (Atlas 950 SuperPoD) را به عنوان ۲۰۴۸ پردازنده مرکزی کونگ‌پنگ 950 (Kungpeng 950)، ۸۱۹۲ واحد پردازش عصبی آسند 950DT (Ascend 950DT)، ۱۶۰ رک (۱۲۸ پردازش + ۳۲ ارتباطات)، ۸ اگزافلاپس FP8، ۱۶ اگزافلاپس FP4، و ۱۶ پتابایت بر ثانیه پهنای باند اتصال متقابل تجمیعی اعلام کرد. با این حال، در جولای ۲۰۲۶ هواوی (Huawei) به‌طور عمومی یک پیاده‌سازی واقعی از اتلس 950 سوپرپاد (Atlas 950 SuperPoD) را با ۲۵۶ پردازنده مرکزی و همچنین ۱۰۲۴ کارت شتاب‌دهنده نشان داد که بسیار پایین‌تر از حداکثر پیکربندی است. در حالی که این شرکت همچنان معماری را به عنوان مقیاس‌پذیر تا ۸۱۹۲ واحد پردازش عصبی توصیف می‌کند، اما در وب‌سایت آن فهرست نشده است، بنابراین ما فقط می‌توانیم تعجب کنیم که چه سیستم‌هایی اکنون در کاربرد تجاری در مقیاس بزرگ هستند.

در حال حاضر، به نظر می‌رسد پذیرش اتلس 950 سوپرپاد (Atlas 950 SuperPod) به سرعت پیش نمی‌رود، شاید به دلیل عرضه ناکافی، یا شاید به خاطر معماری کاملاً جدیدی که نیازمند بازطراحی عمده نرم‌افزار است. در هر صورت، اتلس 950 سوپرپاد (Atlas 950 SuperPod) از بسیاری جهات یک راه‌حل آزمایشی برای این شرکت خواهد بود تا راه را برای شتاب‌دهنده‌های تواناتر سری آسند ۹۶۰ (Ascend 960) و جانشینان آن‌ها پاکسازی کند.

صحبت از آسند ۹۶۰ (Ascend 960) شد، این خانواده با آسند 960DT (Ascend 960DT) در سه ماهه اول سال ۲۰۲۷ آغاز خواهد شد، زمانی که قرار است به‌طور رسمی در دسترس قرار گیرد، یعنی سه فصل زودتر از آنچه قبلاً برنامه‌ریزی شده بود.

انتظار می‌رود شتاب‌دهنده آسند 960DT (Ascend 960DT) عملکردی معادل ۲ پتافلاپس FP8 و ۴ پتافلاپس FP4 ارائه دهد، دارای ۲۸۸ گیگابایت حافظه احتمالاً HiZQ با پهنای باند ۹.۶ ترابایت بر ثانیه باشد و از یک اتصال متقابل ۲.۲ ترابایت بر ثانیه بهره ببرد.

واحد پردازش عصبی آسند 960PR (Ascend 960PR) در سه ماهه سوم سال ۲۰۲۷، یک فصل زودتر از برنامه اولیه، با ۲ پتافلاپس FP8 برای آموزش، اما ۸ پتافلاپس FP4 برای استنتاج (۲ برابر بیشتر از آنچه هواوی (Huawei) سال گذشته اعلام کرد) از راه می‌رسد. این واحد دارای ۱۹۲ گیگابایت حافظه است که پهنای باند ۲.۴ ترابایت بر ثانیه را فراهم می‌کند و اتصال متقابل ۲.۲ ترابایت بر ثانیه را حفظ می‌کند. برای مقایسه: پردازنده گرافیکی وی‌آر۲۰۰ (VR200) شرکت انویدیا (Nvidia) که برای سه ماهه چهارم سال ۲۰۲۶ سررسید می‌شود، می‌تواند ۳۵ پتافلاپس NVFP4 برای آموزش و ۵۰ پتافلاپس NVFP4 برای استنتاج ارائه دهد در حالی که ۲۸۸ گیگابایت حافظه HBM4 را حمل می‌کند.

دیوید وانگ (David Wang)، معاون هیئت مدیره و رئیس چرخشی هواوی (Huawei) در سخنرانی اصلی خود گفت: «ما در حال تکامل دادن سری تراشه‌های آسند (Ascend) خود در یک چرخه یک نسل در سال هستیم. در سال‌های ۲۰۲۸ و ۲۰۲۹، ما به ترتیب تراشه‌های آسند ۹۷۰ (Ascend 970) و ۹۸۰ (980) را عرضه خواهیم کرد. به لطف قانون مقیاس‌گذاری تائو (Tau)، نه تنها مشخصات محاسباتی آن‌ها به دو برابر شدن ادامه خواهد داد، بلکه می‌توانید انتظار داشته باشید که پیشرفت‌های عظیمی را در سراسر هیئت مدیره از نظر پهنای باند حافظه، ظرفیت حافظه، پهنای باند اتصال متقابل و موارد دیگر مشاهده کنید.»

نقشه راه هواوی آسند

واحد پردازش عصبی (NPU)

انتشار هدف

معماری

عملکرد FP8

عملکرد FP4

حافظه

پهنای باند حافظه

پهنای باند اتصال متقابل

فرمت‌های پشتیبانی شده

آسند 910C (Ascend 910C)

۲۰۲۵ سه ماهه ۱

SIMD

۱۲۸ گیگابایت

۳.۲ ترابایت بر ثانیه

۷۸۴ گیگابایت بر ثانیه

FP32, HF32, FP16, BF16, INT8

آسند 950PR (Ascend 950PR)

۲۰۲۶ سه ماهه ۱

SIMD + SIMT

۱ پتافلاپس

۲ پتافلاپس

۱۲۸ گیگابایت HiBL 1.0

۱.۶ ترابایت بر ثانیه

۲.۰ ترابایت بر ثانیه

FP32, HF32, FP16, BF16, FP8, MXFP8, HiF8, MXFP4

آسند 950DT (Ascend 950DT)

۲۰۲۶ سه ماهه ۴

SIMD + SIMT

۱ پتافلاپس

۲ پتافلاپس

۱۴۴ گیگابایت HiZQ 2.0

۴.۰ ترابایت بر ثانیه

۲.۰ ترابایت بر ثانیه

FP32, HF32, FP16, BF16, FP8, MXFP8, HiF8, MXFP4

آسند 960DT (Ascend 960DT)

۲۰۲۷ سه ماهه ۱

SIMD + SIMT

۲ پتافلاپس

۴ پتافلاپس

۲۸۸ گیگابایت

۹.۶ ترابایت بر ثانیه

۲.۲ ترابایت بر ثانیه

FP32, HF32, FP16, BF16, FP8, MXFP8, HiF8, MXFP4, HiF4

آسند 960PR (Ascend 960PR)

۲۰۲۷ سه ماهه ۳

SIMD + SIMT

۲ پتافلاپس

۸ پتافلاپس

۱۹۲ گیگابایت

۲.۴ ترابایت بر ثانیه

۲.۲ ترابایت بر ثانیه

FP32, HF32, FP16, BF16, FP8, MXFP8, HiF8, MXFP4, HiF4

آسند 970 (Ascend 970)

۲۰۲۸

SIMD + SIMT

۳.۶ پتافلاپس

۱۴ پتافلاپس

۲۸۸ گیگابایت

۱۴.۴ ترابایت بر ثانیه

۴.۴ ترابایت بر ثانیه

FP32, HF32, FP16, BF16, FP8, MXFP8, HiF8, MXFP4, HiF4

آسند 980 (Ascend 980)

۲۰۲۹

SIMD + SIMT

۷.۲ پتافلاپس*

۲۸ پتافلاپس*

۳۸۴ گیگابایت

۳۸.۴ ترابایت بر ثانیه*

۸ ترابایت بر ثانیه*

FP32, HF32, FP16, BF16, FP8, MXFP8, HiF8, MXFP4, HiF4*

با شروع از سری آسند ۹۶۰ (Ascend 960) به بعد، هواوی (Huawei) قصد دارد یک ریتم یک نسل در سال را برای شتاب‌دهنده‌های هوش مصنوعی خود حفظ کند. جلو کشیدن آسند 960DT (Ascend 960DT) توسط چندین فصل، بدون شک یک دستاورد چشمگیر است. با این حال، چیزی که حتی فوق‌العاده‌تر است این است که هواوی (Huawei) موفق شده است عملکرد FP4 شتاب‌دهنده آسند 960PR (Ascend 960PR) را در مقایسه با انتظارات اولیه دو برابر کند، که احتمالاً به این معناست که این شرکت قابلیت‌های محاسباتی کم‌دقت پردازنده را به طور قابل توجهی بازسازی کرده است تا اینکه صرفاً زیرسیستم حافظه یا سرعت کلاک را تنظیم کرده باشد. در واقع، عملکرد FP4 چهار برابر بالاتر در مقایسه با FP8 قرار است یک ویژگی متمایز از آسند ۹۷۰ (Ascend 970) و ۹۸۰ (980) باشد.

آسند ۹۷۰ (Ascend 970) در سال ۲۰۲۸ با ۳.۶ پتافلاپس FP8، ۱۴ پتافلاپس FP4، ۲۸۸ گیگابایت حافظه با ارائه ۱۴.۴ ترابایت بر ثانیه، و ۴.۴ ترابایت بر ثانیه پهنای باند اتصال متقابل سررسید می‌شود. آسند ۹۸۰ (Ascend 980) در سال ۲۰۲۹ با ۷.۲ پتافلاپس FP8 و ۲۸ پتافلاپس FP4، به همراه ۳۸۴ گیگابایت حافظه با دستیابی به ۳۸.۴ ترابایت بر ثانیه و یک اتصال متقابل ۸ ترابایت بر ثانیه دنبال می‌شود. هواوی (Huawei) ارقام آسند ۹۸۰ (Ascend 980) را به عنوان مقدماتی علامت‌گذاری می‌کند.


منبع: tomshardware.com

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.