با ظهور فناوریهای نوین و گسترش ابزارهای هوش مصنوعی، اصطلاحات سختافزاری جدیدی مانند پردازندههای مرکزی CPU، پردازندههای گرافیکی GPU، واحدهای پردازش عصبی NPU و حالا واحدهای پردازش تنسور یا همان TPU (Tensor Processing Unit) به ادبیات دنیای فناوری راه پیدا کردهاند. گوگل (Google) یکی از پیشگامان این حوزه است که از سال ۲۰۱۵ از پردازندههای اختصاصی TPU در مراکز داده خود برای محاسبات پیچیده ریاضی و یادگیری ماشین (Machine Learning) استفاده میکند. با این حال، نامگذاری این تراشهها گاهی گیجکننده میشود؛ چرا که گوگل در گوشی هوشمند پیکسل ۱۱ (Pixel 11) و تراشه تنسور جی ۶ (Tensor G6) نیز از اصطلاح TPU برای نامیدن پردازنده مختص کارهای هوش مصنوعی روی دستگاه (On-device) استفاده کرده است.
نگاهی به مشخصات فنی و عملکرد پردازندهها
برای درک بهتر تفاوتها، باید بدانیم که هرکدام از این تراشهها برای چه منظوری بهینهسازی شدهاند. تراشههای NPU پردازندههایی هستند که امروزه در اکثر گوشیهای هوشمند، مکبوکها و رایانههای شخصی یافت میشوند و کارهای سنگین مرتبط با هوش مصنوعی مولد مانند ویرایش عکس یا پردازشهای محلی را انجام میدهند. در سوی دیگر، پردازندههای GPU سالهاست که برای اجرای بازیهای سنگین گرافیکی، رندرینگ و اخیراً آموزش مدلهای هوش مصنوعی و استخراج رمزارز مورد استفاده قرار میگیرند و به عنوان ابزارهای چندکاره شناخته میشوند.
اما TPU مقیاس بسیار بزرگتری دارد. گوگل این تراشه اختصاصی را با معماری خاصی موسوم به آرایه سیستولیک (Systolic Array) طراحی کرده است که به دادهها اجازه میدهد به صورت شبکهای و دو بعدی بدون نیاز به بازگشت مداوم به حافظه، از یک واحد به واحد دیگر منتقل شوند. این ویژگی منحصربهفرد باعث حذف گلوگاههای ارتباطی، کاهش تأخیر و افزایش بهرهوری انرژی میشود؛ مزیتی حیاتی که شرکتهایی مانند آنتروپیک (Anthropic) و میدجرنی (Midjourney) برای پاسخگویی به میلیاردها درخواست روزانه هوش مصنوعی به آن وابستهاند.
مقایسه کاربردها و تاثیر بر بازار فناوری
تفاوت اصلی میان این تراشهها در مقیاس و موارد استفاده آنها نهفته است. در حالی که TPUهای ابری در مقیاس وسیع در مراکز داده عظیم گوگل فعالیت میکنند، NPUها و TPUهای محلی به دلیل مصرف انرژی بسیار پایین، برای پردازشهای سبکتر روی دستگاههای همراه مانند ترجمه همزمان یا جلوههای دوربین به کار گرفته میشوند. پردازندههای گرافیکی یا همان GPUها نیز به دلیل انعطافپذیری بالا، هم در مقیاسهای کوچک و هم بزرگ کاربرد دارند و برای اجرای بازیها و مدلهای زبانی بزرگ محلی گزینهای ایدهآل محسوب میشوند.
در نهایت، هیچکدام از این تراشهها به دیگری برتری مطلق ندارند و هرکدام در حوزه تخصصی خود بهترین عملکرد را ارائه میدهند. پردازندههای NPU و TPUهای محلی به لطف مصرف انرژی بهینه، ستون فقرات هوش مصنوعی در گجتهای همراه هستند، در حالی که TPUهای ابری چرخهای اقتصاد هوش مصنوعی در مقیاس جهانی را به حرکت درمیآورند و GPUها همچنان پادشاهان انعطافپذیری و قدرت پردازشی گرافیکی باقی ماندهاند.
