استفاده OpenAI از تراشه‌های تورین AMD در کنار هالوپینو

شرکت OpenAI در استقرار سخت‌افزاری خود از پردازنده‌های ای‌ام‌دی اپیک تورین (AMD EPYC Turin) به عنوان میزبان استفاده می‌کند و پردازنده ورا (Vera) انویدیا را دارای سطح پختگی پایین‌تری می‌داند.

تتیم تحریریه۴ دقیقه مطالعه۰ بازدیدهمین حالا
استفاده OpenAI از تراشه‌های تورین AMD در کنار هالوپینو

تراشه جدید هالوپینو (Jalapeño) شرکت OpenAI به صورت داخلی در کنار میزبان‌های ای‌ام‌دی اپیک تورین (AMD EPYC Turin) که هر کدام دارای ۱.۵ ترابایت حافظه هستند، مستقر می‌شود. تحلیل نیمه‌رسانا (SemiAnalysis) استقرار در مقیاس رک هالوپینو را پس از رونمایی از این تراشه شرح داد که ما در مصاحبه‌ای با ریچارد هو (Richard Ho)، معاون و رئیس بخش سخت‌افزار در OpenAI، درباره آن پرسیدیم. هو به ما گفت که تصمیم برای استفاده از تورین «عمل‌گرایانه» بوده و پردازنده جدید ورا (Vera) انویدیا را «از نظر آن سطح پختگی... کمی عقب‌تر» توصیف کرد.

هو به بخش پریموم تامز هاردور (Tom’s Hardware Premium) گفت: «رویکرد ما نسبت به آن طراحی واقعاً از نظر کاهش ریسک و توانایی انجام سریع آن طراحی بود. ورا به عنوان یک پردازنده مستقل، از نظر آن سطح پختگی کمی عقب‌تر است. دستگاه تورین قدرتمند است. این تراشه کاری را که ما نیاز داشتیم انجام داد و تا حدی شرکای ما نیز مقداری تجربه با آن داشتند. برای برنامه هالوپینو، ما تلاش می‌کردیم تصمیمات بسیار عمل‌گرایانه‌ای بگیریم. ما می‌خواستیم در اهداف عملکرد و هزینه تهاجمی باشیم، اما نمی‌خواستیم ریسک‌های غیرضروری را بپذیریم. این تصمیم طراحی خوبی به نظر می‌رسید که در پارامترهای نحوه اتخاذ این تصمیمات طراحی قرار می‌گیرد.»

پردازنده‌های مبتنی بر آرم (Arm) زیادی در بازار وجود دارند که بسیاری از آن‌ها به صورت داخلی در ابرمقیاس‌دهندگان مختلف مانند اکسیوم (Axiom) گوگل کلود و گراویتون (Graviton) ای‌دابلیو‌اس مستقر شده‌اند، اما ورا و ای‌جی‌آی (AGI) اختصاصی آرم به عنوان پردازنده‌های عامل (agentic CPUs) توصیف شده‌اند که ادعا می‌شود استدلال پیچیده درگیر در حلقه‌های عامل را در مقایسه با همتایان x86 خود از ای‌ام‌دی و اینتل سرعت می‌بخشد. ما در مورد این پویایی و اینکه چرا تورین با توجه به رابطه کاری نزدیک بین OpenAI و انویدیا انتخاب درستی بوده است، از هو پرسیدیم که او با نقل‌قول بالا پاسخ داد.

آرم مدت‌هاست که مزایای معماری AArch64 را در مقایسه با x86 تبلیغ کرده و تا آنجا پیش رفته که ادعا می‌کند پردازنده AGI خود بیش از دو برابر عملکرد پلتفرم‌های مدرن x86 را ارائه می‌دهد. با این حال، این ادعا بر اساس تخمین‌های داخلی است، نه بنچمارک‌های واقعی. این شرکت به طور طبیعی نسبت به پذیرش AGI در بازار خوش‌بین بوده است، اما حتی با وجود تعهد چشمگیر ۲ میلیارد دلاری، تحلیلگران می‌گویند نفوذ بازار پس از دو سال همچنان در تک‌رقمی پایین باقی خواهد ماند.

با انفجار تقاضا برای پردازنده‌های سرور در سال جاری و بارهای کاری در حال تکامل عامل، انویدیا در خط مقدم پیام‌رسانی بوده و پردازنده مبتنی بر آرم خود یعنی ورا را با رقیب x86 مقایسه کرده و با اطمینان مدعی بهبود ۱.۸ برابری نسبت به تراشه رقیب ای‌ام‌دی تورین شده است؛ رقمی که از یک مجموعه بنچمارک کلی استخراج شده که نشان می‌دهد ورا تنها ۳ درصد جلوتر از EPYC 9755 ای‌ام‌دی است.

بسیاری از طراحی‌های نیمه سفارشی آرم، از گراویتون گرفته تا کبالت (Cobalt) ایژور (Azure)، روی تراکم هسته و بهره‌وری برای بارهای کاری ابری تمرکز کرده‌اند. ورا و AGI تغییری به سمت پیام‌رسانی در برابر اوج عملکرد هستند. در بنچمارک‌های اولیه ورا، پردازنده انویدیا چشمگیر به نظر می‌رسد، যদিও ما هنوز این تراشه را در عمل در طیف گسترده‌ای از بارهای کاری ندیده‌ایم، چه رسد به اینکه در برابر پردازنده‌های آینده ونیز (Venice) ای‌ام‌دی یا دایموند رپیدز (Diamond Rapids) اینتل بنچمارک شود.

نکته جالب در مورد تصمیم OpenAI برای استفاده از تورین این است که این شرکت یکی از شرکای استقرار آرم برای AGI و همچنین در میان فهرست مشتریانی است که «در حال بررسی پردازنده ورا هستند»، بر اساس اعلام انویدیا. OpenAI، سایر آزمایشگاه‌های پیشرو و ابرمقیاس‌دهندگان طیف گسترده‌ای از سخت‌افزار را در ناوگان خود نگه می‌دارند. جفت کردن هالوپینو به طور خاص با تورین به کاهش ریسک ختم شد و هو به پختگی پلتفرم اشاره کرد.

به طور کلی، x86_64 از AArch64 بالغ‌تر است؛ آرم از اواسط دهه ۱۹۸۰ وجود داشته است، যদিও یک پسوند ۶۴ بیتی مناسب ۱۲ سال پس از معرفی آن در x86 ظاهر نشد. و اگرچه آرم در دو دهه گذشته راه خود را به مراکز داده باز کرده است، اما هنوز یک پایه بسیار عمیق‌تر x86 وجود دارد که چندین دهه به عقب بازمی‌گردد.

با این حال، به نظر نمی‌رسد نظرات هو به‌طور خاص در مورد تفکیک بین AArch64 و x86 باشد. در عوض، نظرات بر روی پویایی بین تورین ورا متمرکز است که دومی اولین ورود انویدیا به یک هسته پردازنده سفارشی برای مرکز داده است. اگرچه بنچمارک‌های اولیه ورا چشمگیر هستند، اما با این وجود نشان‌دهنده یک ریسک غیرضروری برای استقرار هالوپینو در مقیاس رک OpenAI بود.

اظهارات هو درباره اینکه شرکای OpenAI با تورین تجربه دارند نیز نشان می‌دهد که تفکر تیم سخت‌افزاری در کجا بوده است. تفاوت‌هایی در عملی بودن سرویس‌دهی به سیستم میزبان بین تورین و ورا وجود دارد، به‌ویژه این واقعیت که ورا روی برد نصب می‌شود در حالی که تراشه‌های تورین دارای سوکت هستند؛ تعویض تراشه‌ها به هر حال در یک سرور رایج نیست، اما با تورین آسان‌تر است.

با توجه به اینکه OpenAI ناوگانی از سخت‌افزار را در اختیار دارد، این امکان وجود دارد که هالوپینو در آینده با یک سیستم میزبان متفاوت مستقر شود و به طور بالقوه با AGI آرم یا ورا انویدیا جفت شود. با این حال، در حال حاضر تورین انتخاب درستی بود.


منبع: tomshardware.com

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.