به دنبال عرضه پردازندههای EPYC 'Venice' شرکت ایامدی (AMD) در ماه جولای، این شرکت در روز جمعه ادعاهای مربوط به عملکرد نسل آینده تراشههای سرور خود را گسترش داد. ادعای سطح بالا تغییری نکرده است. شرکت ایامدی همچنان میگوید که یک تراشه ونیز (Venice) با فرکانس بالا و ۹۶ هسته، در تست نرخ عدد صحیح SPEC CPU 2026 حدود ۲۰ درصد سریعتر از تراشه ۸۸ هستهای انویدیا (Nvidia) ورا (Vera) است. با این حال، این شرکت در یک وایتپیپر جدید وارد جزئیات بسیار بیشتری درباره بنچمارکها شد.
تفاوتهای پیکربندی متعددی بسته به بنچمارک در سراسر وایتپیپر ایامدی (AMD) وجود دارد و اگرچه ما در اینجا این تفاوتها را تا حد توان خود اعلام میکنیم، اما تمام جزئیات را در اختیار نداریم. به ویژه برای مقایسه ورا (Vera)، شرکت ایامدی در حال ترکیب دادههای منابع مختلف است و در برخی موارد، از نسخههای اصلی مختلف مجموعه کامپایلر گنو (GCC) استفاده میکند. این موضوع میتواند تأثیر قابل توجهی بر عملکرد داشته باشد، بنابراین با احتیاط به آن نگاه کنید.
اولین نتایج در SPEC CPU 2026 با تست intrate است که کل توان عملیاتی را بررسی میکند. اینها اعداد قدیمیتری هستند که در ماه جولای با GCC 15.2 جمعآوری شدهاند. تست intrate چندین نسخه از یک برنامه را روی یک پردازنده اجرا میکند و روش استاندارد این است که یک نسخه به ازای هر رشته اجرا شود. احتمالاً ایامدی (AMD) نیز در اینجا همین کار را کرده است، اما وایتپیپر این موضوع را روشن نمیکند، حتی در پانویسها.
بر اساس اسلاید، مدل ۲۵۶ هستهای 9996 به میزان 2.37 برابر سریعتر از پردازنده اینتل زئون 6980P (Intel Xeon 6980P) و 2.24 برابر سریعتر از ورا (Vera) است. وایتپیپر روشن میکند که پردازنده مرموز 9006 همان پرچمدار ۲۵۶ هستهای است. شاید چشمگیرترین بخش، مقایسه نسلی ایامدی (AMD) باشد. بر اساس این نتایج، مدل 9996 حدود ۷۸ درصد سریعتر از پردازنده نسل قبلی EPYC 9965 با ۱۹۶ هسته است.
اگرچه نتایج سطح بالا دادههایی را از اینتل (Intel) و آمازون وب سرویس (AWS) وارد میکند، اما بیشتر وایتپیپر مستقیماً بر روی مقایسه بین ونیز (Venice) و ورا (Vera) تمرکز داشت. ایامدی (AMD) زیرتستهای فردی SPEC CPU 2026 intrate را در وایتپیپر تجزیه کرد که در ادامه میتوانید مشاهده کنید.
این مقایسه طبیعتاً برای ایامدی (AMD) خوب به نظر میرسد،虽然 البته چند ایراد در پیکربندی وجود دارد. ایامدی (AMD) در حال تست یک پردازنده EPYC 9996 با هستههای کاهشیافته است و تعداد هستهها را از ۲۵۶ به ۹۶ کاهش داده است. این شرکت هیچ اشارهای به بودجه توان مصرفی نکرد، اما زمانی که ایامدی (AMD) در ابتدا اعداد SPEC را به اشتراک گذاشت، مدل ۹۶ هستهای به همان توان ۶۰۰ وات مدل ۲۵۶ هستهای دسترسی داشت - مدل ونیز با فرکانس بالا و ۹۶ هستهای ایامدی (AMD) در نهایت به ۵۰۰ وات میرسد. با این حال، کامپایلر اهمیت بیشتری دارد. ایامدی (AMD) از GCC 16.1 استفاده میکند و نتایج را با نتایجی که انویدیا (Nvidia) در وایتپیپر ورا (Vera) خود به اشتراک گذاشته است، مقایسه میکند. انویدیا (Nvidia) از GCC 15.2 استفاده کرده بود.
مایکل لارابل (Michael Larabel) در وبسایت Phoronix یک مقاله عالی درباره تفاوت بین GCC 15 و 16 نوشته است، اما خلاصه داستان این است که تفاوتهای عملکردی وجود دارد، که همیشه هم به سمت بهتر شدن نیست. GCC 16 به دلیل بهینهسازیهای بهتر زمان بیشتری برای کامپایل میبرد، از این رو امتیازات پایینتری در کامپایلهای GCC و LLVM بالا وجود دارد. با این حال، این امر منجر به باینریهای سریعتر میشود. میزان آن به پرچمها، نرمافزار و مجموعهای از عوامل دیگر بستگی دارد. صرف نظر از این، مقایسه بنچمارکها با استفاده از دو نسخه مختلف کامپایلر بهترین رویه نیست.
صحبت از Phoronix شد، ایامدی (AMD) برخی دادهها را برای تست اولیه و کنترلشده این نشریه از ورا (Vera) استخراج کرد. در بالا، میتوانید Stream را ببینید که یک بنچمارک استاندارد صنعتی برای اندازهگیری پهنای باند حافظه است. باز هم، ایامدی (AMD) از یک مدل 9996 با هستههای کاهشیافته از ۲۵۶ به ۹۶ استفاده میکند و بودجه توان ۶۰۰ واتی را به آن اختصاص میدهد. با این وجود، این یک نمایش چشمگیر است، زیرا ورا (Vera) مطلقاً رقبا را در نتایج اصلی Stream این نشریه در هم کوبیده بود. در اینجا، ایامدی (AMD) حدود ۱۸ درصد جلوتر است و عملکرد به ازای هر هسته حدود ۸ درصد جلوتر است.
فراتر از ورا (Vera)، ایامدی (AMD) همچنین عملکرد را در بارهای کاری ابری، از جمله پایگاه داده، جاوا و رمزنگاری نشان داد. بار دیگر، مقایسه نسلی برجسته است، زیرا ایامدی (AMD) پیش از این با تراشههای نسل قبلی خود در این بارهای کاری پیشتاز بود. ایامدی (AMD) این تستها را خودش اجرا کرد، به جای اینکه به دادههای شخص ثالث اعتماد کند، اگرچه نتایج Graviton5 از یک نمونه ابری AWS به دست آمده است.
به همین ترتیب، در بارهای کاری پردازش پرقدرت (HPC)، ایامدی (AMD) پیشی گرفتن خود را از محصول پرچمدار گرانایت رپیدز-ایپی (Granite Rapids-AP) اینتل بیشتر میکند. پردازندههای نسل بعدی مراکز داده اینتل، با نام رمز دایاموند رپیدز (Diamond Rapids)، قرار است سال آینده عرضه شوند.
در نهایت، ما «عملکرد بار کاری هوش مصنوعی عاملمحور» را داریم که برخلاف آنچه نامهای نمودار بالا نشان میدهند، از بنچمارکهای واقعی برای مقایسه استفاده میکند. از چپ به راست، ایامدی (AMD) از NGINX، کیت TPCx-AI، FAISS، TPC-H و TPC-C و پخش مجدد یک عامل چند شخصیتی استفاده کرد. برای TPC-H و TPC-C، ایامدی (AMD) میگوید که بارهای کاری را از آن بنچمارکها مشتق کرده است، بنابراین نتایج در اینجا قابل مقایسه با نتایج منتشر شده نیستند.
اگرچه نگاه کردن به نتایج بنچمارک همیشه جالب است، اما درcontext استقرار سرور، حداقل در مقیاسی که ایامدی (AMD) هدف قرار داده است، حرف چندانی برای گفتن ندارد. از این گذشته، حداکثر عملکرد تنها یکی از عوامل اصلی است که در استقرار سرورها نقش دارد و حتی در این صورت، عملکرد میتواند بسته به نرمافزاری که اجرا میکنید و نحوه ساخت آن به شدت متفاوت باشد.
با این وجود، ونیز (Venice) چشمگیر به نظر میرسد، شاید در مقایسه نسلی بیشتر از هر مقایسه رقابتی دیگری. امیدواریم این امر نویدبخش عرضهی آیندهی Zen 6 ایامدی (AMD) در دسکتاپهای مصرفکننده باشد، اما پیش از نتیجهگیری در این زمینه باید منتظر بمانیم تا تیم سرخ (Team Red) اطلاعات بیشتری را به اشتراک بگذارد.
منبع: tomshardware.com
