سخت‌گیری آمازون بر روی هدررفت پردازنده میان مهندسان

شرکت آمازون وب سرویس (AWS) به دلیل افزایش شدید تقاضا برای پردازنده‌ها در دوران هوش مصنوعی عام خودمختار، مهندسان خود را ملزم به کاهش هدررفت پردازنده و بهینه‌سازی نمونه‌های EC2 کرده است.

تتیم تحریریه۴ دقیقه مطالعه۰ بازدید۱۴۰۵/۵/۲۰
سخت‌گیری آمازون بر روی هدررفت پردازنده میان مهندسان

شرکت آمازون وب سرویس (Amazon Web Services) به طور جدی با استفاده داخلی مهندسان خود از نمونه‌های EC2 مقابله می‌کند. طبق گزارش وب‌سایت اینفورمیشن (The Information)، این شرکت در ماه مه طی جلساتی با مهندسان به آن‌ها دستور داد تا هدررفت پردازنده (CPU) را کاهش دهند تا اطمینان حاصل شود که آمازون وب سرویس (AWS) ظرفیت پردازنده کافی برای پاسخگویی به تقاضای مشتریان را در اختیار دارد. این پیام هم‌زمان با اوج‌گیری تقاضا برای پردازنده‌ها در مراکز داده مطرح می‌شود؛ جایی که نسبت سنتی هشت به یک یا چهار به یک کارت‌های گرافیک (GPU) به پردازنده‌ها (CPU)، در حال نزدیک شدن به برابری است.

نمونه‌های EC2 بخش بزرگی از اینترنت مدرن را تشکیل می‌دهند و در استقرارهای خصوصی نیز مورد استفاده قرار می‌گیرند. به طور سنتی، مهندسان آمازون توانسته‌اند نمونه‌های اختصاصی خود را برای توسعه راه‌اندازی کنند و با بهره‌گیری از میزان پایین‌تر استفاده از پردازنده که برای زیرساخت وب نیاز است، ماشین‌های مجازی بیشتری را به کار بگیرند. اکنون مهندسان می‌گویند که برای دسترسی به این نمونه‌ها باید روزها انتظار بکشند، در حالی که پیش‌تر می‌توانستند ظرف چند ساعت به آن‌ها دسترسی پیدا کنند. یک مهندس به نشریه اینفورمیشن (The Information) گفت که حتی پس از چندین سال کار در آمازون، هرگز مجبور نبوده برای یک نمونه این مدت طولانی صبر کند.

آمازون چندین نوع مختلف از پردازنده‌ها را در نمونه‌های EC2 مستقر می‌کند؛ از جمله گزینه‌هایی مبتنی بر ای‌ام‌دی (AMD) و اینتل (Intel) و همچنین تراشه نسبتاً جدید گریویتون ۵ (Graviton5) این شرکت. گریویتون ۵ قدرتمندترین پردازنده آمازون تا به امروز است و از یک معماری مبتنی بر آرم (Arm) مشابه پردازنده ورا (Vera) شرکت انویدیا (Nvidia) و ای‌جی‌آی (AGI) اختصاصی آرم استفاده می‌کند.

افزایش تقاضا برای پردازنده به دلیل ظهور عوامل هوش مصنوعی (AI agents) رخ داده است؛ پارادایمی جدید در بهره‌وری که حتی شرکت‌های بزرگی مانند آمازون نیز در تقلا برای کنار آمدن با آن هستند. برای مثال، ماه گذشته یک عامل برنامه‌نویسی هزینه‌ای معادل ۱.۸ میلیون دلار توکن در آمازون به بار آورد و بودجه توسعه را ۸۶۰ درصد پشت سر گذاشت.

بخش عمده‌ای از زیرساخت‌های هوش مصنوعی موجود حول محور استنتاج (inference) طراحی شده‌اند؛ بار کاری که توسط پردازنده‌های گرافیکی (GPU) شتاب می‌گیرد. با نسبت چهار به یک، پردازنده صرفاً به عنوان ابزاری برای تغذیه کارت‌های گرافیک عمل می‌کرد و بس. با این حال، بارهای کاری عامل‌محور (agentic) بسیار پیچیده‌تر هستند. آن‌ها اغلب شامل فرایندهای ابزاری روی پردازنده و همچنین ارکستراسیون پیچیده‌تر استنتاج روی کارت‌های گرافیک می‌شوند. این همان چیزی است که پردازنده‌ها را در عصر عامل‌های هوش مصنوعی به مرکز توجه آورده است. شرکت‌های اینتل (Intel)، ای‌ام‌دی (AMD) و دیگران دیدگاه‌هایی را که طی چند ماه گذشته از سوی شرکت‌های تولیدکننده حافظه و ذخیره‌سازی شنیده بودیم، تکرار کرده‌اند: تقاضا برای پردازنده‌ها به قدری بالا است که بیشتر شرکت‌ها هر چه گیرشان بیاید را می‌پذیرند.

بازیگران اصلی در حال سرمایه‌گذاری روی این تقاضا هستند. شرکت ای‌ام‌دی (AMD) اخیراً سبد محصولات پردازنده‌های مرکز داده زن ۶ ونیز (Zen 6 'Venice') خود را معرفی کرد که نشان‌دهنده اولین باری است که ای‌ام‌دی طی دهه‌های اخیر، یک معماری جدید را پیش از بازار کلاینت در مرکز داده عرضه می‌کند. انویدیا (Nvidia) نیز تمرکز پیام‌رسانی خود را از شتاب‌دهنده‌ها به سمت پردازنده جدید ورا (Vera) معطوف کرده است تا سهم خود را در بازار در حال گسترش زیرساخت‌های هوش مصنوعی عامل‌محور تضمین کند.

اگرچه آمازون با چالش ظرفیت پردازنده در میان مهندسان داخلی و مشتریان خارجی خود دست‌وپنجه نرم می‌کند، اما اینفورمیشن گزارش می‌دهد که کمبودها عمدتاً برای نمونه‌های اسپات (spot instances) مشکل‌ساز است. یک مشاور به این رسانه گفت که ظرفیت‌های قراردادی هیچ‌گونه کمبودی را تجربه نکرده‌اند.

پس از انتشار این مطلب، یکی از سخنگویان آمازون وب سرویس (AWS) با ارسال بیانیه‌ای اعلام کرد:

«تقاضا برای خدمات AWS، از جمله EC2، فوق‌العاده قوی است و رشد می‌کند. حتی با وجود این تقاضای سنگین، ما همچنان به تأمین اکثریت قریب به اتفاق نیازهای محاسباتی برای مشتریان داخلی و خارجی خود ادامه می‌دهیم. ما از نزدیک با تیم‌های داخلی همکاری می‌کنیم تا نیازهای محاسباتی آن‌ها را برآورده سازیم و در عین حال اطمینان حاصل کنیم که آن‌ها از منابع EC2 به کارآمدترین شکل ممکن استفاده می‌کنند؛ اقداماتی نظیر بازپس‌گیری نمونه‌های بی‌حاصل، تنظیم اندازه مناسب (right-sizing) و مقیاس‌پذیری رو به بالا و پایین با تغییر نیازها - درستهمان‌طور که همیشه انجام داده‌ایم. این بهره‌وری‌ها به مدیریت ظرفیت برای مشتریان داخلی و خارجی کمک می‌کند و هرگونه این فرض که این تلاش‌های دیرینه نشان‌دهنده محدودیت‌های جدید ظرفیت است، کاملاً نادرست است.»

این پیش‌فرض بزرگ‌نمایی شده است. صرفه‌جویی از روز اول در DNA ما وجود داشته است. ما همیشه تیم‌های خود را تشویق کرده‌ایم که کارآمد عمل کنند. ما همچنین بهترین روش‌ها را برای نحوه بهینه‌سازی منابع با مشتریان خارجی به اشتراک می‌گذاریم. این یک دستورالعمل جدید نیست و تشویق به استفاده کارآمد از منابع مختص آمازون نیست.»

ما از آمازون پرسیدیم که آیا به مهندسان مهلتی برای کاهش مصرف محاسباتی داده شده است یا خیر، همان‌طور که اینفورمیشن (The Information) در ابتدا گزارش داده بود. سخنگوی AWS پاسخ داد: «این روایت درباره EC2 نادرست است. به عنوان بخشی از عملیات تجاری معمولی خود و با پشتیبانی اصل رهبری خود یعنی صرفه‌جویی، ما همواره در حال ارتقای بهره‌وری در تمامی منابع خود هستیم تا اطمینان حاصل کنیم تیم‌ها در حال بهینه‌سازی ظرفیت هستند.»

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.