شرکت آمازون وب سرویس (Amazon Web Services) به طور جدی با استفاده داخلی مهندسان خود از نمونههای EC2 مقابله میکند. طبق گزارش وبسایت اینفورمیشن (The Information)، این شرکت در ماه مه طی جلساتی با مهندسان به آنها دستور داد تا هدررفت پردازنده (CPU) را کاهش دهند تا اطمینان حاصل شود که آمازون وب سرویس (AWS) ظرفیت پردازنده کافی برای پاسخگویی به تقاضای مشتریان را در اختیار دارد. این پیام همزمان با اوجگیری تقاضا برای پردازندهها در مراکز داده مطرح میشود؛ جایی که نسبت سنتی هشت به یک یا چهار به یک کارتهای گرافیک (GPU) به پردازندهها (CPU)، در حال نزدیک شدن به برابری است.
نمونههای EC2 بخش بزرگی از اینترنت مدرن را تشکیل میدهند و در استقرارهای خصوصی نیز مورد استفاده قرار میگیرند. به طور سنتی، مهندسان آمازون توانستهاند نمونههای اختصاصی خود را برای توسعه راهاندازی کنند و با بهرهگیری از میزان پایینتر استفاده از پردازنده که برای زیرساخت وب نیاز است، ماشینهای مجازی بیشتری را به کار بگیرند. اکنون مهندسان میگویند که برای دسترسی به این نمونهها باید روزها انتظار بکشند، در حالی که پیشتر میتوانستند ظرف چند ساعت به آنها دسترسی پیدا کنند. یک مهندس به نشریه اینفورمیشن (The Information) گفت که حتی پس از چندین سال کار در آمازون، هرگز مجبور نبوده برای یک نمونه این مدت طولانی صبر کند.
آمازون چندین نوع مختلف از پردازندهها را در نمونههای EC2 مستقر میکند؛ از جمله گزینههایی مبتنی بر ایامدی (AMD) و اینتل (Intel) و همچنین تراشه نسبتاً جدید گریویتون ۵ (Graviton5) این شرکت. گریویتون ۵ قدرتمندترین پردازنده آمازون تا به امروز است و از یک معماری مبتنی بر آرم (Arm) مشابه پردازنده ورا (Vera) شرکت انویدیا (Nvidia) و ایجیآی (AGI) اختصاصی آرم استفاده میکند.
افزایش تقاضا برای پردازنده به دلیل ظهور عوامل هوش مصنوعی (AI agents) رخ داده است؛ پارادایمی جدید در بهرهوری که حتی شرکتهای بزرگی مانند آمازون نیز در تقلا برای کنار آمدن با آن هستند. برای مثال، ماه گذشته یک عامل برنامهنویسی هزینهای معادل ۱.۸ میلیون دلار توکن در آمازون به بار آورد و بودجه توسعه را ۸۶۰ درصد پشت سر گذاشت.
بخش عمدهای از زیرساختهای هوش مصنوعی موجود حول محور استنتاج (inference) طراحی شدهاند؛ بار کاری که توسط پردازندههای گرافیکی (GPU) شتاب میگیرد. با نسبت چهار به یک، پردازنده صرفاً به عنوان ابزاری برای تغذیه کارتهای گرافیک عمل میکرد و بس. با این حال، بارهای کاری عاملمحور (agentic) بسیار پیچیدهتر هستند. آنها اغلب شامل فرایندهای ابزاری روی پردازنده و همچنین ارکستراسیون پیچیدهتر استنتاج روی کارتهای گرافیک میشوند. این همان چیزی است که پردازندهها را در عصر عاملهای هوش مصنوعی به مرکز توجه آورده است. شرکتهای اینتل (Intel)، ایامدی (AMD) و دیگران دیدگاههایی را که طی چند ماه گذشته از سوی شرکتهای تولیدکننده حافظه و ذخیرهسازی شنیده بودیم، تکرار کردهاند: تقاضا برای پردازندهها به قدری بالا است که بیشتر شرکتها هر چه گیرشان بیاید را میپذیرند.
بازیگران اصلی در حال سرمایهگذاری روی این تقاضا هستند. شرکت ایامدی (AMD) اخیراً سبد محصولات پردازندههای مرکز داده زن ۶ ونیز (Zen 6 'Venice') خود را معرفی کرد که نشاندهنده اولین باری است که ایامدی طی دهههای اخیر، یک معماری جدید را پیش از بازار کلاینت در مرکز داده عرضه میکند. انویدیا (Nvidia) نیز تمرکز پیامرسانی خود را از شتابدهندهها به سمت پردازنده جدید ورا (Vera) معطوف کرده است تا سهم خود را در بازار در حال گسترش زیرساختهای هوش مصنوعی عاملمحور تضمین کند.
اگرچه آمازون با چالش ظرفیت پردازنده در میان مهندسان داخلی و مشتریان خارجی خود دستوپنجه نرم میکند، اما اینفورمیشن گزارش میدهد که کمبودها عمدتاً برای نمونههای اسپات (spot instances) مشکلساز است. یک مشاور به این رسانه گفت که ظرفیتهای قراردادی هیچگونه کمبودی را تجربه نکردهاند.
پس از انتشار این مطلب، یکی از سخنگویان آمازون وب سرویس (AWS) با ارسال بیانیهای اعلام کرد:
«تقاضا برای خدمات AWS، از جمله EC2، فوقالعاده قوی است و رشد میکند. حتی با وجود این تقاضای سنگین، ما همچنان به تأمین اکثریت قریب به اتفاق نیازهای محاسباتی برای مشتریان داخلی و خارجی خود ادامه میدهیم. ما از نزدیک با تیمهای داخلی همکاری میکنیم تا نیازهای محاسباتی آنها را برآورده سازیم و در عین حال اطمینان حاصل کنیم که آنها از منابع EC2 به کارآمدترین شکل ممکن استفاده میکنند؛ اقداماتی نظیر بازپسگیری نمونههای بیحاصل، تنظیم اندازه مناسب (right-sizing) و مقیاسپذیری رو به بالا و پایین با تغییر نیازها - درستهمانطور که همیشه انجام دادهایم. این بهرهوریها به مدیریت ظرفیت برای مشتریان داخلی و خارجی کمک میکند و هرگونه این فرض که این تلاشهای دیرینه نشاندهنده محدودیتهای جدید ظرفیت است، کاملاً نادرست است.»
این پیشفرض بزرگنمایی شده است. صرفهجویی از روز اول در DNA ما وجود داشته است. ما همیشه تیمهای خود را تشویق کردهایم که کارآمد عمل کنند. ما همچنین بهترین روشها را برای نحوه بهینهسازی منابع با مشتریان خارجی به اشتراک میگذاریم. این یک دستورالعمل جدید نیست و تشویق به استفاده کارآمد از منابع مختص آمازون نیست.»
ما از آمازون پرسیدیم که آیا به مهندسان مهلتی برای کاهش مصرف محاسباتی داده شده است یا خیر، همانطور که اینفورمیشن (The Information) در ابتدا گزارش داده بود. سخنگوی AWS پاسخ داد: «این روایت درباره EC2 نادرست است. به عنوان بخشی از عملیات تجاری معمولی خود و با پشتیبانی اصل رهبری خود یعنی صرفهجویی، ما همواره در حال ارتقای بهرهوری در تمامی منابع خود هستیم تا اطمینان حاصل کنیم تیمها در حال بهینهسازی ظرفیت هستند.»
