آمازون برخورد با هدررفت پردازنده را تشدید کرد

شرکت آمازون وب سرویس (AWS) به دلیل افزایش تقاضای جهانی برای پردازنده‌ها و رشد هوش مصنوعی عامل، مهندسان خود را ملزم به کاهش هدررفت پردازنده در نمونه‌های EC2 کرد.

تتیم تحریریه۴ دقیقه مطالعه۰ بازدید۱۴۰۵/۵/۱۹
آمازون برخورد با هدررفت پردازنده را تشدید کرد

سرویس‌های وب آمازون (آمازون وب سرویس یا AWS) در حال برخورد سختگیرانه با استفاده داخلی مهندسان خود از نمونه‌های EC2 است. طبق گزارش The Information، این شرکت در ماه مه با مهندسان خود تشکیل جلسه داده و به آن‌ها گفته است که میزان هدررفت پردازنده مرکزی (CPU) را کاهش دهند تا اطمینان حاصل شود که AWS ظرفیت کافی پردازنده را برای پاسخگویی به تقاضای مشتریان در اختیار دارد. این پیام در حالی ارسال می‌شود که تقاضا برای پردازنده‌ها در مرکز داده به اوج خود رسیده است و نسبت سنتی هشت به یک یا چهار به یک پردازنده‌های گرافیکی (GPU) به پردازنده‌های مرکزی، به سمت برابری حرکت می‌کند.

نمونه‌های EC2 بخش بزرگی از اینترنت مدرن را تشکیل می‌دهند و در استقرار تجهیزات خصوصی نیز استفاده می‌شوند. به طور سنتی، مهندسان AWS می‌توانستند نمونه‌های خود را برای توسعه راه‌اندازی کنند و با بهره‌گیری از مصرف نسبتاً پایین پردازنده مورد نیاز برای زیرساخت وب، از ماشین‌های مجازی بیشتری استفاده کنند. اکنون مهندسان می‌گویند که برای دسترسی به این نمونه‌ها روزها منتظر می‌مانند، در حالی که پیش‌تر می‌توانستند ظرف چند ساعت به آن‌ها دسترسی پیدا کنند. یک مهندس به The Information گفت که حتی پس از چندین سال کار در آمازون، هرگز مجبور نبوده تا این حد برای یک نمونه منتظر بماند.

آمازون انواع مختلفی از پردازنده‌ها را در نمونه‌های EC2 مستقر می‌کند، از جمله گزینه‌های ای‌ام‌دی (AMD) و اینتل (Intel) و تراشه نسبتاً جدید خود یعنی گراویتون ۵ (Graviton5). گراویتون ۵ قدرتمندترین پردازنده آمازون تا به امروز است و از معماری مبتنی بر آرم (Arm) در راستای پردازنده ورا (Vera) شرکت انویدیا (Nvidia) و AGI خود آرم استفاده می‌کند.

افزایش تقاضا برای پردازنده مرکزی به دنبال ظهور ایجنت‌های هوش مصنوعی (AI agents) رخ داده است؛ پارادایم جدیدی در بهره‌وری که حتی شرکت‌های بزرگی مانند آمازون نیز برای مقابله با آن دچار چالش شده‌اند. برای مثال، ماه گذشته یک ایجنت کدنویسی هزینه‌ای معادل ۱.۸ میلیون دلار در توکن‌ها را در آمازون مصرف کرد و بودجه توسعه را ۸۶۰ درصد پشت سر گذاشت.

بخش عمده‌ای از زیرساخت‌های هوش مصنوعی فعلی حول محور استنتاج (inference) طراحی شده‌اند؛ بار کاری که توسط پردازنده‌های گرافیکی شتاب می‌گیرد. با نسبت چهار به یک، پردازنده مرکزی به عنوان راهی برای تغذیه پردازنده‌های گرافیکی عمل می‌کرد و بس. با این حال، بارهای کاری عامل‌محور (agentic) بسیار پیچیده‌تر هستند. آن‌ها اغلب شامل فرایندهای ابزاری روی پردازنده مرکزی و همچنین ارکستراسیون پیچیده‌تر استنتاج روی پردازنده‌های گرافیکی می‌شوند. این همان چیزی است که پردازنده‌های مرکزی را در عصر ایجنت‌ها به مرکز توجه آورده است. اینتل، ای‌ام‌دی و دیگران گفته‌های شرکت‌های حافظه و ذخیره‌سازی را در چند ماه گذشته تکرار کرده‌اند: تقاضا برای پردازنده‌ها به قدری بالا است که بیشتر شرکت‌ها هر چه را که بتوانند به دست می‌آورند.

بازیگران اصلی در حال بهره‌برداری از این تقاضا هستند. شرکت ای‌ام‌دی اخیراً سبد محصولات پردازنده‌های مرکز داده Zen 6 'Venice' خود را معرفی کرد که نشان‌دهنده اولین باری است که ای‌ام‌دی طی دهه‌های اخیر، یک معماری جدید را قبل از بازار کلاینت در مرکز داده راه‌اندازی کرده است. انویدیا نیز پیام‌رسانی خود را از شتاب‌دهنده‌ها به سمت پردازنده جدید ورا (Vera CPU) تغییر داده است تا سهم خود را در بازار رو به رشد زیرساخت‌های هوش مصنوعی عامل‌محور تضمین کند.

اگرچه آمازون با ظرفیت پردازنده مرکزی در میان مهندسان داخلی و مشتریان خارجی خود دست و پنجه نرم می‌کند، اما The Information گزارش می‌دهد که کمبودها عمدتاً مشکلی برای نمونه‌های اسپات (spot instances) هستند. یک مشاور به این رسانه گفت که ظرفیت‌های قراردادشده هیچ‌گونه کمبودی را تجربه نکرده‌اند.

پس از انتشار این مطلب، سخنگوی آمازون وب سرویس با بیانیه زیر پاسخ داد: «تقاضا برای خدمات AWS، از جمله EC2، بسیار قوی است و رشد می‌کند. حتی با وجود این تقاضای سنگین، ما همچنان به تأمین اکثریت قریب به اتفاق نیازهای پردازشی مشتریان داخلی و خارجی خود ادامه می‌دهیم. ما از نزدیک با تیم‌های داخلی همکاری می‌کنیم تا نیازهای پردازشی آن‌ها را برآورده کنیم و در عین حال اطمینان حاصل کنیم که آن‌ها از منابع EC2 به کارآمدترین شکل ممکن استفاده می‌کنند؛ مانند بازپس‌گیری نمونه‌های بیکار، تنظیم اندازه مناسب، و مقیاس‌بندی به بالا و پایین با تغییر نیازها - درستهمان‌طور که همیشه انجام داده‌ایم. این بهره‌وری‌ها به مدیریت ظرفیت برای مشتریان داخلی و خارجی کمک می‌کند و هرگونه این فرض که این تلاش‌های دیرینه نشان‌دهنده محدودیت‌های جدید ظرفیت است، کاملاً نادرست است.»

این پیش‌فرض بزرگ‌نمایی شده است. صرفه‌جویی از روز اول در DNA ما بوده است. ما همیشه تیم‌های خود را تشویق کرده‌ایم که به طور کارآمد عمل کنند. ما همچنین بهترین روش‌ها را برای چگونگی بهینه‌سازی منابع به مشتریان خارجی به اشتراک می‌گذاریم. این یک دستورالعمل جدید نیست و تشویق به استفاده کارآمد از منابع مختص آمازون نیست.»

ما از آمازون پرسیدیم که آیا به مهندسان مهلتی برای کاهش مصرف پردازشی داده شده است یا خیر، همان‌طور که The Information در ابتدا گزارش داده بود. سخنگوی AWS پاسخ داد: «این روایت درباره EC2 نادرست است. به عنوان بخشی از عملیات تجاری عادی خود و با پشتیبانی از اصل رهبری خود یعنی صرفه‌جویی، ما همواره کارایی را در تمام منابع خود هدایت می‌کنیم تا اطمینان حاصل کنیم که تیم‌ها در حال بهینه‌سازی ظرفیت هستند.»

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.