مقابله آامازون با هدررفت پردازنده

آمازون وب سرویس به دلیل افزایش تقاضای پردازنده ناشی از هوش مصنوعی عاملی، مهندسان خود را ملزم به کاهش هدررفت CPU و بهینه‌سازی نمونه‌های EC2 کرده است.

تتیم تحریریه۴ دقیقه مطالعه۰ بازدید۱۴۰۵/۵/۱۷
مقابله آامازون با هدررفت پردازنده

سرویس‌های وب آمازون (Amazon Web Services) در حال برخورد با استفاده داخلی مهندسان خود از نمونه‌های EC2 است. بر اساس گزارش نشریه اینفورمیشن (The Information)، این شرکت در ماه مه ظاهراً با مهندسان ملاقات کرد و به آن‌ها گفت تا هدررفت پردازنده (CPU) را کاهش دهند تا اطمینان حاصل شود که آمازون وب سرویس ظرفیت کافی پردازنده را برای پاسخگویی به تقاضای مشتریان در اختیار دارد. این پیام در حالی منتشر می‌شود که تقاضا برای پردازنده‌ها در مرکز داده به اوج خود رسیده است و نسبت سنتی هشت به یک یا چهار به یک پردازنده‌های گرافیکی (GPU) به پردازنده‌ها (CPU) به برابری نزدیک‌تر می‌شود.

نمونه‌های EC2 بخش بزرگی از اینترنت مدرن را تشکیل می‌دهند و در استقرار خصوصی نیز استفاده می‌شوند. به‌طور سنتی، مهندسان آمازون قادر بوده‌اند نمونه‌های خود را برای توسعه راه‌اندازی کنند و از مصرف نسبتاً پایین پردازنده مورد نیاز برای زیرساخت وب بهره ببرند تا ماشین‌های مجازی بیشتری را به کار بگیرند. اکنون، مهندسان می‌گویند که برای دسترسی روزها انتظار می‌کشند، در حالی که پیش از این می‌توانستند ظرف چند ساعت دسترسی پیدا کنند. یک مهندس به نشریه اینفورمیشن گفت که حتی پس از چندین سال کار در آمازون، هرگز مجبور نبوده اینقدر طولانی برای یک نمونه انتظار بکشد.

آمازون انواع مختلفی از پردازنده‌ها را در نمونه‌های EC2 مستقر می‌کند، از جمله گزینه‌های شرکت‌های ای‌ام‌دی (AMD) و اینتل (Intel) و تراشه نسبتاً جدید گروویتون ۵ (Graviton5) خود. تراشه گروویتون ۵ قدرتمندترین پردازنده آمازون تا به امروز است و از معماری مبتنی بر آرم (Arm) در راستای پردازنده ورا (Vera) انویدیا و ای‌جی‌آی (AGI) خود آرم استفاده می‌کند.

افزایش تقاضا برای پردازنده به پشتوانه ایجنت‌های هوش مصنوعی (AI agents) رخ داده است؛ پارادایم جدیدی در بهره‌وری که حتی شرکت‌های بزرگی مانند آمازون نیز برای کنار آمدن با آن تلاش می‌کنند. برای مثال، ماه گذشته یک ایجنت کدنویسی ۱.۸ میلیون دلار هزینه توکن را در آمازون مصرف کرد و بودجه توسعه را تا ۸۶۰ درصد پشت سر گذاشت.

بخش عمده‌ای از زیرساخت هوش مصنوعی در حال حاضر حول محور استنتاج (inference) طراحی شده است، کاری که توسط پردازنده‌های گرافیکی شتاب می‌یابد. با نسبت چهار به یک، پردازنده به عنوان ابزاری برای تغذیه پردازنده‌های گرافیکی عمل می‌کرد و بس. با این حال، بارهای کاری ایجنت‌ها بسیار پیچیده‌تر هستند. آن‌ها اغلب شامل فرایندهای ابزاری روی پردازنده و همچنین ارکستراسیون پیچیده‌تر استنتاج روی پردازنده‌های گرافیکی می‌شوند. این همان چیزی است که پردازنده‌ها را در عصر ایجنت‌ها به مرکز صحنه آورده است. اینتل، ای‌ام‌دی و دیگران سخنان شرکت‌های حافظه و ذخیره‌سازی را در چند ماه گذشته تکرار کرده‌اند: تقاضا برای پردازنده‌ها به قدری بالا است که بیشتر شرکت‌ها هر چه را که بتوانند به دست می‌آورند، قبول خواهند کرد.

بازیگران اصلی از آن تقاضا بهره‌برداری می‌کنند. شرکت ای‌ام‌دی اخیراً سبد محصولات پردازنده‌های ذن ۶ ونیز (Zen 6 'Venice') خود را برای مرکز داده معرفی کرد که نشان‌دهنده اولین باری است که ای‌ام‌دی پس از دهه‌ها، معماری جدیدی را قبل از بازار مشتری (client market) در مرکز داده راه‌اندازی کرده است. انویدیا نیز پیام‌رسانی خود را از شتاب‌دهنده‌ها به سمت پردازنده جدید ورا خود تغییر داده است تا سهم خود را در بازار رو به رشد زیرساخت هوش مصنوعی عاملی تثبیت کند.

اگرچه آمازون با ظرفیت پردازنده در میان مهندسان داخلی و مشتریان خارجی خود دست و پنجه نرم می‌کند، نشریه اینفورمیشن گزارش می‌دهد که کمبودها عمدتاً مشکلی برای نمونه‌های اسپات (spot instances) هستند. یک مشاور به این رسانه گفت که ظرفیت‌های قراردادی هیچ‌گونه کمبودی را تجربه نکرده‌اند.

پس از انتشار این مطلب، سخنگوی آمازون وب سرویس بیانیه زیر را ارسال کرد: «تقاضا برای خدمات آمازون وب سرویس، از جمله EC2، فوق‌العاده قوی است و رشد می‌کند. حتی با وجود این تقاضای سنگین، ما همچنان به برآورده کردن اکثریت قریب به اتفاق نیازهای محاسباتی مشتریان داخلی و خارجی خود ادامه می‌دهیم. ما از نزدیک با تیم‌های داخلی همکاری می‌کنیم تا نیازهای محاسباتی آن‌ها را برآورده کنیم و در عین حال اطمینان حاصل کنیم که آن‌ها از منابع EC2 به کارآمدترین شکل ممکن استفاده می‌کنند، مانند پس‌گرفتن نمونه‌های بیکار، تنظیم اندازه مناسب، و مقیاس‌پذیری رو به بالا و پایین با تغییر نیازها - درست همان کاری که همیشه انجام داده‌ایم. این بهره‌وری‌ها به مدیریت ظرفیت برای مشتریان داخلی و خارجی به طور یکسان کمک می‌کند، و هر گونه پیشنهادی مبنی بر اینکه این تلاش‌های دیرینه نشان‌دهنده محدودیت‌های ظرفیت جدید است، به سادگی نادرست است.»

«این فرض بزرگ‌نمایی شده است. صرفه‌جویی از روز اول در DNA ما بوده است. ما همیشه تیم‌های خود را تشویق کرده‌ایم که به طور کارآمد عمل کنند. ما همچنین بهترین روش‌ها را برای نحوه بهینه‌سازی منابع برای مشتریان خارجی به اشتراک می‌گذاریم. این یک دستورالعمل جدید نیست و تشویق به استفاده کارآمد از منابع مختص آمازون نیست.» ما از آمازون پرسیدیم که آیا به مهندسان مهلت‌هایی برای کاهش مصرف محاسباتی داده شده است یا خیر، همانطور که نشریه اینفورمیشن در ابتدا گزارش داد. سخنگوی آمازون وب سرویس پاسخ داد: «این روایت در مورد EC2 نادرست است. به عنوان بخشی از عملیات تجاری عادی خود، و با پشتیبانی اصل رهبری صرفه‌جویی، ما همیشه کارایی را در منابع خود هدایت می‌کنیم تا اطمینان حاصل شود که تیم‌ها در حال بهینه‌سازی ظرفیت هستند.»

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.