سخت‌گیری آامازون روی ضایعات CPU مهندسان با اوج‌گیری تقاضای هوش مصنوعی

شرکت آمازون وب سرویس (AWS) به دلیل افزایش شدید تقاضا برای پردازنده‌ها در عصر هوش مصنوعی عام خودمختار، مهندسان خود را ملزم به کاهش هدررفت CPU کرده است.

تتیم تحریریه۳ دقیقه مطالعه۰ بازدید۱۴۰۵/۵/۱۶
سخت‌گیری آامازون روی ضایعات CPU مهندسان با اوج‌گیری تقاضای هوش مصنوعی

شرکت آمازون وب سرویس (Amazon Web Services) نظارت سخت‌گیرانه‌ای بر استفاده داخلی مهندسان خود از نمونه‌های EC2 اعمال کرده است. بر اساس گزارش نشریه «د اینفورمیشن» (The Information)، این شرکت در ماه مه طی نشستی با مهندسان از آن‌ها خواست تا هدررفت CPU را کاهش دهند تا اطمینان حاصل شود که آمازون ظرفیت کافی پردازنده برای پاسخگویی به تقاضای مشتریان را در اختیار دارد. این پیام در حالی منتشر می‌شود که تقاضا برای پردازنده‌ها در مراکز داده به اوج خود رسیده است و نسبت سنتی هشت به یک یا چهار به یک پردازنده‌های گرافیکی به پردازنده‌های مرکزی، در حال نزدیک شدن به برابری است.

نمونه‌های EC2 بخش بزرگی از اینترنت مدرن را تشکیل می‌دهند و در استقرار نیازمندی‌های خصوصی نیز استفاده می‌شوند. به طور سنتی، مهندسان آمازون قادر بودند نمونه‌های خود را برای توسعه راه‌اندازی کنند و با بهره‌گیری از مصرف پایین CPU که برای زیرساخت‌های وب مورد نیاز است، از ماشین‌های مجازی بیشتری استفاده کنند. اکنون مهندسان می‌گویند که برای دسترسی به نمونه‌ها باید روزها منتظر بمانند، در حالی که پیش‌تر می‌توانستند ظرف چند ساعت به آن‌ها دسترسی پیدا کنند. یک مهندس به «د اینفورمیشن» گفت که حتی پس از چندین سال کار در آمازون، هرگز مجبور نبوده این‌قدر برای یک نمونه منتظر بماند.

آمازون انواعی از پردازنده‌ها را در نمونه‌های EC2 مستقر می‌کند، از جمله گزینه‌های ای‌ام‌دی (AMD) و اینتل (Intel) و تراشه نسبتاً جدید گروویتون ۵ (Graviton5) خود. گروویتون ۵ قدرتمندترین پردازنده آمازون تا به امروز است و از معماری مبتنی بر آرم (Arm) مشابه با پردازنده ورا (Vera) انویدیا و تراشه AGI خود آرم بهره می‌برد.

افزایش تقاضا برای پردازنده به دلیل ظهور ایجنت‌های هوش مصنوعی (AI agents) رخ داده است؛ پارادایم جدیدی در بهره‌وری که حتی شرکت بزرگی مانند آمازون نیز برای کنار آمدن با آن دچار چالش شده است. برای نمونه، ماه گذشته یک ایجنت کدنویسی توانست ۱.۸ میلیون دلار هزینه توکن در آمازون به بار بیاورد و بودجه توسعه را ۸۶۰ درصد پشت سر بگذارد.

بخش عمده‌ای از زیرساخت‌های هوش مصنوعی فعلی حول محور استنتاج (inference) طراحی شده‌اند؛ بار کاری که توسط پردازنده‌های گرافیکی شتاب می‌گیرد. با نسبت چهار به یک، CPU تنها به عنوان ابزاری برای تغذیه پردازنده‌های گرافیکی عمل می‌کرد و بس. با این حال، بارهای کاری مبتنی بر ایجنت بسیار پیچیده‌تر هستند. آن‌ها اغلب شامل فرایندهای ابزاری روی CPU و همچنین ارکستراسیون پیچیده‌تری از استنتاج روی پردازنده‌های گرافیکی می‌شوند. این همان عاملی است که پردازنده‌ها را در عصر ایجنت‌ها به مرکز توجه آورده است. شرکت‌های اینتل، ای‌ام‌دی و دیگران سخنانی را تکرار کرده‌اند که طی ماه‌های گذشته از شرکت‌های عرضه‌کننده حافظه و ذخیره‌سازی شنیده بودیم: تقاضا برای پردازنده‌ها به قدری بالا است که بیشتر شرکت‌ها هر چه گیرشان بیاید را می‌پذیرند.

بازیگران اصلی در حال بهره‌برداری از این تقاضا هستند. شرکت ای‌ام‌دی اخیراً سبد محصولات پردازنده‌های زن ۶ ونیز (Zen 6 'Venice') خود را برای مراکز داده معرفی کرد که نشان‌دهنده نخستین باری است که ای‌ام‌دی طی دهه‌های گذشته، یک معماری جدید را پیش از بازار کلاینت در مرکز داده عرضه می‌کند. انویدیا (Nvidia) نیز پیام‌رسانی خود را از شتاب‌دهنده‌ها به سمت پردازنده جدید ورا تغییر داده است تا سهم خود را در بازار رو به رشد زیرساخت هوش مصنوعی عام تضمین کند.

اگرچه آمازون با چالش ظرفیت CPU در میان مهندسان داخلی و مشتریان خارجی خود دست‌وپنجه نرم می‌کند، اما «د اینفورمیشن» گزارش می‌دهد که کمبودها عمدتاً برای نمونه‌های اسپات (spot instances) مشکل‌ساز است. یک مشاور به این رسانه گفت که ظرفیت‌های دارای قرارداد هیچ‌گونه کمبودی را تجربه نکرده‌اند.

نظرات۰

برای نوشتن نظر، وارد حساب خود شوید.

ورود / ثبت‌نام

هنوز نظری ثبت نشده — اولین نفری باش که نظر می‌دهد.