پیمان ۳۸ میلیارد دلاری OpenAI و AWS برای تقویت ChatGPT

OpenAI قرارداد هفت‌ساله‌ای با AWS به ارزش ۳۸ میلیارد دلار امضا کرده تا ChatGPT را روی EC2 UltraServers و خوشه‌های عظیم GPU انویدیا اجرا کند؛ این توافق پیامدهای بزرگی برای مقیاس، امنیت و تجاری‌سازی هوش مصنوعی مولد دارد.

.3 دیدگاه
پیمان ۳۸ میلیارد دلاری OpenAI و AWS برای تقویت ChatGPT

4 دقیقه

دنبال کردن در گوگل

OpenAI انتخاب کرده است که سرویس‌های خود برای اجرای ChatGPT را روی Amazon Web Services (AWS) مستقر کند و قراردادی هفت‌ساله به ارزش ۳۸ میلیارد دلار امضا کرده است. این توافق به OpenAI دسترسی به سرورهای Amazon EC2 UltraServers و خوشه‌های عظیم پردازنده‌های گرافیکی (GPU) انویدیا را می‌دهد که به‌ویژه برای بارهای کاری هوش مصنوعی مولد در مقیاس بزرگ طراحی شده‌اند. این همکاری، نقطه عطفی در تأمین زیرساخت ابری برای مدل‌های یادگیری عمیق و خدمات API توسعه‌دهندگان محسوب می‌شود و افق‌های جدیدی در کارایی، مقیاس‌پذیری و قابلیت اطمینان برای ChatGPT باز می‌کند.

چرا AWS انتخاب راهبردی بود

به‌گفتهٔ OpenAI، این تصمیم براساس نیازهای سرعت، مقیاس و امنیت اتخاذ شده است. آمازون وب سرویس تجربهٔ گسترده‌ای در اجرای استقرارهای عظیم هوش مصنوعی دارد و وعدهٔ قیمت، عملکرد و پوشش جهانی را می‌دهد که OpenAI برای پاسخ به رشد مداوم تقاضا برای ChatGPT و APIهای توسعه‌دهندگان نیاز دارد. تصور کنید که بتوانید درخواستی برای صدها هزار GPU به‌صورت آنی تأمین کنید و در عین حال تأخیر (latency) را پایین نگه دارید — این همان نمایهٔ عملیاتی است که AWS ارائه می‌دهد. علاوه بر این، مجموعه خدمات مدیریت‌شدهٔ AWS مانند IAM، VPC، KMS و سرویس‌های ذخیره‌سازی توزیع‌شده مانند S3 و EBS به همراه قابلیت‌های نظارتی و لاگینگ، به OpenAI کمک می‌کند تا تعادل بین عملکرد، هزینه و رعایت مقررات را حفظ کند.

چه چیزی در توافق ۳۸ میلیارد دلاری گنجانده شده است

این تعهد چندساله شامل زیرساخت و ظرفیت‌هایی است که باید قبل از پایان سال ۲۰۲۶ مستقر شوند و گزینه‌هایی برای گسترش از سال ۲۰۲۷ به بعد را دربر می‌گیرد. هدف اصلی ایجاد یک سکوی سخت‌افزاری و شبکه‌ای است که قادر به میزبانی آموزش و خدمت‌دهی مدل‌های بزرگ مولد باشد، با قابلیت افزایش مقیاس سریع و پشتیبانی از نیازهای مختلف محاسباتی، از آموزش توزیع‌شده تا پاسخ‌دهی بلادرنگ. این قرارداد همچنین بر فراهم‌سازی قابلیت‌های شبکه‌ای با تاخیر پایین، ذخیره‌سازی پرسرعت و مدیریت حجم عظیم دادهٔ آموزشی تاکید دارد؛ به‌ویژه زمانی که مدل‌های بزرگ نیازمند جریان داده‌های سنگین بین ذخیره‌سازی و حافظهٔ GPU هستند.

  • Amazon EC2 UltraServers بهینه‌شده برای بارهای کاری هوش مصنوعی مولد.
  • دسترسی به صدها هزار GPU انویدیا، شامل سری‌های GB200 و GB300.
  • قابلیت مقیاس تا ده‌ها میلیون CPU برای نیازهای محاسبات ترکیبی.
  • طراحی معماری که GPUها را در یک شبکهٔ واحد خوشه‌بندی می‌کند تا عملکرد با تاخیر کم و توان عملیاتی بالا فراهم شود.

چگونه این توافق عملکرد ChatGPT را تغییر خواهد داد

با هم‌مکانی (colocating) تعداد زیادی از GPUهای سطح بالا و اتصال آن‌ها بر روی یک بافت شبکه‌ای یکپارچه و با تاخیر پایین، OpenAI قادر خواهد بود مدل‌های بزرگ‌تر را سریع‌تر آموزش داده و خدمات‌دهی (inference) را با تاخیر کمتر برای کاربران ارائه کند. این معماری بهبود توان عملیاتی برای درخواست‌های همزمان را هدف قرار می‌دهد و پشتیبانی از آزمایش‌های پیشرفتهٔ مدل را بدون برخوردن به گلوگاه‌های ارتباطی یا زمان‌بندی فراهم می‌سازد. برای مثال، خوشه‌هایی که با NVLink، NVSwitch یا پروتکل‌های RDMA پیکربندی شده‌اند می‌توانند تبادل سریع داده بین GPUها را تضمین کنند، که برای عملیات‌هایی مانند توزیع وزن‌ها، آپدیت‌های گرادیان و پردازش دسته‌ای (batching) حیاتی است. همچنین، با استفاده از سرورهای Ultra که ممکن است حافظهٔ HBM بزرگتر، پهنای باند داخلی بالاتر و تنظیمات شبکه‌ای بهینه داشته باشند، هزینهٔ هر توکن یا هر درخواست کاهش می‌یابد و امکان ارائهٔ ویژگی‌های بلادرنگ و تجربیات کاربری با پاسخ‌دهی سریع‌تر فراهم می‌آید.

اهمیت فنی و تجاری فراتر از رقم ۳۸ میلیارد دلار

رقم ۳۸ میلیارد دلاری موجب جلب توجه می‌شود، اما پیام وسیع‌تر روند صنعتی به سمت زیرساخت‌های ابر-فرا (hyperscale) و یکپارچه‌سازی عمودی در حوزهٔ هوش مصنوعی است. برای شرکت‌ها و توسعه‌دهندگان، این یعنی دسترسی قابل‌اطمینان‌تر به مدل‌های پیشرفته، زمان کوتاه‌تر برای عرضهٔ ویژگی‌ها و امکان بهره‌گیری از قابلیت‌های پیشرفتهٔ آموزش و استنتاج بدون نیاز به سرمایه‌گذاری‌های سنگین در سخت‌افزار محلی. برای رقبا، این توافق نشان می‌دهد که شراکت‌های بزرگ ابری می‌توانند تعیین‌کنندهٔ محل خلق و استقرار نسل بعدی مدل‌های هوش مصنوعی باشند و بر تصمیمات معماری و تجاری اثرگذار شوند.

این همکاری همچنین نشانه‌ای از مسیر تجاری‌سازی هوش مصنوعی مولد است؛ به‌ویژه وقتی اکوسیستم GPU انویدیا، ارائه‌دهندگان ابر و شرکت‌های توسعه‌دهندهٔ مدل‌ها در یک سازوکار تجاری بزرگ با هم همکاری می‌کنند. چه در حال رصد بهبودهای محصول در ChatGPT باشید، چه تحرکات بازار خدمات ابری را دنبال کنید یا اکوسیستم GPU و سخت‌افزار هوش مصنوعی را بررسی کنید، این پیوند میان OpenAI و AWS یک نقطهٔ عطف مهم در مقیاس‌بندی و تجاری‌سازی مدل‌های مولد در سطح صنعتی محسوب می‌شود.

مهدی بهرامی
"محتوای آموزشی درباره هوش مصنوعی و یادگیری ماشینی تولید می‌کنم، به‌صورتی که برای خواننده عمومی قابل‌فهم باشد و کاربردهای واقعی را نشان دهد."

نظر بگذارید

نظرات (3)

نوا_اکس

سخت‌افزارهای پرطرفدار مثل NVLink و RDMA چقدر واقعاً کار می‌کنن؟ اگر همه چیز درست باشه، آیا این مدل‌ها با همین قیمت‌ها هم می‌تونن به کاربرها سریع پاسخ بدن؟

لابكور

می‌گم شاید این به سود توسعه‌دهنده‌ها باشه اما قیمت و امنیت هم مهمه. آیا کاربران عادی هم به اندازه کافی ازش بهره می‌برن یا نه؟

آرمن

واقعاً این قرارداد داره آیندهٔ هوش مصنوعی رو دگرگون می‌کنه. با این همه GPU و تاخیر پایین، ChatGPT چطور سریع‌تر می‌شه؟ هزینه‌ها چطور تامین میشه؟