4 دقیقه
OpenAI انتخاب کرده است که سرویسهای خود برای اجرای ChatGPT را روی Amazon Web Services (AWS) مستقر کند و قراردادی هفتساله به ارزش ۳۸ میلیارد دلار امضا کرده است. این توافق به OpenAI دسترسی به سرورهای Amazon EC2 UltraServers و خوشههای عظیم پردازندههای گرافیکی (GPU) انویدیا را میدهد که بهویژه برای بارهای کاری هوش مصنوعی مولد در مقیاس بزرگ طراحی شدهاند. این همکاری، نقطه عطفی در تأمین زیرساخت ابری برای مدلهای یادگیری عمیق و خدمات API توسعهدهندگان محسوب میشود و افقهای جدیدی در کارایی، مقیاسپذیری و قابلیت اطمینان برای ChatGPT باز میکند.
چرا AWS انتخاب راهبردی بود
بهگفتهٔ OpenAI، این تصمیم براساس نیازهای سرعت، مقیاس و امنیت اتخاذ شده است. آمازون وب سرویس تجربهٔ گستردهای در اجرای استقرارهای عظیم هوش مصنوعی دارد و وعدهٔ قیمت، عملکرد و پوشش جهانی را میدهد که OpenAI برای پاسخ به رشد مداوم تقاضا برای ChatGPT و APIهای توسعهدهندگان نیاز دارد. تصور کنید که بتوانید درخواستی برای صدها هزار GPU بهصورت آنی تأمین کنید و در عین حال تأخیر (latency) را پایین نگه دارید — این همان نمایهٔ عملیاتی است که AWS ارائه میدهد. علاوه بر این، مجموعه خدمات مدیریتشدهٔ AWS مانند IAM، VPC، KMS و سرویسهای ذخیرهسازی توزیعشده مانند S3 و EBS به همراه قابلیتهای نظارتی و لاگینگ، به OpenAI کمک میکند تا تعادل بین عملکرد، هزینه و رعایت مقررات را حفظ کند.
چه چیزی در توافق ۳۸ میلیارد دلاری گنجانده شده است
این تعهد چندساله شامل زیرساخت و ظرفیتهایی است که باید قبل از پایان سال ۲۰۲۶ مستقر شوند و گزینههایی برای گسترش از سال ۲۰۲۷ به بعد را دربر میگیرد. هدف اصلی ایجاد یک سکوی سختافزاری و شبکهای است که قادر به میزبانی آموزش و خدمتدهی مدلهای بزرگ مولد باشد، با قابلیت افزایش مقیاس سریع و پشتیبانی از نیازهای مختلف محاسباتی، از آموزش توزیعشده تا پاسخدهی بلادرنگ. این قرارداد همچنین بر فراهمسازی قابلیتهای شبکهای با تاخیر پایین، ذخیرهسازی پرسرعت و مدیریت حجم عظیم دادهٔ آموزشی تاکید دارد؛ بهویژه زمانی که مدلهای بزرگ نیازمند جریان دادههای سنگین بین ذخیرهسازی و حافظهٔ GPU هستند.
- Amazon EC2 UltraServers بهینهشده برای بارهای کاری هوش مصنوعی مولد.
- دسترسی به صدها هزار GPU انویدیا، شامل سریهای GB200 و GB300.
- قابلیت مقیاس تا دهها میلیون CPU برای نیازهای محاسبات ترکیبی.
- طراحی معماری که GPUها را در یک شبکهٔ واحد خوشهبندی میکند تا عملکرد با تاخیر کم و توان عملیاتی بالا فراهم شود.

چگونه این توافق عملکرد ChatGPT را تغییر خواهد داد
با هممکانی (colocating) تعداد زیادی از GPUهای سطح بالا و اتصال آنها بر روی یک بافت شبکهای یکپارچه و با تاخیر پایین، OpenAI قادر خواهد بود مدلهای بزرگتر را سریعتر آموزش داده و خدماتدهی (inference) را با تاخیر کمتر برای کاربران ارائه کند. این معماری بهبود توان عملیاتی برای درخواستهای همزمان را هدف قرار میدهد و پشتیبانی از آزمایشهای پیشرفتهٔ مدل را بدون برخوردن به گلوگاههای ارتباطی یا زمانبندی فراهم میسازد. برای مثال، خوشههایی که با NVLink، NVSwitch یا پروتکلهای RDMA پیکربندی شدهاند میتوانند تبادل سریع داده بین GPUها را تضمین کنند، که برای عملیاتهایی مانند توزیع وزنها، آپدیتهای گرادیان و پردازش دستهای (batching) حیاتی است. همچنین، با استفاده از سرورهای Ultra که ممکن است حافظهٔ HBM بزرگتر، پهنای باند داخلی بالاتر و تنظیمات شبکهای بهینه داشته باشند، هزینهٔ هر توکن یا هر درخواست کاهش مییابد و امکان ارائهٔ ویژگیهای بلادرنگ و تجربیات کاربری با پاسخدهی سریعتر فراهم میآید.
اهمیت فنی و تجاری فراتر از رقم ۳۸ میلیارد دلار
رقم ۳۸ میلیارد دلاری موجب جلب توجه میشود، اما پیام وسیعتر روند صنعتی به سمت زیرساختهای ابر-فرا (hyperscale) و یکپارچهسازی عمودی در حوزهٔ هوش مصنوعی است. برای شرکتها و توسعهدهندگان، این یعنی دسترسی قابلاطمینانتر به مدلهای پیشرفته، زمان کوتاهتر برای عرضهٔ ویژگیها و امکان بهرهگیری از قابلیتهای پیشرفتهٔ آموزش و استنتاج بدون نیاز به سرمایهگذاریهای سنگین در سختافزار محلی. برای رقبا، این توافق نشان میدهد که شراکتهای بزرگ ابری میتوانند تعیینکنندهٔ محل خلق و استقرار نسل بعدی مدلهای هوش مصنوعی باشند و بر تصمیمات معماری و تجاری اثرگذار شوند.
این همکاری همچنین نشانهای از مسیر تجاریسازی هوش مصنوعی مولد است؛ بهویژه وقتی اکوسیستم GPU انویدیا، ارائهدهندگان ابر و شرکتهای توسعهدهندهٔ مدلها در یک سازوکار تجاری بزرگ با هم همکاری میکنند. چه در حال رصد بهبودهای محصول در ChatGPT باشید، چه تحرکات بازار خدمات ابری را دنبال کنید یا اکوسیستم GPU و سختافزار هوش مصنوعی را بررسی کنید، این پیوند میان OpenAI و AWS یک نقطهٔ عطف مهم در مقیاسبندی و تجاریسازی مدلهای مولد در سطح صنعتی محسوب میشود.





نظر بگذارید
نظرات (3)
سختافزارهای پرطرفدار مثل NVLink و RDMA چقدر واقعاً کار میکنن؟ اگر همه چیز درست باشه، آیا این مدلها با همین قیمتها هم میتونن به کاربرها سریع پاسخ بدن؟
میگم شاید این به سود توسعهدهندهها باشه اما قیمت و امنیت هم مهمه. آیا کاربران عادی هم به اندازه کافی ازش بهره میبرن یا نه؟
واقعاً این قرارداد داره آیندهٔ هوش مصنوعی رو دگرگون میکنه. با این همه GPU و تاخیر پایین، ChatGPT چطور سریعتر میشه؟ هزینهها چطور تامین میشه؟