اوپن ای آی و برودکام: چیپ های سفارشی برای دیتاسنتر

اوپن‌ای‌آی قرارداد چندمیلیارد دلاری با برودکام برای طراحی چیپ‌های سفارشی امضا کرد تا ظرفیت حدودی ۱۰ گیگاوات را تأمین کند؛ این حرکت در کنار همکاری با Nvidia و AMD بخشی از برنامهٔ اوپن‌ای‌آی برای رسیدن به تقاضای ۲۵۰ گیگاوات در هشت سال آینده است.

اوپن ای آی و برودکام: چیپ های سفارشی برای دیتاسنتر

6 دقیقه

دنبال کردن در گوگل

اوپن‌ای‌آی در مسیر نزدیک‌تری برای تولید پردازنده‌های هوش مصنوعی سفارشی قرار گرفته است. این شرکت قرارداد بزرگی چند میلیارد دلاری با برودکام امضا کرده تا طراحی چیپ‌هایی ویژه را انجام دهد که اوپن‌ای‌آی قصد دارد در دیتاسنترهای خود مستقر کند، در حالی که نیازهای محاسباتی آن به‌سرعت در حال افزایش است.

یک شرط‌بندی بزرگ روی سیلیکون سفارشی

بر اساس گزارش‌ها، همکاری اوپن‌ای‌آی و برودکام از حدود ۱۸ ماه پیش آغاز شده و اکنون قراردادی رسمی شکل گرفته که هدف تأمین حدود ۱۰ گیگاوات ظرفیت چیپ را دنبال می‌کند. این توافق که وال‌استریت ژورنال ارزش آن را چند میلیارد دلار توصیف کرده است، هزینه طراحی سخت‌افزار سفارشی و تأمین بلندمدت برای توسعه زیرساخت‌های اوپن‌ای‌آی را پوشش می‌دهد.

انتخاب طراحی سیلیکون سفارشی نشان‌دهنده استراتژی بلندمدت برای بهینه‌سازی عملکرد مدل‌های بزرگ یادگیری عمیق و کاهش هزینه انرژی و فضای دیتاسنتر است. چیپ‌های سفارشی می‌توانند پردازش‌های ماتریسی و تانسوری مورد نیاز مدل‌های مولد را با بازدهی بالاتر و مصرف انرژی کمتر انجام دهند؛ امری که برای رقابت در بازار خدمات هوش مصنوعی عمومی و سازمانی حیاتی خواهد بود.

از منظر فنی، طراحی یک پردازندهٔ سفارشی شامل تعریف مجموعه دستورالعمل‌های اختصاصی، واحدهای ماتریسی با پهنای باند بالا، حافظهٔ روی چیپ و معماری‌های شتاب‌دهندهٔ اختصاصی برای عملیات‌های خاص مدل‌های ترنسفورمر است. تعاملی که اوپن‌ای‌آی با برودکام آغاز کرده می‌تواند این مشخصات را در قالب چیپ‌ست‌هایی به تولید برساند که بین مصرف انرژی و توان محاسباتی تعادل مناسبی برقرار کنند.

جدول زمانی، مقیاس و آنچه به دیتاسنترها می‌آید

انتظار می‌رود برودکام نصب رک‌های سخت‌افزاری را در نیمه دوم سال ۲۰۲۶ آغاز کند، در حالی که طراحی و تولید چیپ ممکن است تا پایان سال ۲۰۲۹ ادامه یابد. این توزیع مرحله‌ای مشابه روند معمول پروژه‌های زیرساخت ابری و هوش مصنوعی است: ابتدا استقرارهای اولیه و سپس افزایش ظرفیت به مقیاس کامل.

رول‌اوت مرحله‌ای به اوپن‌ای‌آی اجازه می‌دهد تا عملکرد واقعی چیپ‌ها را در محیط‌های عملیاتی سنجش کند، نقاط ضعف را اصلاح نماید و هم‌زمان تقاضا و تأمین انرژی، خنک‌سازی و مدیریت فضای دیتاسنتر را هماهنگ سازد. این فرآیند همچنین ریسک‌های زنجیره تأمین را کاهش می‌دهد و امکان بازخورد سریع بین تیم‌های توسعه نرم‌افزار و سخت‌افزار را فراهم می‌آورد.

  • دامنه قرارداد: گزارش‌ها از قراردادی چند میلیارد دلاری برای حدود ۱۰ گیگاوات چیپ خبر می‌دهند.
  • استقرار: نصب رک‌ها از نیمه دوم ۲۰۲۶ آغاز می‌شود.
  • طراحی/تولید: احتمالاً تا حدود سال ۲۰۲۹ ادامه خواهد داشت.

تحمیل بار کاری گستردهٔ مدل‌های مولد مانند GPT و سایر معماری‌های بزرگ، نیازمند طراحی ویژه در هر دو سطح سخت‌افزار و نرم‌افزار است. به عنوان مثال، پیاده‌سازی الگوریتم‌های تخصیص حافظه، فشرده‌سازی داده‌ها، و اجرای موازی عملیات محاسباتی از مواردی است که در طراحی چیپ‌های سفارشی باید در نظر گرفته شود تا حداکثر بهره‌وری از هر وات مصرفی حاصل شود.

همچنین باید به مقیاس‌پذیری شبکه‌های داخلی رک‌ها و اتصالات با پهنای باند بالا توجه داشت؛ زیرا در مقیاس‌ بزرگ، توان محاسباتی تنها با شبکهٔ انتقال دادهٔ داخلی همگام خواهد بود. این جنبه‌های زیرساختی بخشی از برنامهٔ اوپن‌ای‌آی و برودکام برای اجرای موفقیت‌آمیز استقرارهای مبتنی بر ۱۰ گیگاوات یا بیشتر را تشکیل می‌دهند.

چگونه این موضوع با همکاری‌های Nvidia و AMD همخوانی دارد

اوپن‌ای‌آی در حال تأمین ظرفیت از چندین تأمین‌کننده است. گزارش‌ها نشان می‌دهند Nvidia متعهد به فراهم آوردن زیرساختی شده است — ارقامی که در رسانه‌ها ذکر شده‌اند، سرمایه‌گذاری در مقیاس بزرگی را مرتبط با حدود ۱۰ گیگاوات محاسباتی نشان می‌دهند — در حالی که گفته می‌شود AMD موافقت کرده است تقریباً ۶ گیگاوات را تأمین کند. گمانه‌زنی‌هایی نیز وجود دارد مبنی بر اینکه اوپن‌ای‌آی مبالغی چند میلیارد دلاری به AMD پرداخت کرده و ممکن است در موقعیتی قرار بگیرد که سهمی معنادار از سهام این شرکت داشته باشد.

داشتن چندین شریک سخت‌افزاری چه مزایایی دارد؟ اتکا به چند فروشنده باعث کاهش ریسک قطع زنجیرهٔ تأمین، تنوع در انتخاب معماری‌ها (مانند معماری‌های مبتنی بر GPU، شتاب‌دهنده‌های مبتنی بر ASIC یا طراحی‌های سفارشی) و امکان انتخاب بهترین ترکیب هزینه-عملکرد برای بارهای کاری خاص می‌شود. به عبارت دیگر، ترکیب چیپ‌های Nvidia، AMD و سیلیکون سفارشی برودکام می‌تواند مزیت رقابتی برای اوپن‌ای‌آی فراهم کند.

در سطح عملیاتی، هر یک از این تامین‌کنندگان نقاط قوت متفاوتی دارند: Nvidia با اکوسیستم نرم‌افزاری قوی و کتابخانه‌های بهینه‌سازی شناخته می‌شود، AMD ترکیبی از قیمت و عملکرد رقابتی ارائه می‌دهد و سیلیکون سفارشی می‌تواند برای بارهای کاری خاص بهینه‌سازی‌های منحصربه‌فردی را فراهم کند. این همگرایی تأمین‌کنندگان به اوپن‌ای‌آی امکان می‌دهد تا بین هزینه‌های سرمایه‌ای، تأخیر شبکه، بازده انرژی و زمان توسعه متوازن‌سازی انجام دهد.

تقاضای جاه‌طلبانه: ۲۵۰ گیگاوات در طول هشت سال

مدیرعامل اوپن‌ای‌آی، سم آلت‌من، به کارکنان گفته است که این شرکت انتظار دارد طی هشت سال آینده حدود ۲۵۰ گیگاوات ظرفیت محاسباتی نیاز داشته باشد. برای درک بهتر این عدد، ۲۵۰ گیگاوات تقریباً معادل یک‌پنجم کل ظرفیت تولید برق ایالات متحده (حدود ۱۲۰۰ گیگاوات) است. ساخت چنین زیرساخت عظیمی برای هوش مصنوعی احتمالاً هزینه‌ای در حدود ۱۰ تریلیون دلار خواهد داشت که فراتر از توان هر شریک سخت‌افزاری منفرد است.

اعداد بالا نشان می‌دهند که چالش اصلی تنها طراحی چیپ نیست، بلکه فراهم کردن انرژی، خنک‌سازی، فشرده‌سازی فضا، و مدل‌های مالی نوآورانه برای پشتیبانی از سرمایه‌گذاری‌های کلان است. علاوه بر این، مسائل زیست‌محیطی و مقررات مربوط به مصرف انرژی و انتشار کربن نیز باید در برنامه‌ریزی استراتژیک لحاظ شوند تا توسعهٔ زیرساخت‌ها با استانداردهای پایداری همگام گردد.

حتی با وجود تعهدات بزرگ فروشندگان و افزایش درآمد — درآمد پیش‌بینی‌شده اوپن‌ای‌آی برای سال جاری در گزارش‌های رسانه‌ای حدود ۱۳ میلیارد دلار برآورد شده است — این شرکت برای تأمین چنین توسعه‌ای به مدل‌های تأمین مالی نوآورانه، شراکت‌های سرمایه‌گذاری مشترک، و احتمالاً ورود به بازارهای جدید درآمدی نیاز خواهد داشت. راه‌حل‌هایی مانند قراردادهای بلندمدت خرید خدمات، مشارکت‌های سرمایه‌گذاری زیرساختی و عرضه محصولات تجاری جدید می‌توانند نقش مهمی در مدیریت بار مالی داشته باشند.

از منظر مهندسی، برنامه‌ریزی برای ۲۵۰ گیگاوات نیازمند هماهنگی نزدیک میان تیم‌های طراحی چیپ، مراکز داده، مهندسی شبکه و عملیات است تا مسیر توسعهٔ ظرفیت از نمونه‌های اولیه تا مقیاس‌پذیری جهانی به‌صورت کارآمد دنبال شود. همچنین باید سیستم‌های اتوماسیون و نرم‌افزار مدیریت منابع به‌طور ویژه برای ارزیابی و تخصیص بارهای AI بهینه‌سازی شوند.

چه چیزهایی را باید دنبال کنیم

به نقاط عطف استقراری برودکام توجه داشته باشید (شروع نصب رک‌ها در ۲۰۲۶) و هرگونه افشای بیشتر دربارهٔ تحویل ظرفیت از Nvidia و AMD را زیر نظر بگیرید. سال‌های پیشِ رو نشان خواهد داد که آیا سیلیکون سفارشی برای هوش مصنوعی و استراتژی تأمین چندفروشنده می‌توانند با تقاضای فزایندهٔ خدمات مولد هوش مصنوعی همگام شوند یا خیر.

علاوه بر این، پیگیری معیارهای عملکردی مانند توان محاسباتی به ازای هر وات، هزینهٔ مالکیت کلی (TCO)، زمان تا بهره‌برداری و تأثیرات زیست‌محیطی از اهمیت بالایی برخوردار است. این معیارها کارایی کسب‌وکار و دوام طرح‌های توسعه را نشان می‌دهند و به مشتریان سازمانی و سرمایه‌گذاران دید روشنی از بازده سرمایه‌گذاری می‌دهند.

در نهایت، تعامل میان سخت‌افزار سفارشی، شتاب‌دهنده‌های عمومی و نرم‌افزارهای بهینه‌سازی مدل‌های بزرگ مشخص خواهد کرد که کدام ترکیب فناوری برای ارائهٔ خدمات هوش مصنوعی مولد در سطح جهانی مقرون‌به‌صرفه و پایدار است. تماشای اعلامیه‌های فنی، نشریات مهندسی و اطلاعات مالی اوپن‌ای‌آی و شرکایش می‌تواند دید بهتری دربارهٔ مسیر این تحول فراهم آورد.

این تحرکات نشان می‌دهد که رقابت برای برتری در زیرساخت‌های هوش مصنوعی تنها به نرم‌افزار محدود نیست؛ بلکه ترکیب استراتژیک سخت‌افزار، شبکه، انرژی و مدل‌های کسب‌وکار است که نقشه راه آیندهٔ خدمات هوش مصنوعی را شکل می‌دهد. دنبال کردن اخبار مربوط به سرمایه‌گذاری‌های زیرساختی، نوآوری‌های سیلیکونی و مدل‌های همکاری بین شرکت‌ها به تحلیلگران و تصمیم‌گیران کمک می‌کند تا چشم‌اندازی واقع‌بینانه از تکامل بازار هوش مصنوعی به‌دست آورند.

نظر بگذارید

نظرات

هنوز نظری ثبت نشده. اولین نفر باشید.