3 دقیقه
تصور کنید یک هوش مصنوعی با یک تریلیون پارامتر که نه روی GPUهای غربی، بلکه روی سختافزاری ساختهشده داخل چین اجرا میشود. این ایده شبیه بازنویسی کامل دنیای فناوری است و دقیقاً همان کاری است که دیپسیک با مدل نسل بعدی خود دنبال میکند.
گزارشها نشان میدهد دیپسیک V4 قرار است بهطور انحصاری روی جدیدترین تراشههای Ascend هواوی اجرا شود. این تغییر جهت، یک چرخش کوچک نیست. این تصمیم نشاندهنده حرکت گستردهتری برای پیوند دادن مدلهای پیشرفته با سیلیکون داخلی است، آن هم در شرایطی که محدودیتهای صادراتی دسترسی توسعهدهندگان چینی به تراشههای سری H انویدیا را دشوارتر کردهاند.
چرا این تغییر؟ بخشی از پاسخ این است که مقیاس بزرگ، اکنون هماهنگی دقیق میان معماری مدل و تراشهای را میطلبد که آن را اجرا میکند. هدف دیپسیک استقرار حدود یک تریلیون پارامتر است و انتظار میرود این استارتاپ برای رسیدن به سرعت استنتاج هدف و ظرفیت موردنظر، از صدها هزار پردازنده Ascend 950PR استفاده کند. هدف نهایی: حدود 1.8 برابر سرعت بیشتر در استنتاج، پنجره متنی نزدیک به یک میلیون توکن، و افزایش بهرهوری به کمک بهینهسازیهای سبک Engram.

این نکته آخر اهمیت زیادی دارد. تکنیکهای Engram نحوه ذخیره و بازیابی اطلاعات توسط مدلها را بازطراحی میکنند و با حفظ عمق استدلال، سربار حافظه را کاهش میدهند. برای مدلی در اندازه V4، چنین ترفندهایی تفاوت میان «عملی بودن» و «فقط در حد ایده» را رقم میزنند. گزارش شده دیپسیک ماهها صرف بازنویسی کدهای اصلی و تست بنچمارک با مهندسان هواوی و کَمبریکون کرده تا از این پشته جدید بیشترین کارایی را بگیرد.
غولهای دیگر فناوری چین نیز روی همین مسیر شرطبندی کردهاند. علیبابا، بایتدنس و تنسنت سفارشهای بزرگی برای تراشه Ascend 950PR ثبت کردهاند؛ نشانهای از اینکه اکوسیستم تراشه داخلی بهسرعت در حال تبدیل شدن به پلتفرم پیشفرض پروژههای بزرگ هوش مصنوعی در چین است. از این منظر، حرکت دیپسیک هم استراتژیک است و هم عملی.
زمانبندی این تصمیم هم مهم است. تراشههای H20 انویدیا با نظارت سختگیرانهتری در حوزه صادرات روبهرو شدهاند و همین موضوع استارتاپها و ارائهدهندگان ابری را به سمت مهاجرت سریعتر به شتابدهندههای تولید داخل سوق داده است. دیپسیک پیشتر هم در مدلهای قبلی از نسخههای Ascend استفاده کرده بود، بنابراین مهاجرت کامل به زیرساخت متمرکز بر هواوی، ادامه همان مسیر قبلی است نه یک جهش ناگهانی.
از نظر عملکردی، گفته میشود V4 بر قابلیتهای پیشرفته کدنویسی و استدلال چندمرحلهای بهتر تمرکز دارد. به زبان ساده: بهتر در نوشتن برنامههای پیچیده، بهتر در حفظ گفتوگوهای طولانی، و بهتر در کنار هم گذاشتن منطق در حجم عظیمی از متن. همچنین گزارش شده دو نسخه دیگر از V4 که برای تراشههای ساخت چین تنظیم شدهاند، در حال توسعه هستند و ممکن است پیش از پایان سال عرضه شوند.
در اینجا یک نتیجهگیری بزرگتر هم وجود دارد. رقابت هوش مصنوعی در حال تکهتکه شدن به اکوسیستمهای سختافزاری مختلف است که هر کدام با مجموعهای از کامپایلرها، زماناجراها و ترفندهای بهینهسازی مخصوص خود تنظیم شدهاند. برای استارتاپهایی مثل دیپسیک، مسیر رسیدن به عملکرد پیشرفته شاید اکنون به همان اندازه که به نوآوری الگوریتمی وابسته است، به سیلیکون داخلی هم وابسته باشد.
اینکه آیا این رویکرد موفق میشود یا نه، به این بستگی دارد که تیمهای نرمافزاری تا چه اندازه بتوانند تراشههای خام را به سرویسهایی قابل استفاده و قابل اعتماد تبدیل کنند و نیز اینکه چشمانداز جهانی سختافزار هوش مصنوعی با چه سرعتی تغییر خواهد کرد.





نظر بگذارید
نظرات (3)
هزینه و محدودیت صادرات که فشار بیاره، طبیعیه چین بره سمت اکوسیستم خودش. ولی تا وقتی بنچمارک واقعی نبینیم، یه کم باید شک کرد...
به نظرم این حرکت از نظر سیاسی و صنعتی کاملاً قابل درکه، اما هنوز معلوم نیست از پس پایداری و هزینه استنتاج هم بربیان یا نه
اگه این اعداد واقعی باشن، دیپسیک داره جدی بازی رو عوض میکنه... ولی 1 تریلیون پارامتر رو روی سختافزار داخلی؟ خیلی جسورانهست