چیپ های فوتونیک چینی؛ شتاب دهنده نوین برای پردازش تصویر

تحلیل مفصل از چیپ‌های فوتونیک هوش مصنوعی چینی (ACCEL و LightGen)، مزایا و محدودیت‌ها در پردازش تصویر و ویدیو، و پیامدهای احتمالی برای سخت‌افزار هوش مصنوعی و مراکز داده.

.6 دیدگاه
چیپ های فوتونیک چینی؛ شتاب دهنده نوین برای پردازش تصویر

7 دقیقه

دنبال کردن در گوگل

پژوهشگران چینی می‌گویند یک کلاس جدید از چیپ‌های فوتونیک برای هوش مصنوعی ساخته‌اند که در برخی وظایف یادگیری ماشین عملکرد را به‌طور چشمگیری افزایش می‌دهد — در مواردی ادعا می‌شود عملکرد بیش از ۱۰۰ برابر نسبت به GPUهای مرسوم داشته و در عین حال انرژی بسیار کمتری مصرف می‌کند. این دستگاه‌ها جایگزین عمومی برای شتاب‌دهنده‌های همه‌منظوره نیستند، اما می‌توانند نحوهٔ پردازش تصاویر، ویدیو و وظایف بینایی ماشینی را دگرگون کنند.

این چیپ‌های فوتونیک AI چه هستند؟

دو نمونهٔ برجسته از دانشگاه‌های معتبر چین منتشر شده‌اند. ACCEL که در دانشگاه Tsinghua توسعه یافته، یک طراحی هیبریدی است که عناصر فوتونیک را با مدارهای الکترونیکی آنالوگ ترکیب می‌کند. این چیپ با فرایندهای ساخت شرکت SMIC ساخته شده و تیم توسعه گزارش می‌دهد که ACCEL در برخی بارهای کاری آنالوگ می‌تواند حدود ۴.۶ پتافلاپس عملکرد ارائه دهد در حالی که تنها کسری ازتوان مصرفی GPUهای معمولی را به‌کار می‌گیرد.

پروژهٔ دیگر، LightGen که همکاری بین Shanghai Jiao Tong و Tsinghua است، یک چیپ کاملاً نوری است که بیش از دو میلیون «نورون فوتونیک» را در خود جای داده است. به گفتهٔ پژوهشگران، LightGen در وظایف محدود و مشخصی مانند تولید تصویر، انتقال سبک، حذف نویز و پردازش سه‌بعدی تصویر، افزایش‌های بزرگ در سرعت و کارایی ارائه می‌دهد.

این دو نمونهٔ اولیه نشان‌دهندهٔ رویکردهای متفاوت مهندسی فوتونیک برای هوش مصنوعی هستند: یکی ترکیب فوتونیک با مدارهای الکترونیکی آنالوگ برای انعطاف‌پذیری و سازگاری بیشتر، و دیگری طراحی تماماً اپتیکال برای بیشینه‌سازی موازی‌سازی نوری و چگالی نورون‌ها. هر رویکرد مزایا و چالش‌های خاص خود را دارد و به نحوهٔ کاربرد در پایپلاین‌های یادگیری عمیق بستگی دارد.

در سطح پیاده‌سازی فیزیکی، اجزایی مانند میکرورینگ‌ها، اینترفرومترهای Mach–Zehnder و شبکه‌های موجبر اپتیکال به‌عنوان بلوک‌های سازندهٔ ماتریس‌های ضرب در معماری‌های فوتونیک عمل می‌کنند. استفاده از این ساختارها امکان محاسبات ماتریسی موازی با پهنای باند بالا و تاخیر بسیار کم را فراهم می‌آورد که برای لایه‌های کانولوشن و ماتریسی در شبکه‌های عصبی مفید است.

از منظر فرآیند ساخت، سازگاری با خطوط تولید موجود مثل فرایندهای SMIC می‌تواند هزینه‌ها و پیچیدگی به‌کارگیری را کاهش دهد؛ با این حال طراحی فوتونیک روی سیلیکون نیازمند دانشی ترکیبی از فوتونیک یکپارچه و میکروالکترونیک است که تیم‌های بین‌رشته‌ای را الزامی می‌کند.

چرا فوتونیک می‌تواند در برخی وظایف AI از الکترون‌ها پیشی بگیرد

GPUهای مدرن مانند Nvidia A100 بر جریان الکترون از طریق میلیاردها ترانزیستور تکیه دارند. این معماری در اجرای گام‌به‌گام و برنامه‌پذیری انعطاف‌پذیر بسیار موفق است، اما مصرف انرژی بالا، تولید گرمای قابل توجه و وابستگی به گره‌های پیشرفتهٔ تولید را نیز به همراه دارد.

در مقابل، چیپ‌های فوتونیک با نور محاسبه می‌کنند. آن‌ها عملیات را از طریق تداخل نوری و تبدیلات آنالوگ انجام می‌دهند که می‌تواند برخی عملیات ریاضی را به‌صورت موازی و با سرعت نور اجرا کند. این ویژگی آنها را برای بارهای کاری از پیش‌تعریف‌شده و ماتریس‌محور بسیار سریع و کارآمد می‌کند — و گاهی امکان ساخت با فناوری‌های فرآیند بالغ‌تر را می‌دهد.

محاسبات آنالوگ نوری مزیت‌هایی مانند توان مصرفی پایین بر سر عملیات، تاخیر بسیار کم و توانایی پردازش موازی روی چندین طول‌موج یا کانال مستقل (Wavelength Division Multiplexing) را فراهم می‌آورد. این امر مخصوصاً در پردازش تصویر و ویدیو که شامل ضرب ماتریس‌ها و جمع‌های گسترده است، می‌تواند منجر به بهبود عملکرد انرژی و زمان شود.

با این حال مهم است بدانیم محاسبات نوری اغلب با محدودیت‌هایی در دقت عددی، نویز آنالوگ و تبدیل بین دامنه‌های آنالوگ و دیجیتال همراه است. مبدل‌های آنالوگ-به-دیجیتال (ADC) و دیجیتال-به-آنالوگ (DAC) می‌توانند درگاه‌هایی برای تنگنا و مصرف انرژی باشند؛ بنابراین طراحان معمولاً تلاش می‌کنند حجم تبدیلات دیجیتال حداقل باشد و چیدمان معماری طوری باشد که بیشترین کار در دامنهٔ نوری آنالوگ انجام شود.

دستاوردهای واقعی — اما در یک محدودهٔ خاص

گزارش‌ها نشان می‌دهد ACCEL و LightGen در بنچمارک‌های مشخصی مرتبط با بینایی و وظایف مولد (generative) در مقایسه با GPUهای متداول برتری‌های بزرگ نشان داده‌اند. با این وجود تیم‌های توسعه با احتیاط دربارهٔ محدودیت‌ها صحبت می‌کنند: این پردازنده‌های فوتونیک محاسبات آنالوگ پیش‌تعریف‌شده را اجرا می‌کنند و مناسب اجرای کد عمومی یا عملیات حافظه‌محور گسترده نیستند. به‌عبارت دیگر، آن‌ها شتاب‌دهنده‌هایی تخصصی‌اند نه جایگزین‌های عمومی برای GPU.

  • نقاط قوت: بسیار سریع در عملیات ماتریس و نوع کانولوشن، مصرف انرژی بسیار کمتر به ازای هر عملیات، و پتانسیل قوی برای خطوط پردازش تصویر/ویدیو/بینایی ماشینی.
  • محدودیت‌ها: تطابق ضعیف با بارهای کاری عمومی، برنامه‌پذیری محدودتر، و مدیریت حافظهٔ مقید و نیاز به واحدهای تبدیل آنالوگ-دیجیتال برای تعامل با سیستم‌های دیجیتال.

به‌طور خاص، مواردی مانند تولید تصویر با مدل‌های مولد مبتنی بر ماتریس‌های بزرگ، فیلترهای کانولوشنی و اعمال تغییرات ادراکی می‌توانند از محاسبهٔ آنالوگ نوری بهره‌مند شوند. اما برای آموزش شبکه‌های عظیم یا کارهایی که نیازمند منطق پیچیده و مدیریت حافظهٔ گسترده هستند (مثل الگوریتم‌های مبتنی بر حافظه یا مدل‌های زبان بزرگ)، GPU یا شتاب‌دهنده‌های دیجیتال دیگر همچنان لازم خواهند بود.

یکی از چالش‌های کلیدی ظرفیت حافظهٔ نوری است: ذخیره‌سازی وزن‌ها، بروزرسانی‌ها در طول آموزش و عملیات‌های با وابستگی بالا به حافظه برای مدل‌های بزرگ، نیازمند طراحی‌های هیبریدی هستند که از حافظهٔ الکترونیکی یا معماری‌های ترکیبی بهره‌مند شوند. بنابراین ترکیب نور و الکترونیک در قالب راه‌حل‌های مبتنی بر FPGA/ASIC هیبریدی یا پیاده‌سازی‌های با شتاب‌دهندهٔ فوتونیک به همراه کنترلرهای دیجیتال منطقی نقش اساسی دارد.

در نهایت، باید اشاره کرد که بنچمارک‌های گزارش‌شده معمولاً در شرایط آزمایشگاهی و برای مجموعه‌ای از وظایف انتخاب‌شده انجام شده‌اند؛ نتایج واقعی در محیط‌های تولیدی می‌تواند تحت تاثیر پیچیدگی‌های سیستم، تبدیل‌های فرمت داده، و یکپارچگی نرم‌افزاری تفاوت داشته باشد.

این برای سخت‌افزار AI چه معنی‌ای دارد

تصور کنید خطوط پردازش هوش مصنوعی که در آن پردازش‌های سنگین بصری به نودهای فوتونیک کم‌مصرف سپرده می‌شود، در حالی که GPUها مسئول آموزش انعطاف‌پذیر، مدیریت حافظه و بارهای کاری کلی‌تر هستند. چنین رویکرد هیبریدی می‌تواند هزینه‌های انرژی را کاهش و برنامه‌های بلادرنگ را تسریع کند؛ مخصوصاً برای مواردی مانند استنتاج روی دستگاه (on-device inference)، مزارع پردازش ویدیو در مراکز داده و خدمات مولد خاص.

برای مثال در یک خط تولید ویدیو سرور، فریم‌های ویدیویی می‌توانند ابتدا از طریق شتاب‌دهندهٔ فوتونیک برای عملیات کانولوشن و فیلترینگ عبور کنند تا استخراج ویژگی‌ها با کمترین مصرف انرژی انجام شود؛ سپس نتایج به واحدهای دیجیتال منتقل شود تا منطق بالاتر، تصمیم‌گیری و ذخیره‌سازی انجام گیرد. این نوع تقسیم کار بین فوتونیک و الکترونیک می‌تواند پهنای باند حافظهٔ دیجیتال و مصرف انرژی کلی را به‌طور چشمگیری کاهش دهد.

مهم است که تیم‌های چینی یافته‌های خود را در مجلهٔ Science منتشر کرده‌اند که نشان‌دهندهٔ اعتبار علمی و بازبینی همتا است. با این وجود مسیر از نمونهٔ آزمایشگاهی تا تولید انبوه دشوار باقی می‌ماند: مسئلهٔ یکپارچه‌سازی با زیست‌بوم نرم‌افزاری و سخت‌افزاری موجود، هزینهٔ ساخت و مقیاس‌پذیری، مدل‌های برنامه‌نویسی مناسب برای نگاشت شبکه‌های عصبی روی سخت‌افزار فوتونیک و پشتیبانی اکوسیستم از جمله موانع بزرگ هستند.

از دید عملیاتی نیز، موضوعاتی مانند پایداری عملکرد در برابر تغییرات دما، طول عمر مؤلفه‌های نوری، تلرانس به خطا و فرآیندهای کالیبراسیون دوره‌ای اهمیت پیدا می‌کند. سیستم‌های آنالوگ نوری می‌توانند به تنظیمات ظریف و کالیبراسیون منظم نیاز داشته باشند تا دقت و ثبات خروجی حفظ شود.

بنابراین آیا صنعت باید نگران شود؟ هنوز نه. چیپ‌های فوتونیک AI ظاهراً در حوزه‌های هدفمند مکمل GPUها خواهند بود، نه جایگزین آنها در همه‌جا. با این حال برای شرکت‌هایی که بر پردازش بصری در مقیاس بزرگ متمرکز هستند — مانند سرویس‌های تولید تصویر، پردازش ویدیو، بینایی ماشین در خودروهای خودران و مراکز دادهٔ تخصصی — این تحولات ارزش دنبال‌کردن دقیق را دارند.

در بلندمدت، ترکیب مزایای محاسبهٔ فوتونیک با انعطاف‌پذیری محاسبات دیجیتال می‌تواند موجب ظهور معماری‌های جدیدی شود که هر دو جهان را متحد می‌کنند: سرعت و کارایی فوتونیک برای لایه‌های سنگین ماتریس و توانایی مدیریت و آموزش دیجیتال برای منطق پیچیده و حافظه‌محور. بهبود در مدل‌های برنامه‌نویسی، ابزارهای کامپایلر و استانداردهای واسط سخت‌افزاری-نرم‌افزاری کلید توانمندسازی پذیرش تجاری خواهند بود.

در نهایت، توسعهٔ اکوسیستم شامل کتابخانه‌های نرم‌افزاری، مترجم‌های شبکه عصبی به توپولوژی‌های نوری و ابزارهای کالیبراسیون خودکار، به اندازهٔ بهبودهای سخت‌افزاری اهمیت دارد. بدون این ابزارها، بهره‌وری عملیاتی و زمان لازم برای توسعهٔ محصول واقعی ممکن است مانع پذیرش شود.

از منظر رقابتی، ظهور چنین شتاب‌دهنده‌هایی می‌تواند باعث پیدایش طبقه‌ای جدید از خدمات ابری تخصصی برای پردازش تصویر و مولدها شود که قیمت‌گذاری بر مبنای مصرف انرژی و تاخیر را بازتعریف کند. شرکت‌هایی که زودتر ابزارهای نرم‌افزاری و جریان‌های کاری (pipelines) مناسب برای نقشه‌برداری مدل‌ها به سخت‌افزار فوتونیک را توسعه دهند، مزیت قابل‌توجهی در بازار خواهند داشت.

به‌طور خلاصه، چیپ‌های فوتونیک یک گزینهٔ قدرتمند و تکاملی برای حوزه‌های تخصصی پردازش تصویر و ویدیو ارائه می‌دهند؛ اما مسیرشان به‌سوی جایگزینی کامل GPUها بسته است و در عوض احتمالاً به‌صورت مکمل و در معماری‌های هیبریدی وارد اکوسیستم خواهند شد.

مهدی بهرامی
"محتوای آموزشی درباره هوش مصنوعی و یادگیری ماشینی تولید می‌کنم، به‌صورتی که برای خواننده عمومی قابل‌فهم باشد و کاربردهای واقعی را نشان دهد."

نظر بگذارید

نظرات (6)

مهران

اما اکوسیستم نرم‌افزاری و کالیبراسیون لازم وجود داره؟ بدون ابزارهای توسعه و کتابخانه‌ها اینا فقط تست آزمایشگاهی می‌مونن.

جاده_سفر

باز هم می‌بینیم که معماری‌های هیبریدی دنبال تعادل‌اند: سرعت ماتریس در نور و انعطاف‌پذیری دیجیتال. منتظرم ببینم بازار چی نشون می‌ده.

لاب_کور

من تو پردازش تصاویر کار می‌کنم. اگر نورپردازی و کانولوشن اینا واقعاً سریع باشن، استنتاج روی دستگاه می‌تونه خیلی باصرفه‌تر بشه.

توربو_مک

ولی واقعاً این بنچمارک‌ها تو محیط تولید پایدارن؟ دقت، نویز و تبدیل‌های آنالوگ-دیجیتال چقدر تاثیر دارن؟

کوین_پیلوت

این چیپ‌های هیبریدی هیجان‌زا به نظر می‌رسن، اما به قول همه، جای GPU نیستن، فقط مکملن. مصرف انرژی پایین رو هم جالب می‌کنه.

راهکار_نور

واقعاً حیرت‌آور به نظر می‌رسه نور می‌تونه تا این حد سریع باشه. اگه واقعاً چنین کار می‌کنه، آینده پردازش تصویر خیلی تغییر می‌کنه!