اگزینوس ۲۶۰۰ و نت اسپرسو؛ جهش هوش مصنوعی در موبایل

ترکیب تراشه اگزینوس ۲۶۰۰ سامسونگ و پلتفرم Netspresso از Nota AI با هدف اجرای مدل‌های هوش مصنوعی بزرگ به‌صورت محلی، کاهش تأخیر، بهبود حریم خصوصی و افزایش عملکرد هوش مصنوعی روی گوشی‌ها انجام شده است.

.7 دیدگاه
اگزینوس ۲۶۰۰ و نت اسپرسو؛ جهش هوش مصنوعی در موبایل

8 دقیقه

دنبال کردن در گوگل

سیلیکون پرچم‌دار بعدی سامسونگ، اگزینوس ۲۶۰۰، وعده جهشی قابل‌توجه در ظرفیت‌های هوش مصنوعی روی دستگاه (on-device AI) را می‌دهد. این تراشه که روی فرآیند ساخت ۲ نانومتری طراحی شده و با هسته‌های پردازنده تازه و واحد گرافیکی (GPU) داخلی ترکیب شده، یک واحد پردازش عصبی (NPU) تقویت‌شده نیز دارد — و شرکت کره‌ای Nota AI در بهینه‌سازی این NPU برای اجرای مدل‌های بزرگ‌تر به‌صورت محلی نقش مهمی ایفا کرده است. در ادامه توضیح می‌دهیم این همکاری چه تأثیری بر عملکرد، مصرف انرژی، حریم خصوصی و تجربه کاربری اپلیکیشن‌ها خواهد داشت و چرا برای اکوسیستم موبایل اهمیت دارد.

چرا این موضوع برای هوش مصنوعی موبایل اهمیت دارد

شرکت Nota AI محصولی به نام Netspresso ارائه می‌کند؛ یک پلتفرم بهینه‌سازی مدل‌های هوش مصنوعی که می‌تواند اندازه مدل‌ها را تا حدود ۹۰ درصد کاهش دهد در حالی که دقت آن‌ها را تا حد زیادی حفظ می‌کند. این نوع کاهش تنها به صرفه‌جویی در فضای ذخیره‌سازی محدود نمی‌شود؛ بلکه نیازهای حافظه و محاسبات را نیز به طرز چشمگیری کاهش می‌دهد و به توسعه‌دهندگان و سازندگان اپلیکیشن اجازه می‌دهد مدل‌های مولد غنی‌تری را مستقیماً روی گوشی اجرا کنند بدون اینکه وابستگی مداوم به ابر داشته باشند. این موضوع بازتاب‌های گسترده‌ای دارد: از ویرایش پیشرفته تصاویر و ویدئو، دستیارهای هوشمند‌تر و طبیعی‌تر، تا قابلیت‌های حفظ حریم خصوصی که در حالت آفلاین نیز کارآمد باقی می‌مانند.

کاهش اندازه مدل‌ها معمولاً از طریق چند تکنیک صورت می‌گیرد: کمّی‌سازی (quantization) برای کاهش دقت عددی پارامترها، پیرایش و برش وزن‌ها (pruning) برای حذف اتصالات کم‌اثر، فشرده‌سازی ساختاری، و روش‌های تقلیدی مانند knowledge distillation که یک مدل بزرگ معلم، دانش خود را به مدل کوچک‌تر منتقل می‌کند. پلتفرم‌هایی مثل Netspresso اغلب ترکیبی از این روش‌ها را همراه با بهینه‌سازی‌های سطح اپراتور و ادغام عملیات (operator fusion) اعمال می‌کنند تا نه‌تنها حجم فایل کاهش یابد بلکه اجرای واقعی روی سخت‌افزار هدف با تاخیر کمتر و مصرف انرژی پایین‌تر امکان‌پذیر شود. این فرآیند زمانی که همراه با طراحی سخت‌افزاری مخصوص — مثل NPU بهینه‌شده در اگزینوس ۲۶۰۰ — انجام شود، بیشترین بهره‌وری را خواهد داشت.

سامسونگ همچنین قرار است با Nota AI در توسعه مجموعه ابزاری به‌نام Exynos AI Studio همکاری کند؛ یک toolchain بهینه‌سازی که هدفش تسهیل کار برای توسعه‌دهندگان است تا مدل‌های خود را دقیقاً برای سخت‌افزار اگزینوس تنظیم و عرضه کنند. این نوع یکپارچه‌سازی سخت‌افزار-نرم‌افزار (hardware-software co-design) همان رویکردی است که سامسونگ در بهبود عملکرد هوش مصنوعی روی اگزینوس ۲۵۰۰ برای گلکسی Z Flip 7 استفاده کرد و اکنون آن را برای تراشه‌ای در کلاس پرچم‌دار گسترده‌تر می‌کند. وقتی تیم‌های توسعه مدل بتوانند با ابزارهای رسمی سازگار شوند، فرایند پورت‌کردن، بهینه‌سازی و تست مدل‌ها کوتاه‌تر و قابل‌اطمینان‌تر می‌شود؛ این یعنی زمان عرضه امکانات جدید به بازار کاهش می‌یابد و تجربه کاربری یکنواخت‌تری حاصل می‌شود.

برای کاربران، مزایا ساده و ملموس است: استنتاج سریع‌تر، تأخیر کمتر، و کاهش وابستگی به اتصال شبکه. وقتی یک مدل مولد یا تشخیصی بتواند به‌صورت محلی اجرا شود، اپلیکیشن‌ها می‌توانند پاسخ‌ها را آنی‌تر ارائه دهند، حتی در شرایط آنتن‌دهی ضعیف یا حالت‌های پرواز. برای توسعه‌دهندگان اپلیکیشن، این یعنی امکان ارائه قابلیت‌های پیشرفته‌تر بدون اینکه همه پردازش‌ها را به سرورهای از راه دور ارسال کنند — که خود باعث کاهش هزینه‌های عملیاتی، افزایش حریم خصوصی کاربران و مقاومت بهتر در برابر قطع ارتباط می‌شود.

مدیرعامل Nota AI، Myungsu Chae، همکاری را ترکیب سخت‌افزار و نرم‌افزار در یک چارچوب با عملکرد بالا توصیف کرده است تا هوش مصنوعی مولد را به دستگاه‌های لبه‌ای (edge devices) بیاورد. این نوع مشارکت نمادین از جهت تجاری و فنّی است: شرکت‌های سازنده تراشه که قبلاً تمرکزشان بر کاهش مصرف انرژی و افزایش کارایی بود، اکنون به‌صورت فعال در اکوسیستم نرم‌افزاری سرمایه‌گذاری می‌کنند تا مزیت‌های سخت‌افزار خود را به‌طور مؤثر به توسعه‌دهندگان و کاربران منتقل کنند.

خواه شما پیگیر عملکرد نسل بعدی سری گلکسی S باشید یا علاقه‌مند به این که هوش مصنوعی روی دستگاه چگونه تجربه موبایل را بازتعریف خواهد کرد، ترکیب اگزینوس ۲۶۰۰ و Netspresso گامی برجسته به‌سوی هوش مصنوعی قوی‌تر، خصوصی‌تر و پاسخگوتر روی گوشی‌ها به‌نظر می‌رسد. در ادامه به جزییات فنی‌تر، سناریوهای کاربردی، چالش‌ها و چشم‌اندازها می‌پردازیم تا تصویر کامل‌تری از تاثیر این همکاری ارائه دهیم.

طراحی تراشه و مزایای ۲ نانومتری
فرآیند ساخت ۲ نانومتری به خلاصه‌ای از مزایا ختم می‌شود: افزایش تراکم ترانزیستور، بهبود کارایی انرژی و امکان طراحی هسته‌های سریع‌تر یا تعداد هسته‌های بیشتر در سطحی از توان مصرفی مشابه. برای محاسبات مربوط به هوش مصنوعی، این یعنی سامسونگ می‌تواند هسته‌های اختصاصی NPU را با توان پردازشی و بهره‌وری انرژی بالاتر تعبیه کند. وقتی این طراحی سخت‌افزاری با بهینه‌سازی‌های نرم‌افزاری مثل Netspresso همراه شود، مجموعه‌ای از فاکتورها کنار هم قرار می‌گیرند تا اجرای مدل‌های بزرگ‌تر و مولد روی دستگاه با مصرف انرژی معقول ممکن شود. البته ۲ نانومتر تنها یکی از عوامل است؛ نحوه مدیریت حافظه، پهنای باند داخلی، آدرس‌دهی حافظه و ویژگی‌های GPU و ISP (پردازش تصویر) هم در عملکرد نهایی تاثیرگذار هستند.

نقش NPU تقویت‌شده و بهینه‌سازی مدل
NPU در واقع واحدی است که عملیات ماتریسی عظیم مورد نیاز در شبکه‌های عصبی را با کارایی بالا انجام می‌دهد؛ از ضرب ماتریس تا توابع فعال‌سازی و نرمال‌سازی. وقتی مدل‌ها را تا ۹۰ درصد کوچک‌تر می‌کنید اما ساختار و دقت آن‌ها را حفظ می‌کنید، نه‌تنها فضای ذخیره کاهش می‌یابد بلکه نیاز به حافظه کاری (working memory) و ترافیک بین حافظه و محاسبات هم کاهش پیدا می‌کند؛ این حالت باعث می‌شود NPU بتواند بارهای کاری پیچیده‌تری را با مصرف انرژی کمتر پردازش کند. Netspresso و ابزارهای مشابه معمولاً با تولید یک نمای بهینه‌شده از مدل (optimized graph) و اعمال تبدیل‌های سطح پایین برای به حداقل رساندن عملیات غیرضروری، زمان اجرا را کم و بهره‌وری را افزایش می‌دهند.

Exynos AI Studio و تجربه توسعه‌دهنده
یکی از موانع اجرای موفق هوش مصنوعی روی دستگاه، پیچیدگی تبدیل مدل‌های توسعه‌یافته در محیط‌های دسکتاپی یا ابری به فرمتی است که با سخت‌افزار هدف سازگار باشد. Exynos AI Studio با هدف ساده‌سازی این مسیر طراحی شده است: از پشتیبانی فرمت‌های رایج مثل ONNX یا TensorFlow گرفته تا ابزارهای پروفایلینگ که مصرف انرژی و زمان اجرا را نشان می‌دهند، و توابع خودکار برای انتخاب استراتژی‌های کمّی‌سازی و پیرایش. این به توسعه‌دهنده امکان می‌دهد که چندین نسخه از یک مدل بسازد و بررسی کند کدام نسخه بهترین تعادل را بین دقت و عملکرد روی اگزینوس ۲۶۰۰ دارد. ضمن اینکه وجود یک toolchain رسمی، باعث می‌شود اپلیکیشن‌ها بهتر تست و تایید شوند و مشکلات سازگاری زودتر شناسایی شوند.

نمونه‌های کاربردی و تجربه کاربری
چند نمونه ملموس از مواردی که اجرای محلی مدل‌ها روی دستگاه بهبود می‌یابد عبارت‌اند از: ویرایش تصویر و ویدئو مبتنی بر شبکه عصبی (مثل حذف اجسام، افزایش کیفیت هوشمند، یا تبدیل سبک‌ها)، تولید متن و پاسخ‌های هوشمند در اپلیکیشن‌های پیام‌رسان یا دستیارها، ترجمه و تشخیص گفتار آفلاین با تاخیر بسیار پایین، و قابلیت‌های امنیتی مبتنی بر مدل مانند تشخیص چهره یا تحلیل رفتار. ترکیب NPU قدرتمند و مدل‌های بهینه‌شده به طراحان اپلیکیشن اجازه می‌دهد تا ویژگی‌هایی عرضه کنند که تا پیش از این یا به سرور نیاز داشتند یا به خاطر محدودیت منابع غیرعملی بودند.

ملاحظات حریم خصوصی و امنیت
یکی از بزرگ‌ترین مزایای انتقال بار محاسباتی از سرورهای ابری به دستگاه نهایی، کنترل بهتر بر داده‌های حساسی است که کاربر تولید می‌کند. وقتی پردازش روی دستگاه انجام شود، داده‌ها لازم نیست به سرورهای خارجی ارسال شوند که ریسک لو رفتن یا سوء‌استفاده کاهش می‌یابد. با این حال، اجرای مدل‌های مولد محلی با خود نیازمندی‌های امنیتی جدیدی می‌آورد: محافظت از مدل‌های محلی در برابر مهندسی معکوس یا دستکاری، مدیریت به‌روزرسانی‌های مدل به‌صورت امن، و تضمین اینکه بهینه‌سازی‌ها باعث کاهش بیش از حد دقت یا تغییرات ناخواسته در خروجی نمی‌شوند. ابزارهای رسمی مثل Exynos AI Studio می‌توانند در ایجاد استانداردهای به‌روزرسانی و امضای دیجیتال مدل‌ها کمک کنند.

چالش‌ها و محدودیت‌ها
با وجود تمام پیشرفت‌ها، هنوز چالش‌هایی باقی می‌ماند. برخی مدل‌های مولد بیش از حد پیچیده‌اند و حتی پس از فشرده‌سازی نیز نیاز به منابعی فراتر از توان یک گوشی دارند. همچنین، هزینه توسعه و تست چندین نسخه از مدل برای سخت‌افزارهای مختلف می‌تواند مسیر عرضه را کند کند. از منظر تجاری، رقابت با خدمات ابری که به‌طور نامحدود مقیاس‌پذیر هستند نیز وجود دارد؛ اما مزیت‌های حریم خصوصی، تاخیر کم و کارایی انرژی می‌تواند تعادل را به سمت اجرای محلی سوق دهد. در نهایت، بهبود تجربه کاربری نیازمند همگرایی میان طراحی سخت‌افزار، ابزارهای توسعه و استراتژی‌های تجاری برای عرضه ویژگی‌های جدید است.

چشم‌انداز آینده
ورود اگزینوس ۲۶۰۰ همراه با ابزارهایی مانند Netspresso می‌تواند آغازی برای یک موج جدید از قابلیت‌های هوش مصنوعی روی موبایل باشد؛ جایی که دستگاه‌ها توان انجام پردازش‌های پیچیده را با حداکثر احترام به حریم خصوصی و حداقل وابستگی به شبکه داشته باشند. در افق نزدیک، می‌توان انتظار داشت لایه‌ای از اپلیکیشن‌های خلاقانه شکل بگیرد که از پردازش محلی برای ارائه خدمات شخصی‌سازی‌شده، تعاملی و مقیاس‌پذیر استفاده می‌کنند—مثلاً ویرایش بلادرنگ ویدئو با هوش مصنوعی، ترجمه گفتگوهای چندزبانه بلافاصله و با کیفیت بالا، یا دستیارهای شخصی که بدون ارسال داده‌ها به ابر وظایف پیچیده را انجام می‌دهند.

در مجموع، اگر هدف سامسونگ فراهم کردن تجربه‌های هوشمندتر، سریع‌تر و خصوصی‌تر روی گوشی است، همکاری با Nota AI و تمرکز بر یکپارچه‌سازی نرم‌افزار-سخت‌افزار یک مسیر منطقی و مؤثر به‌نظر می‌رسد. اگزینوس ۲۶۰۰ همراه با Netspresso می‌تواند استاندارد جدیدی برای اجرا و استقرار مدل‌های هوش مصنوعی در دستگاه‌های موبایل تعیین کند و به توسعه‌دهندگان ابزارهایی بدهد تا قابلیت‌های نوآورانه‌ای را به کاربران نهایی عرضه کنند.

سارا حسینی
"من تازه‌ترین خبرهای دنیای فناوری را پوشش می‌دهم؛ از رونمایی محصولات تا تحولات شرکت‌ها. هدفم این است که خبر را سریع، واضح و بدون اغراق به خواننده منتقل کنم."

نظر بگذارید

نظرات (7)

نفس‌ساز

اگر این مسیر تداوم پیدا کنه، تا چند نسل آینده موبایل‌ها باهوش‌تر می‌شن. ترجمه فوری، دستیار آفلاین، و ویرایش زنده ویدیو!

برق‌وید

همه‌چیز خوبه اما ۹۰ درصد کوچک‌کردن مدل؟ شاید گاهی روی دقت اثر منفی بذاره. به‌روزرسانی امنیتی هم مسئله‌سازه.

فناورک

تصویر رو بهبود می‌ده، اما واقعاً تا چه حد می‌تونه بدون اینترنت کار کنه؟ تاخیر و حریم خصوصی باید با استراتژی‌های جدید هم‌سو باشه.

ایده‌ساز

من سال‌ها پروژه ویرایش ویدیو با هوش مصنوعی روی موبایل دارم. Netspresso شاید بتونه مدل‌ها رو جمع کنه و تجربه‌ی ویرایش سریع‌تری بده.

لابکور

واقعاً این همکاری تا چه حد به توسعه‌دهنده‌ها دسترسی سریع می‌ده؟ Exynos AI Studio چقدر کارش رو ساده می‌کنه؟ آیا مشکلات سازگاری هم وجود داره؟

سریع‌کار

می‌فهمم چرا می‌خوان هوش مصنوعی رو روی دستگاه بیارن؛ اگر دقت رو حفظ کنه، مصرف انرژی و تأخیر هم کم می‌شه.

نتاپلس

واااای واقعاً؟ اگزینوس ۲۶۰۰ با Netspresso یعنی دارک‌سپر هوش مصنوعی روی گوشی! سریع‌تر، آفلاین، و حریم خصوصی. فقط نگرانِ باتری هستم