نانوبانانا: تولید و ویرایش تصویر در جستجو و Google Lens

نانوبانانا، هوش مصنوعی تولید و ویرایش تصویر مبتنی بر Gemini، اکنون در Google Search و Google Lens قرار گرفته است؛ امکان ساخت، ویرایش و دانلود تصاویر مستقیماً از نوار جستجو یا دوربین Lens بدون اپ جداگانه را فراهم می‌کند.

نانوبانانا: تولید و ویرایش تصویر در جستجو و Google Lens

7 دقیقه

دنبال کردن در گوگل

نانوبانانا، هوش مصنوعی تولید تصویر مبتنی بر فناوری Gemini، از محدوده اپلیکیشن Gemini فراتر رفته و مستقیم درون Google Search و Google Lens قرار گرفته است. اکنون کاربران می‌توانند بدون نیاز به نصب برنامه جداگانه، از نوار جستجو یا تجربه دوربین Lens برای ایجاد و ویرایش تصاویر استفاده کنند. این ادغام تمرکز روی سهولت دسترسی، تولید تصویر فوری و ویرایش در محل را به همراه دارد که می‌تواند جریان کارهای خلاقانه و روزمره را ساده‌تر کند.

نحوه نمایش نانوبانانا در حالت AI Mode جستجوی گوگل

در حالت AI Mode در Google Search، یک آیکون جدید به شکل بعلاوه (+) در پایین-چپ فیلد متن ظاهر می‌شود، در حالی که جستجوی صوتی و Lens به سمت راست منتقل شده‌اند. این تغییر ظریف، دسترسی سریع به ابزارهای تولید و ویرایش تصویر را بدون خروج از صفحه نتایج فراهم می‌کند و هدف آن کاهش میان‌برها و ساده‌سازی فرایند خلاقیت تصویری است.

اضافه شدن این میان‌بر باعث شده تا کاربر بتواند با چند ضربه ساده به امکاناتی مانند آپلود عکس، ویرایش موضعی و تولید تصویر جدید دسترسی پیدا کند. این قابلیت به‌خصوص برای کسانی که در جستجو به دنبال الهام تصویری یا اصلاح فوری عکس هستند مفید است و تجربه‌ی جستجو را تعاملی‌تر می‌کند.

رابط کاربری و تجربه کاربر

رابط کاربری به گونه‌ای طراحی شده که گزینه‌های اصلی به سرعت در دسترس باشند و تجربه روانی برای ایجاد تصویر فراهم شود. هدف طراحی، کاهش پیچیدگی و نمایش واضح گزینه‌ها است تا کاربران با هر سطح تجربه‌ای بتوانند از امکانات استفاده نمایند. این گزینه‌ها برای کاربرانی که به دنبال تولید تصویر مفهومی، اصلاح رنگ یا ترکیب تصاویر هستند مناسب است.

  • منوی جدید لینک‌هایی به گالری شما، دوربین و گزینه‌ای با عنوان Create با ایموجی موز دارد.
  • با انتخاب Create، متن راهنما (placeholder) به «شرح تصویر خود را بنویسید» تغییر می‌کند تا بتوانید یک دستور متنی تایپ کنید یا عکس برای ویرایش بارگذاری کنید.
  • تصاویر تولیدشده شبیه خروجی‌های اپ Gemini رفتار می‌کنند: قابل دانلود، قابل اشتراک و دارای واترمارک با برند Gemini در گوشه تصویر.

در عمل، این ابزار به گونه‌ای کار می‌کند که پس از باز کردن منوی بعلاوه (+) بتوانید منبع تصویر (گالری یا دوربین) را انتخاب کرده و سپس با نوشتن یک فرمان متنی، نانوبانانا را برای تولید یا ویرایش تصویر هدایت کنید. نتیجه می‌تواند برای کاربردهای مختلفی از شبکه‌های اجتماعی تا پروژه‌های طراحی سریع مورد استفاده قرار گیرد.

ایجاد و ویرایش در لحظه در Google Lens

Google Lens اکنون زبانه جدیدی به نام Create دارد که نانوبانانا به‌صورت بومی در آن ادغام شده است. طراحی جدید، برچسب‌های متنی را زیر آیکون‌ها قرار می‌دهد تا فیلترها و گزینه‌های بیشتری هم‌زمان نمایش داده شوند، و دکمه شاتر اکنون با ایموجی موز همراه شده — انتخابی که خوانا، صریح و غیرقابل اشتباه است.

به‌صورت پیش‌فرض، فیلتر از دوربین سلفی استفاده می‌کند (قابلیت تغییر دوربین در سمت راست وجود دارد). پس از ثبت تصویر، تصویر گرفته‌شده به باکس ورودی AI Mode منتقل می‌شود تا بتوانید متن راهنما را اضافه کنید و نانوبانانا را برای تولید یا ویرایش تصویر هدایت کنید.

جریان کاری در Lens برای تولید تصویر

جریان کار در Lens به گونه‌ای طراحی شده که کاربر بتواند از لحظه ثبت تصویر تا دریافت خروجی ویرایش‌شده یا تولیدشده، در همان محیط باقی بماند. این روند کم کردن نیاز به جابجایی بین اپلیکیشن‌ها را هدف قرار می‌دهد و باعث می‌شود فرآیندهای سریع مانند تغییر پس‌زمینه، اصلاح رنگ، یا افزودن عناصر گرافیکی به‌سرعت انجام شوند.

موارد استفاده عملی

موارد استفاده عملی شامل خلق تصاویر برای پست‌های رسانه‌های اجتماعی، ساخت نمونه‌های اولیه بصری برای کمپین‌های تبلیغاتی، ویرایش فوری عکس‌های گرفته‌شده در سفر، و همچنین تولید تصاویر مفهومی برای طراحی محصول است. ادغام با Lens به کاربران امکان می‌دهد تا از قابلیت‌های شناسایی بصری Lens (مانند شناسایی اشیاء و متن) به‌عنوان نقطه شروع برای تولید یا ویرایش تصویر استفاده کنند.

زیرساخت فنی: Gemini 2.5 Flash Image

مدل تصویری که نانوبانانا را در گوگل توان می‌بخشد، Gemini 2.5 Flash Image است. این مدل از معماری‌هایی بهره می‌برد که هم تولید تصویر (image generation) و هم ویرایش تصویر (image editing) را به‌طور مستقیم درون Search و Lens پشتیبانی می‌کنند. خروجی‌ها گزینه‌های دانلود و اشتراک را فراهم می‌آورند و دارای واترمارک Gemini هستند تا محتوای تولیدشده توسط هوش مصنوعی قابل شناسایی بماند.

Gemini 2.5 Flash Image با طراحی برای کار در محیط‌های تعاملیِ کاربر-محور، تلاش می‌کند تا زمان تاخیر (latency) را کاهش دهد و کیفیت تصویر را در حدی نگه دارد که برای کاربردهای مصرفی و نیمه‌حرفه‌ای مناسب باشد. این مدل ترکیبی از تکنیک‌های مدرن تولید تصویر، تطبیق بافت، و پردازش سبک هنری است تا نتایج قابل قبولی ارائه دهد.

ویژگی‌های فنی و محافظتی

از لحاظ فنی، چنین مدل‌هایی معمولاً شامل مکانیزم‌های فیلترینگ محتوا، سیاست‌های ایمنی و ابزارهای تشخیص محتوای نامناسب هستند تا ریسک تولید تصاویر خلاف قوانین و هنجارها کاهش یابد. واترمارک Gemini نیز به شناسایی منبع هوش مصنوعی کمک می‌کند که در زمینه شفافیت و نشانه‌گذاری محتوای تولیدشده اهمیت دارد.

علاوه بر این، مدل‌های جدید تلاش می‌کنند تا با استفاده از داده‌های متنوع و به‌روز، از تولید تصاویر با سوگیری‌های آشکار جلوگیری کنند و تنظیمات حریم خصوصی را برای کاربرانی که نمی‌خواهند تصاویرشان در داده‌های آموزشی استفاده شود، تسهیل نمایند. این نوع جزئیات برای سازمان‌ها و افراد حرفه‌ای که حساسیت بیشتری نسبت به مالکیت داده‌ها دارند مهم است.

چه کسانی هم‌اکنون می‌توانند آن را تجربه کنند؟

این قابلیت امروز در ایالات متحده برای کاربران اندروید که در Search Lab ثبت‌نام کرده‌اند و حالت AI Mode را فعال دارند، در حال عرضه است. اگر جزو آن گروه آزمایشی هستید، انتظار داشته باشید که گزینه‌های نانوبانانا به‌زودی در هر دو محیط Search و Lens برایتان ظاهر شود.

فرآیند عرضه معمولاً مرحله‌ای است و ممکن است بسته به بازخورد کاربران و سنجش عملکرد سرورها و مدل، در بازه‌های زمانی متفاوت برای مناطق و دستگاه‌های دیگر نیز منتشر شود. گوگل معمولاً ویژگی‌های جدید را ابتدا برای گروه‌های آزمایشی عرضه می‌کند تا مشکلات احتمالی قبل از انتشار گسترده شناسایی و رفع شوند.

راهنمای دسترسی و ملزومات

برای دسترسی به این قابلیت لازم است که نسخه به‌روز Google Search و Google Lens را داشته باشید، در آزمایشگاه جستجو (Search Lab) ثبت‌شده باشید، و AI Mode را فعال کرده باشید. از آن‌جایی که فعلاً عرضه محدود و مرحله‌ای است، ممکن است برخی کاربران در خارج از منطقه عرضه قادر به دیدن این گزینه‌ها نباشند تا زمانی که انتشار جهانی آغاز شود.

حفظ حریم خصوصی و اشتراک‌گذاری

هنگامی که تصویر تولید یا ویرایش می‌شود، کاربر می‌تواند آن را دانلود یا مستقیماً از طریق رابط اشتراک‌گذاری گوگل ارسال کند. در مواردی که تصویر حاوی اطلاعات حساس یا محتوای شخصی است، بهتر است کاربران قبل از اشتراک‌گذاری، نسبت به حریم خصوصی و مجوزهای استفاده از تصویر دقت کنند. شرکت‌ها معمولاً قابلیت‌هایی برای محدود کردن دسترسی و مدیریت داده‌ها ارائه می‌دهند که برای سازمان‌های نیازمند کنترل بیشتر مفید است.

تصور کنید عکسی می‌گیرید، یک فرمان کوتاه می‌نویسید و فوراً تصویری ویرایش‌شده یا تازه تولیدشده دریافت می‌کنید—بدون تغییر اپلیکیشن. نانوبانانا قصد دارد این جریان کاری را یکپارچه کند. اگر می‌خواهید با تولید تصویر در لحظه آزمایش کنید، این ادغام تصاویر مولد را به مرکز ابزارهای جستجو و دوربین گوگل می‌آورد.

چشم‌انداز و تاثیر بر تولید محتوا

ادغام نانوبانانا با Search و Lens می‌تواند روند تولید محتوای تصویری را تغییر دهد. برای تولیدکنندگان محتوا، بازاریابان و توسعه‌دهندگان، امکان تولید سریع تصاویر با کیفیت قابل قبول در محیطی که قبلاً برای جستجو و شناسایی استفاده می‌شد، می‌تواند زمان تولید را کاهش دهد و خلاقیت را تسریع کند. این قابلیت همچنین می‌تواند به ابزارهای پروتوتایپ سریع و گردش کارهای تصویری جدید در اپلیکیشن‌های موبایل کمک کند.

با این حال، اهمیت دارد که کاربران و تولیدکنندگان محتوا با اصول اخلاقی، شفافیت در استفاده از هوش مصنوعی و قوانین مربوط به کپی‌رایت و مالکیت معنوی نیز آشنا باشند. استفاده مسئولانه از فناوری‌های تولید تصویر، هم برای حفظ کیفیت اکوسیستم و هم برای رعایت حقوق افراد و هنرمندان اهمیت بالایی دارد.

در نهایت، نانوبانانا نمونه‌ای از این است که چگونه مدل‌های پیشرفته تصویری می‌توانند مستقیماً در ابزارهای روزمره کاربران جای بگیرند و تجربه‌های جدیدی برای خلق و ویرایش بصری فراهم آورند. ترکیب Gemini 2.5 Flash Image با رابط‌های ساده و دسترسی از طریق Search و Lens، پایه‌ای برای کاربردهای آینده در تولید تصویر تعاملی است.

نظر بگذارید

نظرات

هنوز نظری ثبت نشده. اولین نفر باشید.