7 دقیقه
نانوبانانا، هوش مصنوعی تولید تصویر مبتنی بر فناوری Gemini، از محدوده اپلیکیشن Gemini فراتر رفته و مستقیم درون Google Search و Google Lens قرار گرفته است. اکنون کاربران میتوانند بدون نیاز به نصب برنامه جداگانه، از نوار جستجو یا تجربه دوربین Lens برای ایجاد و ویرایش تصاویر استفاده کنند. این ادغام تمرکز روی سهولت دسترسی، تولید تصویر فوری و ویرایش در محل را به همراه دارد که میتواند جریان کارهای خلاقانه و روزمره را سادهتر کند.
نحوه نمایش نانوبانانا در حالت AI Mode جستجوی گوگل
در حالت AI Mode در Google Search، یک آیکون جدید به شکل بعلاوه (+) در پایین-چپ فیلد متن ظاهر میشود، در حالی که جستجوی صوتی و Lens به سمت راست منتقل شدهاند. این تغییر ظریف، دسترسی سریع به ابزارهای تولید و ویرایش تصویر را بدون خروج از صفحه نتایج فراهم میکند و هدف آن کاهش میانبرها و سادهسازی فرایند خلاقیت تصویری است.
اضافه شدن این میانبر باعث شده تا کاربر بتواند با چند ضربه ساده به امکاناتی مانند آپلود عکس، ویرایش موضعی و تولید تصویر جدید دسترسی پیدا کند. این قابلیت بهخصوص برای کسانی که در جستجو به دنبال الهام تصویری یا اصلاح فوری عکس هستند مفید است و تجربهی جستجو را تعاملیتر میکند.
رابط کاربری و تجربه کاربر
رابط کاربری به گونهای طراحی شده که گزینههای اصلی به سرعت در دسترس باشند و تجربه روانی برای ایجاد تصویر فراهم شود. هدف طراحی، کاهش پیچیدگی و نمایش واضح گزینهها است تا کاربران با هر سطح تجربهای بتوانند از امکانات استفاده نمایند. این گزینهها برای کاربرانی که به دنبال تولید تصویر مفهومی، اصلاح رنگ یا ترکیب تصاویر هستند مناسب است.
- منوی جدید لینکهایی به گالری شما، دوربین و گزینهای با عنوان Create با ایموجی موز دارد.
- با انتخاب Create، متن راهنما (placeholder) به «شرح تصویر خود را بنویسید» تغییر میکند تا بتوانید یک دستور متنی تایپ کنید یا عکس برای ویرایش بارگذاری کنید.
- تصاویر تولیدشده شبیه خروجیهای اپ Gemini رفتار میکنند: قابل دانلود، قابل اشتراک و دارای واترمارک با برند Gemini در گوشه تصویر.
![]() | ![]() | ![]() |
در عمل، این ابزار به گونهای کار میکند که پس از باز کردن منوی بعلاوه (+) بتوانید منبع تصویر (گالری یا دوربین) را انتخاب کرده و سپس با نوشتن یک فرمان متنی، نانوبانانا را برای تولید یا ویرایش تصویر هدایت کنید. نتیجه میتواند برای کاربردهای مختلفی از شبکههای اجتماعی تا پروژههای طراحی سریع مورد استفاده قرار گیرد.
ایجاد و ویرایش در لحظه در Google Lens
Google Lens اکنون زبانه جدیدی به نام Create دارد که نانوبانانا بهصورت بومی در آن ادغام شده است. طراحی جدید، برچسبهای متنی را زیر آیکونها قرار میدهد تا فیلترها و گزینههای بیشتری همزمان نمایش داده شوند، و دکمه شاتر اکنون با ایموجی موز همراه شده — انتخابی که خوانا، صریح و غیرقابل اشتباه است.
بهصورت پیشفرض، فیلتر از دوربین سلفی استفاده میکند (قابلیت تغییر دوربین در سمت راست وجود دارد). پس از ثبت تصویر، تصویر گرفتهشده به باکس ورودی AI Mode منتقل میشود تا بتوانید متن راهنما را اضافه کنید و نانوبانانا را برای تولید یا ویرایش تصویر هدایت کنید.
جریان کاری در Lens برای تولید تصویر
جریان کار در Lens به گونهای طراحی شده که کاربر بتواند از لحظه ثبت تصویر تا دریافت خروجی ویرایششده یا تولیدشده، در همان محیط باقی بماند. این روند کم کردن نیاز به جابجایی بین اپلیکیشنها را هدف قرار میدهد و باعث میشود فرآیندهای سریع مانند تغییر پسزمینه، اصلاح رنگ، یا افزودن عناصر گرافیکی بهسرعت انجام شوند.
موارد استفاده عملی
موارد استفاده عملی شامل خلق تصاویر برای پستهای رسانههای اجتماعی، ساخت نمونههای اولیه بصری برای کمپینهای تبلیغاتی، ویرایش فوری عکسهای گرفتهشده در سفر، و همچنین تولید تصاویر مفهومی برای طراحی محصول است. ادغام با Lens به کاربران امکان میدهد تا از قابلیتهای شناسایی بصری Lens (مانند شناسایی اشیاء و متن) بهعنوان نقطه شروع برای تولید یا ویرایش تصویر استفاده کنند.
زیرساخت فنی: Gemini 2.5 Flash Image
مدل تصویری که نانوبانانا را در گوگل توان میبخشد، Gemini 2.5 Flash Image است. این مدل از معماریهایی بهره میبرد که هم تولید تصویر (image generation) و هم ویرایش تصویر (image editing) را بهطور مستقیم درون Search و Lens پشتیبانی میکنند. خروجیها گزینههای دانلود و اشتراک را فراهم میآورند و دارای واترمارک Gemini هستند تا محتوای تولیدشده توسط هوش مصنوعی قابل شناسایی بماند.
Gemini 2.5 Flash Image با طراحی برای کار در محیطهای تعاملیِ کاربر-محور، تلاش میکند تا زمان تاخیر (latency) را کاهش دهد و کیفیت تصویر را در حدی نگه دارد که برای کاربردهای مصرفی و نیمهحرفهای مناسب باشد. این مدل ترکیبی از تکنیکهای مدرن تولید تصویر، تطبیق بافت، و پردازش سبک هنری است تا نتایج قابل قبولی ارائه دهد.
ویژگیهای فنی و محافظتی
از لحاظ فنی، چنین مدلهایی معمولاً شامل مکانیزمهای فیلترینگ محتوا، سیاستهای ایمنی و ابزارهای تشخیص محتوای نامناسب هستند تا ریسک تولید تصاویر خلاف قوانین و هنجارها کاهش یابد. واترمارک Gemini نیز به شناسایی منبع هوش مصنوعی کمک میکند که در زمینه شفافیت و نشانهگذاری محتوای تولیدشده اهمیت دارد.
علاوه بر این، مدلهای جدید تلاش میکنند تا با استفاده از دادههای متنوع و بهروز، از تولید تصاویر با سوگیریهای آشکار جلوگیری کنند و تنظیمات حریم خصوصی را برای کاربرانی که نمیخواهند تصاویرشان در دادههای آموزشی استفاده شود، تسهیل نمایند. این نوع جزئیات برای سازمانها و افراد حرفهای که حساسیت بیشتری نسبت به مالکیت دادهها دارند مهم است.
![]() | ![]() | ![]() |
چه کسانی هماکنون میتوانند آن را تجربه کنند؟
این قابلیت امروز در ایالات متحده برای کاربران اندروید که در Search Lab ثبتنام کردهاند و حالت AI Mode را فعال دارند، در حال عرضه است. اگر جزو آن گروه آزمایشی هستید، انتظار داشته باشید که گزینههای نانوبانانا بهزودی در هر دو محیط Search و Lens برایتان ظاهر شود.
فرآیند عرضه معمولاً مرحلهای است و ممکن است بسته به بازخورد کاربران و سنجش عملکرد سرورها و مدل، در بازههای زمانی متفاوت برای مناطق و دستگاههای دیگر نیز منتشر شود. گوگل معمولاً ویژگیهای جدید را ابتدا برای گروههای آزمایشی عرضه میکند تا مشکلات احتمالی قبل از انتشار گسترده شناسایی و رفع شوند.
راهنمای دسترسی و ملزومات
برای دسترسی به این قابلیت لازم است که نسخه بهروز Google Search و Google Lens را داشته باشید، در آزمایشگاه جستجو (Search Lab) ثبتشده باشید، و AI Mode را فعال کرده باشید. از آنجایی که فعلاً عرضه محدود و مرحلهای است، ممکن است برخی کاربران در خارج از منطقه عرضه قادر به دیدن این گزینهها نباشند تا زمانی که انتشار جهانی آغاز شود.
حفظ حریم خصوصی و اشتراکگذاری
هنگامی که تصویر تولید یا ویرایش میشود، کاربر میتواند آن را دانلود یا مستقیماً از طریق رابط اشتراکگذاری گوگل ارسال کند. در مواردی که تصویر حاوی اطلاعات حساس یا محتوای شخصی است، بهتر است کاربران قبل از اشتراکگذاری، نسبت به حریم خصوصی و مجوزهای استفاده از تصویر دقت کنند. شرکتها معمولاً قابلیتهایی برای محدود کردن دسترسی و مدیریت دادهها ارائه میدهند که برای سازمانهای نیازمند کنترل بیشتر مفید است.
تصور کنید عکسی میگیرید، یک فرمان کوتاه مینویسید و فوراً تصویری ویرایششده یا تازه تولیدشده دریافت میکنید—بدون تغییر اپلیکیشن. نانوبانانا قصد دارد این جریان کاری را یکپارچه کند. اگر میخواهید با تولید تصویر در لحظه آزمایش کنید، این ادغام تصاویر مولد را به مرکز ابزارهای جستجو و دوربین گوگل میآورد.
چشمانداز و تاثیر بر تولید محتوا
ادغام نانوبانانا با Search و Lens میتواند روند تولید محتوای تصویری را تغییر دهد. برای تولیدکنندگان محتوا، بازاریابان و توسعهدهندگان، امکان تولید سریع تصاویر با کیفیت قابل قبول در محیطی که قبلاً برای جستجو و شناسایی استفاده میشد، میتواند زمان تولید را کاهش دهد و خلاقیت را تسریع کند. این قابلیت همچنین میتواند به ابزارهای پروتوتایپ سریع و گردش کارهای تصویری جدید در اپلیکیشنهای موبایل کمک کند.
با این حال، اهمیت دارد که کاربران و تولیدکنندگان محتوا با اصول اخلاقی، شفافیت در استفاده از هوش مصنوعی و قوانین مربوط به کپیرایت و مالکیت معنوی نیز آشنا باشند. استفاده مسئولانه از فناوریهای تولید تصویر، هم برای حفظ کیفیت اکوسیستم و هم برای رعایت حقوق افراد و هنرمندان اهمیت بالایی دارد.
در نهایت، نانوبانانا نمونهای از این است که چگونه مدلهای پیشرفته تصویری میتوانند مستقیماً در ابزارهای روزمره کاربران جای بگیرند و تجربههای جدیدی برای خلق و ویرایش بصری فراهم آورند. ترکیب Gemini 2.5 Flash Image با رابطهای ساده و دسترسی از طریق Search و Lens، پایهای برای کاربردهای آینده در تولید تصویر تعاملی است.












نظر بگذارید
نظرات
هنوز نظری ثبت نشده. اولین نفر باشید.