پرش به محتوای اصلی
پرش به محتوای مقاله

گوگل با Google Pics ویرایش دقیق اشیا را به Workspace آورد

·۱۱ شهریور ۱۴۰۵۴ دقیقه مطالعه۳ بازدید
راه‌اندازی Google Pics برای مشتریان Workspace و مشترکان هوش مصنوعی
راه‌اندازی Google Pics برای مشتریان Workspace و مشترکان هوش مصنوعی
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

گذار از تولید تصویر کلی به ویرایش سطح شیء (Object-level editing) در محیط Workspace؛ حالا می‌توان بدون تغییر در کل تصویر، فقط یک جزء خاص را جابه‌جا یا اصلاح کرد.

تصور کنید می‌خواهید رنگ یک محصول را در یک عکس تبلیغاتی تغییر دهید، اما نمی‌خواهید کل تصویر از اول ساخته شود. با عرضه Google Pics در ۱ سپتامبر ۲۰۲۶، این کابوس برای تیم‌های بازاریابی به پایان رسید. آیا تیم‌های تجاری بالاخره می‌توانند از روش آزمون و خطای خسته‌کننده در پرامپت‌نویسی هوش مصنوعی رها شوند؟ با عرضه این ابزار برای مشترکین Workspace و کاربران AI، پاسخ مثبت است.

این مجموعه ویرایش دقیق تصاویر، فراتر از تولید ساده است. این ابزار به کاربران اجازه می‌دهد اشیای خاصی را در یک تصویر ایزوله کرده و آن‌ها را تغییر دهند، بدون اینکه بقیه ترکیب‌بندی تصویر تحت تأثیر قرار گیرد. این ابزار دیگر به شما نمی‌گوید «امیدوارم مدل بفهمد چه می‌خواهید»، بلکه کنترل جراحی‌گونه‌ای روی هر پیکسل به شما می‌دهد. گوگل با این اقدام، هوش مصنوعی را از یک «ماشین اسلات» که شاید جواب درست بدهد، به یک ابزار مهندسی دقیق تبدیل کرده است.

همان‌طور که در تحلیل قبلی ما درباره‌ی ابزارهای تولید محتوای سازمانی اشاره کردیم، نیاز بازار از «تولید تصادفی» به «کنترل دقیق» تغییر کرده است. Google Pics — شبیه به یک میز کار دیجیتال که هر جزء تصویر را می‌توان جدا کرد و جابه‌جا نمود — دقیقاً برای پر کردن این شکاف طراحی شده است. این عرضه نشان‌دهنده انتقال از مرحله محدود «تسترهای مورد اعتماد» (Trusted Tester) به دسترسی عمومی است. در حالی که تولید تصویر با AI پذیرش گسترده‌ای در سطح شخصی داشته، گوگل Pics را به عنوان یک جایگزین حرفه‌ای برای ابزارهایی مانند Canva معرفی می‌کند تا اصطکاکاتی را که کسب‌وکارها در ایجاد دارایی‌های بازاریابی و روایت بصری محصولات با آن مواجه هستند، برطرف کند.

زمینه و ریشه‌ها

گوگل برای اولین بار Pics را در ۱۹ مه ۲۰۲۶، در جریان کنفرانس توسعه‌دهندگان I/O معرفی کرد. این معرفی بخشی از یک مجموعه بزرگ‌تر از به‌روزرسانی‌های Workspace بود. این به‌روزرسانی‌ها شامل یک Inbox AI گسترش‌یافته، قابلیت‌های صوتی مکالمه‌ای برای Keep، Docs و Gmail، و یک عامل هوش مصنوعی شخصی به نام Gemini Spark بود. این تحولات در کنار نقش جدید GAS در اکوسیستم هوش مصنوعی به عنوان یک لایه اجرایی، زیرساخت‌های Workspace را برای اتوماسیون پیشرفته‌تر آماده کرده است.

پس از رونمایی در I/O، این ابزار وارد مرحله تست محدود برای کاربران منتخب شد. عرضه ۱ سپتامبر در واقع تحقق همان جدول زمانی اولیه شرکت است و این ابزار را به طور هم‌زمان برای هر دو سطح تجاری و مشترکین شخصی به ارمغان می‌آورد.

این سرویس بر پایه مدل هوش مصنوعی زاینده (Generative AI) — مثل هنرمندی که میلیاردها تصویر را دیده و حالا می‌تواند هر چیزی را خلق کند — مدل Nano Banana و Gemini کار می‌کند. طبق گزارش unite.ai، Google Pics به عنوان یک محصول مستقل در آدرس pics.new فعالیت می‌کند و به طور مستقیم در Google Docs و Slides ادغام شده است. کاربران می‌توانند تصاویر خود را از کامپیوتر، گوگل درایو یا گوگل فوتوز وارد کنند تا بر اساس یک پرامپت واحد، چندین جایگزین مختلف تولید کنند.

جزئیات قابلیت‌های ویرایش دقیق

قابلیت‌های کلیدی این مجموعه عبارتند از:

  • قطعه‌بندی تصویر (Object Segmentation): کاربران می‌توانند عناصر خاصی را در یک عکس ایزوله، جابه‌جا، تغییر اندازه یا متحول کنند، بدون اینکه بقیه تصویر تغییر کند.
  • تغییرات هدفمند: این مجموعه از قابلیت پیوست کردن کامنت‌های متنی به نواحی خاصی از تصویر برای درخواست ویرایش‌های دقیق پشتیبانی می‌کند. کاربران می‌توانند چندین ویرایش را به طور هم‌زمان اجرا کنند و تغییرات نامطلوب را به حالت قبل برگردانند. این رویکرد یادآور تبدیل خط لوله‌های AI به APIهای بصری است که مدیریت جریان‌های کاری پیچیده را ساده‌تر می‌کند.
  • ویرایش متن درون‌تصویری: کاربران می‌توانند کلمات داخل یک تصویر را تغییر داده یا ترجمه کنند، در حالی که فونت اصلی و استایل طراحی حفظ می‌شود.
  • افزایش وضوح و مقیاس‌بندی (Resolution Scaling): این ابزار می‌تواند تصاویر را به رزولوشن 2K یا 4K ارتقا دهد و آن‌ها را برای شبکه‌های اجتماعی، چاپ، وب یا فرمت‌های دیجیتال برش (Crop) دهد.

کاربردهای تجاری و سازمانی

گوگل این محصول را پاسخی مستقیم به تقاضای کسب‌وکارها می‌داند. این شرکت اشاره کرد که تیم‌ها هنگام ایجاد تصاویر در سطح حرفه‌ای، با نتایج ناسازگار و گردش کارهای دشوار در چندین اپلیکیشن مختلف دست و پنجه نرم می‌کردند.

به طور خاص، گوگل پیشنهاد می‌کند که از Pics برای موارد زیر استفاده شود:

  • ایجاد و ترجمه دارایی‌های دیجیتال و اجتماعی برای بازارهای جهانی.
  • قرار دادن مفاهیم محصول در پس‌زمینه‌ها یا زمینه‌های مختلف. این قابلیت به طور مستقیم به روند کاهش هزینه‌های استودیویی برندها از طریق عکاسی محصول مبتنی بر AI کمک می‌کند.
  • ایده‌پردازی برای اقلام تبلیغاتی رویدادها و طراحی‌های چاپی.
  • توسعه کارت‌های ویزیت و فلایرهای شرکتی.

مدل همکاری در اینجا از استاندارد Workspace پیروی می‌کند و به چندین کاربر اجازه می‌دهد از طریق یک لینک مشترک، یک تصویر واحد را ویرایش کنند. ادغام با Docs و Slides در حال حاضر فعال است؛ گوگل اعلام کرد که قابلیت ویرایش تقریباً هر تصویری که در Drive ذخیره شده است تنها با یک کلیک، در هفته‌های آینده اضافه خواهد شد.

این تغییر نشان‌دهنده حرکتی به سمت «کنترل دانه‌بندی شده» (Granular Control) است و فاصله گرفتن از «نتایج زشت» است که اغلب توسط چت‌بات‌های استاندارد تولید می‌شد. گوگل با تبدیل تصویر از یک شبکه ثابت از پیکسل‌ها به مجموعه‌ای از اشیای قابل ویرایش، سعی دارد مشکل «ثبات» (Consistency) را که مانع پذیرش AI در سازمان‌ها شده بود، حل کند.

برای یک کاربر تجاری معمولی، این به معنای پایان بازسازی کل یک تصویر تنها برای تغییر رنگ پس‌زمینه یا اصلاح یک غلط املایی در یک گرافیک است. این ابزار، AI را از یک «ماشین اسلات» که شاید جواب درست بدهد، به یک ابزار جراحی برای مدیریت دارایی‌های دیجیتال تبدیل می‌کند.

گوگل Pics را از Google Photos متمایز نگه داشته است؛ اولی ابزاری برای پروژه‌های خلاقانه است و دومی مرکزی برای پشتیبان‌گیری و سازماندهی خاطرات شخصی. این تفکیک تضمین می‌کند که گردش کارهای حرفه‌ای از خاطرات شخصی جدا بمانند.

دسترسی به این ابزار برای کاربران پلن‌های Workspace Business Standard، Business Plus، Enterprise Standard و Enterprise Plus فراهم شده است. همچنین این ابزار برای پلن‌های شخصی Google AI Pro و Ultra و همچنین پلن Google AI Pro for Education در دسترس است. کاربران می‌توانند دسترسی خود را از طریق مرکز کمک در صفحه محصول تأیید کنند.

منتظر ادغام آتی با Google Drive باشید، که احتمالاً گوگل درایو را به یک هاب طراحی AI متمرکز برای تیم‌های شرکتی تبدیل خواهد کرد.

گام بعدی شما

  • اگر مشترک Workspace هستید، همین حالا در docs.new قابلیت ویرایش مستقیم تصاویر را تست کنید.
  • برای کمپین‌های بین‌المللی، از قابلیت ویرایش متن درون‌تصویری برای بومی‌سازی سریع گرافیک‌ها استفاده کنید.
  • منتظر ادغام کامل با Google Drive باشید تا تمام دارایی‌های بصری شرکت را در یک هاب AI مدیریت کنید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این ابزار با تکیه بر اعتبار زیرساختی Gemini، هزینه و زمان تولید محتوای بصری در سازمان‌ها را به شدت کاهش می‌دهد. در واقع، کنترل دقیق روی اشیا، مانع اصلی پذیرش هوش مصنوعی در استودیوهای طراحی حرفه‌ای بود که اکنون برطرف شده است.

تأثیر برای ایران

به‌دلیل محدودیت‌های دسترسی به سرویس‌های Google Workspace و نیاز به حساب‌های تجاری، استفاده از این ابزار برای اکثر کاربران ایرانی دشوار است و احتمالاً از طریق واسطه‌ها یا VPNهای تجاری در دسترس قرار می‌گیرد.

·نگاه ما
تحریریه دات‌هوش

جایگزینی «پرامپت‌های طولانی» با «ویرایش لایه‌ای» نشان می‌دهد که گوگل متوجه شکست مدل‌های مولد در حفظ ثبات (Consistency) شده است. این یک چرخش از رویکرد احتمالی به رویکرد ساختاری است؛ یعنی مدل باید بفهمد تصویر از چه اجزایی تشکیل شده، نه اینکه فقط پیکسل‌ها را حدس بزند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.