دسترسی شما به ابزار تولید تصویر هوش مصنوعی را نه یک عدد ثابت، بلکه هدفی متحرک تصور کنید که توسط وصلههای امنیتی واکنشی و ترافیک سرور کنترل میشود. این نوسانات پس از عرضه ChatGPT Images 2.0 در ۲۱ آوریل ۲۰۲۶ شدت گرفت؛ سیستمی که با بهرهگیری از مدل gpt-image-2، تجربه کاربری را به دو حالت متمایز «آنی» (Instant) و «تفکر» (Thinking) تقسیم کرد.
حالت آنی برای همه کاربران، حتی کسانی که از نسخههای رایگان استفاده میکنند، در دسترس است. اما حالت تفکر — که شبیه به شطرنجبازی است که قبل از هر حرکت چند گام جلوتر را میبیند — تنها برای مشترکان Plus، Pro و Business فعال است. این سطح دسترسی ممتاز به مدل اجازه میدهد تا برای یافتن مراجع و منابع در وب جستوجو کند، تا ۸ تصویر در هر درخواست تولید کند و خروجیهایی با وضوح بالا تا 2K ارائه دهد. همچنین، مدل در حالت تفکر پیش از تحویل نهایی، نتایج را بازبینی و خود-اصلاحی میکند تا کیفیت خروجی ارتقا یابد. طبق بررسیهای انجام شده توسط The Decoder، حالت تفکر صحنههایی بسیار واقعگرایانهتر نسبت به نسخه آنی تولید میکند، هرچند باید اشاره کرد که این یافته حاصل یک مقایسه تکموردی بود و نه یک محک سیستماتیک و جامع.
همانطور که در تحلیل قبلی ما دربارهی ادغام جستوجوی وب در مدلهای GPT-5 توسط Amazon Bedrock اشاره کردیم، این تغییر به سمت «تفکر» و ارجاع به منابع خارجی در تولید تصویر، نشاندهنده یک روند گستردهتر برای افزودن لایههای استدلالی به خروجیهای چندوجهی (Multimodal) است؛ مدلی که مثل انسان همزمان متن، عکس و صدا را میفهمد. با این حال، برای کاربر عادی، خستهکنندهترین بخش این تجربه، کیفیت تصاویر نیست، بلکه سقف نامرئی و مبهمی است که تعیین میکند آنها چه تعداد تصویر میتوانند خلق کنند.
افسانه محدودیتهای ثابت
بسیاری از وبلاگهای جامعه کاربری ادعا میکنند محدودیتهای مشخصی وجود دارد؛ برای مثال، ۲ تا ۳ تصویر در روز برای کاربران رایگان یا ۴۰ تا ۵۰ تصویر در هر سه ساعت برای مشترکان Plus. اما باید تأکید کرد که این اعداد صرفاً تخمینهای جامعه کاربری هستند و نه واقعیتهای رسمی. مرکز کمک OpenAI هیچ جدول ثابتی از محدودیتها را منتشر نکرده است، زیرا سیستم به صورت لحظهای و بر اساس تقاضای سرورها، این سقفها را تنظیم میکند.

تنها منبع حقیقت، بنر پویایی است که هنگام نزدیک شدن به سقف مجاز، در رابط کاربری ChatGPT ظاهر میشود. این بنر تعداد درخواستهای باقیمانده و زمان دقیق بازنشانی (Reset) محدودیت را نشان میدهد. تکیه بر مقالات شخص ثالث که قدیمیتر از شش هفته هستند ریسک بالایی دارد، زیرا مدل بین مارس ۲۰۲۵ تا آوریل ۲۰۲۶ با سرعتی زیاد تکامل یافت و از gpt-image-1 به 1-mini، سپس ۱.۵ و در نهایت به gpt-image-2 رسید.
کاربران باید همچنین توجه کنند که در حالت تفکر، یک درخواست برای تولید دستهای (تا ۸ تصویر) تنها یک واحد از سقف مجاز را مصرف میکند. این بدان معناست که محدودیت توسط خودِ «پرامپت» مصرف میشود، نه بر اساس تعداد فایلهای خروجی که روی صفحه نمایش داده میشوند. اگر گردش کار خود را بر اساس یک عدد ثابت از تولیدات برنامهریزی کنید، ریسک این را میپذیرید که در میانه یک ضربالاجل کاری، در صورت تغییر بار سرور، ناگهان با بنبست مواجه شوید.
نوسان قوانین ایمنی
آنچه میتوانید یا نمیتوانید تولید کنید، تقریباً به همان سرعتِ محدودیتها تغییر میکند. در مارس ۲۰۲۵، جوآن جانگ، توسعهدهنده سیاستهای OpenAI، از تغییر رویکرد در مورد چهرههای شناختهشده خبر داد. او توضیح داد که شرکت از مسدود کردن کلی تمام چهرههای عمومی به سمت یک سیستم داوطلبانه برای «خروج» (opt-out) حرکت کرده است. این بدان معناست که اکنون افراد مشهور خودشان تصمیم میگیرند که آیا میخواهند از تصویرشان محافظت شود یا خیر، به جای اینکه شرکت تصمیم بگیرد چه کسی به اندازه کافی «مهم» هست که تحت حفاظت قرار گیرد.
رسانه TechCrunch تأیید کرد که این انعطاف در قوانین، اجازه داد تا مدل چهرههای عمومی و سبکهای بصری برندها را رندر کند. با این حال، شرکت همچنان تقلید از هنرمندان زنده را اکیداً ممنوع کرده و محدودیتهای سختگیرانهتری را برای تصاویر کودکان نسبت به دوران DALL-E 3 اعمال میکند.
این باز شدنِ محدودیتها، بلافاصله شکافهای امنیتی ایجاد کرد. در آوریل ۲۰۲۵، کاربران نشان دادند که ChatGPT میتواند پاسپورتها و کارتهای شناسایی جعلی و کاملاً واقعگرایانه تولید کند. بوریس موسلاک، بنیانگذار SMOK Ventures، در گزارش خود برای Biometric Update اشاره کرد که هر فرآیند تأییدی که بر پایه تصاویر به عنوان مدرک است، اکنون رسماً منسوخ شده است.

پاسخ OpenAI به این بحران واکنشی بود؛ آنها واترمارکهای «نمونه» (sample) و «غیررسمی» (not for official use) را به اسناد تولیدشده اضافه کردند. این الگوی «اول شکست، بعد اصلاح» حتی در درخواستهای روزمره و ساده هم دیده میشود. TechRadar در مارس ۲۰۲۵ گزارش داد که مدل گاهی بدون هیچ توضیحی، متن روی سنگقبرها یا تابلوهای خیابان را مسدود میکند، حتی در حالی که چنین محتوایی به هیچ وجه غیرقانونی نیست.
جزئیات فنی و نقاط ضعف
هنگام ویرایش عکسهای شخصی، کاربران اغلب متوجه میشوند که ویژگیهای چهره تغییر میکند یا به اصطلاح «ذوب» میشود. این اتفاق به این دلیل رخ میدهد که مدلهای انتشار (Diffusion Model) — که شبیه به هنرمندی است که ابتدا یک بوم پر از نویز میبیند و سپس ذرهذره آن را به تصویر تبدیل میکند — پیکسلها را کپی نمیکنند، بلکه صحنه را تفسیر کرده و آن را از ابتدا بازسازی میکنند. حتی یک درخواست ساده برای تغییر پسزمینه به فصل زمستان، میتواند به طور ناخواسته شکل بینی یا چشمها را تغییر دهد.
- اعوجاج چهره: برای کاهش این مشکل، YouCam AI Pro پیشنهاد میکند صراحتاً در پرامپت ذکر کنید که «ویژگیهای اصلی چهره و شکل چشمها و بینی حفظ شود». هرچند این روش میتواند اعوجاج را کاهش دهد، اما هیچ محک مستقلی برای اثبات کارایی آن در تمام خط تولید مدلهای gpt-image وجود ندارد.
- نقصهای سیستماتیک: طبق مستندات موجود در Wikipedia، محدودیتهای ثبتشده شامل ضعف در مدیریت چندین چهره در یک قاب، خطا در رندر کردن فونتهای غیرلاتین، نوردهی بیش از حد (overlighting) و ژستهای بدنی نادرست در نسخه ۱.۵ است.
- مشکلات عرضه: نسخه gpt-image-1.5 که در دسامبر عرضه شد، وعده حفظ بهتر لوگوها و چهرهها و سرعت ۴ برابر بیشتر را داده بود. اما کاربران اولیه در انجمن OpenAI گزارش دادند که به دلیل عرضه منطقهای و مرحلهای (phased rollout)، در دسترسی به API با خطاهای متعددی مواجه شدهاند.
- قابلیت اطمینان متن: آسملاش تکا هادگو، پژوهشگر Lesan AI، هشدار میدهد که این مدلها فقط «بستر را بازسازی میکنند». او استدلال میکند که متنهای تمیز و دقیق در تصاویر هرگز تضمینشده نیستند، صرفنظر از چند نمونه موفق در دموها، مانند منوی رستورانی که در آوریل ۲۰۲۶ توسط TechCrunch تست شد.
این شکاف فنی باعث دوقطبی شدن تجربه کاربران شده است. در وبسایت MacRumors، برخی کاربران نتایج جدید را یک جهش بزرگ میدانند، در حالی که برخی دیگر آنها را «زبالههای هوش مصنوعی» (AI slop) و ابزاری برای اجرای طرحهای کلاهبرداری علیه افراد سالمند توصیف میکنند.
بهداشت دادهها و جایگزینها
برای کسانی که نگران حریم خصوصی هستند، باید دانست عکسهای آپلودشده تا زمانی که چت موجود باشد، در سیستم باقی میمانند. طبق مرکز کمک OpenAI، دادهها ظرف ۳۰ روز پس از حذف چت پاک میشوند، مگر اینکه الزامات قانونی خاصی مانع از این کار شود. برای حفظ حداکثری حریم خصوصی، توصیه میشود چت را بلافاصله پس از تولید تصویر حذف کنید.
برخی کاربران برای جریانهای کاری حرفهای که نیاز به هزینهها و محدودیتهای پیشبینیپذیر دارند، به سراغ تجمیعکنندههای API مانند provod.ai رفتهاند. این پلتفرمها موجودی شفاف و قیمتگذاری به ازای هر فراخوانی (per-call) ارائه میدهند و حدس و گمانهای مربوط به بنرهای پنهان رابط کاربری را حذف میکنند. آنها همچنین امکان پرداخت با روبل و ارائه اسناد بستری برای حسابداری شرکتی را فراهم میکنند.
در نهایت، هیچ دفترچه قانون دائمی برای تصاویر ChatGPT وجود ندارد. منطق رد درخواستها و تعداد تولیدات مجاز، واکنشی است و هر چند ماه یکبار بر اساس آخرین حوادث امنیتی یا فشار سرورها تغییر میکند. در لحظه محدودیت خود را چک کنید، در ویرایش چهره صریح باشید و انتظار داشته باشید که قوانین تغییر کنند.
گام بعدی شما
- برای جلوگیری از اعوجاج چهره در ویرایشها، از عبارات صریح «حفظ ویژگیهای اصلی چهره» در پرامپت استفاده کنید.
- به جای تکیه بر مقالات وب، برای دانستن سقف تولید، فقط به بنر لحظهای داخل محیط ChatGPT اعتماد کنید.
- اگر برای کارهای تجاری به تعداد مشخصی تصویر نیاز دارید، از سرویسهای API با قیمتگذاری شفاف استفاده کنید تا با محدودیتهای ناگهانی مواجه نشوید.
اما داستان سختافزاری این تحول حتی شگفتانگیزتر است — به تحلیل ما دربارهی تراشههای Blackwell مراجعه کنید.




گفتگو