پرش به محتوای اصلی
پرش به محتوای مقاله

محدودیت‌های تولید تصویر ChatGPT بر اساس بار سرور و وصله‌های امنیتی تغییر می‌کند

·۱۵ مرداد ۱۴۰۵۷ دقیقه مطالعه۳ بازدید
چت‌جی‌پی‌تی و تصویر: چرا محدودیت تولید عدد ندارد، اما رد درخواست منطقی؟
چت‌جی‌پی‌تی و تصویر: چرا محدودیت تولید عدد ندارد، اما رد درخواست منطقی؟
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

معرفی حالت «تفکر» در تصاویر ChatGPT که با افزودن لایه استدلال و جست‌وجوی وب، کیفیت واقع‌گرایانه را افزایش داده اما محدودیت‌های دسترسی را به جای اعداد ثابت، به متغیرهای پویا تبدیل کرده است.

دسترسی شما به ابزار تولید تصویر هوش مصنوعی را نه یک عدد ثابت، بلکه هدفی متحرک تصور کنید که توسط وصله‌های امنیتی واکنشی و ترافیک سرور کنترل می‌شود. این نوسانات پس از عرضه ChatGPT Images 2.0 در ۲۱ آوریل ۲۰۲۶ شدت گرفت؛ سیستمی که با بهره‌گیری از مدل gpt-image-2، تجربه کاربری را به دو حالت متمایز «آنی» (Instant) و «تفکر» (Thinking) تقسیم کرد.

حالت آنی برای همه کاربران، حتی کسانی که از نسخه‌های رایگان استفاده می‌کنند، در دسترس است. اما حالت تفکر — که شبیه به شطرنج‌بازی است که قبل از هر حرکت چند گام جلوتر را می‌بیند — تنها برای مشترکان Plus، Pro و Business فعال است. این سطح دسترسی ممتاز به مدل اجازه می‌دهد تا برای یافتن مراجع و منابع در وب جست‌وجو کند، تا ۸ تصویر در هر درخواست تولید کند و خروجی‌هایی با وضوح بالا تا 2K ارائه دهد. همچنین، مدل در حالت تفکر پیش از تحویل نهایی، نتایج را بازبینی و خود-اصلاحی می‌کند تا کیفیت خروجی ارتقا یابد. طبق بررسی‌های انجام شده توسط The Decoder، حالت تفکر صحنه‌هایی بسیار واقع‌گرایانه‌تر نسبت به نسخه آنی تولید می‌کند، هرچند باید اشاره کرد که این یافته حاصل یک مقایسه تک‌موردی بود و نه یک محک سیستماتیک و جامع.

همان‌طور که در تحلیل قبلی ما درباره‌ی ادغام جست‌وجوی وب در مدل‌های GPT-5 توسط Amazon Bedrock اشاره کردیم، این تغییر به سمت «تفکر» و ارجاع به منابع خارجی در تولید تصویر، نشان‌دهنده یک روند گسترده‌تر برای افزودن لایه‌های استدلالی به خروجی‌های چندوجهی (Multimodal) است؛ مدلی که مثل انسان هم‌زمان متن، عکس و صدا را می‌فهمد. با این حال، برای کاربر عادی، خسته‌کننده‌ترین بخش این تجربه، کیفیت تصاویر نیست، بلکه سقف نامرئی و مبهمی است که تعیین می‌کند آن‌ها چه تعداد تصویر می‌توانند خلق کنند.

افسانه محدودیت‌های ثابت

بسیاری از وبلاگ‌های جامعه کاربری ادعا می‌کنند محدودیت‌های مشخصی وجود دارد؛ برای مثال، ۲ تا ۳ تصویر در روز برای کاربران رایگان یا ۴۰ تا ۵۰ تصویر در هر سه ساعت برای مشترکان Plus. اما باید تأکید کرد که این اعداد صرفاً تخمین‌های جامعه کاربری هستند و نه واقعیت‌های رسمی. مرکز کمک OpenAI هیچ جدول ثابتی از محدودیت‌ها را منتشر نکرده است، زیرا سیستم به صورت لحظه‌ای و بر اساس تقاضای سرورها، این سقف‌ها را تنظیم می‌کند.

چت‌جی‌پی‌تی و تصویر: چرا محدودیت تولید عدد ندارد، اما رد درخواست‌ها منطقی ندارد

تنها منبع حقیقت، بنر پویایی است که هنگام نزدیک شدن به سقف مجاز، در رابط کاربری ChatGPT ظاهر می‌شود. این بنر تعداد درخواست‌های باقی‌مانده و زمان دقیق بازنشانی (Reset) محدودیت را نشان می‌دهد. تکیه بر مقالات شخص ثالث که قدیمی‌تر از شش هفته هستند ریسک بالایی دارد، زیرا مدل بین مارس ۲۰۲۵ تا آوریل ۲۰۲۶ با سرعتی زیاد تکامل یافت و از gpt-image-1 به 1-mini، سپس ۱.۵ و در نهایت به gpt-image-2 رسید.

کاربران باید همچنین توجه کنند که در حالت تفکر، یک درخواست برای تولید دسته‌ای (تا ۸ تصویر) تنها یک واحد از سقف مجاز را مصرف می‌کند. این بدان معناست که محدودیت توسط خودِ «پرامپت» مصرف می‌شود، نه بر اساس تعداد فایل‌های خروجی که روی صفحه نمایش داده می‌شوند. اگر گردش کار خود را بر اساس یک عدد ثابت از تولیدات برنامه‌ریزی کنید، ریسک این را می‌پذیرید که در میانه یک ضرب‌الاجل کاری، در صورت تغییر بار سرور، ناگهان با بن‌بست مواجه شوید.

نوسان قوانین ایمنی

آنچه می‌توانید یا نمی‌توانید تولید کنید، تقریباً به همان سرعتِ محدودیت‌ها تغییر می‌کند. در مارس ۲۰۲۵، جوآن جانگ، توسعه‌دهنده سیاست‌های OpenAI، از تغییر رویکرد در مورد چهره‌های شناخته‌شده خبر داد. او توضیح داد که شرکت از مسدود کردن کلی تمام چهره‌های عمومی به سمت یک سیستم داوطلبانه برای «خروج» (opt-out) حرکت کرده است. این بدان معناست که اکنون افراد مشهور خودشان تصمیم می‌گیرند که آیا می‌خواهند از تصویرشان محافظت شود یا خیر، به جای اینکه شرکت تصمیم بگیرد چه کسی به اندازه کافی «مهم» هست که تحت حفاظت قرار گیرد.

رسانه TechCrunch تأیید کرد که این انعطاف در قوانین، اجازه داد تا مدل چهره‌های عمومی و سبک‌های بصری برندها را رندر کند. با این حال، شرکت همچنان تقلید از هنرمندان زنده را اکیداً ممنوع کرده و محدودیت‌های سخت‌گیرانه‌تری را برای تصاویر کودکان نسبت به دوران DALL-E 3 اعمال می‌کند.

این باز شدنِ محدودیت‌ها، بلافاصله شکاف‌های امنیتی ایجاد کرد. در آوریل ۲۰۲۵، کاربران نشان دادند که ChatGPT می‌تواند پاسپورت‌ها و کارت‌های شناسایی جعلی و کاملاً واقع‌گرایانه تولید کند. بوریس موسلاک، بنیان‌گذار SMOK Ventures، در گزارش خود برای Biometric Update اشاره کرد که هر فرآیند تأییدی که بر پایه تصاویر به عنوان مدرک است، اکنون رسماً منسوخ شده است.

چت‌جی‌پی‌تی و تصویر: چرا محدودیت تولید عدد ندارد، اما رد درخواست‌ها منطقی؟

پاسخ OpenAI به این بحران واکنشی بود؛ آن‌ها واترمارک‌های «نمونه» (sample) و «غیررسمی» (not for official use) را به اسناد تولیدشده اضافه کردند. این الگوی «اول شکست، بعد اصلاح» حتی در درخواست‌های روزمره و ساده هم دیده می‌شود. TechRadar در مارس ۲۰۲۵ گزارش داد که مدل گاهی بدون هیچ توضیحی، متن روی سنگ‌قبرها یا تابلوهای خیابان را مسدود می‌کند، حتی در حالی که چنین محتوایی به هیچ وجه غیرقانونی نیست.

جزئیات فنی و نقاط ضعف

هنگام ویرایش عکس‌های شخصی، کاربران اغلب متوجه می‌شوند که ویژگی‌های چهره تغییر می‌کند یا به اصطلاح «ذوب» می‌شود. این اتفاق به این دلیل رخ می‌دهد که مدل‌های انتشار (Diffusion Model) — که شبیه به هنرمندی است که ابتدا یک بوم پر از نویز می‌بیند و سپس ذره‌ذره آن را به تصویر تبدیل می‌کند — پیکسل‌ها را کپی نمی‌کنند، بلکه صحنه را تفسیر کرده و آن را از ابتدا بازسازی می‌کنند. حتی یک درخواست ساده برای تغییر پس‌زمینه به فصل زمستان، می‌تواند به طور ناخواسته شکل بینی یا چشم‌ها را تغییر دهد.

  • اعوجاج چهره: برای کاهش این مشکل، YouCam AI Pro پیشنهاد می‌کند صراحتاً در پرامپت ذکر کنید که «ویژگی‌های اصلی چهره و شکل چشم‌ها و بینی حفظ شود». هرچند این روش می‌تواند اعوجاج را کاهش دهد، اما هیچ محک مستقلی برای اثبات کارایی آن در تمام خط تولید مدل‌های gpt-image وجود ندارد.
  • نقص‌های سیستماتیک: طبق مستندات موجود در Wikipedia، محدودیت‌های ثبت‌شده شامل ضعف در مدیریت چندین چهره در یک قاب، خطا در رندر کردن فونت‌های غیرلاتین، نوردهی بیش از حد (overlighting) و ژست‌های بدنی نادرست در نسخه ۱.۵ است.
  • مشکلات عرضه: نسخه gpt-image-1.5 که در دسامبر عرضه شد، وعده حفظ بهتر لوگوها و چهره‌ها و سرعت ۴ برابر بیشتر را داده بود. اما کاربران اولیه در انجمن OpenAI گزارش دادند که به دلیل عرضه منطقه‌ای و مرحله‌ای (phased rollout)، در دسترسی به API با خطاهای متعددی مواجه شده‌اند.
  • قابلیت اطمینان متن: آسملاش تکا هادگو، پژوهشگر Lesan AI، هشدار می‌دهد که این مدل‌ها فقط «بستر را بازسازی می‌کنند». او استدلال می‌کند که متن‌های تمیز و دقیق در تصاویر هرگز تضمین‌شده نیستند، صرف‌نظر از چند نمونه موفق در دموها، مانند منوی رستورانی که در آوریل ۲۰۲۶ توسط TechCrunch تست شد.

این شکاف فنی باعث دوقطبی شدن تجربه کاربران شده است. در وب‌سایت MacRumors، برخی کاربران نتایج جدید را یک جهش بزرگ می‌دانند، در حالی که برخی دیگر آن‌ها را «زباله‌های هوش مصنوعی» (AI slop) و ابزاری برای اجرای طرح‌های کلاهبرداری علیه افراد سالمند توصیف می‌کنند.

بهداشت داده‌ها و جایگزین‌ها

برای کسانی که نگران حریم خصوصی هستند، باید دانست عکس‌های آپلودشده تا زمانی که چت موجود باشد، در سیستم باقی می‌مانند. طبق مرکز کمک OpenAI، داده‌ها ظرف ۳۰ روز پس از حذف چت پاک می‌شوند، مگر اینکه الزامات قانونی خاصی مانع از این کار شود. برای حفظ حداکثری حریم خصوصی، توصیه می‌شود چت را بلافاصله پس از تولید تصویر حذف کنید.

برخی کاربران برای جریان‌های کاری حرفه‌ای که نیاز به هزینه‌ها و محدودیت‌های پیش‌بینی‌پذیر دارند، به سراغ تجمیع‌کننده‌های API مانند provod.ai رفته‌اند. این پلتفرم‌ها موجودی شفاف و قیمت‌گذاری به ازای هر فراخوانی (per-call) ارائه می‌دهند و حدس و گمان‌های مربوط به بنرهای پنهان رابط کاربری را حذف می‌کنند. آن‌ها همچنین امکان پرداخت با روبل و ارائه اسناد بستری برای حسابداری شرکتی را فراهم می‌کنند.

در نهایت، هیچ دفترچه قانون دائمی برای تصاویر ChatGPT وجود ندارد. منطق رد درخواست‌ها و تعداد تولیدات مجاز، واکنشی است و هر چند ماه یک‌بار بر اساس آخرین حوادث امنیتی یا فشار سرورها تغییر می‌کند. در لحظه محدودیت خود را چک کنید، در ویرایش چهره صریح باشید و انتظار داشته باشید که قوانین تغییر کنند.

گام بعدی شما

  • برای جلوگیری از اعوجاج چهره در ویرایش‌ها، از عبارات صریح «حفظ ویژگی‌های اصلی چهره» در پرامپت استفاده کنید.
  • به جای تکیه بر مقالات وب، برای دانستن سقف تولید، فقط به بنر لحظه‌ای داخل محیط ChatGPT اعتماد کنید.
  • اگر برای کارهای تجاری به تعداد مشخصی تصویر نیاز دارید، از سرویس‌های API با قیمت‌گذاری شفاف استفاده کنید تا با محدودیت‌های ناگهانی مواجه نشوید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این وضعیت نشان می‌دهد که حتی پیشرفته‌ترین مدل‌های چندوجهی هنوز در برابر نوسانات زیرساختی و چالش‌های ایمنی آسیب‌پذیرند. تکیه بر اعتبار OpenAI در مدیریت این تضادها، تعیین‌کننده پذیرش این ابزارها در محیط‌های حرفه‌ای خواهد بود.

تأثیر برای ایران

به‌دلیل محدودیت‌های دسترسی و نیاز به پرداخت ارزی برای اشتراک Plus، کاربران ایرانی بیشتر با نسخه آنی و محدودیت‌های سخت‌گیرانه‌تر سر و کار دارند. استفاده از واسطه‌های API تنها راه دسترسی پیش‌بینی‌پذیر برای توسعه‌دهندگان داخلی است.

·نگاه ما
تحریریه دات‌هوش

وابستگی شدید محدودیت‌های کاربر به بار لحظه‌ای سرور نشان می‌دهد که OpenAI هنوز نتوانسته است تعادلی پایدار بین تجربه کاربری و هزینه استنتاج برقرار کند. این رویکرد واکنشی در سیاست‌های ایمنی نیز دیده می‌شود؛ جایی که شرکت ابتدا اجازه دسترسی می‌دهد و پس از وقوع سوءاستفاده (مثل جعل پاسپورت)، لایه‌های حفاظتی را اضافه می‌کند. این مدل «شکست و سپس اصلاح»، برای کاربرانی که به دنبال پیش‌بینی‌پذیری در جریان کار هستند، یک ریسک استراتژیک محسوب می‌شود.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.