پرش به محتوای اصلی
پرش به محتوای مقاله

«مدل GPT-5.6»؛ موتور محرک حالت خودکار جدید در اپلیکیشن دسکتاپ OpenAI

·۲۷ تیر ۱۴۰۵۹ دقیقه مطالعه۱ بازدید
ادغام Codex با ChatGPT و معرفی عامل خودکار Work توسط OpenAI
ادغام Codex با ChatGPT و معرفی عامل خودکار Work توسط OpenAI
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

تغییر پارادایم از «چت» به «کار»؛ برای نخستین بار یک عامل خودکار در اپلیکیشن دسکتاپ OpenAI اجازه دارد برای ساعت‌ها به‌طور مستقل روی یک هدف کار کرده و فایل نهایی (Artifact) تحویل دهد.

تصور کنید یک پنجره واحد در مک یا ویندوز داشته باشید که در آن یک عامل هوشمند، کارهای چندساعته شما را مدیریت می‌کند و اکوسیستم OpenAI را از یک چت ساده به یک مرکز اجرای بلندمدت تبدیل می‌کند. این تجربه یکپارچه در ۹ جولای ۲۰۲۶ عرضه شد و حالت تخصصی «Work» را که توسط مدل جدید GPT-5.6 قدرت می‌گیرد، معرفی کرد.

این تغییر درست زمانی رخ می‌دهد که هوش مصنوعی از چرخه ساده «پرسش-پاسخ» به سمت جریان‌های کاری عامل‌محور (Agentic) حرکت می‌کند. در حالی که پوشش‌های قبلی ما بررسی می‌کرد که چگونه ابزارهایی مانند Wardrobe از استخراج تصاویر GPT برای خودکارسازی کمد‌های دیجیتال استفاده می‌کنند، حالت جدید Work فراتر از استخراج‌های محدود رفته و به مدیریت جامع و خودکار پروژه‌ها می‌پردازد. این تحول، هوش مصنوعی را از یک مشاور که با او صحبت می‌کنید، به یک کارمند دیجیتال تبدیل می‌کند که به او اهداف می‌سپارید. رقابت در این حوزه شدت گرفته است و برای مثال، مدل Grok 4.5 توانست هزینه‌های اجرای چنین عامل‌های کدنویسی را تا ۵۰ درصد کاهش دهد تا سهم بیشتری از بازار توسعه‌دهندگان جذب کند.

زمینه‌ی ادغام سال ۲۰۲۶

در ۹ جولای ۲۰۲۶، OpenAI یک تغییر بنیادین در معماری محصولات خود اعلام کرد. اپلیکیشن مستقل Codex اکنون با اپلیکیشن دسکتاپ ChatGPT ادغام شده است. به گزارش Tech Times (۱۰ جولای) و ByteIota (۹ جولای)، این به‌روزرسانی برای تمامی کاربران مک و ویندوز در سطح جهان فعال شد.

این ادغام صرفاً یک تغییر در رابط کاربری (UI) نبود؛ بلکه دقیقاً با عرضه عمومی مدل GPT-5.6 هم‌زمان شد. این انتشار هم‌زمان نشان‌دهنده یک تلاش هماهنگ در بازاریابی است تا توانایی‌های مدل از طریق یک کاربرد عملیِ عامل‌محور به نمایش درآید، نه اینکه صرفاً به اعداد و ارقام بنچمارک‌های خام بسنده شود.

نکته مهم این است که تا تاریخ ۱۴ جولای، وبلاگ رسمی OpenAI در پاسخ به درخواست‌های مستقیم خطای ۴۰۳ را برمی‌گرداند. همین موضوع باعث شد تا نشریات فناوری مانند Tech Times و ByteIota به منابع اصلی و قابل اعتماد برای جزئیات این به‌روزرسانی تبدیل شوند. این آپدیت تضمین می‌کند که کاربران دیگر مجبور نباشند برای مدیریت نیازهای مختلف هوش مصنوعی، بین سه برنامه متفاوت جابجا شوند.

معماری سه حالته

طبق گزارش‌های Tech Times و ByteIota، اپلیکیشن مستقل Codex دیگر وجود ندارد. این ابزار اکنون به یکی از سه حالت متمایز در اپلیکیشن یکپارچه ChatGPT دسکتاپ تبدیل شده است. انتخاب بین این حالت‌ها باید اکنون به‌صورت آگاهانه و بر اساس «افق زمانی» (Time Horizon) تسک انجام شود:

  • Chat: متمرکز بر افقی در بازه ثانیه‌ها تا دقایق است. این حالت پاسخ‌های فوری، پیش‌نویس‌ها و توضیحات را ارائه می‌دهد. از این حالت برای پرسش‌های سریع یا گفتگوهای ایده‌پردازی استفاده کنید.
  • Codex: متمرکز بر افقی در بازه دقایق است. این حالت برای اعمال تغییرات در کد، ایجاد پچ‌ها و انجام بازبینی کد (Code Review) در یک مخزن (Repository) طراحی شده است.
  • Work: یک عامل خودکار است که برای افق‌های زمانی چندین ساعته طراحی شده است (طبق توصیفات OpenAI). این عامل زمینه (Context) را از اپلیکیشن‌های متصل جمع‌آوری کرده و «مصنوعات» (Artifacts) تکمیل‌شده‌ای مانند سندها، جداول داده، ارائه‌ها و وب‌اپلیکیشن‌ها را تحویل می‌دهد.

ادغام Codex با ChatGPT و معرفی عامل خودکار Work توسط OpenAI

بررسی عمیق: عامل Work و مدل GPT-5.6

قلب تپنده‌ی این به‌روزرسانی، حالت Work است که بر پایه مدل GPT-5.6 کار می‌کند؛ مدلی که در ۹ جولای به صورت عمومی منتشر شد. برخلاف حالت Chat، حالت Work یک عامل خودکار است که صرفاً به یک پرامپت واکنش نشان نمی‌دهد. در عوض، این حالت از مکانیزم خاصی پیروی می‌کند: هدف را دریافت می‌کند، زمینه را از اپلیکیشن‌های متصل جمع‌آوری می‌نماید و به‌طور مستقل درباره توالی گام‌های لازم برای تولید نتیجه نهایی تصمیم می‌گیرد.

جزئیات فنی کلیدی حالت Work:

  • جمع‌آوری زمینه (Context Gathering): عامل برای ساخت یک پایگاه دانش جهت انجام تسک، داده‌ها را از اپلیکیشن‌های شخص ثالث متصل‌شده می‌خواند.
  • افق اجرا (Execution Horizon): تسک‌ها برای چندین ساعت برنامه‌ریزی می‌شوند، نه چند ثانیه؛ این یعنی عامل در پس‌زمینه سیستم کار می‌کند.
  • انواع خروجی: نتیجه نهایی یک «مصنوع» است؛ یعنی نه یک پیام ساده در چت، بلکه یک فایل یا اپلیکیشن تکمیل‌شده است.
  • وابستگی: موفقیت اجرای تسک به‌شدت به شفافیت هدف کاربر و کیفیت منابع داده‌ای متصل وابسته است.

به دلیل ماهیت خودکار این عامل، اگر هدفی مبهم در یک بازه چندساعته وارد شود، احتمالاً منجر به یک شکست مبهم در طول چند ساعت خواهد شد. به کاربران توصیه می‌شود با این عامل به عنوان یک پردازش پس‌زمینه برخورد کنند، نه یک شریک گفتگو.

انتشار از طریق نسخه بتای Sites

هم‌زمان با معرفی عامل Work، شرکت OpenAI قابلیت Sites را در حالت بتای عمومی عرضه کرد. این ویژگی به‌طور خاص خروجی‌های یک عامل Work — به‌ویژه وب‌اپلیکیشن‌ها — را به یک صفحه وب زنده و خودبه‌روزرسان تبدیل می‌کند.

در این بستر، منظور از «زنده» این است که صفحه می‌تواند به‌طور خودکار به‌روز شود در حالی که عامل همچنان روی پروژه کار می‌کند. با این حال، Tech Times تأکید می‌کند که این قابلیت در حال حاضر در وضعیت بتای عمومی است. هدف از آن، پیش‌نمایش و تکرار (Iterate) نتایج است و نه یک راهکار میزبانی حرفه‌ای برای محیط‌های عملیاتی (Production). کاربران باید به Sites به عنوان یک پیش‌نویس پویای یک انتشار نگاه کنند.

پیاده‌سازی و دسترسی

این اپلیکیشن یکپارچه به‌صورت جهانی برای کاربران مک و ویندوز در تمامی سطوح، از جمله طرح رایگان، در دسترس است. این بدان معناست که هر سه حالت (Chat, Work, Codex) از نظر فنی برای همه قابل دسترسی هستند. با این حال، منابع ذکر نکرده‌اند که محدودیت‌های استفاده یا سهمیه‌های (Quotas) خاصی برای حالت Work در طرح رایگان وجود دارد یا خیر. کاربران باید محدودیت‌های فردی خود را در تنظیمات اپلیکیشن بررسی کنند.

راهنمای گام‌به‌گام برای امتحان کردن ChatGPT Work:
۱. به‌روزرسانی: اپلیکیشن دسکتاپ ChatGPT را برای مک یا ویندوز نصب یا آپدیت کنید (نسخه‌های وب و موبایل بخشی از این ادغام خاص نبودند).
۲. تغییر حالت: از ابزار تغییر حالت (Mode Switcher) استفاده کنید تا به‌جای Chat، حالت «Work» را انتخاب کنید.
۳. اتصال منابع: اپلیکیشن‌های ضروری را لینک کنید تا عامل برای شروع کار «کور» نباشد و زمینه لازم را داشته باشد.
۴. تعریف هدف: هدف خود را در یک پاراگراف شفاف فرموله کنید و فرمت مورد نظر و محدودیت‌ها را مشخص نمایید. از ارسال لیست‌های طولانی پیام‌ها بپرهیزید و بر نتیجه نهایی تمرکز کنید.
۵. اجرا و انتظار: از آنجا که افق زمانی بر اساس ساعت است، تسک را به عنوان یک عملیات پس‌زمینه برنامه‌ریزی کنید.
۶. بازبینی: با خروجی (مصنوع) مانند پیش‌نویس یک پیمانکار برخورد کنید. هر واقعیت، عدد و لینک را مجدداً تأیید کنید.

برای توسعه‌دهندگانی که می‌خواهند از این قابلیت‌ها به‌صورت برنامه‌نویسی شده استفاده کنند، APIهای سازگار با OpenAI همچنان مسیر اصلی هستند. این کار شامل استفاده از یک کلید API و یک Base URL برای هدایت درخواست‌ها به آخرین مدل‌ها با استفاده از الگوی امن پایتون زیر است:

import os
from openai import OpenAI

# API key is retrieved from the environment for security
# export MODEL_API_KEY="YOUR_KEY_HERE"
client = OpenAI(
    api_key=os.environ["MODEL_API_KEY"],
    base_url="https://api.provod.ai/v1", # OpenAI-compatible endpoint
)

resp = client.chat.completions.create(
    model="REPLACE_WITH_MODEL_NAME",
    messages=[
        {"role": "system", "content": "You are a precise assistant."},
        {"role": "user", "content": "Create a three-step plan."},
    ],
)
print(resp.choices[0].message.content)

ادغام Codex با ChatGPT و معرفی عامل خودکار Work توسط OpenAI

تدابیر امنیتی و عیب‌یابی

از آنجا که یک عامل خودکار می‌تواند یک اشتباه کوچک را در طول چندین ساعت تکثیر کند، ریسک «انحراف توهم» (Hallucination Drift) بسیار بیشتر از یک چت استاندارد است. یک پیش‌فرض غلط در شروع کار می‌تواند در هر گام بعدی که عامل برمی‌دارد، ضرب شود و نتیجه را به کلی تغییر دهد.

پروتکل پیشنهادی برای امنیت و کیفیت:

  • اصل حداقل دسترسی (Least Privilege): فقط دسترسی به منابع داده‌ای خاصی را بدهید که برای آن هدف مشخص مورد نیاز است.
  • اجراهای آزمایشی غیرمحرمانه: اولین تکرار را روی داده‌های تستی اجرا کنید تا مطمئن شوید منطق عامل درست است، پیش از آنکه اطلاعات حساس را در معرض قرار دهید.
  • حضور انسان در چرخه (Human-in-the-Loop): هرگز مرحله بازبینی را حذف نکنید. خودمختاری به معنای حذف نیاز به امضای انسانی بر روی مصنوعات نهایی نیست.

ادغام Codex با ChatGPT و معرفی عامل خودکار Work توسط OpenAI

یکپارچگی با پلتفرم‌های اتوماسیون مانند n8n از طریق گره‌های HTTP امکان‌پذیر است. این به کاربران اجازه می‌دهد تا پس از اینکه عامل Work یک سند را تکمیل کرد، گام بعدی را فعال کنند. یک تنظیمات رایج در n8n برای درخواست HTTP شامل موارد زیر است:

  • Method: POST
  • URL: https://api.provod.ai/v1/chat/completions
  • Auth: هدر Authorization: Bearer {{$env.MODEL_API_KEY}}
  • Body: یک JSON حاوی مدل و تسک دریافتی از گره قبلی.

شکست‌های رایج در یکپارچه‌سازی شامل سخت‌نویسی (Hard-coding) کلیدها به‌جای استفاده از متغیرهای محیطی، عدم مدیریت زمان انتظار (Timeout) برای پاسخ‌های طولانی عامل و نادیده گرفتن کدهای خطا است. ثبت (Logging) وضعیت پاسخ و بدنه پیام در هنگام شکست، برای عیب‌یابی این زنجیره‌های طولانی حیاتی است.

ادغام Codex با ChatGPT و معرفی عامل خودکار Work در OpenAI

جایگاه بازار و انتخاب مدل

عرضه هم‌زمان حالت Work و مدل GPT-5.6 نشان‌دهنده تغییری به سمت اثبات «سودمندی عامل‌محور» است. در حالی که GPT-5.6 موتور محرک Work است، اما تنها گزینه برای تسک‌های کدنویسی یا عامل‌محور نیست.

برای کسانی که در مناطقی با موانع پرداخت هستند (مانند روسیه)، تجمیع‌کننده‌هایی مانند provod.ai راهی برای مقایسه GPT-5.6 با رقبایی چون Claude 4.8، Gemini 3.5، DeepSeek V4 Pro یا Qwen 3.6 Plus با استفاده از یک API واحد و ارز محلی (RUB از طریق SBP یا فاکتور) فراهم می‌کنند. این تجمیع‌کنندگان توانسته‌اند هزینه‌های دسترسی به ChatGPT را تا ۷۰٪ کاهش دهند تا دسترسی توسعه‌دهندگان تسهیل شود. اگرچه این تجمیع‌کننده‌ها رابط کاربری و اتصالات اختصاصی (Connectors) اپلیکیشن دسکتاپ OpenAI را بازسازی نمی‌کنند، اما به توسعه‌دهندگان اجازه می‌دهند تا قبل از commit کردن یک جریان کاری، تست کنند که آیا خانواده مدل‌های متفاوتی برای منطق خاص آن‌ها مناسب‌تر است یا خیر.

ادغام Codex با ChatGPT و معرفی عامل خودکار Work توسط OpenAI

راهنمای نهایی: انتخاب حالت مناسب

برای جلوگیری از ناکارآمدی، کاربران باید حالت را بر اساس افق زمانی تسک انتخاب کنند:

تسک حالت پیشنهادی دلیل
پاسخ سریع، پیش‌نویس یا بحث Chat حداقل تأخیر، گفتگومحور
پچ‌های کد، بازبینی مخزن (Repo) Codex تخصصی برای منطق کدبیس
گزارش چندمرحله‌ای، جدول یا دک (Deck) Work عامل خودکار (افق چندساعته)
انتشار نتیجه به صورت یک صفحه وب Work + Sites تبدیل مصنوعات به صفحات بتای زنده
مقایسه خانواده‌های مدل از طریق کد Custom API رابط واحد برای GPT، کلود، جیمینای و غیره

محدودیت‌های شناخته‌شده

علیرغم این ادغام چشمگیر، چندین مرز و محدودیت همچنان باقی است:
۱. عدم فقدان خطا: حالت Work یک مصنوع نهایی تحویل می‌دهد، اما کاربر همچنان مسئول صحت واقعیات است.
۲. سهمیه‌های مبهم: عبارت «در دسترس برای همه طرح‌ها» به معنای دسترسی نامحدود نیست. سقف‌های دقیق حالت Work عمومی نشده‌اند.
۳. میزبانی بتا: ابزار Sites یک ابزار پیش‌نمایش است و جایگزینی برای میزبانی‌های وب حرفه‌ای نیست.
۴. تمرکز بر دسکتاپ: این ادغام‌ها و حالت‌های خاص در حال حاضر برای اپلیکیشن‌های مک و ویندوز برجسته شده‌اند، نه برای موبایل.
۵. تفاوت API و محصول: یک تجمیع‌کننده مانند provod.ai «قدرت پردازشی» (مدل‌ها) را فراهم می‌کند، در حالی که ChatGPT Work یک «محصول» با اتصالات یکپارچه و رابط کاربری خاص است. این دو مکمل یکدیگرند، نه جایگزین.

این تنها آغاز ماجراست؛ اثر موج‌گونه‌ی این تصمیم بر اکوسیستم متن‌باز را در گزارش بعدی بررسی خواهیم کرد.

چرا این موضوع مهم است؟

این تحول بر اساس تجربه کاربر، استدلال‌های کوتاه را با executionهای بلندمدت جایگزین می‌کند. اعتبار این رویکرد در توانایی GPT-5.6 در مدیریت توالی گام‌ها بدون از دست دادن هدف نهایی نهفته است.

تأثیر برای ایران

به‌دلیل تحریم‌ها، دسترسی مستقیم به اپلیکیشن دسکتاپ برای کاربران ایرانی محدود است؛ اما توسعه‌دهندگان می‌توانند از طریق APIهای واسط مانند provod.ai مدل GPT-5.6 را تست کنند.

·نگاه ما
تحریریه دات‌هوش

OpenAI با این حرکت، تعریف «رابط کاربری» را از یک جعبه متن برای گفتگو به یک داشبورد مدیریت پروژه تغییر داد. ادغام Codex و معرفی حالت Work نشان می‌دهد که شرکت دیگر به رقابت در سطح «بهترین پاسخ» قانع نیست و می‌خواهد مالک «بهترین خروجی» باشد. این استراتژی، مدل‌های زبانی را از ابزار کمک‌آموز به نیروی کار عملیاتی تبدیل می‌کند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.