پرش به محتوای اصلی
پرش به محتوای مقاله

دیتابریکس: خطای عامل‌های سازمانی با GPT-5.5 تا ۴۶٪ کاهش یافت

·۲۶ اردیبهشت ۱۴۰۵۲ دقیقه مطالعه
دیتابریکس: خطای عامل‌های سازمانی با GPT-5.5 تا ۴۶٪ کاهش یافت
اشتراک‌گذاری

اگر شرکت شما برای تحلیل فایل‌های اسکن‌شده به هوش مصنوعی تکیه می‌کند، نرخ خطای شما همین حالا ۴۶٪ کاهش یافت. باید بدانید که دقت مدل‌ها در مواجهه با داده‌های «کثیف» بالاخره به نقطه بازدهی رسید.

بسیاری از عامل‌های هوش مصنوعی (AI Agents) — مثل کارمندی که نه تنها می‌داند چه بگوید، بلکه می‌تواند ابزارها را برای انجام کار به کار بگیرد — در مواجهه با داده‌های نامنظم شکست می‌خورند. این مشکل به‌ویژه در اسناد قدیمی یا PDFهای اسکن‌شده دیده می‌شود. همان‌طور که در تحلیل قبلی ما درباره‌ی ادغام داده‌های بانکی در OpenAI دیدیم، دسترسی به داده‌ها یک طرف سکه است؛ اما درک درست از آن‌ها، طرف دیگر ماجراست.

Databricks customer story hero image.

به نقل از وب‌سایت openai.com در ۱۵ ماه مه ۲۰۲۶، مدل GPT-5.5 نخستین مدلی است که سد دقت ۵۰ درصدی در بنچمارک OfficeQA Pro را شکست. اکنون شرکت Databricks این مدل را از طریق AI Unity Gateway ارائه می‌دهد. کاربران می‌توانند آن را در AgentBricks و Agent Supervisor API مستقر کنند. آرناو سینگوی، مهندس پژوهش، این پیشرفت را یک «جهش پله‌ای» در تحلیل متون می‌نامد.

به گزارش منابع فنی، بهبودهای کلیدی این نسخه عبارتند از:

  • کاهش ۴۶ درصدی خطاها نسبت به GPT-5.4 در آزمون OfficeQA Pro.
  • مدیریت برتر PDFهای اسکن‌شده و فایل‌های قدیمی.
  • هماهنگی بهینه با کاهش «مسیرهای جستجوی غیرضروری».

Personal finance in ChatGPT > Media > Cover

این تحول، عامل‌ها را از دستیارهای ساده به کارمندان دانشی قابل‌اعتماد تبدیل می‌کند. برای یک کسب‌وکار، این یعنی «داده‌های تاریک» — میلیون‌ها صفحه اسکن‌شده در آرشیوهای قدیمی — بالاخره قابل استفاده شدند. دیگر نیازی نیست هر فایل قدیمی را دستی دیجیتالی کنید تا یک مدل بتواند روی آن‌ها استدلال کند.

EF Ep20 1.1

گام بعدی شما

  • بررسی کنید که آیا پشته‌ی عامل‌های شما هنوز از GPT-5.4 یا مدل‌های قدیمی‌تر استفاده می‌کند.
  • بنچمارک OfficeQA Pro را بررسی کنید تا نقاط شکست گردش‌کار اسناد خود را بیابید.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این پیشرفت بر اساس اعتبار بنچمارک OfficeQA Pro، دسترسی به داده‌های غیرساختاریافته را تجاری‌سازی می‌کند. شرکت‌ها اکنون می‌توانند بدون هزینه‌ی گزافِ دیجیتالی‌سازی دستی، از حافظه‌ی سازمانی خود استفاده کنند.

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.