
جمینای ۳.۸ فلش با امتیاز ۷۳.۷٪ در DeepSWE رقیب مدلهای پیشرو شد
گوگل مدل اقتصادی Gemini 3.8 Flash را با عملکردی در سطح مدلهای گرانقیمت در کدنویسی و امنیت سایبری معرفی کرد. با وجود قیمت رقابتی، مصرف بالای توکن در استدلالهای پیچیده ممکن است…
موضوع
۴٬۳۸۲ مقاله منتشر شده

گوگل مدل اقتصادی Gemini 3.8 Flash را با عملکردی در سطح مدلهای گرانقیمت در کدنویسی و امنیت سایبری معرفی کرد. با وجود قیمت رقابتی، مصرف بالای توکن در استدلالهای پیچیده ممکن است…

عاملهای هوش مصنوعی در محیطهای عملیاتی به جای دستورات متنی، نیازمند یک سیستم قطعی برای درک محدودیتهای خود هستند. چارچوب جدیدی پیشنهاد شده که با تعریف پنج دستهبندی از «پاسخهای…

گلوگاه اصلی عاملهای هوش مصنوعی هوش مدل نیست، بلکه نبود سازوکار تأیید خروجی است. پروتکل Agateon با تبدیل تأیید به یک زیرساخت سختگیرانه، «مالیات اعتماد» و نیاز به نظارت انسانی…

محیط توسعه OLKIL با ارائه مدل قیمتگذاری تهاجمی و ادغام عاملهای هوش مصنوعی در جریان کدنویسی، هزینههای استنتاج ابری را برای توسعهدهندگان مستقل به شدت کاهش داده است. این ابزار با…

پلاگین Superpowers با تحمیل یک فرآیند سختگیرانه برای مدیریت عاملها، پایداری Claude Code را بالا برده اما هزینهٔ توکنها را بهشدت افزایش داده است. این ابزار برای پروژههای بزرگ…

تحلیل جدید FrontierHarness نشان میدهد هزینهٔ عملیاتی عاملهای مهندسی نرمافزار با نرخ موفقیت آنها فاصله گرفته است. در حالی که برخی مدلها تسکهای بیشتری را پاس میکنند، هزینهٔ…

گوگل دیپمایند مدل Gemini 3.8 Flash را برای تسریع گردشکارهای عاملمحور و مهندسی نرمافزار عرضه کرد. این مدل با حفظ پنجره متنی یک میلیون توکنی، تعادلی بهینه میان کیفیت، هزینه و…

یک تیم مهندسی با جایگزینی نسخههای ریسکی دادههای واقعی با یک مولد دادههای مصنوعیِ آگاه از طرح (Schema-aware)، زمان رفرش محیط استیجینگ را ۹۹٪ کاهش داد. این سیستم جدید علاوه بر…

انتخاب میان تجمیعکنندههای API مانند OpenRouter یا fal به نوع دادههای غالب در برنامه شما بستگی دارد. یک چارچوب عملیاتی جدید پیشنهاد میکند برای تعیین هزینه و تأخیر واقعی،…

پروژه WebLLM با بهرهگیری از استاندارد WebGPU، امکان اجرای کامل مدلهای زبانی بزرگ را بدون نیاز به سرور و مستقیماً در مرورگر فراهم میکند. این رویکرد با حذف پردازشهای ابری، حریم…

سیستم هوش مصنوعی AISLE موفق شد شش حفره امنیتی جدی را در کد curl شناسایی کند، در حالی که مدلهای پیشرو OpenAI و Anthropic هیچ یافتهای نداشتند. این نتیجه نشان میدهد سامانههای…

با اتوماسیون تولید کدهای صیقلخورده توسط عاملهای هوش مصنوعی، چالش توسعهدهندگان از «نوشتن» به «درک» تغییر یافته است. بازبینها اکنون باید بهجای صحت محلی کد، بر سازگاری معماری و…