
Gemini 3.7 Flash با دقت ۹۷.۷٪ برترین مدل اقتصادی برای تحلیل داده شد
یک محک جدید در تحلیل دادهها نشان میدهد مدلهای ارزانقیمت اغلب دلایل کاذب برای تغییرات آماری میسازند یا سقوطهای واقعی داده را نادیده میگیرند. Gemini 3.7 Flash با توازن میان…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۶۶۳ مقاله منتشر شده

یک محک جدید در تحلیل دادهها نشان میدهد مدلهای ارزانقیمت اغلب دلایل کاذب برای تغییرات آماری میسازند یا سقوطهای واقعی داده را نادیده میگیرند. Gemini 3.7 Flash با توازن میان…

کتابخانه Imp با پورت کامل فریمورک DSPy به BEAM، جایگزینی برای مهندسی پرامپت دستی در زبان Elixir فراهم میکند. این ابزار به توسعهدهندگان اجازه میدهد تا برنامههای هوش مصنوعی را…

عامل هوشمند OpsMind با ترکیب حافظهٔ پایدار و استنتاج سریع Groq، تشخیص علت ریشهای خطاها را خودکار میکند. این سیستم با تطبیق ردپای خطاهای لحظهای با گزارشهای پسمرگ (Post-mortem)…

بسیاری از عاملهای کدنویس هنگام مواجهه با فایلهای حجیم، بخشهای انتهایی کد را حذف میکنند که منجر به شکست در خروجیها میشود. TokenCap با معرفی روش نمونهگیری Even-Span، ساختار…

شرکت Laya AI با معرفی یک درگاه تصمیمگیر غیرمولد، جایگزینی سریع برای مدلهای زبانی بزرگ در وظایف طبقهبندی ارائه کرد. این سیستم با حذف تولید توکنبهتوکن، تأخیر پاسخدهی را از چند…

استفاده از مدلهای متفاوت برای ایندکسگذاری و پرسوجو، نتایج جستوجو را به نویز تبدیل میکند. این شکست بدون هیچ خطا یا هشدار سیستمی رخ میدهد و خطری جدی برای خط لولههای RAG است.

توسعهدهندگان llama.cpp با بازطراحی ساختارهای داده و بهینهسازی دسترسی به حافظه، سرعت پیشبینی توکنها در رمزگشایی گمانهزنانه را تا ۱۴۰ برابر افزایش دادند. این تغییرات باعث کاهش…

توسعهدهنده AI Group Call جزئیات فنی سیستمی را افشا کرد که اجازه میدهد انسانها بهطور طبیعی صحبتهای ۸ عامل هوش مصنوعی را قطع کنند. این راهکار بر پایه تشخیص فعالیت صوتی مبتنی بر…

یک چارچوب عملی جدید برای افزونههای Pi Agent نشان میدهد که حذف توصیفات تکراری ابزارها میتواند مصرف توکنهای پرامپت را بیش از ۹۰٪ کاهش دهد. با انتقال پیچیدگی از پرامپت به کد،…

ظهور مدلهای ارزان و سریع مانند Jev، توسعهدهندگان را به عرضهٔ نرمافزارهای بدون تست سوق میدهد. این روند در حال تبدیل کردن «خطاهای سیستمی» به ویژگیهای پذیرفتهشده است و جایگزین…

مطالعهای روی مدل Atria Dawn Preview نشان میدهد که عاملهای هوش مصنوعی اکنون اکثریت مراحل فنی توسعه مدلها را اجرا میکنند، اما قدرت تصمیمگیری حیاتی همچنان در دست انسان است. این…

پژوهشی جدید نشان میدهد جملات سلب مسئولیت رایج در مدلهای زبانی، نه حاصل وزنهای داخلی مدل، بلکه نتیجهی قالبهای چت (Chat Templates) هستند. محققان با دستکاری بردارهای فعالسازی…