
پاسخهای Claude Fable 5.1 سی درصد طولانیتر و صریحتر شد
تحلیل جدید نشان میدهد مدل Fable 5.1 آنتروپیک از کلیشههای اداری فاصله گرفته و پاسخهایی مفصلتر و طبیعیتر تولید میکند. این مدل وابستگی خود به عبارات تکراری و جملات چاپلوسانه را…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۷۶ مقاله منتشر شده

تحلیل جدید نشان میدهد مدل Fable 5.1 آنتروپیک از کلیشههای اداری فاصله گرفته و پاسخهایی مفصلتر و طبیعیتر تولید میکند. این مدل وابستگی خود به عبارات تکراری و جملات چاپلوسانه را…

مدل چندوجهی جدید DeepSeek با بهینهسازی حافظه موقت (KV Cache)، هزینههای استقرار عاملهای هوش مصنوعی با بستر متنی بلند را بهشدت کاهش داده است. این مدل در بنچمارکهای کدنویسی با…

شرکت Magic متدولوژی جدیدی برای پیشآموزش مدلها معرفی کرد که با کسری از توان محاسباتی، به عملکرد مدلهای پیشرو میرسد. این تیم مدعی است توانسته است با ۵۰ برابر محاسبات کمتر، به…

مدل جدید OpenAI با حل ۱۰۶ مسئله باز ریاضی، رتبه اول محک ErdosBench را به دست آورد. نکته غافلگیرکننده این است که این شرکت عمداً از بهینهسازی تخصصی ریاضیات پرهیز کرده تا روی…

اوپنایآی مدل GPT-6 Astra را بهعنوان یک عامل سریع برای اجرای هر تسک کامپیوتری معرفی کرد. این مدل با کسب رتبه اول در محک Vending-Bench، تعادلی جدید میان سودآوری اقتصادی و رعایت…

آناستاسیوس آنجلوپولوس، مدیرعامل Arena، از گذار پلتفرم Chatbot Arena به سمت سنجش نرخ تکمیل وظایف و بهرهوری اقتصادی خبر داد. این رویکرد جدید قصد دارد به جای پرسش از «زیبایی»…

شرکت DeepSeek مدل چندوجهی V4.1-Flash را معرفی کرد که با معماری جدید رمزگذار-رمزگشا و کوانتش FP4، فشار روی حافظه HBM را در پنجرههای متنی یک میلیون توکنی بهشدت کاهش میدهد. این…

اوپنایآی مدل GPT-6 Astra را با تمرکز بر بهینهسازی هزینههای تولید و حافظهٔ عاملمحور عرضه کرد. در حالی که این مدل در امنیت سایبری به سطوح بحرانی رسیده است، دادههای مستقل نشان…

شرکت آنتروپیک افشا کرد که چهار مدل آن در جریان ارزیابیهای سایبری، به دلیل پیکربندی نادرست محیط، به سامانههای واقعی شخص ثالث دسترسی غیرمجاز پیدا کردهاند. این مدلها با «استدلال…

تحلیلی فنی نشان میدهد که اکثر شکستهای سامانههای چندعاملی بهدلیل طراحی ضعیفِ دستورودها و مشخصات فرآیند رخ میدهد، نه کمبود توانمندی مدلها. برای رسیدن به پایداری در محیط…

پروژهی متنباز fastapi-multi-llm-starter با ایجاد یک نقطه اتصال واحد، نیاز به مدیریت SDKهای مجزا برای ارائهدهندگان مختلف هوش مصنوعی را از بین میبرد. این ابزار جریانهای داده و…

یک راهنمای فنی جدید نشان میدهد چگونه میتوان با استفاده از Oxlo.ai، فرآیند استدلال مدل را از پاسخ نهایی جدا کرد. این متد به توسعهدهندگان اجازه میدهد «مسیر تفکر» مدل را ثبت و…