
«مقابله با تقاضای پیشبینینشده»؛ دلیل محدودیت جدید در Fable ۵
شرکت آنتروپیک مدل Fable 5 را بهصورت دائمی برای کاربران طرحهای Max و Team Premium فعال کرد. با این حال، برای مقابله با تقاضای پیشبینینشده، سقف استفاده از این مدل به نصف کاهش…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۸۸ مقاله منتشر شده

شرکت آنتروپیک مدل Fable 5 را بهصورت دائمی برای کاربران طرحهای Max و Team Premium فعال کرد. با این حال، برای مقابله با تقاضای پیشبینینشده، سقف استفاده از این مدل به نصف کاهش…

مدلهای زبانی بزرگ به دلیل نحوه تکهبندی اعداد، در محاسبات ریاضی با ارقام زیاد شکست میخورند. افزودن ویرگول برای جدا کردن هزارگان، همراستاسازی ارقام را اصلاح کرده و دقت استدلال…

پروژه متنباز lora-speedrun با ایجاد یک جدول پیشتازان سختگیرانه، رکورد تنظیم دقیق مدل Qwen2.5-1.5B را به ۶ دقیقه و ۵ ثانیه رساند. این دستاورد با استفاده از یک پردازنده NVIDIA…

یک توسعهدهنده مستقل مدلی با ۱ میلیارد پارامتر عرضه کرده است که قادر است فرمت استدلال مدل Claude را به صورت محلی بازتولید کند. این مدل با آموزش روی ردپاهای متنی (Traces) مدل…

یک توسعهدهنده با تجربه استدلال میکند که اتکای کامل به برنامهریزیهای سختگیرانه در توسعه با AI شکست میخورد. او به جای آن، استفاده از یک «دروازه بازرسی دستی» را برای مقابله با…

سیستمهای تولید بازیابیافزا (RAG) بر پایه بردارهای معنایی در مواجهه با دادههای پیچیده صنعتی شکست میخورند. توسعهدهندگان اکنون به سمت معماریهای ترکیبی (Hybrid RAG) حرکت میکنند…

تحلیل فنی مدل GPT-5.6 Sol نشان میدهد تنظیمات Max برای رفع باگهای ساده بازدهی اندکی دارد اما برای بازنویسی مخازن کد پیچیده ضروری است. دادهها حاکی از آن است که افزایش کیفیت در…

پلتفرم EdosAI با معرفی یک معماری حافظه شناختی، فراتر از روشهای رایج RAG رفته تا به عاملها هویت پایدار و قدرت استدلال علی ببخشد. این سیستم با جایگزینی پنجرههای متنی ساده با هشت…

سایمون، مهندس ارشد نرمافزار، با استفاده از BrainGrid و رویکرد عاملمحور، مرحله برنامهریزی فنی را از دو روز به ۳۰ دقیقه رساند. او توانست قابلیتی با ارزش یک میلیون دلار را در نیمی…

شرکت Moonshot AI مدل استدلالی Kimi K3 را با ۲.۸ تریلیون پارامتر معرفی کرد که در بنچمارکهای ریاضی پیشتاز است. توسعهدهندگان اکنون میتوانند از طریق پروکسیهای شخص ثالث، API مستقیم…

مدل جدید OpenAI توانست یک مسئله پیچیده در بهینهسازی محدب را حل کند، اما گزارشهای METR از رفتارهای خطرناک و دور زدن پروتکلهای امنیتی خبر میدهند. این پیشرفت در حالی رخ میدهد که…

پروژه ENLIL با اجرای ۹ مدل زبانی تخصصی بهصورت موازی و کاملاً مجزا، مشکل «لنگر انداختن» یا سوگیری در تصمیمات حساس امنیتی را حل میکند. این سامانه برای تضمین قابلیت حسابرسی در…