
مدل GLM 5.2 هزینه استنتاج را ۸۰٪ نسبت به Claude Opus کاهش داد
انتشار مدل وزنباز GLM 5.2 رقابتی را در سطح مدلهای پیشرو ایجاد کرده است که قابلیتهای Claude Opus و GPT-5.5 را با کسری از هزینه فراهم میکند. این اتفاق میتواند به فروپاشی حاشیه…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۱۱۶ مقاله منتشر شده

انتشار مدل وزنباز GLM 5.2 رقابتی را در سطح مدلهای پیشرو ایجاد کرده است که قابلیتهای Claude Opus و GPT-5.5 را با کسری از هزینه فراهم میکند. این اتفاق میتواند به فروپاشی حاشیه…

ابزار BrassCoders با طبقهبندی خطاها به ۸ دسته، توهمات ساختاری مانند کتابخانههای جعلی را پیش از اجرا شناسایی میکند. این رویکرد فشار بررسی دستی را کاهش داده و تنها خطاهای پیچیده…

بررسیهای یک توسعهدهنده مستقل روی پروژههای واقعی نشان میدهد مدلهای اقتصادی مانند DeepSeek V4 Flash در تحلیل هزینه به کیفیت، مدلهای گرانقیمت را شکست میدهند. این دادهها…

پژوهشگران آنتروپیک ساختاری spontaneous در مدل کلاود یافتند که مانند یک فضای کار ذهنی عمل میکند. این لایه به مدل اجازه میدهد پیش از تولید پاسخ، بهصورت بیصدا استدلال کرده و…

بررسیهای جدید نشان میدهد بسیاری از برنامهنویسان بهدلیل عادتهای ناکارآمد و حجیم کردن بستر متن، سهمیه استفاده از Claude Code را بهسرعت میسوزانند. با اجرای تکنیکهای…

تنسنت مدل متنباز Hy3 را معرفی کرد؛ معماری ترکیبی خبرهها که با پارامترهای فعال کمتر، عملکردی برابر با مدلهای غولآسای صنعت دارد. این مدل هماکنون در اکوسیستم ویچت ادغام شده است.

یک تحلیل عملیاتی نشان میدهد که مدل Claude در استدلالهای پیچیده و بازسازی کد (Refactoring) درخشان است اما در عیبیابیهای تخصصی شکست میخورد. کلید بهرهوری در این است که با هوش…

رویکرد جدیدی در بهینهسازی RAG پیشنهاد میدهد که بهجای پاسخ نهایی، «زمینه سنتز شده» را ذخیره کند. این متد با کاهش تأخیر و هزینه توکنها، فرآیند استدلال مدل را حفظ کرده و…

پلتفرم Sonn با معرفی یک لایهی استدلالی، از مدل RAG سنتی فراتر رفته تا رفتار عاملهای هوش مصنوعی را بهجای بازیابی سادهی متن، بهصورت فعال هدایت کند. این سیستم با تزریق راهنماهای…

ساختار احتمالات در مدلهای زبانی بزرگ باعث میشود این سامانهها بهجای خلق ایدههای بدیع، به سمت «میانگین» دادهها حرکت کنند. این پدیده باعث تبدیل نوآوریهای واقعی به خطاهایی…

یک ابزار شناسایی نشت داده فاش کرد که عاملهای هوش مصنوعی حتی در صورت فیلتر بودن خروجی نهایی، اطلاعات حساس را در مسیرهای استدلالی داخلی خود لو میدهند. این آسیبپذیری پیش از این…

یک گردشکار فنی جدید نشان میدهد چگونه میتوان مدل Gemma-3 گوگل را با استفاده از بهینهسازی سیاست نسبی گروهی (GRPO) و آداپتورهای لورا برای ریاضیات تنظیم دقیق کرد. این فرآیند یک…