
آموزش فراخوانی ابزار در مدل Qwen3-0.6B با متد XYZ-Aquila-SFT
یک راهنمای فنی جدید، خط لولهای جامع برای آموزش مدلهای زبانی کوچک در استفاده از ابزارهای خارجی ارائه داده است. این فرآیند با استفاده از مجموعه داده XYZ-Aquila-SFT و آداپتورهای…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۷۹ مقاله منتشر شده

یک راهنمای فنی جدید، خط لولهای جامع برای آموزش مدلهای زبانی کوچک در استفاده از ابزارهای خارجی ارائه داده است. این فرآیند با استفاده از مجموعه داده XYZ-Aquila-SFT و آداپتورهای…

یک توسعهدهنده با استفاده از مدل Codex و یک چرخه پژوهشی خودکار، سرعت اجرای هستههای تجزیه QR را ۲۳۲ برابر نسبت به خطمبنای PyTorch افزایش داد. این دستاورد نشان میدهد که تبدیل…

توهمات در مدلهای زبانی، یک نقص فنی نیست بلکه نتیجهی ماهیت آماری آنها در پیشبینی توکنهاست. برای ساخت سامانههای قابلاعتماد، باید از نگاه به مدل بهعنوان «ماشین پاسخگو» فاصله…

مجموعهای از شکستهای اخیر مدلهای زبانی نشان میدهد که این ابزارها هنوز در درک مرزهای دقیق دستورات و مدیریت حلقههای بازخوردی ناتواناند. این خطاها هشدار میدهند که اعتماد به…

عاملهای هوش مصنوعی برای خروج از محیط دمو و ورود به تولید، به جای استقلال مطلق، به محدودیتهای سختافزاری و ساختاری نیاز دارند. جایگزینی حلقههای باز با اسکلتهای جریانکاری قطعی،…

پروتکل ThoughtDAG تاریخچهٔ خطی چتها را با گرافهای متنی جایگزین میکند تا کاربر دقیقاً تعیین کند چه اطلاعاتی به پرامپت برسد. این سازوکار با حذف شاخههای نامرتبط، از «آلودگی…

محک جدید Moonshot AI نشان میدهد حتی پیشرفتهترین مدلهای چندوجهی در درک ابتدایی تصاویر ناتواناند. هیچ مدلی نتوانست از مرز ۶۰ درصد صحت در مهارتهای بصری پایه عبور کند، که ثابت…

بسیاری از کاربران که از افت کیفیت Claude Opus 5 شکایت دارند، در واقع با تغییرات رفتاری مدل روبهرو هستند نه کاهش توانایی. توسعهدهندگان میتوانند با تنظیم پرامپتها یا تثبیت نسخه…

مدل Grok 4.6 شرکت xAI اکنون در GitHub Copilot در دسترس است و روی وظایف مهندسی پیچیده و عاملمحور تمرکز دارد. این مدل در ۸ محیط توسعه مختلف فعال شده و قیمت استنتاج آن بهطور…

تیم Qwen مدل جدید Qwen3.8-27B را با قابلیت تفکر بومی و تواناییهای عاملمحور گسترده عرضه کرد. این مدل در بنچمارکهای کدنویسی و پژوهشهای تخصصی، عملکرد مدلهای پیشرو را به چالش…

شرکت آنتروپیک با استفاده از سیستم پیشرفته Prompt Caching، هزینههای تکرار بافت (Context) را در Claude Code به شدت کاهش داده است. توسعهدهندگان با درک چرخه پیشپُرکردن و رمزگشایی…

شرکت TormentNexus با معرفی یک پروتکل مناظرهٔ ساختاریافته برای دستههای عاملهای هوش مصنوعی، تضادهای فنی را از طریق استدلال مبتنی بر شواهد حل میکند. این رویکرد نرخ نقص در…