
ترکیب Kimi K3 و Fable 5 صحت پاسخها را به ۹۳٪ رساند
تحلیل فنی Fireworks.ai نشان میدهد توزیع وظایف بین مدلهای وزنباز Kimi K3 و مدل بسته Fable 5، نتایجی فراتر از هر یک از این مدلها بهتنهایی دارد. این رویکرد ترکیبی صحت عملیات را…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۱۰۶ مقاله منتشر شده

تحلیل فنی Fireworks.ai نشان میدهد توزیع وظایف بین مدلهای وزنباز Kimi K3 و مدل بسته Fable 5، نتایجی فراتر از هر یک از این مدلها بهتنهایی دارد. این رویکرد ترکیبی صحت عملیات را…

یک محیط آزمایشی جدید مدلهای بینایی را در بازتولید آثار هنری با ابزارهای مداد رنگی سنجید. GPT-5.6 Sol برندهٔ کیفیت شد، در حالی که Claude Fable 5 با هزینهای ۲۰ برابر بیشتر،…

شرکت Poolside AI مدل Laguna S 2.1 را معرفی کرد؛ یک مدل ۱۱۸ میلیارد پارامتری که با پنجره متنی یک میلیون توکنی و «حالت تفکر»، تخصص ویژهای در حل باگهای پیچیده و طولانیمدت…

مدل جدید Kimi K3 متعلق به شرکت Moonshot AI، جایگاه نخست جدول کدنویسی Arena را تصاحب کرد. این مدل با وجود قدرت بالا و وزنهای باز، به دلیل مصرف توکن زیاد، مزیت قیمت ارزانش را از…

دیپسیک ثابت کرد که مدلهای زبانی کوچک میتوانند پیچیدگیهای استدلالی مدلهای عظیم را تنها از طریق تنظیم نظارتشده (SFT) به ارث ببرند. این دستاورد، باور پیشین صنعت مبنی بر…

یک چارچوب جدید برای عاملهای هوش مصنوعی، زنجیرههای شکنندهی پرامپت را با طرحوارههای تایپشده و ارزیابی گامبهگام جایگزین کرده است. این تغییر باعث کاهش شدید توهمات و زمان…

یک راهنمای عملی نشان میدهد چگونه میتوان مدل Llama 3.3 70B تنظیمشده را تنها با ۱۱ دلار در ماه روی زیرساخت DigitalOcean اجرا کرد. این روش با ترکیب vLLM برای استنتاج و آداپتورهای…

یک تحلیل فنی، مسیر تبدیل دادههای خام به دستیاران هوشمند را در چهار مرحله بررسی میکند. این راهنما سازوکارهای توکنسازی، مکانیسم توجه در ترنسفورمرها و نقش بازخوردهای انسانی را…

تلاش یک توسعهدهنده برای ساخت یک سیستم نظارتی سبک با مدلهای محلی، چالشهای جدی در قابلیت اطمینان فراخوانی ابزار و توهمات مدل را آشکار کرد. در نهایت، برای تضمین پایداری در محیط…

آزمونهای عملی مدل Kimi K3 نشان میدهد هزینه تکمیل یک تسک کدنویسی واقعی ۰.۱۹ دلار است. این داده ثابت میکند «هزینه تا رسیدن به پاسخ نهایی» متری کی훨سی از قیمت هر توکن است.

ظهور مدلهای قدرتمند چینی مانند Kimi K3 و Qwen3.8 Max باعث نگرانی شده است، اما تحلیلهای اقتصادی نشان میدهد که پیشروان آمریکایی همچنان برتری هزینه دارند. خطر واقعی نه در اقتصاد،…

مدلهای Sol و Fable با یافتن مثالهای نقض برای حدسهای ریاضی قرنسده، از جمله حدس یاکوبی، نقش ریاضیدانان را از «کشفکننده» به «تفسیرکننده» تغییر دادند. این موفقیت از طریق تبدیل…