
مدل Inkling-Small با ۲۷۶ میلیارد پارامتر در کدنویسی عاملمحور پیشی گرفت
آزمایشگاه Thinking Machines مدل Inkling-Small را معرفی کرد؛ یک مدل MoE با وزنهای باز که علیرغم اندازه کوچکتر، در استدلال و کدنویسی پیچیده از نسخه پیشین خود (۹۷۵ میلیارد…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۸ مقاله منتشر شده

آزمایشگاه Thinking Machines مدل Inkling-Small را معرفی کرد؛ یک مدل MoE با وزنهای باز که علیرغم اندازه کوچکتر، در استدلال و کدنویسی پیچیده از نسخه پیشین خود (۹۷۵ میلیارد…

تکامل پردازش زبان طبیعی از قوانین سختگیرانه به معماری ترنسفورمر رسید. این مدلها با جایگزینی پردازش متوالی با مکانیزم خودتوجهی، مشکل فراموشی دادهها در متون بلند و سرعت پایین…

بنیانگذار یک شرکت هوش مصنوعی استدلال میکند که موفقیت مدلهای زبانی از طریق آمار و مقیاس، مفاهیم ما از هوش انسانی را به چالش میکشد. این دیدگاه بر ضرورت تزریق آگاهانه ارزشهای…

یک محک جدید به نام FROGS_ نشان میدهد که مدلهای هوش مصنوعی در مواجهه با پرامپتهای ساده، دچار «بیشویرایشگری» میشوند. این مدلها بهجای رسم یک قورباغه ساده، ویژگیهای پزشکی و…

یک سامانه چندعاملی جدید با جایگزینی چتباتهای تکمدل، زنجیرهای تخصصی از برنامهریز، پژوهگر، اجراکننده و منتقد ایجاد میکند. این معماری با جداسازی مسئولیتها و اجبار به حلقهٔ…

یک توسعهدهنده با جایگزینی چتهای گروهی ساده با یک «روتر» مبتنی بر ماشین وضعیت (State Machine)، توهمات قوانین را در بازی اجتماعی Werewolf حذف کرد. این معماری ثابت میکند که برای…

آندرج کارپاتی توانایی مدل Opus 5 در تبدیل متن به محیطهای سه بعدی تعاملی و رویهای را به نمایش گذاشت. این آزمایش نشاندهنده گذار به سوی جهانسازی «در لحظه» است، هرچند نبود بازخورد…

پژوهشگران دریافتند حذف دستورالمانهای سختگیرانه در مدیریت حافظه، مدل Kimi K3 را از یک «منشی یادداشتبردار» به یک «طراح سیستم» تبدیل میکند. این تغییر باعث کاهش دفعات بهروزرسانی…

کمپانی Anthropic در ابزار Claude Code مکانیزمی به نام EnterPlanMode ایجاد کرده است که مدل را مجبور میکند پیش از هر تغییری، یک فاز اکتشافیِ «فقط خواندنی» را طی کند. این رویکرد با…

چارچوب معماری جدیدی با ترکیب ترنسفورمرهای تصمیمگیر و حاکمیت «اعتماد صفر»، مدیریت زیستگاههای حیاتی اعماق دریا را ممکن کرد. این سامانه با استفاده از دادههای تلهمتری آفلاین و یک…

مدل جدید آنتروپیک قادر است بازیهای سهبعدی و شبیهسازهای فیزیکی قابل اجرا را تنها با یک پرامپت و از طریق کدنویسی رویهای تولید کند. برخلاف مدلهای ویدئویی، این مدل خروجیهای قابل…

یک شبیهسازی گسترده توسط MIT Sloan نشان داد که پیروی از توصیههای مالی هوش مصنوعی منجر به پسانداز و تنوعبخشی بیشتر نسبت به تصمیمات انسانی میشود. با این حال، مدلها در مدیریت…