پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۱۱۹ مقاله منتشر شده

لوگوی آزمایشگاه COMBINE و عنوان مقاله: «Fable مدل مفیدی نیست»

درون مکانیسم رد درخواست‌های پیچیده در مدل Fable آنتروپیک

یک پژوهشگر ارشد گزارش داده است که مدل Fable متعلق به آنتروپیک به‌دلیل کالیبراسیون بیش‌ازحد لایه‌های ایمنی، درخواست‌های تخصصی در علوم کامپیوتر و بیوانفورماتیک را به‌اشتباه رد…

۱۱ دقیقه خواندن
لوگوی Grok 4.5 با طراحی مدرن و رنگ‌های آبی-بنفش روی پس‌زمینه تیره.

چگونه Grok 4.5 با افزایش بهره‌وری، هزینه‌های عملیاتی را پایین آورد؟

شرکت SpaceXAI مدل Grok 4.5 را برای بهینه‌سازی کدنویسی و کارهای اداری پیچیده عرضه کرد. این مدل با سرعت استنتاج بالا و قیمت به‌مراتب کمتر از رقبا، تمرکز را از اندازه مدل به بهره‌وری…

۳ دقیقه خواندن
آمازون در حال توسعه دستیار الکسای قدرتمندتر با قابلیت عامل‌محوری است
اخبار کوتاه روزانهگزارش تأییدنشده

«عملکرد ناپایدار»؛ چالش اصلی آمازون در مسیر توسعه الکسای عامل‌محور

آمازون در حال توسعه پروژه Moonraker است تا الکسا را از یک ابزار صوتی ساده به یک عامل چندمرحله‌ای تبدیل کند. هزینه‌های نجومی پردازش و عملکرد ناپایدار در نسخه‌های اولیه، باعث ایجاد…

۲ دقیقه خواندن
داده‌ها برای عامل‌های هوشمند: مجموعه‌ای از اطلاعات برای توسعه و آموزش سیستم‌های عاملی.
آموزش کاربردی

انویدیا: داده‌های سنتتیک تنها راه مقیاس‌پذیری عامل‌های هوشمند است

انویدیا معتقد است وزن‌های باز به تنهایی برای ساخت عامل‌های هوشمند کافی نیستند و توسعه‌دهندگان برای پیش‌بینی‌پذیر کردن رفتار عامل‌ها به مجموعه‌داده‌های باز و سنتتیک نیاز دارند. این…

۵ دقیقه خواندن
سه عامل هوشمند روی صحنه مناظره: ساخت گردش‌کار قابل تأیید با Agno و Shepherd
آموزش کاربردی

ترکیب Agno و Shepherd امکان بازگشت به عقب در گردش‌های کاری عامل‌ها را فراهم کرد

یک ادغام جدید، ارکستراسیون چندعاملی Agno را با ردپاهای اجرای پایدار Shepherd ترکیب می‌کند. این ابزار به توسعه‌دهندگان اجازه می‌دهد به‌جای شروع مجدد کل فرآیند، اقدامات عامل‌ها را…

۵ دقیقه خواندن
اتصال عامل‌های واقعی به Halo: از هماهنگ‌کننده ساده به خط لوله تست نفوذ چندعاملی کارا
آموزش کاربردی

درون سامانه چندعاملی Halo برای شناسایی دقیق آسیب‌پذیری‌ها

پروژه Halo از مدل‌های شبیه‌ساز فاصله گرفت و یک سامانه چندعاملی برای تست نفوذ ایجاد کرد که بر اساس شواهد واقعی عمل می‌کند. این سیستم با استفاده از مسیریاب‌های تخصصی، توهمات مدل‌های…

۳ دقیقه خواندن
تصویر: نمونه‌ای از خروجی مقاله که در آن نشانگرهای تفکر یا توکن‌های ویژه در متن نهایی ظاهر شده‌اند.
آموزش کاربردی

مقایسه‌ی مدل‌های چینی؛ DeepSeek و Qwen هزینه‌ی استنتاج را به کف رساندند

بررسی چهار خانواده مدل برتر چینی نشان می‌دهد که این مدل‌ها اکنون با قیمت‌هایی بسیار پایین‌تر و عملکردی رقابتی در برابر غول‌های غربی قرار دارند. تحلیل‌ها DeepSeek را برای کدنویسی…

۸ دقیقه خواندن۱
عصر دیجیتال را بر پایه‌ای ساختیم که هنوز کاملاً نمی‌فهمیم. هوش مصنوعی هم همین‌طور است.

رویکرد آزمایشگاه بل: چرا ساخت ابزارهای هوش مصنوعی پیش از درک کامل آن‌ها حیاتی

مقایسه اختراع ترانزیستور با ظهور هوش مصنوعی نشان می‌دهد که پیشرفت تمدنی نیازمند درک تئوریک کامل نیست. پیروزی در عصر جدید متعلق به «سازندگانی» است که در عین ابهام، بر تکرار و ساخت…

۶ دقیقه خواندن۱
هوش مصنوعی هفته: پرامپت کردن یک صفحه گسترده - نگاهی به TabFM گوگل برای داده‌های جدولی

«حذف تنظیم ابرپارامترها»؛ رویکرد جدید TabFM برای تحلیل داده‌های جدولی

گوگل مدل بنیادی TabFM را معرفی کرد که پیش‌بینی داده‌های جدولی را از طریق یادگیری در بستر متن انجام می‌دهد. این مدل نیاز به مهندسی ویژگی‌های دستی و تنظیم ابرپارامترها را با تبدیل…

۲ دقیقه خواندن
استدلال درست بود، اما جهان تغییر کرد
آموزش کاربردی

مکانیزم State-Binding اثرات مخرب داده‌های قدیمی در عامل‌های هوش مصنوعی را حذف

عامل‌های هوش مصنوعی اغلب بر اساس داده‌های منقضا شده تصمیم می‌گیرند که منجر به اقدامات نادرست در محیط‌های پویا می‌شود. روش State-Binding با الزام عامل به پیوستن یک مرجع وضعیت به هر…

۶ دقیقه خواندن
انتشار Audex توسط انویدیا: مدل زبانی یکپارچه صدا-متن با حفظ هوشمتدی متنی مدل پایه

مدل Audex انویدیا دلیل افت استدلال متنی در سیستم‌های چندوجهی را حل کرد

انویدیا مدل Audex را معرفی کرد؛ یک مدل ۳۰ میلیارد پارامتری که بدون کاهش توان استدلالی، صوت و متن را پردازش می‌کند. این مدل یکی از معدود مدل‌های وزن‌باز است که می‌تواند صداهای…

۵ دقیقه خواندن