پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۶۸۴ مقاله منتشر شده

دکمه خلاقیت نیست. اینجا ببینید واقعاً چه‌کار می‌کند.
آموزش کاربردی

«توزیع احتمالات نه خلاقیت»؛ تحلیل عملکرد پارامتر Temperature در LLM

بسیاری از توسعه‌دهندگان Temperature را به اشتباه یک «لغزنده خلاقیت» می‌بینند، در حالی که این پارامتر صرفاً توزیع احتمالی توکن‌ها را تغییر می‌دهد. تنظیمات بالا ایده‌های جدید خلق…

۴ دقیقه خواندن
تیم Cogent AI مدل VR-1 را منتشر کرد: مدل استدلال سایبری پیشرفته برای ترکیب و تأیید مسیرهای حمله سازمانی

مدل VR-1 شرکت Cogent AI مسیرهای حمله را ۲ برابر بیشتر از Claude Opus یافت

شرکت Cogent AI مدل استدلالی VR-1 را برای طراحی و تأیید زنجیره‌های پیچیده حمله در محیط‌های سازمانی عرضه کرد. این مدل برخلاف مدل‌های عمومی، به‌جای شناسایی تک‌باگ‌ها بر اجرای نفوذهای…

۴ دقیقه خواندن
مدل جستجوی نوروسمبولیک Ontology 1 با دقت ۲.۷ برابر موتورهای جستجوی برتر تجارت الکترونیک جهان

مدل Ontology 1 دقت جست‌وجوی محصولات را در برابر گوگل و آمازون بالا برد

شرکت Onton مدل هوش مصنوعی Neurosymbolic را معرفی کرد که با استفاده از گراف دانش، در پاسخ به پرس‌وجوهای پیچیده تجاری، گوگل شاپینگ و آمازون را شکست می‌دهد. این مدل به‌جای تکیه بر…

۴ دقیقه خواندن۲
نقشه‌راه یادگیری: چرا پردازش زبان طبیعی به ترنسفورمرها نیاز داشت؟
آموزش کاربردی

ترنسفورمرها با حذف پردازش ترتیبی گرهٔ حافظه و سرعت در NLP را گشودند

تکامل پردازش زبان طبیعی از قوانین سخت‌گیرانه به معماری ترنسفورمر رسید. این مدل‌ها با جایگزینی پردازش متوالی با مکانیزم خودتوجهی، مشکل فراموشی داده‌ها در متون بلند و سرعت پایین…

۶ دقیقه خواندن۲
پروازهای خیال‌انگیز با ورود ماشین‌ها

درون منطق مدل‌های زبانی؛ تقابل آمار و مفاهیم ذهنی از هوش

بنیان‌گذار یک شرکت هوش مصنوعی استدلال می‌کند که موفقیت مدل‌های زبانی از طریق آمار و مقیاس، مفاهیم ما از هوش انسانی را به چالش می‌کشد. این دیدگاه بر ضرورت تزریق آگاهانه ارزش‌های…

۵ دقیقه خواندن۱
نمودار SVG قورباغه با فک برجسته هابسبورگ، بنچ‌مارک بهینه‌سازی گرافیک برداری.

«قورباغه‌های سلطنتی»؛ اثرات ناخواسته در خروجی‌های بصری هوش مصنوعی

یک محک جدید به نام FROGS_ نشان می‌دهد که مدل‌های هوش مصنوعی در مواجهه با پرامپت‌های ساده، دچار «بیش‌ویرایشگری» می‌شوند. این مدل‌ها به‌جای رسم یک قورباغه ساده، ویژگی‌های پزشکی و…

۷ دقیقه خواندن۲
معماری سیستم چندعاملی که واقعاً کارها را تمام می‌کند
آموزش کاربردی

«جداسازی مسئولیت‌ها»؛ راهکار جدید برای توقف انباشت داده‌های زائد

یک سامانه چندعاملی جدید با جایگزینی چت‌بات‌های تک‌مدل، زنجیره‌ای تخصصی از برنامه‌ریز، پژوهگر، اجراکننده و منتقد ایجاد می‌کند. این معماری با جداسازی مسئولیت‌ها و اجبار به حلقهٔ…

۴ دقیقه خواندن۲
نمایی از تعامل هوش مصنوعی در یک بازی گفتگویی.
آموزش کاربردی

تحلیل معماری جدید: موتور خارجی جایگزین پرامپت در رفتارهای پیچیده شد

یک توسعه‌دهنده با جایگزینی چت‌های گروهی ساده با یک «روتر» مبتنی بر ماشین وضعیت (State Machine)، توهمات قوانین را در بازی اجتماعی Werewolf حذف کرد. این معماری ثابت می‌کند که برای…

۲۱ دقیقه خواندن۱
آندره کارپاتی در حال سخنرانی در رویدادی مربوط به هوش مصنوعی و یادگیری ماشین

Opus 5 محیط‌های سه بعدی پیچیده را از یک پاراگراف متن خلق کرد

آندرج کارپاتی توانایی مدل Opus 5 در تبدیل متن به محیط‌های سه بعدی تعاملی و رویه‌ای را به نمایش گذاشت. این آزمایش نشان‌دهنده گذار به سوی جهان‌سازی «در لحظه» است، هرچند نبود بازخورد…

۲ دقیقه خواندن
بهینه‌سازی بیشتر تجهیزات بینایی: قانون یادداشت‌ها
آموزش کاربردی

درون سازوکار Kimi K3؛ اثر قانون «صفحه سفید» بر تراکم اطلاعات

پژوهشگران دریافتند حذف دستورالمان‌های سخت‌گیرانه در مدیریت حافظه، مدل Kimi K3 را از یک «منشی یادداشت‌بردار» به یک «طراح سیستم» تبدیل می‌کند. این تغییر باعث کاهش دفعات به‌روزرسانی…

۹ دقیقه خواندن