
حجم توکن در برابر معماری سیستم؛ تضاد در سنجش هوشمندی تجاری
صنعت AI از شمارش درخواستها به سمت توکنها حرکت کرده، اما کارشناسان هشدار میدهند که حجم توکن را نباید با هوشمندی یا درآمد یکی دانست. ارزش واقعی در معماری سیستم، بهویژه مدیریت…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۶۷۹ مقاله منتشر شده

صنعت AI از شمارش درخواستها به سمت توکنها حرکت کرده، اما کارشناسان هشدار میدهند که حجم توکن را نباید با هوشمندی یا درآمد یکی دانست. ارزش واقعی در معماری سیستم، بهویژه مدیریت…

پلتفرم Oxlo.ai مدل قیمتگذاری مبتنی بر توکن را با مدل «درخواستمحور» جایگزین کرد تا هزینههای عملیاتی در گردشهای کاری پیچیده پیشبینیپذیر شود. این رویکرد تفاوت میان هزینه پردازش…

پژوهشی جدید در AIS2C2 ۲۰۲۵ چارچوبی را معرفی میکند که به مدلهای زبانی کوچک و بازمتن اجازه میدهد از طریق پرامپتهای ساختاریافته از ابزارهای خارجی استفاده کنند. این روش نیاز به…

گذار از RAG استاندارد به سیستمهای عاملمحور، هوش مصنوعی را از یک «کتابدار» به «مدیر پروژه» تبدیل میکند. این تغییر، موانع زیرساختی جدی از جمله پیچیدگی مسیریابی ابزارها و جهشهای…

تالوس یک مفسر جدید برای WebAssembly است که با استفاده از زبان Lean 4، اجرای کد را با اثبات ریاضی ادغام میکند. این ابزار به توسعهدهندگان اجازه میدهد صحت برنامهها را در همان کدِ…

انویدیا مدل Nemotron 3 Ultra را معرفی کرد که برخلاف مدلهای پیشرو، نه تنها وزنها، بلکه دادههای آموزشی و متدهای ساخت را نیز بهصورت باز منتشر کرده است. این مدل با معماری ترکیبی،…

پروژه متنباز Clioloop با استفاده از مکانیزم «تلفیق عاملمحور»، پاسخهای باکیفیت را از ترکیب چندین مدل کوچک و ارزان تولید میکند. این سیستم با جایگزینی یک مدل واحد و گران با تیمی…

شرکت OpenAI مدل GPT-5.5 Instant را معرفی کرد که در بنچمارکهای بهداشتی، دقت و شفافیتی بیشتر از پزشکان انسانی دارد. این ابزار اکنون برای تمامی کاربران رایگان جهت تحلیل نتایج…

پژوهشگران با معرفی بنچمارک MosaicLeaks نشان دادند که عاملهای هوش مصنوعی چگونه اطلاعات محرمانه را از طریق کوئریهای وب لو میدهند. برای حل این مشکل، متد آموزشی PA-DR توسعه یافت که…

یک مطالعه گسترده با ۱۹٬۰۰۰ گفتگو نشان میدهد که سیستمهای پیشرفته هوش مصنوعی در تغییر باورها بسیار اثرگذارتر از متخصصان انسانی هستند. در تستهای واقعی جذب سرمایه، این مدلها…

گزارش جدید Hugging Face نشان میدهد که لورا (LoRA) با وجود محبوبیت زیاد، لزوماً بهینهترین انتخاب برای تنظیم دقیق نیست. تحلیلها ثابت میکند برخی متدهای جایگزین، دقت بالاتر و مصرف…

دو مطالعه در نشریه Nature نشان میدهد عاملهای هوش مصنوعی MIRA و AMIE در تشخیصهای شبیهسازیشده و رعایت دستورالعملهای پزشکی از پزشکان پیشی گرفتهاند. با این حال، یافتهها حاکی…