
جمینای با نرخ انتخاب ۳۹.۶٪ برندهٔ آزمون کورِ مقالهنویسی دانشجویی شد
یک مطالعه کور روی ۶۸۰۰ دانشجو نشان میدهد جمینای محبوبترین هوش مصنوعی برای نوشتن مقالات دانشگاهی است و از کلود و ChatGPT پیشی گرفته است. دادهها حاکی از آن است که در حالی که…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۸۲ مقاله منتشر شده

یک مطالعه کور روی ۶۸۰۰ دانشجو نشان میدهد جمینای محبوبترین هوش مصنوعی برای نوشتن مقالات دانشگاهی است و از کلود و ChatGPT پیشی گرفته است. دادهها حاکی از آن است که در حالی که…

کاربران پیشرفته در Hacker News مجموعهای از وظایف ساده اما دشوار برای هوش مصنوعی را شناسایی کردند. این شکستها شکاف عمیق میان تسلط زبانی و دقت منطقی در مدلهای فعلی را افشا میکند.

مدل DeepSeek V4 اکنون از طریق یک درگاه API یکپارچه و سازگار با SDK شرکت OpenAI در دسترس است. این بهروزرسانی شامل یک لایه Flash برای کاهش تأخیر در کارهای سبک و حذف نیاز به کدنویسی…

مدل جدید Darwin-36B-Opus توانست در یکی از سختترین محکهای استدلال، با مدلی ۱۱ برابر بزرگتر برابری کند. این دستاورد بهجای آموزش سنگین با GPU، از طریق یک فرآیند تکاملی برای ترکیب…

وابستگی بیش از حد به هوش مصنوعی برای راستیآزمایی اخبار، منجر به ایجاد «پارادوکس وابستگی» شده است. این پدیده در حالی که در ابتدا دقت کاربر را بالا میبرد، در بلندمدت توانایی تفکر…

بسیاری از شکستهای سامانههای RAG ناشی از معماری سیستم است، نه نقص مدلهای زبانی. با تبدیل بازیابی به مرحلهٔ «تولید کاندید» و افزودن لایههای بازرتبهبندی و اعتبارسنجی، میتوان از…

آیبیام خانواده مدلهای استدلالی Granite 4.2 را با وزنهای باز منتشر کرد که بر اساس ۱۵ تریلیون توکن آموزش دیدهاند. این مدلها با استفاده از یک خط لوله یادگیری تقویتی…

تلاش یک توسعهدهنده برای بهروزرسانی ۵۰۰ اسکریپت نشان داد که موازیسازی «کار» با موازیسازی «استدلال» متفاوت است. این پروژه تنها زمانی موفق شد که وظایف قطعی به اسکریپتها سپرده شد…

شرکت Multiverse Computing روشی به نام Quantization-Aware Healing (QAH) معرفی کرد که مدلهای فشرده ۴ بیتی را دقیقتر از نسخههای ۱۶ بیتی میکند. این تکنیک با بازیابی مستقیم دانش از…

مجموعهای منتخب از ابزارهای هوش مصنوعی به دانشجویان پرستاری کمک میکند تا با تمرکز بر بازیابی فعال و استدلال بالینی، حجم عظیم مطالب درسی را مدیریت کنند. استراتژی کلیدی، جایگزینی…

مؤسسه لود ابزار متنباز Headlong را معرفی کرد که به عاملهای هوش مصنوعی اجازه میدهد یک «تکگویی درونی» دائمی داشته باشند. برخلاف مدلهای واکنشی، این عاملها بهطور خودکار…

لینکدین برای بهینهسازی عاملهای استخدام خود، معماری GraphRAG را با یک سیستم حافظه سلسلهمراتبی درختی جایگزین کرد. این تغییر باعث کاهش چشمگیر هزینههای مدل زبانی و تأخیر در…