پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۸۱۳ مقاله منتشر شده

تریلر ویروسی بازی AI معیار نیست؛ این‌گونه آن را معیار کنید.
آموزش کاربردی

درون سازوکار ردیابی؛ تبدیل کلیپ‌های ویروسی به بنچ‌مارک‌های قابل تکرار

یک کلیپ ویروسی از Grok در حال ساخت تریلر بازی، شکاف عمیق میان خروجی‌های صیقل‌خورده و گردش‌کارهای تکرارپذیر را آشکار کرد. این چارچوب پیشنهادی با معرفی «قرارداد اجرا» و مدل ردیابی،…

۴ دقیقه خواندن۴
فرضیه ملکه سرخ: راهی نو برای هوش مصنوعی خودبهبودیابنده

پژوهش انویدیا: تکامل هم‌زمان ارزیاب و عامل هزینه‌های محاسباتی را کاهش داد

پژوهشگران کمبریج و انویدیا چارچوبی را توسعه داده‌اند که در آن عامل‌های هوش مصنوعی و ارزیابان آن‌ها به‌طور هم‌زمان تکامل می‌یابند. این رویکرد مانع از توقف پیشرفت در اثر بنچمارک‌های…

۵ دقیقه خواندن۵
قطع سرویس Anthropic دسترسی به Claude را مختل کرد؛ پس از خطای ورود، رفع‌اشکال اعمال شد.

۱۴ اختلال در دو هفته؛ بحران پایداری در اکوسیستم کلود آنتروپیک

شرکت آنتروپیک در بازه زمانی ۱۴ روزه، ۱۴ مورد اختلال در سرویس‌های خود را تجربه کرد که آخرین مورد آن در ۱۶ اوت ۲۰۲۶ منجر به قطع گسترده دسترسی شد. با وجود نرخ پایداری ظاهری بالای…

۴ دقیقه خواندن۳
یونی‌تری در آزمون تریلیون‌یوانی: نرخ پذیره‌نویسی ۰٫۰۱۸٪، P/E ۲۱۹ برابر و لنگر ارزش‌گذاری ربات‌های انسان‌نما

ارزش‌گذاری ۲۱۹ برابری Unitree؛ لنگر قیمت برای صنعت ربات‌های انسان‌نما

عرضه اولیه Unitree در بازار STAR نخستین معیار عمومی برای ارزش‌گذاری ربات‌های انسان‌نما را ایجاد کرد. این اتفاق نشان‌دهنده گذار صنعت از دوران «روایت‌های تخیلی» به عصر مطالبه…

۵ دقیقه خواندن۲
ChatGPT با سرعت ۱۴ برابری: چه معنایی برای کاربران دارد

حالت Ultrafast در GPT-5.6 Sol سرعت تولید متن را به ۷۵۰ توکن در ثانیه رساند

اوپن‌ای‌آی با معرفی حالت Ultrafast برای مدل GPT-5.6 Sol، سرعت پاسخ‌دهی را تا ۱۴ برابر افزایش داد. با این حال، سقف سخت ۷۵۰ توکنی برای خروجی، کاربرد این حالت را برای وظایف پیچیده و…

۹ دقیقه خواندن
فشار آمریکا بر متحدان برای انتخاب طرف در رقابت تراشه هوش مصنوعی با چین

التیماتوم واشینگتن به متحدان برای مسدود کردن دسترسی چین به تراشه‌های AI

دولت آمریکا در حال آماده‌سازی ضرب‌الاجلی برای متحدان خود است تا کنترل‌های صادراتی سخت‌گیرانه‌ای بر نیمه‌رساناهای هوش مصنوعی اعمال کنند. این استراتژی با هدف ایجاد یک دیوار جهانی…

۳ دقیقه خواندن
روتر تصادف‌کرده به امتیاز اطمینان ۰.۹۷ اعتماد کرد؛ نیاز به رأی‌گیری داشت.
آموزش کاربردی

رای‌گیری قطعی در برابر تصمیم‌گیری تک‌بعدی برای اصلاح خروجی‌های مدل

یک تیم توسعه با جایگزینی تصمیم‌گیری تک‌بعدی هوش مصنوعی با یک سیستم رای‌گیری (Voter)، مانع از گم شدن باگ‌های بحرانی در صف‌های اشتباه شد. در این معماری، قوانین قطعی محلی قدرت وتو…

۶ دقیقه خواندن۳
سه دستور ساده برای بررسی دروازه‌های منطقی در مدارهای هوش مصنوعی.
آموزش کاربردی

تأیید مکانیکی در برابر کامپایلرهای استاندارد در شناسایی خطاهای کدنویسی

دستیارهای هوش مصنوعی اغلب کدهای اسمبلی به‌ظاهر درست اما معیوبی تولید می‌کنند که از فیلتر کامپایلرها می‌گذرد. یک فرآیند تأیید مکانیکی جدید با ترکیب «اسمبل، دیس‌اسمبل و مقایسه»،…

۳ دقیقه خواندن۳
طبقه‌بندی دسته‌ای با طرحواره، صف بازبینی و محاسبه هزینه توکن در پایتون
آموزش کاربردی

«جلوگیری از توهمات عملیاتی»؛ هدف از پیاده‌سازی اعتبارسنجی سخت‌گیرانه در LLM

یک الگوی معماری جدید برای نظارت بر محتوا با استفاده از پیش‌فیلترهای قطعی و اعتبارسنجی سخت‌گیرانهٔ طرح‌واره، از ورود توهمات مدل‌های زبانی به داده‌های عملیاتی جلوگیری می‌کند. این…

۹ دقیقه خواندن۱
لوگوی «بیانیه اول محلی»: آینده هوش مصنوعی باید آزاد، مستقل و جامعه‌محور باشد.
آموزش کاربردی

مانیفست TormentNexus: جایگزینی ابرهای متمرکز با مدل‌های محلی برای حاکمیت داده‌ها

یک مانیفست جدید استدلال می‌کند که آینده هوش مصنوعی باید از ارائه‌دهندگان ابری متمرکز به مدل‌های محلی و متن‌باز تغییر کند. این جنبش برای جلوگیری از وابستگی شرکتی و شکنندگی…

۴ دقیقه خواندن۱
کیوئن ۳.۵ با وجود استدلال مشابه جی‌ال‌ام-۵.۲، ۸۲ درصد واقعیت‌ها را توهم می‌زند

چرا مدل‌های پیشرو در ریاضیات همچنان دچار توهمات گسترده می‌شوند؟

تحلیل‌های فنی جدید نشان می‌دهد آزمایشگاه‌های AI برای افزایش کارایی استدلال، عمداً دانش فکت‌محور را از مدل‌ها حذف می‌کنند. مدل‌هایی مانند Qwen3.5 در ریاضیات پیشرو هستند اما در نبود…

۱۲ دقیقه خواندن