
زبان C در برابر چارچوبهای سنگین برای شتابدهی مدلهای هوش مصنوعی
توسعهدهندهای به نام zserge با خلق کتابخانه utensil در زبان C، نشان داد که حذف چارچوبهای سنگین میتواند سرعت آموزش شبکه عصبی را در سختافزارهای لبه بهطور چشمگیری بالا ببرد.…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۸۷ مقاله منتشر شده

توسعهدهندهای به نام zserge با خلق کتابخانه utensil در زبان C، نشان داد که حذف چارچوبهای سنگین میتواند سرعت آموزش شبکه عصبی را در سختافزارهای لبه بهطور چشمگیری بالا ببرد.…

یک معماری عاملمحور جدید با جداسازی محاسبات دادهای از استدلال مدلهای زبانی، تحلیل تبلیغات را از گزارشهای ساده به بریفهای خلاقانه تبدیل میکند. این سامانه با شناسایی دقیق…

آزمایشهای جدید نشان میدهد که تنظیم دقیق و RAG نمیتوانند سیگنالهای پیشبینیکننده را در دادههای نویزی خلق کنند. مدلهای بزرگتر تمایل دارند به جای الگو، «نویز» را حفظ کنند و…

پژوهش جدید آنتروپیک نشان میدهد مدلهای Claude بسته به زبان مورد استفاده، ویژگیهای رفتاری متفاوتی از خود نشان میدهند. این تحلیل تفاوتهای شخصیتی میان خانوادههای Sonnet و Opus…

فرماندار نیویورک برای جلوگیری از فشار بر شبکه برق و افزایش هزینههای انرژی، مجوزهای جدید مراکز داده با توان بیش از ۵۰ مگاوات را به حالت تعلیق درآورد. این نخستین اقدام ایالتی در…

نقشههای داخلی سنتی به دلیل تحمیل بار ذهنی برای تبدیل تصویر دوبعدی به حرکت سهبعدی شکست میخورند. رایانش مکانی با ادغام مسیریابی زمینهای و بلادرنگ در محیط فیزیکی، این شکاف شناختی…

توسعهدهندگان برای فرار از وابستگی به یک شرکت و کاهش هزینهها، به سمت مدلهای وزنباز حرکت میکنند. APIهای جدید اکنون امکان استقرار این مدلها را بدون نیاز به مدیریت پیچیده…

بازکشف کدهای منبع برنامهٔ ELIZA از دههٔ ۶۰ میلادی نشان میدهد که مدلهای زبانی بزرگ امروز همچنان بر پایهٔ همان ترفند روانشناختی پیشین عمل میکنند. «اثر الیزا» توضیح میدهد چرا…

شرکت Mistral AI مدل Robostral Navigate را معرفی کرد؛ یک مدل ۸ میلیارد پارامتری که رباتها را قادر میسازد تنها با یک دوربین معمولی و بدون نیاز به حسگرهای گرانقیمت، در محیطهای…

Blume یک چارچوب متنباز جدید است که پوشههای Markdown را بدون نیاز به تنظیمات پیچیده به سایتهای مستندات حرفهای تبدیل میکند. این ابزار با پشتیبانی بومی از پروتکل MCP و تولید…

یک الگوی معماری جدید، تأییدیه های ایمیلی انسان را بهجای اعلان ساده، به عنوان نقاط بازرسی سیستمی تعریف میکند. این روش با استفاده از شناسههای منحصربهفرد برای هر اجرا، از خطاهای…

یک چارچوب اندازهگیری جدید ادعا میکند ادعاهای مبهم دربارهٔ «صرفهجویی در باتری» در هوش مصنوعی گمراهکننده است. توسعهدهندگان اکنون میتوانند با ردیابی چهار بودجهٔ مجزا (تأخیر،…