پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۷۸۸ مقاله منتشر شده

راهنمای مهندسی سیستم‌های عامل‌محور برای مدیریت پرس‌وجوهای بزرگ در محیط‌های توزیع‌شده
آموزش کاربردی

سامانه‌های توزیع‌شدهٔ عامل‌محور زمان پرس‌وجوهای حجیم را از ۴۰ دقیقه به ۹۰ ثانیه

تغیری بنیادین در معماری هوش مصنوعی، دستیاران یکپارچه را با سامانه‌ای چهارلایه جایگزین کرده تا پرس‌وجوهای در مقیاس پتابایت را مدیریت کند. این رویکرد با تجزیهٔ درخواست‌های پیچیده به…

۲۳ دقیقه خواندن۱
راهنمای فنی مدل زبانی کم‌تأخیر برای پیش‌بینی سری زمانی
آموزش کاربردی

قیمت‌گذاری تخت Oxlo.ai هزینه پیش‌بینی سری‌های زمانی با LLM را کاهش داد

زیرساخت جدید Oxlo.ai با حذف «راه‌اندازی سرد» و تغییر مدل هزینه از توکن به هر درخواست، تأخیر در پیش‌بینی داده‌های عددی را می‌گیرد. این رویکرد اجازه می‌دهد مدل‌های زبانی جایگزین…

۵ دقیقه خواندن
هکر هوش مصنوعی GPT-Red شرکت OpenAI برای افزایش امنیت مدل‌ها ساخته شد.

«اتوماسیون Red-Teaming»؛ راهکار جدید OpenAI برای شناسایی حفره‌های امنیتی

اوپن‌ای‌آی مدل تخصصی GPT-Red را برای شناسایی و رفع خودکار حفره‌های امنیتی مدل‌های دیگر توسعه داده است. این سیستم با استفاده از یک حلقه «بازی با خود»، استواری GPT-5.6 را به‌طوری…

۵ دقیقه خواندن۲
مسیریابی مدل ساده است. تا وقتی که نیست.
آموزش کاربردی

الگوریتم‌های بهینه‌ساز در برابر روترهای ساده در مدیریت حافظهٔ مدل‌ها

رویکردهای ساده برای توزیع وظایف بین مدل‌های ارزان و گران به‌دلیل نادیده گرفتن زیرساخت و حافظه موقت، هزینه‌ها را افزایش می‌دهند. جایگزینی این روش با الگوریتم‌های بهینه‌ساز…

۵ دقیقه خواندن
مدل هدف‌مند عمومی ماینکرفت - پانتوگراف

آیا تماشای ویدیوهای اینترنتی می‌تواند جایگزین برچسب‌گذاری داده‌ها شود؟

شرکت Pantograph مدلی با ۴ میلیارد پارامتر به نام Pan توسعه داده که بدون نیاز به داده‌های برچسب‌گذاری‌شده، تنها از طریق تماشای ویدیوهای اینترنتی، رفتارهای هدفمند را یاد می‌گیرد.…

۱۵ دقیقه خواندن
همکاری Supply Co. و Work Louدر: کیبورد و ماوس ارگونومیک برای کار مدرن

OpenAI با Codex Micro کنترل عامل‌های هوش مصنوعی را به دنیای فیزیکی آورد

شرکت OpenAI با همکاری Work Louder سخت‌افزار Codex Micro را برای مدیریت مستقیم عامل‌های هوش مصنوعی معرفی کرد. این دستگاه با استفاده از کلیدهای مکانیکی و پیچ‌های چرخشی، امکان تنظیم…

۱ دقیقه خواندن۲
فضای J، مدل‌های متن‌باز — نسخه ۲

بردار‌های هدایت مفاهیم در مدل‌های مختلف هوش مصنوعی با چرخش خطی منتقل می‌شوند

پژوهش‌های جدید نشان می‌دهد بردار‌های هدایت (Steering Vectors) یک مدل زبانی را می‌توان با یک چرخش ریاضی ساده به مدل دیگری از خانواده‌ای متفاوت منتقل کرد. این یافته ثابت می‌کند…

۲۰ دقیقه خواندن
مدل زبانی بزرگ با تأخیر کم برای تولید متن طبیعی
آموزش کاربردی

آیا معماری MoE می‌تواند تأخیر بین‌توکنی را بدون کاهش دقت حذف کند؟

بهینه‌سازی تولید زبان طبیعی نیازمند موازنه بین زمان تا نخستین توکن و تأخیر بین‌توکنی است. استفاده از معماری ترکیب خبره‌ها اجازه می‌دهد عمق استدلال مدل حفظ شود و در عین حال توان…

۲ دقیقه خواندن
زبان‌های دامنه‌محور، استفاده مطمئن از مدل‌های زبانی بزرگ را ممکن می‌سازند
آموزش کاربردی

زبان‌های تخصصی (DSL) راهکار دستیابی به کدنویسی قابل‌اعتماد با هوش مصنوعی

استفاده از زبان‌های تخصصی (DSL) با محدود کردن فضای خروجی مدل‌ها، احتمال توهم را حذف و صحت سینتکسی را تضمین می‌کند. این رویکرد به توسعه‌دهندگان اجازه می‌دهد حلقه‌های خودکارسازی…

۱۵ دقیقه خواندن