پرش به محتوای اصلی

موضوع

استدلال

Chain-of-thought, reasoning models (o-series, R-series), test-time compute

۱٬۱۰۵ مقاله منتشر شده

نمودار مقایسه عملکرد مدل GPT-Oss 120B با سایر مدل‌های زبانی بزرگ در معیارهای استاندارد.
آموزش کاربردی

Oxlo.ai: کاهش شدید هزینه‌های استنتاج با مدل متراکم ۱۲۰ میلیارد پارامتری

مدل GPT-Oss 120B به عنوان جایگزینی متراکم برای مدل‌های MoE معرفی شده که با مدل قیمت‌گذاری ثابت در Oxlo.ai، هزینه‌های عملیاتی عامل‌های پیچیده را به‌شدت می‌کاهد. این مدل برای…

۴ دقیقه خواندن۱
مدل‌های تولید متن برای شبکه‌های زبانی بزرگ
آموزش کاربردی

معماری ترکیب خبره‌ها هزینه‌ی استنتاج مدل‌های زبانی را بدون افت استدلال کاهش

صنعت تولید متن از مدل‌های متراکم به سمت معماری ترکیب خبره‌ها (MoE) می‌رود تا توان استدلالی و پنجره‌های متنی بزرگ را بدون هزینه‌های سرسام‌آور حفظ کند. این تغییر اجازه می‌دهد…

۲ دقیقه خواندن
پردازش جریانی با مدل زبانی بزرگ: تولید متن در لحظه و به‌صورت تکه‌تکه برای پاسخ سریع‌تر.
آموزش کاربردی

چطور قیمت‌گذاری مبتنی بر درخواست، هزینه‌ی استریم مدل‌های سنگین را می‌کاهد؟

پلتفرم Oxlo.ai با حذف پرداخت توکن‌به‌توکن در حالت استریم، هزینه‌ی هر درخواست را ثابت کرد. این تغییر به توسعه‌دهندگان اجازه می‌دهد بدون نگرانی از بودجه، از مدل‌های استدلالی سنگین…

۴ دقیقه خواندن
ابزار Echo: نتایج سطح Fable با یک‌سوم هزینه، با مدل‌های متن‌باز
آموزش کاربردیتأییدنشده · منبع منفرد

سامانه Echo: کاهش ۶۷ درصدی هزینه استنتاج با مدل‌های وزن‌باز

سامانه Echo با جایگزینی تک‌مدل با شبکه‌ای از مدل‌های وزن‌باز، عملکردی مشابه سیستم‌های رده‌بالای Fable ارائه می‌دهد. این رویکرد هزینه‌های استنتاج را تا ۶۷ درصد کاهش داده است.

۲ دقیقه خواندن
سهم بازار ChatGPT برای اولین بار زیر ۵۰ درصد رفت | تک‌کرانچ

گسترش قابلیت‌های سلامتی ChatGPT در برابر شکایتی حقوقی بر سر توصیه‌های خطرناک

اوپن‌ای‌آی قابلیت‌های سلامتی ChatGPT را برای تمامی کاربران بالای ۱۸ سال در آمریکا فعال کرد تا امکان تحلیل پرونده‌های پزشکی فراهم شود. این گسترش در حالی رخ می‌دهد که شرکت با شکایتی…

۳ دقیقه خواندن
عاملم سه بار «تمام شد» گفت، بدون هیچ مدرکی. دیگر به AGENTS.md اعتماد نکردم.
آموزش کاربردی

قواعد متنی AGENTS.md توهم عامل‌های هوش مصنوعی را متوقف نمی‌کنند

اتکای به فایل‌های دستورالعمل برای کنترل رفتار عامل‌ها ناکارآمد است زیرا مدل‌ها ادعای پیروی می‌کنند بدون آنکه واقعاً بررسی شود. امنیت واقعی نیازمند انتقال کنترل از متن به لایه‌ی…

۷ دقیقه خواندن
مهندسی پیشرفته زمینه برای عامل‌های کدنویسی: راهنمای کاربردی
آموزش کاربردی

«بازگشت معماران انسانی»؛ تنها راه نجات کدبیس‌ها از تخریب هوش مصنوعی

تحلیل‌های تخصصی نشان می‌دهد کارخانه‌های نرم‌افزاری «بدون نظارت انسانی» شکست می‌خورند، زیرا آموزش‌های فعلی مدل‌ها، عبور از تست‌ها را بر حفظ کیفیت بلندمدت کد اولویت می‌دهند. راهکار…

۲۸ دقیقه خواندن
لامپ تایپ: شما نسبتاً درست می‌گویید!
آموزش کاربردی

آیا مدل‌های زبانی مختلف اثرانگشت نویسندگی یکسانی دارند؟

پلتفرم Typebulb ابزاری برای تحلیل «اثرانگشت نویسندگی» ۲۲ مدل زبانی بزرگ معرفی کرد که شباهت‌های سبک‌شناختی مدل‌های آزمایشگاه‌های مختلف را می‌سنجد. این تحلیل نشان می‌دهد که مدل‌های…

۴۸۸ دقیقه خواندن
پلاگین امنیتی Claude برای Claude Code: اسکنر آسیب‌پذیری چندعاملی در ترمینال
آموزش کاربردی

پنل‌های چندعاملی Anthropic نرخ خطای شناسایی آسیب‌های امنیتی را کاهش داد

آنتروپیک یک افزونه امنیتی بتا برای Claude Code معرفی کرد که با استفاده از یک خط لوله شش‌مرحله‌ای و پنل‌های تأیید تخاصمی، مخازن کد را برای یافتن آسیب‌پذیری‌ها اسکن می‌کند. این…

۷ دقیقه خواندن