
مدلهای Zero-shot در طبقهبندی تیکتها بر تنظیم دقیق پیروز شدند
استفاده از مدلهای زبانی بزرگ در حالت Zero-shot برای دستهبندی تیکتهای پشتیبانی، انعطافپذیری بیشتر و هزینه عملیاتی کمتری نسبت به تنظیم دقیق (Fine-tuning) دارد. این رویکرد تیمی…
موضوع
۴٬۴۳۴ مقاله منتشر شده

استفاده از مدلهای زبانی بزرگ در حالت Zero-shot برای دستهبندی تیکتهای پشتیبانی، انعطافپذیری بیشتر و هزینه عملیاتی کمتری نسبت به تنظیم دقیق (Fine-tuning) دارد. این رویکرد تیمی…

اوپنایآی با معرفی حالت Ultrafast برای مدل GPT-5.6 Sol، سرعت پاسخدهی را تا ۱۴ برابر افزایش داد. با این حال، سقف سخت ۷۵۰ توکنی برای خروجی، کاربرد این حالت را برای وظایف پیچیده و…

یک تیم توسعه با جایگزینی تصمیمگیری تکبعدی هوش مصنوعی با یک سیستم رایگیری (Voter)، مانع از گم شدن باگهای بحرانی در صفهای اشتباه شد. در این معماری، قوانین قطعی محلی قدرت وتو…

دستیارهای هوش مصنوعی اغلب کدهای اسمبلی بهظاهر درست اما معیوبی تولید میکنند که از فیلتر کامپایلرها میگذرد. یک فرآیند تأیید مکانیکی جدید با ترکیب «اسمبل، دیساسمبل و مقایسه»،…

یک الگوی معماری جدید برای نظارت بر محتوا با استفاده از پیشفیلترهای قطعی و اعتبارسنجی سختگیرانهٔ طرحواره، از ورود توهمات مدلهای زبانی به دادههای عملیاتی جلوگیری میکند. این…

شرکت استرایپ در قراردادی ۷ میلیارد دلاری، پلتفرم OpenRouter را خرید تا به لایهی زیرساختی مرکزی در اقتصاد هوش مصنوعی تبدیل شود. این مبلغ جهشی خیرهکننده نسبت به ارزشگذاری قبلی…

یک مانیفست جدید استدلال میکند که آینده هوش مصنوعی باید از ارائهدهندگان ابری متمرکز به مدلهای محلی و متنباز تغییر کند. این جنبش برای جلوگیری از وابستگی شرکتی و شکنندگی…

ابزار LoreKit به عاملهای هوش مصنوعی اجازه میدهد درسهای آموختهشده از شکستهای قبلی را در فایلهای محلی ذخیره کنند. این سیستم مشکل «فراموشی» در جلسات جدید را بدون نیاز به حساب…

ابزار MathCode با تبدیل زبان طبیعی به قضایای رسمی Lean 4، فاصله میان تفکر شهودی ریاضی و تایید ماشین را پر میکند. این عامل ترمینالمحور با استفاده از یک REPL پایدار و گراف دانش،…

یک توسعهدهنده با استفاده از مدل Qwen3.8-Max علیبابا، دو عامل هوشمند برای مدیریت قیمتگذاری و جذب مشتری در تلگرام ساخت. این مدل در مقایسه با DeepSeek V4 Flash، توکنهای کمتری…

بررسی جامع ۹ مدل چندوجهی نشان میدهد Qwen3-VL-32B بهینهترین گزینه برای OCR و تشخیص اشیا است. انتخاب اشتباه مدل در این حوزه میتواند هزینههای عملیاتی ماهانه را تا ۵۰۰٪ افزایش دهد.

یک دانشجوی علوم کامپیوتر چارچوبی ساختاریافته در هفت مرحله برای یادگیری هوش مصنوعی ارائه داده است که اولویت را از مصرف غیرفعال دورههای آموزشی به سمت پروژههای عملی و «یادگیری در…