
درون اختلافی که DiffusionGemma را از LM Studio دور کرد
مدل DiffusionGemma با وجود سرعت ۴ برابری نسبت به نسلهای قبل، بهدلیل یک اختلاف فنی در پروژه llama.cpp برای کاربران ابزارهای Ollama و LM Studio در دسترس نیست. در حال حاضر تنها…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۳٬۵۹۵ مقاله منتشر شده

مدل DiffusionGemma با وجود سرعت ۴ برابری نسبت به نسلهای قبل، بهدلیل یک اختلاف فنی در پروژه llama.cpp برای کاربران ابزارهای Ollama و LM Studio در دسترس نیست. در حال حاضر تنها…

جیمز میلر با جایگزینی گزارشهای متنی دستی با یک پایگاهداده SQLite، مشکل فراموشی در عاملهای OpenClaw را حل کرد. این سیستم تمام فراخوانیهای ابزار و خطاها را در سطح زمان اجرا ثبت…

شرکت Cohere یک مدل بازمتن با ۲ میلیارد پارامتر برای تبدیل گفتار به متن در زبان عربی منتشر کرد. این مدل در مدیریت گویشهای محلی و جملات ترکیبی (عربی-انگلیسی) عملکردی برتر از…

بی توکیان، متخصص NVIDIA، متدی را برای اجبار عاملهای هوش مصنوعی به تولید دادههای ساختاریافته به جای متون پیشبینیناپذیر معرفی کرد. این رویکرد بر یک حلقه «تجزیه-اعتبارسنجی-اصلاح»…

اتکای به پرامپتهای سیستمی برای محدود کردن هزینههای عاملهای هوش مصنوعی یک نقص معماری است که منجر به تخطی از بودجه میشود. راهکار جدید، انتقال نظارت از متن دستور به لایهی پرداخت…

کتابخانه متنباز mcp-elements با ارائه ۳۸ مؤلفه آماده، نیاز برنامهنویسان به بازنویسی تکراری صفحات رابط کاربر در پروتکل MCP را از بین برد. این ابزار با پشتیبانی از React، Angular…

تحلیلهای جدید نشان میدهد مدلهای زبانی بزرگ قادر به تشخیص ابطال مقالات علمی پس از تاریخ قطع آموزش خود نیستند. در حالی که مدلها موارد قدیمی و مشهور را میشناسند، مقالات بهتازگی…

یک آزمایش ۳۰ روزه نشان میدهد مسیریابی ترافیک مدلها از طریق تجمیعکنندههایی مانند Global API میتواند هزینهها را تا ۹۴٪ نسبت به استفاده مستقیم از GPT-4o کاهش دهد. این مطالعه بر…

هرس کردن مدلهای زبانی بزرگ برای اجرا روی سختافزارهای لبه، به دلیل هزینههای بالای مهندسی و افت دقت، جایگاه خود را نسبت به استنتاج ابری از دست میدهد. این مقاله توازن میان هرس…

تورستن اسلوک، اقتصاددان ارشد شرکت آپولو، هشدار میدهد که سودآوری شرکتهای غیرفناورانه از هوش مصنوعی ممکن است سالها بیشتر از پیشبینی والاستریت زمان ببرد. این شکاف بین انتظارات…

استارتاپ چینی DeepSeek برای摆脱 وابستگی به انویدیا و هواوی، طراحی تراشههای اختصاصی استنتاج را آغاز کرده است. این شرکت همزمان در حال جذب ۷ میلیارد دلار سرمایه با ارزشگذاری…

چارچوب A11 با معرفی لایههای «اراده» و «خرد»، ساختار خطی رباتهای مدرن را به یک مدل تصمیمگیری عمودی تبدیل میکند. این تغییر اجازه میدهد رباتها بهجای اجرای صرف دستورات، تضادهای…