
چرا برای کنترل مدلهای محلی دیگر نیازی به مهندسی پرامپت ندارید؟
مهندسان اکنون میتوانند با تغییر فعالسازهای داخلی مدلهای زبانی، خروجیها را هدایت کنند. انتشار DeepSeek-V4-Flash و ابزار DwarfStar 4 این روش را برای کدنویسی عاملمحور کاربردی…
موضوع
SLMs, on-device inference, mobile AI, AI PCs
۱٬۷۶۰ مقاله منتشر شده

مهندسان اکنون میتوانند با تغییر فعالسازهای داخلی مدلهای زبانی، خروجیها را هدایت کنند. انتشار DeepSeek-V4-Flash و ابزار DwarfStar 4 این روش را برای کدنویسی عاملمحور کاربردی…

OpenAI با ادغام Codex در اپلیکیشن موبایل ChatGPT، امکان مدیریت محیطهای توسعه محلی و ابری را فراهم کرد. این بهروزرسانی با معرفی ابزارهایی مثل SSH از راه دور، کنترل کدها را از میز…

پژوهشگران مؤسسه Allen و دانشگاه برکلی مدلی به نام EMO را معرفی کردند که با سازماندهی متخصصان بر اساس دامنههای معنایی، عملکرد خود را حتی با حذف ۸۷.۵٪ از ظرفیت متخصصان حفظ میکند.

توسعهدهندگان با استفاده از Hermes Agent و Termux، گوشیهای اندرویدی را به ایستگاههای کاری هوش مصنوعی تبدیل میکنند. این عاملهای خودگردان بدون نیاز به ابر، مخازن گیتهاب را…

یک استراتژی جدید با ترکیب مدل Mistral Nemo و ابزار vLLM، هزینه استنتاج را تا ۹۵٪ کاهش میدهد. این پیکربندی روی GPUهای ارزانقیمت، سرعت پاسخدهی را ۳ برابر کرده و نیاز به پرداخت…

مدل محلی Qwen 3.6 27B اکنون در بنچمارک SWE-bench Verified تنها ۳.۶ درصد با Claude Opus 4.6 فاصله دارد. برای توسعهدهندگانی که هزینههای بالای API دارند، خرید یک GPU RTX 4090 در…

پروژه متنباز Osaurus به کاربران مک اجازه میدهد تا مدلهای محلی و ابری را در یک محیط امن و ایزوله مدیریت کنند. این ابزار با انتقال کنترل دادهها از مراکز داده به سختافزار شخصی،…

ابزار جدید whichllm با اولویت دادن به بنچمارکهای واقعی بهجای تعداد پارامترها، بهترین مدل محلی را برای سختافزار شما پیشنهاد میدهد. این ابزار مشخصات GPU و CPU را شناسایی کرده و…

پلتفرم متنباز GlycemicGPT با استفاده از مدل «هوش مصنوعی شخصی» (BYOAI)، تحلیل دادههای گلوکز و پمپ انسولین را خودکار میکند. این ابزار با اولویت دادن به حریم خصوصی، اجازه میدهد…

یک توسعهدهنده با انتقال به سختافزار محلی و استفاده از مدلهای Qwen و Ollama، هزینههای API خود را کاملاً حذف کرد. این تغییر، هزینه ماهانه را از پرداخت به شرکتهای ابری به قبض…

شرکت Supertone مدل Supertonic 3 را معرفی کرد؛ یک سیستم تبدیل متن به گفتار (TTS) سبک که روی دستگاه اجرا میشود و از ۳۱ زبان پشتیبانی میکند. این مدل در نرمالسازی متون پیچیده مالی…

ابزار جدیدی به نام DS4 امکان اجرای مدلهای پیشرو هوش مصنوعی را روی سختافزارهای مصرفکننده با ۱۲۸ گیگابایت رم فراهم میکند. این سیستم با استفاده از یک روش خاص کوانتیزاسیون، شکاف…