پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۲٬۰۵۲ مقاله منتشر شده

اس۱-مینی: نرمال‌ساز متن باز ۴۶۲ مگابایتی سوپرویسپر که رونویسی خام گفتار را به متن تمیز تبدیل می‌کند
آموزش کاربردی

مدل S1-mini متون خام بازشناسی گفتار را به نوشته‌های صیقل‌خورده تبدیل می‌کند

شرکت Superwhisper مدل S1-mini را منتشر کرد؛ یک مدل زبانی کوچک با وزن‌های باز که تپق‌ها و کلمات پرکننده را از متن‌های تبدیل‌شده از صوت حذف می‌کند. این مدل به‌گونه‌ای بهینه شده که…

۵ دقیقه خواندن۱
کیوئن ۳.۸-۲۷B: مدل زبانی بازوزنی که روی یک GPU جدی جا می‌شود — روز ۱/۳۰
آموزش کاربردی

علی‌بابا: مدل جدید ۲۷ میلیارد پارامتری جایگزینی اقتصادی برای APIهاست

مدل جدید علی‌بابا، Qwen3.8-27B، تعادلی میان اندازه و قدرت ایجاد کرده است که اجازه می‌دهد یک میلیون توکن در یک GPU رده‌بالا جای بگیرد. این مدل در استخراج داده‌های ساخت‌یافته و…

۶ دقیقه خواندن۱
بیش از ۱ میلیارد بار دانلود مدل‌های باز گوگل جمّا؛ تنوع مدل‌ها از ۱۰۰ هزار گذشت

«پذیرش گسترده مدل‌های وزن‌باز»؛ دستاورد جدید گوگل در اکوسیستم AI

خانواده مدل‌های وزن‌باز گوگل با عبور از مرز یک میلیارد دانلود، به زیرساختی برای توسعه‌دهندگان تبدیل شده است. ایجاد ۱۰۰ هزار نسخهٔ شخصی‌سازی‌شده از گما، نشان‌دهندهٔ پذیرش گسترده…

۴ دقیقه خواندن۲
استنتاج تا ۳.۲ برابر سریع‌تر با LFM2.5-DSpark
آموزش کاربردی

چطور DSpark سرعت پاسخ‌دهی عامل‌های هوشمند را در سخت‌افزارهای محلی بالا برد؟

شرکت Liquid AI با معرفی مدل‌های پیش‌نویس DSpark و استفاده از رمزگشایی گمانه‌زنانه، توان عملیاتی مدل‌های LFM2.5 را روی GPU و مک‌بوک به‌شدت افزایش داد. این به‌روزرسانی تأخیر…

۵ دقیقه خواندن۱
دو کارت گرافیک در حال پردازش هوش مصنوعی در یک کیس کامپیوتر خانگی
آموزش کاربردی

رمزگشایی گمانه‌زنانه سرعت استنتاج مدل‌های محلی روی سخت‌افزارهای قدیمی را

یک آزمایش عملی نشان می‌دهد ترکیب رمزگشایی گمانه‌زنانه با بهینه‌سازی‌های سطح BIOS و کرنل می‌تواند سرعت تولید توکن را در سرورهای خانگی چند-GPU دوبرابر کند. این روش با رفع گلوگاه‌های…

۲۶ دقیقه خواندن۱
راهکارهای درگاه MCP سازمانی: ارائه‌دهندگان، جایگزین‌ها و هزینه
آموزش کاربردی

گیت‌وی Bifrost هزینه استنتاج ابزارهای هوش مصنوعی را ۹۲.۲٪ کاهش داد

پلتفرم Bifrost با معرفی یک گیت‌وی یکپارچه برای پروتکل MCP، مدیریت ابزارها و مدل‌های زبانی را متمرکز کرد. این سیستم با جایگزینی تزریق توکن‌های حجیم با ارکستراسیون پایتونی در حالت…

۱۴ دقیقه خواندن۲
ابزار پاک‌سازی توکن‌های اضافی کلود ۵ با مدل زبانی دیگر. صرفه‌جویی در توکن، کلود ۵ ناامیدکننده است.
آموزش کاربردی

ابزار Vomit خروجی‌های نامفهوم Claude 5 را با مدل‌های محلی پاک‌سازی می‌کند

ابزار متن‌باز Vomit با انتقال خروجی‌های به‌هم‌ریخته مدل Claude 5 به یک مدل زبانی محلی، آن‌ها را به متنی خوانا تبدیل می‌کند. این ابزار راهکاری کاملاً محلی و بدون نیاز به ارسال داده…

۱ دقیقه خواندن۲
نشست ModCon 2026: متن‌باز، ابر متن‌باز، سیلیکون متن‌باز
آموزش کاربردی

متن‌باز شدن ابزارهای Mojo چه تأثیری بر بهینه‌سازی نرم‌افزارهای AI دارد؟

زبان برنامه‌نویسی Mojo اکنون تمام کدهای منبع کامپایلر و ابزارهای توسعه خود را به‌صورت متن‌باز منتشر کرده است. این اقدام به توسعه‌دهندگان اجازه می‌دهد با شفافیت کامل، نرم‌افزارهای…

۳ دقیقه خواندن۲
هک ساعت هوشمند ۲۷ دلاری با کلود
آموزش کاربردی

«جریان‌های کاری عامل‌محور»؛ راهکاری برای ساخت سریع رابط‌های سخت‌افزاری

مایک کاسبرگ با استفاده از Claude و مدل‌های متن‌باز، یک صفحه ساعت سفارشی برای سخت‌افزار ارزان‌قیمت PineTime ساخت. این پروژه نشان می‌دهد چگونه جریان‌های کاری عامل‌محور می‌توانند…

۴ دقیقه خواندن
مدل همیشه بخش کند استنتاج محلی نیست
آموزش کاربردی

اولاما با حافظهٔ متاداده تأخیر استنتاج محلی را کاهش داد

نسخه پیش‌انتشار ۰.۳۲.۱۵ اولاما با معرفی حافظهٔ متاداده، سربار هر درخواست را حذف می‌کند. این به‌روزرسانی نشان می‌دهد که سرعت نهایی تجربه کاربر، فراتر از نرخ تولید توکن و وابسته به…

۲ دقیقه خواندن۲
عامل هوش مصنوعی شما به مرورگر بهتر نیاز ندارد؛ نیاز دارد کسی برایش با کلودفلر بجنگد.
آموزش کاربردی

تفکیک لایه‌ی استدلال از زیرساخت؛ راهکار جدید برای عبور از سد Cloudflare

توسعه‌دهندگان عامل‌های هوش مصنوعی در سال ۲۰۲۶ با شکافی عمیق میان چارچوب‌های استدلالی و زیرساخت‌های مرورگر مواجه‌اند. در حالی که ابزارهایی مثل Browser Use بر «چه چیزی کلیک شود»…

۱۷ دقیقه خواندن۱