پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۱٬۹۴۶ مقاله منتشر شده

آموزش LLM اختصاصی معمولاً به معنای ساخت یک متخصص است
آموزش کاربردی

ساخت مدل‌های متخصص جایگزین پیش‌آموزش‌های چندمیلیون دلاری شد

بسیاری از توسعه‌دهندگان به‌جای صرف هزینه‌های هنگفت برای پیش‌آموزش مدل‌های کلی، باید بر ساخت متخصص‌های محدود از طریق پس‌آموزش تمرکز کنند. با استفاده از لورا و گیت‌های ارزیابی…

۲ دقیقه خواندن۱
مقایسه مدل زبانی اختصاصی و آماده در عملیات مالی: کدام برای هوش مصنوعی مناسب‌تر است؟
آموزش کاربردی

مدل‌های زبانی کوچک با هزینه ۱/۲۰ مدل‌های پیشرو در عملیات مالی پیروز شدند

تیم‌های مالی در حال گذار از مدل‌های غول‌پیکر به معماری‌های ترکیبی هستند که در آن مدل‌های کوچکِ تنظیم‌شده برای حجم بالا و مدل‌های پیشرو برای تصمیم‌گیری‌های پیچیده به کار می‌روند.…

۱۹ دقیقه خواندن۲
اس۱-مینی: نرمال‌ساز متن باز ۴۶۲ مگابایتی سوپرویسپر که رونویسی خام گفتار را به متن تمیز تبدیل می‌کند
آموزش کاربردی

مدل S1-mini متون خام بازشناسی گفتار را به نوشته‌های صیقل‌خورده تبدیل می‌کند

شرکت Superwhisper مدل S1-mini را منتشر کرد؛ یک مدل زبانی کوچک با وزن‌های باز که تپق‌ها و کلمات پرکننده را از متن‌های تبدیل‌شده از صوت حذف می‌کند. این مدل به‌گونه‌ای بهینه شده که…

۵ دقیقه خواندن۱
کیوئن ۳.۸-۲۷B: مدل زبانی بازوزنی که روی یک GPU جدی جا می‌شود — روز ۱/۳۰
آموزش کاربردی

علی‌بابا: مدل جدید ۲۷ میلیارد پارامتری جایگزینی اقتصادی برای APIهاست

مدل جدید علی‌بابا، Qwen3.8-27B، تعادلی میان اندازه و قدرت ایجاد کرده است که اجازه می‌دهد یک میلیون توکن در یک GPU رده‌بالا جای بگیرد. این مدل در استخراج داده‌های ساخت‌یافته و…

۶ دقیقه خواندن۱
بیش از ۱ میلیارد بار دانلود مدل‌های باز گوگل جمّا؛ تنوع مدل‌ها از ۱۰۰ هزار گذشت

«پذیرش گسترده مدل‌های وزن‌باز»؛ دستاورد جدید گوگل در اکوسیستم AI

خانواده مدل‌های وزن‌باز گوگل با عبور از مرز یک میلیارد دانلود، به زیرساختی برای توسعه‌دهندگان تبدیل شده است. ایجاد ۱۰۰ هزار نسخهٔ شخصی‌سازی‌شده از گما، نشان‌دهندهٔ پذیرش گسترده…

۴ دقیقه خواندن۱
استنتاج تا ۳.۲ برابر سریع‌تر با LFM2.5-DSpark
آموزش کاربردی

چطور DSpark سرعت پاسخ‌دهی عامل‌های هوشمند را در سخت‌افزارهای محلی بالا برد؟

شرکت Liquid AI با معرفی مدل‌های پیش‌نویس DSpark و استفاده از رمزگشایی گمانه‌زنانه، توان عملیاتی مدل‌های LFM2.5 را روی GPU و مک‌بوک به‌شدت افزایش داد. این به‌روزرسانی تأخیر…

۵ دقیقه خواندن
دو کارت گرافیک در حال پردازش هوش مصنوعی در یک کیس کامپیوتر خانگی
آموزش کاربردی

رمزگشایی گمانه‌زنانه سرعت استنتاج مدل‌های محلی روی سخت‌افزارهای قدیمی را

یک آزمایش عملی نشان می‌دهد ترکیب رمزگشایی گمانه‌زنانه با بهینه‌سازی‌های سطح BIOS و کرنل می‌تواند سرعت تولید توکن را در سرورهای خانگی چند-GPU دوبرابر کند. این روش با رفع گلوگاه‌های…

۲۶ دقیقه خواندن
راهکارهای درگاه MCP سازمانی: ارائه‌دهندگان، جایگزین‌ها و هزینه
آموزش کاربردی

گیت‌وی Bifrost هزینه استنتاج ابزارهای هوش مصنوعی را ۹۲.۲٪ کاهش داد

پلتفرم Bifrost با معرفی یک گیت‌وی یکپارچه برای پروتکل MCP، مدیریت ابزارها و مدل‌های زبانی را متمرکز کرد. این سیستم با جایگزینی تزریق توکن‌های حجیم با ارکستراسیون پایتونی در حالت…

۱۴ دقیقه خواندن۲
ابزار پاک‌سازی توکن‌های اضافی کلود ۵ با مدل زبانی دیگر. صرفه‌جویی در توکن، کلود ۵ ناامیدکننده است.
آموزش کاربردی

ابزار Vomit خروجی‌های نامفهوم Claude 5 را با مدل‌های محلی پاک‌سازی می‌کند

ابزار متن‌باز Vomit با انتقال خروجی‌های به‌هم‌ریخته مدل Claude 5 به یک مدل زبانی محلی، آن‌ها را به متنی خوانا تبدیل می‌کند. این ابزار راهکاری کاملاً محلی و بدون نیاز به ارسال داده…

۱ دقیقه خواندن۲
نشست ModCon 2026: متن‌باز، ابر متن‌باز، سیلیکون متن‌باز
آموزش کاربردی

متن‌باز شدن ابزارهای Mojo چه تأثیری بر بهینه‌سازی نرم‌افزارهای AI دارد؟

زبان برنامه‌نویسی Mojo اکنون تمام کدهای منبع کامپایلر و ابزارهای توسعه خود را به‌صورت متن‌باز منتشر کرده است. این اقدام به توسعه‌دهندگان اجازه می‌دهد با شفافیت کامل، نرم‌افزارهای…

۳ دقیقه خواندن۱
هک ساعت هوشمند ۲۷ دلاری با کلود
آموزش کاربردی

«جریان‌های کاری عامل‌محور»؛ راهکاری برای ساخت سریع رابط‌های سخت‌افزاری

مایک کاسبرگ با استفاده از Claude و مدل‌های متن‌باز، یک صفحه ساعت سفارشی برای سخت‌افزار ارزان‌قیمت PineTime ساخت. این پروژه نشان می‌دهد چگونه جریان‌های کاری عامل‌محور می‌توانند…

۴ دقیقه خواندن