پرش به محتوای اصلی

موضوع

مدل‌های بازوزن

Open-source models, open weights, local hosting, licensing

۱٬۹۴۶ مقاله منتشر شده

مدل همیشه بخش کند استنتاج محلی نیست
آموزش کاربردی

اولاما با حافظهٔ متاداده تأخیر استنتاج محلی را کاهش داد

نسخه پیش‌انتشار ۰.۳۲.۱۵ اولاما با معرفی حافظهٔ متاداده، سربار هر درخواست را حذف می‌کند. این به‌روزرسانی نشان می‌دهد که سرعت نهایی تجربه کاربر، فراتر از نرخ تولید توکن و وابسته به…

۲ دقیقه خواندن۲
عامل هوش مصنوعی شما به مرورگر بهتر نیاز ندارد؛ نیاز دارد کسی برایش با کلودفلر بجنگد.
آموزش کاربردی

تفکیک لایه‌ی استدلال از زیرساخت؛ راهکار جدید برای عبور از سد Cloudflare

توسعه‌دهندگان عامل‌های هوش مصنوعی در سال ۲۰۲۶ با شکافی عمیق میان چارچوب‌های استدلالی و زیرساخت‌های مرورگر مواجه‌اند. در حالی که ابزارهایی مثل Browser Use بر «چه چیزی کلیک شود»…

۱۷ دقیقه خواندن۱
اگر این درست باشد، ابرشرکت‌های فناوری نابود شده‌اند.

مطالعه استنفورد: مدل‌های زبانی کوچک در ۸۱٪ وظایف با مدل‌های ابری برابری می‌کنند

پژوهش جدید دانشگاه استنفورد نشان می‌دهد مدل‌های زبانی کوچک (SLM) که روی سخت‌افزار محلی اجرا می‌شوند، به‌سرعت در حال پر کردن شکاف عملکرد با مدل‌های ابری هستند. این تغییر می‌تواند…

۵ دقیقه خواندن۱
مقایسه عملکرد مدل‌های GPT-4o، Claude و Mistral در معیارهای مختلف وظایف هوش مصنوعی
آموزش کاربردی

استراتژی مسیریابی مدل‌ها؛ جایگزینی بنچمارک‌های کلی با ارزیابی‌های وظیفه‌محور

اتکای صرف به امتیازات کلی بنچمارک‌ها برای انتخاب مدل زبانی اشتباه است. معماری‌های «آگاه از وظیفه» با ایجاد یک لایه مسیریابی، هر درخواست را به مدلی می‌سپارند که بهترین توازن میان…

۳ دقیقه خواندن
نحوه تعیین اندازه مدل‌های زبانی محلی: حافظه VRAM، کش KV و معماری سخت‌افزار در ۲۰۲۶
آموزش کاربردی

محاسبهٔ حافظهٔ VRAM برای مدل‌های محلی؛ فراتر از وزن‌های مدل

اجرای مدل‌های زبانی بزرگ به‌صورت محلی نیازمند حافظه‌ای بیش از حجم وزن‌های مدل است. حافظهٔ KV Cache در پنجره‌های متنی بلند می‌تواند تا ۱۴ گیگابایت فضای اضافی اشغال کند و باعث کندی…

۳ دقیقه خواندن
هشدار نهادهای آمریکایی: مهاجمان از هوش مصنوعی برای ساخت اکسپلویت سیستم‌های کنترل صنعتی استفاده می‌کنند

آژانس‌های امنیتی آمریکا: هوش مصنوعی اتوماسیون حملات به کنترلرهای صنعتی زیمنس را

NSA، FBI و CISA هشدار دادند که مهاجمان از هوش مصنوعی برای ساخت سریع اسکریپت‌های نفوذ به سیستم‌های کنترل صنعتی استفاده می‌کنند. این تغییر، سد فنی برای حمله به زیرساخت‌های حیاتی…

۱ دقیقه خواندن
پیش‌نویس موازی DFlash 2: حفظ هم‌زمان چندین نسخه
آموزش کاربردی

DFlash 2 توان عملیاتی مدل‌های زبانی را تا ۴.۶ برابر افزایش داد

شرکت Inco AI با معرفی DFlash 2، مکانیزم رمزگشایی گمانه‌زنانه را بهینه‌تر کرد تا توکن‌ها به‌جای توالی، به‌صورت موازی پیش‌بینی شوند. این به‌روزرسانی سرعت استنتاج را در مدل‌های خاص…

۱۱ دقیقه خواندن
مفهوم جاودانگی دیجیتال: حفظ هویت انسانی در قالب داده‌های دیجیتال برای ادامه وجود پس از مرگ فیزیکی.

«جاودانگی آماری»؛ تبدیل هر کلمهٔ انسانی به بخشی از معماری LLM

آزمایشگاه‌های پیشرو در هوش مصنوعی تمام متون دیجیتال موجود در وب را برای آموزش مدل‌های آینده می‌بلعند. این فرآیند نوعی «جاودانگی آماری» ایجاد می‌کند که در آن خروجی‌های انسانی…

۱ دقیقه خواندن