
سقوط پارادایم آموزش: یافتن معماریهای مینیمال با قدرت تصادف
روشی جدید به نام Random Cloud اجازه میدهد بدون نیاز به آموزش اولیه، کوچکترین و بهینترین ساختار شبکههای عصبی شناسایی شوند. این متد با جایگزینی چرخه پرهزینه…
موضوع
SLMs, on-device inference, mobile AI, AI PCs
۱٬۰۸۱ مقاله منتشر شده

روشی جدید به نام Random Cloud اجازه میدهد بدون نیاز به آموزش اولیه، کوچکترین و بهینترین ساختار شبکههای عصبی شناسایی شوند. این متد با جایگزینی چرخه پرهزینه…

یک چارچوب سلسلهمراتبی جدید با ترکیب قوانین قطعی و یادگیری تقویتشده، ایمنی پهپادها را در عملیات امداد و نجات متحول کرده است. این سیستم حتی بدون پیشآموزش، نرخ برخوردها را کاهش…

یک مدل تخصصی Qwen2.5-7B در تریاژ پزشکی از GPT-4o پیشی گرفت. این نتیجه ثابت میکند تنظیم دقیق روی دادههای بالینی بسیار موثرتر از تکیه بر مدلهای عمومی عظیم است.

پژوهشگران با طراحی یک خط لوله تطبیقی، ثابت کردند که استفاده از انگلیسی ساده در زمان بحرانها، سرعت و دقت ترجمه را بهشدت افزایش میدهد. این سیستم با تمرکز بر مدلهای زبانی کوچک،…

مدل جدید Star-Fusion با تغییر رویکرد از رگرسیون به طبقهبندی گسسته، مشکل «گمشدن در فضا» را حل کرده است. این معماری چندوجهی با دقت ۹۳.۴ درصد و تأخیر بسیار کم، استقرار ماهوارههای…

پژوهشگران با معرفی چارچوب DUAL-BLADE، گلوگاه حافظه در رایانش لبه را با حذف حافظهی صفحهی هسته (Kernel Page Cache) شکستند. این سیستم تأخیر استنتاج را بهطور چشمگیری کاهش داده و…

پژوهشگران راهکاری برای کاهش تأخیر در مدلهای چندوجهی (VLM) ابداع کردهاند که ارتباط بین دستگاههای لبه و ابر را بهینه میکند. این سیستم با استفاده از Meta AutoEncoder، دادههای…

SecMate یک دستیار هوش مصنوعی عاملمحور است که با تحلیل دادههای دستگاه و کاربر، دقت حل مشکلات امنیتی را به بیش از ۹۰ درصد رسانده است. این سیستم ثابت کرد که در اکثر سناریوهای…

چارچوب MetaSR با استفاده از ترنسفورمرهای انتشار، هزینه انتقال دادههای تصویری را نصف کرده و همزمان کیفیت را افزایش میدهد. این فناوری با جایگزینی متادیتای ثابت با استراتژیهای…

مایکروسافت با معرفی Phi-4-mini-instruct، مدلی با ۳.۸ میلیارد پارامتر عرضه کرد که در ریاضیات و استدلال، رقبای دو برابر بزرگتر خود را شکست میدهد. این مدل با پنجره بافت ۱۲۸ هزار…

تیم Unsloth با ارائه نسخههای بهینهشدهی DeepSeek-R1، مدل ۶۷۱ میلیارد پارامتری را برای سختافزارهای مصرفکننده در دسترس قرار داد. این دستاورد به لطف تکنیک کوانتایزیشن ۱.۵۸ بیتی،…

مدل Kokoro با تنها ۸۲ میلیون پارامتر، کیفیت صدای رقبای بزرگتر را با هزینهای کمتر از ۱ دلار برای هر میلیون نویسه به دست آورده است. این مدل با لایسنس آپاچی منتشر شده و مسیر جدیدی…