
Reame هزینه استنتاج را با ذخیرهسازی حافظه در دیسک کاهش داد
پروژه Reame با اولویت دادن به پردازندههای ارزانقیمت (CPU) بهجای GPU، هزینههای عملیاتی هوش مصنوعی را بهشدت پایین آورد. این سرور از حافظه موقت دیسکمحور و رمزگشایی گمانهزنانه…
موضوع
SLMs, on-device inference, mobile AI, AI PCs
۱٬۶۶۵ مقاله منتشر شده

پروژه Reame با اولویت دادن به پردازندههای ارزانقیمت (CPU) بهجای GPU، هزینههای عملیاتی هوش مصنوعی را بهشدت پایین آورد. این سرور از حافظه موقت دیسکمحور و رمزگشایی گمانهزنانه…

جورج هاتز، مهندس سابق Comma، استدلال میکند که هوش مصنوعی نمیتواند قوانین فیزیکی و لجستیک دنیای واقعی را دور بزند. او معتقد است «جهش سریع» مدلها یک افسانه است و تنها راه حفاظت…

یک پیادهسازی جدید با جایگزینی شبکههای عصبی با جداول جستوجوی کوانتیده، جستوجوی معنایی را به وبسایتهای استاتیک میآورد. این روش با حجمی تنها ۴ مگابایت، کیفیتی مشابه مدلهای…

یک کلاینت متنباز جدید برای مدلهای زبانی محلی، مشکل گم شدن پاسخهای طولانی هنگام رفرش یا کرش مرورگر را حل کرده است. این ابزار فرآیند تولید متن را از اتصال HTTP جدا کرده و مدیریت…

اپل متهم میکند OpenAI از طریق جذب مهندسان و سرقت دادههای محرمانه، سعی در تسریع توسعه سختافزاری خود داشته است. این پرونده نشان میدهد رقابت AI از مدلهای نرمافزاری به جنگ…

سرمایه و حریم خصوصی در برابر API؛ ابزار اولاما امکان اجرای مدلهای زبانی بزرگ را مستقیماً روی سختافزار کاربر فراهم میکند. این رویکرد هزینههای تکرار شونده سرویسهای ابری را حذف…

بسیاری از کسبوکارها برای حفظ حریم خصوصی و کاهش هزینههای API، مدلهای ابری را با جایگزینهای محلی مانند Ollama عوض میکنند. دادهها نشان میدهد این تغییر میتواند زمان بازبینی…

روشی جدید در کتابخانه AudioTrace با استفاده از پردازش سیگنال و سنجش زیروبمی صدا، نیاز به مدلهای گیتدار و GPU را برای تفکیک دو گوینده حذف کرده است. این رویکرد دقت را در تماسهای…

اپل شرکت OpenAI را به سرقت سازمانیافته اسناد فنی و طرحهای محرمانه برای توسعه یک دستگاه سختافزاری رقیب متهم کرد. این شکایت مستقیماً مدیران ارشد و کارکنان سابق اپل را هدف قرار…

مدل DeepAnalyze-8B امکان ساخت عاملهای تحلیل داده مستقل را فراهم میکند که قادر به کدنویسی، اجرا و اصلاح خطا در محیط ایزوله هستند. استفاده از کوانتش ۴ بیتی، این گردش کار را حتی بر…

پروژه متنباز Agent OS با معرفی معماری دو-عاملی، برنامهریزی هوش مصنوعی را از اجرای کد جدا میکند. این سیستم بهجای اعتماد به ادعای مدل، هر تسک را تنها پس از موفقیت در 빌د و…

سپیساکس برای استقرار نسل سوم استارلینک با هدف ارتقای ۱۰۰ برابری پهنای باند درخواست مجوز داده است. این شبکه عظیم قرار است سرعتهای چند گیگابیتی را برای میلیاردها دستگاه هوش مصنوعی…