
تحلیل هزینهها: کاهش ۹۸ درصدی بودجهٔ پشتیبانی با DeepSeek V4 Flash
تحلیل جدید هزینهها نشان میدهد استفاده از مدلهای اقتصادی مانند DeepSeek V4 Flash میتواند صورتحساب ماهانه پشتیبانی مشتری را از ۴۲۰۰ دلار به تنها ۵۲ دلار کاهش دهد. این استراتژی…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۰۰ مقاله منتشر شده

تحلیل جدید هزینهها نشان میدهد استفاده از مدلهای اقتصادی مانند DeepSeek V4 Flash میتواند صورتحساب ماهانه پشتیبانی مشتری را از ۴۲۰۰ دلار به تنها ۵۲ دلار کاهش دهد. این استراتژی…

سازمان مدیریت دره تنسی (TVA) تعرفه جدیدی را برای مراکز داده هوش مصنوعی وضع کرد تا مانع از افزایش قبض برق کاربران خانگی شود. این طرح شامل سرمایهگذاری ۱۳ میلیارد دلاری برای افزودن…

عاملهای کدنویس برای جلوگیری از تداخل در تغییرات (Merge Conflicts)، معماری نرمافزار را به سمت تکهتکه شدن یا مودولار بودن سوق میدهند. با الگوبرداری از رویکرد میکروسرویسهای…

پژوهشگران امنیتی با استفاده از تکنیکی به نام «متا-هکینگ»، حفرهای را در Copilot Personal یافتند که اجازه میداد دادههای Gmail و گوگل درایو کاربران تنها با یک کلیک سرقت شود. این…

تیمهای مالی در حال گذار از مدلهای غولپیکر به معماریهای ترکیبی هستند که در آن مدلهای کوچکِ تنظیمشده برای حجم بالا و مدلهای پیشرو برای تصمیمگیریهای پیچیده به کار میروند.…

شرکت Superwhisper مدل S1-mini را منتشر کرد؛ یک مدل زبانی کوچک با وزنهای باز که تپقها و کلمات پرکننده را از متنهای تبدیلشده از صوت حذف میکند. این مدل بهگونهای بهینه شده که…

پژوهشی جدید نشان میدهد که تحلیل ضریب «انفجاری بودن» و «حافظه» در رویدادهای اسکرول، میتواند تفاوت انسان و عاملهای هوش مصنوعی را برملا کند. در حالی که رباتهای پیشرفته مرورگرها…

کشف دو حفره امنیتی در Semantic Kernel مایکروسافت نشان میدهد که تزریق پرامپت تنها نقطه آغازین یک زنجیره حمله است. تیمهای امنیتی باید به جای اعتماد به مدل، هر ورودی ابزار را به…

مدل جدید علیبابا، Qwen3.8-27B، تعادلی میان اندازه و قدرت ایجاد کرده است که اجازه میدهد یک میلیون توکن در یک GPU ردهبالا جای بگیرد. این مدل در استخراج دادههای ساختیافته و…

شرکت Anthropic با بحرانی جدی در پایداری زیرساختهای خود مواجه شده است. اختلالات گسترده در API و ابزارهای عاملمحور این شرکت در بازه زمانی ۱۳ تا ۲۰ اوت، وابستگی سازمانها به یک…

الگوهای معماری جدید اجازه میدهند نرمافزارهای کلاسیک، وظایف با زمان اجرای نمایی را به واحدهای پردازش کوانتومی (QPU) بسپارند. این رویکرد ترکیبی، بهرهبرداری از سختافزارهای…

انویدیا تأیید کرد که OpenAI از سیستم GB200 NVL72 برای آموزش و استنتاج مدلهای پیشرو استفاده میکند. این تغییر نشاندهنده گذار از تمرکز بر تعداد GPUها به سمت زیرساختهای یکپارچه در…