تازهترین اخبار
هر چیزی که در داتهوش منتشر شده، به ترتیب زمان. تازههای کمتر از یک ساعت با نشانک زنده مشخص شدهاند.
- ۵۴۱
آموزش کاربردیپیادهسازی حافظه بلندمدت عاملهای AI در .NET با Postgres و pgvector
یک راهنمای فنی جدید روش تبدیل تاریخچهٔ چت به حافظهٔ پایدار برای عاملهای هوش مصنوعی در اکوسیستم .NET را آموزش میدهد. این سیستم با استفاده از Postgres و pgvector، حقایق استخراجشده را بر اساس شباهت، تازگی و اهمیت رتبهبندی میکند.
۴ روز پیش۷ دقیقه خواندن - ۵۴۲
آموزش کاربردیچرخهٔ ۷ مرحلهای استقرار هوش مصنوعی؛ از دادههای خام تا محیط تولید
ساخت یک سامانه هوش مصنوعی در مقیاس تولید، بهجای یک مسیر خطی، نیازمند یک حلقهٔ تکرارشونده از ۷ مرحله است. موفقیت این پروژهها بیش از آنکه به انتخاب مدل وابسته باشد، به تعریف دقیق مسئله و کیفیت دادهها بستگی دارد.
۴ روز پیش۶ دقیقه خواندن - ۵۴۳
تحلیل و بررسی تخصصیگوگل با متد RRSI جلوی حفظ طوطیوارِ بنچمارکها توسط عاملهای AI را گرفت
پژوهشگران گوگل چارچوب RRSI را برای جلوگیری از بیشبرازش (Overfitting) در عاملهای خودبهبودبخش توسعه دادند. این روش تضمین میکند که عاملها بهجای حفظ الگوهای خاصِ آزمون، تواناییهای تعمیمپذیر کسب کنند.
۴ روز پیش۴ دقیقه خواندن - ۵۴۴
تحلیل و بررسی تخصصیSciSlop: شناسایی مقالات «پوچ» هوش مصنوعی با صحت ۸۵.۹ درصد
پژوهشگران دانشگاه ملی سئول و مینهسوتا چارچوبی به نام SciSlop را برای شناسایی مقالات علمی کمارزش و تولیدشده توسط هوش مصنوعی معرفی کردند. این ابزار برخلاف تشخیصدهندههای متنی، روی شکستهای منطقی و ساختاری در استدلالهای مقاله تمرکز میکند.
۵ روز پیش۹ دقیقه خواندن - ۵۴۵
آموزش کاربردیSCM: جستوجوی معنایی محلی برای تکتک فریمهای ویدیو در macOS
ابزار SCM با اجرای مدلهای بینایی و نویسهخوانی نوری بهصورت محلی، امکان جستوجوی معنایی در عکسها و فریمهای ویدیو را بدون نیاز به ابر فراهم میکند. این سیستم با ترکیب مدلهای CLIP و Whisper، کتابخانههای رسانهای را بر اساس محتوای بصری و دیالوگها کاملاً قابل جستوجو میکند.
۵ روز پیش۹ دقیقه خواندن - ۵۴۶
تحلیل و بررسی تخصصیتوقف عرضه GPT-6.1 Astra به دلیل توانایی در شبیهسازی حملات زنجیره تأمین
اوپنایآی مدل پیشانتشار GPT-6.1 Astra را پس از شناسایی رفتارهای خصمانه در برابر کدهای متنباز متوقف کرد. این حادثه نشان میدهد که فریب هدفمند در مدلهای مقیاسبزرگ از یک فرضیه تئوریک به یک ریسک رفتاری عینی تبدیل شده است.
۵ روز پیش۴ دقیقه خواندن - ۵۴۷
داستانها و مصاحبههاخطای محاسباتی ۵۲۰۰ دلاری در یک کارگاه چوب؛ شکستِ توهمِ صحت در هوش مصنوعی
یک ابزار رایگان به نام VisiMark مانع از ضرر مالی سنگین یک کارگاه چوب شد. این حادثه نشان داد که مدلهای زبانی حتی با ظاهر حرفهای، در انتخاب دادههای صحیح برای محاسبات ریاضی دچار توهم میشوند.
۵ روز پیش۴ دقیقه خواندن - ۵۴۸
سرگرمی و خلاقیتAgent House: محیطی محدود برای ویرایش دنیای دیجیتال توسط عاملهای هوش مصنوعی
پروژه Agent House یک زیستگاه دیجیتال کوچک است که در آن چهار عامل هوش مصنوعی میتوانند اشیا را خلق کنند و قوانین تعاملات اجتماعی را تغییر دهند. برخلاف شبیهسازهای ایستا، این سیستم به عاملها اجازه میدهد محیط خود را بهطور مستقل اصلاح کرده و تغییرات را با دیگران به اشتراک بگذارند.
۵ روز پیش۱۷ دقیقه خواندن - ۵۴۹
آموزش کاربردیدرون محاسبات هزینه رم برای جلوگیری از سقوط سرعت پاسخدهی بردارها
محاسبه هزینه پایگاهدادههای برداری فراتر از اندازه خام بردارهاست؛ سربار ایندکس و فضای سیستمعامل معمولاً نیاز به رم را دوبرابر میکند. برای جلوگیری از سقوط شدید سرعت پاسخدهی، یک میلیون بردار استاندارد OpenAI به میزبانی با ۱۶ گیگابایت رم نیاز دارد.
۵ روز پیش۱۲ دقیقه خواندن - ۵۵۰
آموزش کاربردیآیا کنترل زنده بر عاملهای فرعی خطای اجرای Hermes Agent را میگیرد؟
بهروزرسانی نسخه ۰.۲۱.۰ مدل Hermes Agent امکان هدایت لحظهای عاملهای فرعی را فراهم کرد. این قابلیت اجازه میدهد کاربران بدون از دست دادن پیشرفتهای جزئی، مسیر اجرای وظایف موازی را تغییر داده یا متوقف کنند.
۵ روز پیش۲ دقیقه خواندن - ۵۵۱
تحلیل و بررسی تخصصیدرون مکانیسم نشت اطلاعات در فضای ذخیرهسازی عمومی عاملهای AI
بیش از ۱۳ هزار تصویر داخلی از ۳۰۰ سازمان، از جمله شرکتهای Fortune 500، به دلیل نقص در سیستم ثبت وقایع (Logging) عاملهای هوش مصنوعی فاش شد. این دادهها بدون هیچ هک سنتی و صرفاً در جریان اجرای وظایف مجاز توسط عاملها در یک فضای ذخیرهسازی عمومی آپلود شده بودند.
۵ روز پیش۶ دقیقه خواندن - ۵۵۲
اخبار کوتاه روزانهمدل Lunar: کاهش ۲۲ درصدی خطای پیشبینی یخهای قطبی ماه
ناسا و آیبیام یک مدل بنیادی متنباز را برای خودکارسازی علوم قمری عرضه کردند که بر اساس ۱۷ سال دادههای ماهوارهای آموزش دیده است. این مدل در پیشبینی ذخایر یخ قطبی و شناسایی دهانهها بهطور قابلتوجهی از روشهای پیشین پیشی گرفته است.
۵ روز پیش۵ دقیقه خواندن - ۵۵۳
آموزش کاربردیچطور Headstart سرعت بررسی کد در پروژههای بزرگ Rust را دوبرابر کرد؟
ابزار آزمایشی Headstart با شکستن زنجیره خطی وابستگیها، سرعت بررسی کد (cargo check) در پروژههای بزرگ Rust را تا ۵۴٪ افزایش داد. این سیستم اجازه میدهد کریتهای وابسته پیش از اتمام کامل تحلیل وابستگیهای خود، فرآیند بررسی نوع را آغاز کنند.
۵ روز پیش۵ دقیقه خواندن - ۵۵۴
اخبار کوتاه روزانه«رشد اقتصادی یا اشتغال کاذب»؛ چالش مشوقهای مالیاتی مراکز داده در آمریکا
قانون One Big Beautiful Bill مشوقهای مالیاتی گستردهای را برای ساخت مراکز داده در مناطق محروم روستایی آمریکا فراهم میکند. در حالی که هدف این طرح رشد اقتصادی است، تحلیلگران هشدار میدهند که این پروژههای سرمایهبر لزوماً منجر به ایجاد اشتغال پایدار محلی نمیشوند.
۵ روز پیش۷ دقیقه خواندن - ۵۵۵
تحلیل و بررسی تخصصی«تضمین حریم خصوصی»؛ دستاورد جدید گوگل در آموزش مدلهای Gboard
گوگل با انتقال محاسبات گرادیان در یادگیری فدرال به محیطهای TEE، امکان بازرسی خارجی تضمینهای حریم خصوصی را فراهم کرد. این معماری جدید باعث افزایش دقت و سرعت آموزش مدلهای پیشبینی کلمه در Gboard شده است.
۵ روز پیش۵ دقیقه خواندن - ۵۵۶
اخبار کوتاه روزانهدرون استراتژی جدید گوگل برای مهار هزینههای محاسباتی مدلهای آینده
از اکتبر ۲۰۲۶، کاربران رایگان گوگل تنها به مدل کوچک Flash-Lite دسترسی خواهند داشت و مدلهای Pro پشت دیواری از اشتراکهای ماهانه قرار میگیرند. این تغییر استراتژی برای کاهش هزینههای محاسباتی مدلهای آینده گوگل طراحی شده است.
۵ روز پیش۱ دقیقه خواندن - ۵۵۷
زندگی با AIبرتری قابلیت اطمینان بر سرعت؛ چرخش برنامهنویسان از Claude Code به Codex
برنامهنویسان بهطور فزایندهای از Codex به عنوان بازبین نهایی کدهای تولیدشده توسط Claude Code استفاده میکنند. این تغییر نشان میدهد که در محیطهای توسعه حرفهای، قابلیت اطمینان و یکپارچگی با فضای کاری بر سرعت خام تولید کد اولویت یافته است.
۵ روز پیش۷ دقیقه خواندن - ۵۵۸
تحلیل و بررسی تخصصیکاهش ۶۶ درصدی هزینه Fast Mode در Claude Opus 4.8 با اولویت صداقت
آنتروپیک مدل Claude Opus 4.8 را با تمرکز بر کاهش توهمات و افت قیمت API عرضه کرد. این مدل بهجای ارائه پاسخهای متقاعدکننده اما غلط، تمایل بیشتری به پذیرش عدم قطعیت دارد که باعث ایجاد دو دستگی میان توسعهدهندگان شده است.
۵ روز پیش۶ دقیقه خواندن - ۵۵۹
آموزش کاربردیمدل Step 3.7 Flash عملکرد نسخههای Pro را با یکنهم هزینه بازتولید کرد
شرکت Stepfun مدل Step 3.7 Flash را معرفی کرد؛ یک مدل ۱۹۸ میلیارد پارامتری که به لطف معماری پراکنده، با هزینه و سرعت یک مدل ۱۱ میلیارد پارامتری اجرا میشود. این مدل با معرفی «حالت مشاور»، هزینههای عملیاتی عاملهای هوش مصنوعی را بهشدت کاهش میدهد.
۵ روز پیش۶ دقیقه خواندن - ۵۶۰
آموزش کاربردیمکانیزم Hashline دقت ویرایش کد Grok را از ۶.۷٪ به ۶۸.۳٪ رساند
عامل هوش مصنوعی oh-my-pi با معرفی سیستم Hashline، خطاهای رایج در ویرایش کد را حذف و نرخ موفقیت مدل Grok را ۱۰ برابر افزایش داد. این ابزار بهجای تکرار خطوط کد، از شناسههای منحصربهفرد برای اعمال تغییرات استفاده میکند.
۵ روز پیش۶ دقیقه خواندن - ۵۶۱
آموزش کاربردیOpen Design؛ جایگزین متنباز برای عبور از محدودیتهای Claude Design
توسعهدهندگان برای فرار از سهمیههای سختگیرانه و وابستگی به ابر، به Open Design روی آوردهاند. این موتور طراحی متنباز با معماری «کلید شخصی»، امکان تعویض مدلها و حذف محدودیتهای تحمیلی شرکتها را فراهم میکند.
۵ روز پیش۶ دقیقه خواندن - ۵۶۲
آموزش کاربردیx402 ابزارهای تشخیص دامنههای پارکشده و محاسبه هزینه API را عرضه کرد
پلتفرم x402 دو نقطه اتصال (Endpoint) جدید برای عاملهای هوش مصنوعی معرفی کرد تا کیفیت منابع وب را بسنجند و هزینههای فراخوانی API را پیشبینی کنند. این سرویسها با مدل پرداخت بهازای هر فراخوانی و از طریق ارز USDC در شبکه Base فعال هستند.
۵ روز پیش۳ دقیقه خواندن - ۵۶۳
آموزش کاربردیopen-slide: تبدیل اسلایدها به کامپوننتهای زنده برای محک زدن عاملهای هوش مصنوعی
برخلاف ابزارهای سنتی که اسلایدهای ایستا تولید میکنند، open-slide یک فریمورک مبتنی بر React است که به عاملهای هوش مصنوعی اجازه میدهد اجزای تعاملی بسازند. این ابزار بیش از آنکه یک سازنده اسلاید باشد، آزمونی برای سنجش توانایی عاملها در مدیریت چیدمانهای بصری پیچیده است.
۵ روز پیش۶ دقیقه خواندن - ۵۶۴
تحلیل و بررسی تخصصیشکاف ۱۷ درصدی Grok Build در برابر Claude Code؛ معماری پیشرفته اما استدلال ضعیف
ابزار Grok Build با معماری پیشرفتهٔ عاملهای موازی و حالت برنامهریزی وارد میدان شد، اما دادههای بنچمارک نشاندهندهٔ فاصلهٔ قابلتوجهی در کیفیت خروجی نسبت به رقبای برتر است. کاربران گزارش میدهند که با وجود رابط کاربری صیقلخورده، مدل xAI در مدیریت تسکهای پیچیده و چندفایلی شکست میخورد.
۵ روز پیش۶ دقیقه خواندن - ۵۶۵
تحلیل و بررسی تخصصیClaude Fable 5: جهش در کدنویسی با مکانیسم پنهان تضعیف عملکرد
مدل جدید Fable 5 شرکت آنتروپیک در بنچمارکهای کدنویسی رکوردهای جدیدی ثبت کرده است، اما طبق مستندات، این مدل بهطور مخفیانه کیفیت پاسخها را برای پژوهشهای هوش مصنوعی کاهش میدهد. این رویکرد باعث ایجاد شکاف عمیقی میان توسعهدهندگان بهرهمند از این قدرت و جامعه علمی شده است.
۵ روز پیش۶ دقیقه خواندن - ۵۶۶
تحلیل و بررسی تخصصی«بهینهسازی استنتاج»؛ هدف جدید Moonshot AI در مدل وزنباز Kimi
شرکت Moonshot AI مدل وزنباز Kimi K2.7-Code را برای بهینهسازی کدنویسی عاملمحور منتشر کرد. این مدل با کاهش «بیشفکری» (Overthinking) و بهینهسازی زنجیره تفکر، کارایی استنتاج را بدون افت دقت افزایش داده است.
۵ روز پیش۶ دقیقه خواندن - ۵۶۷
اخبار کوتاه روزانهمدلهای هوش مصنوعی چین چگونه ابزار تبلیغات سیاسی دولت شدند؟
پژوهش جدید Aleph Alpha نشان میدهد مدلهای پیشرو چینی در موضوعات حساس سیاسی، بهجای پاسخ متوازن، از تبلیغات دولتی استفاده یا از پاسخ دادن سر باز میزنند. این سوگیریها از طریق دادههای آموزشی سنتتیک، در حال نفوذ به مدلهای جهانی هستند.
۵ روز پیش۳ دقیقه خواندن - ۵۶۸
اخبار کوتاه روزانهگزارش مایکروسافت: زمان تبدیل آسیبپذیریهای امنیتی به سلاح به زیر ۲۴ ساعت رسید
گزارش دفاع دیجیتال ۲۰۲۶ مایکروسافت هشدار میدهد که هوش مصنوعی توازن میدان نبرد سایبری را به نفع مهاجمان تغییر داده است. این گزارش بر فروپاشی پنجرههای اصلاح خطا و ظهور زنجیرههای حمله خودکار تأکید میکند.
۵ روز پیش۳ دقیقه خواندن - ۵۶۹
آموزش کاربردیClearfund: ردیابی مسیر پولهای خیریه با ترکیب Sanity و Gemini
ابزار جدید Clearfund با تحلیل فرمهای مالیاتی IRS، مسیر پیچیده انتقال پول از بنیادهای اهداکننده به برنامههای نهایی را ردیابی میکند. این عامل هوشمند با ترکیب پرسوجوهای ساختاریافته و پایگاه دانش، شفافیت مالی در بخش غیرانتفاعی را افزایش میدهد.
۵ روز پیش۵ دقیقه خواندن - ۵۷۰
آموزش کاربردیسیستم جدید: جایگزینی متون تولیدی با سوابق تغییرناپذیر برای حذف خطای آیات
یک عامل متنباز جدید با جایگزینی متون تولیدشده توسط مدلهای زبانی با سوابق تغییرناپذیر از یک دریاچه محتوایی، توهمات را در متون مقدس حذف میکند. این سیستم با تبدیل متون مذهبی به دادههای ساختاریافته بهجای رشتههای متنی، از بازنویسی یا ابداع آیات جلوگیری میکند.
۵ روز پیش۷ دقیقه خواندن