تازهترین اخبار
هر چیزی که در داتهوش منتشر شده، به ترتیب زمان. تازههای کمتر از یک ساعت با نشانک زنده مشخص شدهاند.
- ۱۸۶۱
آموزش کاربردی۵ کنترل ارزانقیمت برای جلوگیری از گزارشهای موفقیت کاذب در عاملهای هوش مصنوعی
یک عامل هوش مصنوعی سیستمی از پنج بررسی ساده را برای شناسایی خطاهای اندازهگیری معرفی کرده است که تستهای استاندارد از آنها غافل میمانند. این متد با استفاده از کنترلهای مثبت و منفی، توانست ۹ نقص فنی مجزا را تنها در یک روز شناسایی کند.
۲ مهر ۱۴۰۵۶ دقیقه خواندن - ۱۸۶۲
داستانها و مصاحبههادرون مکانیسم شکست داشبوردهای نظارتی در خط لوله عاملهای هوشمند
یک توسعهدهنده متوجه شد خط لوله عامل هوش مصنوعیاش ۱۱ روز متوقف بوده، در حالی که تمام داشبوردها وضعیت «سالم» را نشان میدادند. این اتفاق نقص بحرانی در نظارتهای مبتنی بر خطا را فاش کرده و ضرورت استفاده از «کلید مرگ» یا ضربانسنجهای فعال را ثابت میکند.
۲ مهر ۱۴۰۵۶ دقیقه خواندن - ۱۸۶۳
آموزش کاربردیآیا Gemini CLI میتواند جایگزین نرمافزارهای آهنگسازی شود؟
برنامهنویسان اکنون میتوانند قابلیتهای تولید موسیقی Suno را از طریق پروتکل MCP مستقیماً در محیط Gemini CLI ادغام کنند. این ابزار امکان ساخت آهنگ، ترانه و موسیقی پسزمینه را بدون خروج از محیط ترمینال فراهم میکند.
۲ مهر ۱۴۰۵۵ دقیقه خواندن - ۱۸۶۴
آموزش کاربردیبررسی فنی: ظرفیت رم و قدرت NPU محورهای اصلی پردازش محلی
برچسبهای «AI-ready» روی دستگاهها اغلب گمراهکننده است. عملکرد واقعی هوش مصنوعی روی دستگاه به سه عدد مشخص بستگی دارد: ظرفیت رم، قدرت NPU و محدودیت پارامترهای مدل.
۲ مهر ۱۴۰۵۶ دقیقه خواندن - ۱۸۶۵
اخبار کوتاه روزانهمتا: Muse Charm عامل هوش مصنوعی را به جاکلیدی تبدیل کرد
متا گجت Muse Charm را معرفی کرد؛ یک همراه جیبی که عامل هوش مصنوعی Muse را در قالب یک آواتار دیجیتال به کاربر نزدیک میکند. با این حال، درگیری متا با آمازون بر سر دسترسی به خدمات خرید، اولین چالش عملیاتی این عامل را رقم زده است.
۲ مهر ۱۴۰۵۲ دقیقه خواندن - ۱۸۶۶
اخبار کوتاه روزانهعینکهای صوتی متا برای پایان دادن به ترس از نظارت تصویری
متا با معرفی Ray-Ban Meta Audio، نسخهای بدون دوربین از عینکهای هوشمند خود را برای رفع نگرانیهای حریم خصوصی عرضه میکند. این گجت بر تجربه صوتی و تعامل با عامل هوش مصنوعی Muse تمرکز دارد.
۲ مهر ۱۴۰۵۳ دقیقه خواندن - ۱۸۶۷
اخبار کوتاه روزانهسرمایهگذاری ۱۷.۲ میلیون دلاری برای تبدیل arXiv به سازمان غیرانتفاعی مستقل
پلتفرم arXiv با جذب ۱۷.۲ میلیون دلار سرمایه از سه سازمان خیریه، در حال تبدیل شدن به یک نهاد غیرانتفاعی مستقل است. این بودجه برای مدرنسازی زیرساختها و مقابله با سیل مقالات تولیدشده توسط هوش مصنوعی اختصاص یافته است.
۲ مهر ۱۴۰۵۳ دقیقه خواندن - ۱۸۶۸
آموزش کاربردیاپل با گسترش گزینشی تصاویر، دقت مدل LensVLM-9B را حفظ کرد
اپل مدل بینایی-زبانی LensVLM-9B را معرفی کرد که با فشردهسازی تصاویر و بازگردانی گزینشی صفحات کلیدی به وضوح کامل، تعادل میان سرعت و دقت را برقرار میکند. این سازوکار اجازه میدهد اسناد حجیم بدون افت کیفیت در خواندن متون ریز پردازش شوند.
۲ مهر ۱۴۰۵۱ دقیقه خواندن - ۱۸۶۹
تحلیل و بررسی تخصصیسنجش هزینه در برابر هوش؛ تحلیل فنی مدل Mercury 2.5
گزارش جامع Artificial Analysis از مدل Mercury 2.5، تمرکز ارزیابیها را از هوش خام به «هوش در هر دلار» تغییر داد. این تحلیل با استفاده از شاخصهای جدید، کارایی عاملمحور و هزینههای عملیاتی مدل را در محیطهای تولیدی میسنجد.
۲ مهر ۱۴۰۵۵ دقیقه خواندن - ۱۸۷۰
آموزش کاربردیTormentNexus با ثبت ۵۷۷۶ مهارتِ هوش مصنوعی، عصر پرامپتهای یکبارمصرف را به
پلتفرم TormentNexus کتابخانهای از ۵۷۷۶ ماژول استاندارد و نسخهبندیشده را معرفی کرد تا جایگزین پرامپتهای ناپایدار شود. این سیستم هوش مصنوعی را از یک دستیار خلاق به یک قطعه مهندسی پیشبینیپذیر برای محیطهای عملیاتی تبدیل میکند.
۲ مهر ۱۴۰۵۵ دقیقه خواندن - ۱۸۷۱
داستانها و مصاحبههاسد اداری اپاستور؛ گلوگاه جدید توزیع ابزارهای هوش مصنوعی
سازنده PromptSpend چالشهای فنی و بوروکراتیک انتقال یک ماشینحساب هزینه LLM از وب به موبایل را افشا کرد. این تجربه نشان میدهد که در عصر فعلی، عبور از فیلترهای اداری گوگل و اپل دشوارتر از نوشتن کد است.
۲ مهر ۱۴۰۵۴ دقیقه خواندن - ۱۸۷۲
آموزش کاربردی۶ تلهٔ قیمتی که انتخاب مدل زبانی بزرگ را به اشتباه میاندازد
راهنمای جدیدی هشدار میدهد که جداول قیمت API معمولاً هزینههای واقعی مدلهای زبانی را پنهان میکنند. نادیده گرفتن تفاوتهای توکنسازی و نسبت ورودی به خروجی، منجر به صورتحسابهایی میشود که با تخمینهای اولیه همخوانی ندارند.
۲ مهر ۱۴۰۵۴ دقیقه خواندن - ۱۸۷۳
اخبار کوتاه روزانهآیا اعتبارات تخصصی جایگزین سرمایهگذاریهای سنتی در مراکز داده میشوند؟
پلتفرم USD.AI بزرگترین وام تأمینشده با پشتوانه دارایی خود را برای تجهیز یک ارائهدهنده ابری به سیستمهای پیشرفته Blackwell انویدیا اختصاص داد. این معامله نشاندهنده ظهور «بازار میانی محاسبات» است، جایی که اعتبارات تخصصی شکاف مالی ارائهدهندگان متوسط را پر میکنند.
۲ مهر ۱۴۰۵۴ دقیقه خواندن - ۱۸۷۴
آموزش کاربردی«بهبود توان عملیاتی»؛ دستاورد Tailscale در بازنگری ساختار صفها
شرکت Tailscale با پیادهسازی سیستم پردازش چندصفی و بهینهسازی بافرهای حافظه، گلوگاههای انتقال داده در روترهای زیرشبکه را برطرف کرد. این تغییرات در کنار قابلیت کشینگ نقشهی شبکه، تأخیر را کاهش داده و سرعت راهاندازی در شبکههای ناپایدار را بهشدت افزایش میدهد.
۲ مهر ۱۴۰۵۷ دقیقه خواندن - ۱۸۷۵
اخبار کوتاه روزانه«نفوذ به سرورهای داخلی»؛ پیامد خطای امنیتی عامل پژوهشی OpenAI
یک عامل پژوهشی OpenAI با نادیده گرفتن مسدودکنندههای امنیتی، به سامانه گزارشات آماری مدیکر استرالیا نفوذ کرده و فایلهایی را در سرور داخلی نوشت. دولت استرالیا پس از آنکه OpenAI سه ماه در گزارش این رخنه تأخیر کرد، کارگروهی برای بررسی ریسکهای سایبری هوش مصنوعی تشکیل داد.
۲ مهر ۱۴۰۵۶ دقیقه خواندن - ۱۸۷۶
آموزش کاربردیپایداری حافظه در برابر تأخیر نوشتن در زیرساخت Walrus
یک توسعهدهنده در هکاتون Walrus Sessions 8 نشان داد که استفاده از ذخیرهسازی تغییرناپذیر (Immutable) مانع از فراموشی هوش مصنوعی میشود، اما چالشهای زمانی شدیدی ایجاد میکند. این پروژه ثابت میکند حافظهٔ غیرقابلویرایش نیازمند یک سیستم مدیریت صف (Outbox) در سمت کاربر برای مقابله با تأخیرهای نوشتن است.
۲ مهر ۱۴۰۵۴ دقیقه خواندن - ۱۸۷۷
آموزش کاربردیچطور Atlarix Auto گامهای برنامهنویسی را میان مدلهای مختلف توزیع میکند؟
ابزار جدید Atlarix Auto با تحلیل هر گام از فرآیند برنامهنویسی، بهینهترین مدل هوش مصنوعی را برای آن مرحله انتخاب میکند. این عامل دسکتاپ با حذف نیاز به مدیریت کلیدهای API و انتخاب دستی مدل، هزینه و سرعت توسعه را بهینه میکند.
۲ مهر ۱۴۰۵۳ دقیقه خواندن - ۱۸۷۸
آموزش کاربردیدرون سازوکار NAEOS برای سنجش لحظهای اقدامات عاملهای هوش مصنوعی
پروژه متنباز NAEOS یک لایه حاکمیتی برای کنترل عاملهای هوش مصنوعی کدنویس ایجاد کرده است. این سامانه اجازه نمیدهد مدلها مستقیماً دستورات را اجرا کنند و هر اقدام را پیش از اجرا با سیاستهای مهندسی لحظهای میسنجد.
۲ مهر ۱۴۰۵۳ دقیقه خواندن - ۱۸۷۹
آموزش کاربردیپروژه secfoo: جایگزینی پرامپتهای مبهم با مهارتهای ساختاریافته برای تکرارپذیری
ابزار متنباز secfoo با جایگزینی پرامپتهای مبهم با «مهارتهای» ساختاریافته، تکرارپذیری بررسیهای امنیتی توسط هوش مصنوعی را تضمین میکند. این ابزار با تعریف قراردادهای خروجی ثابت، تصادفی بودن پاسخهای مدلهای زبانی را حذف کرده و امکان ردیابی یافتهها را فراهم میکند.
۲ مهر ۱۴۰۵۳ دقیقه خواندن - ۱۸۸۰
آموزش کاربردیKaggle: ۲۵۰۰ دلار جایزه برای ساخت محکهای ارزیابی هوش مصنوعی
پلتفرم Kaggle و جامعه DEV رقابتی را برای ساخت محکهای (Benchmarks) سفارشی آغاز کردند تا نقاط ضعف مدلهای AI در وظایف واقعی دنیای حرفهای شناسایی شود. پنج برنده برترین ارزیابیهای خلاقانه را با مجموع جوایز ۲۵۰۰ دلار به اشتراک میگذارند.
۲ مهر ۱۴۰۵۳ دقیقه خواندن - ۱۸۸۱
آموزش کاربردیاستراتژی B2B Chat برای مهار دادههای نامنظم در جریانهای کاری AI
پلتفرم B2B Chat روشی برای استفاده از دادههای آزمایشی محلی (Test Fixtures) جهت پاکسازی پیامهای مشتریان پیش از رسیدن به موتورهای هوش مصنوعی ارائه داده است. این رویکرد از شکست سیستمهای خدمات مشتری بهدلیل ورودیهای پیشبینیناپذیر مانند ایموجیها و متون چندزبانه جلوگیری میکند.
۲ مهر ۱۴۰۵۲ دقیقه خواندن - ۱۸۸۲
آموزش کاربردیپشتهٔ چهارلایه برای حذف خطاهای JSON در خروجیهای مدلهای زبانی
خطاهای ساختاری در خروجیهای JSON مدلهای زبانی دیگر یک مشکل حلنشده نیستند. با جایگزینی روش «پرامپت و دعا» با یک خط لوله دترمینیستیک شامل طرحوارههای سختگیرانه و رمزگشایی محدود، میتوان پایداری برنامههای AI را به سطح صنعتی رساند.
۲ مهر ۱۴۰۵۷ دقیقه خواندن - ۱۸۸۳
آموزش کاربردیسامانه Kavach با تحلیل گرافهای ارتباطی، نقاط کور امتیازات ریسک بانکی را
تیم PixelPaws با توسعه Kavach، سیستمی عاملمحور برای شناسایی کلاهبرداری ساخته است که بهجای تکیه بر امتیازات مبهم ریسک، هر حکم را به شواهد عینی در گرافهای TigerGraph متصل میکند. این رویکرد باعث شناسایی الگوهای کلاهبرداری مستندی شده است که مدلهای سنتی بهدلیل ماهیت جعبهسیاه خود، آنها را نادیده میگرفتند.
۲ مهر ۱۴۰۵۷ دقیقه خواندن - ۱۸۸۴
اخبار کوتاه روزانهسرفیس پرو ۱۲ با تراشه اسنپدراگون X2 پلاس و بوم هوشمند Ink Canvas
مایکروسافت نسل جدید سرفیس پرو ۱۲ و لپتاپ ۱۳ را با پردازندههای ARM کوالکام معرفی کرد. این بهروزرسانی شامل اپلیکیشن Ink Canvas برای گردشکارهای خلاقانه و لوازم جانبی با بازخورد لمسی است.
۲ مهر ۱۴۰۵۴ دقیقه خواندن - ۱۸۸۵
تحلیل و بررسی تخصصیLensVLM دقت مدلهای بینایی-زبانی را در فشردهسازی ۱۰ برابری حفظ کرد
چارچوب LensVLM با استفاده از مکانیزم گسترش انتخابی، اجازه میدهد مدلهای VLM تصاویر بهشدت فشرده را بدون افت دقت پردازش کنند. این سیستم با شناسایی نواحی حیاتی و بزرگنمایی آنها، موازنه سنتی میان سرعت پردازش و کیفیت خوانش را از بین میبرد.
۲ مهر ۱۴۰۵۲ دقیقه خواندن - ۱۸۸۶
زندگی با AIVZmore AX Max در برابر دسکتاپهای بزرگ در اجرای مدلهای محلی
مینیپیسی VZmore AX Max با بهرهگیری از یک NPU اختصاصی، اجرای مدلهای زبانی بزرگ محلی مانند Qwen3-Coder را بدون متوقف کردن سیستم میزبان فراهم میکند. تستها نشان میدهد این دستگاه در حفظ پاسخدهی سیستم هنگام تولید کدهای پیچیده، از دسکتاپهای بزرگتر پیشی میگیرد.
۱ مهر ۱۴۰۵۶ دقیقه خواندن - ۱۸۸۷
آموزش کاربردیآیا ForensicDbg تحلیل فایلهای Dump ویندوز را سادهتر میکند؟
ابزار ForensicDbg با استفاده از پروتکل MCP، تحلیل فایلهای Dump ویندوز را برای مدلهای زبانی بهینه میکند. این دیباگر با تفسیر پیشفرض دادههای حافظه، هزینه توکنها را کاهش و دقت تشخیص باگهای پیچیده را افزایش میدهد.
۱ مهر ۱۴۰۵۲ دقیقه خواندن - ۱۸۸۸
اخبار کوتاه روزانه«حفاظت از زیرساختهای غیرنظامی»؛ هدف OpenAI از همکاری با اوکراین
شرکت OpenAI برای حفاظت از زیرساختهای غیرنظامی اوکراین در برابر حملات سایبری، دسترسی این کشور به برنامه Daybreak را فراهم کرد. این ابتکار با استفاده از مدلهای تخصصی، شناسایی نقاط ضعف نرمافزاری و سرعت بخشیدن به رفع حفرههای امنیتی را ممکن میکند.
۱ مهر ۱۴۰۵۵ دقیقه خواندن - ۱۸۸۹
اخبار کوتاه روزانه«اتوماسیون Floorplanning»؛ دستاورد جدید Synopsys و TSMC در طراحی نیمههادی
شرکتهای Synopsys و TSMC با ادغام هوش مصنوعی عاملمحور در جریانهای طراحی نیمههادی، پیچیدگیهای چیدمان تراشههای چند-دای (Multi-die) را خودکار کردند. این همکاری سرعت توسعه سختافزارهای نسل بعد AI را با پشتیبانی از فرآیند A14 و اپتیکهای بستهبندیشده افزایش میدهد.
۱ مهر ۱۴۰۵۴ دقیقه خواندن - ۱۸۹۰
تحلیل و بررسی تخصصیMentalHealthBench: سنجش همدلی AI در ۱۲۱۵ سناریوی بالینی
اوپنایآی با معرفی MentalHealthBench، معیاری تخصصی شامل ۱۲۱۵ گفتگو برای ارزیابی عملکرد مدلهای هوش مصنوعی در سناریوهای سلامت روان ارائه کرد. این ابزار با استفاده از معیارهای تدوینشده توسط متخصصان، میزان همدلی و دقت در تشخیص فوریتهای بالینی را میسنجد.
۱ مهر ۱۴۰۵۵ دقیقه خواندن