پرخوانندهترینها
گزیدهای از خواندنیترین و مهمترین مطالب داتهوش.
- ۱۶۲۱
تحلیل و بررسی تخصصیچگونه LLM4Branch اتوماسیون سیاستهای شاخهبندی را در MILP به سطح SOTA رساند؟
چارچوب LLM4Branch با استفاده از مدلهای زبانی بزرگ، کشف سیاستهای شاخهبندی در برنامهریزی خطی عدد-صحیح (MILP) را خودکار کرده است. این روش با بهینهسازی اسکلتهای برنامهنویسی تولیدشده توسط LLM، رکورد جدیدی را برای متدهای مبتنی بر CPU ثبت کرد.
۲۲ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۲۲
تحلیل و بررسی تخصصیکاهش زمان کالیبراسیون BCI به ۱۰ دقیقه با انتقال دانش EEG در چارچوب CORTEG
پژوهشگران با معرفی چارچوب CORTEG، مدلهای بنیادی EEG پوستی را برای رمزگشایی سیگنالهای درونجمجمهای (ECoG) بهینه کردند. این رویکرد نیاز به دادههای اختصاصی هر بیمار را بهشدت کاهش داده و سرعت کالیبراسیون را به ۱۰ تا ۳۰ دقیقه میرساند.
۲۲ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۲۳
تحلیل و بررسی تخصصیسازوکار HAGE: تبدیل حافظهی ایستا به نقشهی شناختی پویا با یادگیری تقویتشده
چارچوب HAGE جستجوی برداری ایستا در عاملهای هوش مصنوعی را با گرافهای حافظه چندرابطهای و وزنی جایگزین میکند. این سیستم با استفاده از یادگیری تقویتشده برای بهینهسازی وزن یالها، استدلال در افقهای بلند و کارایی بازیابی را بهطور چشمگیری بهبود میبخشد.
۲۲ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۲۴
تحلیل و بررسی تخصصیسازوکار M2A: تزریق استدلال ریاضی به عاملهای هوش مصنوعی بدون آموزش مجدد
رویکرد جدید M2A با ادغام پارامترها در فضای تهی، توانایی استدلال ریاضی را به عاملهای هوش مصنوعی تزریق میکند بدون آنکه نیاز به آموزش مجدد باشد. این متد نرخ حل مسائل SWE-Bench در مدل Qwen3-8B را از ۴۴ به ۵۱.۲ درصد رساند.
۲۲ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۲۵
تحلیل و بررسی تخصصیچگونه «عمق تعهد یادگیرای» مدلهای کوچک را در استدلال از GPT-5.5 پیشتاز کرد؟
یک مدل ۷ میلیارد پارامتری با استفاده از متغیر «عمق تعهد یادگیرای»، در وظایف استدلالی بلندمدت از GPT-5.5 و Claude Sonnet پیشی گرفت. این رویکرد با بهینهسازی زمان بازطراحی برنامهها، توازن میان هزینه محاسباتی و خطاهای اجرایی را اصلاح میکند.
۲۲ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۲۶
اخبار کوتاه روزانهچرا جنرال موتورز به جای آموزش کارکنان، ۶۰۰ نقش IT را حذف کرد؟
جنرال موتورز بیش از ۱۰ درصد از کارکنان IT خود را اخراج کرد تا متخصصان مهندسی مدل و توسعه بومی هوش مصنوعی را جایگزین کند. این اقدام نشاندهنده تغییر استراتژی شرکتهای بزرگ از «استفاده از ابزارهای AI» به «بازسازی کامل نیروی فنی» است.
۲۲ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۲۷
اخبار کوتاه روزانهپشتصحنه چرخش استراتژیک GitLab برای تبدیل شدن به زیرساختِ عاملهای هوش مصنوعی
شرکت GitLab در حال بازسازی کامل زیرساخت و ساختار سازمانی خود است تا از یک ابزار مدیریت کد به محیط اجرای عاملهای هوش مصنوعی تبدیل شود. این تغییر شامل کاهش ۳۰ درصدی حضور جهانی و حذف لایههای مدیریتی برای تسریع تولید نرمافزار ماشینمحور است.
۲۲ اردیبهشت ۱۴۰۵۳ دقیقه خواندن - ۱۶۲۸
اخبار کوتاه روزانهگزارش بایدو: کاهش ۹۴ درصدی هزینه آموزش Ernie 5.1 در مسیر رقابت با GPT-5.5
مدل Ernie 5.1 شرکت بایدو با کاهش ۹۴ درصدی هزینههای پیشآموزش، جایگاه چهارم جهانی را در جدول Arena Search به دست آورد. این مدل با استفاده از یک چارچوب آموزشی الاستیک، توانسته است قابلیتهای استدلالی خود را در سطح مدلهای پیشرو حفظ کند.
۲۱ اردیبهشت ۱۴۰۵۴ دقیقه خواندن - ۱۶۲۹
تحلیل و بررسی تخصصیگزارش Sakana AI و NVIDIA: افزایش ۲۱.۹ درصدی سرعت آموزش LLM با فرمت داده TwELL
پژوهشگران Sakana AI و NVIDIA با معرفی TwELL، فرمت دادهای جدید و کرنل CUDA بهینه، سرعت آموزش مدلهای زبانی را ۲۱.۹ درصد افزایش دادند. این سیستم بدون کاهش دقت مدل، بهرهوری لایههای پیشخور را در آموزش و استنتاج با حجم بالا بهینه میکند.
۲۱ اردیبهشت ۱۴۰۵۳ دقیقه خواندن - ۱۶۳۰
داستانها و مصاحبههاگزارش curl: مدل Mythos تنها یک آسیبپذیری کماهمیت در ۱۷۸ هزار خط کد یافت
مدل Mythos شرکت Anthropic که با ادعای «قدرت خطرناک» در شناسایی حفرههای امنیتی معرفی شده بود، در آزمون واقعی روی کد curl شکست خورد. این مدل تنها یک آسیبپذیری جزئی یافت که عملکرد آن را با ابزارهای امنیتی قدیمی یکسان کرد.
۲۱ اردیبهشت ۱۴۰۵۳ دقیقه خواندن - ۱۶۳۱
آموزش کاربردیچگونه ترکیب کد قطعی و مدل زبانی، تحلیل امکانسنجی CNC را به ۴۰ ثانیه رساند؟
سیستم MachinaCheck با استفاده از مدلهای محلی، تحلیل فایلهای CAD برای تولید CNC را از ۲۰ ساعت در هفته به ۴۰ ثانیه کاهش داده است. این راهکار با اجرای مدل Qwen روی سختافزار AMD، امنیت دادههای حساس مهندسی را تضمین میکند.
۲۰ اردیبهشت ۱۴۰۵۳ دقیقه خواندن - ۱۶۳۲
اخبار کوتاه روزانهپالو آلتو نتورکس: یک سال تست نفوذ دستی در ۳ هفته با هوش مصنوعی
گزارشها نشان میدهد مدلهای پیشرو مانند Claude Mythos اکنون قادرند عملیات پیچیده تست نفوذ یکساله را در ۲۱ روز به پایان برسانند. این تحول، هوش مصنوعی را از یک دستیار ساده به یک عامل خودکار تبدیل کرده که میتواند حملات سایبری را در دقایقی اجرا کند.
۲۰ اردیبهشت ۱۴۰۵۳ دقیقه خواندن - ۱۶۳۳
آموزش کاربردیتوقف توهمات در محیط تولید؛ ابزارهای جدید پایتون برای تضمین ساختار خروجی LLM
مجموعهای از سه ابزار جدید پایتون برای تبدیل تستهای ذهنی و انسانی در خط لولههای هوش مصنوعی به قراردادهای سختگیرانه و خودکار معرفی شدند. این استک با شناسایی زودهنگام خطاهای ساختاری، از ورود خروجیهای معیوب به محیط عملیاتی جلوگیری میکند.
۱۹ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۳۴
آموزش کاربردیرمزگشایی از Spec-Kit: گیتهاب چگونه کدنویسی را از حدسزنی به مهندسی دقیق میبرد؟
گیتهاب با معرفی Spec-Kit، رویکرد «توسعه مبتنی بر مشخصات» (SDD) را جایگزین پرامپتهای پراکنده میکند. این ابزار با تبدیل مستندات محصول به منبع واحد حقیقت، مانع از حدسزنی عاملهای هوش مصنوعی در پیادهسازی کد میشود.
۱۹ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۳۵
آموزش کاربردیچرا سرورهای مرکزی، بزرگترین مانع رشد ارتشهای هوش مصنوعی شما هستند؟
پروتکل Pilot با معرفی معماری همتابههمتا، نیاز به سرور مرکزی برای ارتباط عاملهای هوش مصنوعی را از بین میبرد. این تغییر، گلوگاههای مقیاسپذیری و نقاط شکست تکنقطهای را در استقرار ارتشهای بزرگ عامل حذف میکند.
۱۹ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۳۶
اخبار کوتاه روزانهپایان سلطهی ابر؛ چرا Anthropic برای Claude Code به SpaceX تکیه کرد؟
شرکت Anthropic با تکیه بر زیرساختهای پردازشی SpaceX، سرعت و ظرفیت Claude Code را دو برابر کرد. این چرخش استراتژیک در حالی رخ میدهد که غولهای سنتی ابری تحت فشار هزینههای انرژی هستند و OpenAI با بحران مدیریتی دستوپنجه نرم میکند.
۱۸ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۳۷
اخبار کوتاه روزانهچرا حذف نمایشگر در Fitbit Air هوشمندانهترین حرکت تجاری گوگل است
گوگل با معرفی Fitbit Air، نمایشگر را از مچ دست حذف کرد تا تمرکز را از اعداد خام به کوچینگ هوشمند منتقل کند. این گجت ۱۰۰ دلاری در واقع درگاه ورود کاربران به اکوسیستم اشتراکی Google Health است.
۱۸ اردیبهشت ۱۴۰۵۳ دقیقه خواندن - ۱۶۳۸
تحلیل و بررسی تخصصیچرا اعتماد به «اصلاحشده» بودن مدلهای زبانی یک اشتباه است
پژوهشگران ابزاری برای شناسایی تغییرات رفتاری پنهان در مدلهای زبانی پس از مداخلات فنی ساختهاند. این سیستم میتواند اثرات جانبی پیشبینینشده در فرآیندهای تقطیر و ویرایش دانش را بدون توهم شناسایی کند.
۱۸ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۳۹
تحلیل و بررسی تخصصیدادههای جدید Arxiv: مدل DART دقت بازرسی کابلها را ۳۸٪ جهش داد
مدل DART با ترکیب بینایی و زبان، بازرسی کابلهای صنعتی را خودکار کرده و دقت تشخیص آسیب را به شکل چشمگیری افزایش داده است. این سیستم بدون نیاز به تنظیم دقیق، شدت آسیب را تخمین زده و توصیههای تعمیراتی ارائه میدهد.
۱۸ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۴۰
تحلیل و بررسی تخصصی۷ عامل پنهانی که استنتاج علیتی در شبکههای ژنی را مختل میکنند
پژوهشگران ۷ «پاتولوژی» یا نقص دادهای را شناسایی کردند که مزایای روشهای علیتی در نقشهبرداری ژنی را خنثی میکند. این مطالعه با ۶,۱۲۰ آزمایش ثابت کرد که مدلهای علیتی در محیطهای پاک برنده هستند، اما در مواجهه با نویزهای واقعی شکست میخورند.
۱۸ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۴۱
تحلیل و بررسی تخصصیآیا اتحاد GPT، Gemini و Llama میتواند نمرهدهی دانشگاهی را نجات دهد؟
سیستم AICoFe با ترکیب سه مدل زبانی پیشرو، بازخوردهای پراکنده دانشجویان را به نقدهای ساختاریافته و کاربردی تبدیل میکند. این رویکرد چندمدلی، ناهماهنگیهای مزمن در ارزیابیهای دانشگاهی را هدف قرار داده است.
۱۸ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۴۲
تحلیل و بررسی تخصصیروشی که خاطرات بصری شما را از اسکن مغزی استخراج میکند
پژوهشگران چارچوب MB2L را برای همراستاسازی سیگنالهای EEG با تصاویر دیجیتال توسعه دادهاند. این سیستم با تقلید از پردازشهای قشر مغز، دقت خیرهکنندهای در بازیابی تصاویر بدون آموزش قبلی (Zero-shot) به دست آورده است.
۱۸ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۴۳
تحلیل و بررسی تخصصیروشی که خطاهای تکراری مدلهای تشخیص اشیاء را برای همیشه پاک میکند
چارچوب EBOD با ادغام SAM3 و DINOv3، خطاهای تکراری در تشخیص اشیاء را بدون نیاز به آموزش مجدد مدل حذف میکند. این رویکرد هزینههای محاسباتی سنگین را کنار گذاشته و یادگیری از اشتباهات قبلی را ممکن میسازد.
۱۷ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۴۴
تحلیل و بررسی تخصصیپایان عصر شباهتسنجی؛ چگونه VACAI-Bowl درک زبانهای نادر را متحول کرد؟
پژوهشگران با معرفی چارچوب VACAI-Bowl، دقت تجزیه وابستگی در زبانهای کممنبع را بیش از ۵۴ درصد افزایش دادند. این سیستم به جای جستجوی شباهتها، از تفاوتهای زبانی برای بهبود یادگیری مدل استفاده میکند.
۱۷ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۴۵
تحلیل و بررسی تخصصیچگونه یک مدل ۱۴ میلیارد پارامتری، GPT-5 را در تست نفوذ شکست داد؟
چارچوب جدید Pen-Strategist با ترکیب مدل استدلالی و طبقهبندیکننده CNN، توانست در اجرای استراتژیهای تست نفوذ، عملکرد GPT-5 و Claude-4.6 را به شدت پشت سر بگذارد. این دستاورد نشان میدهد مدلهای تخصصی کوچک میتوانند در حوزههای حساس امنیتی، مدلهای غولآسای عمومی را شکست دهند.
۱۷ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۴۶
تحلیل و بررسی تخصصیچرا پنجرههای بافت بزرگتر راه نجات عاملهای هوش مصنوعی نیستند؟
پژوهشگران با معرفی LongSeeker، پارادایم جدیدی برای مدیریت حافظه در عاملهای جستجو ایجاد کردهاند. این مدل با حذف دادههای زائد، دقت جستجوهای پیچیده را به ۶۲.۵٪ رسانده و رقبای قدرتمندی چون Tongyi DeepResearch را شکست داده است.
۱۷ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۴۷
تحلیل و بررسی تخصصیپایان عصر دادههای برچسبدار؛ چگونه SensingAgents ابهام حسگرها را میزداید
پژوهشگران با معرفی SensingAgents، چارچوبی عاملمحور ایجاد کردهاند که تشخیص فعالیتهای انسانی را از طریق شبیهسازی بحثهای استدلالی بهبود میبخشد. این سیستم در حالت Zero-shot، دقتی بهمراتب بالاتر از مدلهای سنتی یادگیری عمیق به دست آورده است.
۱۷ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۴۸
آموزش کاربردیچرا مهارت کدنویسی شما در برابر گوگل Antigravity منسوخ خواهد شد؟
گوگل با معرفی Antigravity، نقش برنامهنویس را از نویسنده کد به مدیر تیمهای هوش مصنوعی تغییر میدهد. در حالی که VSCode همچنان پادشاه دقت است، این ابزار جدید سرعت توسعه را با مدیریت موازی عاملها متحول میکند.
۱۷ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۴۹
اخبار کوتاه روزانهدرون Terafab؛ نقشه جسورانه اسپیساکس برای تسلط بر سختافزار AI
اسپیساکس در حال برنامهریزی برای ساخت یک مرکز عظیم تولید تراشه به نام Terafab در تگزاس است. این پروژه ۱۱۹ میلیارد دلاری قصد دارد گلوگاههای محاسباتی را برای xAI، تسلا و مراکز داده فضای تبدیل به مزیت رقابتی کند.
۱۷ اردیبهشت ۱۴۰۵۲ دقیقه خواندن - ۱۶۵۰
آموزش کاربردیرمزگشایی از گذار خطرناک برنامهنویسان به عصر «کدنویسی حسی»
مرز بین کدنویسی آماتور و مهندسی حرفهای در حال محو شدن است. متخصصان اکنون بازبینی خطبهخط کدها را رها کرده و تمرکز خود را از پیادهسازی به طراحی و تأیید صحت منتقل میکنند.
۱۶ اردیبهشت ۱۴۰۵۳ دقیقه خواندن