
پروژههای Vibe Coding نمره ۳۱ از ۱۰۰ را در آزمون آمادگی تولید کسب کردند
ابزار Audit Vibe Coding نشان داد اکثر اپلیکیشنهای ساختهشده با هوش مصنوعی در معیارهای امنیتی و سئو شکست میخورند. این سامانه با شناسایی ۴۷ نقص رایج، فاصله میان یک نمونه اولیه…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۷۶۰ مقاله منتشر شده

ابزار Audit Vibe Coding نشان داد اکثر اپلیکیشنهای ساختهشده با هوش مصنوعی در معیارهای امنیتی و سئو شکست میخورند. این سامانه با شناسایی ۴۷ نقص رایج، فاصله میان یک نمونه اولیه…

شرکتهای آنتروپیک، گوگل و متا دسترسی به توکنهای استدلالی را محدود کردند تا این دادهها فقط در مدل سازنده قابل استفاده باشند. این تغییر باعث شکست سیستمهای مسیریابی چندمدلی میشود…

برخی توسعهدهندگان به اشتباه متن چت عاملهای هوش مصنوعی را به جای تغییرات واقعی فایلسیستم میپذیرند. این راهنما چارچوبی برای تطبیق ادعاهای مدل با واقعیت دیسک از طریق ابزارهای git…

تحلیل جامع هزینه مالکیت نشان میدهد میزبانی شخصی مدلهای Llama زمانی بهصرفهتر از APIهای ابری میشود که حجم مصرف ماهانه از ۵۳۴ میلیون توکن فراتر رود. در حالی که APIها برای…

یک API رایگان جدید به عاملهای هوش مصنوعی اجازه میدهد اعتبارنامههای هشت فرمت مختلف را تنها با یک درخواست تأیید کنند. این ابزار شکاف امنیتی خطرناکی را میپوشاند که در آن عاملها…

عاملهای هوش مصنوعی ممکن است در حلقههای تکرار بیپایان گیر کنند و هزینههای عملیاتی را بدون هشدار افزایش دهند. ابزار TokenOps با معرفی بودجهبندی در سطح هر اجرا، این حلقهها را…
تیم Perplexity با معرفی موتور استنتاج Lily، لایههای اضافی PyTorch و MLX را حذف کرد تا مدل Qwen3.6-35B-A3B را مستقیماً روی سختافزار اپل بهینه کند. این رویکرد با ادغام هستهها و…

اوپنایآی مدل GPT-6 Astra را معرفی کرد؛ سیستمی که بهجای چت، مستقیماً نرمافزارها و دسکتاپ را مانند انسان مدیریت میکند. این مدل با پنجره متنی ۱.۰۵ میلیون توکنی، نخستین مدل این…

مطالعهای گسترده روی ۱۶,۸۹۳ جلسه نشان میدهد عاملهای هوش مصنوعی لزوماً «بهترین» ابزار را انتخاب نمیکنند، بلکه به سراغ گزینههایی میروند که با زبان برنامهنویسی یا دادههای…

مخزن کد x-algorithm معماری موتور توصیهگر X را افشا کرده است. این ساختار با جداسازی مرحله تولید کاندیداها از تحویل نهایی، الگویی برای ساخت سامانههای رتبهبندی با توان عملیاتی…

پروتکل زمینهٔ مدل (MCP) در حال تبدیل شدن به یک لایه استاندارد برای اتصال عاملهای هوش مصنوعی به دادهها و ابزارهای خارجی است. این استاندارد در حالی که مشکل مقیاسپذیری ادغامها را…

اوپنایآی مدل GPT-6 Astra را معرفی کرد که قادر به نفوذ خودکار در سامانههای امنیتی و مدیریت کامل رایانه است. گرگ بروکمن مدعی است این مدل اکنون در اکثر کارهای دارای ارزش اقتصادی،…