
درون بازرسیهای خودکار OpenAI برای اصلاح عدمهمسویی مدلهای نسل بعد
شرکت OpenAI آموزش مدلهای نسل بعد خود را برای دو هفته متوقف کرد تا نقصهای امنیتی و رفتارهای غیرقابلپیشبینی را برطرف کند. این شرکت اکنون از بازرسان خودکار برای نظارت لحظهای بر…
دستهبندی
تحلیلهای عمیق مدلها، مقالات و بنچمارکها — پیشچاپها، ارزیابیها، مدلهای زبانی پیشرو و پژوهش همراستاسازی.
۵٬۸۰۵ مقاله منتشر شده

شرکت OpenAI آموزش مدلهای نسل بعد خود را برای دو هفته متوقف کرد تا نقصهای امنیتی و رفتارهای غیرقابلپیشبینی را برطرف کند. این شرکت اکنون از بازرسان خودکار برای نظارت لحظهای بر…

پژوهشگران یک حفره امنیتی شدید در Claude Code برای macOS کشف کردند که اجرای دستورات خارج از محیط ایزوله را ممکن میکند. این نقص ناشی از تفسیر اشتباه نام پوشههای حاوی علامت ستاره…

تحلیلی جدید نشان میدهد تکنیک «کالیبراسیون زمینهای» میتواند نوسانات دقت ناشی از ترتیب قرارگیری مثالها در پرامپتهای چندنمونهای را بهطور کامل از بین ببرد. با این حال،…

بسیاری از سامانههای چندعاملی در محیط عملیاتی بهدلیل ضعف در لایهی هماهنگکننده شکست میخورند. AgentForge با معرفی پروتکلهای ساختاریافته و مکانیزمهای حفاظتی، تلاش میکند تا…

یک چارچوب جدید پیشنهاد میکند که بهجای تکیه بر «ابر-عاملهای» خودمختار، هوش مصنوعی را به صورت یک سازمان لایهبندیشده با سلسلهمراتب صریح و پاسخگویی انسانی مدیریت کنیم. این…

برخلاف نرمافزارهای سنتی، هر توکن تولیدشده در هوش مصنوعی هزینهٔ واقعی سختافزاری دارد. این واقعیت اقتصادی باعث میشود هر طرح رایگان، در واقع یک سوبسید موقت یا محدودیت سختگیرانه…

تحلیل ۱۵ روزه لاگهای سرور نشان میدهد که زیرساختهای سنتی سئو بسیار مؤثرتر از نقاط دسترسی اختصاصی AI هستند. در حالی که GPTBot کل سایت را اسکن میکند، ClaudeBot تقریباً بهطور…

تحلیل قیمت ۳۰ سرویس API نشان میدهد مدلهای وزنباز مانند Qwen3 هزینه استنتاج را به شدت کاهش دادهاند. این تغییر به توسعهدهندگان اجازه میدهد بدون افت کیفیت در کارهای رایج، از…

پروژه Bun در مسیر انتقال به زبان Rust با بحران اعتماد مواجه شده است. منتقدان معتقدند اتکای شدید به کد تولیدشده توسط هوش مصنوعی و نادیده گرفتن مهندسی انسانی، این پروژه را به یک…

مقیاسپذیری هوش مصنوعی در محیط عملیاتی نیازمند گذار از تخصیص ایستا به ارکستراسیون بر اساس اولویتهای تجاری است. سازمانها باید حجم کاری را بر اساس تأخیر و حساسیت طبقهبندی کنند تا…

یک راهنمای عملی نشان میدهد چگونه میتوان با جایگزینی حافظه مدل با پروتکل زمینه مدل (MCP)، توهمات عددی را در دادههای مالی از بین برد. این رویکرد بر مبنای منبع واحد حقیقت و اثبات…

عامل کدنویسی Pi اکنون امکان دور زدن ارائهدهندگان پیشفرض را فراهم کرده است تا توسعهدهندگان از طریق یک فایل JSON به هر گیتوی سازگار با OpenAI متصل شوند. این قابلیت دسترسی به…