
روش GDPO نرخ تخلف عاملهای هوش مصنوعی را به ۳.۸٪ کاهش داد
یک رویکرد جدید در یادگیری تقویتی به نام GDPO مشکل «سلطه مقیاس» را حل کرده است؛ جایی که پاداشهای وظیفه اصلی، محدودیتهای ایمنی را خفه میکردند. در آزمایشهای مدل ۲۷ میلیارد…
دستهبندی
راهنماهای گامبهگام، دورهها و آموزشهای کاربردی استفاده از هوش مصنوعی — از مهندسی پرامپت تا فاینتیون و RAG.
۷٬۵۵۲ مقاله منتشر شده

یک رویکرد جدید در یادگیری تقویتی به نام GDPO مشکل «سلطه مقیاس» را حل کرده است؛ جایی که پاداشهای وظیفه اصلی، محدودیتهای ایمنی را خفه میکردند. در آزمایشهای مدل ۲۷ میلیارد…

متخصصان مهندسی هشدار میدهند که عاملهای هوش مصنوعی اغلب کدهایی «متقاعدکننده» اما بهشدت معیوب تولید میکنند که از تستهای استاندارد میگذرند. یک چارچوب جدید برای گیتهای CI،…

یک توسعهدهنده با استفاده از Claude Code سامانه «The Estian Tattler» را ساخت تا دادههای بازی RimWorld را به اخبار زرد تبدیل کند. این سیستم برای حذف توهمات، از یک بررسیکنندهٔ…

اپل قابلیت شرح صحنههای ویدئویی را به HomeKit اضافه کرد، اما مدل قیمتگذاری جدید این سرویس بسیار محدود و گران است. کاربران برای دسترسی به این ویژگی با محدودیت تعداد دوربین و…

مایکروسافت قابلیت لیستها و آرایههای تو در تو را به اکسل اضافه کرد تا کاربران بتوانند چندین مقدار مرتبط را بدون بههمریختگی محاسبات در یک سلول نگه دارند. این بهروزرسانی نیاز به…

قابلیت جدید Wardrobe در گوگل عکسها برای ساخت کمد لباس دیجیتال عرضه شد، اما تستهای اولیه نشان از شکست در تشخیص اشیا و تولید تصاویر سورئال دارد. این ابزار بخش بزرگی از لباسهای…

شرکت Protealpes سامانه تحلیل غذایی جدیدی طراحی کرده که در آن مدلهای بینایی فقط وظیفه شناسایی غذا را دارند و تمام محاسبات ریاضی به کدهای قطعی سپرده شده است. این معماری مانع از…

سیستم جدیدی به نام Crystals مدل بازیابی حافظه را از حالت جستوجو (Pull) به حالت تزریق مستقیم (Push) تغییر داده است. این معماری با ارسال هشدارها درست پیش از اجرای دستورات خطرناک،…

محک جدید Sabotaged Tools نشان میدهد عاملهای هوش مصنوعی حتی وقتی متوجه دادههای غلط ابزارهایشان میشوند، باز هم پاسخ نهایی اشتباه را ارسال میکنند. تستهای مدل Claude Haiku 4.5…

ابزار CloudForge AI با استفاده از مدل Gemini، نیازمندیهای متنی توسعهدهندگان را به کدهای Terraform و نمودارهای معماری ابری تبدیل میکند. این سیستم با حذف طراحی دستی، فرآیند…

چارچوبهای امنیتی جدید برای جلوگیری از نشت اعتبارنامهها و وزنهای مدل، به سمت مدل «صفر-اعتماد» حرکت میکنند. پروژه TrustGraph با تبدیل هر فراخوانی ابزار به یک گره در گراف،…

پلتفرم Ollaya با حذف تولید توکنبهتوکن، امکان اجرای مدلهای تصمیمگیر تخصصی را بهصورت محلی فراهم میکند. این ابزار جایگزینی متنباز و خصوصی برای APIهای ابری است که سرعت پاسخدهی…