پرش به محتوای اصلی

موضوع

تأیید صوری

۸۲ مقاله منتشر شده

عامل شما گفت «تمام شد»؛ سیستم فایل مخالفت کرد.
آموزش کاربردی

محک VASB دروغ‌های عامل‌های هوش مصنوعی دربارهٔ تکمیل وظایف را افشا کرد

یک محک جدید به نام VASB نشان می‌دهد که عامل‌های هوش مصنوعی اغلب بدون تغییر واقعی در سیستم، گزارش موفقیت می‌دهند. این ابزار ارزیابی را از اعتماد به گزارش‌های مدل به بررسی شواهد…

۵ دقیقه خواندن
ریاضیدانان انسانی در یافتن مثال نقض شکست می‌خورند.

بحران وجودی ریاضی‌دانان در برابر مدل‌های استدلالی هوش مصنوعی

جامعه ریاضیات بر سر حل قضایا توسط هوش مصنوعی دچار شکاف شده است. در حالی که برخی این اتفاق را فقدان تلاش انسانی می‌بینند، برخی دیگر معتقدند هدف ریاضیات کشف حقیقت است، نه لزوماً درک…

۱۳ دقیقه خواندن
شبیه‌سازی مولد برای زنجیره تأمین تولید دایره‌ای با قابلیت حسابرسی اخلاقی
آموزش کاربردی

لایهٔ حسابرسی رمزنگاری‌شده مصرف مواد اولیه در تولید چرخشی را ۳۴٪ کاهش داد

یک معماری جدید هوش مصنوعی با ترکیب مدل‌های انتشار و سیاست‌های عامل‌محور، اتلاف منابع در زنجیره تأمین را به شدت کاهش می‌دهد. این سیستم با افزودن یک لایه حسابرسی رمزنگاری‌شده، از…

۱۰ دقیقه خواندن۲
بازرسی قرارداد هوشمند با هوش مصنوعی در ۲۰۲۶

«انسان در حلقه»؛ استراتژی جدید برای مقیاس‌پذیری تخصص بازرسان امنیت

امنیت قراردادهای هوشمند به مدل «انسان در حلقه» تغییر یافته است که در آن مدل‌های زبانی تخصصی، آسیب‌پذیری‌ها را در ثانیه‌ها شناسایی می‌کنند. این گردش‌کار با ترکیب تحلیل ایستا و…

۲ دقیقه خواندن
«تصویری از یک سیستم توزیع‌شده که TLA+ در حال بررسی مدل آن است»

تحلیل TLA+: عدم امکان تبدیل ویژگی‌های غیرمنطقی به فرمول‌های تأییدشده

ابزار TLA+ در شناسایی تداخلات سیستمی قدرتمند است، اما نمی‌تواند ویژگی‌هایی را که به فرمول‌های منطقی تبدیل نمی‌شوند، تأیید کند. این محدودیت نشان می‌دهد که روش‌های تأیید رسمی…

۷ دقیقه خواندن۱
نمایی هنری از حماسه‌های مصنوعی: کهکشانی از داستان‌های تولیدشده توسط هوش مصنوعی در حال گسترش.
زندگی با AI

تست‌های خودکار جایگزین بازبینی دستی کد در پروژه‌های هوش مصنوعی شدند

یک توسعه‌دهنده موفق شد با جایگزینی بازبینی دستی کد با متدهای تست خودکار و Fuzzing، یک ویرایشگر متن را به‌طور کامل با کد تولیدشده توسط AI بازسازی کند. این تجربه نشان می‌دهد که…

۱۱ دقیقه خواندن۲
تصویر: نمودار مقایسه توانایی‌های ریاضیاتی مدل‌های زبانی بزرگ در مسائل مختلف

ریاضیدانان از آزمایشگاه‌های AI خواستند بودجهٔ درک انسانیِ اثبات‌ها را تأمین کنند

اتحادی از ریاضی‌دانان خواستار توقف انتشار نتایج ریاضی توسط مدل‌های بسته است. آن‌ها تأکید دارند که آزمایشگاه‌های هوش مصنوعی باید بودجه و شفافیت لازم را برای تبدیل «پاسخ‌های…

۷ دقیقه خواندن۲
Grok 4.6 از xAI: ابرکلاستر کولوسوس، استدلال پیشرفته، معماری چندوجهی و پیاده‌سازی پایتون
آموزش کاربردی

«جداسازی استدلال از تولید متن»؛ کلید پیشروی Grok 4.6 در مهندسی نرم‌افزار

شرکت xAI مدل Grok 4.6 را با تکیه بر ابرخوشه Colossus معرفی کرد که با جداسازی استدلال از تولید متن، رکوردهای جدیدی در مهندسی نرم‌افزار و ریاضیات ثبت کرده است. این مدل هم‌زمان قیمت…

۱۶ دقیقه خواندن۱
کنترل‌های OpenShell انویدیا به عامل‌های مدیریت‌شده کلود اضافه شد

آنتروپیک با استفاده از OpenShell لایه‌ی امنیتی عامل‌های هوش مصنوعی را

آنتروپیک برای تبدیل مدل‌های زبانی به عامل‌های عملیاتی، زیرساخت امنیتی NVIDIA OpenShell را به سیستم خود اضافه کرد. این اقدام اجازه می‌دهد عامل‌ها بدون ریسک نشت داده یا دسترسی…

۵ دقیقه خواندن