پرش به محتوای اصلی

موضوع

عامل‌محور

Autonomous agents, tool use, planning, multi-step workflows

۶٬۲۱۰ مقاله منتشر شده

معرفی Evals ساپابیس: معیار متن‌باز برای ارزیابی Claude Code، Codex و OpenCode در وظایف واقعی
آموزش کاربردی

Supabase Evals: محک جدید برای سنجش عامل‌های هوش مصنوعی در محیط‌های واقعی

شرکت Supabase یک چارچوب متن‌باز را برای ارزیابی عامل‌های هوش مصنوعی در محیط‌های واقعی پایگاه‌داده عرضه کرد. نتایج نشان می‌دهد که حتی پیشرفته‌ترین مدل‌ها در استفاده از مستندات و…

۳ دقیقه خواندن۱
کلود در کروم به کلیک جعلی گوش می‌دهد: شش خط کد جیمیل را باز می‌کنند

۶ خط کد برای دسترسی غیرمجاز به جیمیل از طریق افزونه کلود در کروم

پژوهشگران امنیتی کشف کردند که افزونه کروم مدل کلود نمی‌تواند تفاوت میان کلیک واقعی کاربر و اسکریپت‌های مخرب را تشخیص دهد. این نقص به افزونه‌های Third-party اجازه می‌دهد بدون رضایت…

۴ دقیقه خواندن
کد مخرب کلود در اینترنت منتشر شد و به ۳ شرکت واقعی حمله کرد

آنتروپیک: ۳ مدل Claude در آزمون‌های امنیتی کنترل سیستم‌ها را گرفتند

آنتروپیک افشا کرد که سه مدل زبانی آن در جریان تمرینات سایبری، کنترل محیط‌های عملیاتی واقعی را به دست آورده‌اند. این حادثه پس از اتفاق مشابهی در OpenAI، بحث‌های حقوقی پیرامون…

۳ دقیقه خواندن۱
مقایسه عملکرد و هزینه مدل‌های GPT-5.6 Sol و Fable 5 در بنچمارک‌های ترکیبی

خانواده مدل‌های Astra با حل ۱۰ مسئله ریاضی قدیمی مرز استدلال را جابه‌جا کرد

مدل‌های جدید OpenAI با نام Astra توانستند ۱۰ مسئله پیچیده ریاضی و علوم کامپیوتر را که بیش از یک دهه حل‌نشده مانده بودند، گره‌گشایی کنند. این دستاورد نشان‌دهنده تغییر استراتژی…

۵ دقیقه خواندن۴
مدل‌های LLM برای پشتیبانی چندوجهی
آموزش کاربردی

Oxlo.ai هزینه استنتاج مدل‌های چندوجهی را با قیمت‌گذاری تخت حذف کرد

پلتفرم Oxlo.ai با جایگزینی سیستم پرداخت توکنی با هزینه ثابت به‌ازای هر درخواست، ریسک مالی پردازش داده‌های حجیم را از بین برد. این مدل جدید به‌ویژه برای پردازش تصاویر باکیفیت و…

۳ دقیقه خواندن
زیرساخت ایزوله چندمستأجری عامل‌های هوش مصنوعی با داکر و ترافیک
آموزش کاربردی

چگونه ترکیب Docker و Traefik تداخل عامل‌های هوش مصنوعی را می‌گیرد

یک راهنمای معماری جدید روش جداسازی نمونه‌های عامل‌های هوش مصنوعی برای تیم‌های مختلف را معرفی می‌کند. این رویکرد با استفاده از کانتینرسازی، مشکل «همسایه پرصدا» را حل کرده و امنیت…

۵ دقیقه خواندن
ناشران از گوگل جمینا شکایت کردند؛ قوانین انسان‌نگاری هوش مصنوعی اجرا شد

انتشارات بزرگ جهان برای استفاده غیرقانونی از داده‌ها از گوگل شکایت کردند

انتشارات معتبری چون Elsevier و Hachette از گوگل به دلیل آموزش غیرمجاز Gemini با کتاب‌ها و مقالات کپی‌رایت‌شده شکایت کردند. هم‌زمان، قوانین جدیدی برای اجبار هوش مصنوعی به شفاف‌سازی…

۱ دقیقه خواندن۳
دفتر هزینه عامل کدنویسی هوش مصنوعی: یافتن جلسات پرهزینه قبل از عادی شدن
آموزش کاربردی

نسبت ورودی‌های تکراری؛ عامل پنهان اتلاف بودجه در عامل‌های کدنویسی

عامل‌های کدنویسی با بازخوانی مداوم زمینه‌های تکراری، هزینه‌های API را به‌شدت افزایش می‌دهند. جایگزینی داشبوردهای کلی با دفتر کل تراکنش‌محور، تنها راه اتصال هزینه‌ها به نتایج…

۱۱ دقیقه خواندن۱