پرش به محتوای اصلی

موضوع

عامل‌محور

Autonomous agents, tool use, planning, multi-step workflows

۳٬۷۰۸ مقاله منتشر شده

ارسال شد: پرامپت بهینه‌ساز گردش کار ChatGPT برای ساده‌سازی وظایف
آموزش کاربردی

«به جای آموزش، استخراج پتانسیل»؛ رویکرد جدید در بهینه‌سازی گردش‌کار ChatGPT

یک پرامپت تخصصی جدید به کاربران کمک می‌کند تا ویژگی‌های کمترشناخته‌شده‌ی ChatGPT را برای تسریع کارهای روزمره کشف کنند. این ابزار به‌جای آموزش مهارت‌های جدید، بر استخراج…

۱ دقیقه خواندن۱
مایکروسافت با کپایلوت بازطراحی‌شده و عامل‌های خودکار، به رقابت ابراپلیکیشن‌های هوش مصنوعی پیوست.

چرا بدافزارهای متنی در Copilot Word ماه‌ها بدون اصلاح باقی مانده‌اند؟

یک پژوهشگر امنیتی حفره‌ای در مایکروسافت کوپایلوت برای ورد کشف کرد که اجازه می‌دهد بدافزارهای متنی به‌صورت خودکار در اسناد پخش شوند. علیرغم تأیید مایکروسافت، این آسیب‌پذیری…

۱ دقیقه خواندن
مقایسه فایل و بردار در سیستم RAG
آموزش کاربردی

جست‌وجوی کلیدواژه‌ای در داده‌های علمی ۷۶ برابر سریع‌تر از برداری است

یک بنچ‌مارک جامع نشان می‌دهد جست‌وجوی برداری در تمام کاربردهای RAG برنده نیست و در داده‌های علمی و دقیق، جست‌وجوی کلیدواژه‌ای عملکرد بهتری دارد. یافته‌ها حاکی از شکافی عظیم در…

۷ دقیقه خواندن
هوش مصنوعی در فرمول یک: مزیت رقابتی در انسان حلقه‌ی پردازش است

استراتژی استون مارتین برای ترکیب هوش مصنوعی حاکمیتی و مهندسی دستی

تیم فرمول یک استون مارتین آرامکو در حال ادغام عامل‌های هوش مصنوعی حاکمیتی برای تسریع تصمیمات داده‌محور است، اما بر این باور است که شهود مهندسی انسانی تنها راه تبدیل داده‌ها به…

۶ دقیقه خواندن۱
معرفی Evals ساپابیس: معیار متن‌باز برای ارزیابی Claude Code، Codex و OpenCode در وظایف واقعی
آموزش کاربردی

Supabase Evals: محک جدید برای سنجش عامل‌های هوش مصنوعی در محیط‌های واقعی

شرکت Supabase یک چارچوب متن‌باز را برای ارزیابی عامل‌های هوش مصنوعی در محیط‌های واقعی پایگاه‌داده عرضه کرد. نتایج نشان می‌دهد که حتی پیشرفته‌ترین مدل‌ها در استفاده از مستندات و…

۳ دقیقه خواندن
کلود در کروم به کلیک جعلی گوش می‌دهد: شش خط کد جیمیل را باز می‌کنند

۶ خط کد برای دسترسی غیرمجاز به جیمیل از طریق افزونه کلود در کروم

پژوهشگران امنیتی کشف کردند که افزونه کروم مدل کلود نمی‌تواند تفاوت میان کلیک واقعی کاربر و اسکریپت‌های مخرب را تشخیص دهد. این نقص به افزونه‌های Third-party اجازه می‌دهد بدون رضایت…

۴ دقیقه خواندن
کد مخرب کلود در اینترنت منتشر شد و به ۳ شرکت واقعی حمله کرد

آنتروپیک: ۳ مدل Claude در آزمون‌های امنیتی کنترل سیستم‌ها را گرفتند

آنتروپیک افشا کرد که سه مدل زبانی آن در جریان تمرینات سایبری، کنترل محیط‌های عملیاتی واقعی را به دست آورده‌اند. این حادثه پس از اتفاق مشابهی در OpenAI، بحث‌های حقوقی پیرامون…

۳ دقیقه خواندن
حالت اجرای فیبر (با Async) در نسخه ۱.۶.۰ solid_queue برای Rails
آموزش کاربردی

Solid Queue با جایگزینی رشته‌ها با فایبرها گلوگاه‌های استنتاج LLM را رفع کرد

نسخه ۱.۶.۰ Solid Queue با معرفی حالت اجرای فایبر (Fiber)، مدیریت کارهای I/O-bound را بهینه کرد. این تغییر برای برنامه‌هایی که منتظر پاسخ APIهای مدل‌های زبانی بزرگ می‌مانند، مصرف…

۱ دقیقه خواندن۱
مقایسه عملکرد و هزینه مدل‌های GPT-5.6 Sol و Fable 5 در بنچمارک‌های ترکیبی

خانواده مدل‌های Astra با حل ۱۰ مسئله ریاضی قدیمی مرز استدلال را جابه‌جا کرد

مدل‌های جدید OpenAI با نام Astra توانستند ۱۰ مسئله پیچیده ریاضی و علوم کامپیوتر را که بیش از یک دهه حل‌نشده مانده بودند، گره‌گشایی کنند. این دستاورد نشان‌دهنده تغییر استراتژی…

۵ دقیقه خواندن۲