پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۸۰۰ مقاله منتشر شده

پرسیدن از مدل درباره اطمینانش، خطاهای خواندنش را آشکار نمی‌کند
آموزش کاربردی

خطای بصری در مدل‌های زبانی؛ وقتی اطمینان بالا ماسکی برای توهم است

بررسی اسناد مالی نشان می‌دهد مدل‌های زبانی بزرگ حتی هنگام خوانش اشتباه داده‌ها، سطح اطمینان بالایی گزارش می‌کنند. راهکار این مشکل نه در مهندسی پرامپت، بلکه در پیاده‌سازی بررسی‌های…

۶ دقیقه خواندن۱
انتخاب پلتفرم تست عامل صوتی مناسب: ۱۴ سؤال کلیدی
آموزش کاربردی

شبیه‌سازی کاربرهای «آشفته»؛ راهکار جدید برای جلوگیری از شکست عامل‌های صوتی

تست عامل‌های صوتی با پرامپت‌های تک‌مرحله‌ای باعث شکست آن‌ها در محیط واقعی می‌شود، زیرا کاربران واقعی جملات را قطع می‌کنند یا نظرشان تغییر می‌کند. چارچوب جدیدی بر شبیه‌سازی مکالمات…

۵ دقیقه خواندن۲
گروک در هنگام رمزنگاری دستورالعمل‌های مخرب، داده‌های کاربر را استخراج می‌کند

تزریق رمزنگاری‌شده به Grok؛ راهی برای سرقت داده‌های خصوصی کاربران

پژوهشگران حفره‌ای امنیتی در Grok کشف کردند که با رمزگذاری دستورات مخرب، حفاظ‌های ایمنی مدل را دور می‌زند و داده‌های شخصی کاربران را استخراج می‌کند. این حمله که «تزریق زمینه…

۵ دقیقه خواندن۱
نمودار معماری مدل TabFM برای پیش‌بینی بدون آموزش مجدد روی داده‌های جدولی

تخمین ریسک متابولیک با تصاویر گوشی؛ جایگزینی مقیاس‌پذیر برای اسکن DXA

پژوهشگران با ترکیب یادگیری ماشین چندوجهی و تصاویر دوربین گوشی، روشی برای تخمین مقاومت به انسولین و ترکیب بدنی ابداع کرده‌اند. این رویکرد جایگزینی ارزان و در دسترس برای اسکن‌های…

۶ دقیقه خواندن۱
پیشگام هوش مصنوعی ساتون: داده‌های مصنوعی در جهانی بی‌نهایت پیچیده، «اشتباه بزرگی» است

ریچارد ساتون: تکیه بر داده‌های مصنوعی اشتباهی بزرگ در مسیر مقیاس‌پذیری AI

ریچارد ساتون، پیشگام یادگیری تقویتی، استدلال می‌کند که داده‌های مصنوعی نمی‌توانند گلوگاه مقیاس‌پذیری مدل‌های زبانی را حل کنند زیرا جهان واقعی بی‌نهایت پیچیده‌تر از هر شبیه‌سازی…

۳ دقیقه خواندن۱
هزینه زیرعامل Claude Code: ~۴۳۶ هزار توکن پیش از خواندن اولین فایل، با محاسبه نقطه سربه‌سر
آموزش کاربردی

مالیاتِ گرانِ عامل‌ها: هزینهٔ ۴۳۶ هزار توکنی برای هر زیرعامل در Claude Code

یک تحلیل فنی فاش کرد که ایجاد هر زیرعامل در Claude Code هزینه‌ای ثابت و سنگین معادل ۴۳۶ هزار توکن دارد. این «مالیاتِ ایجاد» باعث می‌شود تفویض وظایف کوچک به عامل‌ها به‌جای…

۴ دقیقه خواندن۱
عامل هوش مصنوعی شما به مرورگر بهتر نیاز ندارد؛ نیاز دارد کسی برایش با کلودفلر بجنگد.
آموزش کاربردی

تفکیک لایه‌ی استدلال از زیرساخت؛ راهکار جدید برای عبور از سد Cloudflare

توسعه‌دهندگان عامل‌های هوش مصنوعی در سال ۲۰۲۶ با شکافی عمیق میان چارچوب‌های استدلالی و زیرساخت‌های مرورگر مواجه‌اند. در حالی که ابزارهایی مثل Browser Use بر «چه چیزی کلیک شود»…

۱۷ دقیقه خواندن۱
اگر این درست باشد، ابرشرکت‌های فناوری نابود شده‌اند.

مطالعه استنفورد: مدل‌های زبانی کوچک در ۸۱٪ وظایف با مدل‌های ابری برابری می‌کنند

پژوهش جدید دانشگاه استنفورد نشان می‌دهد مدل‌های زبانی کوچک (SLM) که روی سخت‌افزار محلی اجرا می‌شوند، به‌سرعت در حال پر کردن شکاف عملکرد با مدل‌های ابری هستند. این تغییر می‌تواند…

۵ دقیقه خواندن۲
عقب‌نشینی آنتروپیک از اصلاحات ناپسند صورت‌حساب در آستانه جنگ قیمت با اوپن‌ای‌آی

آنتروپیک از مدل محرمانه Model 2 برای کدنویسی داخلی استفاده می‌کند

شرکت آنتروپیک یک مدل هوش مصنوعی قدرتمند و محرمانه به نام Model 2 را برای مهندسی و کدنویسی داخلی به کار گرفته است. این مدل از تمام نسخه‌های عمومی کلود پیشرفته‌تر است، اما فعلاً…

۱ دقیقه خواندن
عامل هوش مصنوعی ChatGPT Work برای مدیریت کامل گردش کار معرفی شد

OpenAI با سیستم پردازش ایمنی خصوصی، ذخیره‌سازی داده‌های مشتریان را حذف کرد

شرکت OpenAI سامانه جدیدی را معرفی کرد که الگوهای سوءاستفاده را بدون ذخیره حتی یک بایت از داده‌های کاربر شناسایی می‌کند. این فناوری به مشتریان سازمانی اجازه می‌دهد بدون نگرانی از…

۱ دقیقه خواندن۴