پرش به محتوای اصلی

دسته‌بندی

تحلیل و بررسی تخصصی

تحلیل‌های عمیق مدل‌ها، مقالات و بنچمارک‌ها — پیش‌چاپ‌ها، ارزیابی‌ها، مدل‌های زبانی پیشرو و پژوهش همراستاسازی.

۵٬۷۸۷ مقاله منتشر شده

AI

درون استراتژی OpenAI برای تبدیل ایمنی مدل‌ها به یک چک‌لیست قانونی

OpenAI با انتشار «چارچوب حاکمیتی پیشرو»، تلاش می‌کند استانداردهای داخلی ایمنی خود را با قوانین سخت‌گیرانه اتحادیه اروپا و کالیفرنیا هم‌راستا کند. این سند در واقع ترجمه مدیریت ریسک…

۲ دقیقه خواندن۱
AI

چرا هند با یارانه‌ی سخت‌افزاری، انحصار ابرهای جهانی را می‌شکند؟

هند با استقرار ۳۴ هزار پردازنده گرافیکی (GPU) یارانه‌ای، هزینه محاسبات برای توسعه‌دهندگان محلی را به ۱.۸۰ دلار در ساعت کاهش داد. این اقدام بخشی از مأموریت IndiaAI برای گذار از…

۲ دقیقه خواندن۱
AI

RSI در برابر AGI: چرا خود-بهبودبخشی هدف جدید آزمایشگاه‌های هوش مصنوعی است؟

آزمایشگاه‌های هوش مصنوعی از هدف مبهم AGI به سمت RSI یا «خود-بهبودبخشی بازگشتی» حرکت کرده‌اند. هدف، ساخت سیستم‌هایی است که بتوانند بدون دخالت انسان، کد و معماری خود را ارتقا دهند.

۲ دقیقه خواندن۲
AI

چرا گلوگاه هوش مصنوعی از کدنویسی به مس و کربن تغییر مسیر داده است؟

سه شرکت فناوری اقلیمی با ارزش مجموع ۳۰ میلیارد دلار، در حال تأمین زیرساخت‌های انرژی حیاتی برای مراکز داده هوش مصنوعی هستند. هم‌زمان، بایت‌دنس برای عبور از بحران کمبود تراشه‌ها،…

۲ دقیقه خواندن۱
AI
آموزش کاربردی

چرا نمرات بنچمارک در انتخاب بین Daybreak و Glasswing دیگر تعیین‌کننده نیستند؟

شرکت‌های OpenAI و Anthropic هم‌زمان ابزارهای امنیتی Daybreak و Glasswing را معرفی کردند. شباهت شدید عملکرد این دو ابزار نشان می‌دهد که مدل‌های پیشرو به سقف توانایی خود در داده‌های…

۲ دقیقه خواندن
AI

۸۹ برابر ارزان‌تر؛ تحلیل شکاف قیمتی DeepSeek V4 Flash و Claude Opus در کدنویسی

همبستگی میان کیفیت و هزینه در مدل‌های کدنویسی فروپاشیده است. آزمایشگاه‌های چینی اکنون قابلیت‌های نزدیک به مدل‌های پیشرو را با کسری از هزینه جایگزین‌های غربی ارائه می‌دهند.

۲ دقیقه خواندن
AI

چگونه Dynamo Snapshot انویدیا زمان Cold-Start استنتاج را به زیر ۵ ثانیه رساند؟

انویدیا مکانیزم جدیدی برای ذخیره و بازیابی وضعیت مدل‌ها در Kubernetes توسعه داده است که تأخیر چند دقیقه‌ای Cold-Start را حذف می‌کند. این سیستم با جداسازی وزن‌های مدل از وضعیت…

۳ دقیقه خواندن
AI

گزارش Anthropic: عامل‌های کدنویسی تولید مقالات در حال بررسی را ۷۵٪ افزایش دادند

بررسی ۱۲۶۰ پژوهشگر علوم اجتماعی نشان می‌دهد که استفاده از عامل‌های کدنویسی مستقل، تعداد مقالات در حال بررسی (Working Papers) را ۷۵٪ افزایش داده است. با این حال، شکاف جنسیتی و…

۲ دقیقه خواندن۱
AI

چگونه GPT-5.5 مصرف توکن‌های برنامه‌نویسی را در پلتفرم Oz تا ۳۰٪ کاهش داد؟

شرکت Warp با معرفی پلتفرم Oz و بهره‌گیری از GPT-5.5، ۹۰٪ از Pull Requestهای خود را خودکار کرده است. این رویکرد «توسعه‌ی عامل‌محور»، باعث رشد ۳۵ برابری درآمد سالانه‌ی این شرکت شده…

۳ دقیقه خواندن