
درون جابهجایی نوآم شازیر از گوگل به OpenAI
نوآم شازیر، یکی از نویسندگان مقاله اثرگذار Attention Is All You Need، گوگل را ترک کرد تا به OpenAI بپیوندد. این جابهجایی استراتژیک در حالی رخ میدهد که گوگل برای بهبود مدلهای…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۱۱۰ مقاله منتشر شده

نوآم شازیر، یکی از نویسندگان مقاله اثرگذار Attention Is All You Need، گوگل را ترک کرد تا به OpenAI بپیوندد. این جابهجایی استراتژیک در حالی رخ میدهد که گوگل برای بهبود مدلهای…

تستهای عملی روی مدلهای محلی Qwen نشان میدهد که با وجود مزیت حریم خصوصی، این مدلها در مدیریت پروژههای کدنویسی طولانی دچار «حلقههای تکرار» میشوند. این یافتهها فاصلهٔ…

OpenAI با معرفی محک LifeSciBench نشان داد که حتی پیشرفتهترین مدلهای تخصصی زیستشناسی در مواجهه با مسائل پیچیده پژوهشی ناتواناند. این دادهها حاکی از شکاف عمیق میان حفظ اطلاعات…

توسعهدهندگان اکنون میتوانند با استفاده از SDKهای استاندارد OpenAI، مدلهای DeepSeek را بدون تغییر در کد سازگار کنند. این انتقال باعث کاهش شدید هزینههای عملیاتی میشود در حالی…

شرکت MiniMax مدل M3 را با قابلیتهای کدنویسی پیشرفته و پنجره متنی یک میلیون توکنی بهصورت وزنهای باز منتشر کرد. این مدل با ادغام قابلیتهای چندوجهی و استدلال، رقابت مستقیمی با…

استارتاپ Odyssey با جذب ۳۱۰ میلیون دلار سرمایه در سری B، بر توسعه «مدلهای جهانی» برای شبیهسازی قوانین فیزیک تمرکز میکند. این دور سرمایهگذاری با حمایت انویدیا، ایامدی و…

یک پژوهشگر مایکروسافت با ساخت یک شبکه عصبی عملیاتی در محیط بازی Age of Empires II، نشان داد که «آگاهی» در هوش مصنوعی تنها یک توهم ناشی از بستهبندی ظاهری است. این مطالعه هشدار…

اوپنایآی با ترکیب مدل GPT-5.4 و آزمایشگاه خودکار Molecule.one توانست یک واکنش پیچیده در شیمی دارویی را بهینه کند. این سامانه با شناسایی یک افزودنی غیرمنتظره، بازدهی تولید…

هوش مصنوعی هزینه پیادهسازی نرمافزار را به شدت کاهش داده و کدنویسی را به یک فرآیند ترجمه ساده تبدیل کرده است. برای حفظ ارزش شغلی، مهندسان ارشد باید از «ساختن سریع» به سمت «قضاوت…

شرکت Greptile لایهی اجرایی TREX را معرفی کرد تا بررسی کدهای AI را از خواندن ساده به اجرای واقعی تغییر دهد. این رویکرد اجازه میدهد خطاهای منطقی و پسرویهای رابط کاربری که در…

استارتآپ Pramaana Labs با جذب ۲۷ میلیون دلار سرمایه، در تلاش است تا با ادغام اثباتهای ریاضی در مدلهای زبانی، خطاهای بحرانی در حوزههای حقوق و پزشکی را به صفر برساند.

پژوهشگران انویدیا و دانشگاههای برکلی و کارنگی ملون سامانهای به نام ENPIRE ساختهاند که در آن عاملهای هوش مصنوعی بهطور خودکار کدهای آموزشی رباتها را مینویسند. این سیستم…