
«اهمیت هارنس»؛ عاملی کلیدی در بازدهی مدل OpenCode
آزمونهای جدید نشان میدهد مدل GLM 5.3 Flash Max OpenCode در تولید محیطهای پیچیده علمی-تخیلی با Three.js بیشترین کارایی را دارد. این نتایج ثابت میکند انتخاب «هارنس» یا محیط…
موضوع
Chain-of-thought, reasoning models (o-series, R-series), test-time compute
۱٬۷۷۵ مقاله منتشر شده

آزمونهای جدید نشان میدهد مدل GLM 5.3 Flash Max OpenCode در تولید محیطهای پیچیده علمی-تخیلی با Three.js بیشترین کارایی را دارد. این نتایج ثابت میکند انتخاب «هارنس» یا محیط…

تحلیلی فنی نشان میدهد عاملهای هوش مصنوعی حتی با دستورات صریح، قادر به استفاده مؤثر از کتابخانههای تست پیشرفته یا متدهای تأیید رسمی نیستند. این مدلها بهجای یافتن باگهای…

مؤسسه مدلهای بنیادی (IFM) خانواده مدلهای متنباز K2 Horizon را با معماریهای متنوع منتشر کرد. این مدلها با معرفی مکانیزم MoVA و آداپتورهای Uno، سرعت استنتاج را بدون کاهش کیفیت…

یک عامل خودگردان مبتنی بر GPT-6 Astra توانست بدون دخالت انسان، تمام مراحل بازی Portal را در کمتر از ۲۴ ساعت طی کند. این دستاورد جهشی بزرگ در برنامهریزی بلندمدت و توانایی استفاده…

مدیرعامل انویدیا با استناد به قابلیتهای مدل Astra، ادعا کرد که هوش مصنوعی عمومی (AGI) محقق شده است. در حالی که OpenAI این ادعا را تأیید میکند، برخی پژوهشگران نبود تعریف علمی…

پژوهشهای جدید نشان میدهند که میتوان بدون بهروزرسانی کامل وزنهای مدل، هزینههای استنتاج را بهشدت کاهش داد. متدهای WHALE و Random Attention با بهینهسازی پرامپتها و تغییر در…

یک کاربر با استفاده از هوش مصنوعی Fable توانست فرمت موسیقی اختصاصی پیانوهای خودنواز PianoDisc Protigy را مهندسی معکوس کند. این ابزار نه تنها دادههای MIDI پنهان در فایلهای MP3 را…

سامانه MathKernel با تفکیک قصد ریاضی (توسط LLM) از اجرای محاسبات (توسط موتورهای تأییدشده)، توهمات عددی را حذف میکند. این ابزار یک مدل اعتماد سختگیرانه و ردپای کامل برای هر…

بازرسی قراردادهای هوشمند در سال ۲۰۲۶ به یک خط لوله ترکیبی تبدیل شده است که ابزارهای تحلیل ایستا را با مدلهای زبانی بزرگ برای شناسایی خطاهای منطقی ادغام میکند. این رویکرد به…

یک مدل داخلی آنتروپیک طی ۱۱ روز بهصورت خودگردان، اثبات اندرو وایلز برای قضیه آخر فرمات را به زبان Lean 4 تبدیل کرد. این دستاورد مدیون لایه هماهنگی Prove2Me است که امکان حفظ حافظه…

پژوهشگران دانشگاه هونان با کمک مدل Codex توانستند حدس کروی هادویگر را که از سال ۱۹۷۴ باز بود، اثبات کنند. این دستاورد نشان میدهد که حتی پیچیدهترین حوزههای ریاضیات محض نیز در…

OpenAI با دستیابی به هدف ساخت «کارآموز پژوهشی خودکار»، حجم عملیات داخلی خود را به شدت افزایش داده است. اکنون در سازمان پژوهشی این شرکت، هر یک روز کاری انسان با بیش از سه روز تلاشِ…