تصور کنید میخواهید یک آشیانه فضایی با مه حجیم و پهپادهای شناور را تنها با یک دستور متنی بسازید؛ حالا مدل GLM 5.3 Flash Max این کار را با دقت خیرهکنندهای انجام میدهد. طبق گزارشی که در ۸ سپتامبر ۲۰۲۶ منتشر شد، این مدل به نرخ موفقیت ۹۶.۸۹٪ در تولید محیطهای پیچیده سه-بعدی دست یافته است.
برای توسعهدهندگان، انتخاب هارنس (Harness) — که شبیه به یک قالب یا چارچوب است که مدل را در بر میگیرد تا خروجی را سازماندهی کند — اغلب به اندازه خودِ مدل اهمیت دارد. این آزمایش بهطور خاص بررسی کرد که چگونه پیکربندیهای مختلف بر توانایی هوش مصنوعی زاینده (Generative AI) — مثل هنرمندی که میلیاردها طرح را دیده و حالا میتواند هر چه بخواهید را رسم کند — در تولید یک فایل HTML واحد و بدون خطا اثر میگذارد.
همانطور که در تحلیلهای قبلی ما دربارهی بهینهسازی مدلهای کدنویس اشاره کردیم، ساختار خروجی میتواند تعیینکننده باشد. بر اساس دادههای منتشر شده در alvins82.github.io، نتایج بین پیکربندیها تفاوت فاحشی داشت:
- GLM 5.3 Flash Max OpenCode: با نرخ موفقیت ۹۶.۸۹٪ در صدر قرار گرفت.
- Qwen 3.8 27B x-high OpenCode: با ۹۵.۶۴٪ در رتبه دوم بود.
- Astra 6.0 MaxCodexOpen: امتیاز ۹۴.۹۳٪ را کسب کرد.
- GLM 5.3 Flash Max Codex Open: با ۸۵.۲۶٪ عملکرد ضعیفی داشت.
نکته جالب این است که مدل Qwen 3.8 27B بسته به هارنس، نوسان شدیدی داشت. در حالی که نسخه OpenCode آن عالی عمل کرد، نسخه OMPOpen به ۸۶.۹۲٪ سقوط کرد. این موضوع نشان میدهد که هارنس بهشدت بر توانایی مدل در حفظ یکپارچگی ساختاری در کدهای طولانی اثر میگذارد.
این تغییر رویکرد ثابت میکند که برای توسعه وب سه-بعدی، هارنس OpenCode چارچوب برتری برای استدلال روی مختصات فضایی و حلقههای انیمیشن فراهم میکند. بنابراین، توسعهدهندگان باید بهجای مهاجرت صرف به مدلهای بزرگتر، روی بهینهسازی هارنس تمرکز کنند تا قابلیت اطمینان کد را بالا ببرند.
گام بعدی شما
- پرامپتهای مورد استفاده در این مطالعه را روی مدلهای مختلف تست کنید تا تفاوت خروجی Three.js را ببینید.
- در پروژههای وب سه-بعدی، ابتدا پیکربندی OpenCode را برای استقرار مدلها امتحان کنید.
- بررسی کنید آیا تغییر هارنس در مدلهای فعلی شما، نرخ خطای سینتکس را کاهش میدهد یا خیر.
اما تأثیر این بهینهسازیها بر هزینههای استنتاج در مقیاس صنعتی حتی جذابتر است — به تحلیل ما دربارهی کاهش هزینههای GPU مراجعه کنید.




گفتگو