پرش به محتوای اصلی
پرش به محتوای مقاله

VeraBench: مدل Kimi K2.5 با زبان Vera به دقت ۱۰۰ درصدی رسید

·۱۰ اردیبهشت ۱۴۰۵۲ دقیقه مطالعه
VeraBench: مدل Kimi K2.5 با زبان Vera به دقت ۱۰۰ درصدی رسید
اشتراک‌گذاری

اگر می‌خواهید کدی بدون نقص داشته باشید، باید دست از مجبور کردن مدل‌های زبانی به نوشتن شبیه انسان‌ها بردارید. تصور کنید زبانی داشته باشید که در آن توهمات مدل در سطح کامپایلر شناسایی و حذف شوند.

در ۲۹ آوریل ۲۰۲۶، توسعه‌دهنده‌ای به نام Alasdair Allan زبان Vera را معرفی کرد؛ زبانی که به‌طور اختصاصی برای نویسندگان ماشینی طراحی شده است. به نقل از مستندات گیت‌هاب این پروژه، Vera نام متغیرها را به‌طور کامل حذف کرده و آن‌ها را با اندیس‌های دو بروین (De Bruijn indices) تایپ‌شده جایگزین می‌کند. این تغییر بنیادین باعث می‌شود مشکل «خطاهای مرتبط با نام‌گذاری» — جایی که مدل‌ها فراموش می‌کنند هر نام به کدام مقدار اشاره دارد — به‌طور کامل ریشه‌کن شود.

Vera — A language designed for machines to write

برای تضمین قابلیت اطمینان مطلق، Vera یک سیستم تأیید سخت‌گیرانه را پیاده کرده است:

  • قراردادهای اجباری (Mandatory Contracts): هر تابع باید پیش‌شرط‌های requires() و پس‌شرط‌های ensures() را اعلام کند.
  • تأیید SMT: کامپایلر از حل‌کننده Z3 (Z3 solver) برای اثبات استاتیک قراردادها استفاده می‌کند؛ اگر اثبات شکست بخورد، کد کامپایل نمی‌شود.
  • اثرات صریح (Explicit Effects): اثرات جانبی تایپ شده‌اند (مثلاً <Http, Inference>) و تابع نمی‌تواند عملی غیرمجاز انجام دهد.
  • هدف WASM: برنامه‌ها به وب‌اسمبلی (WebAssembly) کامپایل می‌شوند تا در هر محیطی اجرا شوند.

طبق گزارش‌های منتشر شده در بنچمارک VeraBench، مدل Kimi K2.5 در زبان Vera به نرخ اجرای صحیح ۱۰۰ درصدی رسید؛ در حالی که دقت این مدل در پایتون ۸۶ درصد و در تایپ‌اسکریپت ۹۱ درصد بود.

همان‌طور که در پوشش پیشین ما از AlphaMaze دیدیم، مسیر رسیدن به عامل (Agent)های قابل اعتماد، نیازمند حذف انتزاع‌های انسان‌محور است که باعث سردرگمی استدلال مدل‌های هوش مصنوعی زاینده (Generative AI) می‌شوند.

در حالی که این پروژه هنوز در نسخه‌ی توسعه (v0.0.127) است، نقشه‌ی راه آن به سمت ایجاد یک سرور ابزارهای MCP اشاره دارد که طرح‌های ابزار را در زمان کامپایل تضمین می‌کند. اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

گام بعدی شما

  • بررسی بنچمارک VeraBench برای درک تفاوت دقت مدل‌ها در زبان‌های مختلف.
  • مطالعه مفاهیم SMT و نحوه عملکرد حل‌کننده Z3 برای تأیید کد.
  • دنبال کردن پیشرفت‌های Vera در زمینه سرورهای MCP برای اتوماسیون ابزارها.
چرا این موضوع مهم است؟

این تحول با استفاده از تخصص در اثبات‌های ریاضی، استانداردهای جدیدی برای امنیت و دقت در کدنویسی توسط AI تعریف می‌کند. نتیجه این است که توسعه‌دهندگان می‌توانند از مدل‌های زبانی برای نوشتن کدهای حیاتی (Mission-critical) استفاده کنند، بدون اینکه نیاز به بازبینی دستی خط به خط داشته باشند.

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.