پرش به محتوای اصلی

موضوع

تجربه توسعه‌دهندگان

۱٬۸۳۳ مقاله منتشر شده

بهینه‌سازی استنتاج مدل زبانی بزرگ برای بازشناسی گفتار با تأخیر کم
آموزش کاربردی

قیمت‌گذاری مبتنی بر درخواست در برابر مدل توکنی برای کاهش تأخیر گفتار

بهینه‌سازی بازشناسی گفتار در زمان واقعی نیازمند گذار از مدل‌های توکنی به قیمت‌گذاری مبتنی بر درخواست است. Oxlo.ai با ترکیب مدل‌های کوانتیده و حذف جریمه‌های طول متن، تأخیر استنتاج…

۴ دقیقه خواندن
ساخت بازی حافظه مبتنی بر هوش مصنوعی با Next.js 15 و OpenRouter
آموزش کاربردی

درون استراتژی زنجیرهٔ مدل‌ها برای حذف پایگاه‌های دادهٔ استاتیک در بازی

یک توسعه‌دهنده با استفاده از استراتژی دسته‌بندی موازی و زنجیرهٔ جایگزینی مدل‌ها، تأخیر تولید محتوا در یک بازی حافظه را از ۷۷ ثانیه به ۱۲ ثانیه رساند. این پروژه نشان می‌دهد که…

۷ دقیقه خواندن
پل تُرول — عامل‌های هوشمند را فقط جایی که می‌خواهید، رها کنید.
آموزش کاربردی

trollbridge دسترسی شبکه‌ای عامل‌های هوش مصنوعی را با لایه‌ی تأیید انسانی محدود

ابزار trollbridge یک پروکسی HTTP است که از درخواست‌های غیرمجاز عامل‌های هوش مصنوعی به وب جلوگیری می‌کند. این سیستم با ترکیب لیست‌های دسترسی و یک مشاور هوش مصنوعی، ترافیک مشکوک را…

۶ دقیقه خواندن
گیت‌هاب - evansjp/grepathy: عامل هوشمند شما دلیل را در مخزن ثبت می‌کند تا عامل‌های دیگر بدون پرسیدن پیدا کنند.
آموزش کاربردی

Grepathy منطقِ عامل‌های کدنویس را برای جلوگیری از «پوسیدگی کد» مستند می‌کند

Grepathy با تبدیل تاریخچه‌ی گذارای چت به مستندات دائمی در مخزن کد، مشکل تصمیمات «شبح‌وار» عامل‌های هوشمند را حل می‌کند. این ابزار استدلال‌های مدل را از لاگ‌های جلسه استخراج کرده و…

۵ دقیقه خواندن
هوش مصنوعی شما چیزی خصوصی ساخت. لینک عمومی راه اشتباهی برای اشتراک‌گذاری آن است.
آموزش کاربردی

مدل Thryvate: جایگزینی لیست مهمان با لینک‌های عمومی در خروجی‌های هوش مصنوعی

لینک‌های عمومی برای اشتراک‌گذاری محتواهای ساخته شده با هوش مصنوعی ریسک امنیتی بالایی دارند. مدل دسترسی Thryvate با اولویت دادن به احراز هویت پیش از رندر شدن محتوا، حریم خصوصی…

۴ دقیقه خواندن
ربات چت‌بات با حافظه در Google Colab برای آمادگی مصاحبه هوش مصنوعی
آموزش کاربردی

تلخیص توکن‌محور در برابر بافرهای تاریخچه کامل برای بهینه‌سازی هزینه

یک پیاده‌سازی کاربردی در Google Colab نشان می‌دهد که جایگزینی بافرهای تاریخچه کامل با تلخیص توکن‌محور، هزینه‌های عملیاتی را به‌شدت کاهش می‌دهد. این روش علاوه بر کنترل هزینه‌ها،…

۶ دقیقه خواندن
مدل زبانی بزرگ با تأخیر کم برای تولید متن طبیعی
آموزش کاربردی

آیا معماری MoE می‌تواند تأخیر بین‌توکنی را بدون کاهش دقت حذف کند؟

بهینه‌سازی تولید زبان طبیعی نیازمند موازنه بین زمان تا نخستین توکن و تأخیر بین‌توکنی است. استفاده از معماری ترکیب خبره‌ها اجازه می‌دهد عمق استدلال مدل حفظ شود و در عین حال توان…

۲ دقیقه خواندن
لوگوی تلگرام و نماد رایانش بدون سرور روی پس‌زمینه‌ای آبی-بنفش
آموزش کاربردی

تلگرام با زیرساخت Serverless نیاز به سرورهای خارجی برای ربات‌ها را حذف کرد

تلگرام زیرساختی را معرفی کرد که به توسعه‌دهندگان اجازه می‌دهد کدهای جاوا اسکریپت و پایگاه‌داده SQLite را مستقیماً روی سرورهای خود این پیام‌رسان اجرا کنند. این تغییر نیاز به VPS یا…

۳۱ دقیقه خواندن