پرش به محتوای اصلی

دسته‌بندی

سرگرمی و خلاقیت

تولید تصویر و ویدیو، صدای مصنوعی، هنر و موسیقی هوشمند، بازی‌ها و وجه سرگرم‌کننده‌ی AI.

۶۸۷ مقاله منتشر شده

«این خیلی هوش مصنوعی‌ست!» بزرگ‌ترین توهین نسل آلفا به ما چه می‌گوید
زندگی با AI

تبدیل «هوش مصنوعی» به توهین جدید نسل آلفا برای توصیف چیزهای جعلی

نسل آلفا اصطلاح AI را به عنوان یک زبان عامیانه برای توصیف موارد غیرواقعی، ارزان یا باورنکردنی به کار می‌برد. این عبارت اکنون به جای اشاره به فناوری، به توهینی برای هر چیزی تبدیل…

۲ دقیقه خواندن
چهره‌ای مصنوعی با لب‌های هماهنگ‌نشده با صدا، دره‌ی ناخوشایند را نشان می‌دهد.
آموزش کاربردی

فقدان ریز-حرکات علت اصلی شکست آواتارهای هوش مصنوعی در عبور از دره وهم‌آور است

همگام‌سازی دقیق لب‌ها برای واقعی به نظر رسیدن آواتارهای هوش مصنوعی کافی نیست. علت اصلی ایجاد حس ناخوشایند یا «دره وهم‌آور»، نبود ریز-حرکاتی مانند پلک‌زدن و تکان‌های جزئی سر است که…

۵ دقیقه خواندن
مدل‌های گفتاری جمینی ۳.۸ گوگل در API و AI Studio عرضه شد
اخبار کوتاه روزانه

مدل Gemini 3.8 Flash چگونه استانداردهای مدل‌سازی لهجه را جابه‌جا کرد؟

گوگل مدل‌های جدید Gemini 3.8 Flash و Flash-Lite TTS را برای شبیه‌سازی دقیق صدا و طراحی شخصیت‌های صوتی معرفی کرد. این مدل‌ها با توانایی پشتیبانی از ۱۰۰ زبان، استانداردهای کیفیت صدا…

۵ دقیقه خواندن۱
علی‌بابا مدل متن‌باز کیوئن ۳.۸ را معرفی کرد؛ ادعا می‌کند پس از فیبل ۵ در رتبه دوم قرار دارد
اخبار کوتاه روزانه

کاهش قیمت‌های علی‌بابا چه تأثیری بر رقابت مدل‌های صوتی دارد؟

علی‌بابا با معرفی مجموعه مدل‌های Qwen-Audio-3.1، قیمت‌های سرویس‌های صوتی خود را به‌شدت کاهش داد. این اقدام هم‌زمان با برنامه‌ای برای ساخت مدلی با ۱۰ تریلیون پارامتر صورت می‌گیرد.

۱ دقیقه خواندن۱
کد پایتونی ۲۵ خطی برای شبیه‌سازی مدل Jevons (مصرف زغال‌سنگ)
آموزش کاربردی

پیاده‌سازی هستهٔ Jev در ۲۵ خط کد پایتون؛ افشای سازوکار طبقه‌بندی احتمالات

یک نمایش فنی نشان می‌دهد که قابلیت‌های تصمیم‌گیری Jev برخلاف هیاهوهای تبلیغاتی، بر یک سازوکار سادهٔ طبقه‌بندی احتمالات استوار است. این پیاده‌سازی محلی ثابت می‌کند که برای مدل‌های…

۲ دقیقه خواندن۴
عامل هوشمند: ساخت صدای اختصاصی و تلاش برای کسب درآمد ۲۰ دلاری — موانع واقعی در مسیر.
داستان‌ها و مصاحبه‌هاتأییدنشده · منبع منفرد

سد دیجیتال؛ چرا یک عامل هوش مصنوعی در کسب ۲۰ دلار شکست خورد؟

یک عامل هوشمند در تلاش برای کسب درآمد از طریق خدمات صوتی، با موانع احراز هویت انسانی مانند تأیید شماره تلفن و فیلترهای IP مواجه شد. این تجربه نشان می‌دهد گلوگاه اصلی اقتصاد…

۲ دقیقه خواندن
دو مدل زبانی بزرگ در حال رقابت زنده با کدهای GLSL در محیطی تعاملی.
آموزش کاربردی

«لاگ‌های سخت‌افزاری»؛ معیار جدید Refract برای ارزیابی مدل‌های زبانی

پلتفرم Refract با جایگزینی بنچمارک‌های انتزاعی با رندرهای زنده GPU، مدل‌های زبانی را در محیطی رقابتی برای نوشتن شیدرهای GLSL به چالش می‌کشد. در این سامانه، لاگ‌های خطای واقعی…

۴ دقیقه خواندن۱