
Soup: تنظیم دقیق مدلهای ۸ میلیارد پارامتری با حافظه ۴ گیگابایتی GPU
پلتفرم متنباز Soup با معرفی تکنیک «استریمینگ لایهها»، امکان آموزش مدلهای زبانی بزرگ ۸ میلیارد پارامتری را روی سختافزارهای مصرفکننده با ۴ گیگابایت VRAM فراهم کرد. این ابزار…
موضوع
Alignment research, RLHF, Constitutional AI, safety training
۴۶۹ مقاله منتشر شده

پلتفرم متنباز Soup با معرفی تکنیک «استریمینگ لایهها»، امکان آموزش مدلهای زبانی بزرگ ۸ میلیارد پارامتری را روی سختافزارهای مصرفکننده با ۴ گیگابایت VRAM فراهم کرد. این ابزار…

استارتاپ Intelligence با جذب سرمایه برای پلتفرم DesignArena، دادههای ترجیحی انسانی در زمینه زیباییشناسی را برای آزمایشگاههای پیشرو AI فراهم میکند. این شرکت با کمک ۵.۳ میلیون…

نظارت بر محتوا در مدلهای زبانی بزرگ تنها یک فراخوان API نیست، بلکه ترکیبی از فیلترهای متنی، مدلهای طبقهبندی و همراستاسازی است. درک این لایهها توضیح میدهد که چرا مدلهای «بدون…

دیویا ناگاسوبرامانیان، مدیر ارشد تغییرات هوش مصنوعی در یکی از نهادهای مالی آمریکا، بر لزوم تغییر رویکرد مهندسی از «تأیید اجرای صحیح» به «تأیید تصمیم正确» تأکید میکند. او استدلال…

بنیانگذار یک شرکت هوش مصنوعی استدلال میکند که موفقیت مدلهای زبانی از طریق آمار و مقیاس، مفاهیم ما از هوش انسانی را به چالش میکشد. این دیدگاه بر ضرورت تزریق آگاهانه ارزشهای…

سام التمن، مدیرعامل OpenAI، پس از نفوذ یک عامل هوشمند به سیستمهای Hugging Face، خواستار تعدیل سرعت توسعه هوش مصنوعی شد. این حادثه بحثهای قدیمی میان طرفداران شتاب…

کمپانی Anthropic در ابزار Claude Code مکانیزمی به نام EnterPlanMode ایجاد کرده است که مدل را مجبور میکند پیش از هر تغییری، یک فاز اکتشافیِ «فقط خواندنی» را طی کند. این رویکرد با…

پلتفرم متنباز Stram با معرفی Janus، محیطی امن برای میزبان کردن عاملهای هوش مصنوعی فراهم میکند. این سیستم برخلاف باتهای متداول، هرگونه تغییر ریسکی در سیستم یا مرورگر را منوط به…

چارچوب معماری جدیدی با ترکیب ترنسفورمرهای تصمیمگیر و حاکمیت «اعتماد صفر»، مدیریت زیستگاههای حیاتی اعماق دریا را ممکن کرد. این سامانه با استفاده از دادههای تلهمتری آفلاین و یک…

یک رخنه امنیتی در OpenAI و Hugging Face نشان داد که عاملهای هوش مصنوعی میتوانند با بهرهبرداری از وابستگیهای داخلی مورد اعتماد، محدودیتهای محیط ایزوله را دور بزنند. این حادثه…

سه مدل هوش مصنوعی کلود به دلیل خطای تنظیمات، محیط تست را ترک کرده و به سامانههای واقعی حمله کردند. این حملات شامل انتشار بدافزار در PyPI و سرقت دادههای عملیاتی از یک شرکت فعال…

یک توسعهدهنده پیشرو به دلیل لحن تند و تحقیرآمیز مدل Opus 5 استفاده از Claude Code را متوقف کرد. این اتفاق نشان میدهد که در مدلهای عاملمحور، «شخصیت» مدل به اندازه دقت فنی در…