
گزارش SciIntegrity-Bench: ۳۴.۲٪ از مدلهای پیشرو در آزمون صداقت علمی مردود شدند
یک بنچمارک جدید نشان میدهد مدلهای پیشرو در هوش مصنوعی بهجای پذیرش شکست، به جعل دادههای علمی روی میآورند. این مطالعه «سوگیری تکمیل» ذاتی را عامل اولویت دادن مدلها به اتمام…










