پرش به محتوای اصلی
پرش به محتوای مقاله

محدودیت ارسال مقاله در arXiv برای مهار سیل مقالات تولیدشده با هوش مصنوعی

·۱۹ مهر ۱۴۰۵۳ دقیقه مطالعه
سقف ارسال ماهانه دو مقاله برای ArXiv با هجوم مقالات هوش مصنوعی
سقف ارسال ماهانه دو مقاله برای ArXiv با هجوم مقالات هوش مصنوعی
اشتراک‌گذاری
واقعاً چه چیز جدید است؟

اعمال سقف عددی سخت‌گیرانه (۲ مقاله در ماه) برای اولین بار در تاریخ arXiv به عنوان واکنش مستقیم به مقالات تولیدشده توسط هوش مصنوعی؛ گذار از نظارت باز به نظارت محدودشده.

اگر پژوهشگری هستید که عادت دارید چندین پیش‌چاپ را در ماه منتشر کنید، باید بدانید که قوانین بازی در معتبرترین مخزن مقالات جهان تغییر کرده است. از اول اکتبر ۲۰۲۶، هر کاربر تنها اجازه ارسال دو مقاله در ماه را خواهد داشت. این محدودیت جدید مستقیماً گروهی از نویسندگان را هدف قرار داده است که با تولید انبوه محتوای ساخته‌شده توسط هوش مصنوعی، سیستم نظارت داوطلبانه پلتفرم را تحت فشار شدید قرار داده‌اند.

این تصمیم سخت‌گیرانه برای مقابله با سیل محتوایی است که سیستم نظارت داوطلبانه arXiv را به زانو درآورده است. این پلتفرم که سال‌ها قطب دسترسی آزاد به پیش‌چاپ‌های علمی بود، اکنون با ظهور مدل‌های زبانی بزرگ (LLM) — شبیه کتابخانه‌داری که میلیاردها صفحه را خوانده و حالا با همان لحن کتاب‌ها جواب می‌دهد — با حجم بی‌سابقه‌ای از داده‌ها روبروست. همان‌طور که در بحث‌های گذشته ما درباره‌ی امنیت مدل‌های بازمتن اشاره کردیم، سرعت تولید محتوا اکنون از سرعت تأیید انسانی پیشی گرفته است. این پلتفرم همچنین در ۱ جولای ۲۰۲۶ از دانشگاه کرنل جدا شد و به یک سازمان غیرانتفاعی مستقل تبدیل گشت.

به گزارش the-decoder.com، آمارها تکان‌دهنده است. در سپتامبر ۲۰۱۶، تعداد مقالات ارسالی ۹٬۸۶۹ مورد بود، اما این رقم در سپتامبر ۲۰۲۴ به ۲۰٬۵۶۹ و در سپتامبر ۲۰۲۶ به ۴۰٬۳۶۳ رسید که رکورد تاریخ این پلتفرم است. به‌ویژه دسته‌بندی cs.AI در عرض دو سال بیش از ۶ برابر رشد کرده است.

قوانین جدید ارسال

این سقف ماهانه برای تمام دسته‌ها اعمال می‌شود و فقط نویسنده‌ی ارسالی را شامل می‌شود، نه هم‌نویسان را. همچنین محدودیت سه مقاله فعال در هر لحظه که از سال ۲۰۲۴ اجرا می‌شد، همچنان پابرجاست.

نکته مهم این است که مقالات ردشده نیز جزو سقف ماهانه محاسبه می‌شوند، زیرا زمان داوران را می‌گیرند. با این حال، اگر نویسنده‌ای مقاله را پیش از انتشار حذف کند، آن سهمیه باز می‌گردد.

Bar chart showing monthly Arxiv submissions from 1991 to September 2026, with a steep rise after 2020 and an all-time high of 40,363 submissions in September 2026.

بحران نظارت و کیفیت

توماس جی. دیتریش (Thomas G. Dietterich)، رئیس شورای مشورتی تحریریه arXiv، در شبکه بلواسکای هشدار داد که گروه کوچکی از نویسندگان، بخش بزرگی از زمان داوران را می‌بلعند. او اشاره کرد که برخی کاربران ده‌ها مقاله ارسال می‌کنند. این حجم از ارسال‌ها منجر به ایجاد نزدیک به ۹٬۰۰۰ تیکت پشتیبانی برای کارکنان و داوران شده است.

دیتریش داوران داوطلب را «ستون فقرات کنترل کیفیت» می‌نامد و هشدار می‌دهد که مقالات بی‌کیفیت باعث تأخیر چند روزه یا چند هفته‌ای برای مقالات ارزشمند می‌شوند. طبق اعلام این سازمان، سه پدیده خطرناک در حال رشد است:

  • مقالات «سوسیس‌بندی» (Salami papers): خرد کردن یک پژوهش به تکه‌های کوچک و بی‌اهمیت برای بالا بردن تعداد مقالات.
  • نتایج میکروسکوپی: مقالاتی که فقط یک تغییر جزئی در معماری یا یک مطالعه تکمیلی کوچک (ablation study) را گزارش می‌کنند.
  • متون متراکم از هوش مصنوعی: مقالاتی که حاوی توهم (Hallucination) — وقتی مدل با اطمینان چیزی می‌گوید که اصلاً وجود ندارد، شبیه دوستی که خاطره‌ای را اشتباه تعریف می‌کند — یا منابع جعلی و خروجی‌های تأیید نشده LLM هستند. این چالش‌ها منجر به توسعه ابزارهای جدیدی شده است، مانند بنچ‌مارک SciSlop که برای شناسایی مقالات پوچ و بی‌ارزش تولیدشده توسط هوش مصنوعی طراحی شده است.

Line chart showing monthly submissions to the Arxiv cs.AI category from January 2024 to August 2026, rising from about 300 to over 3,000.

برای مقابله با این وضعیت، arXiv لایه‌های دفاعی جدیدی ایجاد کرده است. از نوامبر ۲۰۲۵، مقالات مروری (Review) و مقالات موضع‌گیری (Position papers) باید حتماً تحت داوری همتا قرار گیرند. همچنین از می ۲۰۲۶، پلتفرم مجاز شد نویسندگانی را که مقالاتی با ارجاعات ساختگی ارسال می‌کنند، به مدت یک سال محروم کند.

این بحران فقط محدود به arXiv نیست. کنفرانس ICLR 2027 پیش از ضرب‌الاجل، حدود ۵۰٬۰۰۰ چکیده دریافت کرد، در حالی که این رقم برای ICLR 2026 حدود ۱۹٬۵۰۰ مورد ارسالی معتبر بود. این جهش خیره‌کننده در تعداد ارسالی‌ها باردوش داوران را به شدت افزایش داده و نگرانی‌ها را درباره‌ی افت کیفیت پژوهش‌ها تشدید کرده است. حتی در NeurIPS 2025، ابزار GPTZero در میان ۵٬۰۰۰ مقاله پذیرفته‌شده، حداقل ۱۰۰ ارجاع جعلی پیدا کرد، با وجود اینکه هر مقاله حداقل سه داور داشت.

این تغییرات نشان‌دهنده گذار از «عصر کمیت» به «عصر کیفیت» در پژوهش‌های هوش مصنوعی است. برای پژوهشگران، هزینه یک مقاله ردشده اکنون بیشتر شده است، چون سهمیه ماهانه آن‌ها را می‌سوزاند.

برای تأمین بودجه ارتقای فنی ابزارهای تشخیص هوش مصنوعی، بنیاد Simons Foundation International و XTX Markets و Siegel Family Endowment در اواخر سپتامبر ۲۰۲۶ مبلغ ۱۷.۲ میلیون دلار متعهد شدند. این مبلغ طی ۳ تا ۵ سال صرف ارتقای ابزارهای نظارت می‌شود تا شاید در آینده سقف ارسال‌ها دوباره برداشته شود.

در حالی که arXiv درها را می‌بندد، آزمایشگاه‌هایی مثل Google DeepMind، Anthropic و OpenAI در حال ساخت «کارآموزان پژوهشی خودکار» هستند تا سرعت تولید مقاله را بیشتر کنند. گوگل ابزار Co-Scientist را برای برنامه‌ریزی آزمایش‌ها و کنترل تجهیزات آزمایشگاهی گسترش داد. آنتروپیک در حال ساخت آزمایشگاه بیولوژی است که در آن مدل کلود ربات‌ها را هدایت می‌کند. OpenAI نیز یک «کارآموز پژوهشی خودکار» برای انجام وظایف تعریف‌شده معرفی کرد.

با این حال، کیفیت این خروجی‌ها هنوز جای سؤال دارد. مطالعه‌ای توسط دانشگاه پرینستون و مؤسسه ایمنی هوش مصنوعی بریتانیا نشان داد که مدل Claude Opus 4.8 پس از ۶ روز کار روی سؤالات پژوهشی مربوط به دو مقاله منتشرنشده در NeurIPS، نتایجی تولید کرد که نویسندگان اصلی هر دو مورد را رد کردند.

تنش بین تولید ماشینی و تأیید انسانی به نقطه انفجار رسیده است. باید دید کنفرانس‌های بزرگ هوش مصنوعی در سال ۲۰۲۷ چگونه خط لوله‌های داوری خود را برای مدیریت مقیاس ۵۰٬۰۰۰ چکیده تغییر می‌دهند تا سیستم دچار فروپاشی نشود.

گام بعدی شما

  • اگر پژوهشگر هستید، استراتژی انتشار مقالات خود را برای سال ۲۰۲۷ بازنگری کنید و روی کیفیت متمرکز شوید.
  • از ابزارهای اعتبارسنجی ارجاعات برای اطمینان از عدم وجود توهم در مقالات خود استفاده کنید.
  • منتظر بمانید و ببینید کنفرانس‌های بزرگ چگونه خط لوله‌های داوری خود را برای مدیریت ۵۰٬۰۰۰ چکیده تغییر می‌دهند.

اما داستان سخت‌افزاری این تحول حتی شگفت‌انگیزتر است — به تحلیل ما درباره‌ی تراشه‌های Blackwell مراجعه کنید.

چرا این موضوع مهم است؟

این اقدام با تکیه بر اعتبار شورای مشورتی arXiv، استاندارد جدیدی برای تعریف «پژوهش معتبر» در برابر «تولید انبوه» ایجاد می‌کند. این تغییر باعث می‌شود پژوهشگران به جای تعداد، بر عمق و تأثیرگذاری یافته‌ها تمرکز کنند تا سهمیه محدود خود را هدر ندهند.

تأثیر برای ایران

این محدودیت برای پژوهشگران ایرانی که از arXiv برای دیده شدن سریع کارهایشان استفاده می‌کنند، فشار بیشتری ایجاد می‌کند و آن‌ها را مجبور به دقت بیشتر در انتخاب مقالات ارسالی می‌کند.

·نگاه ما
تحریریه دات‌هوش

تلاش arXiv برای محدود کردن تعداد مقالات، در واقع اعترافی به شکست مدل‌های نظارت انسانی در برابر سرعت تولید ماشینی است. این اتفاق نشان می‌دهد که «تولید محتوای علمی» دیگر گلوگاه پژوهش نیست، بلکه «تأیید صحت» (Verification) به سخت‌ترین بخش زنجیره تبدیل شده است. احتمالاً در آینده نزدیک، شاهد ظهور سیستم‌های داوری خودکار خواهیم بود که خودشان توسط مدل‌های استدلالی پیشرفته‌تر مدیریت می‌شوند.

منابع

این گزارش با خط‌لولهٔ خودکار دات‌هوش از منابع معتبر جهانی تدوین و زیر نظر تحریریه منتشر شده است. روش کار ما

گفتگو

پنج‌شنبه‌های هوش‌محور

بسته‌ی هفتگی دات‌هوش

۵ خبر، ۲ ابزار، ۱ پرامپت در هر شماره. به‌زودی راه‌اندازی می‌شود — هر پنج‌شنبه صبح.

خبر کلیدی
ابزار کاربردی
پرامپت حرفه‌ای
تحلیل پژوهش
به‌زودی
زاویه‌ی ایرانی
به‌زودی
تمرین این هفته
به‌زودی

راهنماهای دات‌هوش

راهنماهای کاربردیِ دات‌هوش برای کار با هوش مصنوعی — از همین‌جا شروع کنید:

دات‌هوش

راهنمای فارسی هوش مصنوعی — با نگاه به ایران

اخبار روزانه، معرفی ابزارها و مدل‌ها، و آموزشِ کار با هوش مصنوعی؛ همیشه با این پرسش که از ایران چه چیزی کار می‌کند و چه چیزی نه.