arXiv가 AI 논문 홍수 속에 1인당 월 2편 투고 제한을 도입한다

the-decoder53분 전

arXiv가 2026년 10월 1일부터 한 사람이 한 달에 올릴 수 있는 논문 수를 두 편으로 제한한다. 카테고리를 가리지 않고 적용되며, 제한을 받는 쪽은 실제로 투고 버튼을 누른 사람이다. 공저자로 이름을 올리는 것은 편수와 무관하다. 2024년부터 유지돼 온 '동시에 3편까지' 규칙은 그대로 남는다.

반려된 논문도 한도에 포함된다. 심사 과정에서 모더레이터의 시간을 소모하기 때문이다. 다만 게재 전에 저자가 직접 삭제하면 그 자리는 다시 돌아온다.

숫자가 이 결정의 배경을 설명한다. 2016년 9월 한 달 투고량은 9,869건이었고, 2024년 9월에는 20,569건으로 늘었다. 2026년 9월에는 40,363건을 기록하며 역대 최다를 새로 썼다. 같은 시기 직원과 모더레이터에게 몰린 지원 요청은 약 9,000건에 달했다. 컴퓨터과학의 AI 분야(cs.AI)만 보면 2년 새 제출량이 6배 이상으로 뛰었다.

자원봉사 모더레이터들이 마주하는 논문의 성격도 달라졌다. 내용이 얇고 초점이 좁은 글, 잘게 쪼갠 이른바 살라미 논문, AI가 써낸 빽빽한 텍스트가 늘었다는 것이 arXiv 측 설명이다. 편집자문위원회 의장인 Thomas G. Dietterich는 일부 저자가 수십 편을 제출하고 있으며, 그 탓에 품질 높은 논문을 꾸준히 내는 연구자들의 심사가 며칠에서 몇 주씩 밀린다고 짚었다. 그는 이번 상한이 실험 하나를 덧붙이거나 구조를 살짝 손본 수준의 '미세 결과' 논문을 줄이는 데도 도움이 되기를 기대한다.

규제는 이번이 처음이 아니다. arXiv는 2025년 11월 컴퓨터과학 논문 규정을 강화해 리뷰 논문과 입장 논문에 피어리뷰를 요구하기 시작했다. 2026년 5월에는 환각 출처처럼 검증되지 않은 LLM 출력이 명백히 들어간 논문의 저자에게 1년 투고 금지 조치를 예고했다. 학회도 같은 압력을 받고 있다. ICLR 2027은 마감 전에 이미 약 5만 건의 초록을 받았고, ICLR 2026의 유효 제출은 약 19,500건이었다. NeurIPS 2025에서 채택된 약 5,000편 가운데 GPTZero는 최소 100건에서 조작된 인용을 찾아냈는데, 해당 논문들은 모두 리뷰어를 세 명 이상 배정받은 상태였다.

arXiv는 25년 만에 코넬대학교에서 분리해 2026년 7월 1일부터 독립 비영리법인으로 전환하는 중이다. 9월 말에는 Simons Foundation International, XTX Markets, Siegel Family Endowment가 3~5년에 걸쳐 총 1,720만 달러를 지원하기로 약속했다. 이 자금의 일부는 AI 생성 콘텐츠 대응을 포함한 기술 업그레이드에 쓰일 예정이다. 한편 주요 AI 연구소들은 자사 모델을 연구 도구로 밀어붙이고 있다. Google DeepMind는 8월 Co-Scientist를 실험 계획 수립과 실험 장비 제어, 원고 생성까지 다루는 시스템으로 확장했고, Anthropic은 Claude가 로봇을 안내해 실험을 수행하는 생물학 실험실을 짓고 있다. OpenAI는 9월 사람의 감독 아래 정해진 연구 과제를 처리하는 '자동화된 연구 인턴'을 발표했다.

개발자 입장에서 가장 직접적인 변화는 제출 계획이다. 여러 편을 한꺼번에 올려 실적을 쌓아 온 개인이나 팀은 월 단위로 일정을 다시 짜야 한다. 반대로 공저자 지위는 제한에 걸리지 않으므로, 여러 편을 준비하는 프로젝트라면 누가 실제 제출자가 될지를 나눠 맡기는 방식이 유효하다. 반려와 삭제의 카운트 규칙도 미리 계산에 넣어야 한다. cs.AI처럼 투고가 몰리는 카테고리에서는 심사 지연이 더 길어질 수 있고, LLM이 만든 문장과 인용을 검증 없이 붙여 넣는 관행은 이제 투고 자격 자체를 위협한다.

arXiv는 이번 상한을 자체 모더레이션 도구가 충분히 확장될 때까지의 임시 조치로 규정한다. Dietterich도 나중에 상한을 올리거나 없앨 수 있기를 바란다고 밝혔다. 자동화된 연구가 실제로 어디까지 갈 수 있는지도 아직 열린 문제다. 프린스턴대와 영국 AI Safety Institute가 함께한 연구에서는 Claude Opus 4.8이 미공개 NeurIPS 논문 두 편의 연구 질문에 6일간 매달렸지만, 원저자들이 리뷰어로 나선 검토에서 두 결과 모두 거부됐다.