arXiv의 1년 ban 경고, AI 논문 쓰기보다 검증 책임이 먼저인 이유
Original: ArXiv to Ban Researchers for a Year if They Submit AI Slop View original →
arXiv가 생성형 AI로 만든 흔적이 명백한 논문 제출물에 더 강한 제재를 적용하겠다는 방침으로 다시 주목받았다. 404 Media 보도에 따르면, arXiv 컴퓨터과학 섹션 의장 Thomas Dietterich는 LLM 출력의 부적절한 문구, 표절, 편향, 오류, 잘못된 참고문헌, 오해를 부르는 내용을 저자가 그대로 포함했다면 책임은 저자에게 있다고 설명했다.
핵심은 AI 사용 금지가 아니다. 저자가 결과를 확인하지 않았다는 “반박하기 어려운 증거”가 제출물에 남아 있으면 신뢰가 무너진다는 기준이다. 예시는 hallucinated references, “200단어 요약을 만들었다” 같은 LLM의 메타 코멘트, “이 표는 예시이니 실제 숫자로 채우라”는 안내문이 논문 안에 남은 경우다. 이런 수준의 흔적은 도구 사용보다 검토 실패에 가깝다.
r/artificial의 토론은 학술 출판이 AI 생성 텍스트를 어떻게 다뤄야 하는지로 이어졌다. 연구자가 초안 작성이나 문장 정리에 AI를 쓰는 일은 이미 흔하지만, 참고문헌과 수치, 주장까지 검증하지 않으면 학술 기록 전체의 비용이 커진다. 사전심사 저장소인 arXiv는 빠른 공개를 장점으로 삼지만, 명백한 검증 실패가 반복되면 moderation 부담도 함께 늘어난다.
404 Media 보도와 Reddit 게시물은 2026년 6월 8일 생성돼 72시간 기준 안에 들어왔다. 제재는 1년 ban과 이후 평판 있는 peer-reviewed venue 승인 요구로 설명됐다. 메시지는 단순하다. AI로 썼는지보다, 저자가 자기 이름으로 낼 만큼 확인했는지가 기준이다.
Related Articles
Bristol Myers Squibb가 8대 DGX Vera Rubin NVL72 기반 두 번째 DGX SuperPOD를 도입해 전 세계 연구자가 쓰는 단일 AI 환경을 만든다. 기존 AI cluster에서 target identification 시간을 몇 주 줄인 뒤, drug discovery 전 과정으로 compute를 확대하는 결정이다.
미국 DOE light source 시설의 데이터 병목이 AI 실험 자동화 과제로 커졌다. Meta는 Berkeley Lab의 SYNAPS-I 프로젝트가 SAM 3와 DINOv3로 초당 100,000장까지 늘어난 detector 데이터를 처리한다고 소개했다.
임상 예시 문제가 아니라 실제 사용자가 말한 증상 대화 13,917건이 평가 대상이 됐습니다. Google Research의 SymptomAI 연구는 AI symptom checker 논의를 “의료 시험 문제 풀이”에서 원격 문진과 wearable biosignal 검증으로 옮깁니다.