needhelp
← Back to blog

AI 시대 프로그래밍·알고리즘 대회의 위기

by needhelp
AI
Competitive Programming
Algorithm
Education
Academic Integrity

명단은 비율이 아니다

2026년 8월 30일, 2026 Baidu Star 1차전에 관한 X 게시물이 부정행위 49건과 별도의 위반 명단을 공개했다. 게시물은 올해 첫 공개분이 부정행위 49명, 위반 63명이며 2년 전에는 관련자가 30명이었다고 말한다. 첨부 이미지에서 확인되는 것은 부정행위 49행과 위반 57행이다. 위반 표에는 1–25행과 32–63행이 보이고 26–31행은 보이지 않는다. 이는 사건의 신호이지, 완전하게 독립 검증된 데이터셋은 아니다. 원 게시물

확인 가능한 106개 행은 87개 학교에 분산되어 있다. 부정행위 표는 45개 학교, 위반 표의 확인 가능한 부분은 50개 학교다. 대부분의 학교는 한 번만 등장하며, 가장 많이 등장한 세 학교의 비중도 각각 6/49와 8/57이다. 소수 학교에 집중된 현상으로 보기는 어렵다.

표에는 중학교, 고등학교, 대학과 직업교육기관이 함께 나온다. 학교별 참가자 수와 위반 유형이 없으므로 행의 수를 학교별 비율이나 순위로 바꿀 수 없다.

규정은 “ChatGPT 금지”에서 코드 출처 관리로 이동한다

Codeforces의 2024년 규정은 직접 번역과 작은 문법 제안을 허용하지만, AI로 핵심 알고리즘을 만들거나 부분 문제를 이해하거나 오답을 수정하는 행위는 금지한다. 코드 유사성과 대회 전에 코드가 공개되었는지도 조사 신호가 될 수 있다. Codeforces 규정

AtCoder는 최근 AGC까지 생성형 AI 규정을 확대하고, AI 코드 자동완성과 AI를 이용한 언어 변환을 금지했으며, AI가 만든 검색 요약을 의도적으로 사용하는 것도 제한했다. 허용된 자동완성과 문제 해결 대행의 경계를 감시하기 어렵기 때문이다. AtCoder 규정 변경

DeepMind는 2022년 AlphaCode가 Codeforces의 10개 대회에서 인간 중위권 참가자 정도의 수준에 도달했다고 발표했다. 2023년 AlphaCode 2 보고서에는 10번의 시도 안에 43%의 문제를 해결했다는 결과가 있으며, 첫 AlphaCode는 25%였다. 평균 성능은 참가자의 85퍼센트보다 높다고 추정됐다. 이제 높은 순위만으로 비보조 인간 추론을 증명할 수 없다. AlphaCode AlphaCode 2 보고서

벤치마크 오염도 문제다. 공개 문제가 학습 데이터에 들어갈 수 있기 때문이다. LiveCodeBench는 Codeforces, AtCoder, LeetCode의 새 문제를 모아 코드 생성, 실행, 자기 수정, 테스트 출력 예측을 평가하며, v6에는 2025년 4월까지 공개된 1,055개 문제가 기록되어 있다. LiveCodeBench 저장소 LiveCodeBench 논문

대회는 인간 전용, AI 협업, 학습 모드로 나누는 편이 낫다. 인간 전용 모드에는 통제된 기기와 허용 기능 목록, 로그, 이의 제기 절차가 필요하다. AI 협업 모드에는 모델, 버전, 프롬프트, 수정 내용과 테스트를 기록하고 설명과 검증도 평가해야 한다. 프로그래밍 대회가 끝난 것은 아니지만, 온라인 순위표 하나가 학생의 전체 능력을 설명할 수는 없다. 2026 수학 모델링 대회 AI 규정

참고 자료

Share this page