needhelp
← Back to blog

Кризис соревнований по программированию и алгоритмам в эпоху ИИ

by needhelp
AI
Competitive Programming
Algorithm
Education
Academic Integrity

Список не равен уровню нарушений

30 августа 2026 года публикация в X о первом туре Baidu Star 2026 показала таблицу из 49 случаев мошенничества и отдельную таблицу нарушений. Автор пишет о 49 случаях мошенничества и 63 нарушениях в первой партии против 30 человек двумя годами ранее. На приложенных изображениях видны 49 строк о мошенничестве и 57 строк о нарушениях: присутствуют строки 1–25 и 32–63, а строки 26–31 отсутствуют. Это сигнал инцидента, а не полный независимо проверенный набор данных. Исходная публикация

106 видимых записей относятся к 87 школам. В списке случаев мошенничества 49 записей из 45 школ, в видимой части списка нарушений 57 записей из 50 школ. Большинство школ встречается один раз; три наиболее частые школы дают 6/49 и 8/57 записей соответственно. Поэтому картина выглядит распределённой, а не сосредоточенной в нескольких учреждениях.

В таблице есть средние школы, университеты и профессиональные колледжи. Без числа участников и точной классификации нарушения число записей нельзя превращать в рейтинг школ.

Правила переходят к контролю происхождения кода

Правила Codeforces 2024 разрешают прямой перевод и небольшие синтаксические подсказки, но запрещают просить ИИ придумать основной алгоритм, решить подзадачу или исправить отклонённое решение. При расследовании могут учитываться сходство программ и то, был ли код опубликован до соревнования. Правила Codeforces

AtCoder недавно распространил ограничения на AGC, запретил AI-автодополнение и преобразование языков с помощью ИИ, а также ограничил намеренное использование AI-обзоров в поиске. Причина практическая: разрешённое автодополнение трудно отделить от подсказки, которая уже заменяет решение участника. Изменения правил AtCoder

В 2022 году DeepMind сообщил, что AlphaCode достиг примерно уровня среднего участника на десяти соревнованиях Codeforces. В отчёте AlphaCode 2 за 2023 год указаны 43% решённых задач за десять попыток против 25% у первой версии и оценка выше 85-го процентиля участников. Значит, высокий результат больше нельзя автоматически считать доказательством самостоятельного человеческого рассуждения. AlphaCode AlphaCode 2

Есть и проблема загрязнения бенчмарков: публичные задачи могут попасть в обучающие данные. LiveCodeBench собирает новые задачи с Codeforces, AtCoder и LeetCode, проверяя генерацию, выполнение, саморемонт и предсказание вывода; версия v6 содержит 1055 задач, опубликованных до апреля 2025 года. Репозиторий LiveCodeBench Статья LiveCodeBench

Конкурсы стоит разделить на человеческий режим, режим работы с ИИ и учебный режим. В первом нужны контролируемое устройство, список разрешённых функций, логи и апелляция; во втором — раскрытие модели, версии, запросов, изменений и тестов; в третьем — разбор ошибок модели и доказательство итогового решения. Конкурсы по программированию не исчезают, но одна онлайн-таблица больше не описывает всю способность студента.

Правила национального конкурса математического моделирования Китая 2026 года уже отдельно упоминают языковые модели, генеративный ИИ, помощников по коду и агентов. Следующий стандарт должен оценивать не только выдачу кода, но и объяснение, проверку и способность обнаружить ошибку. Правила по ИИ в конкурсе моделирования

Источники

Share this page