بحران مسابقات برنامهنویسی و الگوریتم در عصر هوش مصنوعی
فهرست، نرخ تخلف نیست
در ۳۰ اوت ۲۰۲۶، پستی در X درباره دور اول Baidu Star 2026 جدولی شامل ۴۹ مورد تقلب و جدولی جداگانه برای تخلفها نشان داد. این پست میگوید در نخستین بخش ۴۹ مورد تقلب و ۶۳ تخلف پیدا شده، در حالی که دو سال قبل ۳۰ نفر درگیر بودند. در تصاویر ۴۹ ردیف تقلب و ۵۷ ردیف تخلف دیده میشود: ردیفهای ۱–۲۵ و ۳۲–۶۳ حاضرند، اما ۲۶–۳۱ دیده نمیشوند. این یک نشانه از حادثه است، نه مجموعهدادهای کامل و مستقلًا راستیآزماییشده. پست اصلی
۱۰۶ ردیف قابل مشاهده به ۸۷ مدرسه مربوط است. فهرست تقلب ۴۵ مدرسه و بخش قابل مشاهده فهرست تخلف ۵۰ مدرسه را شامل میشود. بیشتر مدارس فقط یک بار ظاهر میشوند؛ سه مدرسه پرتکرار بهترتیب ۶/۴۹ ردیف تقلب و ۸/۵۷ ردیف تخلف دارند. بنابراین نتیجه بیشتر پراکنده است تا متمرکز در چند مدرسه.
در فهرست، دبیرستانها، دانشگاهها و مؤسسات حرفهای کنار هم آمدهاند. بدون تعداد شرکتکنندگان و نوع دقیق تخلف، تعداد ردیفها را نمیتوان به نرخ مدرسه تبدیل کرد.
قوانین از «ممنوعیت ChatGPT» به منشأ کد میرسند
قانون Codeforces در سال ۲۰۲۴ ترجمه مستقیم و پیشنهادهای کوچک نحوی را مجاز میداند، اما درخواست از هوش مصنوعی برای ساخت الگوریتم اصلی، توضیح زیربرنامه یا اصلاح پاسخ ردشده را ممنوع میکند. شباهت کد و انتشار آن پیش از مسابقه میتواند در بررسی یک نشانه باشد. قانون Codeforces
AtCoder اخیراً قوانین را به AGC گسترش داده، تکمیل کد با هوش مصنوعی و تبدیل زبان با AI را ممنوع کرده و استفاده عمدی از خلاصههای جستوجوی تولیدشده با AI را محدود کرده است. تشخیص مرز میان یک پیشنهاد کوچک و جایگزین شدن فرایند حل مسئله دشوار است. بهروزرسانی AtCoder
در سال ۲۰۲۲، DeepMind گزارش کرد که AlphaCode در ده مسابقه Codeforces تقریباً به سطح شرکتکننده انسانی میانه رسید. گزارش فنی AlphaCode 2 در سال ۲۰۲۳ حل ۴۳٪ مسائل در حداکثر ده تلاش را در برابر ۲۵٪ برای سیستم نخست بیان کرد و عملکرد میانگین را بالاتر از صدک ۸۵ برآورد کرد. رتبه بالا دیگر بهتنهایی نشاندهنده استدلال انسانی بدون کمک نیست. AlphaCode گزارش AlphaCode 2
بنچمارکها نیز با آلودگی روبهرو هستند، چون مسائل عمومی ممکن است وارد دادههای آموزشی شوند. LiveCodeBench مسائل تازه Codeforces، AtCoder و LeetCode را جمع میکند و تولید کد، اجرا، خودترمیمی و پیشبینی خروجی آزمون را میسنجد؛ نسخه v6 شامل ۱۰۵۵ مسئله منتشرشده تا آوریل ۲۰۲۵ است. مخزن LiveCodeBench مقاله LiveCodeBench
مسابقات باید دستکم سه حالت داشته باشند: فقط انسان، همکاری با AI و یادگیری. حالت نخست به دستگاه کنترلشده، فهرست قابلیتهای مجاز، لاگ و فرایند اعتراض نیاز دارد؛ حالت دوم باید مدل، نسخه، prompt، تغییرات و تستها را اعلام کند؛ حالت سوم باید از دانشجو بخواهد خطاهای AI و روش اعتبارسنجی پاسخ نهایی را توضیح دهد. مسابقات برنامهنویسی تمام نشدهاند، اما یک جدول رتبهبندی آنلاین دیگر تمام توانایی دانشجو را توصیف نمیکند. قوانین AI مسابقه مدلسازی ریاضی ۲۰۲۶