needhelp
← Back to blog

بحران مسابقات برنامه‌نویسی و الگوریتم در عصر هوش مصنوعی

by needhelp
AI
Competitive Programming
Algorithm
Education
Academic Integrity

فهرست، نرخ تخلف نیست

در ۳۰ اوت ۲۰۲۶، پستی در X درباره دور اول Baidu Star 2026 جدولی شامل ۴۹ مورد تقلب و جدولی جداگانه برای تخلف‌ها نشان داد. این پست می‌گوید در نخستین بخش ۴۹ مورد تقلب و ۶۳ تخلف پیدا شده، در حالی که دو سال قبل ۳۰ نفر درگیر بودند. در تصاویر ۴۹ ردیف تقلب و ۵۷ ردیف تخلف دیده می‌شود: ردیف‌های ۱–۲۵ و ۳۲–۶۳ حاضرند، اما ۲۶–۳۱ دیده نمی‌شوند. این یک نشانه از حادثه است، نه مجموعه‌داده‌ای کامل و مستقلًا راستی‌آزمایی‌شده. پست اصلی

۱۰۶ ردیف قابل مشاهده به ۸۷ مدرسه مربوط است. فهرست تقلب ۴۵ مدرسه و بخش قابل مشاهده فهرست تخلف ۵۰ مدرسه را شامل می‌شود. بیشتر مدارس فقط یک بار ظاهر می‌شوند؛ سه مدرسه پرتکرار به‌ترتیب ۶/۴۹ ردیف تقلب و ۸/۵۷ ردیف تخلف دارند. بنابراین نتیجه بیشتر پراکنده است تا متمرکز در چند مدرسه.

در فهرست، دبیرستان‌ها، دانشگاه‌ها و مؤسسات حرفه‌ای کنار هم آمده‌اند. بدون تعداد شرکت‌کنندگان و نوع دقیق تخلف، تعداد ردیف‌ها را نمی‌توان به نرخ مدرسه تبدیل کرد.

قوانین از «ممنوعیت ChatGPT» به منشأ کد می‌رسند

قانون Codeforces در سال ۲۰۲۴ ترجمه مستقیم و پیشنهادهای کوچک نحوی را مجاز می‌داند، اما درخواست از هوش مصنوعی برای ساخت الگوریتم اصلی، توضیح زیربرنامه یا اصلاح پاسخ ردشده را ممنوع می‌کند. شباهت کد و انتشار آن پیش از مسابقه می‌تواند در بررسی یک نشانه باشد. قانون Codeforces

AtCoder اخیراً قوانین را به AGC گسترش داده، تکمیل کد با هوش مصنوعی و تبدیل زبان با AI را ممنوع کرده و استفاده عمدی از خلاصه‌های جست‌وجوی تولیدشده با AI را محدود کرده است. تشخیص مرز میان یک پیشنهاد کوچک و جایگزین شدن فرایند حل مسئله دشوار است. به‌روزرسانی AtCoder

در سال ۲۰۲۲، DeepMind گزارش کرد که AlphaCode در ده مسابقه Codeforces تقریباً به سطح شرکت‌کننده انسانی میانه رسید. گزارش فنی AlphaCode 2 در سال ۲۰۲۳ حل ۴۳٪ مسائل در حداکثر ده تلاش را در برابر ۲۵٪ برای سیستم نخست بیان کرد و عملکرد میانگین را بالاتر از صدک ۸۵ برآورد کرد. رتبه بالا دیگر به‌تنهایی نشان‌دهنده استدلال انسانی بدون کمک نیست. AlphaCode گزارش AlphaCode 2

بنچمارک‌ها نیز با آلودگی روبه‌رو هستند، چون مسائل عمومی ممکن است وارد داده‌های آموزشی شوند. LiveCodeBench مسائل تازه Codeforces، AtCoder و LeetCode را جمع می‌کند و تولید کد، اجرا، خودترمیمی و پیش‌بینی خروجی آزمون را می‌سنجد؛ نسخه v6 شامل ۱۰۵۵ مسئله منتشرشده تا آوریل ۲۰۲۵ است. مخزن LiveCodeBench مقاله LiveCodeBench

مسابقات باید دست‌کم سه حالت داشته باشند: فقط انسان، همکاری با AI و یادگیری. حالت نخست به دستگاه کنترل‌شده، فهرست قابلیت‌های مجاز، لاگ و فرایند اعتراض نیاز دارد؛ حالت دوم باید مدل، نسخه، prompt، تغییرات و تست‌ها را اعلام کند؛ حالت سوم باید از دانشجو بخواهد خطاهای AI و روش اعتبارسنجی پاسخ نهایی را توضیح دهد. مسابقات برنامه‌نویسی تمام نشده‌اند، اما یک جدول رتبه‌بندی آنلاین دیگر تمام توانایی دانشجو را توصیف نمی‌کند. قوانین AI مسابقه مدل‌سازی ریاضی ۲۰۲۶

منابع

Share this page