AI 코드 오류 분류에서 70억 파라미터 소형 모델 코드라마가 매크로 F1 80.6%로 거대 모델 제미나이(71.9%)를 앞섰다. 학생들이 제출한 코드 4만 8646건을 담은 PyMETA 벤치마크…