SlopCodeBench를 검토한 분석은 생성 코드의 장황성 0.33과 복잡한 함수에 코드가 몰리는 침식도 0.68이 기존 저장소의 0.15와 0.31보다 높았다고 설명했습니다. 단계별로 요구사항을 추가하고 문맥을 초기화한 실험에서는 평가 모델 모두 모든 단계의 테스트를 완전히 통과하지 못했습니다. 다만 기준의 엄격함과 일부 설명의 모호성이라는 한계가 있고 Astra와 Fable 5.1은 대상이 아니었습니다. 줄 수만 줄이기보다 결합도와 설계 누적을 함께 검토해야 합니다.
Tech로 돌아가기
Tech
SlopCodeBench, AI 코드 중복과 복잡도 증가 측정
테스트 통과만으로 유지보수성을 판단할 수 없으며, 수치 최적화에 치우치지 않는 사람의 검토가 필요합니다.