Claude Code 사용자가 같은 다섯 작업을 높은 노력 수준과 중간 수준으로 비교해 출력 토큰이 약 45% 줄었다는 경험을 소개했다. 간단한 수정에는 추론 자원을 줄이고 복잡한 디버깅에는 더 배정하는 접근이다. 지원하는 단계와 기본값은 모델마다 다르며 적은 토큰이 곧 같은 품질을 보장하지는 않는다. 자신의 작업에서 정답률과 재작업 비용을 함께 측정해 설정을 고르는 데 참고할 수 있다.