GitHub는 Copilot CLI에서 요청마다 단일 모델, 저비용 초안 뒤 상위 모델로 올리는 Cascade, 다른 모델군이 읽기 전용으로 검토하는 Critique 중 하나를 고르는 HydraFusion 연구 프리뷰를 열었습니다. 통제된 오프라인 평가에서 Claude Opus 5 대비 TerminalBench 2.1 검증 품질은 4.9%포인트 높고 추정 비용은 67% 낮았습니다. DeepSWE와 내부 CheckpointBench에서는 비용을 각각 36%, 65% 줄인 대신 품질이 1.5%포인트, 0.1%포인트 낮았으며, 결과는 특정 모델 풀과 가격 가정에 한정됩니다.