GitHub는 Copilot CLI에서 요청마다 단일 모델, 저비용 초안 뒤 상위 모델로 올리는 Cascade, 다른 모델군이 읽기 전용으로 검토하는 Critique 중 하나를 고르는 HydraFusion 연구 프리뷰를 열었습니다. 통제된 오프라인 평가에서 Claude Opus 5 대비 TerminalBench 2.1 검증 품질은 4.9%포인트 높고 추정 비용은 67% 낮았습니다. DeepSWE와 내부 CheckpointBench에서는 비용을 각각 36%, 65% 줄인 대신 품질이 1.5%포인트, 0.1%포인트 낮았으며, 결과는 특정 모델 풀과 가격 가정에 한정됩니다.
Tech로 돌아가기
Tech
GitHub HydraFusion이 코딩 작업마다 모델 흐름을 조립합니다
추가 모델 호출의 비용과 지연을 감수할 작업을 자동 판별하는 능력이 코딩 에이전트 경쟁의 새 축입니다.