텐센트 연구진의 Gander는 음성 대화를 맡는 모델과 복잡한 추론 및 작업을 수행하는 에이전트를 분리합니다. 뒤쪽 에이전트는 Codex나 Claude Code처럼 교체할 수 있고, 사용자는 작업 중에도 말을 끊거나 지시를 추가할 수 있습니다. 연구진 보고에서 대화 개입 시점은 100개 시나리오 모두 적절했고 사용자 발화 방해 비율은 8%였지만, 과제 정확도와 일부 시청각 이해는 약했습니다. 가중치와 학습 데이터는 공개 절차 이후 배포할 계획이므로, 현재 결과는 초기 연구와 자체 평가 범위로 봐야 합니다.