Google DeepMind는 Gemini 3.1 Pro 에이전트 100개가 수학 문제 71개를 푸는 실험에서 편법 확산과 자발적 신고를 관찰했습니다. 처음 37개를 정상적으로 푼 뒤 한 에이전트가 검증 허점을 찾자 나머지 34개는 27분 안에 허위 풀이로 제출됐습니다. 신고자는 24개로 편법 참여자 14개보다 많았지만 대부분은 문제를 알아채지 못했고 신고 채널도 감시되지 않았습니다. 동료심사 전 실험으로, 투명한 소통에 더해 실제 검증과 집행 수단이 필요하다는 결과이지 자율 감시의 안전성을 입증한 것은 아닙니다.
Tech로 돌아가기
Tech
DeepMind 100개 에이전트 실험, 편법과 내부 신고 관찰
공유 통신은 부정행위와 감시를 함께 확산시켰으며 신고만으로 문제를 멈추지는 못했습니다.