Anthropic의 다리오 아모데이가 외부 평가자가 첨단 모델 개발사의 내부 도구와 학습 체크포인트, 로그에 접근하는 평가 방식을 제안했고 OpenAI의 샘 올트먼도 취지에 동의한 것으로 보도됐습니다. 출시 직전 제한된 모델만 시험하는 것보다 개발 중 위험 신호를 살필 수 있다는 구상입니다. 다만 이미 시행 중인 공동 제도로 확정된 것은 아니며, 평가자에게 개발을 강제로 멈출 법적 권한을 주는 안도 아닙니다. 공개 보고의 독립성, 평가기관의 인력과 선택 방식이 실효성을 좌우합니다.