구글이 AI 모델 성능 평가의 공정성을 높이기 위해 암호화 기술 기반 이중맹검 평가 시스템을 시범 운영한다고 발표했어요. 이 기술은 AI 모델이 평가 데이터를 미리 학습해 성능을 조작하는 벤치마크 오염 문제를 해결하기 위함이에요. 구글 딥마인드는 이중맹검 평가 기술 보고서를 공개하며, 평가자가 벤치마크 문제를 미리 알 수 있는 기존 방식의 한계를 극복하고자 노력하고 있다고 설명했어요.