산업
구글, 세계 첫 AI 이중맹검 평가 시범 운영…'벤치마크 오염' 방지 나서
구글이 암호화 기술을 활용해 개발한 최첨단 AI 모델에 대한 이중맹검Doubleblind 평가를 시범 운영한다고 발표했다. AI 모델이 평가 전에 문제 데이터를 미리 학습해 성능 점수가 인위적으로 부풀려지는 '벤치마크 오염' 문제를 기술적으로 해결하겠다는 취지다.구글 딥마인드는 27일현지시간 세계 최초로 자체 개발한 이중맹검 평가 기술 보고서를 공개했다. 그동안 AI 업계의 한계로 지적되어 온 성능 평가 체계를 다듬기 위한 시도라는 설명이다.현재는 평가자가 벤치마크 문제를 공개하면, 개발사가 이를 모델에 학습할 위험이 있다
이 콘텐츠는 AI타임스 원본 기사의 요약입니다. 전문은 원본 사이트에서 확인해주세요.
원문 기사 보기 →