산업
아마존, AI 학습데이터 확보 위해 희귀 서적 수집하고 파괴
온라인 서점으로 출발한 아마존이 AI 모델 학습에 활용할 데이터를 확보하기 위해 희귀 서적을 대량으로 사들인 뒤 제본을 뜯고 스캔하고 있다는 정황이 포착됐다. 인터넷에 공개된 고품질 텍스트 데이터가 한계에 이르고 AI가 생성한 콘텐츠를 반복 학습하면 모델 성능이 저하될 수 있다는 우려가 커지면서, 온라인에서 구하기 어려운 절판·희귀 서적이 새로운 데이터 공급원으로 떠오르고 있다. 404미디어는 17일현지시간 추적 장치를 부착한 희귀 서적의 이동 경로를 추적한 결과, 아마존의 라스베이거스 시설인 ‘VGT3’로 운송된 사실을 확인했
이 콘텐츠는 AI타임스 원본 기사의 요약입니다. 전문은 원본 사이트에서 확인해주세요.
원문 기사 보기 →