산업
텐센트, 음성 생성·편집 모델 'AuK' 공개..."오디오용 나노바나나"
텐센트가 텍스트를 음성으로 변환하는 것은 물론 기존 음성의 내용과 음색, 감정, 억양 등을 자연어 지시만으로 수정할 수 있는 오픈소스 AI 모델을 공개했다. 하나의 모델에서 음성 생성과 편집을 통합적으로 처리한다는 점을 강조하며 ‘오디오용 나노바나나Nano Banana for Audio’라는 별칭을 내세웠다.텐센트는 10일현지시간 음성 생성 및 편집을 통합한 AI 파운데이션 모델 ‘AuK’를 공개했다.자연어 지시어와 참조 오디오를 하나의 인터페이스에서 처리하는 통합 모델이다. 기존에는 음성 생성과 음성 편집, 음질 개선 등에
이 콘텐츠는 AI타임스 원본 기사의 요약입니다. 전문은 원본 사이트에서 확인해주세요.
원문 기사 보기 →