산업
바이트댄스, 인간-사물 상호작용까지 반영하는 영상 AI ‘옴니쇼’ 공개
텍스트·이미지·오디오·포즈를 한번에 이해하고, 사람과 사물의 자연스러운 상호작용까지 구현하는 영상 생성 AI가 등장했다. 바이트댄스는 13일현지시간 텍스트와 이미지, 오디오, 포즈 데이터를 동시에 활용해 영상을 생성하는 차세대 AI 모델 ‘옴니쇼OmniShow’를 온라인 아카이브를 통해 공개했다.기존 영상 생성 AI의 한계를 넘어, 인간과 사물 간의 자연스러운 상호작용까지 구현했다는 점에서 주목받고 있다.영상 생성 AI는 빠르게 발전해 왔지만, 캐릭터가 물체를 잡거나 움직이는 과정에서 손이 물체를 뚫고 지나가거나 형태가 왜곡
이 콘텐츠는 AI타임스 원본 기사의 요약입니다. 전문은 원본 사이트에서 확인해주세요.
원문 기사 보기 →