텐센트, 음성 생성·편집 모델 'AuK' 공개..."오디오용 나노바나나"
텐센트가 텍스트를 음성으로 변환하는 것은 물론 기존 음성의 내용과 음색, 감정, 억양 등을 자연어 지시만으로 수정할 수 있는 오픈소스 AI 모델을 공개했다. 하나의 모델에서 음성 생성과 편집을 통합적으로 처리한다는 점을 강조하며 ‘오디오용 나노바나나(Nano Banana for Audio)’라는 별칭을 내세웠다.텐센트는 10일(현지시간) 음성 생성 및 편집을 통합한 AI 파운데이션 모델 ‘AuK’를 공개했다.자연어 지시어와 참조 오디오를 하나의 인터페이스에서 처리하는 통합 모델이다. 기존에는 음성 생성과 음성 편집, 음질 개선 등에
AI타임스 · 2026. 09. 15. 오전 02:50