텐센트, 음성 생성·편집 모델 'AuK' 공개..."오디오용 나노바나나"
텐센트는 음성 생성과 편집을 통합한 AI 모델 'AuK'를 공개했다. 이 모델은 자연어 지시만으로 기존 음성의 내용, 음색, 감정, 억양 등을 수정할 수 있다. 이전에는 각각의 작업이 별도로 이루어졌으나, 이제 하나의 인터페이스에서 처리 가능해졌다. 텐센트는 이를 '오디오용 나노바나나'라고 부르며, 이 모델은 음성 AI 분야에서 혁신을 가져올 것으로 기대된다. 그러나 원문에는 구체적인 수치나 인물명이 없어, 이 모델의 성능이나 적용 범위에 대한 정보는 제공되지 않았다.
텐센트는 음성 생성과 편집을 통합한 AI 모델 'AuK'를 공개했다. 이 모델은 자연어 지시만으로 기존 음성의 내용, 음색, 감정, 억양 등을 수정할 수 있다. 이전에는 각각의 작업이 별도로 이루어졌으나, 이제 하나의 인터페이스에서 처리 가능해졌다. 텐센트는 이를 '오디오용 나노바나나'라고 부르며, 이 모델은 음성 AI 분야에서 혁신을 가져올 것으로 기대된다. 그러나 원문에는 구체적인 수치나 인물명이 없어, 이 모델의 성능이나 적용 범위에 대한 정보는 제공되지 않았다.
음성 콘텐츠를 다루는 사람은 다시 녹음하지 않고 원하는 부분만 고칠 수 있는 길이 생겼다
녹음해둔 음성 하나를 올려 말로 지시해 감정이나 음색을 바꿔보세요 — 15분
원문 읽기이어서 볼 것
이 글을 읽은 뒤 바로 이어볼 수 있는 추천
더 읽기로 감을 넓히고, 사례를 본 뒤, 필요하면 참여나 도구로 넘어가면 됩니다.
다음 행동
아직 댓글이 없습니다. 첫 댓글을 작성해보세요!