최신 뉴스

전체 뉴스

가장 최근에 발행된 뉴스부터 확인하세요.

주제별로 좁혀보기 · 사진·영상·생성미디어
일반 기사
AI 활용

mlsubgen — subtitles in 45 languages for your videos, entirely on your own machine

전체 요약

mlsubgen은 45개 언어의 자막을 개인 컴퓨터에서 만들 수 있게 해주는 도구입니다. 저자가 태국에 살면서 처음에는 친구들의 요청으로 시작했지만, 지금은 다양한 언어를 지원하는 일반적인 도구로 발전했습니다. 이 도구는 여러 언어의 대화를 동시에 인식하고, 기존 인간 작업을 우선적으로 사용하며, Blu-ray 재mux 파일에서도 자막을 추출합니다. 하지만 Linux와 NVIDIA GPU만 지원하며, 성능은 메모리 크기에 따라 달라집니다.

핵심 보기
원문 보기
AI 활용

Voice Acting Arena

전체 요약

Voice Acting Arena라는 새로운 AI 음성 연기 평가 플랫폼이 출시되었습니다. 두 명의 익명 AI가 동일한 장면과 스크립트를 연기하고, 그들의 연기를 비교해봅니다. 실제 연기와 얼마나 비슷한지, 지시사항을 잘 따랐는지 등을 평가합니다. 이 플랫폼은 AI 음성 모델의 성능을 향상시키는데 도움이 될 것입니다. 관심 있는 분들은 청크를 착용하고 몇 가지 비교 시험을 해보세요.

핵심 보기
원문 보기
AI 활용

텐센트, 음성 생성·편집 모델 'AuK' 공개..."오디오용 나노바나나"

전체 요약

텐센트는 음성 생성과 편집을 통합한 AI 모델 'AuK'를 공개했다. 이 모델은 자연어 지시만으로 기존 음성의 내용, 음색, 감정, 억양 등을 수정할 수 있다. 이전에는 각각의 작업이 별도로 이루어졌으나, 이제 하나의 인터페이스에서 처리 가능해졌다. 텐센트는 이를 '오디오용 나노바나나'라고 부르며, 이 모델은 음성 AI 분야에서 혁신을 가져올 것으로 기대된다. 그러나 원문에는 구체적인 수치나 인물명이 없어, 이 모델의 성능이나 적용 범위에 대한 정보는 제공되지 않았다.

핵심 보기
원문 보기
AI 활용

챗GPT 이미지 2.5 정리: 전 요금제에 열렸는데, 자동화에서는 2.5를 못 고릅니다

전체 요약

OpenAI는 2026년 9월 8일 챗GPT 이미지 2.5를 공개했어요. 이 모델은 인물과 사물을 정확하게 수정하고, 여러 번 고쳐도 화질이 안 떨어지는 게 특징이에요. 생성 속도는 50% 더 빠르고, 토큰 단가도 같아요. 하지만 구독 경로에서는 모델을 무시하고 API만 쓸 수 있어요. 이 점 때문에 자동화 작업은 API 키를 사용해야 해요.

핵심 보기
원문 보기