3

TTS
티티에스
음성 AI 분야에서 쓰이는 Text-to-Speech(텍스트 음성 변환)의 약자로, 글로 된 문장을 사람 목소리 같은 음성으로 바꿔 주는 기술입니다. 음성을 텍스트로 옮기는 STT의 반대 방향입니다. 2016년 DeepMind의 WaveNet이 파형을 직접 생성하는 딥러닝 방식으로 품질을 크게 끌어올린 뒤, 지금은 몇 초 분량 샘플로 특정인의 목소리를 재현하는 수준까지 왔습니다. 내레이션·더빙·AI 상담·음성 에이전트에서 '입' 역할을 맡습니다.
모델·서비스
Udio
우디오
AI 활용 분야에서 미국 Uncharted Labs가 2024년에 공개한 텍스트 기반 음악 생성 서비스로, Google DeepMind 출신 팀이 만든 보컬·악기 사실성에 강점을 둔 Suno 경쟁 서비스입니다.
모델·서비스
Veo
베오
AI 활용 분야에서 Google DeepMind가 2024년에 공개한 텍스트 기반 영상 생성 모델 시리즈로, 사용자가 한 줄 설명만 입력해도 사실적인 단편 영상을 1080p 해상도로 자동으로 만들어 줍니다.
모델·서비스
검색 · AI for Everyone