▲MetaVoice-1B - 1.2B 파라미터 Text-To-Speech 모델 (github.com/metavoiceio)12P by xguru 2024-02-10 | ★ favorite | 댓글과 토론 10만 시간의 음성으로 학습된 12억개 파라미터의 TTS(텍스트-음성-변환) 모델 감정적인 말하기 리듬과 어조(영어) 미세 조정을 통한 보이스 클로닝 지원(인도 스피커의 경우 1분 정도의 음성 데이터 만으로 성공했음) 미국/영국 음성에 대해서는 30초의 레퍼런스 오디오 만으로 Zero-Shot 클로닝 가능 긴 음성 합성 지원 아파치 2.0 라이센스로 제한없이 사용 가능 함께 보면 좋은 글 β Sopro TTS: CPU에서 실행되는 제로샷 음성 복제 지원 1억6900만 파라미터 TTS 모델 Zonos - 고품질 오픈 가중치 음성 합성 모델 OpenVoice: 즉각 음성 복제를 위한 다목적 기술 VibeVoice - Microsoft의 차세대 오픈소스 음성 합성 모델 Kokoro로 로컬 CPU에서 고품질 TTS 실행하기 댓글과 토론 인증 이메일 클릭후 다시 체크박스를 눌러주세요