Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
dots studio가 공개한 20억(2B) 파라미터급 완전 연속(fully continuous) 엔드투엔드 자기회귀 TTS 시스템입니다. 음성을 이산 토큰(discrete token)으로 양자화하지 않고 48kHz 연속 잠재공간에서 곧바로 다루는 것이 특징이며, 저장소가 공개한 Seed-TTS-Eval 벤치마크에서 영어 WER 1.30%·화자유사도 77.1%, 중국어 WER 0.94%·유사도 81.0%를 기록했다고 밝힙니다. base·soar·mf 등 7종의 체크포인트를 함께 제공해 최고 화자유사도, 저지연 스트리밍, 음성 편집 등 용도별로 골라 쓸 수 있게 구성했습니다. 24개 언어에서 테스트를 거쳤고 라이선스는 Apache-2.0입니다.
CorentinJ
5초 음성으로 즉시 목소리 복제 가능한 실시간 TTS 시스템
RVC-Boss
1분 음성으로 고품질 TTS 모델 훈련 가능한 음성 변환 웹UI
2noise
대화형 AI를 위한 자연스러운 음성 생성, 중영 이중언어 지원
babysor
5초 음성으로 목소리를 복제하는 실시간 음성 클로닝 TTS