Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
VieNeu-TTS는 베트남어에 특화된 온디바이스 음성 합성 모델로, 3~5초 분량 참조 음성만으로 목소리를 복제한다. v2는 1만 시간 이상의 영어·베트남어 데이터로 학습해 두 언어를 섞어 쓰는 코드 스위칭 발음을 처리하며, 화자를 자동 구분하는 팟캐스트·대화 모드를 제공한다. 미리보기로 공개된 v3 Turbo는 48kHz 출력, 기본 내장 음색, 뉴스·스토리텔링 등 낭독 스타일 선택, 텍스트에 삽입하는 비언어 감정 표현을 지원한다. GPU는 LMDeploy, CPU는 GGUF/ONNX 경로로 최적화해 PyTorch 없이도 완전 오프라인 추론이 가능하다.
CorentinJ
5초 음성으로 즉시 목소리 복제 가능한 실시간 TTS 시스템
RVC-Boss
1분 음성으로 고품질 TTS 모델 훈련 가능한 음성 변환 웹UI
2noise
대화형 AI를 위한 자연스러운 음성 생성, 중영 이중언어 지원
babysor
5초 음성으로 목소리를 복제하는 실시간 음성 클로닝 TTS