Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
독서 앱 LoudReader의 음성 엔진으로 쓰이는 로컬 TTS 툴킷이다. 자체 모델 loudr-1과 더 빠른 loudr-1-turbo를 쓰며(첫 실행 시 747MB 모델 다운로드), 영어 10종을 포함해 10개 언어 28개 음성을 제공하고 5~10초 녹음으로 약 150KB짜리 휴대용 보이스 프로필을 만들어 음성을 복제한다. 첫 다운로드 이후에는 계정·텔레메트리·사용료 없이 오프라인으로 동작한다. Python 외에 Swift(CoreML)·Go·Rust·TypeScript(ONNX Runtime) 네이티브 SDK가 같은 적합성 테스트를 통과하며, OpenAI 호환 /v1/audio/speech를 갖춘 HTTP 서버, gRPC, MCP 서버(프리뷰)로 에이전트에 붙일 수 있다. README 측정치로 RTX 3090에서 loudr-1이 실시간 대비 8.55배 속도를 낸다. 영어 외 9개 언어는 자동 검사만 거쳤고 원어민 청취 평가는 아직 없다고 밝힌다.
CorentinJ
5초 음성으로 즉시 목소리 복제 가능한 실시간 TTS 시스템
RVC-Boss
1분 음성으로 고품질 TTS 모델 훈련 가능한 음성 변환 웹UI
2noise
대화형 AI를 위한 자연스러운 음성 생성, 중영 이중언어 지원
babysor
5초 음성으로 목소리를 복제하는 실시간 음성 클로닝 TTS