Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
음성 합성과 전사를 한 데스크톱 앱 안에서 처리하는 로컬 우선 음성 작업 도구입니다. 기존 OmniVoice-Studio에서 이름을 바꾼 프로젝트로, 16개 TTS 엔진과 11개 ASR 엔진을 모델 카탈로그에서 골라 끼우는 구조를 택했습니다. 짧은 참조 음성으로 목소리를 복제하고, 영상 더빙과 받아쓰기, EPUB·PDF를 넣어 챕터별 오디오북을 만드는 작업 흐름을 갖췄습니다. 계정이나 API 키 없이 로컬에서 동작하며 음성·프로젝트·결과물이 기본적으로 사용자 기기에 남습니다.
CorentinJ
5초 음성으로 즉시 목소리 복제 가능한 실시간 TTS 시스템
RVC-Boss
1분 음성으로 고품질 TTS 모델 훈련 가능한 음성 변환 웹UI
2noise
대화형 AI를 위한 자연스러운 음성 생성, 중영 이중언어 지원
babysor
5초 음성으로 목소리를 복제하는 실시간 음성 클로닝 TTS