Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
yovoice는 macOS와 Windows에서 텍스트를 음성으로 바꿔주는 로컬 음성 제작 도구다. 클라우드 API를 쓰지 않아 글자당 요금이 없고, 음성 복제·감정 조절·오디오 프로젝트 관리를 한 앱에서 처리한다. audio.cpp 엔진 위에서 IndexTTS 2.0/2.5, VoxCPM2, OmniVoice, Qwen3-TTS, Kokoro 중 원하는 모델을 골라 쓴다. 참조 음성·참조 연기를 따라 하거나 말투를 글로 설명해 조절할 수 있고, 자막을 불러와 스토리 더빙도 만든다. Apple Silicon은 Metal, Windows는 CPU·CUDA와 실험적 Vulkan 가속을 지원하며 CLI와 에이전트용 Skill도 있다. 라이선스는 Apache-2.0이고 일부 모델 가중치는 별도 라이선스를 따른다.
openai
99개+ 언어 지원 범용 음성 인식 모델 - GitHub 96K 스타
coqui-ai
1100개 이상 언어를 지원하는 오픈소스 음성 합성 딥러닝 도구 모음
suno-ai
Suno AI의 텍스트-오디오 생성 모델 - 다국어 음성, 음악, 효과음 생성
RVC-Project
10분 이하 음성으로 학습하는 retrieval 기반 음성 변환 WebUI