Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
audio.cpp는 ggml 위에 구축된 순수 C++ 오디오 추론 프레임워크로, 파이썬 환경 없이 음성 합성·음성 인식·음원 분리·보이스 컨버전·음악 생성 모델을 하나의 네이티브 런타임에서 실행한다. 2026년 6월 공개 이후 두 달 만에 44개 모델 패밀리를 지원하는 규모로 확장됐고, VibeVoice·Higgs Audio v3·Qwen3-ASR·VoxCPM2·Stable Audio 3 같은 모델을 GGUF 양자화 상태로 돌릴 수 있다. CUDA·ROCm·Vulkan·Metal·CPU 백엔드를 모두 갖춰, 콘다 환경과 의존성 충돌 없이 로컬 오디오 AI를 배포하려는 개발자에게 유용하다.
openai
99개+ 언어 지원 범용 음성 인식 모델 - GitHub 96K 스타
coqui-ai
1100개 이상 언어를 지원하는 오픈소스 음성 합성 딥러닝 도구 모음
suno-ai
Suno AI의 텍스트-오디오 생성 모델 - 다국어 음성, 음악, 효과음 생성
RVC-Project
10분 이하 음성으로 학습하는 retrieval 기반 음성 변환 WebUI