Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
Music Source Separation Training은 보컬·악기 스템 분리 모델을 학습하기 위한 범용 코드베이스입니다. MDX23C, HTDemucs4, BS-RoFormer, Mel-Band RoFormer, SCNet, BandIt v2, Apollo, Conformer 등 15종 이상의 최신 아키텍처를 --model_type 옵션 하나로 선택해 학습할 수 있습니다. MUSDB18 데이터셋 기준 설정 예시가 포함돼 있고, 기존 체크포인트를 이어받아 파인튜닝하는 것도 지원합니다. 음원 분리 서비스 MVSep.com이 SDX23 챌린지 코드를 기반으로 개발해 실전 검증을 거쳤으며, 2026년 8월 기준으로도 활발히 업데이트되고 있습니다. 라이선스는 MIT입니다.
openai
99개+ 언어 지원 범용 음성 인식 모델 - GitHub 96K 스타
coqui-ai
1100개 이상 언어를 지원하는 오픈소스 음성 합성 딥러닝 도구 모음
suno-ai
Suno AI의 텍스트-오디오 생성 모델 - 다국어 음성, 음악, 효과음 생성
RVC-Project
10분 이하 음성으로 학습하는 retrieval 기반 음성 변환 WebUI