Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
HeartMuLa 팀이 2026년 9월 16일 코드와 가중치를 공개한 커버곡·리믹스 생성 모델이다. 레퍼런스 음원을 프레임 단위로 복사하지 않고 멜로디·화성·(선택적) 드럼 같은 기호적 리드시트로 변환한 뒤, 이를 사전학습된 text-to-song 백본에 게이트형 적응 교차 어텐션으로 주입한다. 레퍼런스 오디오에서 시작하거나 멜로디/코드 MIDI를 직접 넣을 수 있고, 원곡 가사를 유지하거나 새 가사로 바꾸면서 장르·악기·주제·분위기를 텍스트로 지정한다. 코드는 Apache-2.0이지만 모델 가중치와 생성 결과물은 비상업적 용도로만 사용할 수 있으며, NVIDIA GPU가 있는 Linux 환경을 요구한다.
openai
99개+ 언어 지원 범용 음성 인식 모델 - GitHub 96K 스타
coqui-ai
1100개 이상 언어를 지원하는 오픈소스 음성 합성 딥러닝 도구 모음
suno-ai
Suno AI의 텍스트-오디오 생성 모델 - 다국어 음성, 음악, 효과음 생성
RVC-Project
10분 이하 음성으로 학습하는 retrieval 기반 음성 변환 WebUI