Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
믹스된 완성곡 녹음 파일을 5인조 학교 밴드가 연주할 수 있는 반주 총보로 바꿔 주는 에이전트 스킬이다. 단독 앱이 아니라 SKILL.md 기반으로 에이전트가 작업 흐름을 따라가도록 설계됐다. Demucs로 시간 정렬된 분석용 스템을 분리하고, 구간·템포·박자·화성·베이스 진행·리프를 분석한 뒤 리드/리듬 기타, 베이스, 키보드, 드럼에 파트를 재배치한다. 초급·중급·고급 난이도를 지원하며 결과물은 MIDI, 인쇄용 PDF, 편집 가능한 MuseScore(.mscz) 파일로 출력된다. 기본적으로 로컬·무료 도구만 사용해 오디오를 유료 외부 API로 업로드하지 않는다. README는 모델 출력을 '증거'로만 취급하며 무오류 채보를 주장하지 않는다고 명시한다. 현재 초기 릴리스(v0.2.0) 단계다.
openai
99개+ 언어 지원 범용 음성 인식 모델 - GitHub 96K 스타
coqui-ai
1100개 이상 언어를 지원하는 오픈소스 음성 합성 딥러닝 도구 모음
suno-ai
Suno AI의 텍스트-오디오 생성 모델 - 다국어 음성, 음악, 효과음 생성
RVC-Project
10분 이하 음성으로 학습하는 retrieval 기반 음성 변환 WebUI