Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
기타·베이스 앰프와 이펙터 페달의 소리를 신경망으로 재현하는 오디오 모델링 프로젝트입니다. 회로를 수식으로 모사하는 기존 방식 대신, 기기에 들어간 DI 신호와 그 기기를 거쳐 나온 리앰프 신호 두 파일을 짝지어 학습시켜 입력 파형이 출력 파형으로 어떻게 변형되는지를 직접 학습합니다. 학습 결과는 .nam 파일로 내보내고, 별도 저장소로 제공되는 VST3·AudioUnit 플러그인에서 실시간 연주에 사용합니다. 이 저장소는 학습과 내보내기를 담당하는 파이썬 패키지이며, WaveNet과 순환신경망 등 여러 아키텍처 구현과 GUI·CLI·Colab 학습 경로를 함께 제공합니다.
openai
99개+ 언어 지원 범용 음성 인식 모델 - GitHub 96K 스타
coqui-ai
1100개 이상 언어를 지원하는 오픈소스 음성 합성 딥러닝 도구 모음
suno-ai
Suno AI의 텍스트-오디오 생성 모델 - 다국어 음성, 음악, 효과음 생성
RVC-Project
10분 이하 음성으로 학습하는 retrieval 기반 음성 변환 WebUI