Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
FreyaTTS-small은 Freya(YC S25)가 공개한 1억 8,300만 파라미터 규모의 터키어 특화 텍스트-음성 변환 모델이다. 음소 변환기(G2P) 없이 92개 문자 단위로 터키어를 직접 읽고, 고정된 AudioVAE2 잠재 공간에서 비자기회귀 조건부 flow-matching DiT로 음성을 생성해 48kHz 오디오를 출력한다. README 기준 RTX 4090에서 RTF 0.10~0.11, VRAM 1.5GB로 동작하며 Apple M3 노트북 CPU에서도 실시간 합성이 가능하다. 공개 평가셋 Freya-TR-Eval에서 WER 8.0%를 기록했다. 화자 임베딩 없이 시드 값이 목소리를 결정하는 구조이며, 가중치·추론 코드·학습 파이프라인이 Apache-2.0으로 공개됐다.
CorentinJ
5초 음성으로 즉시 목소리 복제 가능한 실시간 TTS 시스템
RVC-Boss
1분 음성으로 고품질 TTS 모델 훈련 가능한 음성 변환 웹UI
2noise
대화형 AI를 위한 자연스러운 음성 생성, 중영 이중언어 지원
babysor
5초 음성으로 목소리를 복제하는 실시간 음성 클로닝 TTS