Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
Breeze TTS 2는 미국 스타트업 BreezeBlue가 2026년 8월 25일 공개한 오픈 웨이트 실시간 음성 합성 모델이다. Artificial Analysis TTS 리더보드에서 오픈 웨이트 모델 중 1위를 기록했으며, Fish Audio S2 Pro 등 기존 상용 모델을 앞섰다고 밝혔다. 참조 음성 없이 자연어 설명만으로 목소리를 만드는 Voice Design, 참조 음성의 화자 정체성은 유지한 채 톤·감정·속도를 지시문으로 조절하는 Voice Direction, 기존 방식의 Voice Clone까지 세 가지 생성 모드를 지원한다. NVIDIA H100 기준 워밍업 후 첫 오디오 출력까지 40ms 미만, 실시간 대비 약 3.1배 속도(RTF 0.32)를 낸다. 영어·중국어를 하나의 모델로 지원하며, 추론 코드는 Apache-2.0로 공개됐지만 모델 가중치와 파생 모델은 연구·비상업적 용도로만 사용할 수 있는 별도 라이선스가 적용된다.
CorentinJ
5초 음성으로 즉시 목소리 복제 가능한 실시간 TTS 시스템
RVC-Boss
1분 음성으로 고품질 TTS 모델 훈련 가능한 음성 변환 웹UI
2noise
대화형 AI를 위한 자연스러운 음성 생성, 중영 이중언어 지원
babysor
5초 음성으로 목소리를 복제하는 실시간 음성 클로닝 TTS