Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
TTS로 만든 단일 채널(모노) 음성을 헤드폰용 바이노럴 스테레오로 렌더링하는 Python 도구다. Neumann KU100 더미 헤드로 25cm부터 실측한 근거리(near-field) HRIR 데이터를 사용해 귓가에서 말하는 듯한 저역 상승과 양 귀 음량 차이를 재현한다. 원고에 [左耳]·[右耳]·[脑后]·[面前]·[贴近]·[退开] 같은 위치 태그를 넣으면 말하는 동안 머리 주변을 천천히 이동하고, 숨 쉬는 쉼 구간에서는 움직이지 않는다. ElevenLabs 타임스탬프 API 연동 예제를 제공하며, 헤드폰 전용·수평면 한정이라는 한계가 명시되어 있다.
CorentinJ
5초 음성으로 즉시 목소리 복제 가능한 실시간 TTS 시스템
RVC-Boss
1분 음성으로 고품질 TTS 모델 훈련 가능한 음성 변환 웹UI
2noise
대화형 AI를 위한 자연스러운 음성 생성, 중영 이중언어 지원
babysor
5초 음성으로 목소리를 복제하는 실시간 음성 클로닝 TTS