Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요. LLM, Vision, Audio 등 다양한 카테고리의 프로젝트를 확인할 수 있습니다.
총 822개의 프로젝트
OpenMOSS
영상과 동기화된 소리를 한 번의 추론으로 함께 생성하는 오픈소스 비디오-오디오 파운데이션 모델
starVLA
백본과 액션 헤드를 갈아 끼우며 VLA 모델을 조립하는 로보틱스 연구 코드베이스
liustack
이미지를 못 읽는 텍스트 전용 모델에 붙여넣기만으로 시각 능력을 더해 주는 하니스 플러그인
Open-Less
단축키를 누르고 말하면 AI가 다듬은 텍스트를 커서에 바로 넣어주는 macOS·Windows 음성 입력 도구
antirez
Voxtral Realtime 4B를 외부 의존성 없이 순수 C로 구현한 실시간 음성인식 추론 엔진
OpenMOSS
전사와 화자 분리를 한 모델에서 동시에 처리하는 0.9B 엔드투엔드 장문 오디오 이해 모델
stepfun-ai
감정·말투·비언어적 소리까지 텍스트 지시로 재편집하는 3B 규모 LLM 기반 음성 편집 모델
studio-dots-ai
이산 토큰 없이 48kHz 연속 잠재공간에서 동작하는 2B 규모 엔드투엔드 TTS, 체크포인트 7종 제공
ysharma3501
50MB 크기로 8~48kHz 음성을 48kHz로 복원하는 초경량 음성 향상 모델
Marvis-Labs
10초 음성으로 클로닝하는 310M 규모 온디바이스 실시간 스트리밍 TTS, CSM-1B 구조 기반
stemdeckapp
Demucs 기반으로 기기 안에서 6개 스템을 분리하는 로컬 우선 스템 분리 앱
NVIDIA
역할과 목소리를 지정할 수 있는 NVIDIA의 풀듀플렉스 음성 대화 모델