Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요. LLM, Vision, Audio 등 다양한 카테고리의 프로젝트를 확인할 수 있습니다.
총 1086개의 프로젝트
MirroS-Lab
멀티모달 모델 내부에서 물체 위치를 담는 3차원 공간 부분공간을 찾고 조작하는 해석 연구 코드
Liuziyu77
텍스트·이미지·비디오를 보고 후보별 확률을 바로 반환하는 저지연 멀티모달 의사결정 모델
InternLM
이해·이미지 생성·편집·비디오·3D를 하나로 처리하는 16B-A1B 멀티 코드북 확산 LLM
AudarAI
아랍어 방언과 아랍어-영어 코드 스위칭에 강한 LLM 디코더 기반 생성형 음성 인식 모델 (Flash·Turbo)
NVIDIA
Nemotron·Parakeet 음성 인식과 화자 분리·번역·TTS를 로컬에서 돌리는 NVIDIA 공식 ggml 기반 C++ 런타임
QuintinShaw
여러 ASR 모델을 하나의 CLI와 OpenAI 호환 로컬 API로 실행하는 텔레메트리 없는 로컬 음성 인식 엔진
zeroweight-ai
GPU 없이 CPU에서 실시간 스트리밍 합성이 가능한 202M 파라미터 베트남어 TTS
FireRedTeam
24개 언어·21개 중국어 방언 보이스 클로닝에 자연어 보이스 디자인과 음성 편집을 더한 통합 TTS 모델
nari-labs
단일 H100에서 Qwen3-TTS를 50ms 미만 첫 오디오 지연으로 서빙하는 Nari Labs의 추론 엔진
HeartMuLa
레퍼런스 음원이나 MIDI를 기호적 리드시트로 바꿔 새 가사·스타일의 커버곡을 만드는 음악 생성 모델
xiaomi-research
LLM과 토큰 단위 flow matching으로 음성·음악·효과음·환경음을 한 번에 생성하는 오디오 장면 모델
NeptuneHub
곡의 실제 소리를 분석해 클러스터링·유사곡·텍스트 검색 플레이리스트를 만드는 셀프호스팅 음악 도구