Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요. LLM, Vision, Audio 등 다양한 카테고리의 프로젝트를 확인할 수 있습니다.
총 822개의 프로젝트
NVIDIA-NeMo
텍스트·이미지·비디오·오디오를 단일 모델로 처리하는 NVIDIA의 옴니모달 오픈 모델 허브
OpenGVLab
이해·추론·생성·편집을 하나로 통합한 4B 오픈 멀티모달 모델
EvolvingLMMs-Lab
텍스트·이미지·비디오·오디오를 아우르는 멀티모달 평가 표준 툴킷
senstella
Apple Silicon 기반 MLX로 구동하는 NVIDIA Parakeet ASR 포트
FluidInference
Apple Silicon용 CoreML 기반 STT·TTS·화자분리 Swift 라이브러리
MahmoudAshraf97
Whisper에 화자 분리 기능을 더한 오픈소스 ASR 파이프라인
metavoiceio
감정 표현형 영어 TTS 파운데이션 모델
DigitalPhonetics
7,000개 언어를 지원하는 다국어 TTS 툴킷
shivammehta25
플로우 매칭 기반의 빠른 비자기회귀 TTS
iver56
오디오 ML 학습을 위한 표준 파이썬 데이터 증강 라이브러리
riffusion
Stable Diffusion 기반 실시간 텍스트-투-뮤직 생성 프로젝트
OpenMOSS
음성, 사운드, 음악을 통합 이해하는 오디오 파운데이션 모델