Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요. LLM, Vision, Audio 등 다양한 카테고리의 프로젝트를 확인할 수 있습니다.
총 1086개의 프로젝트
InnovatorLM
화학·생물·의학 등 과학 특화 8B 멀티모달 추론 모델
studio-dots-ai
차트·다이어그램을 SVG로 변환하는 멀티모달 문서 OCR 모델
inclusionAI
이미지·영상·오디오·텍스트를 이해하고 생성하는 옴니모달 MoE 모델
salute-developers
러시아어 특화 음성인식·감정인식 파운데이션 모델, MIT로 공개
revdotcom
Rev가 공개한 회의·실적발표 특화 음성인식·화자분리 오픈소스
nvidia
영어 전사를 초고속·고정확도로 처리하는 NVIDIA의 6억 파라미터 ASR 모델
muscriptor
오디오를 MIDI·악보로 변환하는 다중 악기 음악 채보 모델
fluxions-ai
실시간 음성 비서용 경량 TTS, Vui Nano 기반
Soul-AILab
멀티 화자 팟캐스트 생성에 특화된 오픈소스 TTS
zai-org
제로샷 음성 복제 지원하는 Zhipu의 오픈소스 TTS
Tencent-Hunyuan
영상에 동기화된 48kHz 폴리 사운드를 생성하는 텍스트-비디오-투-오디오 모델
asteroid-team
PyTorch 기반 오디오 음원 분리 연구 툴킷