Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요. LLM, Vision, Audio 등 다양한 카테고리의 프로젝트를 확인할 수 있습니다.
총 822개의 프로젝트
ZJUI-AI4H
텍스트·2D/3D·비디오를 통합하는 투명한 제너럴리스트 의료 VLM
facebookresearch
표준 VLM 구조로 3D 공간 이해를 학습하는 Meta FAIR의 멀티모달 모델
HumeAI
텍스트-오디오 듀얼 정렬로 환각 없는 장문 합성을 구현한 Hume AI의 오픈소스 TTS
Tencent
Tencent가 공개한 7B 풀-듀플렉스 엔드투엔드 오디오 언어 모델
OpenMOSS
0.1B 파라미터로 CPU에서도 실시간 동작하는 초경량 오픈소스 TTS
nomadkaraoke
MDX-Net·Demucs·UVR 모델 기반 오디오 스템 분리 CLI/라이브러리
facebookresearch
24/48kHz를 지원하는 Meta의 SOTA 신경망 오디오 코덱
descriptinc
44.1kHz 오디오를 90배 압축하는 최첨단 신경망 오디오 코덱
Wan-Video
MoE 기반 차세대 오픈 비디오 생성 파운데이션 모델
NVlabs
VAE 없이 픽셀 공간에서 직접 이미지를 생성하는 디퓨전 트랜스포머
rednote-hilab
단일 VLM으로 다국어 문서 레이아웃을 파싱하는 오픈소스 OCR
chopratejas
AI 에이전트용 LLM 컨텍스트 압축기 - 토큰 60~95% 절감