Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요. LLM, Vision, Audio 등 다양한 카테고리의 프로젝트를 확인할 수 있습니다.
총 1086개의 프로젝트
netease-youdao
대본 없이 목소리를 복제해 14개 언어로 말하게 하는 넷이즈 유다오의 교차언어 제로샷 TTS
Ampixa
3달러 ESP32 칩과 브라우저에서 실시간으로 도는 29만~230만 파라미터 초소형 TTS
Tencent-Hunyuan
하나의 자연어 지시로 TTS·음성 편집·잡음 제거·음원 분리를 처리하는 텐센트의 1.5B 음성 파운데이션 모델
FireRedTeam
이해와 생성 표현을 분리해 9B LLM 하나로 듣고 말하고 편집하는 오디오 언어 모델
QwenAudio
멀티모달 LLM의 단계별 추론으로 영상에 맞는 효과음을 생성·편집하는 Any2Audio 모델
facebookresearch
텍스트·영상·시간 구간 프롬프트로 원하는 소리만 분리하는 Meta의 오디오 분할 모델
modelscope
저사양 GPU까지 겨냥한 ModelScope의 이미지·영상 Diffusion 엔진
Peterande
DETR의 박스 회귀를 분포 정제로 바꾼 실시간 객체 검출 모델
kornia
PyTorch 기반 미분 가능 컴퓨터 비전·기하 연산 라이브러리
BlinkDL
어텐션 없이 선형 시간·상수 메모리로 트랜스포머급 성능을 내는 병렬 학습 가능 RNN 기반 LLM 아키텍처
hpcaitech
데이터·텐서·파이프라인 병렬화를 통합 제공해 대형 언어모델 학습 비용을 낮추는 HPC-AI Tech의 분산 학습 프레임워크
OpenRLHF
Ray+vLLM 분산 아키텍처와 에이전트 기반 파이프라인을 갖춘 프로덕션급 오픈소스 RLHF 학습 프레임워크