Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
데이터 준비부터 학습, 장시간 추론까지 인터랙티브 비디오 월드 모델 구축 과정을 통째로 공개한 오픈 프레임워크다. CUHK-SZ, NUS, HKUST, NVIDIA 등 연구진이 참여했다. 하나의 코드베이스로 Wan2.2, LTX-2.5, MiniMax-H3 기반의 5B~33B 모델 4종을 다루며, 양방향 적응 → 교사 강제 자기회귀 초기화(TF-AnyFlow) → 분포 매칭 증류(DMD) 3단계 레시피로 양방향 비디오 모델을 카메라 제어가 가능한 소수 스텝 자기회귀 모델로 바꾼다. 슬라이딩 윈도우 추론으로 길이 제한 없이 생성을 이어 간다. 14개 데이터셋을 프레임 정렬 형식으로 통합한 143만 클립·25TB 데이터셋과 처리 파이프라인을 함께 공개했으며, 현재 3단계 전체가 제공되는 백엔드는 Wan2.2-5B와 MiniMax-H3다.
AUTOMATIC1111
웹 UI로 쓰는 대표적인 Stable Diffusion 이미지 생성 도구

Comfy-Org
노드 기반 디퓨전 모델 GUI
hacksider
단 한 장의 이미지로 실시간 얼굴 교체 및 딥페이크 구현 - 84K 스타 인기 프로젝트

opendatalab
PDF를 AI 워크플로우용 마크다운/JSON으로 변환하는 비전-언어 기반 문서 파싱 엔진