Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
베이징대 Yuan Group이 공개한 14B 규모의 실시간 장편 영상 생성 모델입니다. 단일 H100 GPU에서 종단간 19.5 FPS를 기록하며 분 단위 길이의 영상을 만들어내는데, self-forcing이나 error bank 같은 기존 안티드리프팅 기법도, KV 캐시나 희소 어텐션 같은 표준 가속 기법도 쓰지 않고 학습·추론 파이프라인 자체를 최적화해 이 속도에 도달했습니다. Text-to-Video와 Image-to-Video, Video-to-Video, 인터랙티브 생성을 모두 지원하고 Diffusers에 통합돼 있어, 실시간 영상 생성이나 월드 모델을 연구하는 팀이 바로 실험을 시작할 수 있습니다.

Comfy-Org
노드 기반 디퓨전 모델 GUI
hacksider
단 한 장의 이미지로 실시간 얼굴 교체 및 딥페이크 구현 - 84K 스타 인기 프로젝트

opendatalab
PDF를 AI 워크플로우용 마크다운/JSON으로 변환하는 비전-언어 기반 문서 파싱 엔진

ultralytics
엣지 최적화 실시간 객체 감지 YOLO 프레임워크