Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
ByteDance가 공개한 영상 생성·편집 통합 프레임워크입니다. MLLM 기반 시맨틱 플래너가 편집 지시를 먼저 분해해 의미 변화를 계획하고, DiT 기반 렌더러가 실제 프레임을 생성하는 2단 구조를 씁니다. Wan2.1에서 파인튜닝한 렌더러 단독 모델 Bernini-R(14B, 1.3B)과 플래너를 결합한 7+14B 전체 파이프라인을 모두 공개했고, t2i·i2i·t2v·v2v·rv2v·r2v 여섯 태스크를 같은 인터페이스로 다룹니다. EditVerse·OpenVE·OpenS2V·VBench 점수와 자체 아레나의 인간 선호 평가를 함께 공개했습니다. 다만 Hopper 계열 GPU와 CUDA 12.6, Open-VeOmni 의존성이 필요합니다.

Comfy-Org
노드 기반 디퓨전 모델 GUI
hacksider
단 한 장의 이미지로 실시간 얼굴 교체 및 딥페이크 구현 - 84K 스타 인기 프로젝트

opendatalab
PDF를 AI 워크플로우용 마크다운/JSON으로 변환하는 비전-언어 기반 문서 파싱 엔진

ultralytics
엣지 최적화 실시간 객체 감지 YOLO 프레임워크