Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
HunyuanImage 3.0은 텐센트가 공개한 네이티브 멀티모달 이미지 생성 모델이다. 확산 모델 대신 자기회귀 프레임워크 안에서 이해와 생성을 묶었고, 총 800억 파라미터 중 토큰당 130억을 활성화하는 MoE 구조를 쓴다. 긴 지시문을 해석해 프롬프트를 스스로 다시 쓰는 기능과 사고 사슬 추론으로 세계 지식이 필요한 장면, 복잡한 구도, 텍스트 렌더링을 처리한다. Instruct 버전은 이미지 편집과 참조 이미지 3장 융합을 더했고 8스텝용 Distil 버전도 있다. 다만 기본 모델이 VRAM 240GB 이상을 요구하고, Tencent Hunyuan Community License는 한국·EU·영국을 적용 지역에서 제외한다.

Comfy-Org
노드 기반 디퓨전 모델 GUI
hacksider
단 한 장의 이미지로 실시간 얼굴 교체 및 딥페이크 구현 - 84K 스타 인기 프로젝트

opendatalab
PDF를 AI 워크플로우용 마크다운/JSON으로 변환하는 비전-언어 기반 문서 파싱 엔진

ultralytics
엣지 최적화 실시간 객체 감지 YOLO 프레임워크