Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
알리바바 Qwen 팀이 2026년 9월 20일 공개한 통합 텍스트-이미지 생성·이미지 편집 모델이다. 시각 생성부는 32개의 Single-Stream DiT 레이어로 구성된 7B 파라미터 규모이며, 혼합 단위(mixed-granularity) 어텐션과 프리픽스 KV 캐시 재사용으로 연산 비용을 낮췄다. 하나의 모델에서 일반 이미지와 투명 배경(RGBA) 이미지를 생성하고, 투명 레이어 편집과 사진 속 피사체 추출까지 처리한다. 편집 시 최대 10장의 참조 이미지를 받을 수 있고 원·페인트 주석·별도 마스크로 국소 편집 영역을 지정할 수 있다. 네이티브 2K 해상도를 지원하며 Diffusers, ComfyUI, vLLM-Omni, SGLang, LightX2V가 공개 당일부터 지원한다. 라이선스는 Qwen Research License로 이전 Qwen-Image(Apache-2.0)와 조건이 다르다.
AUTOMATIC1111
웹 UI로 쓰는 대표적인 Stable Diffusion 이미지 생성 도구

Comfy-Org
노드 기반 디퓨전 모델 GUI
hacksider
단 한 장의 이미지로 실시간 얼굴 교체 및 딥페이크 구현 - 84K 스타 인기 프로젝트

opendatalab
PDF를 AI 워크플로우용 마크다운/JSON으로 변환하는 비전-언어 기반 문서 파싱 엔진