Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
Depth Anything 3(DA3)는 카메라 포즈 정보가 있든 없든 임의의 시점 이미지 묶음에서 공간적으로 일관된 3D 기하 구조를 예측하는 ByteDance Seed의 비주얼 지오메트리 파운데이션 모델입니다. 태스크별 전용 아키텍처 대신 평범한 DINO 트랜스포머 하나만 백본으로 사용하고, 복잡한 멀티태스크 학습 대신 depth-ray라는 단일 표현으로 통합한 것이 핵심입니다. 이 최소 설계만으로 단안 깊이 추정에서는 Depth Anything 2를, 다중 뷰 깊이 및 카메라 포즈 추정에서는 VGGT를 앞섭니다. 단안·다중 뷰·포즈 조건부 깊이 추정, 카메라 내외부 파라미터 추정, 3D 가우시안 직접 예측까지 하나의 모델이 처리하며, 모든 모델을 공개 학술 데이터셋만으로 학습했습니다.
graphdeco-inria
실시간 3D 방사장 필드 렌더링의 원본 구현체
isl-org
포인트 클라우드·메쉬 처리의 표준 3D 라이브러리

Tencent-Hunyuan
텐센트 고해상도 3D 생성
openai
OpenAI의 텍스트/이미지 → 3D 오브젝트 생성 모델 (MIT)