Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
NVIDIA가 공개한 로봇 조작(manipulation)용 대규모 3D 월드 모델로, RGB-D 관측과 로봇 액션을 입력받아 장면 전체의 3D 포인트 흐름(point flow)을 예측한다. DINOv3를 장면 인코더로, PointTransformerV3(PTv3)를 코어 아키텍처로 사용하며, 실제 로봇 조작 데이터인 DROID와 시뮬레이션 데이터인 BEHAVIOR를 함께 또는 개별적으로 학습에 활용한다. 기존의 깊이맵이나 액션 예측 대신 3D 포인트 궤적으로 장면의 동적 변화를 직접 표현하는 것이 특징이며, 노이즈가 섞인 실측 데이터를 다루기 위한 전문가 신뢰도(expert-confidence) 기반 필터링 평가 지표도 함께 제공한다. Apache 2.0 라이선스로 공개된다.
ahujasid
LLM으로 Blender를 조작하는 MCP 플러그인
graphdeco-inria
실시간 3D 방사장 필드 렌더링의 원본 구현체
NVlabs
해시 인코딩으로 NeRF를 수 초 만에 학습하는 CUDA 구현체
isl-org
포인트 클라우드·메쉬 처리의 표준 3D 라이브러리