Open Source
GitHub, HuggingFace의 최신 AI 오픈소스 프로젝트를 탐색하세요.
비전-언어-행동(VLA) 모델을 레고처럼 조립해 만드는 로보틱스 연구용 코드베이스입니다. 학습 인프라를 공유한 채 파운데이션 백본(VLM 또는 월드 모델), 액션 헤드, 벤치마크 배포 훅을 각각 독립된 축으로 떼어 놓아, 새로운 VLA 프레임워크를 만드는 일이 대개 백본이나 액션 헤드 하나를 갈아 끼우는 작업으로 줄어듭니다. π₀-fast 방식의 이산 토큰부터 flow matching, GR00T식 듀얼 시스템까지 네 가지 대표 구조가 같은 데이터 인터페이스 위에 구현돼 있고, LIBERO·SimplerEnv·RoboCasa·BEHAVIOR 등 10여 개 벤치마크 파이프라인과 Franka 실로봇 예제를 함께 제공합니다.