로봇 파운데이션 모델·논문 가이드 | Gemini Robotics·GR00T·MolmoAct

Robot foundation model guide

로봇 파운데이션 모델 흐름을 한곳에서 비교하세요

로봇 파운데이션 모델은 로봇이 보고, 추론하고, 실제 행동으로 옮기는 과정을 연결하는 핵심 기술입니다. 이 허브는 Gemini Robotics, GR00T, MolmoAct, Cosmos, openpi 같은 모델과 논문 흐름을 VLA, embodied reasoning, action policy, 월드 모델 기준으로 나눠 읽는 출발점입니다.

VLA 모델Embodied ReasoningAction PolicyWorld Model

로봇 파운데이션 모델은 어디서 시작할까요?

모델 이름보다 역할을 먼저 나누면 글을 훨씬 빠르게 읽을 수 있습니다.

로봇 파운데이션 모델 핵심 글

Google DeepMind, NVIDIA, Ai2, Physical Intelligence 계열 글을 기술 역할별로 묶었습니다.

더 깊게 볼 글

시뮬레이션 학습, 범용 브레인, 오픈 학습 생태계까지 이어서 읽을 수 있습니다.

기술 축으로 비교하기

로봇 파운데이션 모델은 하나의 순위표보다 역할 구분이 더 중요합니다.

기술 축 대표 글 핵심 질문
Embodied Reasoning Gemini Robotics-ER 1.6 로봇이 행동 전 장면을 어떻게 해석하고 멈추는가
VLA/Action Policy Gemini Robotics 1.5, MolmoAct 2, openpi 시각·언어 입력이 실제 행동으로 어떻게 변환되는가
World Model NVIDIA Cosmos, MolmoBot 합성 데이터와 시뮬레이션이 현실 실패를 줄이는가
Cross-Embodiment GR00T N1.6, Skild AI 다른 로봇 몸체로 정책을 얼마나 옮길 수 있는가

공식 자료 확인

모델과 논문은 공개 범위가 자주 바뀌므로 공식 페이지와 연구 자료를 함께 확인하는 것이 좋습니다.

함께 볼 허브

로봇 파운데이션 모델은 휴머노이드 제품 비교와 엣지 AI 조건을 같이 봐야 실제 적용 가능성이 보입니다.