구글의 새 로봇 뇌, 무엇이 나뉘었나…Gemini Robotics 2·ER 2 차이

  • 무슨 일: Google DeepMind가 2026년 7월 30일 Gemini Robotics 2와 Gemini Robotics ER 2를 공개했습니다.
  • 왜 중요한가: 로봇의 몸 움직임과 여러 단계의 판단을 분리해 연결하는 구조를 제시했습니다.
  • 아직 모르는 것: 실제 현장 배치 시점과 개별 로봇에서의 성능은 이번 발표만으로 확정되지 않았습니다.

공식 원문: Google DeepMind의 Gemini Robotics 2 발표 · Google의 Gemini Robotics ER 2 발표

Google DeepMind가 7월 30일 공개한 Gemini Robotics 2는 로봇의 몸을 움직이는 비전·언어·행동 모델이고, Gemini Robotics ER 2는 여러 단계를 계획하고 진행을 살피는 고수준 추론 모델입니다. 개발자는 ER 2를 Gemini API와 Google AI Studio에서 확인할 수 있습니다.

실험 공간에서 촬영한 흰색 휴머노이드 로봇의 상반신
Google DeepMind가 공개한 Gemini Robotics 2 관련 로봇 이미지 · 원문 보기

이번 공개의 핵심은 ‘로봇 뇌’라는 한 표현에 기능을 섞어 두지 않았다는 데 있습니다. 어떤 동작을 할지 판단하는 층과 실제 관절·그리퍼·이동을 제어하는 층을 나눠, 복잡한 작업을 더 긴 흐름으로 다루려는 접근입니다.

다만 발표는 모델의 기능과 접근 경로를 알린 것이지, 특정 공장·가정·매장에 언제 대규모로 투입된다는 확정 일정은 아닙니다. 제목을 보고 즉시 상용화가 결정됐다고 받아들이기보다, 무엇이 공개됐고 어디까지 가능한지 분리해 보는 편이 정확합니다.

Gemini Robotics 2는 몸의 움직임을 어떻게 맡나

Gemini Robotics 2는 시각과 언어 입력을 로봇의 운동 제어로 연결하는 VLA(vision-language-action) 모델입니다. Google DeepMind는 이 모델이 휴머노이드의 전신 동작, 양팔 로봇의 조작, 손과 그리퍼를 활용한 정밀 작업을 다루도록 설계됐다고 설명합니다.

공식 발표에 나온 예시는 물건을 집어 선반의 지정 위치에 두는 작업입니다. 로봇이 지시를 이해한 뒤 이동하고, 물체를 잡고, 목적지에 놓는 흐름을 한 모델 계층이 동작으로 이어 주는 방식입니다. 다중 로봇 협업도 이번 발표가 제시한 범위에 포함됩니다.

물체를 들고 있는 흰색 휴머노이드 로봇
Google DeepMind가 공개한 Gemini Robotics 2 관련 로봇 이미지 · 원문 보기

ER 2는 ‘다음 단계’를 판단하는 역할입니다

Gemini Robotics ER 2는 로봇의 고수준 판단을 맡는 embodied reasoning 모델입니다. 사람의 지시를 이해하고 주변 상황을 보며 여러 단계의 작업을 계획한 다음, 하위 VLA 모델이나 로봇 API에 실행을 넘기는 구조입니다.

Google은 ER 2가 연속 영상으로 작업 진행을 추적하고, 단계가 실패했을 때 조정하거나 다음 단계로 넘어갈 시점을 찾도록 설계됐다고 밝혔습니다. 따라서 ER 2가 팔·다리 모터를 직접 대체한다기보다, 작업 순서와 상태를 관리하는 상위 계층이라는 점이 Gemini Robotics 2와의 차이입니다.

개발자가 바로 확인할 수 있는 접근 경로는

공식 발표 기준으로 ER 2는 Gemini API와 Google AI Studio에서 개발자에게 공개됐고, Gemini Enterprise Agent Platform에서는 비공개 프리뷰로 제공됩니다. Google은 시작용 예제도 함께 안내했습니다.

반면 Gemini Robotics 2와 Gemini Robotics On-Device 2는 공식 페이지에서 early-access partners 대상이라고 구분합니다. 따라서 ‘Gemini Robotics를 바로 써 볼 수 있다’는 말은 ER 2의 API·AI Studio 접근과, 로봇 하드웨어 제어 모델의 파트너 접근을 같은 조건으로 보지 않아야 합니다.

발표에서 확인된 범위와 아직 확인되지 않은 범위

확인된 사실은 Google DeepMind가 전신 제어·정밀 조작·다단계 계획·진행 추적·다중 로봇 협업을 묶는 모델 구성을 공개했다는 점입니다. 로봇이 새로운 몸체에 적응하는 방식과 로컬 실행 모델도 공식 발표의 주요 설명에 포함됩니다.

반대로 개별 사업장에 적용되는 비용, 안전 인증, 실제 작업 속도, 제품별 출시·도입 일정은 이 두 발표만으로 확정할 수 없습니다. Google도 실제 로봇이 인간 수준의 정밀도와 속도에 더 도달해야 한다는 과제를 함께 언급했습니다.

정리하면 Gemini Robotics 2는 ‘움직임을 실행하는 층’, ER 2는 ‘작업을 계획하고 확인하는 층’으로 이해하면 됩니다. 개발자는 먼저 Gemini API Robotics 안내Google AI Studio의 ER 2 프리뷰를 확인하고, 하드웨어 모델의 접근 조건은 Google DeepMind 공식 발표에서 구분해 보는 것이 좋습니다.

이 글과 함께 읽으면 좋은 글