본문 바로가기

전자,전기/IT News

제미나이 로보틱스 2 공개, AI 로봇 모델 3종 총정리

반응형

로봇 AI 소식은 늘 화려한 시연 영상으로 소비되지만, 정작 "무엇이 달라졌는지"는 남지 않습니다. 이번 구글 딥마인드 발표의 핵심은 로봇 한 대의 손재주가 아니라, 판단하는 모델과 움직이는 모델을 분리해 묶은 구조입니다. 이 구조를 한 번 이해해두면 앞으로 나올 피지컬 AI 뉴스가 훨씬 빠르게 읽힙니다.

3줄 핵심 요약

1. 구글 딥마인드가 7월 30일(현지시간) '제미나이 로보틱스 2' 모델 3종을 공개했습니다.
2. 상체·로봇팔 중심이던 기존 모델과 달리, 이동·균형·몸 굽히기까지 전신 동작을 하나의 흐름으로 처리합니다.
3. 서로 다른 로봇이 작업을 나눠 맡는 다중 로봇 협업과, 인터넷 없이 돌아가는 온디바이스 모델이 새로 추가됐습니다.

1. 모델 3종, 역할부터 구분하기

이번 발표에서 가장 헷갈리는 지점이 '왜 3개냐'입니다. 하나의 큰 모델이 아니라 역할을 나눈 조합이라고 보면 정리됩니다.

모델 역할 비유하자면
제미나이 로보틱스 2 (VLA) 시각·언어 입력을 모터 제어 신호로 변환 몸을 움직이는 '운동신경'
제미나이 로보틱스 ER 2 (체화 추론) 상황 이해 → 작업 순서 계획 → 하위 모델·API에 지시 계획을 세우는 '두뇌'
제미나이 로보틱스 온디바이스 2 클라우드 없이 로봇 기기 안에서 실행되는 경량 VLA 오프라인에서도 도는 '축소판 운동신경'

VLA는 Vision-Language-Action의 약자로, 보고 들은 것을 곧바로 동작으로 바꾸는 모델을 뜻합니다.

2. 무엇이 실제로 달라졌나

기존 로봇 AI 모델은 대체로 탁자 위 작업, 즉 상체나 로봇팔 제어에 초점이 맞춰져 있었습니다. 이번 모델은 범위 자체가 넓어졌습니다.

  • 전신 제어 — 걸어서 이동하고, 균형을 잡고, 몸을 낮추거나 팔을 뻗어 물체를 놓는 과정을 하나의 동작 흐름으로 처리
  • 정밀 조작 — 앱트로닉 휴머노이드 '아폴로 2'의 다섯 손가락형 손으로 매듭 묶기·지퍼백 잠그기, 프랑카 양팔 로봇의 2지 그리퍼로 포장 작업 시연
  • 오류 복구 — 연속 영상으로 진행 상황을 추적해, 실패 시 처음부터 반복하지 않고 실패한 단계만 다시 수행
  • 외부 도구 호출 — 구글 검색, 내비게이션 API 등 외부 기능을 필요할 때 불러 사용

특히 오류 복구는 실용성 측면에서 가장 큰 변화입니다. 다단계 작업에서 한 번 실패할 때마다 전체를 되돌리면 현장 투입이 어렵기 때문입니다.

3. 공개된 성능 수치, 어떻게 읽어야 하나

구글이 밝힌 ER 2의 자체 평가 결과는 다음과 같습니다.

평가 항목 결과
작업 진행 상황을 5단계로 구분하는 정확도 57.4%
작업 전환 시점 탐지 정확도 91.3%
전환 시점 평균 오차 0.96초

전환 시점은 잘 잡지만(91.3%), 진행 단계를 세밀하게 구분하는 능력은 아직 절반 수준(57.4%)이라는 뜻입니다. 즉 "언제 다음 동작으로 넘어갈지"는 안정적이나 "지금 어느 단계인지"는 여전히 개선 여지가 있다고 읽는 것이 정확합니다. 제조사 자체 벤치마크라는 점도 함께 감안해야 합니다.

4. 다중 로봇 협업과 온디바이스

새로 추가된 다중 로봇 협업은 서로 형태와 특기가 다른 로봇이 작업 상황을 공유하고 단계를 나눠 맡는 기능입니다. 이동과 전신 동작에 강한 휴머노이드가 물체를 옮기면, 정밀 조작에 강한 양팔 로봇이 후속 작업을 이어받는 식입니다. 구글은 아폴로 2와 프랑카 F3 듀오가 작업을 인계하는 사례를 공개했고, 보스턴다이내믹스의 4족 보행 로봇 '스팟'을 ER 2로 제어하는 시연도 함께 선보였습니다.

온디바이스 2는 인터넷 연결 없이 로봇 하드웨어에서 직접 실행되는 경량 모델입니다. 구글에 따르면 일반적으로 200개 미만의 작업 예시와 수 시간의 학습만으로 새로운 양팔 로봇에 적용할 수 있습니다.

실전 체크포인트

  • 개발자·기업 담당자 — ER 2는 제미나이 API와 구글 AI 스튜디오를 통해 이용 가능합니다. VLA 모델(로보틱스 2·온디바이스 2)은 현재 얼리 액세스 파트너 한정이므로, 지금 시점의 실험은 ER 2 기반 계획·추론 영역부터 접근하는 것이 현실적입니다.
  • 안전 요건 — ER 2는 작업 공간에 사람이 접근하면 로봇을 멈추고 안전해진 뒤 재개하도록 설계됐고, 위험한 동작 명령 거부와 불확실 시 사람에게 확인 요청을 평가하는 안전 벤치마크도 도입됐습니다.
  • 뉴스 읽는 기준 — 앞으로 피지컬 AI 발표를 볼 때는 '시연 성공 여부'보다 작업 속도와 장시간 운용 안정성 수치가 함께 공개됐는지를 확인하는 편이 낫습니다.

FAQ

Q. 일반 사용자도 지금 써볼 수 있나요?
A. 아닙니다. ER 2는 개발자용 API로 열려 있고, 나머지 두 모델은 얼리 액세스 파트너에게만 제공됩니다.

Q. 로봇이 스스로 판단한다는 게 어느 수준인가요?
A. 자연어 지시를 받아 작업 순서를 세우고 중간 오류를 수정하는 수준입니다. 목표 자체를 스스로 정하는 단계는 아닙니다.

Q. 국내 산업 현장에 언제 적용될까요?
A. 시점을 못 박기는 어렵습니다. 실제 현장 투입은 작업 속도와 장시간 운용 안정성을 파트너 실증으로 검증한 뒤의 문제로 남아 있습니다.

마무리

이번 발표의 의미는 로봇 한 대를 더 똑똑하게 만든 것이 아니라, 추론 모델이 여러 동작 모델과 서로 다른 로봇을 조율하는 구조를 제시했다는 데 있습니다. 앞으로 나올 피지컬 AI 뉴스도 이 '두뇌–운동신경 분리' 틀에 대입해보면 훨씬 빠르게 판단할 수 있습니다.

참고 출처
구글, 휴머노이드 전신 제어 '제미나이 로보틱스 2' 공개 – 아이티데일리(2026.07.31)
제미나이 로보틱스 2: 로봇에 전신 지능을 구현하다 – Google 공식 블로그
구글, 휴머노이드 전신 제어 AI '제미나이 로보틱스 2' 공개 – AI타임스

반응형