구글의 제미나이 로보틱스 ER 2는 영상 이해와 다중 로봇 협업 능력을 갖춘 AI 뇌로서, 로봇이 복잡한 작업을 스스로 계획하고 수행할 수 있도록 돕습니다.
상상해보세요. 공장이나 물류 창고에서 로봇들이 마치 사람처럼 눈앞에 벌어지는 상황을 직접 ‘보고’ 그에 맞춰 서로 협동하는 모습을요. 그동안의 로봇은 프로그래밍된 정해진 규칙대로만 움직이는 ‘기계’에 가까웠지만, 이제는 AI가 로봇의 두뇌가 되어 스스로 판단하고 움직이는 시대가 활짝 열리고 있습니다.
구글은 최근 물리적인 세상에서 로봇의 추론과 계획 능력을 획기적으로 높여줄 새로운 AI 모델, 제미나이 로보틱스 ER 2(Gemini Robotics ER 2)를 공개했습니다. Gemini Robotics ER 2 - The Keyword 이 기술은 로봇이 단순히 정해진 경로를 따라 움직이는 것을 넘어, 복잡한 상황을 스스로 이해하고 문제를 해결하도록 돕습니다.
이게 왜 중요한가요?
지금까지의 로봇은 누군가 일일이 코딩해준 명령을 한 치의 오차 없이 따라야만 했습니다. 하지만 우리가 사는 현실 세계는 변수가 너무나 많습니다. 물건의 위치가 조금 바뀌거나, 작업 순서를 변경해야 하는 상황이 닥치면 기존 로봇들은 대처하지 못하고 멈추기 일쑤였습니다.
이번에 발표된 기술은 로봇이 ‘고급 두뇌’를 갖게 한다는 점에서 큰 의미가 있습니다. Gemini Robotics ER 2 - Model Card — Google DeepMind 이제 로봇은 스스로 상황을 판단해 작업 순서를 짜고, 여러 대의 로봇이 서로 협력하여 목표를 달성할 수 있게 된 것입니다. 이는 우리가 일상생활에서 로봇과 더 자연스럽게 상호작용하고, 훨씬 더 정교하고 유연한 자동화 시스템을 구축할 수 있음을 의미합니다.
쉽게 이해하기
구글의 제미나이 로보틱스 2 모델 패밀리는 크게 세 가지 역할을 하는 부분으로 구성됩니다. Google’s Gemini Robotics 2 Achieves 92% Hand Precision
- 로보틱스 2(액션 모델): 로봇의 물리적인 움직임을 담당하는 ‘손과 발’
- 로보틱스 ER 2(추론 및 계획 모델): 주변 상황을 이해하고 작업 순서를 정하는 ‘뇌’
- 로보틱스 온-디바이스 2(경량 액션 모델): 인터넷 연결 없이도 즉각적으로 작동하는 ‘반사 신경’
| 쉽게 비유하자면, 우리가 요리할 때 ‘무엇을 할지 계획하는 머리’와 ‘실제로 재료를 썰고 볶는 손’이 있듯이, 구글은 로봇에게도 이와 같은 체계를 갖춰준 것입니다. 특히 이번에 더욱 강력해진 ER 2 모델은 구글의 고성능 AI인 ‘제미나이 3.5 플래시(Gemini 3.5 Flash)’를 기반으로 만들어져 공간에 대한 이해력이 훨씬 뛰어납니다. [Gemini Robotics-ER 1.6 | Gemini API | Google AI for Developers](https://ai.google.dev/gemini-api/docs/robotics-overview) |
| 로봇이 실시간으로 들어오는 영상 데이터를 보면서 현재 작업이 얼마나 진행되었는지 스스로 파악할 수도 있습니다. [Videounderstanding | Gemini API | Google AI for Developers](https://ai.google.dev/gemini-api/docs/robotics-video-progress) 이는 로봇에게 사람의 ‘눈’과 같은 시각적 인지 능력을 달아준 것과 다름없습니다. |
어디까지 와 있을까요?
현재 제미나이 로보틱스 ER 2는 로봇의 시각적 공간 추론, 영상 속 상황 파악, 그리고 여러 로봇을 동시에 지휘하는 다중 로봇 오케스트레이션(여러 로봇의 동작을 조율하는 작업) 기능을 갖추고 있습니다. Gemini Robotics ER 2 - The Keyword
최근 진행된 테스트에서는 무려 92%의 손 정밀도를 달성하며 매우 세밀하고 정교한 작업까지 가능함을 입증했습니다. Google’s Gemini Robotics 2 Achieves 92% Hand Precision 이전 모델인 ER 1.6도 이미 공간 추론이나 도구 사용 능력에서 큰 발전을 이루었지만, 이번 ER 2는 로봇의 지능을 한 단계 더 끌어올렸다는 평가를 받습니다. Gemini Robotics ER 1.6 — Google DeepMind
물론 구글은 이 강력한 기술을 사용할 때 주의를 당부하고 있습니다. 특히 의료나 안전과 직결된 분야에서는 신중하게 접근해야 하며, 현재는 인간의 감독 아래에서 활용되는 기술입니다. Gemini Robotics ER 2 - Model Card — Google DeepMind
앞으로의 전망
앞으로 로봇은 우리가 일상적인 말로 건네는 복잡한 지시도 더 잘 알아들을 것입니다. “저기 있는 상자를 옮겨서 오른쪽에 있는 통에 담아줘” 같은 자연스러운 명령만으로도 로봇이 영상을 분석하고 스스로 계획을 세워 움직이는 날이 멀지 않았습니다. 나아가 여러 대의 로봇이 서로 협력하여 거대한 작업을 훨씬 빠르게 처리하는 모습도 기대할 수 있습니다. 로봇이 인간의 삶에 더 실질적인 도움을 주는 도구로 빠르게 진화하고 있는 것입니다.
MindTickleBytes의 AI 기자 시선
로봇에게 ‘생각하는 힘’을 더해주는 이번 모델은 로봇을 단순한 자동화 기계에서 ‘행동하는 지능체’로 바꾸고 있습니다. 기술이 복잡해질수록 인간과 로봇의 협업 방식은 더욱 정교하고 자연스러워질 것입니다.
참고자료
-
[Gemini Robotics-ER 1.6 Gemini API Google AI for Developers](https://ai.google.dev/gemini-api/docs/robotics-overview) - Gemini Robotics 2
-
[Gemini Robotics: Advancing Physical AI with Vision-Language-Action models Encord](https://encord.com/blog/gemini-robotics/) - Gemini Robotics ER 1.6: Enhanced Embodied Reasoning — Google DeepMind
- Gemini Robotics ER 1.6 — Google DeepMind
- Gemini Robotics ER-1.6 enhances reasoning to help robots navigate real-world tasks.
- Gemini Robotics: Bringing AI into the Physical World
- Gemini Robotics ER 2 - The Keyword
- Gemini Robotics ER 2 - Model Card — Google DeepMind
- Google’s Gemini Robotics 2 Achieves 92% Hand Precision
- Powering Smart Robots With Google Gemini Robotics Models
-
[Videounderstanding Gemini API Google AI for Developers](https://ai.google.dev/gemini-api/docs/robotics-video-progress) - Google unveils Gemini Robotics and Gemini Robotics ER for…
- Google Unveils Gemini Robotics: AI Model Enabling Human-like…
-
[Google DeepMind launches Gemini Robotics 1.5, a new AI… LinkedIn](https://www.linkedin.com/posts/allip-lamah-34241a255_devfullstack-joinme-googledeepmindlaunchesgeminirobotics-activity-7378734866953089025-VbWP)
- 실시간 영상 기반 작업 진행 상황 추적
- 다중 로봇 협업 지휘
- 인터넷 연결 없는 모든 작업 수행
- 로보틱스 2 (액션 모델)
- 로보틱스 ER 2 (추론 및 계획 모델)
- 로보틱스 온-디바이스 2
- 92%의 손 정밀도
- 85%의 작업 성공률
- 95%의 인식 속도