Google Deepmind는 Gemini Robotics Op Device를 출시합니다

Jun 30, 2025 메시지를 남겨주세요

6 월 24 일, Google Deepmind는 혁신적인 로봇 공학 모델 Gemini Robotics Op-Device를 발표했으며, 모델이 클라우드 연결에 의존하지 않고 처음으로 전체적으로 작동 할 수있는 시간을 표시했습니다. .이 시각적 언어 액션 (VLA) 모델, Gemini 2. 0의 시각적 이해, 자연스런 인식, 및 행동 및 행동에 기초 하여이 시각적 언어 작용 (VLA) 모델을 사용합니다. 로봇이 오프라인 환경에서 폴딩 의류, 지퍼 지퍼 및 떼를 묶는 것과 같은 복잡한 작업을 정확하게 수행 할 수 있도록합니다.

 

Gemini Robotics On-Device

 

기술 혁신 : 클라우드에서 가장자리로 자율성을 향한 도약


Gemini Robotics Op-Device는 가벼운 설계 및 알고리즘 최적화를 통해 로컬 하드웨어의 클라우드 기반 모델과 비교할 수있는 반면, 다른 로컬 솔루션 . . . .는 IP67 방수 설계를 갖추고 있으며 30 분 동안까지 1 미터까지의 물로 작동 할 수 있습니다. 이동성 조건, 보행 속도는 이전 세대에 비해 60% 향상되었으며, 전문 체조 선수와의 균형 정밀도와 듀얼 암 협업을 지원하기위한 듀얼 암 협력을 지원하여 산업 조립품 .

 

개발자 생태계 : 단지 50 개의 데모로 사용자 정의


Google의 첫 번째 오픈 튜닝 VLA 모델로서 Gemini Robotics On-Device는 50-100 작업 시연을 통해 새로운 시나리오에 신속하게 적응할 수 있습니다. "Rubik 's Cube를 선물 가방에 배치하는 것"과 같은 Appollo Humanoid Robot ..} 개발자가 가상 환경에서 모델을 테스트하고 "신뢰할 수있는 테스터 프로그램 ."을 통해 액세스 할 수있게 해줍니다.이 이니셔티브는 업계에서 하드웨어 소프트웨어 디퍼 커플 링 및 저 산업 개발 장벽을 주도 할 수있는 잠재력으로 업계에서 "로봇 공학의 안드로이드"로 간주됩니다.

 

응용 시나리오 : 공장에서 가정으로의 일반화


산업 분야 에서이 모델은 Franka FR3 Dual-Arm Robot에 적응하여 컨베이어 벨트 어셈블리 및 품질 검사 .와 같은 작업을 가능하게하여 자연어 상호 작용을 통해 요리 및 개를 걷는 것과 같은 매일 서비스를 수행 할 수 있으며, 사용자의 일정을 기반으로 한 사용자의 스케줄을 기반으로 아침 식사를 준비하는 것과 같은 일상적인 서비스를 수행 할 수 있으며,. .을 통해 SMANTITIC SAVITY를 구현했습니다. 다층 안전 보호 시스템을 구축하기 위해 하드웨어 수준에서 액션 힘 및 속도 제한을 설정하십시오. .

 

Gemini Robotics On-Devicefm

 

현재 Gemini 2 . 0을 기반으로 개발되었지만, 핵심 팀은 이미 최신 Gemini 2 . 5의 성능 향상을 통합하기 시작했으며, 지역화 된 AI 모델로서 더 많은 의존성이되는 다단계 논리 계획 기능 ({7}}}. .은 잠재적으로 잠재적으로 잠재적으로 획기적인 획기적인 길을 열어 줄 수 있습니다. 지능." Gemini Robotics Op-Device의 출시는 대규모 응용 프로그램에 들어가는 새로운 구체화 된 지능 시대를 나타냅니다.