제미나이 로보틱스 2 완전 분석 - 성공률 44% 공개와 VLA를 지휘하는 계층 구조
구글 딥마인드가 공개한 제미나이 로보틱스 2를 로봇 연구자들이 뜯어봤다. 상위 추론 모델이 VLA를 지휘하는 계층 구조, 44%라는 성공률을 그대로 공개한 이유, 하드웨어를 만들지 않는 전략을 짚는다.
핵심 내용 읽기 →AI TOPIC
로봇 파운데이션 모델 관련 핵심 뉴스와 활용 인사이트 7편을 최신순으로 모았습니다.

구글 딥마인드가 공개한 제미나이 로보틱스 2를 로봇 연구자들이 뜯어봤다. 상위 추론 모델이 VLA를 지휘하는 계층 구조, 44%라는 성공률을 그대로 공개한 이유, 하드웨어를 만들지 않는 전략을 짚는다.
핵심 내용 읽기 →
ETH 취리히가 새로 개설한 로봇 러닝 강의 1강을 정리했다. 모라벡의 역설, 1966년 로봇 셰이키부터 오늘의 휴머노이드까지의 흐름, 그리고 로봇에 아직 챗GPT 순간이 오지 않은 이유와 데이터 격차를 짚는다.
핵심 내용 읽기 →
피지컬 인텔리전스 공동창업 멤버가 ETH 취리히 초청 강연에서 로봇 모델 π0.7을 설명했다. 하나의 체크포인트로 빨래 개기·나사 조이기·포장을 모두 해낸 과정, 저품질 데이터를 메타데이터로 살려 낸 방법, 로봇을 바꿔도 작업이 옮겨 간 사례와 남은 과제를 정리했다.
핵심 내용 읽기 →
로봇 엔지니어가 피지컬 AI를 이끄는 세 그룹의 VLA 모델을 공개 자료 기준으로 비교했다. 이해와 행동을 나누는 구조, 데이터 확장 전략, 서로 다른 로봇 몸체로 학습을 옮기는 문제의 해법에서 세 계열의 설계 철학이 갈린다.
핵심 내용 읽기 →
피지컬 인텔리전스의 π0.7 논문 리뷰. 좋은 시연만 골라 쓰는 대신 실패·저품질 데이터에 품질·속도·실수 메타데이터를 붙여 학습시키고, 언어 코칭과 목표 이미지로 훈련에 없던 작업까지 수행하는 구조를 정리했다.
핵심 내용 읽기 →
보고 이해하는 데까지는 잘하지만 접촉 작업에서 흔들리는 VLA 로봇 모델. 힘과 촉각을 모델에 넣는 다섯 편의 최신 연구를 통해 로봇에게 손끝 감각이 필요한 이유를 정리했다.
핵심 내용 읽기 →
딥러닝논문읽기모임이 양팔 로봇 조작용 확산 파운데이션 모델 RDT-1B를 해설한다. 통합 행동 공간과 확산 정책으로 처음 보는 물체까지 다루는 구조를 짚는다.
핵심 내용 읽기 →