휴머노이드 로봇 파운데이션 모델 Ψ0: 1인칭 영상 사전학습으로 이동과 조작을 통합한 스탠퍼드 세미나 정리
스탠퍼드 로보틱스 세미나에서 소개된 Ψ0는 사람이 머리에 쓴 카메라로 모은 1인칭 영상으로 사전학습해, 40여 개 관절을 가진 휴머노이드가 걸으면서 물건을 다루게 만든 로봇 모델이다. 데이터 수집과 실시간 제어 설계를 정리했다.
핵심 내용 읽기 →AI TOPIC
비전언어행동모델 관련 핵심 뉴스와 활용 인사이트 3편을 최신순으로 모았습니다.

스탠퍼드 로보틱스 세미나에서 소개된 Ψ0는 사람이 머리에 쓴 카메라로 모은 1인칭 영상으로 사전학습해, 40여 개 관절을 가진 휴머노이드가 걸으면서 물건을 다루게 만든 로봇 모델이다. 데이터 수집과 실시간 제어 설계를 정리했다.
핵심 내용 읽기 →
피지컬 인텔리전스 공동창업자 첼시 핀이 범용 로봇 모델 개발 과정을 공개했다. 빨래 개기에서 3개월간 성공률 0%를 겪은 뒤 찾아낸 사전학습·사후학습 조합과, 처음 가보는 집에서도 작동한 비결을 짚는다.
핵심 내용 읽기 →
허깅페이스 연구자가 올해 주목하는 세 가지 AI 흐름을 짚었다. 세계를 압축해 담는 월드 모델, 자연어 지시를 행동으로 옮기는 비전-언어-행동 모델, 그리고 휴대폰 화면을 직접 조작하는 온디바이스 에이전트다.
핵심 내용 읽기 →