구글, 로봇용 AI 학습모델 'RT-2' 출시

Google wants to make its robots smarter with the release of the AI learning model Robotic Transformer (RT-2). RT-2 is the new version of what the company calls its vision-language-action (VLA) model, which teaches robots to better recognize visual and language patterns, interpret instructions, and infer what objects work best for the request. Researchers tested RT-2 with a robotic arm in a kitchen office setting, asking it to decide what makes a good improvised hammer (it chose a rock) and to choose a drink to give to an exhausted person (it chose a Red Bull). The model was trained on web and robotics data, leveraging research advances in large language models like Google’s own Bard and combining it with robotic data (like which joints to move). Google's new robot is not perfect. The New York Times saw a live demo of the robot and reported that it incorrectly identified soda flavors and misidentified fruit as the color white.

구글은 로봇용 AI 학습모델인 Robotic Transformer (RT-2)를 출시했다. RT-2는 구글이 시각-언어-행동(VLA) 모델이라고 부르는 새로운 버전으로, 로봇이 시각적 언어 패턴을 더 잘 인식하고 지시사항을 해석하며, 요청에 가장 적합한 객체를 추론하도록 한다. 연구자들은 주방 사무실 환경에서 로봇 팔로 망치나 음료를 선택하는 행동을 테스트했다. 이 모델은 웹과 로봇 데이터에 대해 학습하였고, 구글의 Bard와 같은 대형언어모델의 연구 발전을 활용하여 로봇 데이터와 결합했다. 물론 뉴욕타임스는 로봇이 소다 맛을 잘못 식별하고, 과일을 흰색으로 잘못 식별하는 등 완벽하지 않다고 보도했다.

버트

ai@tech42.co.kr
기자의 다른 기사보기
저작권자 © Tech42 - Tech Journalism by AI 테크42 무단전재 및 재배포 금지

관련 기사

"우주 데이터센터 띄운다"… 구글, AI 칩 궤도 안착시켰지만 난제 수두룩

구글(Google)이 자체 개발한 인공지능(AI) 반도체를 탑재한 위성을 우주로 쏘아 올리며 궤도상 데이터센터 구축을 위한 첫 시험에 나섰다.

애플 TV 장시간 먹통에 사용자 분통

애플(Apple)의 OTT 서비스인 애플 TV가 지난 30일 오후 4시 43분부터 장시간 먹통 사태를 겪으며 이용자들의 불편이 이어지고 있다.

"내 목소리 함부로 쓰지 마"… 일본 법원, AI 음성 무단 복제에 '인격권' 첫 인정

일본 도쿄지방재판소가 유명 성우의 음성을 인공지능(AI)으로 무단 복제해 영상 내레이션에 활용한 익명의 틱톡(TikTok) 계정 사건과 관련해 인간의 목소리도 법적 보호 대상이라고 판결했다.

오픈AI, '옷 입어보기'까지 진출… 챗GPT 쇼핑 생태계 본격 확장

오픈AI(OpenAI)가 사용자가 업로드한 인물 사진에 의류 이미지를 가상으로 입혀주는 신규 쇼핑 기능을 차트GPT에 추가했다.