제너럴리스트 AI, 시연 한 번만으로 로봇에 새 작업 학습시키는 GEN-1.5 공개
로봇 스타트업 Generalist AI가 단 한 번의 시연 영상만으로 로봇이 새 작업을 수행하게 하는 AI 모델 GEN-1.5를 공개했습니다. 3~12초 시연을 '물리적 프롬프트'로 컨텍스트 윈도우에 입력하면 별도 학습 없이 작업을 수행하며, 5분 데이터로 10번만 미세조정하면 성공률이 59%에서 83%로 상승합니다. 다만 모든 결과는 회사 자체 발표로 아직 독립적으로 검증되지 않았습니다.
제너럴리스트 AI, 시연 한 번만으로 로봇에 새 작업 학습시키는 GEN-1.5 공개 막시밀리안 슈라이너 | 2026년 8월 20일
로봇 스타트업 Generalist AI가 단 한 번의 시연(demo)만으로 로봇에 새로운 작업을 가르치는 AI 모델 GEN-1.5를 공개했다.
3~12초 분량의 시연 영상은 '물리적 프롬프트(physical prompt)'로 모델의 컨텍스트 윈도우, 즉 모델의 단기 기억 공간에 로드된다. 이후 로봇은 별도의 학습 없이 해당 작업을 수행한다.
병 뚜껑 열기나 지갑에서 돈 꺼내기 같은 10가지 테스트에서 회사 측은 평균 59%의 성공률을 보고했다. 5분 분량의 데이터로 10번의 학습 단계를 거치자 이 수치는 83%로 상승했다.
이 모델은 두 개의 프롬프트를 연결해 더 긴 작업 시퀀스를 구성할 수 있고, 시뮬레이션에서 얻은 시연을 활용할 수 있으며, 인간의 손 움직임을 부분적으로 모방할 수도 있다. Generalist에 따르면 이러한 능력들은 8개월 이상의 상호작용 데이터 사전학습 과정에서 자발적으로 나타난 것이며, 명시적으로 학습시킨 것이 아니다.
다른 연구팀들도 유사한 '맥락 내 학습(in-context learning)'을 보여준 바 있지만, 소수의 작업 유형에 한정됐다. Generalist는 다양한 작업 전반에 걸쳐 이를 구현한 최초의 기업이라고 주장한다.
다만 공개된 작업들은 단순하고 짧으며, 모든 결과는 회사 자체 발표로서 독립적인 검증은 이루어지지 않았다.