메뉴

#인공지능 이론

HN
Hacker News 16일 전
IMP 8

AI 연구의 한 단계 예측 함정

강화학습의 거장 리치 서튼(Rich Sutton)은 단기 예측 모델만 학습해 장기 예측을 반복적으로 생성하려는 접근 방식의 한계를 지적합니다. 단기 예측의 오차가 누적되고 계산 복잡도가 기하급수적으로 증가하기 때문입니다. 이를 극복하기 위해 옵션(Options)이나 GVF 등을 활용한 시간적 추상화(Temporal abstraction) 기반 모델 구축을 제안합니다.

강화학습 세계 모델 시간적 추상화