HN
Hacker News • 45일 전
IMP 8
대형 언어 모델의 창발적 자기 성찰 인식 연구
대형 언어 모델(LLM)이 단순한 텍스트 생성을 넘어 자신의 내부 상태를 관찰하고 인식하는 '자기 성찰(Introspection)' 능력을 어느 정도 갖추고 있음이 확인되었습니다. 연구진이 모델의 내부 활성화(Activation)에 특정 개념을 주입하는 방식으로 실험한 결과, 모델이 이를 인지하고 자신의 의도나 출력물을 구별해 내는 등 실질적인 내부 상태 인지 능력을 입증했습니다. 비록 현재는 이 능력이 매우 불안정하고 상황에 따라 좌우되지만, 향후 모델 고도화에 따라 AI의 자의식 및 통제 능력이 어떻게 발전할지 보여주는 중요한 기초 연구입니다.
LLM 인공지능 메타인지