TD
The Decoder • 7일 전
IMP 8
AI의 사고 과정 공개는 안전성 이점이지만, 그 투명성은 사라지고 있다
Google DeepMind 연구진은 AI 모델이 추론 과정을 자연어로 공개하는 '사고 연쇄(CoT)'가 기만 행위나 위험한 계획을 탐지할 수 있는 핵심 안전 도구라고 강조했습니다. 그러나 OpenAI의 GPT-6 Astra 시스템 카드는 CoT 모니터링 가능성이 크게 감소했음을 보고했으며, 미래 모델은 인간이 읽을 수 없는 방식으로 사고할 수 있다고 경고했습니다.
안전성 사고연쇄 구글딥마인드