메뉴

#안전 및 정렬

HN
Hacker News • 44일 전
IMP 8

앤스로픽, 개념적 추론 지수(CRI) 도입

앤스로픽과 레드우드 연구소는 AI가 철학이나 AI 미래주의 등 경험적 검증이 어려운 분야에서도 논리적 추론을 잘 수행할 수 있도록 평가하기 위해 '개념적 추론 지수(CRI)'를 새롭게 발표했습니다. 이는 AI가 인류의 AI 통제 및 안전 문제 해결을 스스로 돕는 데 필수적인 능력인 '개념적 추론' 능력을 정확히 측정하고 개선하기 위한 핵심적인 시도입니다. 연구진은 세 가지 벤치마크(LMCA, ACCoRD, DTBench)를 통해 인간 전문가 수준의 안전 연구를 AI로 자동화할 수 있는 시점을 앞당들 수 있을 것으로 기대하고 있습니다.

안전 및 정렬 벤치마크 추론 능력