메뉴

#에이전트코딩

MP
MarkTechPost 42일 전
IMP 7

오픈AI, 시뮬레이션 도구 호출로 사전 위험 평가 강화

오픈AI는 신규 모델을 실제 배포하기 전, 과거 대화 데이터를 재생하여 부작용 발생 확률을 평가하는 '배포 시뮬레이션(Deployment Simulation)' 기법을 공개했습니다. 이를 통해 자율형 코딩 에이전트(Agentic Coding) 환경에서도 모델이 도구를 오용하거나 의도치 않은 행동을 할 위험을 사전에 통제할 수 있게 되었다는 점에서 중요합니다. 다만 중앙값 기준 1.5배의 오차율이 발생하는 등 파이프라인의 한계점도 함께 논의됩니다.

오픈AI 위험평가 에이전트코딩