OpenAI, 고객 데이터 저장 없는 안전 모니터링 서비스 공개
OpenAI가 Anthropic의 30일 데이터 보존 정책과 대비되는 '프라이빗 세이프티 프로세싱(Private Safety Processing)'을 선별 고객에게 프리뷰로 공개했습니다. 이 시스템은 고객 데이터를 전혀 보관하지 않으면서도 여러 세션에 걸친 악용 징후를 AI 에이전트가 자동 탐지합니다. 민감 데이터를 다루는 기업들에게 프라이버시와 안전성의 균형을 제시하는 경쟁 포인트입니다.
AI 모델이 더욱 강력해지면서 모델이 악용될 가능성도 커졌고, 그런 남용을 막을 수 있는 안전장치를 요구하는 목소리도 커지고 있다. AI 기업들은 이제 기업 고객의 프라이버시를 존중하는 동시에 사용 내역을 모니터링해 잠재적 문제를 살피는 줄타기를 해야 한다. 라이벌 Anthropic을 앞서려는 기회를 감지한 OpenAI는 방금 프라이버시 중심의 안전 모니터링 접근 방식을 발표했다.
이 회사는 선별된 고객을 대상으로 '프라이빗 세이프티 프로세싱(Private Safety Processing)'이라는 새로운 서비스를 프리뷰로 선보였다. 이는 고객 데이터를 전혀 보관하지 않으면서 동시에 잠재적 악용을 감시하는 자동화 시스템이다. 이 시스템은 Anthropic이 최근 발표한 데이터 보존 정책과 정면으로 배치된다.
일부 고객의 불만을 샀던 Anthropic의 이 정책은 '커버드 모델(covered models)'에 대해 AI 연구소가 사용자 데이터(해당 세션 전부와 그 안의 대화들)를 30일간 보관할 수 있게 한다. 이 모델에는 모든 Mythos급 모델과 "유사한 역량을 갖춘 향후 모델"이 포함된다고 회사는 밝혔다. 7월에 발표된 이 정책은 안전 목적으로 설계되어, 연구소가 잠재적 부적절 행위를 조사·분석할 수 있게 한다. 하지만 대량의 민감 데이터를 다루며 AI 연구소가 이를 보관(또는 검열)하는 것을 원하지 않는 일부 기업들의 깊은 우려를 샘다.
OpenAI는 다른 대부분의 AI 기업들과 마찬가지로 '제로 데이터 리텐션(Zero Data Retention, ZDR)'이라는 정책을 준수하며 이미 고객에게 상대적인 수준의 프라이버시를 제공하고 있다. ZDR은 OpenAI API 내 에이전트를 활용해 세션 단위로 악용 여부를 모니터링한다. 이 방식에서는 고객 데이터가 회사에 보관되지 않지만, 인간의 개입 없이도 나쁜 활동을 스캔할 수 있다. 참고로 Anthropic도 Fable 같은 '커버드 모델'을 제외하고는 대체로 ZDR을 준수하고 있다.
OpenAI에 따르면 프라이빗 세이프티 프로세싱은 ZDR의 범위를 확장하는 신기술이다. 이를 '장기적 안전 모니터링(long-horizon safety monitoring)'의 한 형태로, 단일 대화가 아니라 여러 대화의 입력과 출력을 평가한다고 설명한다. 이 모니터링 역시 에이전트가 수행하며, 트리거되면 상호작용을 포착해 세션 간 잠재적 악용 징후를 분석한다.
대변인은 테크크런치(TechCrunch)에 이 신기술이 여러 세션에 걸쳐 이루어지는 AI의 악의적 사용을 탐지하는 데 도움이 된다고 말했다. 가상의 시나리오로, 사이버공격용 악성코드를 만들려는 악의적 행위자는 적발을 피하기 위해 요청을 여러 번에 나누어 할 수 있다. 프라이빗 세이프티 프로세싱은 사용자 대화를 인간이 검토하지 않고도 그 여러 대화를 분석해 악용 징후를 찾아낼 수 있다.
회사에 따르면 시스템이 트리거되면 특정 유형의 활동을 경고하는 "범위가 좁게 정의된 신호"를 OpenAI에 보낼 수 있다. 그 신호를 바탕으로 OpenAI는 "제재가 필요한지" 여부를 결정한다. 필요할 경우 OpenAI는 더 많은 맥락을 얻거나 문제 해결을 협의하기 위해 고객에게 연락하며, 고객은 재량에 따라 OpenAI에 데이터를 공유할지 선택할 수 있다고 대변인은 말했다.
이와 대조적으로 Anthropic은 인간에 의한 고객 데이터 검토가 "소수의 승인된 검토자들"이 포함된 "통제된 접근 경로"를 통해서만 이루어질 수 있다고 밝힌다. 그리고 모든 검토 세션은 "검토자가 삭제하거나 수정할 수 없는 변조 방지 로그에 기록된다"고 회사는 덧붙였다.
현재 OpenAI와 Anthropic 간의 기업 경쟁은 치열하며, 양사는 상대를 앞설 수 있는 어떤 기회든 찾고 있다. 최근 보고서에 따르면 OpenAI의 2분기 성장세가 Anthropic보다 더뎠다. Anthropic의 연 환산 매출 런레이트는 현재 650억 달러로 알려졌다. Anthropic 투자자들은 2조 달러에 IPO할 수 있다고 말한 반면, OpenAI도 IPO를 준비 중이다.