오픈AI, 수백 명의 계약직이 사용자 챗GPT 대화를 읽고 있다
404 Media의 조사에 따르면 오픈AI는 수백 명의 계약직 검수자가 실제 챗GPT 사용자 대화를 읽고 응답을 1~7점으로 평가하며, 과도한 아첨과 인간적 행동을 줄이는 작업을 하고 있다. 관련 안내는 깊숙이 묻힌 FAQ에만 있어 사실상 동의로 보기 어렵고, 사용자는 기본 켜져 있는 '모두를 위해 모델 개선' 설정을 꺼야 사람이 대화를 읽는 것을 막을 수 있다. Anthropic과 Google도 유사하게 인간 검수를 활용하고 있다.
오픈AI, 수백 명의 계약직이 사용자의 챗GPT 대화를 읽고 있다 Matthias Bastian | 2026년 9월 14일 | THE DECODER
404 Media의 조사에 따르면, 오픈AI는 챗봇의 응답 품질을 개선하기 위해 수백 명의 계약직 근로자가 실제 챗GPT 사용자의 대화를 읽고 있다. 해당 매체는 유출된 내부 문서를 확보하고 추가 소스들과의 인터뷰를 진행했다.
검수자들은 챗GPT 응답을 1점부터 7점까지 평가하며, 모델 출력에서 과도한 아첨(flattery)과 인간 같은 행동을 줄이는 임무를 맡고 있다. 한 검수자는 404 Media에 사용자들이 자신의 대화를 사람이 읽고 있다는 사실을 알지 못할 것이라고 말했다. 실제로 검수된 프롬프트를 보면 그 우려가 뒷받침된다. 일부 대화에는 사용자가 챗GPT에게 대화 내용을 비밀로 유지해달라고 명시적으로 요청한 경우도 있었다. 프롬프트는 익명화되어 있지만 여전히 민감한 개인정보를 포함할 수 있다. 오픈AI는 프라이버시 필터를 사용하지만 실수할 수 있음을 인정한다.
404 Media에 따르면 계약직 검수자들은 Crossing Hurdles("전문 인력과 미래의 AI 작업을 연결합니다")를 통해 모집되며, AI 훈련 회사인 Mercor를 통해 급여를 받는다. 북미 기반 검수자 한 명은 시간당 50달러 이상을 번다고 밝혔다.
사용자는 기본적으로 활성화되어 있는 '모두를 위해 모델 개선(Improve the model for everyone)' 설정을 끄면 자신의 대화가 모델 훈련에 사용되거나 사람이 읽는 것을 막을 수 있다. 이 설정은 새로운 대화에만 적용된다. 오픈AI는 또한 입력 데이터를 모델 훈련에 사용하지 않는다는 임시 채팅(temporary chat) 모드를 제공한다.
인간 검수 안내는 깊숙이 묻힌 FAQ에만 존재
404 Media가 사용자에게 인간 검수에 대해 어디서 명시적으로 알려주는지 묻자 오픈AI는 처음에 답변하지 않았다. FAQ 페이지에서 회사는 모델 성능 개선을 위해 승인된 인력과 서비스 제공업체가 사용자 데이터를 열람할 수 있으며 민감한 정보를 입력하지 말 것을 권고한다고 설명한다. 이 안내는 최소 2023년부터 온라인에 게시되어 왔으며 수년간 약간만 변경되었다.
404 Media는 이러한 고지가 너무 숨겨져 있고 모호해서 실제로 얼마나 많은 인간 검수가 이루어지는지 사용자가 인식하기 어렵다고 지적한다. 또한 '모두를 위해 모델 개선'이라는 표현은 자신의 대화를 사람이 읽는 것에 대한 동의라기보다 친절한 커뮤니티 기여처럼 읽힌다. 하지만 이런 모호한 표현은 아마 치밀하게 설계된 것일 수 있다. 오픈AI가 명시적인 동의를 요청했다면 옵트아웃 비율이 상당히 높았을 것이기 때문이다. 그러나 AI 연구소들에게 이런 종류의 인간 피드백은 모델 개선의 핵심 요소다.
이러한 관행은 광범위하게 퍼져 있다. Anthropic은 인간 검수자가 Claude의 응답을 확인하고 향후 모델을 개선하는 데 활용한다고 404 Media에 확인해주었다. 이는 프라이버시 설정에서 'AI 모델 개선 돕기'를 켠 사용자에게 적용된다. Anthropic은 인간 검수 전에 이메일 주소 같은 계정 정보를 제거하여 대화를 익명화한다. Google도 인간 검수자를 사용하며, Gemini에서 저장된 채팅을 사람이 검토할 수 있다고 안내하고 있다.
출처: 404 Media