구글, 파산 항공사 스피릿 데이터를 경매에서 1,000만 달러에 낙찰받다
2026년 5월 영구 운항 중단 후 청산 절차에 들어간 미국 저가 항공사 스피릿의 데이터가 경매에 부쳐졌고, 구글이 1,000만 달러에 낙찰받았습니다. 구글은 1억 건의 이메일, 3천만 건 이상의 녹음 고객 상담 전화, Teams·Oracle·SAP 데이터 등 방대한 자료를 확보했으며, AI 서비스 향상 목적이라고 밝혔습니다. 데이터는 비식별화되었고 구글은 개인정보(PII) 발견 시 삭제하겠다고 약속했지만, 완전한 안전성에 대한 의문은 남습니다.
구글이 파산한 미국 항공사 스피릿(Spirit)의 데이터를 인수했다. 스피릿은 2020년 코로나19 사태가 닥치면서 재정적 난기류에 부딪혀 적자를 기록하기 시작했고, 재무 상태는 결코 안정 궤도로 회복되지 못한 채 2026년 5월 영구적으로 운항을 중단했다. 이 저가 항공사는 청산 절차에 들어갔으며, 현재 자산을 경매로 처분해 현금을 마련하고 채무를 최소한 일부라도 변제하고 있다.
지난주 제출된 법원 서류(PDF)에 따르면 매각 대상 자산 중 하나는 대규모 비식별화(deidentified) 데이터 모음이었고, 구글이 입찰에 참여해 단 1,000만 달러에 낙찰받았다.
이 금액으로 구글은 1억 건의 이메일과 마이크로소프트 Teams의 5억 개 항목, 1,700만 개의 OneDrive 파일, 2,050만 개의 SharePoint 항목을 구입했다. 또한 3천만 건 이상의 녹음된 고객 상담 전화와 1,500만 건 이상의 고객 상담 채팅 기록도 소유하게 되었다.
이 밖에도 60만 건의 ServiceNow 티켓, 오라클의 마케팅 애플리케이션 Responsys의 활성 이메일 주소 1,370만 개, 기내 와이파이 서비스 판매 1,100만 건 상세 정보도 포함되어 있다. 운영 데이터도 있는데, 76만 3천 회 이상의 항공편, 500만 건의 승무원 배정(crew pairing), 120만 건 이상의 유류 전표, 78만 7,452개 부품 구매 기록 등을 담고 있다.
구글은 AI 서비스 개선을 위해 이 데이터를 구매했다고 밝힌 것으로 전해진다. 차순위 입찰자는 AI 모델 학습용 데이터를 제공하는 회사인 머코르(Mercor)였다. 즉, 스피릿의 데이터가 AI 기업들에게 분명히 가치가 있다는 뜻이다. 실제로 The Register는 최근 AI 전문가들이 대규모 언어 모델(LLM)은 둔감한 도구이며, 특정 분야 지식으로 학습된 더 작은 모델이 일부 응용 분야에서 더 유용하다고 점점 더 생각하고 있다고 보도한 바 있다. 구글은 항공 운영 모델의 기초를 확보했을 수도 있고, 각종 일상적 재무 기록이 다른 AI에 유용할 수도 있다.
스피리틀 이용했고, 구글이 곧 해당 항공사 콜센터와의 언쟁을 알게 될까 걱정된다면, 걱정하지 말라는 안내를 받게 될 것이다. 법원 서류에 따르면 데이터는 매각 전에 비식별화되었으며, 구글은 데이터에서 개인식별정보(PII)를 발견하면 삭제하겠다고 약속했다. 다만 The Register는 앞으로 어떤 프롬프트나 검색 결과로 개인정보 일부가 노출되는, 불가피한 실수의 증거를 기다려 볼 참이다. 안전벨트를 매시오! ®