미국 정부의 앤스로픽 AI 모델 사용 중단 조치, '탈옥(Jailbreak)'이 진짜 이유가 아니었다
미국 상무부가 국가 안보를 이유로 앤스로픽(Anthropic)의 최신 AI 모델에 대한 접근을 금지하는 수출 통제 지시를 내려, 회사가 즉각 모든 고객에 대한 서비스를 중단했습니다. 하지만 이 조치는 실제 기술적 보안 결함보다는 정부의 보복성 행정 조치에 가깝다는 전문가들의 비판이 쏟아지고 있습니다. 이 사건은 미국 AI 기업들이 정부의 자의적인 개입에 언제든 흔들릴 수 있음을 보여주는 중요한 선례로 작용할 것입니다.
미국 정부가 앤스로픽(Anthropic)에 보낸 집행 서한은 주말 직전에 회사가 최신 AI 모델을 강제로 오프라인으로 전환하게 만들었습니다. 이는 AI 연구소를 비롯한 모든 미국 기술 기업에 경종을 울려야 하는 사건입니다. 관련 뉴스 폭풍을 요약해 드리자면 다음과 같습니다. 금요일 오후, 미국 상무부는 불분명한 국가 안보 우려를 이유로 앤스로픽 직원을 포함한 비미국인의 'Fable 5' 및 'Mythos 5' 모델 접근을 금지하는 생소한 수출 통제 지시를 담은 서한을 앤스로픽에 보냈습니다. 앤스로픽은 이 서한이 모델의 안전 가드레일(guardrail) 우회와 관련이 있다고 믿지만, 구체적인 세부 정보가 없어 확신하지 못한다고 밝혔습니다. 이 서한은 공개되지 않았습니다. 이에 대응하여 앤스로픽은 지시를 준수하기 위해 모든 고객에 대해 두 가지 핵심 모델을 종료했습니다. 그 결과, 미국 정부는 법원 승인이 필요 없어 보이는 신속하고 일방적인 조치로 기술 기업의 모델을 오프라인으로 전환시키는 데 성공했습니다.
금요일 트럼프 행정부의 개입은 AI 산업이 정부의 간섭에 결코 면역이 아님을 보여줍니다. 이는 또한 기술 산업 전반에 대한 경고이기도 합니다. '순종하라, 그렇지 않으면 당신과 당신의 제품을 강제로 종료시킬 수 있다'는 것입니다. Axios는 소식통을 인용하여 두 주요 플레이어 간의 주말 동안 긴장된 상황을 전했으며, AI 제품의 기술적 문제가 아니라 앤스로픽과 트럼프 행정부 간의 '성향 차이'로 인해 수출 지시가 내려졌다고 보도했습니다.
주말 동안 밝혀진 이 사안에 대한 새로운 세부 정보는 본래 흔들리고 있던 정부의 명분에 더 큰 의문을 제기하고 있습니다. Luta Security를 설립한 사이버 보안 베테랑이자 연구원인 케이티 무수리스(Katie Moussouris)는 블로그 게시물에서 앤스로픽이 최근 보안 연구원들이 작성한 Fable 5의 안전 장치 우회를 설명하는 논문 사본을 공유했다고 밝혔습니다. (월스트리트 저널은 논문의 저자들이 아마존(Amazon)의 보안 연구원이라고 보도했습니다.) 무수리스는 앤스로픽이 논문에 대한 자신의 의견을 요청해왔다고 말했습니다. 무수리스의 블로그 게시물은 연구원들이 안전 장치 우회를 어떻게 유발했는지 설명했지만, 그 우회 자체가 "결코 수출 통제를 촉발해서는 안 된다"고 밝혔습니다. 그 차이는 주로 AI 모델에게 "보안 문제에 대한 코드를 검토해 달라"고 요청하는 것과 "이 코드를 수정해 달라"고 요청하는 것 사이에 있습니다. 질문을 약간만 다르게 하더라도 최종 결과는 거의 같습니다.
무수리스는 수출 통제 지시를 성급하고 무거운 손길이며 잘못된 것이라고 비판하며, "논문에 설명된 동작은 의미 있는 방법으로 수정될 수 없으며, 수정을 시도하면 방어 목적을 위해 모델을 약화시킬 뿐이다"라고 말했습니다. 무수리스와 수십 명의 다른 최고 보안 연구원 및 전문가들은 트럼프 행정부에 수출 통제 명령을 철회해 달라고 요청하며, 미국 내 네트워크 방어자들로부터 고급 사이버 보안 기능을 빼앗는 움직임을 "위험하다"고 불렀습니다. 과거 행정부들도 지식 격차에 대해 포괄적인 결정을 내린 바 있습니다. 예를 들어, 2010년대에 미국 정부가 사이버 공격에도 사용될 수 있는 사이버 보안 도구를 다루기 위해 수출법을 수정할 때 사용한 언어는 너무 광범위하여 의도치 않게 합법적인 보안 및 취약성 연구를 거의 불법으로 만들 뻔했습니다.
하지만 트럼프 행정부의 지시는 보복성으로 보입니다. Tech Policy Press의 편집장인 저스틴 헨드릭스(Justin Hendrix)는 트럼프 행정부의 조치가 "핵심 애플리케이션을 위한 미국 AI의 신뢰성에 대해 외국 수도들에 경보를 울릴 가능성이 있다"고 말했습니다. 여기서 전달되는 메시지는 미국의 AI 기업이 미국 정부의 간섭 없이 운영될 것이라고 신뢰할 수 없다는 것입니다. 트럼프 행정부는 수출 통제 지시를 발동한 이유를 확인하지 않았습니다. 관리들이 보고서를 잘못 읽고 당황한 것일까요? 아니면 아마존 CEO 앤디 재시(Andy Jassy)가 주의 또는 앙심으로 인해 고위 정부 관리들에게 반응을 촉발하는 무언가를 말한 것일까요? 번역 과정에서 오해가 있었던 것일까, 아니면 이것이 앤스로픽에 압력을 가하기 위한 방법이었을까요?