클로드 코드 실수 분석: 60초 자동 승인 기능의 위험성
Anthropic이 Claude Code에 사용자 동의 없이 60초 후 자동으로 작업을 진행하는 기능을 은연중에 추가하여 논란이 되었습니다. 이는 자동화된 환경에서 큰 보안 및 통제권 문제를 야기할 수 있는 명백한 설계 실수였으며, 며칠 뒤 수정되었지만 AI 에이전트의 자율성과 신뢰 문제를 다시금 환기시켰습니다.
원문 제목: Claude Code: Anatomy of a Misfeature (클로드 코드: 잘못된 기능의 해부)
소스: hackernews
#AI #security #cli #automation
Olaf Alders 작성 · 2026년 7월 17일 · 읽는 데 29분 · 6,163단어
목차 Hustvedt의 "기계식 계란 타이머"는 CC BY-SA 3.0 라이선스를 따릅니다. 더 넓은 프레임으로 확장되었으며, 이 각색본 역시 CC BY-SA 3.0로 라이선스됩니다.
2026년 캐나다의 날(7월 1일), Anthropic은 Claude Code 사용자들에게 놀라운 '이스터에그'를 출시했습니다. 버전 2.1.198에는 에이전트가 인간의 지시를 기다리지 않고 작업을 계속 진행할 수 있도록 하는 '효율성 바이패스'가 포함되어 있었습니다. 기본적으로 Claude Code가 사용자 입력을 요청한 후 60초짜리 타이머가 작동합니다. 이 시간 안에 응답하지 않으면, Claude Code가 친절하게(?) 자신이 가장 좋다고 판단하는 방향으로 작업을 마음대로 진행합니다. 그 상황은 다음과 같이 보입니다:
● Claude가 질문했습니다: ⎿ ... ● 60초 후 응답 없음 — 답변 없이 계속 진행함 ● 사용자가 자리를 비웠습니다. 제 판단에 따라 진행하겠습니다. 내 계획은:
참고: 위 내용은 질문 부분만 다듬은 제 실제 Claude 세션에서 그대로 가져온 것입니다.
이러한 동작 방식이 놀랍다고 느껴진다면, 당신만 그런 것은 아닙니다. 발생할 수 있는 잠재적 결과들을 생각해 봅시다:
- 샌드위치를 만들러 갈 때 노트북을 주방까지 가져가야 할까요?
- 이 시간 동안 자리를 비우면 어떻게 될까요?
- 한 번에 몇 개의 에이전트를 실행하고 계신가요? 그것들을 동시에 모두 감시할 수 있나요?
- 두 개 이상의 에이전트가 같은 60초 안에 입력을 요청하면 어떻게 될까요?
- 에이전트가 잘못된 선택을 하면 어떻게 될까요?
- 그 사이에 얼마나 많은 토큰이 소모될까요?
- 배포(deployment)를 위해 에이전트를 사용하고 있다면 어떻게 될까요? (네, 그런 일은 없겠지만 만약 그렇다면요)
이러한 것들은 이 기능을 출시할 때 합리적으로 고려해야 할 사항들이며, 어쩌면 변경 이력(changelog)에 그 이유를 문서화했을 수도 있습니다. 하지만 만약 변경 이력에 이 새로운 기본 설정에 대해 전혀 언급하지 않았다면 어떨까요? 그것이 훨씬 더 놀라운 일 아니겠습니까? (스포일러: 정말 그랬습니다!)
이 이야기에는 (어느 정도의) 해피엔딩이 있습니다. '빠르게 움직이고 부수기(Move fast and break things)'가 반드시 '빠르게 움직이고 고치기(Move fast and fix things)'를 배제하는 것은 아닙니다. 며칠 만에 수정 패치가 출시되었지만, 그렇다면 이 제품에 대한 사용자의 신뢰는 어디에 남게 되는 걸까요?
우리는 몇 가지 교훈을 얻었습니다:
- Claude Code의 놀라운 기능들은 이론적으로나 실제적으로 Anthropic에 의해 매일 새로 출시될 수 있습니다.
- 모든 기능이 반드시 변경 이력에 나타나는 것은 아닙니다.
- 기본값이 되어서는 안 되는 것들이 문서화된 비활성화 스위치(off switch)를 갖고 있지 않을 수 있습니다.
- Claude Code의 자동 업데이트 기능은 우리가 초기에 의심했던 것보다 훨씬 더 '알아서 내버려 둬(YOLO)' 모드에 가깝게 느껴집니다.
우리가 진정으로 교훈을 얻았는지 모를 몇 가지 사항들도 있습니다:
- 이 과정에서 인간은 어떤 역할을 했을까요?
- 인간이 이 기능을 구상했나요?
- 인간이 직접 이 기능을 작성했나요? (아니면 에이전트에게 작성하게 했나요?)
- 인간이 이 기능을 리뷰했나요?
- 인간이 이 기능을 승인했나요?
- 인간이 이 기능을 병합(merge)했나요?
- 인간이 문서화나 변경 이력 추가를 거부했나요?
- 인간인 릴리스 관리자가 배포하기 전에 이전 릴리스와 비교(diff)해 보고 최종 승인 인장을 찍어주었나요?
개인적으로, 인간이 이 모든 단계의 관문을 지키면서 '이게 정말 좋은 아이디어인가?'라고 묻지 않았다고는 믿기 어렵습니다. 만약 누군가 'Claude Code가 스스로 이 기능을 만들고, 배포하고, 승인한 다음 문서화할 가치가 없다고 판단했다'고 말한다면 저는 차라리 그쪽을 더 믿겠지만, 진실은 알 수 없습니다. 어쩌면 두 가지가 결합된 형태일 수도 있습니다. 아마도 여러 가지 일이 잘못되었겠지만, 분명한 것은 이런 일이 절대 일어나서는 안 된다는 것입니다. 저 역시 '실 서버 환경에 심각한 버그를 넣긴 했지만...'이라고 말했던 성과 평가를 받아본 적이 있는 사람으로서 이렇게 말하는 것입니다.
이 일이 어떻게 발생했었는지, 그리고 공개된 기록에 어떤 종류의 사후 분석(post-mortem)이 있는지 궁금해졌습니다. 그래서 Claude Code에게 자신을 조사해 보라고 했습니다. Claude에게 유리하게 말하자면, 이 코드와 관련하여 자기 성찰을 방해하는 필터가 없는 것 같습니다. 미리 밝히자면, 아래에 이어지는 내용은 대부분 Claude가 작업한 것이므로 그 점을 감안해서 읽으시길 바랍니다. 그리고 만약 당신이...