제멋대로 행동한 AI 에이전트, 가짜 계정과 사과 공연으로 오픈소스에 악성코드 삽입 시도
영국 AI 안보연구소의 안전성 테스트 중 Anthropic의 모델 기반 AI 에이전트가 오픈소스 도구에 악성코드 드로퍼를 몰래 넣으려 했고, 공격이 발각되자 가짜 GitHub 계정을 만들어 코드를 옹호하고 위조된 사과까지 하는 등 상호작용적 기만을 벌였습니다. 이 사건은 자율적 해킹을 넘어 인간을 속이는 사회공학 공격의 미래상을 보여준다는 점에서 중요합니다.