앤스로픽, 최강 AI 모델 '클로드 페이블' 대중 공개
앤스로픽이 자사의 가장 강력한 AI 모델인 '미토스'의 대중 접근 버전인 '클로드 페이블 5'를 공식 출시했습니다. 이 모델은 소프트웨어 엔지니어링 및 데이터 분석에서 탁월한 성능을 보이지만, 사이버 보안 및 화학 등 고위험군 질문에 대해서는 안전장치를 위해 더 안전한 모델로 폴백(Fallback)하도록 설계되었습니다. 철저한 보안 탐색을 거쳤음에도 잠재적 위협에 대비하여 업계 최초로 모든 트래픽의 30일 의무 보관 정업을 도입했다는 점이 가장 큰 특징입니다.
앤스로픽(Anthropic)이 자사의 가장 강력한 AI 모델을 일반 대중에게 처음으로 선보이고 있지만, 이는 강력한 안전장치와 함께 제공됩니다. 이번 화요일, AI 기업 앤스로픽은 '미토스(Mythos)' 모델의 첫 대중 공개 버전인 '클로드 페이블 5(Claude Fable 5)'를 출시했습니다. 앤스로픽에 따르면 페이블 5는 소프트웨어 엔지니어링, 지식 노동(Knowledge work), 그리고 시각(비전) 분야에 탁월하지만, 강력한 안전 한계선을 가지고 있습니다. 사이버 보안, 생물학, 화학, 지식 증류(Distillation)와 같은 고위험 분야에서는 모델이 응답을 차단하고 기존 모델인 '클로드 오푸스 4.8(Claude Opus 4.8)'로 대체(Fallback)됩니다.
지난 4월 프리뷰 버전으로 출시되었던 미토스는 초기에 사이버 보안에 대한 우려로 인해 소수의 파트너에게만 제한되었습니다. 지난주에는 15개국의 수백 개 기관으로 접근 범위를 확대했으며, 여전히 핵심 인프라를 관리하는 조직에 초점을 맞췄습니다. 이제 앤스로픽의 Claude API 및 사용량 기반(Consumption-based) 기업 요금제를 통해 누구나 이 기술의 일부 버전을 사용할 수 있습니다.
구독을 통한 접근은 단계적으로 이루어질 예정입니다. 6월 22일까지는 페이블 5가 Pro, Max, Team 및 좌석 기반(Seat-based) Enterprise 요금제에 추가 비용 없이 포함됩니다. 6월 23일, 앤스로픽은 해당 플랜에서 페이블 5를 분리하고 향후 사용량 크레딧(Credits)을 요구할 예정이며, 최대한 빨리 이를 표준 구독 기능으로 복원할 계획을 갖고 있습니다. 또한 앤스로픽은 고급 모델에 대한 접근이 이미 승인된 조직에 '미토스 5(Mythos 5)'라는 새 버전의 미토스를 배포하고 있습니다.
페이블의 출시는 앤스로픽이 OpenAI 및 일론 머스크의 SpaceX와 함께 공개 시장에 진출할 준비를 하면서 이루어지고 있습니다. 또한 이는 주요 글로벌 AI 연구소들이 첨단 AI 개발에 대한 조정된 '브레이크 페달(일시 정지)'을 설정해야 한다는 앤스로픽의 호소 이후에 나온 것입니다. 앤스로픽은 시스템이 너무 빠르게 발전하여 곧 인간의 개입 없이 스스로 개선하는 '재귀적 자기 개선(RSI, Recursive self-improvement)'을 달성할 수 있다고 경고했습니다.
미토스급 모델이 악의적인 사람의 손에 들어갈 경우를 우려하여, 앤스로픽은 페이블 5를 출시하기 전에 탈옥(Jailbreak) 시도를 통해 분류기를 스트레스 테스트했다고 밝혔습니다. "내부적으로 외부 버그 바운티(Bug bounty) 프로그램을 운영하여 1,000시간 이상의 테스트 동안 단 하나의 범용 탈옥도 발견하지 못했습니다. 이후 외부 레드팀(Red-teaming) 기관들과 협력했지만, 이들 역시 범용 탈옥을 찾는 데 실패했습니다."
그럼에도 불구하고 여전히 새롭고 전례 없는 공격이 가능할 수 있습니다. 그 결과, 앤스로픽은 페이블 5와 미토스 5의 출시와 함께 기업이 이전에 데이터 미보관(Zero-retention) 계약을 맺었더라도 모든 트래픽에 대해 30일 보관을 의무화할 것이라고 밝혔습니다. 앤스로픽은 해당 데이터를 훈련에 사용하지 않고, "새로운 탈옥을 포함한 복잡하고 새로운 공격에 방어"하고 "오탐지를 식별 및 줄이기 위한" 목적으로만 사용할 것이라고 덧붙였습니다. 이 정책은 점점 더 강력해지는 모델에 대한 접근이 안전 조치로서의 의무적인 데이터 보관 정책을 동반하는 업계의 선례가 될 수 있습니다.
이 모델을 계속 사용하는 사용자라 할지라도, 모든 질문에 페이블 5가 직접 답변하지는 않습니다. 앤스로픽은 페이블이 오푸스 4.8에 의존해야 하는 경우가 드물다고 밝혔으며, 초기 데이터에 따르면 최소 95%의 페이블 세션이 모델 자체의 응답으로만 완전히 실행되는 것으로 나타났습니다.
서드파티 테스트에서 분석 기업 Hex는 성명을 통해 페이블이 복잡하고 오래 실행되는 분석 작업을 측정하는 자사의 핵심 분석 벤치마크에서 90%를 달성한 첫 번째 모델이라고 밝혔습니다. Hex는 "가장 어려운 질문에서도 강력한 판단력과 미묘한 차이에 대한 주의력을 보여준다"고 말했습니다. 바이브 코딩(Vibe-coding) 플랫폼 Base44는 성명에서 페이블이 "원샷으로 전체 앱을 완성하는 능력"이 더 뛰어나며 툴 호출(Tool-calling) 능력이 탁월하다고 지적했습니다. AI 기반 워크스페이스 및 에이전트 플랫폼인 Genspark는 평가에서 페이블이 다른 모든 모델을 능가했으며, UI 디자인 및 게임 코딩과 같은 작업에서 훨씬 더 나은 성능을 보였다고 밝혔습니다.
페이블 5와 미토스 5의 가격은 백만 입력 토큰(Input token)당 10달러, 백만 출력 토큰(Output token)당 50달러로, 기존 오푸스 4.8 가격의 두 배입니다. 이 가격만으로도 대규모 사용에 대한 억제력이 될 수 있습니다. 많은 기업들이 청구서를 받거나 연간 AI 예산을 일찍 소진한 후 AI 비용에 대해 비판적으로 변하고 있습니다. 오푸스 4.8과 같은 고급 모델은 고급 추론 및 연산 과정으로 인해 이러한 비용 문제를 더욱 악화시킬 수 있습니다.