클로드 오푸스 5 (Claude Opus 5) 발표
앤스로픽(Anthropic)이 최신 AI 모델인 클로드 오푸스 5(Claude Opus 5)를 공개했습니다. 이 모델은 이전 세대인 오푸스 4.8 대비 동일한 비용으로 압도적인 성능 향상을 보여주며, 코딩 및 지식 작업 벤치마크에서 새로운 SOTA(State-of-the-Art)를 달성했습니다. 특히 모델의 노력도(effort) 설정을 통해 토큰 비용과 지능도를 최적화할 수 있어 실무자의 일일 업무 효율성을 극대화하는 데 중요한 의미가 있습니다.
제품 발표: 클로드 오푸스 5 (Claude Opus 5) 소개 (2026년 7월 24일)
오늘 클로드 오푸스 5(Claude Opus 5)를 출시합니다. 이 모델은 사려 깊고 주도적인 모델로, 클로드 페이블 5(Claude Fable 5)에 필적하는 최고 수준의 지능을 절반의 가격에 제공합니다. Frontier-Bench 및 GDPval-AA와 같은 코딩 및 지식 작업 평가에서 오푸스 5는 새로운 최고 수준(State-of-the-Art)의 모델입니다. 단, 사이버 보안 작업에서는 여전히 Mythos 5 뒤처집니다. 오푸스 5는 매일 사용할 수 있도록 설계되었으며, 다른 모델들보다 더 효율적으로 작동합니다. 이 모델은 Claude Max의 새로운 기본 모델이자, Claude Pro에서 가장 강력한 모델입니다.
성능 및 비용 효율성 클로드 오푸스 5는 이전 세대인 오푸스 4.8과 동일한 비용으로 대폭 향상된 성능을 제공합니다. 이 섹션의 차트는 모델의 노력도(effort) 설정에 따라 성능이 어떻게 변하는지 보여주며, 고객은 이를 활용해 지능을 극대화하거나 토큰을 절약해 더 빠르고 저렴한 결과를 얻을 수 있습니다.
오푸스 5는 가치 있는 소프트웨어 엔지니어링 작업에서 탁월합니다. 예를 들어, Frontier-Bench v0.1에서 오푸스 5는 다른 모든 모델을 능가하며, 작업당 더 낮은 비용으로 오푸스 4.8의 성능을 두 배 이상 달성했습니다. CursorBench 3.2에서 최대 노력(max effort)으로 설정 시, 이 모델은 페이블 5의 최고 점수와 0.5% 이내의 성능을 보여주지만 작업당 비용은 절반에 불과합니다. 또한 high, xhigh, max 노력 설정에서 주어진 비용 대비 다른 모든 모델보다 더 높은 성능을 달성합니다.
지식 작업 및 문제 해결 작업에서도 유사한 결과를 확인했습니다. 예를 들어:
- 모델이 새로운 문제를 해결해야 하는 평가인 ARC-AGI 3에서 오푸스 5의 점수는 차상위 모델보다 3배 높습니다.
- 모델이 비즈니스 작업을 처음부터 끝까지 완료할 수 있는지 측정하는 Zapier AutomationBench에서 오푸스 5의 통과율은 작업당 동일한 비용 대비 차상위 모델의 약 1.5배입니다. 최저 노력 설정에서도 오푸스 5는 다른 모든 모델보다 더 많은 작업을 통과합니다.
- 컴퓨터 사용 벤치마크인 OSWorld 2.0에서 오푸스 5는 주어진 모든 비용 조건에서 다른 모든 모델을 능가하며, 단 3분의 1 약간 넘는 비용으로 페이블 5의 최고 결과를 뛰어넘습니다.
또한 여러 관련 평가에서 우리의 가장 좋고 비용 효율적인 모델입니다: ARC-AGI 3, GDPval-AA v2, OSWorld 2.0, HLE, AutomationBench, DeepSearchQA.
오푸스 5는 과학 연구 분야에서도 오푸스 4.8 대비 의미 있는 발전을 이루었습니다. 구조생물학, 유기화학, 생물정보학 등을 다루는 모든 생명 과학 평가에서 오푸스 4.8보다 더 나은 성능을 보여줍니다. 유기화학 작업(내부 벤치마크에서 분광 데이터로부터 분자 구조를 추론하여 오푸스 4.8보다 10.2% 높은 점수 기록)과 단백질 관련 작업(단백질 서열 변이가 기능에 미치는 영향 예측에서 7.7% 높은 점수 기록)에서 향상이 두드러집니다. 마지막으로 오푸스 5는 훨씬 더 강력한 시각적 출력물을 생성할 수 있습니다: 풍동(Wind tunnel), 셀 아티팩트(Cell artifact).
클로드 오푸스 5와 함께 일하기 클로드 오푸스 5는 자신의 작업을 검증하고 성공할 때까지 꼼꼼하게 반복하는 능력이 훨씬 강화되었습니다. 평가 및 얼리 액세스 테스트에서 우리와 사용자는 오푸스 5의 주도성과 철저함에 대한 많은 사례를 확인했습니다:
- 한 Frontier-Bench 작업에서 오푸스 5에게 기계 부품 도면이 주어졌고, 이를 3D FreeCAD 모델로 재구성하는 코드를 작성하도록 요청받았습니다. 그러나 이 작업에서 모델은 도면을 직접 볼 수 없도록 의도적으로 제한되었습니다. 이에 오푸스 5는 원시 픽셀에서 기하학적 형상을 추출하기 위해 자체 컴퓨터 비전 파이프라인을 작성한 다음, 전체 기계 부품을 재구성했습니다. 이 과정에서 반복적으로 성공했으며, 동일한 설정을 사용한 경쟁 모델은 5번의 시도 끝에도 이를 해결하지 못했습니다.
- 인기 있는 오픈 소스 패키지 관리자의 실제 버그가 주어졌을 때, 오푸스 5는 근본 원인을 찾아내고 커뮤니티 패치가 놓친 엣지 케이스를 수정했습니다. 반면 경쟁 모델은 표면적인 증상만 수정하고 근본 원인을 파악하지 못한 채 버그가 해결되었다고 보고했습니다.
- 한 트레이딩 회사의 엔지니어는 오푸스 5를 사용해 단 한 번의 세션으로 새로운 거래소를 위한 시장 데이터 피드를 구축했습니다. 이전 모델들은 이 작업을 완수할 수 없었습니다.