xAI, 저렴한 가격의 Grok 4.7 출시…벤치마크는 경쟁사에 크게 뒤져
일론 머스크의 xAI가 코딩·지식 작업용 최신 모델 Grok 4.7을 출시했습니다. 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러로 서방 최첨단 모델보다 중국 모델에 가까운 파격적 가격이지만, 종합 벤치마크에서는 Claude Fable 5.1과 GPT-6에 큰 격차로 뒤처지고 에이전트 코딩 벤치마크에서는 저가 DeepSeek 모델보다도 낮은 성적을 기록했습니다.
xAI가 저렴한 가격에 Grok 4.7을 출시했지만, 벤치마크에서는 Claude와 GPT-6에 큰 격차 드러나
마티아스 바스티안 (Matthias Bastian), 2026년 9월 21일
일론 머스크의 xAI가 코딩 및 지식 작업용으로 지금까지 가장 성능이 뛰어난 모델인 Grok 4.7을 공개했다. 회사에 따르면 이 모델은 더 큰 기반 모델 위에 구축됐으며, 더 긴 강화학습(reinforcement learning)으로 훈련되었고, 자신의 출력을 더 잘 검증하도록 설계되었다.
가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러다. 이 요금은 서방 최첨단 모델보다는 중국 모델에 가까운 수준인데, 그만한 이유가 있는 것으로 보인다.
10개 벤치마크를 종합한 독립 지표인 Artificial Analysis Intelligence Index(v4.3.2)에서 Grok 4.7은 46점을 기록하며 중위권에 머물렀다. Claude Fable 5.1과 GPT-6은 각각 53점으로 선두를 달리고 있다.
에이전트 코딩(agent coding) 분야에서는 격차가 더욱 벌어진다. Terminal-Bench 4.0에서 Grok 4.7은 26%에 그친 반면, GPT-6 Astra는 60%, Claude Fable 5.1은 55%를 기록했다. 심지어 더 저렴한 DeepSeek V4.1 Flash도 27%로 Grok 4.7을 근소하게 앞섰다.
이 모델은 Grok API, Cursor, Grok Build를 통해 이용할 수 있다.
출처: xAI