세레브라스, 오픈AI GPT-5.6 Sol 초고속 모드 공개
세레브라스(Cerebras)와 오픈AI(OpenAI)가 초당 최대 750 토큰을 처리하는 '울트라패스트 모드(Ultrafast Mode)'를 선보였습니다. 이를 통해 GPT-5.6 Sol 모델의 품질을 유지하면서도 경쟁 모델 대비 최대 11배 빠른 추론 속도를 자랑하며, 시간이 생명인 금융, 보안, 코딩 등 실무 환경에서 AI 작업의 효율을 극대화할 수 있게 되었습니다.
2026년 8월 13일 — 세레브라스(Cerebras)와 오픈AI(OpenAI), GPT-5.6 Sol 초고속 모드 가속화 (작성자: Joyce Er)
오늘 세레브라스와 오픈AI는 세레브라스의 기술력을 바탕으로 오픈AI API에서 최초로 출시되는 새로운 서비스 계층인 '울트라패스트 모드(Ultrafast Mode)'를 일찍 공개하게 되었습니다. 울트라패스트 모드는 우선 일부 선별된 고객 그룹에게 제공되며, 점진적으로 액세스 권한이 확대될 예정입니다. 세레브라스가 지원하는 울트라패스트 모드의 GPT-5.6 Sol은 초당 최대 750개의 출력 토큰(Token)을 처리하면서도 품질 저하가 전혀 없습니다. 이를 통해 솔 울트라패스트(Sol Ultrafast)는 시간이 가장 중요하고 미션 크리티컬한 업무를 가속화할 수 있습니다.
전례 없는 속도의 최첨단 인공지능
AI 개발자들은 항상 속도와 지능 사이에서 하나를 선택해야 했습니다. 모델의 크기와 지능이 커질수록 더 많은 컴퓨팅 및 데이터 이동 비용이 발생하여 응답 속도가 느려집니다. 사용자는 고품질의 결과를 기다리거나, 짧은 시간 안에 낮은 수준의 결과를 타협해서 받아들여야 했습니다. GPT-5.6 Sol 울트라패스트 모드는 이러한 트레이드오프를 해결하여 1초가 아쉬운 제품 및 워크플로우에 최첨단 지능을 제공합니다.
인공지능 분석 플랫폼 Artificial Analysis가 보고한 출력 속도와 비교했을 때, 울트라패스트 모드의 GPT-5.6 Sol은 페이블 5(Fable 5)보다 11배 빠르며, 패스트 모드(Fast mode)의 오퍼스 4.8(Opus 4.8)보다 5배 빠릅니다. 세레브라스는 인류의 마지막 시험(Humanity's Last Exam, HLE)에서 인기 있는 모델들과 정면 대결하여 울트라패스트 모드를 테스트했습니다. HLE는 화학, 경제학, 문학 등 여러 분야에서 박사학위를 소지한 사람만 답할 수 있는 2,500개의 질문으로 구성된 까다로운 벤치마크입니다.
평가 결과, 울트라패스트 모드의 GPT-5.6 Sol은 11시간 11분 만에 2,500개의 HLE 질문에 모두 답변했습니다. 반면 클로드 페이블 5(Claude Fable 5)는 동일한 결론에 도달하기 위해 78시간 27분, 즉 3일 이상의 연속 컴퓨팅 시간이 필요했습니다. 다시 말해, 울트라패스트 모드는 단 하루 근무 시간 안에 인류 지식의 최전선을 탐구했으며, 비슷한 정확도를 거의 7배 더 빠르게 달성했습니다.
인류의 마지막 시험(Humanity's Last Exam) 벤치마크: 벤치마크는 세레브라스가 수행했으며, 7월 10일에 Codex 기반 '매우 높은 추론(xhigh reasoning)' 설정의 GPT 5.6 Sol 울트라패스트 모델과 7월 13~15일에 Claude Code 기반 '매우 높은 추론' 설정의 Claude Fable 5를 사용했습니다.
모델의 성능이 계속 발전함에 따라 빠른 추론을 위한 애플리케이션의 범위도 확장되고 있습니다. GPT-5.6 Sol은 법적 변론, 재무 모델 및 엔지니어링 보고서를 작성하는 데 있어 오픈AI의 역대 최고의 모델입니다. 경제적으로 가치 있는 지식 작업을 측정하는 벤치마크인 GDP-Val에서 울트라패스트 모드는 품질 저하 없이 엔드투엔드 속도를 5.6배 향상시켰으며, 이는 더 빠른 추론이 경제적으로 가치 있는 작업을 어떻게 가속화할 수 있는지 보여줍니다.
벤치마크는 세레브라스가 2026년 7월 31일 Codex 내에서 '중간 추론(medium reasoning)' 설정을 사용하여 GPT 5.6 Sol 및 GPT 5.6 Sol 울트라패스트로 수행되었습니다.
고속 인공지능, 고위험업무의 핵심 동력으로
더 빠른 인텔리전스는 개인과 조직에게 가능성의 지평을 넓혀줍니다. 울트라패스트 모드를 통해 이제 여러분은 1초가 급급한 문제의 핵심 경로에 AI 에이전트를 투입할 수 있습니다.
"GPT-5.6 Sol 울트라패스트를 통해 세레브라스는 사용자가 생각하고, 코드를 작성하고, 협업하는 속도를 따라잡는 AI를 구현합니다. 우리는 울트라패스트 추론을 통해 워크플로우와 애플리케이션이 어떻게 혁신되는지 기대하고 있습니다." - Rohan Varma, OpenAI 제품 총괄
울트라패스트 모드는 최첨단 AI를 사용하여 들어오는 정보에 신속하게 대응하려는 조직에 지속적인 경쟁 우위를 제공합니다. 웹 서비스를 운영하는 기업은 울트라패스트 모드를 활용하여 서비스 중단의 근본적인 원인을 파악하고 해결함으로써 고객의 신뢰를 유지하고, 수익 손실을 방지하며, SLA(서비스 수준 계약)에 따른 다운타임을 줄일 수 있습니다. 또한 고위험 사이버 공격 상황에서 울트라패스트는 막대한 피해를 막기 위해 악의적인 위협을 신속하게 탐지하고 대응해야 하는 보안 팀에게 매우 귀중한 도구입니다.
더 나아가 울트라패스트 모드는 에이전트를 활용하는 완전히 새로운 작업 방식을 가능하게 합니다. 에이전트의 성능을 최대한 끌어내기 위해 여러 병렬 세션 간에 컨텍스트를 전환할 필요 없이 실시간 통찰력과 업데이트를 제공합니다.
"과거에는 작업이 완료될 때까지 몇 분을 기다려야 했지만, 이제는 내가 컨텍스트를 전환할 틈도 없이 작업이 완료됩니다. 이 점이 제 생산성을 비약적으로 높여주었습니다." - Jeffrey Wang, OpenAI 연구원