메뉴

#Cerebras

HN
Hacker News • 22일 전
IMP 7

Qwen 3.8 27B, Cerebras에서 초당 1500토큰으로 제공

Cerebras의 공개 API 엔드포인트에서 Qwen 3.8 27B 모델을 초당 약 1500토큰의 속도로 사용할 수 있게 되었습니다. 무료 체험 및 종량제 요금제에서 이용 가능하며, 컨텍스트는 무료 64k/유료 128k입니다. Cerebras는 가지치기(Pruning) 없이 원본 모델을 제공하며, 저장 시에만 선택적 양자화를 사용해 품질을 보존한다고 강조했습니다.

Cerebras Qwen 추론 속도
TD
The Decoder • 33일 전
IMP 7

세레브라스, 같은 칩으로 성능 2배 달성한 CS-4 공개

Cerebras가 기존 WSE-3 칩을 그대로 사용하면서 전력 공급과 냉각 개선을 통해 클럭 속도를 높여 CS-3 대비 2배 성능을 낸 CS-4 AI 가속기를 공개했습니다. 랙 단위 제품으로 사용자당 초당 최대 4,400 토큰을 처리하며, 엔비디아 GPU 기반 대비 최대 30배 빠르다고 주장합니다. OpenAI가 Codex Spark에 이 하드웨어를 사용하는 등 실제 도입 사례가 있다는 점에서 주목할 만합니다.

하드웨어 AI가속기 Cerebras
HN
Hacker News • 43일 전
IMP 8

세레브라스, 오픈AI GPT-5.6 Sol 초고속 모드 공개

세레브라스(Cerebras)와 오픈AI(OpenAI)가 초당 최대 750 토큰을 처리하는 '울트라패스트 모드(Ultrafast Mode)'를 선보였습니다. 이를 통해 GPT-5.6 Sol 모델의 품질을 유지하면서도 경쟁 모델 대비 최대 11배 빠른 추론 속도를 자랑하며, 시간이 생명인 금융, 보안, 코딩 등 실무 환경에서 AI 작업의 효율을 극대화할 수 있게 되었습니다.

OpenAI Cerebras AI 모델