BL
MarkTechPost • 7일 전
PrismML, 5.9GB 삼진법 모델 'Ternary Bonsai 2 27B' 공개
IMP 8/10
핵심 요약
PrismML이 Qwen3.8 27B를 삼진 가중치(Ternary)로 압축한 'Ternary Bonsai 2 27B'를 아파치 2.0 라이선스로 공개했습니다. FP16 대비 약 9분의 1 수준인 5.93GB 크기임에도 20개 벤치마크 평균의 98.2% 성능을 유지하며, 텍스트와 이미지 입력 및 26만 토큰 컨텍스트를 지원합니다. 소비자급 GPU에서도 대형 멀티모달 모델 실행이 가능해졌다는 점에서 주목할 만합니다.
번역된 본문
PrismML이 Qwen3.8 27B의 삼진 가중치(Ternary-weight) 버전인 'Ternary Bonsai 2 27B'를 공개했습니다. 이 언어 모델의 용량은 5.93GB로, FP16 기준 53.80GB에 비해 크게 줄어들었습니다. PrismML에 따르면 이 모델은 20개 벤치마크 평균에서 원본 모델 성능의 98.2%를 유지합니다. 텍스트와 이미지 입력을 지원하며 26만 2천 토큰(262K)의 컨텍스트 길이를 갖추고 있습니다. PrismML은 이 모델이 Cline 코딩 에이전트를 구동하는 모습을 시연했습니다.
원문 보기 (영어)
PrismML has released Ternary Bonsai 2 27B, a ternary-weight version of Qwen3.8 27B. The language model occupies 5.93 GB, against 53.80 GB in FP16. PrismML reports that it keeps 98.2% of the parent model’s average across 20 benchmarks. The model accepts text and images and supports a 262K-token context. PrismML demos it driving Cline coding […]
The post PrismML Releases Ternary Bonsai 2 27B: A 5.9 GB Apache 2.0 Model Retaining 98.2% of Qwen3.8 27B Performance appeared first on MarkTechPost.