텐센트, 활성 크기의 5배 모델과 맞먹는 Hy3 오픈소스 공개
텐센트가 총 295B(활성 21B) 파라미터의 MoE 아키텍처 기반 오픈소스 AI 모델인 Hy3를 공개했습니다. 이 모델은 자신보다 2~5배 큰 모델들과 동등한 성능을 보이며, 환각률을 5.4%로 낮춘 것이 특징입니다. 아파치 2.0 라이선스로 상업적 사용이 가능해 AI 실무자와 개발자들에게 중요한 대안이 될 것으로 보입니다.
텐센트가 총 2950억 개의 파라미터를 가진 혼합 전문가(Mixture-of-Experts, MoE) 아키텍처 기반의 AI 모델인 Hy3를 공식적으로 발표했습니다. 추론 시 특정 시점에는 210억 개의 파라미터가 활성화되며, MTP(Multi-Token Prediction) 레이어를 위한 38억 개의 파라미터가 추가됩니다. 최대 25만 6,000 토큰의 문맥을 처리할 수 있으며, 텐센트는 이 모델이 자신의 활성 크기보다 2~5배 큰 규모의 기존 모델들과 동등한 성능을 낸다고 밝혔습니다. 270명의 전문가가 참여한 블라인드 평가에서 Hy3는 4점 만점에 2.67점을 받아 2.51점을 기록한 GLM-5.1을 제쳤습니다. 또한 내부 테스트 결과 환각 현상 비율이 12.5%에서 5.4%로 감소했습니다. Hy3는 Hugging Face, ModelScope, GitHub에서 Apache 2.0 라이선스로 제공되며, FP8 양자화 버전도 함께 공개되었습니다. 향후 OpenRouter 및 Cline과 같은 플랫폼 지원도 예정되어 있습니다. 텐센트는 이미 이 모델을 자체 제품인 워크버디, 위안바오, 위챗 및 '패스 오브 엑자일: 어드벤트' 게임 도우미에 탑재했습니다.
광고 없이 인간이 직접 엄선한 AI 뉴스를 만나보세요. THE DECODER를 구독하시면 주간 AI 뉴스레터, 연 6회 발행되는 독점 프론티어 보고서 'AI 레이더', 전체 아카이브 및 댓글 섹션 접근 권한이 제공됩니다. 지금 바로 구독하세요.
출처: Tencent