HN
Hacker News • 52일 전
IMP 8
미스트랄, 오픈소스 멀티모달 검열 모델 '실드스트랄' 공개
미스트랄(Mistral)은 텍스트와 이미지를 동시에 처리할 수 있는 30억(3B) 매개변수 규모의 오픈소스 멀티모달 안전 검열 모델인 '실드스트랄(Shieldstral)'을 공개했습니다. 이 모델은 콘텐츠 검열을 '질의응답(QA)' 작업으로 정의하여, 일반 텍스트로 정책을 입력하면 별도의 재학습 없이도 유연하게 안전도를 평가합니다. 단일 16GB GPU에서 구동되는 가벼운 모델임에도 자신보다 7배 큰 기존 가드레일 모델들과 동등하거나 더 뛰어난 성능을 보여준다는 점에서 AI 안전 및 검열 시스템 구축에 있어 매우 중요한 의미를 갖습니다.
모델 평가 AI 안전 멀티모달