미스트랄, 경쟁사 제친 신규 OCR 모델 'OCR 4' 공개
미스트랄 AI가 문서 내 텍스트, 표, 수식 등의 요소와 레이아웃을 정확하게 분석하는 새로운 OCR 모델 'OCR 4'를 출시했습니다. 600개 이상의 문서로 진행된 블라인드 테스트에서 72%의 압도적인 승률로 경쟁 모델들을 제쳤으며, 170개 국어를 지원해 글로벌 문서 처리 작업에 매우 유용합니다.
미스트랄 AI는 PDF, 워드 파일, 파워포인트 프레젠테이션과 같은 문서에서 텍스트를 읽어내는 새로운 모델, OCR 4를 발표했습니다. 이전 버전들과 달리 OCR 4는 단순히 원시 텍스트만 추출하는 것이 아닙니다. 제목, 표, 수식 또는 서명인지 여부에 상관없이 페이지 내 각 요소의 위치와 역할을 식별합니다. 이러한 블록 분류 기능은 문서를 의미 있는 섹션으로 자동 분할하는 데 도움을 주며, 검색 시스템에 데이터를 입력하거나 AI 에이전트가 문서를 처리하는 데 매우 유용합니다. 또한 이 모델은 신뢰도 점수를 출력하여 읽어낸 각 단어나 페이지에 대해 얼마나 확신하는지 추정치를 제공합니다. 미스트랄에 따르면 OCR 4는 170개 언어를 지원하며, 희귀 언어에서도 우수한 성능을 발휘합니다. 회사 측은 600개 이상의 문서로 진행된 블라인드 테스트에서 독립적인 평가자들이 경쟁 모델보다 OCR 4의 결과를 72%의 사례에서 더 선호했다고 밝혔습니다. 이 모델은 API, 미스트랄 스튜디오(Mistral Studio), 마이크로소프트 파운드리(Microsoft Foundry)를 통해 이용할 수 있습니다. 가격은 1,000페이지당 4달러이며, 배치 모드에서는 1,000페이지당 2달러입니다.