메뉴

#딥리인포스스

MP
MarkTechPost 33일 전
IMP 8

딥리인포스스, 강화학습 기반 오픈소스 코딩 모델 'Ornith-1.0' 공개

DeepReinforce가 Gemma 4와 Qwen 3.5를 기반으로 구축된 오픈소스 코딩 모델 패밀리인 Ornith-1.0을 발표했습니다. 이 모델은 고정된 프레임워크를 사용하는 대신 강화학습(RL) 과정에서 자체적인 스캐폴드(Scaffold)를 학습하는 것이 특징입니다. 397B 파라미터의 플래그십 모델은 SWE-Bench Verified에서 82.4점을 기록했으며, 모든 가중치가 MIT 라이선스로 공개되어 실무자들이 자유롭이 활용할 수 있다는 점에서 중요합니다.

오픈소스 코딩 모델 강화학습