모질라 CTO가 전하는 오픈소스 AI의 현주소
오픈소스(오픈 웨이트) AI 모델이 폐쇄형 최상위 모델과의 성능 격차를 거의 좁혔으며, 추론 비용은 36개월 만에 50배 이상 폭락했습니다. 이제 실무의 대부분의 작업 부하에서는 오픈소스 모델이 주력으로 사용되고 있으며, 기술적 가치는 단순한 모델 자체를 넘어 이들을 유기적으로 연결하는 에이전트 환경으로 이동하고 있습니다. AI 주도권이 특정 빅테크에 독점되지 않도록 상호운용성과 경쟁을 보장하는 오픈소스 생태계의 중요성이 그 어느 때보다 커졌습니다.
모질라(Mozilla) CTO 라피 크리코리안(Raffi Krikorian)의 메시지
"뉴질랜드 최북단에서 마오리 방송인은 데이터를 자신들의 공동체에 묶어두는 라이선스 하에 '테 레오(te reo)'를 위한 음성 모델을 훈련합니다. 이 언어는 시장 규모가 너무 작아 기존 기업들의 관심을 끌지 못했죠. 세계 최대 회계법인 중 하나인 PwC는 재무 용어에 맞춰 오픈 모델을 미세조정(fine-tuned)했으며, 오늘날 자체 하드웨어에서 토큰당 비용을 지불할 필요 없이 수백 명의 고객을 위해 이를 운영하고 있습니다. 로잔의 연구원들은 적십자사와 함께 인도적 가이드라인에 맞춰 조정된 의료용 오픈 모델을 구축했으며, 자국과 탄자니아에서 임상 시험을 준비하고 있습니다. 동아프리카에서 농부들은 클라우드가 닿지 않는 들판에서 오프라인으로 작동하는 폰 자체의 모델을 사용해 카사바(cassava) 질병을 진단합니다. 스위스의 한 공공 컨소시엄은 공용 슈퍼컴퓨터에서 국가적 모델을 훈련하고 가중치, 데이터, 훈련 코드를 모두 공개했습니다. 이들 중 누구도 허락을 구하지 않았으며, 이런 방식은 기업의 유료 서비스를 빌리는 것으로는 불가능했을 것입니다. 그들은 이를 스스로 소유합니다. 이것이 오픈소스의 핵심 아이디어입니다.
우리는 이전에도 이런 상황을 겪었습니다. 모질라가 탄생한 이유도 한 기업이 웹의 현관문을 독점하려 했을 때, 오픈 커뮤니티가 일어나 그것을 막았기 때문입니다. 25년이 지난 지금, 누군가가 똑같은 패턴을 시도하고 있습니다. 우리는 지난번에 '오픈'에 베팅했고, 오픈이 승리했습니다. 함께한다면 우리는 다시 그렇게 할 수 있습니다. 우리의 믿음은 단순합니다. 앞으로 나아갈 길은 경쟁과 상호운용성(interoperability)에 있습니다. 우리는 수많은 모델이 존재하고, 이들을 표준적인 방식으로 연결할 수 있으며, 언제든 특정 벤더(vendor)의 속박에서 벗어날 자유가 있는 세상을 믿습니다. 오픈소스는 이에 대한 실적이 있습니다. 오픈소스는 파이를 키워 더 많은 사람들이 몫을 가질 수 있게 했습니다. 이어지는 내용을 하나의 지도로 읽어보세요: 오픈 AI가 승리하는 곳 (일부 수치는 우리조차 놀라게 했습니다), 그리고 취약점이 드러나는 곳. 약점을 숨기는 사례는 그저 광고일 뿐입니다."
라피의 전체 서한 읽기 → 여기에서 보고서 다운로드 ↓
오픈 웨이트(Open weights)가 성능 격차를 좁히는 동안 인공지능의 가격은 붕괴했습니다. 0% 최상위 폐쇄형(Closed) 모델과의 성능 격차 — 코딩에서는 동등한 수준, 추론에서는 뒤처짐 0× 36개월 동안 GPT-4 급 추론 비용의 하락: 100만 토큰당 $20 → $0.40
01 오픈소스 AI의 현재 상태
동등한 수준(Parity)에 도달했습니다. 이제 경쟁은 한 단계 더 높은 곳에서 벌어집니다. 오픈 웨이트(Open weights)는 더 이상 타협점이 아닙니다. 현재 실무 작업이 일어나는 곳입니다. 이제 실제 프로덕션 환경에서 처리되는 대부분의 토큰이 오픈 모델을 통과하며, OpenRouter에서 사용량이 가장 많은 상위 5개 모델 역시 모두 오픈소스입니다. 폐쇄형 모델은 여전히 추론 및 멀티모달리티(Multimodality) 같은 최전방(Frontier) 기술에서 앞서지만, 최전방 기술은 대부분의 실제 작업 부하에 필요하지 않습니다. 범용화된 입력값은 가격 결정력을 유지할 수 없습니다. 가치는 상위 계층인 에이전트 하네스(Agentic harness)로 이동하고 있습니다.
성능 격차: 8.04% → 0.5% → 3.3% 지난 24개월 동안 Chatbot Arena에서 나타난 오픈 vs 폐쇄형 모델 간의 격차입니다. 2024년 8월, 격차는 0.5%로 좁혀졌고, 2025년 2월에는 DeepSeek-R1이 미국의 최상위 모델과 잠시 동등한 수준을 기록했습니다. 2026년 3월에는 폐쇄형 추론 모델이 앞서나가면서 격차가 다시 3.3%로 벌어졌습니다. 하지만 이 3.3%라는 수치는 불규칙한 최전방 기술 평균치일 뿐입니다. 오픈 모델은 코딩, 지시 따르기, 일반 상식에서 동등하거나 근접한 수준이며, 격차는 주로 고차원적인 추론, 긴 문맥 검색, 에이전트 작업에 집중되어 있습니다. 따라서 중요한 것은 오픈 모델이 '충분히 좋은가?'가 아니라 '내 작업에 무엇이 필요한가?'입니다.
출처: Chatbot Arena, 2024년 1월 – 2026년 3월.
추론 비용은 36개월 만에 50배 하락했습니다.
GPT-4 동급 모델의 100만 토큰당 가격 — 닷컴 버블 시대의 대역폭이나 PC 연산 비용 하락 곡선보다 더 빠른 속도입니다. (로그 스케일)
출처: Stanford HAI AI Index 2025 (18개월 동안 GPT-3.5 급 하락률 280배); Epoch AI (연간 9900배 감소); 2025년 11월 MIT 연구 (최전방 기술 기준 하드웨어를 고려하여 연간 510배 하락).
오픈 웨이트가 토큰 점유율을 가져갑니다 OpenRouter에서 오픈 웨이트 모델을 통해 라우팅되는 토큰의 비율은 미미한 수준에서 2025년 말 3분의 1, 2026년 중반에는 과반수를 차지할 만큼 성장했습니다. 출처: OpenRouter 100조 토큰 연구 (2024년 11월 – 2025년 11월) 및 실시간 리더보드; 중간 지점은 보간법 적용.
단, 요청 수(Request count)를 기준으로 하면 여전히 미국의 폐쇄형(Closed) 공급업체들이 선두를 달리고 있습니다. — 오픈 모델의 선두는 토큰 사용량 기준입니다.