GPT-4 1년 vs 지금 7주, AI 생태계 경쟁 격화
GPT-4가 언어모델 성능 1위를 1년간 유지했던 것과 달리, 최근에는 1위 모델의 평균 수명이 7주에 불과할 정도로 AI 경쟁이 극심해졌습니다. 2024년 추론형 모델(예: o1) 등장 이후 1위 교체 횟수가 급증했으며, 기술 격차는 점차 줄어들고 있습니다. 이는 기업이 도입해야 할 최적의 AI 모델을 선택하는 주기가 짧아지고 있음을 시사합니다.
OpenAI의 GPT-4가 언어 모델 성능을 평가하는 복합 지표인 Epoch Capabilities Index(ECI) 최정상을 약 1년간 지켰습니다. Epoch AI의 연구원인 Jaeho Lee에 따르면, 이는 이후에 등장한 어떤 모델보다도 월등히 오래 기록입니다. OpenAI의 o1이 3개월 약간 넘는 기간 동안 2위로 긴 1위를 기록했는데, 이마저도 GPT-4의 집권 기간의 3분의 1에도 못 미칩니다.
Claude 3 Opus가 2024년 2월 GPT-4를 밀어내고 1위를 차지한 이후, 정상 자리는 무려 17번이나 교체되었습니다. 현재 모델별 최정상 평균 머물 기간은 약 7주에 불과합니다. 이 차트는 두 가지 방식으로 해석할 수 있습니다. 첫째, 출시 당시 확실한 이례적 존재였던 GPT-4를 경쟁 연구소들이 따라잡는 데 얼마나 오랜 시간이 걸렸는지 보여줍니다. 하지만 동시에, 그 이후 경쟁이 얼마나 치열해졌는지도 보여줍니다.
이제 어떤 모델도 압도적인 우위를 유지할 수 없습니다. 모델 간 교체기의 성능 도약은 2024년 가즘 o1-preview와 같은 추론 모델로 시작된 시절이나 GPT-4 시절에 비해 더 빠르지만, 그 격차는 훨씬 작아졌습니다.