HN
Hacker News • 16일 전
IMP 7
Qwen 3.8, GPT-5.5 Pro 추론 프리필 결과 추종
오픈 모델에 GPT-5.5 Pro의 추론 초반 1%를 프리필로 삽입하는 실험에서 Qwen3.8 A95B는 정답 유사도가 18.18%p나 상승했습니다. 반면 DeepSeek V4 Flash는 오히려 소폭 하락하고 Kimi K3는 4.54%p만 증가해, Qwen이 GPT-5.5 Pro(또는 유사 GPT 모델)로부터 학습했을 가능성을 시사합니다.
추론 프리필 모델 증류 Qwen