HN
Hacker News • 5일 전
IMP 7
헤츠너, LLM 추론 API 실험 공개
저렴한 서버 호스팅으로 유명한 헤츠너(Hetzner)가 자체 인프라 기반의 LLM 추론 API 실험을 시작했습니다. 오픈AI 호환 API 형태로 제공되며, 현재는 Qwen 35B 모델 하나만 지원하지만 토큰당 224개의 매우 빠른 처리 속도를 보여줍니다. 아직 상용화 단계는 아니지만, 클라우드 사업자가 저비용 고효율 GPU 인프라를 무기로 LLM 서비스 시장에 진출하려는 시도라는 점에서 주목할 만합니다.
헤츠너 LLM 추론 오픈AI API