메뉴

#API비용

HN
Hacker News • 29일 전
IMP 7

소형 모델의 시대가 왔다

gpt-5.6-luna 같은 소형 고속 모델이 놀라운 능력과 저렴한 비용(~$0.10)을 제공하면서 소비자용 AI 앱의 경제성이 finally 성립하게 되었다는 분석입니다. 저자는 '천재형' 업무보다 기업 업무의 약 95%를 차지하는 '빠르고 반응성 좋은 토큰 뿜어내기'형 업무에 소형 모델 수요가 폭발할 것으로 전망합니다.

소형모델 API비용 GPT
TD
The Decoder • 50일 전
IMP 7

알리바바 큐웬3.8 맥스, 클로드와 동급...하지만 비용·환각 문제는 여전

알리바바의 최신 모델인 Qwen3.8 Max가 지능 지수에서 Claude Opus 4.8과 맞먹는 수준으로 성능이 크게 향상되었습니다. 하지만 과도한 토큰 처리량 증가로 인해 오히려 작업당 비용은 크게 상승했으며, 모르는 질문을 억지로 추측하면서 환각(Hallucination) 현상도 급증한 한계를 보입니다.

알리바바 큐웬 인공지능모델
HN
Hacker News • 106일 전
IMP 8

마법의 듀얼: LLM 게임 플레이 성능을 테스트하다

복잡한 카드 게임인 '매직 더 개더링'을 활용해 다양한 최신 LLM들의 게임 플레이 및 논리적 추론 능력을 평가하는 'MTG Bench'가 공개되었습니다. 개발자는 규칙 강제 엔진 없이 MCP(Model Context Protocol) 서버를 연동하여, 에이전트 루프에서 발생하는 API 토큰 비용을 획기적으로 절감하는 효율적인 테스트 방식을 제안했습니다.

LLM평가 에이전트 매직더개더링