메뉴

#Hermes 에이전트

HN
Hacker News • 24일 전
IMP 6

M4 Pro 맥 미니로 구축한 로컬 LLM 서버

48GB RAM을 갖춘 M4 Pro 맥 미니에서 Qwen3.6-35B와 Gemma-4 모델을 oMLX 추론 서버로 구동하고, Tailscale로 아이폰·맥북을 연결해 에이전트 백엔드로 활용하는 방법을 소개합니다. 클라우드 API의 가격 변동, 데이터 프라이버시, AI 주권 리스크를 피하고 비용 예측성과 지연 감소, 오프라인 사용 등의 실용적 이점을 얻을 수 있다는 것이 핵심입니다. GPT-5나 Claude Opus가 필요한 나머지 20%를 제외한 일상 요청의 80%를 무료로 처리하는 것이 목적입니다.

로컬 LLM 맥 미니 oMLX