메뉴

#로컬LLM

HN
Hacker News • 15시간 전
IMP 6

Ollaya – 오픈소스 Jev 스타일 의사결정 모델의 로컬 실행 도구

Ollaya는 Ollama처럼 자체 하드웨어에서 의사결정 모델을 로컬로 실행할 수 있는 오픈소스 도구입니다. 텍스트나 JSON에 대해 타입화된 질문을 던지면 토큰 생성 없이 단일 순전파로 밀리초 단위의 캘리브레이션된 답변을 얻을 수 있습니다. RTX 4090 기준 5개 질문 처리에 약 10ms가 걸리며, TypeSafe API와 호환되고 데이터가 외부로 나가지 않아 프라이버시가 중요한 업무에 유용합니다.

오픈소스 로컬LLM 의사결정모델
HN
Hacker News • 52일 전
IMP 8

홈벤치: 로컬 LLM 속도·메모리·성능 벤치마크

홈벤치(Homebench)는 사용자의 PC에 설치된 로컬 LLM(Ollama, LM Studio 등)의 속도, 메모리 사용량, 품질을 측정하여 실시간 터미널 리더보드로 보여주는 도구입니다. 복잡한 설정이나 클라우드 API 키 없이 단 한 줄의 명령어로 실행되어, 개발자가 자신의 하드웨어 환경에 맞는 최적의 로컬 모델을 빠르고 직관적으로 찾을 수 있게 해줍니다.

로컬LLM 오픈소스 벤치마크
MP
MarkTechPost • 68일 전
IMP 7

단일 24GB GPU로 구동하는 최고의 로컬 LLM 비교

본문은 진지한 로컬 추론 작업을 위한 실질적인 최소 요건인 24GB 단일 GPU 환경에서 실행할 수 있는 6가지 주요 오픈웨이트 모델을 비교 분석합니다. Qwen, Gemma, Mistral, DeepSeek 등 각 모델의 VRAM 요구량, 라이선스, 그리고 최적의 활용 사례를 소개하여 실무자의 모델 선택을 돕습니다.

로컬LLM 오픈소스 VRAM
HN
Hacker News • 73일 전
IMP 7

자바(Java) 기반 초저지연 로컬 LLM 실행 런타임 공개

Hacker News에 자바 22의 Project Panama FFM API를 활용하여 로컬에서 대규모 언어 모델(LLM)을 매우 빠르게 실행할 수 있는 'libargus'가 공개되었습니다. 이 런타임은 텍스트뿐만 아니라 비전, 오디오, 영상 처리를 단일 프로세스로 통합하고, GC(가비지 컬렉션) 부하가 없는 제로 카피(Zero-copy) 메모리 기술을 적용해 AI 추론 성능을 극대화한 것이 특징입니다. 자바 생태계에서 네이티브 수준의 고성능 멀티모달 AI를 구현하고자 하는 개발자에게 중요한 오픈소스입니다.

자바 로컬LLM 멀티모달AI
HN
Hacker News • 84일 전
IMP 7

최신 고성능 AI 모델을 로컬에서 구동하는 법

OpenAI나 Anthropic 같은 빅테크에 의존하지 않고, 로컬 환경에서 최고 수준(SOTA)의 AI 모델을 구동하기 위한 하드웨어 구성 및 세팅 가이드입니다. 약 2,000달러로 시작하는 중소형 구성부터 약 4만 달러의 다중 GPU 워크스테이션까지, 가격대별 권장 부품과 Docker 기반 실행 환경을 제공합니다. 특히 PCIe 스위치를 활용해 GPU 간 통신 병목을 해결한 점이 기술적으로 주목할 만합니다.

로컬LLM 하드웨어 오픈소스