메뉴

#분산 컴퓨팅

HN
Hacker News 17일 전
IMP 8

메시 LLM: Iroh 기반 분산 AI 컴퓨팅

메시 LLM(Mesh LLM)은 기존에 보유한 여러 대의 컴퓨터 GPU와 메모리를 묶어 하나의 거대한 GPU처럼 작동하게 만드는 분산 AI 인프라 기술입니다. 이를 통해 고비용의 클라우드 API에 의존하지 않고도, 사내에 방치된 GPU를 활용해 대규모 언어 모델(LLM)을 자체 운영하고 통제권을 확보할 수 있어 실무자들에게 매우 유용한 대안입니다.

분산 컴퓨팅 오픈소스 LLM 인프라
HN
Hacker News 101일 전
IMP 8

차세대 LLM 서비스 아키텍처: 데이터센터를 넘나드는 KVCache

대규모 언어 모델(LLM) 서비스를 위한 새로운 분산 아키텍처인 'Prefill-as-a-Service(PrfaaS)'를 제안하는 연구 논문입니다. 최신 하이브리드 어텐션 모델을 활용하여 KVCache 크기를 획기적으로 줄이고, 이를 일반 이더넷 망을 통해 다른 데이터센터로 전송하여 연산 부하를 분산시킵니다. 이를 통해 이기종 GPU 클러스터를 유연하게 확장할 수 있으며, 실험 결과 기존 방식 대비 최대 54% 높은 서비스 처리량을 달성하여 대규모 AI 인프라 운영에 매우 중요한 의미를 갖습니다.

인프라 스케일링 KVCache LLM 서비스