美 최대 전력망, 대규모 정전 방지 위해 데이터센터 전력 공급 중단 검토
미국의 최대 전력망 운영사인 PJM이 폭증하는 데이터센터 전력 수요를 감당하지 못하고 대규모 정전을 방지하기 위한 조치로 전력 부족 시 대형 데이터센터들의 전력 공급을 중단하는 정책을 도입했습니다. 이는 전력망의 한계를 드러내는 동시에, 데이터센터 업계가 자체 전력 인프라 구축이나 백업 발전기 운영에 더욱 의존하게 만드는 중요한 변화입니다.
미국의 최대 전력망 운영사인 PJM이 폭증하는 데이터센터 전력 수요를 감당하지 못하고 대규모 정전을 방지하기 위한 조치로 전력 부족 시 대형 데이터센터들의 전력 공급을 중단하는 정책을 도입했습니다. 이는 전력망의 한계를 드러내는 동시에, 데이터센터 업계가 자체 전력 인프라 구축이나 백업 발전기 운영에 더욱 의존하게 만드는 중요한 변화입니다.
인텔이 수천 회의 워크로드 실험을 통해 기업용 에이전트 AI(Agentic AI) 환경 구축을 위한 핵심 인사이트를 제시합니다. 에이전트 AI는 단순한 LLM 추론을 넘어 시스템 전체의 문제이므로, CPU 밀도(agent density)와 작업 지연 시간(latency) 등 실질적인 성능 지표를 중심으로 용량을 계획하고 확장해야 합니다.
오라클이 AI 붐에 대응하기 위해 전 직원의 약 13%에 달하는 2만 1천 명을 감원하며, 이는 오픈AI와의 3천억 달러 규모 컴퓨팅 인프라 계약을 지원하기 위함입니다. 하지만 최근 신용등급 하락과 70억 달러 규모의 전력망 인프라 보증금 요구로 인해 이 대규모 프로젝트는 난관에 직면했습니다.
AMD가 AI 스택 최상위 모델인 인스팅트 MI355X를 대체할 새로운 MI455X를 공개했습니다. 이 GPU는 CDNA5 아키텍처를 기반으로 랙(Rack) 단위의 확장을 지원하며, UALink 기반의 새로운 네트워크 아키텍처를 통해 단일 시스템 내에서 72개의 GPU까지 확장할 수 있습니다. 컴퓨팅 성능과 메모리 대역폭, 용량을 대폭 강화하여 대규모 AI 인프라 구축을 위한 핵심 경쟁력을 확보했다는 점에서 중요합니다.
오픈AI는 미국 조지아주 에핑엄 카운티에 '프로젝트 카멜리아'라는 대규모 데이터센터를 건설할 계획이며, 2028년부터 2032년까지 3.2기가와트(GW)의 전력을 단계적으로 공급받는 계약을 체결했습니다. 이는 미국 전역에서 데이터센터 건설에 대한 반대 여론이 거세짐에 따라 지역 사회를 달래기 위해 폐쇄형 수냉각 시스템 채택, 요금 인상 부담 없음, 막대한 지역 사회 기여금 및 학생용 크레딧 지원 등 대대적인 환경·사회적 보상을 내세운 것이 특징입니다.
구글이 자체 AI 모델인 제미나이의 구동 효율을 기존 대비 최대 10배 높일 새로운 서버 칩을 개발 중입니다. 이 칩은 내부 명칭 '프로즌 v2(Frozen v2)'로 불리며 2028년 출시를 목표로 하고 있습니다. 막대한 AI 인프라 투자에 대한 부담감 속에서, 구글이 엔비디아 의존도를 낮추고 자체 하드웨어 경쟁력을 강화하려는 전략적 행보로 평가됩니다.
최근 발표된 Kimi K3와 Qwen 3.8 등 고성능 오픈소스 기반 모델은 최고 수준(SOTA)의 AI 성능을 무료로 제공하며 폐쇄형 선도 기업들에게 큰 위협이 되고 있습니다. 이는 AI 모델의 상용화 과정에서 발생하는 막대한 추론(Inference) 비용을 절감하고 자체 인프라를 보유한 기업들에게 유리한 경쟁 구도를 형성합니다. 결국 인프라가 없는 모델 중심 기업들은 가격 경쟁이나 완벽한 기술 독점을 통한 생존 전략을 강요받게 될 것입니다.
메타가 자사 데이터센터의 남는 AI 컴퓨팅(compute) 용량을 앤스로픽(Anthropic)에 임대하는 방안을 논의 중이며, 이 계약은 최대 100억 달러 규모가 될 수 있습니다. 이는 메타에게는 AI 인프라 투자를 활용한 새로운 수익원이 되며, 'Claude Code' 수요가 폭증한 앤스로픽에게는 절실한 연산력 확보처가 됩니다. 메타는 자체 AI 수요가 예상보다 낮을 경우 초과 용량을 판매하겠다는 마크 저커버그 CEO의 이전 전략을 처음으로 실행에 옮길 것으로 보입니다.
샌디스크 등은 플래시 메모리 칩을 수직으로 적층하는 첨단 패키징 기술을 통해 읽기 속도를 획기적으로 높이는 '고대역폭 플래시(High-Bandwidth Flash)' 기술을 제시했습니다. 이를 통해 방대한 AI 모델 가중치(Model Weights)를 효율적으로 저장하고 불러올 수 있어 AI 인프라의 메모리 병목 현상을 해결할 핵심 기술로 주목받고 있습니다.
인터넷 연결이 불안정하거나 대규모 데이터센터 인프라가 부족한 지역을 중심으로 소형 AI 모델이 빠르게 확산하고 있습니다. 이러한 소형 모델(TinyML)은 기존 클라우드 환경에 의존하지 않고도 기기 자체에서 데이터를 처리하고 유용한 결과를 도출할 수 있어 실용성이 높습니다. 통신 및 인프라 한계를 극복할 수 있는 엣지 AI(Edge AI) 기술로서 가치가 재평가되고 있는 중요한 흐름입니다.
이 글은 단일 서버 구조, UniFi 네트워크 기기, 자동화된 Docker 업데이트 및 백업을 활용해 홈랩 유지보수 시간을 월 15분으로 획기적으로 줄인 사례를 다룹니다. 복잡한 클러스터나 하이퍼바이저 대신 단순함과 자동화를 선택함으로써, IT 실무자가 개인 인프라를 효율적으로 운영할 수 있음을 보여줍니다.
AI 스타트업 오멘 AI(Omen AI)가 데이터센터 내 칩 냉각수를 모니터링하고 세균 번식을 방지하는 기술을 개발하여 3,100만 달러(약 410억 원)의 시리즈 A 투자를 유치했습니다. 최근 고성능 AI 칩이 늘어나면서 액체 냉각 방식이 필수화되고 있어, 냉각수의 수질과 위생을 관리하는 기술의 중요성이 대두되고 있습니다. 이 솔루션은 데이터센터 인프라 관리자에게 냉각 효율을 높이고 유지보수 비용을 절감할 수 있는 핵심 도구가 될 것입니다.
AI 데이터센터의 전력 수요가 폭증하는 반면, 미국 전력망의 인프라 확충 속도는 이를 따라가지 못해 전력 공급 차질이 심각한 병목 현상으로 이어지고 있습니다. 이에 따라 빅테크 기업들은 전력망 의존도를 낮추고 자체적인 BTM(계량기 후면) 발전 설비를 구축하는 방향으로 전환하고 있으며, 오는 2028년에는 신규 데이터센터의 절반 이상이 자체 전력으로 운영될 것으로 전망됩니다.
네트워크 자동화 스타트업 '네트리스(Netris)'가 AI 클라우드(Neocloud) 데이터센터의 오픈 및 구축 기간을 단축하는 기술력을 인정받아 a16z로부터 1500만 달러(약 200억 원)의 시리즈 A 투자를 유치했습니다. 이 회사의 하드웨어 가속화 기반 자동화 소프트웨어는 엔비디아(Nvidia)와 AMD 장비를 모두 지원하며, 폭스콘, HPE 등 글로벌 기업들의 GPU 클러스터 운영 시간과 비용을 획기적으로 절감하고 있습니다.
모델 학습 파이프라인이 고도로 복잡해짐에 따라, 수동 작업으로는 다수의 전문 팀 간 협업과 인프라 관리를 처리하기 어려워졌습니다. AI 연구소 Aleph Alpha는 이를 해결하기 위해 전체 학습 과정을 코드로 구현하는 '모델 팩토리(Model Factory)' 시스템인 Savanna를 구축했습니다. 이를 통해 학습 과정 전체를 클릭 한 번으로 실행하고, 인적 오류와 반복 작업을 줄여 모델 학습을 하나의 협업 소프트웨어 프로젝트처럼 효율적으로 관리할 수 있게 되었습니다.
미국 오클라호마주에서 열린 데이터센터 건립 관련 공청회에서 한 주민이 발언 제한 시간을 수 초 초과했다는 이유로 경찰에 체포되는 사건이 발생했습니다. 이 사건은 개발사의 비밀주의로 인해 지역 주민들의 의견 수렴 없이 진행되는 데이터센터 건립에 대한 거센 반발과 함께 표현의 자유 위축을 초래할 수 있다는 우려를 낳고 있습니다. 인프라 건설이 지역 사회에 미치는 장기적인 영향과 절차적 정당성에 대한 중요한 경고로 작용합니다.
클라우드 네이티브 환경을 위한 보안 강화 컨테이너 이미지인 Minimus가 무료 티어를 전면 개방했습니다. 해당 이미지들은 기존 대비 취약점과 불필요한 패키지를 80~100%가량 성공적으로 감소시킨 것이 특징입니다. 단, 무료 티어는 별도의 기술 지원이나 보안 패치 보장(SLA)이 없으므로 실무 적용 시 주의가 필요합니다.
2026년 6월 23일, 독일의 철도 통신 시스템에 문제가 발생하여 전국적인 열차 운행이 전면 중단되는 사태가 발생했습니다. 이로 인해 뮌헨, 뒤스부르크, 하노버 등 주요 기차역에는 목적지를 찾지 못한 승객들이 크게 몰리며 장기 대기 행렬이 형성되었습니다. 국가 핵심 인프라의 통신 장애가 대규모 물류 및 인력 이동에 즉각적인 마비를 초래한 사례로 평가됩니다.
캐시 도입 시 가장 먼저 떠오르는 Redis는 시간이 지나면서 개발자들에 의해 영구적인 DB처럼 오용되어 운영자에게 큰 부담을 줍니다. 반면 Memcached는 디스크 저장 기능이 없고 클라이언트 기반 클러스터링을 지원하여 장애 처리가 매우 단순합니다. 단순한 캐시가 필요한 인프라 환경이라면 운영 및 관리 측면에서 Memcached가 훨씬 안정적이고 가벼운 선택지가 될 수 있습니다.
이 기사는 노르웨이에서 건설 중인 세계 최장·최심해 해저 도로 터널인 '로그파스트(Rogfast)'의 현장을 취재한 내용입니다. 발파 공법 등 노르웨이의 독보적인 터널 건설 기술력과 극한 환경에서 일하는 엔지니어들의 도전 정신을 조명합니다.
AI 인퍼런스 스타트업 베이스텐(Baseten)이 불과 5개월 전 50억 달러 가치로 3억 달러를 유치한 데 이어, 현재 130억 달러의 기업가치로 15억 달러 규모의 대규모 투자 유치를 임박한 것으로 알려졌습니다. 최근 투자 업계에서 '인퍼런스 골드러시'가 일면서 사용자의 요청을 가장 효율적인 모델로 라우팅해 비용을 절감하는 베이스텐의 핵심 기술력이 높은 평가를 받고 있습니다.
미국 연방에너지규제위원회(FERC)는 전력망 운영자들에게 AI 데이터센터의 전력망 연결을 신속하게 처리하라고 명령했습니다. 이는 AI 산업 경쟁력 유지를 위한 조치이며, 데이터센터를 위한 '계량기 뒤쪽(BTM)' 자가 전력 사용 및 대체 송전 기술 도입도 장려했습니다. 하지만 신규 발전소 부족과 전력 수요 급증으로 인한 근본적인 전력 부족 및 요금 폭등 문제는 여전히 해결 과제로 남아있습니다.
AI 에이전트가 활용할 수 있는 외부 도구와 API, 워크플로우 같은 '자원'이 폭증함에 따라, AI가 필요한 기능을 스스로 찾지 못하는 '탐색' 문제가 새로운 병목으로 떠올랐습니다. 이를 해결하기 위해 AI가 작업에 적합한 자원을 검색하고 정보를 얻을 수 있도록 돕는 표준 규격인 ARD(Agentic Resource Discovery)가 소개되었습니다. 이는 기업 내부망이나 퍼블릭 환경에서 AI가 사용 가능한 수많은 도구를 쉽게 발견하고 연동할 수 있는 핵심 인프라가 될 것입니다.
AI가 이메일을 읽고 대신 처리하는 시대가 되면서, SPF, DKIM, DMARC 등 이메일 인증 기술의 중요성이 그 어느 때보다 커지고 있습니다. 구글과 야후 등 대형 이메일 제공자들은 이미 발신자 인증을 필수 인프라로 요구하고 있으며, 이는 AI 기반 피싱 공격을 막는 핵심 방어막 역할을 합니다.
구글은 버지니아주에 대한 투자를 확대하여 2030년까지 2,741명의 전기 기술 견습생을 양성하는 등 지역 인프라 성장에 맞춘 차세대 기술 인력을 지원합니다. 또한 1,500만 달러의 '에너지 임팩트 펀드'를 신설해 주민들의 공공요금 부담을 줄이고, 500MW 이상의 신규 에너지 용량을 확보하며 데이터센터를 책임감 있게 구축할 계획입니다.
데이터독(Datadog) 초기 엔지니어 출신들이 창업한 AI 코딩 스타트업 나이트시프트(Niteshift)가 700만 달러의 시드 투자를 유치했습니다. 이 회사는 오픈AI나 앤스로픽 같은 기초 모델 기업들이 수직적 시장으로 영역을 확장하며 경쟁 앱을 출시하는 상황(SaaS 대란) 속에서, 고객사들이 특정 모델이나 벤더에 종속되지 않도록 돕는 인프라를 제공하는 데 주력합니다.
오픈AI가 오하이오주에 10GW(기가와트) 규모의 거대 데이터센터를 임대하기 위해 협상 중이며, 엔비디아가 재정적으로 지원할 것으로 알려졌습니다. 이는 오픈AI가 고성능 AI 모델 학습과 운영을 위해 필요한 막대한 인프라를 확보하려는 중요한 움직임으로, AI 산업 내 빅테크 간 인프라 및 파트너십 경쟁이 한층 심화될 것임을 시사합니다.
최근 전 세계적인 AI 컴퓨팅 인프라 부족 현상 속에서, xAI가 Anthropic과 Google에 대규모 데이터센터 용량을 임대하는 거래를 성사시켰습니다. 스페이스X와의 합병을 앞둔 xAI는 이를 통해 막대한 수익을 창출하며 사실상 데이터센터 부동산 임대 기업과 같은 형태로 변모하고 있습니다. 이는 심각한 서버 부족을 겪던 Anthropic과 같은 AI 기업들에게는 단비와 같으며, 일론 머스크의 압도적인 인프라 구축 속도가 시장에서 강력한 무기로 작용하고 있음을 보여줍니다.
소프트웨어 관측 가능성(Observability) 스타트업 Coralogix가 자율적으로 작동하는 AI 에이전트의 등장에 대비하여 2억 달러(약 2,700억 원)를 유치했습니다. 이번 펀딩은 기업들이 AI 시스템을 본격 도입하면서 이를 모니터링하고 오류를 해결할 차세대 인프라의 필요성이 커졌음을 시사합니다. 이 회사는 AI 기반 도구를 활용해 장애를 진단하는 비중을 늘리며 빠른 매출 성장을 기록하고 있습니다.
클라우드 호스팅 플랫폼인 Railway가 상위 클라우드 제공업체인 Google Cloud의 계정 차단을 원인으로 대규모 서비스 장애를 겪고 있습니다. 이로 인해 사용자 인증 실패, 대시보드 접속 불가 등의 증상이 발생했으며, API 및 내부 네트워크 제어 등 핵심 인프라 복구를 위해 구글 측과 협력 중입니다. 현재 복구 시점(ETA)은 미확정 상태이며 지속적인 모니터링이 필요합니다.