새로운 세계 공항과 그 짐: 덴버 국제공항의 탄생
덴버 국제공항(DIA)이 어떻게 건설되었는지를 다룬 글로, 노후하고 확장 불가능했던 스테이플턴 공항의 한계와 1980년대 정치적 우연 속에서 신공항 계획이 추진된 배경을 설명합니다. 미국에서 1974년 달라스-포트워스 이후 첫 대형 공항 프로젝트로 예산 30억 달러에서 50억 달러로 늘어나는 등 수많은 우여곡절을 겪었습니다.
덴버 국제공항(DIA)이 어떻게 건설되었는지를 다룬 글로, 노후하고 확장 불가능했던 스테이플턴 공항의 한계와 1980년대 정치적 우연 속에서 신공항 계획이 추진된 배경을 설명합니다. 미국에서 1974년 달라스-포트워스 이후 첫 대형 공항 프로젝트로 예산 30억 달러에서 50억 달러로 늘어나는 등 수많은 우여곡절을 겪었습니다.
Tailscale이 서브넷 라우터, 앱 커넥터, 엑시트 노드의 처리량을 높이는 멀티 큐 기술과 메모리 오버헤드 개선 사항을 발표했습니다. 작은 패킷에 대한 64KiB 버퍼 복사를 제거해 약 5% 속도 향상을 얻었으며, 향후 안정 클라이언트 릴리스에 적용될 예정입니다. 성능에 민감한 CI, 원격 개발 환경, 엣지 디바이스 등의 워크로드에 실용적인 영향을 줍니다.
구글이 'AX(Open Agentic Orchestrator)'를 오픈소스로 공개했습니다. AX는 에이전트 작업을 YAML로 선언하면 샌드박스 격리, 네트워크 정책, 워크스페이스 구성을 자동으로 처리하고 클러스터당 수십억 개의 태스크를 실행할 수 있게 해주는 도구입니다. 액터 기반의 'Agent Substrate' 런타임 위에서 동작해 서브초 단위 재개와 고밀도 멀티플렉싱을 지원합니다.
우버는 깊은 의존성 체인에서 서비스 하나의 장애가 재시도 트래픽 증폭으로 이어져 전체 시스템 장애로 번지는 '재시도 폭풍' 문제를 다룹니다. 기존의 수동 재시도 설정과 재시도 예산(retry budget)만으로는 교차 서비스 증폭을 막기 어려워, 오류를 발생시킨 서비스와 전달만 하는 서비스를 구분하는 '오류 소유권(error ownership)' 기반의 컨텍스트 인식 메커니즘을 공유 인프라에 도입했습니다. 이를 통해 오류 발생 지점 근처에서만 재시도를 허용해 기준 대비 10% 이내의 트래픽 증가로 가용성을 유지할 수 있습니다.
메타 엔지니어링 팀은 가장 널리 쓰이는 키-값 저장소 ZippyDB와 클라이언트 애플리케이션 사이에 위치한 프록시 계층 'ZGateway'를 발표했습니다. ZGateway는 100만 개 이상의 클라이언트 호스트에서 발생하는 연결 난립(connection sprawl) 문제를 해결하기 위해 시작되어, 초당 수십억 건의 작업을 처리하는 ZippyDB 트래픽을 통합하는 무상태(stateless) 프록시 계층으로 발전했습니다.
OpenAI의 최신 최강 모델 '아스트라(Astra)'의 전례 없는 수요로 인해 인프라에 부하가 걸리자, OpenAI는 월 200달러짜리 Pro 요금제의 신규 구독을 일시 중단했습니다. 기존 사용자 서비스 품질 유지가 우선이며, API와 저가형 Go·Plus 요금제는 계속 이용 가능합니다. 이는 아스트라 출시가 'AGI 시대의 개막'으로 홍보되며 수요가 폭증한 사례로, AI 인프라 확장이 수요를 따라가지 못하는 상황을 보여줍니다.
문서 호스팅 플랫폼 Read the Docs가 2026년 6월 약 10일간 지속된 사상 최대 규모의 정교한 DDoS 공격을 받았습니다. 분당 550만 요청(평소의 약 100배)이 수백 개 네트워크의 수백만 개 IP에서 동시에 유입되었고, 공격자는 캐시 우회와 TLS/헤더 무작위화, 방어 적응 행동까지 보였습니다. AI 크롤러 증가 이후 인프라 커뮤니티 전반이 겪는 트래픽 남용 문제의 심각성을 보여주는 사례입니다.
영국 항공교통관제(ATC) 시스템 문제로 전국 공항에서 수백 편의 항공편이 취소·지연되는 대혼란이 발생했습니다. 맨체스터, 버밍엄, 히드로, 글래스고 등 주요 공항에서 저녁 늦게까지 운항 차질이 이어졌으며, 일부 편은 다음 날 새벽으로 지연되었습니다. 대규모 항공 인프라 장애 사례로서 시스템 복원력 측면에서 주목할 사건입니다.
Applied Compute가 코딩 에이전트, 모델 학습, 평가, 추론 라우팅까지 아우르는 종단 간(end-to-end) 연구 플랫폼 'AC2(Applied Compute Agent Cloud)'를 공개했습니다. SDK, 런타임, OpenTelemetry 기반 추적(observability) 패키지와 MCP 서버를 제공해 개발자가 하나의 환경에서 모델 개발 전 과정을 처리할 수 있게 한 점이 핵심입니다.
9월 3일(목) 오전 안스로픽, 오픈AI, xAI의 프론티어 AI 모델이 동시에 서비스 중단을 겪었다. xAI는 스페이스X의 멤피스 컴퓨트 센터 장애가 원인이라고 밝혔지만, 오픈AI는 라우팅 오류라고만 설명했고 안스로픽은 원인 코멘트를 거절했다. 동시 다발 장애는 보통 공유 클라우드 제공업체 문제를 시사하지만, Cloudflare·AWS·Azure 모두 장애를 보고하지 않아 진짜 원인은 베일에 싸여 있다.
미레이(Mireye)는 미국 내 모든 위치에 대한 데이터, 보강(enrichment), 도구, 신호를 하나의 API와 MCP 서버로 제공하는 인프라입니다. 창업자는 건설 에이전트를 개발하다가 AI가 물리적 장소에 대한 정보가 부족해 환각을 일으키는 문제를 직접 겪었고, 고객들이 앱이 아닌 기반 엔진을 원한다는 것을 확인해 인프라 회사로 전환했습니다.
해커뉴스에 OpenAI, Anthropic(Claude), xAI(Grok) 등 주요 AI 서비스가 동시에 서비스 장애를 겪고 있다는 질문이 올라왔습니다. 글쓴이는 각사의 공식 상태 페이지(status.openai.com, status.claude.com, status.x.ai) 링크를 공유하며 이것이 우연인지 의문을 제기했습니다. 주요 AI 인프라가 동시에 마비되는 사례로, 공용 클라우드 인프라 의존성이나 연쇄 장애 가능성 등이 관심사입니다.
앤스로픽(Anthropic)이 엔비디아(Nvidia)가 지원하는 클라우드 제공업체 람다(Lambda)와 350억 달러 규모의 클라우드 컴퓨팅 계약을 체결했습니다. 텍사스주 누에세스 카운티에 약 350MW 규모의 데이터센터가 건설되며, 이는 계획 중인 IPO에 앞서 대규모 인프라 확장의 일환입니다. Claude 및 Claude Code의 수요 증가에 대응하기 위한 것으로, 지난주에는 Nscale과도 450억 달러 계약을 맺었습니다.
트럼프 대통령은 미국 전역의 AI 데이터센터 반대 여론을 강하게 비판하며, 데이터센터 유치를 거부하는 지역사회는 '낙후되고 가난해질 것'이라고 주장했습니다. 여론조사에서 미국인 71%가 인근 데이터센터 건설에 반대하고 있으며, 2026년 1분기에만 약 1,300억 달러 규모의 75개 프로젝트가 차단·지연된 상황입니다. 중국은 향후 5년간 데이터센터 용량을 두 배 가까이 늘릴 계획이어서 미국 내 건설 지연이 AI 경쟁에서 중국에 유리하게 작용할 수 있다는 우려가 나오고 있습니다.
Stoa Markets는 분산된 GPU 및 AI 하드웨어 시장의 가격 불투명성을 해결하기 위해 YC 지원을 받아 출시된 검증된 거래 마켓플레이스입니다. 이 플랫폼은 공급망 전반의 가격을 투명하게 제시하고, 신뢰할 수 있는 거래자 간에 안전하게 결제 및 정산이 이루어지도록 설계되었습니다. 브로커, 데이터센터, AI 연구소 등 다양한 실무자들이 시장 리스크 없이 효율적으로 하드웨어를 매매할 수 있다는 점에서 중요합니다.
일론 머스크는 스페이스X의 컴퓨팅 인프라를 2027년 말까지 5GW 이상으로 대규모 확장하며, 차세대 엔비디아 '루빈(Rubin)' GPU 수백만 개를 도입할 계획입니다. 특히 자회사 흡수합병된 xAI의 막대한 적자 속에서도 클라우드 컴퓨팅 임대 사업(주요 고객은 안스로픽으로 추정)을 통해 수익을 크게 증대시키는 전략을 구사하고 있어 주목됩니다.
AI 스타트업 앤스로픽이 클로드(Claude) 모델의 처리 속도와 효율성을 극대화하기 위해 자체적인 AI 맞춤형 칩을 설계하는 팀을 꾸리고 있습니다. 기존에 AWS, 구글, 엔비디아 등과 협력해 인프라를 확보했음에도 폭발적인 수요를 감당하기 위해 독자적인 하드웨어 확보에 나선 것으로, 오픈AI와 메타 등 경쟁사들의 자체 칩 개발 추세와 맞물려 중요한 전략적 전환점으로 평가됩니다.
미국의 서버 및 클라우드 인프라 스타트업인 옥사이드 컴퓨터(Oxide Computer Co.)가 SEC에 Form D를 제출하며 4억 4,500만 달러(약 6,000억 원)의 대규모 자금 유치를 완료했습니다. 이는 규제 D 면제 규정(Rule 506(b))을 적용받는 비상장 유가증권 발행으로, 동사가 차세대 상용 클라우드 하드웨어 시장 공략을 위해 막대한 자금을 확보했음을 시사합니다.
AI 개발사 앤스로픽(Anthropic)이 올해 설립된 AI 클라우드 스타트업 볼타(Volta)와 6년간 100억 달러 규모의 클라우드 컴퓨팅 공급 계약을 체결했습니다. 볼타는 비트디어(Bitdeer)와 협력해 노르웨이에 엔비디아(Nvidia)의 최신 '베라 루빈(Vera Rubin)' 시스템 기반 데이터센터를 구축하여 클로드(Claude) 모델 학습 및 운영에 필요한 연산력을 제공할 예정입니다. 이는 스페이스X, 아마존 등과의 최근 연이은 협력에 이어, 경쟁사들과의 치열한 AI 경쟁에서 우위를 점하기 위해 앤스로픽이 컴퓨팅 인프라를 대규모로 확보한 핵심 사례입니다.
텍사스주가 신규 데이터센터 프로젝트에 대한 전력망 연결 수요가 폭증함에 따라, 새로운 건설을 전면 감사 대상으로 전환했습니다. 이는 데이터센터와 가상화폐 채굴장이 전력망에 과부하를 일으키고 전기 요금을 상승시키는 추세를 막기 위한 조치로 평가됩니다. 인프라 입지를 노리는 실무자들은 규제가 완화되었던 텍사스가 더 이상 데이터센터의 안전한 성지가 아닐 수 있음을 인지해야 합니다.
스페이스X가 자회사 xAI의 데이터센터에 불법으로 가동 중인 무허가 가스 터빈 69기를 영구적인 1.2GW 발전소로 전환하는 2027년 7월까지 철거하지 않기로 했습니다. 환경단체와 지역사회는 미국에서 가장 오염된 지역 중 한 곳에서 연간 2,000톤 이상의 스모그 유발 물질이 배출되는 심각한 환경 문제로 간주하고 강하게 반발하고 있으며, 현재 법적 공방이 진행 중입니다.
최근 AI 업계의 자본 순환 거래(예: 투자금을 다시 서버 비용으로 지불)는 단순한 버블 붕괴 징조가 아니라, AI가 전기나 원유 같은 '필수 상품(commodity)'으로 진화하고 있음을 보여줍니다. 원유 시장의 전통적인 인프라 투자 방식처럼, 막대한 초기 개발 비용을 감당하기 위해 수요를 미리 보장하는 순환 거래는 산업 성장의 자연스러운 과정입니다. 결과적으로 컴퓨팅 파워와 지능은 점점 더 유동적인 거래가 가능한 상품으로 자리 잡고 있습니다.
미국 캔자스주 엠포리아에서 1천 에이커 규모의 대형 데이터센터 건설을 반대하던 주민이 시의회에서 박수를 친 이유로 체포되는 사건이 발생했습니다. 해당 주민은 수정헌법 제1조가 보장하는 표현의 자유를 강조하며, 이 사업에 얽힌 막대한 전력 소모 문제와 개발업자의 의구심 등을 지적했습니다. 디지털 인프라 확충이 지역 사회에 미치는 막대한 영향과 주민의 알 권리 및 표현의 자유가 충돌하는 중요 사례입니다.
AI 붐에 따른 데이터센터의 폭발적인 전력 수요를 기존 전력망이 감당하지 못하는 심각한 인프라 병목 현상이 발생하고 있습니다. 발전소나 송전망 구축에는 수년에서 수십 년이 걸리지만 데이터센터 건설은 1년 이내에 끝나기 때문에, 한계에 직면한 기업들은 항공기 엔진을 재활용하는 등 돌파구를 찾고 있습니다.
미국의 최대 전력망 운영사인 PJM이 폭증하는 데이터센터 전력 수요를 감당하지 못하고 대규모 정전을 방지하기 위한 조치로 전력 부족 시 대형 데이터센터들의 전력 공급을 중단하는 정책을 도입했습니다. 이는 전력망의 한계를 드러내는 동시에, 데이터센터 업계가 자체 전력 인프라 구축이나 백업 발전기 운영에 더욱 의존하게 만드는 중요한 변화입니다.
인텔이 수천 회의 워크로드 실험을 통해 기업용 에이전트 AI(Agentic AI) 환경 구축을 위한 핵심 인사이트를 제시합니다. 에이전트 AI는 단순한 LLM 추론을 넘어 시스템 전체의 문제이므로, CPU 밀도(agent density)와 작업 지연 시간(latency) 등 실질적인 성능 지표를 중심으로 용량을 계획하고 확장해야 합니다.
오라클이 AI 붐에 대응하기 위해 전 직원의 약 13%에 달하는 2만 1천 명을 감원하며, 이는 오픈AI와의 3천억 달러 규모 컴퓨팅 인프라 계약을 지원하기 위함입니다. 하지만 최근 신용등급 하락과 70억 달러 규모의 전력망 인프라 보증금 요구로 인해 이 대규모 프로젝트는 난관에 직면했습니다.
AMD가 AI 스택 최상위 모델인 인스팅트 MI355X를 대체할 새로운 MI455X를 공개했습니다. 이 GPU는 CDNA5 아키텍처를 기반으로 랙(Rack) 단위의 확장을 지원하며, UALink 기반의 새로운 네트워크 아키텍처를 통해 단일 시스템 내에서 72개의 GPU까지 확장할 수 있습니다. 컴퓨팅 성능과 메모리 대역폭, 용량을 대폭 강화하여 대규모 AI 인프라 구축을 위한 핵심 경쟁력을 확보했다는 점에서 중요합니다.
오픈AI는 미국 조지아주 에핑엄 카운티에 '프로젝트 카멜리아'라는 대규모 데이터센터를 건설할 계획이며, 2028년부터 2032년까지 3.2기가와트(GW)의 전력을 단계적으로 공급받는 계약을 체결했습니다. 이는 미국 전역에서 데이터센터 건설에 대한 반대 여론이 거세짐에 따라 지역 사회를 달래기 위해 폐쇄형 수냉각 시스템 채택, 요금 인상 부담 없음, 막대한 지역 사회 기여금 및 학생용 크레딧 지원 등 대대적인 환경·사회적 보상을 내세운 것이 특징입니다.
구글이 자체 AI 모델인 제미나이의 구동 효율을 기존 대비 최대 10배 높일 새로운 서버 칩을 개발 중입니다. 이 칩은 내부 명칭 '프로즌 v2(Frozen v2)'로 불리며 2028년 출시를 목표로 하고 있습니다. 막대한 AI 인프라 투자에 대한 부담감 속에서, 구글이 엔비디아 의존도를 낮추고 자체 하드웨어 경쟁력을 강화하려는 전략적 행보로 평가됩니다.