해커뉴스의 절반이 AI인 시대
한 블로거가 2026년 2월과 6월 해커뉴스(HN) 상위 인기 글을 조사한 결과, 일일 상위 게시물의 약 50~60%가 AI 관련 주제이거나 AI가 작성한 콘텐츠인 것으로 나타났습니다. 2월 40%에서 6월에는 50% 이상으로 증가했으며, AI 탐지 도구 Pangram을 활용해 AI 작성 여부를 검증했습니다. 거대 기술 커뮤니티에서 AI가 콘텐츠 소비와 생산 양쪽을 지배하는 추세를 보여주는 데이터입니다.
해커뉴스(HN)는 얼마나 AI에 점령당했을까?
TL;DR: 2026년 6월 기준, 일일 인기 상위 글의 약 50%가 AI에 관한 글이거나 AI가 생성한 글입니다.
2026년 3월 12일
나는 해커 뉴스와 복잡한 관계를 맺고 있다. 이 사이트는 가장 중요한 긱(Geek) 뉴스 애그리게이터이자 이 블로그의 주요 트래픽 출처다. 동시에 상당수의 악성 댓글 작성자들이 있어서 나를 향한 모욕의 확실한 공급원이기도 하다. 그 맛을 보고 싶다면, 이 글은 '묽게 타버린(watered-down)' '쓰레기(slop)'라는 평가를 받았다.
이 사이트는 긱에 의해, 긱을 위해 운영되기 때문에 기술 트렌드의 영향을 받는다. 예를 들어 2018년경에는 암호화폐와 NFT에 관한 글이 꽤 많았다. 그렇지만 최근의 변화는 더 심각해 보인다. 거의 매일, 인기 목록이 AI에 관한 글, AI가 쓴 글, AI가 댓글을 단 글로 점령당하는 느낌이다.
그 이미지는 유독 심했던 날을 보여주는 것이므로, 더 정직한 평가를 위해 2026년 2월과 같은 해 6월에 더 체계적인 조사를 수행했다.
원래의 2026년 2월 조사
피드에서 AI 관련 주제가 얼마나 많은 비중을 차지하는지 파악하기 위해 2월 한 달간 매일 상위 5개 글을 샘플링했다. AI는 2월 4일과 2월 12일에 5개 중 4개 자리를 차지했고, 2월 5일에는 사실상 목록 전체가 AI 관련이었다(3위 글은 AI 벤더의 스텔스 마케팅이었다). 상위 5개 중 LLM 뉴스가 없었던 날은 2월 1일(첫 AI 글이 7위, 그다음 9위), 2월 9일(첫 글이 8위), 2월 25일(AI가 6, 9, 10위)뿐이었다.
실험의 두 번째 부분인 '어떤 글이 AI 작성일 가능성이 높은지' 파악하기 위해 Pangram을 활용했다. Pangram은 LLM 생성 텍스트를 탐지하는 매우 정확하고 보수적인 모델이다. 이런 탐지 도구는 기술 커뮤니티에서 평판이 나쁘지만, 그런 비판은 대개 시대에 뒤떨어진 가정이나 명백한 오해에 기반한다. 도구가 작동하려면 AI 글쓰기가 어떤 의미로 '비인간적'일 필요가 없다. 현재 LLM들의 기본 문체가 준결정론적(quasi-deterministic)이라는 것으로 충분하다. 같은 에세이를 두 번 요청하면 문체적으로 유사한 결과가 나온다. 개별적인 특유의 표현은 인간과 비슷하지만, 당신의 글이 정확히 같은 조합을 담고 있을 가능성은 매우 낮다. 이에 대해서는 여기서 조금 더 다뤘다.
결과를 검증하기 위해 플래그된 모든 글을 직접 검토했는데, 조사 결과는 타당하다고 생각한다. 오히려 Pangram이 거짓 음성(false negative)을 몇 개 놓친 정도다. 어떤 글이 플래그되었는지 감을 주자면, 2월 19일의 3위 글("AI는 동료가 아니라 외골격이다")을 보라. 500개 이상의 업보트와 500개 이상의 댓글을 받았다. 내 견해로는 다양한 위험 신호(red flags)를 담고 있다.
2026년 6월 업데이트 데이터
6월에는 더 자세한 정보를 담기 위해, 순수하게 AI 자체에 대한 글(벤더 발표, 기술의 장단점에 대한 오피니언 등)은 진한 검은색으로, AI에 크게 기대지만 더 넓은 파급 효과가 있는 글(예: 인스타그램 AI 고객지원 에이전트 계정 해킹 사건)은 빗금 무늬로 표시했다. 이전과 마찬가지로 AI와는 우연히만 관련된 글(예: RAM 가격 인상 보도)은 플래그하지 않았다.
월 상반기에는 해커뉴스 일일 목록의 대략 60%가 AI 관련이거나 AI 생성 글이었고, 월말에 다가가면서 약 50%로 줄어들었다. 이는 2월의 40%에서 증가한 수치다.