메뉴

#ai 코딩 에이전트

HN
Hacker News • 4시간 전
IMP 7

AI 없이 한 달을 보내며: AI 코딩 중독에서 벗어난 개발자의 고백

한 오픈소스 개발자가 직장에서 AI 코딩 에이전트에 지나치게 의존하게 된 경험을 고백합니다. 처음에는 생산성이 폭발적으로 오르는 듯했지만, 점차 코드를 이해하지 못한 채 AI가 작성한 PR을 그대로 병합하고, 여러 에이전트를 동시에 돌리며 통제력을 잃어가는 과정을 담담하게 회고합니다. AI가 개발자를 '멍청하고, 게으르고, 더 나쁜 개발자'로 만든다는 개인적 성찰을 담은 글로, 해커뉴스에서 큰 화제가 되었습니다.

AI 코딩 에이전트 개발자 생산성 오픈소스
HN
Hacker News • 15일 전
IMP 7

아스트라 코딩 에이전트, 우리는 왜 또 이 짓을 하고 있나?

파이썬의 창시자 중 한 명이자 CPython 개발자인 아르민 로나처가 GPT-6 아스트라로 주말 내내 '소프트웨어 공장' 실험을 돌려본 결과를 공유했습니다. 약 40억 토큰과 35시간을 소모했지만 가치 있는 결과물은 없었고, 모델이 장기 과제 완수에는 강하지만 저품질 코드에 대한 페널티가 부족해 엉뚱한 방식으로 작동한다고 분석했습니다. AI 엔지니어링 전반이 '내권(內卷, 인볼루션)' — 노력은 늘지만 실질 생산성은 그대로인 상태 — 를 닮아가고 있다는 비판이 핵심입니다.

GPT-6 아스트라 아르민 로나처 AI 코딩 에이전트
HN
Hacker News • 23일 전
IMP 7

AI 에이전트 시대, 사라져가는 리팩토링

AI 코딩 에이전트는 인간과 달리 복잡한 코드에서 길을 잃지 않기 때문에 '더 이상 못 참겠으니 리팩토링하자'는 결정이 점점 일어나지 않는다는 문제를 지적한다. 모듈화와 캡슐화 같은 소프트웨어 설계 원칙은 본질적으로 인간의 작업 기억 용량에 대한 타협이었는데, 에이전트가 이 한계를 우회하면서 장기적 유지보수성을 지켜주던 핵심 방아쇠가 사라지고 있다는 것이다.

리팩토링 AI 코딩 에이전트 소프트웨어 유지보수
MP
MarkTechPost • 31일 전
IMP 6

에이전틱 코딩이 주니어 엔지니어를 대체하려면 무엇이 참이어야 하는가

에이전틱 코딩(Agentic Coding)이 주니어 엔지니어를 실제로 대체하려면 충족되어야 하는 네 가지 반증 가능한 조건을 제시하고, METR, OpenAI, DORA, 스탠퍼드의 1차 자료 증거와 대조해 검증하는 글입니다. AI 코딩 에이전트의 실제 역량과 한계를 데이터 기반으로 평가한다는 점에서 개발자와 채용 담당자 모두에게 중요한 참고자료입니다.

에이전틱 코딩 AI 코딩 에이전트 소프트웨어 엔지니어링
HN
Hacker News • 38일 전
IMP 6

Claude Code, macOS에서 HP 레이저 1008a 프린터 지원 구현기

개발자가 AI 코딩 에이전트 Claude Code(Opus 4.8, 100만 컨텍스트)를 이용해 HP가 맥을 지원하지 않는 Laser 1008a 프린터를 macOS에서 사용 가능하게 만들었습니다. 약 4시간의 단일 세션에서 SPL3 래스터 언어를 리버스 엔지니어링하고, HP의 실제 코덱을 리눅스 컨테이너에서 실행하는 방식으로 구현했습니다. AI 에이전트가 제조사조차 해내지 못한 하드웨어 호환성 문제를 해결할 수 있음을 보여주는 사례입니다.

Claude Code 리버스 엔지니어링 macOS
HN
Hacker News • 53일 전
IMP 8

AI가 단독으로 완성할 수 있는 가장 큰 소프트웨어 프로젝트는?

기존 소프트웨어 엔지니어링 평가 방식과 달리, MirrorCode 벤치마크는 AI의 한계를 제대로 테스트하기 위해 파격적인 추론 예산을 제공합니다. 실제로 한 태스크에는 약 2,600달러의 비용이 들었으며, AI가 무려 19일 동안 사람의 개입 없이도 독립적으로 작업을 수행했습니다. 이는 자율적인 AI 코딩 에이전트가 실제 업무 환경에서 얼마나 복잡하고 장기적인 프로젝트를 감당할 수 있는지 보여주는 중요한 척도입니다.

AI 코딩 에이전트 소프트웨어 엔지니어링 벤치마크
TD
The Decoder • 56일 전
IMP 8

AI 코딩 에이전트, 연구 소프트웨어 혁신 이끌지만 '과학적 검증'엔 한계

OpenAI와 학계의 연구 보고서에 따르면, AI 코딩 에이전트가 노후화된 과학 연구용 소프트웨어를 현대화하고 최대 60배 이상의 처리 속도 향상을 이끌어낼 수 있습니다. 하지만 AI는 코드를 매우 빠르게 작성할 뿐, 해당 결과가 과학적으로 옳은지 스스로 판단하고 검증하는 데에는 여전히 치명적인 한계를 보입니다. 따라서 연구자들은 AI가 제안하는 코드를 맹신하지 말고 전문가의 검토와 독립적인 테스트를 병행해야 합니다.

AI 코딩 에이전트 연구 소프트웨어 OpenAI
HN
Hacker News • 77일 전
IMP 9

에이전트 시대, 오픈소스의 '무비용'이라는 환상

생성형 AI의 발달로 코드 생성이 산업화되면서, 오픈소스 생태계가 구조적 소진과 유지보수 비용 문제로 심각한 위기를 맞고 있습니다. 대형 기업들의 일방적 착취, 저품질 AI 코드(PR) 홍수, 그리고 신뢰할 수 없는 평가 지표 등으로 인해 핵심 메인테이너들이 번아웃을 겪으며 오픈소스 지속 가능성의 근간이 흔들리고 있습니다.

오픈소스 AI 코딩 에이전트 소프트웨어 공학
HN
Hacker News • 83일 전
IMP 7

클로드가 작성한 sqlite-utils 4.0rc2 (약 149달러)

Simon Willison은 Claude AI를 적극 활용하여 데이터베이스 트랜잭션 처리 과정의 치명적인 버그를 발견하고 수정하는 등 sqlite-utils 4.0rc2의 핵심 코드를 작성했습니다. 개발자는 휴대폰으로 AI 에이전트에게 프롬프트를 지시하는 동안 휴식을 취할 수 있었으며, 최종적으로 약 149달러의 API 비용으로 30개 파일에 달하는 대규모 코드 수정 및 설계 개선을 완료했습니다. 이는 현업 소프트웨어 개발에서 코딩 에이전트가 얼마나 강력하고 실용적인 도구가 되었는지를 보여주는 훌륭한 사례입니다.

AI 코딩 에이전트 SQLite 오픈소스
HN
Hacker News • 83일 전
IMP 8

AI가 러스트로 짠 PHP 엔진, 공식 테스트 17% 통과

러스트(Rust) 문법을 전혀 모르는 개발자가 AI 코딩 에이전트를 지시만 해서 기존 PHP 소스 코드 없이 밑바닥부터 새롭게 구축된 PHP 인터프리터(Phargo)를 개발했습니다. 이 프로젝트는 AI가 자체적으로 결과를 판단하지 못하도록 30년간 축적된 약 2만 2천 개의 공식 PHP 테스트 스위트(suite)를 엄격한 기준으로 삼아 진행되었으며, 현재 전체 테스트의 17.4%를 통과하며 워드프레스 렌더링을 성공적으로 구현했습니다.

AI 코딩 에이전트 러스트 PHP
HN
Hacker News • 97일 전
IMP 8

코드가 작동해도 AI 코드를 반려하는 이유

AI 코딩 에이전트의 도입으로 코드 작성 속도는 크게 빨라졌지만, 진정한 병목 현상은 생성된 방대한 코드를 리뷰하는 과정으로 넘어왔습니다. 단순히 코드가 작동하는 것을 넘어, 시스템의 복잡성을 높이거나 스스로 설명할 수 없는 AI 코드는 과감히 반려해야 한다는 실무자의 인사이트를 제공합니다. 이는 AI가 자율적으로 소프트웨어를 개발하기보다는, 훌륭한 엔지니어의 통제 아래에서 보조 도구로 사용되어야 함을 시사합니다.

AI 코딩 에이전트 코드 리뷰 소프트웨어 엔지니어링
TD
The Decoder • 100일 전
IMP 9

엔비디아, 스스로 학습하는 AI 코딩 에이전트 로봇 연구

엔비디아, 카네기멜론, UC 버클리 연구진은 AI 코딩 에이전트가 로봇을 스스로 훈련시키는 'ENPIRE' 프레임워크를 개발했습니다. 8개의 로봇이 협력해 핀 조립, 케이블타이 절단 등 까다로운 실제 작업에서 최대 99%의 성공률을 달성했습니다. 이는 로봇 학습 과정에서 인간의 개입을 획기적으로 줄여 학습 시간과 비용을 크게 단축할 수 있는 중요한 기술 패러다임 전환을 보여줍니다.

로봇공학 AI 코딩 에이전트 엔비디아
HN
Hacker News • 102일 전
IMP 6

홈랩을 위한 나만의 AI 개발 플랫폼 구축하기

개발자가 자체 홈랩(Home server) 환경에서 AI 코딩 에이전트인 OpenCode와 GitOps를 연동하여 인프라 관리를 자동화한 사례를 공유했습니다. AI가 직접 코드를 수정하고 PR을 생성하면 관리자가 이를 검토해 병합하는 방식으로, 컨테이너 업데이트와 네트워크 설정 변경을 매우 빠르고 안전하게 처리할 수 있습니다. 모바일 등 기기에 동기화되는 웹 UI를 통해 언제 어디서나 AI의 도움을 받아 복잡한 홈랩 인프라를 쉽게 유지보수할 수 있다는 점이 핵심입니다.

홈랩 AI 코딩 에이전트 GitOps
TD
The Decoder • 104일 전
IMP 8

AI 코딩 에이전트, '올바른 파일'은 찾지만 '핵심 코드'는 놓친다

국제 연구진이 개발한 새로운 벤치마크(SWE-Explore)에 따르면, AI 코딩 에이전트가 버그가 발생한 파일은 잘 찾지만 정작 수정이 필요한 정확한 코드 줄(Line)을 놓치는 치명적인 약점을 보이는 것으로 나타났습니다. 개발 실무에서는 문맥을 누락하는 것이 불필요한 코드를 읽는 것보다 버그 수정 실패에 훨씬 더 큰 악영향을 미치므로, 향후 AI 시스템은 더 공격적으로 필터링하기보다 코드를 더 넓게 읽도록 개선되어야 합니다.

AI 코딩 에이전트 소프트웨어 개발 버그 수정
TC
TechCrunch AI • 107일 전
IMP 7

데이터독 출신들, '빅테크 AI 독점'에 맞서는 AI 코딩 스타트업 나이트시프트 출범

데이터독(Datadog) 초기 엔지니어 출신들이 창업한 AI 코딩 스타트업 나이트시프트(Niteshift)가 700만 달러의 시드 투자를 유치했습니다. 이 회사는 오픈AI나 앤스로픽 같은 기초 모델 기업들이 수직적 시장으로 영역을 확장하며 경쟁 앱을 출시하는 상황(SaaS 대란) 속에서, 고객사들이 특정 모델이나 벤더에 종속되지 않도록 돕는 인프라를 제공하는 데 주력합니다.

ai 코딩 에이전트 인프라 벤더 종속성
MP
MarkTechPost • 108일 전
IMP 8

2026년 최고의 AI 코딩 에이전트 및 개발 플랫폼 비교

소프트웨어 개발의 패러다임이 변화하여, 엔지니어가 직접 코드를 입력하기보다 의도를 설명하면 AI 에이전트가 코드를 작성하고 PR까지 생성하는 시대가 도래했습니다. 본 가이드는 Atoms, Devin, Windsurf, Cursor, Warp 등 2026년을 주도하는 주요 AI 코딩 에이전트들을 비교 분석합니다. 각 도구마다 고유한 장점이 있으므로, 실무자들은 자신의 개발 환경과 목적에 맞는 최적의 솔루션을 선택해야 합니다.

AI 코딩 에이전트 소프트웨어 개발 Cursor
TC
TechCrunch AI • 108일 전
IMP 8

클릭 한 번으로 게임을 만드는 앤스로픽 '포블 5'

앤스로픽이 공개한 새로운 AI 모델 '클로드 포블 5(Fable 5)'는 단 한 번의 프롬프트 입력만으로 완벽하게 작동하는 비디오 게임과 지도 시각화 도구 등을 즉각적으로 생성하는 놀라운 능력을 선보입니다. 한 연구원의 테스트 결과에 따르면 이 모델은 다른 어떤 공개 모델보다 뛰어난 성능을 발휘했으며, 수십 페이지에 달하는 복잡한 명세를 독자적으로 처리했습니다. 이는 전문 개발 팀이 필요했던 소프트웨어 구축이 이제는 단일 프롬프트로 가능해졌음을 의미하며, AI 기반 코딩의 실용성이 급속도로 진화하고 있음을 보여줍니다.

앤스로픽 클로드 포블 5 AI 게임 개발
HN
Hacker News • 113일 전
IMP 9

AI, 다각형 교차 영역 형식 검증 최초 성공

최신 AI 모델을 활용해 폴리곤 교차 알고리즘을 수학적으로 엄격하게 증명(형식 검증)하는 데 처음으로 성공한 사례입니다. 과거에는 인간이 여러 단계로 증명 전략을 제시해야 했으나, 최신 모델은 한 번의 프롬프트로 완벽한 코드와 증명을 생성해 냈습니다. 정확성은 AI가 아닌 Lean 4 증명 보조기와 87줄의 짧은 명세 코드를 통해 100% 보장되며, 웹 데모를 통해 직접 테스트해 볼 수 있습니다.

형식 검증(Lean 4) AI 코딩 에이전트 계산 기하학
HN
Hacker News • 114일 전
IMP 7

인프라코스트, 클라우드 비용 절감 에이전트 공개

인프라코스트(Infracost)가 코딩 에이전트 및 IDE에 클라우드 비용 예측 및 최적화 기능을 제공하는 'Dev Cloud'를 출시했습니다. 개발자가 인프라 코드(IaC)를 작성하는 즉시 1,000개 이상의 클라우드 서비스에 대한 정확한 비용을 분석하고, 자연어로 비용 절감 방안을 제시합니다. 이를 통해 PR 리뷰나 배포 이전에 클라우드 리소스 낭비를 방지하고 FinOps 정책을 자동으로 적용할 수 있게 되었습니다.

클라우드 비용 최적화 인프라 코드(IaC) AI 코딩 에이전트
TC
TechCrunch AI • 119일 전
IMP 8

코그니션 스캇 우 대표 "AI 코딩 에이전트, 인간 대체 아니다"

AI 코딩 에이전트 '데빈(Devin)'으로 유명한 스타트업 코그니션(Cognition)이 최근 260억 달러(약 3조 5천억 원)의 기업가치로 10억 달러 규모의 투자를 유치했습니다. 스캇 우 대표는 데빈이 인간 개발자를 완전히 대체하는 것이 아니라, 지루하고 반복적인 유지보수 작업을 대신 처리해 소프트웨어 엔지니어들이 오로지 창의적인 제품 개발에 집중할 수 있도록 돕는 '버디(Buddy)' 역할을 해야 한다고 강조했습니다.

AI 코딩 에이전트 코그니션 데빈
HN
Hacker News • 120일 전
IMP 9

AI 시대의 전문성: 주니어 엔지니어의 미래

AI 코딩 에이전트의 발전으로 소프트웨어 엔지니어링 직무의 본질이 빠르게 변화하고 있습니다. 코딩 에이전트를 효과적으로 다루기 위해서는 수동 코딩 경험에서 비롯된 '컴퓨팅 직관'이 필수적이며, 이로 인해 시장은 일부 핵심 주니어 인재를 다투는 양극화 시장으로 재편되고 있습니다. 따라서 예비 개발자와 실무자 모두 단순 코딩 능력을 넘어 에이전트를 통제하고 활용하는 근본적인 컴퓨팅 사고력을 기르는 것이 중요합니다.

AI 코딩 에이전트 개발자 채용 시장 소프트웨어 엔지니어링
AR
Ars Technica • 120일 전
IMP 8

AI 코딩 봇 반발한 개발자, 오픈소스에 데이터 삭제 프롬프트 숨겨

한 오픈소스 개발자가 자신이 만든 자바(Java) 테스트 엔진에 AI 코딩 에이전트의 기존 지시를 무시하고 테스트 코드를 전부 삭제하라는 '프롬프트 인젝션(Prompt Injection)' 공격 코드를 몰래 숨겨 넣어 논란이 일었다. 해당 코드는 사람의 눈에 띄지 않도록 터미널 화면에서 지워지는 기능까지 포함되어 있어 시스템에 치명적인 피해를 줄 수 있다는 비판을 받고 있다. 이 사건은 생성형 AI 도구의 무분별한 사용에 맞서는 '바이브 코딩(Vibe Coding)' 반발 운동이 개발자 윤리를 넘어선 위험한 수준으로 번지고 있음을 보여준다.

오픈소스 보안 프롬프트 인젝션 AI 코딩 에이전트
HN
Hacker News • 120일 전
IMP 8

클로드 코드, 동적 워크플로우 기능 도입

Anthropic이 복잡하고 거대한 작업을 처리하기 위해 수십~수백 개의 하위 에이전트를 병렬로 실행하는 '동적 워크플로우(Dynamic Workflows)'를 클로드 코드(Claude Code)에 도입했습니다. 분기 단위로 계획되던 대규모 마이그레이션이나 코드베이스 전체 버그 수정, 보안 감사 같은 고난도 작업이 며칠 만에 완료될 수 있어 개발 생산성에 큰 변화를 줄 수 있습니다. 실제로 Bun 런타임을 Zig에서 Rust로 포팅하는(약 75만 줄, 11일 소요) 등 대규모 프로젝트에 성공적으로 적용된 바 있습니다.

클로드 코드 동적 워크플로우 소프트웨어 마이그레이션
TD
The Decoder • 121일 전
IMP 8

AI 코딩 에이전트 데빈(Devin) 개발사 인지도 9개월 만에 260억 달러로 2배 이상 급증

AI 소프트웨어 개발자 '데빈(Devin)'으로 유명한 Cognition이 10억 달러 이상의 자금을 유치하며 기업 가치가 260억 달러를 돌파했습니다. 이는 지난해 9월 100억 달러에서 불과 9개월 만에 2배 이상 급증한 수치로, 연간 4억 9,200만 달러의 매출을 기록하며 시티, 메르세데스-벤츠 등 주요 기업 고객을 확보한 점이 반영되었습니다. 투자자들의 폭발적인 열기 속에서도 일부 개발자들은 AI 에이전트의 실질적 가치에 여전히 회의적인 시각을 보이고 있어 향후 시장 반응이 주목됩니다.

Cognition Devin AI 코딩 에이전트
TD
The Decoder • 124일 전
IMP 8

조지 핫츠 "코딩 에이전트, 소프트웨어 개발 최악의 실수 될 것"

유명 해커 조지 핫츠가 6개월간의 테스트 끝에 코딩 에이전트가 소프트웨어 개발 업계에서 가장 비용이 많이 드는 실수가 될 것이라고 경고했습니다. 그는 LLM이 단순히 코드의 통계적 분포를 모방하여 찾기 힘든 미묘한 오류를 만들어낼 뿐이라며 얀 르쿤 등과 같은 회의론자의 편에 섰습니다. 반면 안드레이 카파시 등은 코드의 질이 떨어지더라도 생산성이 극대화된다며 코딩 에이전트의 긍정적인 미래를 강조하며 AI 업계의 의견이 첨예하게 엇갈리고 있습니다.

AI 코딩 에이전트 조지 핫츠 LLM 한계
HN
Hacker News • 127일 전
IMP 6

안티그래비티 2.0, OpenSCAD 건축 3D LLM 벤치마크 1위

ModelRift가 여러 AI 코딩 도구를 대상으로 텍스트 기반의 파라미터 3D 모델링 도구인 OpenSCAD를 사용해 판테온을 설계하는 벤치마크를 진행했습니다. 그 결과, 안티그래비티 2.0(Antigravity 2.0) 모델이 가장 뛰어난 공간 기하학 처리 및 건축적 디테일 구현 능력을 보여주며 1위를 차지했습니다. 이 벤치마크는 LLM이 복잡한 3D 형상을 얼마나 잘 코드로 변환하는지 평가하여, AI가 실제 CAD 및 3D 프린팅 워크플로우에 적용될 수 있는지를 보여준다는 점에서 중요합니다.

3D 모델링 AI 코딩 에이전트 LLM 벤치마크
HN
Hacker News • 128일 전
IMP 7

AI 코딩 루프를 위한 정형 검증 게이트

AI가 코드를 대량 생성하는 시대에는 프롬프트로 모델의 행동을 통제하는 '행동적 게이트'만으로는 치명적인 보안 버그를 막기 어렵습니다. 이 글은 코드가 원하는 규칙을 위반하면 컴파일이나 테스트 자체가 실패하도록 구조를 짜는 '구조적 게이트(정형 검증)'를 제안하며, 이를 위해 Shen이라는 정적 타입 언어 기반의 'Shen-Backpressure' 도구를 소개합니다.

AI 코딩 에이전트 소프트웨어 테스트 정형 검증
HN
Hacker News • 129일 전
IMP 8

AI 에이전트를 활용한 분산 시스템 테스트

AI 코딩 에이전트가 분산 및 상태 유지 시스템을 테스트하기 위한 계획을 수립하고, 실행하여 구조화된 결과 보고서를 생성하는 두 가지 테스트 스킬(Skill)을 소개합니다. 이 방법론은 단순한 통합 테스트가 놓치기 쉬운 네트워크 분할, 동시성, 장애 복구 등 복잡한 버그를 철저히 검증하며, 최종 산출물만으로 리뷰어가 배포 여부를 결정할 수 있게 돕습니다. 클라우드 환경이나 대규모 시스템 안정성을 다루는 엔지니어에게 매우 유용한 접근법입니다.

분산 시스템 AI 코딩 에이전트 클레임 기반 테스트
HN
Hacker News • 130일 전
IMP 9

미니 샤이훌루드 공격 재개: 314개 npm 패키지 탈취

2026년 5월 19일, npm 계정이 해킹당해 317개 패키지에 걸쳐 637개의 악의적인 버전이 단 22분 만에 자동으로 퍼블리싱되었습니다. 이 악성코드는 AWS 자격 증명, GitHub 토큰, SSH 키 등을 광범위하게 탈취할 뿐만 아니라, Claude Code 및 VS Code와 같은 AI 개발 도구를 하이재킹하여 지속적으로 감염을 유지하는 정교한 공격입니다. 특히 공개 GitHub 저장소를 C2(명령 및 제어) 채널로 위장하고 CI/CD 파이프라인에 침투하여 서명된 합법적인 아티팩트를 위조하므로 소프트웨어 공급망 전체에 심각한 위협을 줍니다.

보안 취약점 npm 공급망 공격 소프트웨어 공급망
TD
The Decoder • 133일 전
IMP 8

월 13억 원 쓰는 오픈클로우, 100개 AI 에이전트로 코딩·버그 수정

오픈소스 프로젝트 오픈클로우(OpenClaw)의 창립자 피터 스타인버거는 약 3명의 소규모 팀과 함께 100개의 AI 에이전트를 운영하며 소프트웨어 개발을 수행하고 있습니다. 이 에이전트들은 PR 생성 및 리뷰, 보안 취약점 탐지, 버그 수정은 물론 회의 내용을 듣고 기능 구현을 시작할 정도로 고도로 자동화되어 있습니다. 30일간 13억 원(약 130만 달러)의 API 비용이 발생했으나, 오픈AI가 지원하는 환경에서 토큰 비용의 한계를 없앴을 때의 개발 효율성을 실험 중이라는 점에서 큰 의미를 갖습니다.

AI 코딩 에이전트 오픈AI GPT-5.5