메뉴

코딩 에이전트

30개 소식

AI 코딩 도구 및 자동화

AI 모델코딩 에이전트오픈소스이미지 생성영상 생성정책/규제비즈니스연구
HN
Hacker News • 15시간 전
IMP 7

메타 Muse, 내부적으로 'azure/muse-special'이라는 OpenAI 모델 사용 정황

한 개발자가 Meta의 AI 웹사이트 빌더 Muse의 파일시스템과 세션 로그를 분석한 결과, 대부분의 세션은 Meta 내부 모델 'Avocado'를 사용하지만 일부 서브에이전트가 'azure/muse-special'이라는 모델을 사용했으며, 응답 시그니처와 툴콜 ID 패턴으로 미루어 OpenAI(GPT) 모델일 가능성이 높다는 것. Muse 에이전트 데몬에는 Claude, GPT, Kimi 등 다양한 외부 모델 클라이언트가 포함되어 있어 Meta가 사용자 동의 없이 서버 측에서 모델 라우팅을 변경할 수 있는 인프라를 갖추고 있으나, OpenAI/Anthropic 모델의 원시 추론(chain of thought)은 암호화되어 RL에 활용되지 않으므로 지식 증류(distillation) 증거는 없다는 결론.

메타 Muse OpenAI
HN
Hacker News • 17시간 전
IMP 6

제브메모(Jevmem) – Claude Code용 자동 프로젝트 메모리 도구

제브메모(Jevmem)는 Claude Code 채팅에서 나온 결정, 제약조건, 버그, 할 일을 JEVMEM.md 파일에 자동으로 저장하고, 다음 세션에서 관련 내용을 컨텍스트에 다시 불러오는 도구입니다. Cursor와 Codex에서도 작동하며, 기존 결정이 바뀌면 삭제하지 않고 '폐기(superseded)' 처리해 히스토리를 보존하는 것이 특징입니다. 전용 소형 분류기(Jev by TypeSafe AI)를 사용해 판단 속도가 0.3초로 기존 LLM 대비 10배 이상 빠르면서 정확도도 최상위권입니다.

Claude Code 개발자 도구 에이전트 메모리
TD
The Decoder • 21시간 전
IMP 8

메타 뮤즈 에이전트, 모든 사용자에게 우분투 리눅스 클라우드 PC 제공

메타의 AI 에이전트 '뮤즈(Muse)'가 모든 사용자에게 우분투 리눅스가 설치된 완전한 클라우드 컴퓨터를 무료로 제공합니다. 사용자와 에이전트는 격리된 '런타임 셀'에서 자유롭게 작업하고, '센티넬' 프로세스가 민감한 활동을 감시하는 보안 구조로 프롬프트 인젝션 등의 위협에 대응합니다. 뮤즈는 출시 첫 주 50만 사용자를 모으며 앱스토어 1위를 기록하는 등 메타의 '최고 모델이 아닌 최고 제품' 전략의 핵심으로 떠오르고 있습니다.

메타 뮤즈 AI 에이전트
HN
Hacker News • 23시간 전
IMP 6

에이전트 기반 CUDA 커널 최적화 도구 공개

해커뉴스에 LangGraph 기반 '에이전트형 CUDA 커널 옵티마이저'가 공개되었습니다. 워크로드 설명만 입력하면 GPU 구현을 자동 생성하고, 컴파일·정확성 검증·벤치마크·개선을 반복하며 가장 빠른 검증 커널을 선별합니다. NVIDIA 문서 조회와 Nsight Compute 프로파일링 카운터 확인도 지원해 GPU 커널 최적화 업무의 자동화 가능성을 보여준다는 점에서 주목할 만합니다.

에이전트 CUDA GPU 최적화
TD
The Decoder • 23시간 전
IMP 8

루비온레일즈 창시자 DHH, 손으로 직접 코딩하는 것을 그만둔다

루비온레일즈(Ruby on Rails) 창시자이자 Basecamp 공동창업자인 데이비드 하이네마이어 한손(DHH)이 Rails World 2026 기조연설에서 25년의 프로그래머 생활을 마치고 수동 코딩을 완전히 중단했다고 선언했습니다. 1년 전만 해도 AI 코딩에 공개적으로 반대했던 그는 이제 "영어가 루비보다 나은 프로그래밍 언어"라며 대부분의 프로그래머와 기업에게 수동 코딩은 경제적으로 더 이상 의미가 없다고 주장했습니다. 소프트웨어 아키텍처도 AI 에이전트가 코드를 수정하는 시대에 맞게 재정의되어야 한다고 강조한 그는 이를 "컴퓨팅 역사상 가장 큰 사건"이라 불렀습니다.

DHH 루비온레일즈 AI 코딩
HN
Hacker News • 1일 전
IMP 7

레일스는 이제 어떻게 되나?

Ruby on Rails 창시자 DHH가 Rails World 2026 기조연설에서 자신은 더 이상 직업 프로그래머가 아니라 '메이커'라고 선언하고, LLM 코드 생성에 전적으로 베팅한다고 밝혔다. 대표적 Rails 앱이던 Hey의 다음 버전은 네이티브 앱과 Rust 서버로 Rails를 벗어나 개발된다는 발표는 Rails 커뮤니티에 큰 충격을 주고 있다.

루비 온 레일스 DHH LLM 코딩
WR
Wired AI • 1일 전
IMP 7

위험을 감수할 만한 AI 에이전트를 찾았다

WIRED를 떠난 저자가 초대 기반 AI 에이전트 'Instinct'를 직접 사용해본 후기입니다. Instinct는 iMessage와 WhatsApp으로 소통하며 이메일, 캘린더, 메신저를 연동하는 에이전트로, 이미 3억 5천만 달러를 투자받았고 100억 달러 가치로 10억 달러 추가 투자 협상 중입니다. 핵심은 열린 텍스트창 대신 익숙한 메신저 형태(form factor)로 사용자에게 먼저 제안하고 실행하는 방식이며, 저자는 베네치아 출장 중 식당 예약을 맡겨 성공적인 결과를 얻었습니다.

AI 에이전트 Instinct 메타 Muse
MP
MarkTechPost • 2일 전
IMP 5

타입세이프 AI 'Jev' 코딩 가이드: 타입화된 판단과 신뢰도 보정

TypeSafe AI의 'Jev'는 텍스트가 아닌 구조화된 판단을 위한 'System One' 모델로, 공식 Python SDK 설치부터 기본 질문 타입(Choice, Score, Null), 투기적 팬아웃(speculative fan-out), 신뢰도 기반 라우팅, 비동기 프로덕션 워크플로 구축까지 다루는 완전한 코딩 튜토리얼이 공개되었습니다. LLM 출력을 타입 안전하게 다루고 신뢰도를 활용해 워크플로를 분기하고자 하는 개발자에게 유용한 내용입니다.

AI 모델 Python SDK 구조화된 출력
HN
Hacker News • 2일 전
IMP 6

VSCode의 SSH 원격 편집 기능은 충격적이다

Thomas Ptacek가 VSCode의 SSH 원격 편집(Remote-SSH) 방식을 분석한 글이다. Emacs의 Tramp와 달리 VSCode는 원격 서버에 Node 바이너리를 포함한 에이전트를 직접 설치하며, 이 에이전트는 파일시스템 탐색, 임의 파일 수정, 셸 PTY 프로세스 실행, 자기 지속(persist)까지 가능하다. 이는 사실상 원격 접근 툴(_rat_)과 유사한 동작 방식이라, 개발 서버에서는 신중해야 하고 운영 환경에서는 절대 허용하면 안 된다는 지적이다.

VSCode SSH 원격 편집 보안
HN
Hacker News • 2일 전
IMP 8

2주 만에 claude.ai 3배 빠르게 만든 방법

Anthropic이 8월에 2주간의 스프린트를 통해 claude.ai와 데스크톱 앱의 핵심 사용자 경험을 약 3배 빠르게 개선했습니다. Claude(Claude Tag, Opus 5.5 수준의 내부 연구 모델)가 병목 지점을 찾고 벤치마크를 만들고 개선사항을 배포하는 방식으로, 인간은 목표 설정과 변경 승인만 담당했습니다. 그 결과 3천 건 이상의 변경을 단 한 건의 고객 대면 사고나 롤백 없이 병합했으며, 하루에 수만 시간의 사용자 대기 시간을 절약한 것으로 추정됩니다.

[object Object] [object Object] [object Object]
HN
Hacker News • 2일 전
IMP 7

Claude Code, 텔레메트리가 꺼져 있으면 AGENTS.md를 읽지 않음

Claude Code의 AGENTS.md 지원 기능은 원격 기능 플래그(tengu_agents_md_mod)에 의존하는데, 텔레메트리나 비필수 트래픽을 비활성화하면 플래그를 가져올 수 없어 로컬 파일임에도 AGENTS.md가 아예 로드되지 않습니다. 아무런 경고도 없이 조용히 무시되기 때문에 사용자는 모델이 지시를 무시한다고 오해하기 쉽습니다. 해결책은 CLAUDE.md에 '@AGENTS.md' 한 줄을 추가하는 것이지만, 이는 AGENTS.md 지원이 없애려 했던 파일을 하나 더 만드는 셈입니다.

Claude Code AGENTS.md 텔레메트리
HN
Hacker News • 3일 전
IMP 6

비개발자에게 소프트웨어 개발이 여전히 어려운 이유를 설명하는 법

노코드 AI 도구인 Lovable로 해커톤에서 1일차에 90%를 완성했지만, 2일차에 끝없는 버그로 제대로 된 데모조차 위태로워진 경험을 소개한다. 저자는 '집 짓기' 비유를 통해 소프트웨어의 근본 원인 수정과 인프라 작업이 왜 필요한지 비개발자에게 설명하는 방법을 제시한다. AI 코딩 시대에도 소프트웨어 엔지니어링의 본질적 어려움은 그대로 남아 있다는 점이 핵심이다.

AI 코딩 Lovable 노코드
HN
Hacker News • 3일 전
IMP 6

언리얼 에이전트, 도구 호출 비동기화로 최대 40% 비용 절감

Unreal Labs가 도구 호출을 완전 비동기 방식으로 처리하는 '언리얼 에이전트(Unreal Agent)' 하네스를 공개했습니다. 모델이 도구 대기·폴링·하트비트를 관리하지 않아도 되어 사용자 개입이 즉시 가능하고, 모델 호출 사이에 더 많은 유용한 도구 작업을 배치할 수 있습니다. 그 결과 실제 워크로드와 에이전트 벤치마크에서 Codex 대비 최대 40%, Pi 대비 최대 20%의 비용 절감을 달성했습니다.

에이전트 비용효율 비동기처리
HN
Hacker News • 3일 전
IMP 7

AI 에이전트에게 '더 빠르게' 요청해 러스트 코드 최적화하기

저자는 Claude Opus 4.5 같은 에이전트형 LLM에 적절한 가드레일과 제약 조건을 주고 반복적으로 최적화를 요청하면, 기존 최고 수준 구현보다 2~20배 빠른 러스트(Rust) 코드를 작성할 수 있음을 검증했습니다. PyO3로 파이썬과 연동하고 criterion 벤치마크 도구를 활용해 UMAP 차원 축소 알고리즘을 최소 의존성으로 처음부터 구현하는 실험을 진행했으며, unsafe 코드 금지 원칙을 지켰습니다.

러스트 코드-최적화 LLM-코딩
HN
Hacker News • 3일 전
IMP 7

AI에도 지혜가 없고, 당신에게도 없어질 것이다

AI 코드 생성에만 의존하면 개발자는 숙련(expertise)에 도달할 수 없으며, 바이브 코딩 프로젝트는 시간이 지나면 유지보수 불가능한 상태로 악화된다고 경고하는 글입니다. 유지보수성과 좋은 아키텍처는 즉각 측정이 어려워 AI 학습의 보상 신호가 될 수 없고, 전문가의 직관은 규칙화할 수 없기 때문에 AI는 결코 이를 대체할 수 없다는 것이 핵심 논지입니다.

AI 코딩 코드 유지보수성 소프트웨어 엔지니어링
MP
MarkTechPost • 4일 전
IMP 7

엔비디아, SoL-Pi 공개…코딩 에이전트 토큰 사용량 최대 49% 절감

엔비디아 연구진이 오픈소스 코딩 에이전트 Pi용 하네스 메커니즘 4종 'SoL-Pi'를 발표했습니다. AI가 535개 환경에서 자동 연구 루프를 돌려 발견한 것으로, EdgeBench에서 토큰 트래픽을 44.7~49.0%, API 비용을 약 33% 줄이면서도 GPT-5.6 Sol 및 Opus 5 벤치마크에서 원래 성능의 약 94%를 유지합니다.

엔비디아 코딩-에이전트 SoL-Pi
HN
Hacker News • 4일 전
IMP 7

'충분히 좋은' AI 시대의 보안 감사

보안 업체가 Miden zkVM 감사를 준비하며 AI 에이전트를 활용해 LSP 서버, 디컴파일러, 정적 분석 엔진, Lean 형식 모델을 6개월간 직접 구축한 사례를 소개한다. 이렇게 만든 도구들이 실제 보안 취약점(악성 프로버가 Falcon 서명을 위조해 자금을 탈취할 수 있는 미검증 입력 문제)을 발견했고, 95개의 기계 검증 정확성 증명을 확보했다. 코드 리뷰 외에도 감사 준비 단계부터 AI가 감사 품질과 깊이를 크게 높일 수 있음을 보여준다.

보안 감사 AI 에이전트 영지식 증명
MP
MarkTechPost • 4일 전
IMP 6

AWS, 토큰 비용 28% 절감한 오픈소스 에이전트 하네스 'Strands Harness' 공개

AWS Strands Agents 팀이 완전히 조립된 범용 에이전트 하네스인 'Strands Harness'를 오픈소스로 공개했습니다. Claude Code나 Codex에서 잘 작동하던 에이전트 아이디어가 직접 구축한 루프에서는 성능이 저하되는 문제를 해결하는 것이 목표로, 로컬 또는 클라우드에서 실행 가능하며 Python 버전이 제공됩니다. 동등한 정확도를 유지하면서 토큰 비용을 28% 낮췄다는 점이 핵심입니다.

AWS 에이전트 하네스 오픈소스
HN
Hacker News • 4일 전
IMP 6

AI 코딩 시대, CI가 병목이 되어 개선한 Linear의 사례

AI 코딩 에이전트로 코드 생산 속도는 빨라졌지만 검증을 담당하는 CI가 병목이 되면서 Linear는 인프라 업그레이드, 타입 체커 없는 린트, 게이팅 작업 최적화 등을 통해 대기 시간을 6분에서 5분으로 줄이고 테스트당 러너 시간을 절반으로 감축했습니다. 테스트 규모가 4배 가까이 늘어난 상황에서도 달성한 결과로, TypeScript 기반 팀뿐 아니라 다양한 언어·툴체인에 적용 가능한 실전 CI 최적화 가이드입니다.

CI/CD AI 코딩 DevOps
HN
Hacker News • 4일 전
IMP 6

포머지 – 병렬 코딩 에이전트 간 의도 충돌 감지

Foremerge는 Git 위에 구축된 오픈소스 코딩 에이전트 조정 프로토콜로, 여러 AI 에이전트가 격리된 워크트리에서 작업하더라도 각자 수정하려는 대상(의도)을 공유 목록에 선언해 충돌을 코드 작성 전에 감지합니다. Git은 텍스트만 비교하기 때문에 서로 다른 파일에 대한 합리적인 변경이 의미상 충돌하는 경우를 잡아내지 못하는데, Foremerge는 결정론적 탐지기로 이를 해결합니다. 파일 잠금이나 LLM 판단 없이 자동으로 경고만 제공하는 advisory 방식이 특징입니다.

코딩 에이전트 오픈소스 깃(Git)
HN
Hacker News • 4일 전
IMP 7

Cloudflare Python Workers 정식 출시(GA)

Cloudflare가 Python Workers를 정식 버전(GA)으로 출시했습니다. 이제 Python이 Cloudflare 개발자 플랫폼에서 1급 언어로 완전 지원되며, FastAPI, Django, Flask 같은 인기 프레임워크를 Workers에서 실행할 수 있게 되었습니다. 기존에 필요했던 JavaScript 타입 변환 코드 없이 순수한 Python 코드만으로 Cloudflare의 모든 바인딩(R2, D1, Queues 등)을 사용할 수 있게 된 점이 핵심입니다.

클라우드플레어 파이썬 서버리스
HN
Hacker News • 5일 전
IMP 7

AI 코딩이 코드 품질을 떨어뜨린다면 품질 관리가 잘못된 것

코딩 에이전트로 인해 코드 품질이 저하된다는 우려는 무작정 PR을 병합하는 경우에만 해당된다는 글입니다. 스펙 기반 개발과 AI 리뷰, 95% 이상의 단위 테스트 커버리지, 수동 테스트, 광범위한 E2E 테스트라는 다층적 품질 관리를 적용하면 버그를 오히려 줄이면서 생산성을 2-3배 높일 수 있다고 설명합니다.

AI 코딩 코드 품질 테스트 주도 개발
HN
Hacker News • 6일 전
IMP 8

마이크로소프트, AI 에이전트로 Copilot 런타임을 Rust로 이식…비용 12만 달러

마이크로소프트가 GitHub Copilot의 기반이 되는 런타임을 TypeScript에서 Rust로 완전히 이전했으며, 이식 작업의 대부분을 AI 에이전트가 수행했습니다. 토큰 비용 약 12만 달러와 개발자 3주치 시간만으로 43만 줄 TypeScript를 80만 줄 프로덕션 Rust 코드로 변환했고, 벤치마크에서 최대 15.9배의 속도 향상과 메모리 90% 절감을 달성했습니다.

마이크로소프트 Rust GitHub-Copilot
TD
The Decoder • 6일 전
IMP 7

유니티, 클로드 코드·코덱스 공식 플러그인 출시

Unity가 Claude Code와 OpenAI Codex용 공식 플러그인을 출시했습니다. AI 코딩 에이전트가 오래된 튜토리얼을 참고해 제대로 작동하지 않는 코드를 생성하는 문제를 해결하기 위한 것으로, Unity 팀이 직접 작성·유지보수하는 '스킬'을 에이전트에 제공합니다. Codex 버전은 URP 렌더 파이프라인, 물리, 멀티플레이어 등 31개 스킬과 함께 출시되며 Unity 6 이상에서 사용할 수 있습니다.

유니티 클로드 코드 OpenAI 코덱스
HN
Hacker News • 7일 전
IMP 6

Claude Code, CLAUDE.md 없으면 AGENTS.md 읽도록 지원

Claude Code 2.1.277 업데이트에서 프로젝트에 CLAUDE.md가 없을 경우 AGENTS.md를 대신 읽는 기능이 추가되었습니다. 이는 Anthropic이 Agent 표준화 흐름에 맞춰 상호운용성을 높인 변화로, 다른 코딩 에이전트와 프로젝트 설정을 공유할 수 있게 됩니다. 이 외에도 게이트웨이 프록시 개선과 다수의 안정성 버그 수정이 포함되었습니다.

claude-code anthropic changelog
HN
Hacker News • 7일 전
IMP 7

LLM에 머리를 끄고 맡기는 순간, 당신 자리는 필요 없어진다

LLM 성능이 향상되면서 코드 작성 등을 검증 없이 맡기는 '미트 프록시(meat proxy)' 방식이 실제로 어느 정도 작동하기 시작했지만, 저자는 이 방식이 성공할수록 회사가 인간 대신 LLM을 루프로 돌리면 되므로 결국 직원에게는 돌아올 것이 없다고 지적한다. Luke Burton의 코멘트는 고가치 작업일수록 QA·아키텍트·매니저 역할이 필수이며, 에이전트가 쉽게 해내는 일은 이미 본인이 낮은 난이도 업무에 안주하고 있었을 가능성을 의미한다고 덧붙인다.

LLM AI 코딩 에이전트
HN
Hacker News • 7일 전
IMP 9

ZCode 코딩 에이전트, 사용자 Git 히스토리 몰래 업로드 발각

Z.ai(지푸AI)의 AI 코딩 앱 ZCode가 로그인 상태에서 사용자 워크스페이스 전체(.git 히스토리, LFS 캐시, 설정 파일 포함)를 암호화해 알리바바 클라우드 OSS에 몰래 업로드하는 것으로 밝혀졌습니다. 설정 토글을 꺼도 업로드는 멈추지 않으며, 복호화 키는 Z.ai 서버에만 존재해 사용자 자신도 업로드된 데이터를 열 수 없습니다. GLM 모델 가중치는 오픈이지만 ZCode 런타임은 폐쇄 소스라는 점이 혼란을 일으키고 있습니다.

보안 프라이버시 ZCode
MP
MarkTechPost • 8일 전
IMP 7

앤스로픽, 클로드 코드 프로젝트 베타 출시

앤스로픽이 Claude Code의 '프로젝트' 기능을 재설계해 베타로 공개했습니다. 기존의 폴더 기반 프로젝트와 달리, 새 프로젝트는 하나의 지속적인 대화에서 클로드가 조정자 역할을 하며 작업을 분석해 스레드를 생성합니다. 각 스레드는 독립적인 브랜치에서 실행되는 완전한 클라우드 세션으로, 노트북을 닫아도 계속 실행된다는 점이 핵심입니다.

앤스로픽 클로드 코드 코딩 에이전트
TD
The Decoder • 8일 전
IMP 7

앤스로픽, 클로드 코드 병렬 에이전트 워크플로 공개

앤스로픽이 Claude Code의 Projects 기능을 재설계해, 사용자가 목표를 입력하면 코디네이터가 작업을 병렬 '스레드'로 분할해 각각 클라우드 세션에서 실행하는 베타를 공개했다. 각 스레드는 PR 생성과 테스트 실행이 가능하며 스레드 간 공유 메모리가 형성된다. 이는 코드 자동화로의 또 한 걸음이지만, 자율 에이전트가 늘수록 토큰 소비가 늘고 그 통제권이 사용자에서 회사로 넘어간다는 우려도 있다.

앤스로픽 Claude Code 에이전트
HN
Hacker News • 8일 전
IMP 6

Ax-check.com – AI 에이전트가 당신의 제품을 잘 쓸 수 있나요?

Ax-check.com은 AI 에이전트(AX, Agent Experience) 관점에서 웹사이트를 진단하는 서비스입니다. 사이트를 점검한 뒤 세 개의 에이전트가 온보딩을 끝까지 수행해 보고, 문서·마케팅 사이트·CLI·MCP·Skills에서 개선할 부분을 구체적으로 안내합니다. Supabase, Postmark 등은 만점을 받았지만 LinkedIn은 8점에 그치는 등 격차가 커서, AI 시대의 UX 대응이 중요해지고 있음을 보여줍니다.

AI 에이전트 에이전트 경험(AX) 개발자 도구