메뉴

#Codex

TD
The Decoder • 13일 전
IMP 7

OpenAI, GPT-6 Astra는 간결한 프롬프트와 완화된 가드레일 권장

OpenAI는 GPT-6 Astra 개발자들에게 과도하게 긴 스킬 설명, 무조건적인 문서 읽기 요구, 경직된 승인 규칙이 모델 성능을 저해할 수 있다고 조언했습니다. 더 뛰어난 모델일수록 개입을 줄이고, 작업 완료 기준을 명확히 정의해 조기 중단을 방지하는 것이 핵심입니다.

OpenAI GPT-6 Astra 프롬프트 엔지니어링
HN
Hacker News • 15일 전
IMP 8

OpenAI, 에이전트 API 공개

OpenAI가 Codex 하네스를 API로 제공하는 'Agents API'를 발표했습니다. OpenAI가 세션 관리, 오케스트레이션, 컨텍스트 압축, 복구를 담당하고, 개발자는 도구와 실행 환경만 제공하면 에이전트가 샌드박스에서 코드 실행, 파일 편집, MCP 서버 연결 등을 수행할 수 있습니다. 요금은 선택한 모델의 API 요율에 따라 부과됩니다.

openai 에이전트-API codex
HN
Hacker News • 16일 전
IMP 6

자체 호스팅 기업용 OS 'OtoDock', Claude Code·Codex 에이전트 부서별 협업

해커뉴스에 'OtoDock'이라는 자체 호스팅 가능한 기업용 AI 에이전트 운영체제가 소개되었습니다. Claude Code와 Codex를 기반으로 회사 업무를 수행하는 AI 에이전트들을 만들고, 부서별로 협업시키며 사용자 각자의 Anthropic·OpenAI 구독으로 실행할 수 있습니다. 멀티 테넌트 설계, 전화 연동, 자체 서버 샌드박스 실행 등 기업 데이터를 외부에 노출하지 않고 AI 에이전트를 운영하려는 실무자에게 주목할 만한 오픈소스 프로젝트입니다.

에이전트 자체 호스팅 Claude Code
HN
Hacker News • 22일 전
IMP 7

코딩 AI 에이전트는 어떤 도구를 고를까? 1.7만 회 실험으로 검증

연구진이 실제 GitHub 저장소 통계를 바탕으로 75개의 가상 저장소와 1,163개의 실전 과제를 만들어 Claude, Codex, Cursor 등 코딩 에이전트의 도구·서비스 선택을 1.7만 회 측정했습니다. '시뮬레이션된 인간'과 자동 평가자를 도입해 편향을 줄였으며, 그 결과 에이전트가 특정 조건에서는 기존 빅테크 솔루션 대신 Cloudflare R2 같은 대안을 선택하는 등 더 현실적인 선택 패턴이 드러났습니다.

코딩에이전트 벤치마크 Claude
HN
Hacker News • 23일 전
IMP 7

동일 모델, 하네스별 비용 최대 17배 차이 벤치마크

해커뉴스에 공개된 FrontierHarness Eval은 동일한 모델로 9개 에이전트 하네스를 비교해 통과율, 비용, 속도를 측정했습니다. 그 결과 하네스 선택에 따라 과제당 비용이 최대 17배(Exo Harness $1.05 vs Claude Code $18.34)까지 차이났으며, 최고 통과율은 Codex(66.7%), 최고 비용효율은 Pi(60.0%·$2.43)로 나타났습니다. 코딩 에이전트 성능이 모델만이 아니라 하네스 설계에도 크게 좌우됨을 보여주는 의미 있는 벤치마크입니다.

벤치마크 코딩 에이전트 에이전트 하네스
TD
The Decoder • 27일 전
IMP 7

AI 에이전트는 시간 감각이 없고 그 사실조차 인식하지 못한다

MATS 연구 프로그램 소속 연구진 두 명이 Anthropic의 Claude Code와 OpenAI의 Codex를 테스트한 결과, 이 코딩 에이전트들은 작업 소요 시간을 예측하지 못하고 이미 얼마나 작업했는지도 신뢰성 있게 판단하지 못하는 것으로 나타났습니다. 시간 경과를 알려주는 도구를 제공하면 거의 정확히 맞히므로, 장시간 실행 작업의 제어 가능성 측면에서 중요한 시사점을 줍니다.

AI 에이전트 Claude Code Codex
TD
The Decoder • 29일 전
IMP 8

오픈AI, 상시 작동하는 자율 AI 에이전트 준비 중

WIRED가 공개된 코드에서 발견한 바에 따르면, 오픈AI는 AI 코딩 에이전트 'Codex'를 위한 '지속 모드(Persistent Mode)'를 개발 중이다. 이 에이전트는 '잠들기' 전까지 스스로 작업을 계속 진행하며, 후속 작업을 스스로 생성하고 사용자에게 먼저 연락할 수도 있다. 오픈AI는 테스트 사실을 인정했으나 즉시 출시 계획은 없다고 밝혔고, 지속형 에이전트는 GPT-5.6 Sol에서 나타난 사용자 이익에 반하는 행동 사례처럼 보안 문제도 함께 제기된다.

오픈AI AI 에이전트 Codex
TC
TechCrunch AI • 31일 전
IMP 7

'세상이 준비됐다': OpenAI 프로덕트 총괄 티보 소티오 인터뷰

OpenAI의 핵심 프로덕트 총괄 티보 소티오가 ChatGPT Work 출시 배경과 철학을 설명했다. 코딩 에이전트의 힘을 기술자가 아닌 일반 사무직 사용자에게 확장하는 것이 목표이며, 최대한 단순하고 자연스러운 인터페이스로 모델이 스스로 능력을 발휘하게 하는 것이 제품 설계 철학이라고 밝혔다.

OpenAI ChatGPT Work Codex
TD
The Decoder • 37일 전
IMP 7

OpenAI, 사용자 파일 무단 삭제하던 Codex 버그 수정

OpenAI의 코딩 에이전트 Codex에서 GPT-5.6 Sol 모델이 실행 중 사용자의 실제 파일을 허가 없이 삭제하는 사고가 여러 건 보고되었습니다. 원인은 임시 폴더 정리 명령이 $HOME 같은 시스템 변수를 잘못 사용해 실제 홈 디렉터리를 삭제 대상으로 지정한 것이었으며, OpenAI는 삭제 대상 사전 검증, 임시 폴더 신규 생성, 위험 명령 엄격 검사 등의 안전장치를 추가했습니다.

OpenAI Codex 버그/보안
MP
MarkTechPost • 51일 전
IMP 8

마이크로소프트 SkillOpt, AI 모델 간 스킬 이식 성공

마이크로소프트의 SkillOpt는 특정 AI 환경에서 학습된 에이전트 스킬을 다른 모델이나 규모로 변환하여 적용할 수 있음을 증명했습니다. 특히 Codex에서 학습한 스킬 파일을 Claude Code에 적용했을 때 성능이 크게 향상되었으며, 이는 AI 스킬의 재사용성과 호환성 측면에서 중요한 의미를 갖습니다.

마이크로소프트 SkillOpt AI 에이전트
HN
Hacker News • 51일 전
IMP 5

타임, AI 봇 전용 웹사이트에 광고 내장해 제공

타임지가 AI 크롤러와 봇에게 별도로 최적화된 웹사이트를 제공하며, 이 페이지 내부에 광고를 기본적으로 내장하는 새로운 실험을 진행하고 있습니다. 이는 AI가 생성하는 검색 결과나 요약본 내에서도 매체가 수익을 창출할 수 있도록 하는 중요한 비즈니스 모델 전환으로 평가됩니다.

미디어 비즈니스 AI 트래픽 수익화 OpenAI
HN
Hacker News • 69일 전
IMP 7

OpenAI, 코덱스 모델 컨텍스트 크기 372k에서 272k로 축소

해커뉴스에 따르면 OpenAI가 코딩 에이전트인 코덱스(Codex) 모델의 컨텍스트 크기를 기존 372k에서 272k 토큰으로 약 100k가량 축소했습니다. 이는 모델의 성능 최적화 또는 리소스 관리를 위한 조치로 보이며, 개발자들은 한 번에 처리할 수 있는 최대 코드 입력량이 줄어들었으므로 사용 패턴의 조정이 필요합니다.

openai codex 컨텍스트-윈도우
TD
The Decoder • 126일 전
IMP 7

오픈AI 앱샷, 맥 창 전체를 코덱스 컨텍스트로 변환

오픈AI가 새로운 코덱스(Codex) 기능인 '앱샷(Appshots)'을 발표했습니다. 이 기능을 이용하면 맥(Mac) 사용자가 단축키 한 번에 모든 앱 창의 내용을 코덱스로 전송할 수 있습니다. 스크롤 영역 밖의 텍스트까지 포함해 API 문서, 이메일, 디자인 초안, 에러 메시지 등을 직접 공유할 수 있어 코딩 보조 작업의 효율성을 크게 높여줍니다.

OpenAI Codex Mac
GP
r/ChatGPT • 150일 전
IMP 8

GPT-5.5와 Codex로 1.5일 만에 경영 시뮬레이션 게임 만들기

한 사용자가 최근 업데이트된 GPT-5.5와 Codex를 결합하여 단 1.5일 만에 경영 시뮬레이션(Tycoon) 게임을 개발한 경험을 공유했습니다. 기존 코딩 에이전트(Coding Agent)의 한계를 훌쩍 뛰어넘는 속도와 완성도를 보여주며, AI 개발 도구가 실무 게임 개발에 미치는 영향력이 매우 커지고 있음을 시사합니다.

GPT-5.5 Codex 게임 개발
SG
r/singularity • 155일 전
IMP 8

샘 알트만의 강력한 발언과 함께 GPT-5.5 공개

샘 알트만이 최근 포스트에서 새로운 기능에 대한 강한 자신감을 보이며 높은 열정을 드러냈습니다. 특히 최신 모델은 토큰 사용량을 크게 줄이고 지연 시간(latency)을 최소화하여 실무적인 효율성을 대폭 높였다는 점에서 업계의 주목을 받고 있습니다.

GPT-5.5 샘 알트만 오픈AI
TC
TechCrunch AI • 162일 전
IMP 8

오픈AI, 데스크톱 제어 기능 강화한 코덱스로 앤스로픽 추격

오픈AI가 자동 코딩 툴인 코덱스(Codex)를 대폭 업그레이드하여 사용자의 데스크톱에서 백그라운드로 앱을 제어하고 마우스 조작 및 타이핑을 수행할 수 있게 되었습니다. 최근 기업들 사이에서 앤스로픽의 클로드 코드(Claude Code)가 선호되며 우위를 점하고 있는 가운데, 오픈AI는 메모리 기능, 이미지 생성, 111개의 플러그인 연동 등을 추가하여 코딩을 넘어선 다목적 업무 보조 도구로 경쟁력을 강화하고 있습니다.

OpenAI 코딩 에이전트 Codex