메뉴

#ai-모델

HN
Hacker News 20일 전
IMP 8

SWE-1.7, GPT-5.5급 성능 달성하다

Cognition이 Devin에 탑재된 새로운 코딩 AI 모델 SWE-1.7을 공개했습니다. 이 모델은 훨씬 낮은 비용으로 GPT-5.5 및 클로드 3.5 오퍼스(Claude 3.5 Opus)에 필적하는 최고 수준의 지능을 달성했습니다. 특히 '사후 학습의 한계(Post-training ceiling)'를 뛰어넘어 장기적인 소프트웨어 엔지니어링 작업에 탁월한 성능을 발휘하는 것이 특징입니다.

강화학습 코딩-에이전트 AI-모델
HN
Hacker News 23일 전
IMP 5

GPT-5.6 솔 울트라, 코덱스에 탑재 예정

오픈AI의 차세대 최고 성능 모델로 예상되는 'GPT-5.6 솔 울트라(Sol Ultra)'가 개발자용 코드 생성 에이전트인 코덱스(Codex)에 통합될 예정이라는 소식이 전해졌습니다. 이는 향후 출시될 핵심 AI 모델이 소프트웨어 개발 및 코딩 작업 자동화에 직접적으로 적용될 수 있음을 시사합니다. 개발자들은 코덱스 환경에서 한층 더 강력해진 AI 기반 코딩 보조 기능을 기대할 수 있습니다.

gpt 코덱스 오픈AI
TD
The Decoder 26일 전
IMP 8

안스로픽 "클로드 코드 시스템 프롬프트 80% 감소...모델이 원해서"

안스로픽(Anthropic)이 새로운 '페이블 5(Fable 5)' 모델의 도입과 함께 '클로드 코드(Claude Code)'의 시스템 프롬프트를 80%나 대폭 축소했다고 밝혔습니다. 과거에는 프롬프트에 지시사항과 예시를 많이 넣을수록 성능이 좋아졌으나, 새로운 모델은 오히려 스스로의 추론 능력과 창의성을 발휘하는 데 방해가 되기 때문입니다. AI 업계의 프롬프트 엔지니어링 패러다임이 '엄격한 규칙 기반'에서 '핵심 컨텍스트 위주의 간결함'으로 전환되는 중요한 신호로 평가받습니다.

안스로픽 클로드 프롬프트-엔지니어링
OA
r/OpenAI 80일 전
IMP 7

클로드 신화는 과장 마케팅일 뿐이라는 주장에 대한 반격

클로드(Claude) AI 모델의 우수한 성능이 단순한 마케팅 과장이라고 폄하하던 루머가 사실과 다르다는 점이 다시 한번 확인되었습니다. 실제 실무 환경에서 진행된 심층 보안 테스트와 성능 검증을 통해 모델의 실질적인 고성능이 입증되었습니다. 이는 최신 AI 모델의 실력이 단순한 홍보를 넘어선 진정한 기술력에 기반하고 있음을 시사합니다.

claude 인공지능-성능 마케팅-논란
VB
VentureBeat AI 202일 전
IMP 8

Nous Research, 오픈소스 코딩 모델 NousCoder-14B 공개

Nous Research가 단 4일 만에 학습한 오픈소스 코딩 모델 'NousCoder-14B'를 공개했습니다. 이 모델는 더 큰 규모의 상용 모델들에 필적하는 성능을 보여주며, Anthropic의 'Claude Code'가 장악한 AI 코딩 시장에서 강력한 오픈소스 대안으로 떠오르고 있습니다. 특히 모델 가중치뿐만 아니라 강화 학습 환경과 학습 도구까지 완벽하게 공개하여 연구 및 재현 가능성을 극대화한 점이 핵심입니다.

오픈소스 코딩-에이전트 Nous-Research