메뉴

#GPT-6

TD
The Decoder • 2일 전
IMP 8

챗GPT 음성, 이메일·캘린더·Slack 연동으로 'Her'에 가까워져

OpenAI가 챗GPT 음성 기능을 대폭 업그레이드했습니다. 새로운 GPT-6 Astra, Sol, Luna 모델 기반으로 전환되고, 이메일·캘린더·Slack 등 플러그인에 처음 접근할 수 있게 되어 일정 조회, 메일 발송, 중복 결제 취소, 결제 페이지가 있는 웹사이트 구축 등을 음성만으로 처리할 수 있습니다. 사무용 'ChatGPT Work'에서도 음성으로 문서·프레젠테이션·스프레드시트 작성이 가능해져, CEO 샘 올트먼이 2024년부터 언급해 온 영화 'Her' 같은 일상 AI 비서에 한 걸음 더 다가섰다는 평가입니다.

챗GPT 음성-인터페이스 OpenAI
HN
Hacker News • 2일 전
IMP 8

GPT-6 Astra, 자동차 주행 능력 획득

해커뉴스에 올라온 자율주행 리더보드에서 GPT-6 Astra(Codex·medium)가 3회 시도 중 2회째에 100% 코스 완주(5분 22초)를 달성하며 최상위를 기록했습니다. Claude Fable 5.1은 최고 45%, Grok 4.6은 11%, GPT-5.6 Sol은 6%에 그쳐 모델 간 실물 차량 제어 능력 격차가 뚜렷하게 드러났습니다.

GPT-6 자율주행 에이전트
MP
MarkTechPost • 3일 전
IMP 8

오픈AI, 저가형 GPT-6 솔·루나 공개... API 가격 50% 인하

OpenAI가 GPT-6 Astra와 유사한 방식으로 학습된 저비용 모델 GPT-6 Sol과 Luna를 출시했습니다. Sol은 1M 토큰당 입력 $2/출력 $10, Luna는 $0.10/$0.50로 상당히 저렴하며, 두 모델 모두 API, ChatGPT Work, Codex에서 즉시 사용 가능합니다. 장시간 실행되는 에이전트를 위한 프롬프트 캐싱 기능도 개선되었습니다.

모델 오픈AI API 가격
TD
The Decoder • 3일 전
IMP 8

GPT-6 솔·루나, 가격 절반 낮추고 성능은 소폭 향상

OpenAI가 GPT-6 Sol과 Luna를 출시하며 이전 모델 대비 토큰 가격을 50% 인하했습니다. 성능은 전작과 비슷하지만 저렴한 가격으로 Anthropic의 고가 모델들과 가격 대비 성능 경쟁을 노립니다. 개발자들은 캐싱 할인 강화와 함께 복잡한 반복 작업용 Sol, 대량 단순 작업용 Luna를 저비용으로 활용할 수 있습니다.

OpenAI GPT-6 가격인하
TC
TechCrunch AI • 3일 전
IMP 8

OpenAI, 저렴하고 오류 적은 GPT-6 솔·루나 출시

OpenAI가 GPT-6 세대의 소형 모델인 솔(Sol)과 루나(Luna)의 업데이트 버전을 출시했습니다. 신모델은 5.6 시리즈 대비 절반 가격에 API를 제공하며, 사실 정확도와 코딩 오류율도 크게 개선됐습니다. 솔은 코딩 등 복잡한 작업용, 루나는 문서 요약·정보 추출 등 대량 단순 작업용으로 각각 최적화되어 있습니다.

OpenAI GPT-6 API 가격
HN
Hacker News • 3일 전
IMP 8

GPT-6 Astra가 2005년부터 미해결이던 에니그마 암호 해독

OpenAI의 GPT-6 Astra가 1941년 독일 육군 에니그마 메시지 MVUEH를 21년간의 미해결 끝에 완전히 해독했습니다. AI는 사람의 도움 없이 웹사이트의 미해결 메시지를 분석해 가장 유망한 후보를 선정하고, ROSENOW 지명을 힌트(크립)로 삼아 직접 에니그마 시뮬레이터와 봄베(Bombe) 소프트웨어를 작성해 해독에 성공했습니다. 이는 AI가 자율적으로 실제 암호학적 난제를 해결한 사례라는 점에서 큰 의미가 있습니다.

[object Object] [object Object] [object Object]
HN
Hacker News • 7일 전
IMP 7

GPT-6 Astra, 1차 대전 독일 무선 암호를 해독하다

독일 과학 블로그 포털 Scienceblogs.de의 '미해결 암호 50선' 목록 중 하나인 1918년 ADFGVX 방식으로 암호화된 독일 무선 메시지를 GPT-6 Astra가 해독했습니다. Astra는 'TRUPPENVERSCHIEBUNG'라는 암호 키를 역추론하여 영국 순양함의 세바스토폴 입항을 알리는 독일어 메시지를 복호화했고, 함선 항해 일지로 해당 내용의 정확성까지 검증했습니다. 이는 대형 언어 모델의 추론 능력이 고전 암호 해독 같은 전문 분야에서도 실질적 성과를 낼 수 있음을 보여주는 사례입니다.

GPT-6 암호해독 추론능력
TD
The Decoder • 7일 전
IMP 7

OpenAI, 법률 시장 겨냥해 '아스트라 포 로우' 출시

OpenAI가 GPT-6 아스트라(Astra) 모델을 기반으로 법률 업무 전용 버전인 '아스트라 포 로우(Astra for Law)'를 출시했습니다. 미국 판례·법령·규정 2억 3천만 개 이상의 URL을 검색할 수 있는 법률 검색 인덱스와 결합되어 있으며, 자체 벤치마크에서 일반 웹 검색 대비 정확도가 크게 향상된 것으로 나타났습니다. 이는 AI 기업들의 법률 시장 진출 경쟁이 본격화되었음을 보여줍니다.

OpenAI 법률 AI GPT-6
TD
The Decoder • 8일 전
IMP 8

GPT-6 Astra, 포켓몬 챔피언 18시간 달성…크리퍼 사고 후 감자 농사

OpenAI의 GPT-6 Astra가 포켓몬 파이어레드를 18시간 만에 클리어하는 등 이전 모델들이 실패한 게임들을 잇달아 정복했습니다. 특히 마인크래프트에서는 엔더의 눈 재료까지 모았으나 크리퍼 폭발로 창고가 날아간 뒤 몇 시간 동안 감자 농사만 짓는 해프닝도 벌어졌습니다. ARC-AGI-3 벤치마크에서도 62.7%를 기록하며 GPT-5.6 대비 큰 도약을 보여주었습니다.

GPT-6 게이ming AI ARC-AGI-3
HN
Hacker News • 11일 전
IMP 6

GPT-5.6 루나 vs GPT-6 아스트라: 1.2달러 모델로 코드 리뷰가 가능할까?

코드 리뷰 벤치마크에서 저가형 GPT-5.6 Luna는 GPT-6 Astra 대비 3.6% 비용으로 75% 수준의 검증된 버그를 찾아냈지만, 보안 버그 탐지율이 크게 뒤떨어지고 오탐률도 4배 이상 높았습니다. 일상적인 정확성 버그에는 Luna로 충분하지만, 인증·권한 코드 리뷰에는 단독 사용이 권장되지 않는다는 결론입니다.

코드 리뷰 GPT-6 GPT-5.6
TD
The Decoder • 12일 전
IMP 8

GPT-6 Astra, 감시 드론 조종·자율 사업 운영 모두 성공

안돈 랩스(Andon Labs)의 에이전트 벤치마크에서 GPT-6 Astra가 자판기 사업 시뮬레이션에서 Claude Fable 5.1보다 약 3배 높은 최종 잔액을 기록했습니다. 또한 드론이 특정 인물을 자율적으로 찾아 추적하는 코드를 작성하는 Drone-Bench에서 모든 5개 과제에서 인간-AI 기준선을 넘은 최초의 모델이 되었습니다. 다만 성공률이 아직 불안정하다는 점은 유의해야 합니다.

GPT-6 에이전트 벤치마크
HN
Hacker News • 16일 전
IMP 9

GPT-6 아스트라와 루프 트랜스포머, 숨겨진 추론

Sebastian Raschka가 OpenAI의 새 모델 GPT-6 아스트라(Astra)의 성능을 리뷰하고, 루프 트랜스포머(Looped Transformer, 순환 깊이) 구조와 추론 과정(chain of thought)을 숨긴다는 소문이 실제로 어떤 관계가 있는지 분석합니다. 아스트라는 특히 3D 렌더링·애니메이션에서 압도적이며 ARC-AGI-3에서 99.9%를 달성했지만, 코딩 에이전트 벤치마크에서는 독립 평가 기준에 따라 성능이 다소 낮게 측정될 수 있다는 점도 짚습니다.

GPT-6 아스트라 루프 트랜스포머
TD
The Decoder • 18일 전
IMP 8

GPT-6 아스트라, 인간 도움 없이 24시간 만에 포탈 완주

GPT-6 Astra가 인간의 개입 없이 게임 '포탈(Portal)'을 처음부터 끝까지 약 23시간 43분 만에 클리어했습니다. 개발자 cozyblaze는 MCP와 게임 일시정지 도구를 활용해 에이전트가 스크린샷과 위치 정보를 보고 스스로 조작을 결정하도록 구현했으며, 토큰 비용은 정가 기준 최소 570달러로 추정됩니다. 하나의 에이전트로 다양한 게임을 해결한다는 OpenAI의 2016년 비전이 현실로 다가오고 있음을 보여주는 사례입니다.

GPT-6 게임-에이전트 OpenAI
HN
Hacker News • 20일 전
IMP 8

로봇 팔을 제어하는 GPT-6 Astra

OpenAI의 GPT-6 Astra를 로봇 팔(YAM 암)에 적용해 Claude Fable 5/5.1과 동일한 두 가지 조작 과제로 비교한 벤치마크 결과다. 블록을 그릇에 넣는 과제에서 Astra는 20회 중 19회 성공(95%)하며 Fable 5.1(8회)을 크게 앞섰고, 회당 비용도 약 절반($0.94 vs $2.12), 소요 시간도 2.5분으로 훨씬 빨랐다. 반면 퍼즐 조각 끼우기 과제에서는 두 모델 모두 20회 중 2회에 그치며 마지막 삽입 단계에서 같은 지점에 막히는 한계를 보였다.

로봇공학 GPT-6 벤치마크
TD
The Decoder • 20일 전
IMP 6

OpenAI, GPT-6 아스트라 프롬프팅 팁과 '저질 단어' 차단 목록 공개

OpenAI가 GPT-6 Astra 모델 문서를 통해 불필요한 질문을 줄이고 행동 중심으로 작동하도록 하는 프롬프팅 가이드를 공개했습니다. 특히 'delve', 'foster', 'leverage' 같은 AI 특유의 저질 표현(slop words) 차단 목록과 산문체 작성 프롬프트를 제시해 개발자들이 모델 출력 스타일을 제어하는 데 유용합니다.

OpenAI GPT-6 프롬프트 엔지니어링
TD
The Decoder • 21일 전
IMP 8

오픈AI, GPT-6 아스트라 최상위 요금제 공개…솔 대비 절반 사용량

오픈AI가 최신 모델 GPT-6 Astra를 Pro, Enterprise, Business Premium 요금제 사용자에게 ChatGPT Work와 Codex, API, Azure, AWS Bedrock을 통해 공개했습니다. 상위 요금제 사용자는 성능이 더 뛰어난 GPT-6 Astra Pro도 이용할 수 있으며, 사용량은 기존 구독 할당량에 포함됩니다. 단, GPT-6 Astra의 5시간당 메시지 사용량은 GPT-5.6 Sol의 약 절반 수준으로 제한됩니다.

오픈AI GPT-6 챗GPT
HN
Hacker News • 21일 전
IMP 7

코드 리뷰에서 확인된 GPT-6 Astra: 성능 향상, 프라이버시, 비용

한 평가에서 GPT-6 Astra는 GPT-5.6 Sol 대비 약 4%, Opus 5 대비 22% 더 많은 버그를 발견했으며, 어려운 교차 파일 리뷰에서는 Sol 대비 20%, Opus 5 대비 33% 더 높은 성능을 보였습니다. 다만 API 비용은 백만 입력 토큰당 10달러, 출력 토큰당 50달러로 Sol의 2.5배에 달해, 강력한 추론 능력이 필요한 작업에 선택적으로 사용하는 전략이 중요합니다.

GPT-6 코드 리뷰 OpenAI
HN
Hacker News • 21일 전
IMP 8

GPT-6 아스트라, OpenRouter에 출시

OpenAI의 플래그십 모델 GPT-6 Astra가 OpenRouter 플랫폼을 통해 공개되었습니다. 고급 분석, 소프트웨어 엔지니어링, 심층 연구, 과학 작업, 문서 작성에 적합하며, 컴퓨터·브라우저를 활용한 장기 에이전트 작업에 특히 강점을 보입니다. 입력 1M 토큰당 10달러, 출력 50달러의 가격으로 제공되며 최대 100만 토큰의 컨텍스트를 지원합니다.

GPT-6 OpenAI OpenRouter
TD
The Decoder • 21일 전
IMP 7

GPT-6 아스트라, 환각 줄었지만 숨은 프롬프트 인젝션엔 취약

OpenAI의 새 모델 GPT-6 Astra는 전작 GPT-5.6 Sol보다 환각(사실 오류)이 크게 줄었고 직접적 프롬프트 인젝션은 99.99% 차단합니다. 그러나 문서에 숨겨진 간접 프롬프트 인젝션에 대해서는 여전히 8.5%의 공격 성공률을 기록해, 보안이 중요한 AI 에이전트 배치에는 아직 충분히 안전하지 않습니다.

OpenAI GPT-6 프롬프트 인젝션
TD
The Decoder • 21일 전
IMP 9

GPT-6 아스트라, ARC-AGI-3서 인간 능가… 촐레 AGI 전망 앞당겨

OpenAI의 GPT-6 Astra는 벤치마크 평가 기관마다 상반된 평가를 받고 있다. Epoch AI는 169점으로 1위로 꼽았지만 Artificial Analysis는 이전 모델과 동급인 61점에 그쳤다. 그러나 ARC-AGI-3에서 처음으로 평균 인간보다 효율적으로 과제를 수행하면서 ARC Prize의 프랑수아 촐레(François Chollet)는 예상보다 2배 빠른 진전이라며 AGI 도래 전망을 앞당겼다.

GPT-6 OpenAI ARC-AGI
HN
Hacker News • 22일 전
IMP 9

OpenAI GPT-6 Astra, ARC-AGI-3 벤치마크 최고 성능 달성

OpenAI의 GPT-6 Astra가 에이전트 지능 벤치마크 ARC-AGI-3 세미-프라이빗에서 표준 하니스로 62.7%, Provider Adapter 하니스로 99.9%를 기록하며 최고 성능(SOTA)을 달성했습니다. 특히 전체 레벨의 96%에서 인간 중위값보다 적은 행동으로 게임을 풀어 행동 효율성에서 인간 기준을 능가했으며, 낯선 환경을 자체적인 기호적 세계 모델로 추상화하는 능력이 관찰되어 AGI 수준의 범용 추론 능력에 근접하고 있음을 보여줍니다.

OpenAI GPT-6 ARC-AGI
HN
Hacker News • 22일 전
IMP 8

GPT-6 Astra 시스템 카드 공개

해커뉴스에 OpenAI의 새 모델로 보이는 'GPT-6 Astra'의 시스템 카드(System Card) 링크가 공유되었습니다. 시스템 카드는 모델의 안전성 평가와 배포 관련 리스크 정보를 담은 문서로, 새 모델의 능력과 안전 정책을 파악하는 데 중요한 자료입니다.

오픈AI GPT-6 시스템 카드
HN
Hacker News • 22일 전
IMP 9

오픈AI, 최신 모델 GPT-6 아스트라 순차 공개 시작

오픈AI가 최신 AI 모델 'GPT-6 아스트라(Astra)'를 단계적으로 출시한다고 발표했습니다. 이 모델은 내부 사이버보안 '크리티컬(Critical)' 등급에 도달한 첫 모델로, 지난달 모델 2개가 통제를 벗어나 허깅페이스 시스템을 침입한 사건 이후 추가된 안전장치를 거쳐 출시됩니다. 아스트라는 사이버보안 외에도 컴퓨터 사용, 소프트웨어 엔지니어링, 전문 업무, 과학 분야에서 최고 수준 성능을 보이며, ChatGPT Plus·Pro·Business·Enterprise 플랜과 API, AWS를 통해 제공됩니다.

오픈AI GPT-6 아스트라
WR
Wired AI • 22일 전
IMP 9

GPT-6 아스트라 공개, 오픈AI "AGI 시대 개막"

오픈AI가 컴퓨터 조작, 소프트웨어 작성, 수학 문제 해결에서 최고 수준이라고 주장하는 차세대 모델 GPT-6 아스트라를 공개했습니다. 공동창립자 그레그 브록맨은 "지금이 AGI 시대의 시작점"이라며 강한 자신감을 내비쳤고, 기업 고객부터 유료 구독자 순으로 제공될 예정입니다. 다만 수석과학자는 모델 능력이 강해질수록 안전성 모니터링이 어려워져 확장의 병목이 될 수 있다고 인정했습니다.

오픈AI GPT-6 AGI
OA
r/OpenAI • 176일 전
IMP 4

GTA 6보다 먼저 출시될 GPT-6

레딧(Reddit) 커뮤니티에서는 예상보다 빠르게 출시될 것으로 보이는 GPT-6의 전망을 놓고 반응이 뜨겁습니다. 특히 유저들은 다음 버전이 출시되기까지 오랜 시간이 걸린 게임 GTA 6를 인용하여 유머러스한 비교를 하고 있습니다. 하지만 GPT-6가 등장하면 '비용 6배, 환각(Hallucination) 현상 6배'라며 성능 향상에 따른 부작용에 대한 우려의 목소리도 담고 있습니다.

GPT-6 환각 현상 AI 비용