메뉴

#AI 모델

MP
MarkTechPost • 2일 전
IMP 5

타입세이프 AI 'Jev' 코딩 가이드: 타입화된 판단과 신뢰도 보정

TypeSafe AI의 'Jev'는 텍스트가 아닌 구조화된 판단을 위한 'System One' 모델로, 공식 Python SDK 설치부터 기본 질문 타입(Choice, Score, Null), 투기적 팬아웃(speculative fan-out), 신뢰도 기반 라우팅, 비동기 프로덕션 워크플로 구축까지 다루는 완전한 코딩 튜토리얼이 공개되었습니다. LLM 출력을 타입 안전하게 다루고 신뢰도를 활용해 워크플로를 분기하고자 하는 개발자에게 유용한 내용입니다.

AI 모델 Python SDK 구조화된 출력
TC
TechCrunch AI • 3일 전
IMP 8

OpenAI, 저렴하고 오류 적은 GPT-6 솔·루나 출시

OpenAI가 GPT-6 세대의 소형 모델인 솔(Sol)과 루나(Luna)의 업데이트 버전을 출시했습니다. 신모델은 5.6 시리즈 대비 절반 가격에 API를 제공하며, 사실 정확도와 코딩 오류율도 크게 개선됐습니다. 솔은 코딩 등 복잡한 작업용, 루나는 문서 요약·정보 추출 등 대량 단순 작업용으로 각각 최적화되어 있습니다.

OpenAI GPT-6 API 가격
WR
Wired AI • 3일 전
IMP 6

쥐 뇌세포 기반 AI 모델, 현실로 다가와

생물학적 컴퓨팅 스타트업 TBC(The Biological Computing Company)가 쥐 뇌세포의 신경 패턴을 활용한 AI 모델을 아마존 웹 서비스(AWS) 제한 프리뷰로 선보인다. TBC는 뇌세포가 정보를 처리하는 방식을 분석해 이를 모방하는 소프트웨어 도구를 만들어 비디오 생성 AI의 효율을 높이는 데 초점을 맞추고 있다. AI 효율성 경쟁이 치열해지면서 생물학적 컴퓨팅이라는 비주류 분야가 주목받고 있다는 점에서 의미가 크다.

생물학적 컴퓨팅 AI 모델 AWS
MP
MarkTechPost • 6일 전
IMP 6

TypeSafe AI, 텍스트 대신 타입화된 확률 기반 결정을 반환하는 'Jev' 출시

TypeSafe AI가 System One 모델인 'Jev'를 공개했습니다. 이 모델은 텍스트를 생성하는 대신, 타입이 지정된 질문에 보정된 확률(calibrated probability)로 답을 반환하는 것이 특징입니다. 입력 비용은 100만 토큰당 0.042달러이며 출력 토큰은 무료입니다. MarkTechPost는 API 사용법, 벤더 벤치마크와 그 유의점, 개발자들이 이미 만들고 있는 것들, 공개된 한계점을 다룹니다.

AI 모델 TypeSafe AI Jev
TD
The Decoder • 14일 전
IMP 7

구글, 미래를 예측하는 AI 모델 '타임스FM-3' 공개

구글 리서치가 시계열 데이터뿐 아니라 관련 변수와 예정된 할인 일정, 날씨 예보 등 미래에 알려진 사건까지 활용해 미래를 예측하는 '타임스FM-3(TimesFM-3)'를 공개했습니다. 3억 3천만 개 파라미터의 이 모델은 단일 패스로 전체 미래 시점을 한 번에 예측해 기존의 단계별 예측 방식의 오차 누적 문제를 해결했으며, 세 개 벤치마크에서 최고 성능을 기록했습니다. 깃허브와 허깅페이스에 공개되었고 향후 빅쿼리(BigQuery)에도 추가될 예정입니다.

구글 시계열 예측 타임스FM
TC
TechCrunch AI • 43일 전
IMP 8

오픈AI, GPT-5.6 Sol 속도 14배 높이는 '울트라패스트' 공개

OpenAI가 최신 모델인 GPT-5.6 Sol의 처리 속도를 기존 대비 최대 14배(초당 750 토큰) 끌어올리는 새로운 '울트라패스트(Ultrafast)' 모드를 프리뷰(미리보기) 형태로 공개했습니다. 이는 작고 특화된 모델을 써야만 했던 기존의 한계를 넘어, 고성능 대형 모델로도 실시간 처리가 가능함을 의미하며 고객 서비스 및 금융 분석 등 기업의 실무 작업 속도를 혁신적으로 단축할 수 있습니다. 해당 기능은 칩 제조사인 세레브라스(Cerebras)와의 파트너십을 통해 구동됩니다.

OpenAI GPT-5.6 AI 모델
HN
Hacker News • 43일 전
IMP 8

세레브라스, 오픈AI GPT-5.6 Sol 초고속 모드 공개

세레브라스(Cerebras)와 오픈AI(OpenAI)가 초당 최대 750 토큰을 처리하는 '울트라패스트 모드(Ultrafast Mode)'를 선보였습니다. 이를 통해 GPT-5.6 Sol 모델의 품질을 유지하면서도 경쟁 모델 대비 최대 11배 빠른 추론 속도를 자랑하며, 시간이 생명인 금융, 보안, 코딩 등 실무 환경에서 AI 작업의 효율을 극대화할 수 있게 되었습니다.

OpenAI Cerebras AI 모델
HN
Hacker News • 49일 전
IMP 8

DeepMind, 사이클론 예측 혁신... AI 모델 오픈소스화

Google DeepMind는 사이클론(태풍)의 이동 경로와 강도를 기존보다 하루 더 먼저 정확하게 예측하는 AI 모델 'WeatherNext'를 개발해 성과를 입증했습니다. 이는 기존 물리 기반 모델들이 가진 한계를 넘어선 것으로, 10년 치 기상학적 발전에 필적하는 획기적인 성과로 평가받습니다. 이를 통해 재난 대비 시간을 확보할 수 있게 되었으며, 연구진은 이 모델을 오픈소스로 공개해 재난 대응 및 기상 예측 전반의 발전을 촉진하고자 합니다.

AI 모델 기상 예측 오픈소스
TC
TechCrunch AI • 50일 전
IMP 9

챗GPT, 무료 사용자 텍스트 대화 한도 폐지

OpenAI가 최근 주간 활성 사용자 10억 명을 돌파한 챗GPT의 모든 사용자를 대상으로 텍스트 기반 대화의 횟수 제한을 전면 폐지합니다. 무료 및 Go 사용자에게는 새로운 GPT-5.6 Luna 모델이 기본으로 적용되며, 복잡한 질문에 대한 추론 능력을 높여주는 'Think(생각)' 버튼이 추가됩니다. 또한 유료 사용자(Plus 및 Pro)들은 빠른 작업 처리와 간결한 답변에 최적화된 GPT-5.6 Sol 모델을 즉시 사용할 수 있으며, 사실적 오류가 크게 감소했습니다.

OpenAI 챗GPT GPT-5.6
TD
The Decoder • 53일 전
IMP 8

중국 미니맥스 H3, 오픈 AI 비디오 모델 최초로 성능 1위 달성

중국의 AI 기업 미니맥스(MiniMax)가 공개한 비디오 생성 모델 'H3'가 오픈소스 모델 최초로 글로벌 AI 비디오 평가 순위 정상을 차지했습니다. 이 모델은 텍스트, 이미지, 오디오를 동시에 처리하여 입체 음향이 포함된 짧은 영상을 생성하며, 자체 데이터로 파인튜닝(미세조정)이 가능해 실무 적용 가치가 높습니다. 단, 고해상도 모듈 등 일부 핵심 기능은 비공개이며 연 매출 2,000만 달러 이하 기업에만 상업적 이용이 허용되는 라이선스 제약이 있습니다.

미니맥스 오픈소스 비디오 생성
TD
The Decoder • 59일 전
IMP 7

아마존, 자체 AI 모델 노바 축소하고 프론티어 연구팀에 베팅

아마존이 사내 '노바(Nova)' AI 모델 대부분의 개발을 사실상 중단하고, 전략을 전면 재편합니다. 기존 고객을 위한 최소한의 서비스는 유지하나, 자원은 새롭게 물적분산 합병한 핵심 인물이 이끄는 '프론티어 모델 연구(Frontier Model Research)' 팀에 집중됩니다. 이는 아마존이 자체 파운데이션 모델 개발 방식을 바꾸고 앤스로픽(Anthropic) 및 OpenAI 등 외부 기업에 대규모 투자를 병행하는 거시적 AI 전략의 일환으로 풀이됩니다.

아마존 Nova AI 모델
AR
Ars Technica • 60일 전
IMP 9

마이크로소프트, 경쟁사 제압한 AI 보안 모델 공개

마이크로소프트는 소프트웨어 취약점을 자동으로 분석하고 해결하는 최초의 전용 보안 AI 모델인 MAI-Cyber-1-Flash와 다중 에이전트 플랫폼인 Project Perception을 발표했습니다. 이 새로운 도구들은 벤치마크 테스트에서 구글, 오픈AI 등 경쟁사들을 뛰어넘는 성능을 보여줬으며, 비용 또한 대폭 절감하여 보안 운영의 효율성을 극대화할 수 있어 실무자들에게 매우 중요한 변화입니다.

마이크로소프트 AI 보안 취약점 분석
TC
TechCrunch AI • 60일 전
IMP 8

마이크로소프트, 사이버보안 특화 AI 모델 및 에이전트 플랫폼 출시

마이크로소프트가 복잡한 코드에서 취약점을 찾아내는 데 특화된 첫 보안 AI 모델 'MAI-Cyber-1-Flash'를 공개했습니다. 또한, 레드팀과 블루팀 등 다수의 AI 에이전트를 투입해 보안 위협을 탐지하고 코드를 자동 수정하는 에이전트 보안 플랫폼 'Perception(퍼셉션)'을 선보이며 기존 빅테크 보안 솔루션과의 경쟁에 돌입했습니다.

마이크로소프트 사이버보안 AI 모델
HN
Hacker News • 60일 전
IMP 8

마이크로소프트, 비용 절반 보안 AI 모델 MAI-Cyber-1-Flash 공개

마이크로소프트(Microsoft)는 다중 에이전트 보안 플랫폼인 MDASH 내에 통합된 새로운 보안 특화 AI 모델, MAI-Cyber-1-Flash를 발표했습니다. 이 모델은 기존 최고 수준의 모델들보다 뛰어난 취약점 발견 및 수정 성능을 보여주면서도 비용은 절반으로 줄여주며, 이를 통해 실시간 위협 모니터링과 패치가 가능한 자율형 보안 시스템인 Project Perception의 역량을 강화합니다.

사이버 보안 취약점 분석 AI 모델
TC
TechCrunch AI • 65일 전
IMP 8

전문가들 "Kimi K3의 성능, 단순 기술 도용 때문은 아냐"

미국 백악관은 중국의 문샷(Moonshot)이 수출 통제를 받는 칩을 사용하고 미국 기업 앤스로픽(Anthropic)의 모델을 불법적으로 증류(Distillation)하여 오픈소스 모델인 Kimi K3를 만들었다고 비난했습니다. 하지만 AI 전문가들은 Fable 모델이 공개된 지 얼마 되지 않았으며, Kimi K3의 압도적인 성능은 단순한 데이터 증류나 지도 미세조정(SFT)만으로는 불가능하다고 반박했습니다. 대규모 강화학습(RL)과 자체적인 고도화된 훈련이 있었을 것으로 분석하며, 증류 기법의 한계와 최근 중국 모델들의 실제 기술력을 보여주는 사례로 주목받고 있습니다.

AI 모델 오픈소스 미중 AI 경쟁
MP
MarkTechPost • 65일 전
IMP 8

2026년 최고의 공개 음성 인식 모델 비교

2026년에 접어들며 오픈소스 음성 인식(ASR) 생태계는 더 이상 OpenAI의 Whisper가 독점하지 않게 되었습니다. 이제 Cohere Transcribe, IBM Granite, MOSS-Transcribe 등 여러 오픈소스 모델들이 오차율 1% 미만의 비슷한 성능을 보여주고 있습니다. 이 글은 16개 모델의 인식률, 언어 지원, 스트리밍 속도 및 라이선스를 비교하고, 공개된 단순 평균 점수로 순위를 매기는 것이 무의미해진 이유를 설명합니다.

음성 인식 오픈소스 ASR
MP
MarkTechPost • 66일 전
IMP 8

시스코, 오픈소스 보안 AI 'Antares' 공개

시스코 파운데이션 AI는 코드베이스 내의 알려진 취약점 위치를 정확히 찾아내는 소규모 언어 모델인 Antares(350M, 1B)를 오픈웨이트로 공개했습니다. 이 모델은 파라미터 753B의 거대 AI 모델들보다 뛰어난 성능을 보이면서도, 단일 GPU 환경에서 매우 빠르고 저렴한 비용으로 작동하여 실무 보안 점검의 효율성을 크게 높일 수 있습니다.

시스코 보안 취약점 오픈소스 AI
HN
Hacker News • 67일 전
IMP 8

오픈소스 모델의 추격과 앤스로픽의 위기

최근 발표된 Kimi K3와 Qwen 3.8 등 고성능 오픈소스 기반 모델은 최고 수준(SOTA)의 AI 성능을 무료로 제공하며 폐쇄형 선도 기업들에게 큰 위협이 되고 있습니다. 이는 AI 모델의 상용화 과정에서 발생하는 막대한 추론(Inference) 비용을 절감하고 자체 인프라를 보유한 기업들에게 유리한 경쟁 구도를 형성합니다. 결국 인프라가 없는 모델 중심 기업들은 가격 경쟁이나 완벽한 기술 독점을 통한 생존 전략을 강요받게 될 것입니다.

오픈소스 AI 모델 인프라
MR
MIT Tech Review • 67일 전
IMP 7

AI 채용 편향성과 기상 데이터 조작 위협

AI가 자체적인 경험을 통해 인간보다 심각한 편향을 만들어내어 채용 과정에서 위험을 초래할 수 있다는 연구 결과가 나왔습니다. 또한 예측 시장의 확대와 데이터 기반 AI 기상 예측이 도입되면서, 기상 데이터를 악의적으로 조작하려는 위협이 커지고 있어 대응이 필요합니다. 이 밖에도 스페이스X의 국방부 AI 컴퓨팅 공급, 팔란티어의 데이터 공유 논란 등 주요 기술 이슈를 점검해야 합니다.

AI 편향성 채용 AI 기상 예측
TD
The Decoder • 68일 전
IMP 8

알리바바 Qwen 3.8 공개, "Fable 5 다음으로 뛰어나"

알리바바가 2.4조 개 매개변수를 갖춘 최신 오픈 웨이트(open-weight) 모델인 Qwen 3.8을 공개했습니다. 이 모델은 특히 코딩 및 복잡한 데이터 분석 작업에서 기존 모델을 크게 앞지르며, 급부상하는 경쟁사 Moonshot AI의 Kimi K3 모델을 견제하는 전략적 목적을 띠고 있습니다. 아직 오픈 웨이트는 공개되지 않았으나 곧 풀릴 예정입니다.

알리바바 Qwen 오픈소스
TD
The Decoder • 69일 전
IMP 7

문샷 Kimi K3, 프론트엔드 코딩 1위...수학은 부진

중국 문샷(Moonshot)의 AI 모델 Kimi K3가 프론트엔드 코드 벤치마크에서 서방 선도 모델들을 제치고 1위를 차지하며 인간 선호도 기준 뛰어난 코딩 성능을 입증했습니다. 그러나 전문가 수준의 고난도 수학 벤치마크에서는 약 39%의 정확도에 그쳐 오픈AI와 앤스로픽 등 최상위권 모델들(약 90%)에 크게 뒤처지는 편향된 성능을 보여주었습니다.

문샷 Kimi K3 프론트엔드
TD
The Decoder • 70일 전
IMP 9

중국 무버스터 키미(Kimi K3), 서구 컴퓨팅 우위 흔들다

중국의 문샷 AI가 최근 공개한 '키미(Kimi K3)' 모델가 서구의 최고 수준 AI 모델과 맞먹는 성능을 보여주며 큰 화제를 모으고 있습니다. GPU 부족이라는 한계를 혁신적인 아키텍처와 강화학습 설계로 극복하여 탄생한 이 모델은, 서구 진영의 '컴퓨팅 우위' 전략이 과연 유효한지에 대한 깊은 의문을 던지고 있습니다.

AI 모델 중국 AI 문샷 AI
HN
Hacker News • 70일 전
IMP 9

모질라 CTO가 전하는 오픈소스 AI의 현주소

오픈소스(오픈 웨이트) AI 모델이 폐쇄형 최상위 모델과의 성능 격차를 거의 좁혔으며, 추론 비용은 36개월 만에 50배 이상 폭락했습니다. 이제 실무의 대부분의 작업 부하에서는 오픈소스 모델이 주력으로 사용되고 있으며, 기술적 가치는 단순한 모델 자체를 넘어 이들을 유기적으로 연결하는 에이전트 환경으로 이동하고 있습니다. AI 주도권이 특정 빅테크에 독점되지 않도록 상호운용성과 경쟁을 보장하는 오픈소스 생태계의 중요성이 그 어느 때보다 커졌습니다.

오픈소스 AI 모델 비용 절감
HN
Hacker News • 72일 전
IMP 8

오픈 웨이트 모델 '잉클링(Inkling)' 공개

새로운 오픈 웨이트(Open-Weights) 기반 파운데이션 모델인 '잉클링(Inkling)'이 공개되었습니다. 이 모델은 총 975B(활성 41B) 매개변수와 최대 1M 토큰의 컨텍스트를 지원하며, 특히 텍스트, 이미지, 오디오를 아우르는 멀티모달推理 및 에이전트 코딩에 강점을 보입니다. 개발자들은 Tinker 플랫폼을 통해 이 모델을 손쉽게 파인튜닝(Fine-tuning)하여 다양한 실제 작업 환경에 맞춤형으로 활용할 수 있다는 점에서 의미가 큽니다.

오픈소스 파인튜닝 멀티모달
TC
TechCrunch AI • 72일 전
IMP 8

미라 무라티의 최초 오픈 모델 '잉클링' 공개

전 오픈AI CTO 미라 무라티가 설립한 씽킹 머신 랩(Thinking Machines Lab)이 첫 오픈 웨이트(Open-weight) 기반 AI 모델인 '잉클링(Inkling)'을 공개했습니다. 이 모델은 단순히 성능을 경쟁하기보다 기업이 자체적으로 맞춤화하여 사용하는 데 초점을 맞추고 있으며, 범용 AI 모델보다 맞춤형 모델이 더 높은 가치를 창출한다는 업계의 흐름을 강력하게 지지합니다. 기업들은 이 모델을 시작점 삼아 자사의 데이터와 전문성을 결합해 비용과 효율성을 모두 잡는 최적화된 AI를 구축할 수 있습니다.

오픈소스 AI 모델 씽킹 머신 랩
TD
The Decoder • 77일 전
IMP 7

메타 '뮤즈 스파크 1.1', 코딩 성능 강화 및 비용 절감

메타가 새롭게 선보인 '뮤즈 스파크 1.1(Muse Spark 1.1)' 모델은 코딩 분야에서 GLM 5.2를 앞질렀으며, 작업당 비용 측면에서도 더 저렴합니다. 지능 지수는 선두권 모델들과 동등한 수준이며, 환각(Hallucination) 현상은 크게 감소하고 컨텍스트 윈도우(Context Window)는 100만 토큰으로 확장되었습니다. 현재 이 모델은 메타 자체 API를 통해서만 이용할 수 있습니다.

메타 AI 모델 코딩
MP
MarkTechPost • 79일 전
IMP 7

데이터랩 '리프트' 문서 추출 AI 비교 분석

데이터랩(Datalab)이 개발한 문서 추출 도구 '리프트(Lift)'는 문서를 마크다운으로 변환하는 기존 방식과 달리, 이미지 자체를 직접 분석하여 지정된 JSON 스키마 형태의 결과물을 즉시 생성하는 것이 특징입니다. 90억(9B) 개 매개변수를 가진 이 모델은 PDF 등 복잡한 문서에서 핵심 정보를 빠르고 정확하게 추출해야 하는 데이터 처리 실무자에게 작업 효율을 대폭 높여줄 중요한 도구입니다.

문서 추출 JSON 스키마 리프트
MR
MIT Tech Review • 79일 전
IMP 8

오늘의 기술 뉴스: 지렁이의 환경 오염 해결과 지구공학의 현실

축산업계의 심각한 분뇨 오염 문제를 줄이기 위해 지렁이와 미생물을 활용하는 '버미필트레이션(v Vermifiltration)' 기술이 주목받고 있으며, 전 지구적 온난화를 막기 위한 태양 지구공학 연구가 실용화 단계의 엔지니어링 한계에 직면했습니다. 이외에도 트럼프 행정부의 오픈AI GPT 규제 완화, 중국 딥시크(DeepSeek)의 자체 AI 칩 개발, 메타(Meta)의 상시 촬영 스마트 안경 테스트 등 AI 및 빅테크 생태계의 주요 동향을 확인해야 합니다.

AI 모델 AI 반도체 AI 규제
MP
MarkTechPost • 83일 전
IMP 8

전 알리바바 Qwen 리더가 밝히는 하이브리드 추론의 한계와 에이전트의 미래

알리바바 '큐원(Qwen)'의 전 기술 책임자인 임준양(Junyang Lin)은 최근 강연과 에세이를 통해 Qwen3의 하이브리드 추론 모델이 가진 한계를 분석하고, AI의 방향성이 단순 추론에서 '에이전트적 사고(Agentic Thinking)'로 전환되어야 함을 강조했습니다. 특히 에이전트 강화학습(RL) 인프라를 구축하는 것이 기술적으로 훨씬 까다로우며, 보상 해킹(Reward hacking)과 같은 문제를 어떻게 해결해야 하는지가 현업 실무자들에게 중요한 과제로 남았습니다.

Qwen 에이전트 하이브리드 추론
TD
The Decoder • 88일 전
IMP 8

경쟁사 AI 모델 학습 차단하는 메타

메타가 자사 엔지니어들의 경쟁사 AI 코딩 도구 사용을 제한하고 있습니다. 이는 Claude나 Codex의 결과물이 메타의 AI 학습 데이터에混入되는 '증류(Distillation)' 문제를 막기 위한 조치입니다. 메타는 자체 코딩 어시스턴트인 메타코드(MetaCode) 구축에 집중하며 외부 도구에 대한 의존도를 낮추고 비용을 절감하려 합니다.

메타 AI 모델 데이터 보안