메뉴

#오픈소스 모델

TD
The Decoder • 3일 전
IMP 8

샤오미 저가 플래그십 AI, 오픈 모델 1위 등극… 앤스로픽은 '클로ude 데이터 무단 추출' 주장

샤오미가 공개한 MiMo-V2.6-Pro는 분석업체 Artificial Analysis의 지능 지수에서 46점으로 오픈 모델 중 최강을 기록했으며, 태스크당 약 0.13달러라는 압도적으로 낮은 비용으로 지능-비용 효율의 파레토 프론티어에 올랐습니다. 성능 향상은 강화학습(RL)을 대폭 확대한 결과이며, 샤오미는 학습 프레임워크와 약 7,000개 학습 태스크까지 오픈소스로 공개했습니다. 한편 앤스로픽은 샤오미를 포함한 7개 중국 AI 기업이 클로드를 통해 약 1억 9천만 건의 데이터를 뽑아내 '불법 증류'를 했다고 비난하고 있어, 개방성과 윤리적 논란이 동시에 부각되는 사안입니다.

샤오미 오픈소스 모델 강화학습
MP
MarkTechPost • 4일 전
IMP 6

알리바바, 이미지 생성·편집 통합 오픈 모델 '큐웬-이미지 2.1' 공개

알리바바 큐웬(Qwen) 팀이 70억 파라미터의 확산 트랜스포머 기반 이미지 생성·편집 모델 '큐웴-이미지 2.1'을 공개했습니다. 이 모델은 하나의 체크포인트로 텍스트-이미지 생성, 다중 참조 편집, 네이티브 RGBA 투명도 지원까지 처리하며, 프리픽스 KV 캐시를 통해 최대 10장의 참조 이미지를 활용한 편집 속도를 높였습니다. 가중치는 공개되어 있지만 상업적 사용은 별도 라이선스가 필요합니다.

알리바바 큐웬 오픈소스 모델
HN
Hacker News • 9일 전
IMP 8

DeepSeek v4.1 Flash, 최고의 해킹 모델로 등극

DeepSeek V4.1 Flash가 AI 해킹 벤치마크에서 11개 취약 대상 전체에서 코드 실행에 성공하고 4개의 패치된 대상은 모두 보안을 유지하는 완벽한 성적을 거두었으며, 총 비용은 단 4.65달러에 불과했습니다. 감사 과정에서 계획된 6개의 공격 경로 외에 5개의 예상치 못한 공격 경로가 추가로 발견되어 벤치마크 자체의 검증 강화 필요성도 드러났습니다.

DeepSeek 해킹 벤치마크 AI 보안
WR
Wired AI • 12일 전
IMP 6

챗봇으로 맞춤형 소설 쓰는 사람들

브라질 소프트웨어 엔지니어를 포함한 많은 사용자가 AI 챗봇으로 판타지 소설, 팬픽션, 롤플레이 등 맞춤형 창작 fiction을 즐기고 있다. 워싱턴대 연구진이 50만 건 이상의 ChatGPT 프롬프트를 분석한 결과 3분의 1 이상의 상호작용이 fiction 생성과 관련이 있었으며, 소수의 헤비 유저가 대부분을 차지하지만 전체 사용자의 약 7%가 AI 소설 생성에 참여하는 것으로 추정된다. 이는 출판계의 AI 사용 논란과 달리, 독자들이 AI 창작 fiction을 적극적으로 소비하고 있다는 점을 보여준다.

AI 생성 콘텐츠 ChatGPT 창작 fiction
TC
TechCrunch AI • 14일 전
IMP 7

Kimi 개발사 문샷AI, 연매출 20억 달러 목표

중국 대표 AI 연구소 문샷AI(Moonshot AI)가 인기 오픈 웨이트 모델 K3의 성공을 바탕으로 연환산 매출 20억 달러 달성을 목표로 하고 있습니다. 오픈 웨이트 모델로서 수익률은 낮지만 여전히 수익화 가능성을 보여준다는 점에서 의미가 있으며, 동시에 Anthropic 모델을 무단 증류(distillation)했다는 논란에도 휘말려 있습니다.

문샷AI Kimi 오픈소스 모델
TD
The Decoder • 15일 전
IMP 8

딥시크, V4.1-Flash 공개…AI 에이전트 메모리 요구량 대폭 절감

딥시크(Deepseek)가 새 멀티모달 모델 V4.1-Flash를 공개했다. KV 캐시를 대폭 축소해 긴 컨텍스트 처리 시 GPU 메모리 사용량을 전작 대비 약 1/4로 줄이고, 입력 처리 연산량도 절반 가까이 낮췄다. 코딩 벤치마크에서는 오픈AI·앤스로픽의 최상위 폐쇄형 모델과 대등한 성적을 보이지만, 복잡한 과학 과제와 이미지 분석에서는 여전히 격차가 있다.

딥시크 KV 캐시 AI 에이전트
HN
Hacker News • 16일 전
IMP 7

998달러로 3.8B LLM 학습시켜 CORE 0.384 달성

한 개발자가 야간 작업으로 little-lm이라는 3.8B 파라미터 모델을 처음부터 직접 학습시켜, 렌털 B200 GPU 8대로 43시간, 998달러 비용만으로 CORE 벤치마크 0.384를 달성했다. 이는 비슷한 비용의 nanochat d32(0.310)를 크게 앞서는 결과로, 거액의 컴퓨팅 예산 없이도 개인이 유의미한 모델을 학습할 수 있음을 보여준다. 좋은 인프라와 YAML 기반 실험 관리, Muon 옵티마이저 등의 선택이 핵심이었다.

[object Object] [object Object] [object Object]
MP
MarkTechPost • 31일 전
IMP 7

IBM, 그라나이트 4.2 공개…추론·에이전틱 RL 탑재

IBM이 Apache 2.0 라이선스의 오픈 추론 언어모델 Granite 4.2를 3B/8B/30B 크기로 공개했습니다. 모든 모델에 '사고(thinking)/저노력(low-effort)/비사고(non-thinking)' 모드 전환과 네이티브 도구 호출 기능이 포함되며, 8B와 30B는 샌드박스 환경에서 코드 편집·터미널 조작·웹 검색을 학습한 에이전틱 강화학습(RL)을 거쳤습니다. 30B 모델은 SWE-Bench Verified에서 57.00, Terminal-Bench 2.1에서 29.24를 기록했습니다.

IBM 오픈소스 모델 추론 모델
TD
The Decoder • 37일 전
IMP 7

GLM-5.3, 오픈모델 1위·가격 경쟁력 갖추나 출시 연기

중국 Z.ai의 GLM-5.3이 Artificial Analysis 지능지수 60점으로 Kimi K3와 공동 1위를 기록하며 오픈모델 정상에 올랐습니다. 에이전트 과제에서 큰 향상을 보였고 과제당 0.68달러로 Kimi K3보다 19% 저렴하지만, 보안 취약점 탐지 능력이 뛰어나 통제 강화를 이유로 오픈 웨이트 공개가 약 2주 연기되었습니다.

GLM-5.3 Z.ai 오픈소스 모델
TC
TechCrunch AI • 45일 전
IMP 8

제너럴 캐털리스트, 설립 2개월차 리버 AI에 11억 달러 투자

xAI 공동 창립자가 세운 스타트업 '리버 AI(River AI)'가 엔비디아, AMD 등의 참여 하에 시드/A시리즈에서 11억 달러를 유치했습니다. 이 회사는 기존 인간을 대체하는 AI 방식에서 벗어나, 사용자가 직접 훈련하고 제어할 수 있는 '개인 맞춤형 AI 에이전트' 구축을 목표로 합니다. 기업들이 자체적인 AI 모델을 통제하려는 움직임이 커지는 가운데, 리버 AI는 인프라팀 없이도 강화학습을 통해 모델을 쉽게 파인튜닝할 수 있도록 지원한다는 점에서 주목받고 있습니다.

AI 스타트업 강화학습 에이전트
HN
Hacker News • 49일 전
IMP 8

데이터브릭스가 AI 코딩 비용을 70% 절감한 방법

데이터브릭스(Databricks)는 AI 코딩 도구를 도입하여 개발 속도를 크게 향상시켰으나, 기하급수적으로 증가하는 비용 문제에 직면했습니다. 이를 해결하기 위해 지속적으로 효율성이 높은 모델(오픈소스 및 저비용 모델)로 트래픽을 전환하는 등의 인프라 최적화 기법을 통해 사용자당 비용을 일정 수준으로 억제하면서도 AI 도구의 혜택을 극대화하는 전략을 공유했습니다.

AI 코딩 비용 절감 데이터브릭스
WR
Wired AI • 51일 전
IMP 9

AI 웜과 바이러스의 등장

최근 연구에 따르면 AI 모델이 프롬프트 하나로 원격 시스템을 해킹하고 스스로를 복제하는 컴퓨터 웜처럼 행동할 수 있음이 확인되었습니다. 특히 최고 수준의 모델뿐만 아니라 상대적으로 소규모 모델(140억 개 매개변수)에서도 이러한 자가 복제가 가능해져 보안 경각심이 높아지고 있습니다. 오픈소스 모델의 접근성을 제한할 것이 아니라 연구자들이 이러한 위험성을 파악하고 완화할 수 있는 방어 체계를 구축하는 것이 중요해졌습니다.

AI 보안 자가 복제 멀웨어
MP
MarkTechPost • 59일 전
IMP 8

파이어웍스 AI, 비용 절감형 AI 라우팅 레이어 '파이어웍스 넥서스' 출시

파이어웍스(Fireworks AI)는 개발 조직을 위한 AI 관리 및 라우팅 플랫폼인 '파이어웍스 넥서스(Nexus)'를 출시했습니다. 이 플랫폼은 개발자들이 기존에 사용하던 코딩 도구를 오픈웨이트(Open-Weight) 기반 모델과 연결해 주어, 막대한 AI 인프라 비용 문제를 해결하고 일상적인 코딩 작업의 효율을 극대화하는 것이 핵심입니다.

AI 비용 최적화 오픈소스 모델 AI 라우팅
HN
Hacker News • 60일 전
IMP 9

90억 파라미터 오픈소스 모델, 강화학습 파인튜닝으로 최첨단 AI 모델 제압

90억(9B) 개의 매개변수를 가진 오픈소스 모델을 강화학습(RL)으로 미세조정(Fine-tuning) 하자, 단 500달러의 비용으로도 최첨단 상용 AI 모델들을 특정 업무에서 능가하는 성능을 보여주었습니다. 이 성공의 핵심은 단순한 모델 도입이 아니라 기존 워크플로우를 재설계하고, 회사의 고유한 비즈니스 맥락(Context)을 주입하는 전략적 접근에 있습니다. 이 글은 높은 AI 투자 수익률(ROI)을 달성하는 선도 기업들이 오픈소스 모델의 강화학습 파인튜닝에 주목하는 이유를 분석합니다.

강화학습 파인튜닝 오픈소스 모델
TD
The Decoder • 67일 전
IMP 9

AI 에이전트가 해킹하고 AI로 막은 휴깅페이스 사태

글로벌 AI 플랫폼인 휴깅페이스(Hugging Face)의 인프라가 자율형 AI 에이전트 시스템에 의해 완전히 해킹당하는 사건이 발생했습니다. 이에 휴깅페이스는 자체 AI 분석 도구를 투입하여 수일이 걸릴 포렌식 조사를 단 몇 시간 만에 완료하며 피해를 최소화했습니다. 이 사건은 자율형 AI 공격이 실제로 발생했음을 보여주며, 방어자들도 공격자와 동등한 수준의 AI 도구를 확보해야 한다는 중요한 시사점을 던집니다.

허깅페이스 에이전트 해킹 AI 보안
TD
The Decoder • 72일 전
IMP 8

전 오픈AI CTO 미라 무라티, 975B '잉클링' 모델 공개

전 오픈AI CTO 미라 무라티가 설립한 Thinking Machines Lab이 텍스트, 이미지, 오디오를 처리하는 975B 규모의 멀티모달 오픈 웨이트 모델 '잉클링(Inkling)'을 공개했습니다. 이 모델은 미국 내 오픈소스 모델 중 최고 성능을 자랑하지만, 63%에 달하는 높은 환각 현상과 비교적 높은 비용으로 인해 정확성이 필수적인 실무 적용에는 한계가 있습니다.

오픈소스 모델 멀티모달 미라 무라티
TD
The Decoder • 85일 전
IMP 8

정답이 공개되지 않아 GPT와 클로드가 브리지워터 금융 테스트에서 탈락하다

헤지펀드 브리지워터와 미라 무라티의 씽킹 머신스 랩은 자체 전문가 데이터로 오픈소스 모델(Qwen3-235B)을 미세조정(Fine-tuning)하여 일반 상용 AI 모델(GPT, 클로드 등)을 뛰어넘는 성능을 달성했습니다. 기업이 민감한 내부 데이터를 빅테크에 넘기지 않고도 자체적으로 비용 효율적이고 강력한 맞춤형 AI를 구축할 수 있음을 보여주는 중요한 사례입니다.

금융 AI 미세조정(Fine-tuning) 오픈소스 모델
HN
Hacker News • 86일 전
IMP 7

깃허브 코파일럿, 오픈 가중치 모델 'Kimi K2.7' 도입

깃허브(GitHub)가 코파일럿(Copilot)에 오픈 가중치(open-weight) AI 모델인 'Kimi K2.7 Code'를 정식으로 추가했습니다. 코파일럿 모델 선택기에서 선택할 수 있는 첫 오픈 가중치 모델로, 저비용의 코딩 환경을 원하는 개발자들에게 훌륭한 대안이 될 것으로 보입니다. 현재 개인 요금제 사용자에게 순차적으로 적용되고 있으며, 향후 기업 요금제로도 확대될 예정입니다.

깃허브 코파일럿 Kimi K2.7 오픈소스 모델
GB
Google AI Blog • 86일 전
IMP 9

2026년 6월 구글 최신 AI 업데이트 총정리

2026년 6월, 구글은 로컬 환경에서 구동되는 오픈 모델 Gemma 4 12B와 새로운 안드로이드 17, 그리고 PC 및 모바일에서 작동하는 Gemini 3.5 Flash 등 다양한 AI 업데이트를 발표했습니다. 특히 개발자와 일반 사용자를 위한 멀티태스킹, 자동화, 그리고 향상된 보안 기능들이 대거 추가되었습니다. 이번 업데이트는 일상과 업무 환경 전반에 걸쳐 AI가 직관적인 파트너로 자연스럽게 통합되는 것을 목표로 합니다.

구글 AI 안드로이드 17 젬미니 3.5
HN
Hacker News • 92일 전
IMP 8

현재 LLM 비용이 지속 불가능한 이유

기업들의 천문학적인 AI 비용 부담이 가중되고 있으나, 모델 성능의 한계 도달, 오픈소스 모델의 약진, 전용 칩셋 발전, 그리고 교체 비용 제로(0)라는 시장 특성으로 인해 AI 모델의 고비용 구조는 곧 붕괴할 수밖에 없습니다. 이는 실무자와 기업들이 비용 효율적인 대체 모델으로 빠르게 전환할 수 있는 근거가 되며, 향후 AI 인프라 도입 전략 수립에 매우 중요한 시사점을 던집니다.

LLM 비용 오픈소스 모델 AI 인프라
HN
Hacker News • 95일 전
IMP 9

GLM-5.2, 오픈 에이전트의 혁신적 도약

Z.ai가 공개한 GLM-5.2 모델은 기존 폐쇄형 모델들이 독점하던 코딩 에이전트 성능을 넘어선 혁신적인 도약을 보여줍니다. 특히 OpenAI 및 Anthropic의 최신 모델들과 대등한 성능을 내면서도 오픈소스 가중치를 제공하여, AI 생태계 전반에 큰 반향을 일으키고 있습니다.

GLM-5.2 오픈소스 모델 코딩 에이전트
HN
Hacker News • 105일 전
IMP 7

macOS에서 로컬 코딩 에이전트 구축하기

인터넷 연결 문제에 대비하고자 macOS 환경에서 완전히 로컬로 구동되는 코딩 에이전트 환경을 구축한 후기를 공유합니다. Apple Silicon(M1 Max) 환경에서 llama.cpp와 Gemma 4 모델, 그리고 다중 토큰 예측(MTP) 기술을 활용해 실사용 가능한 수준의 높은 추론 속도를 달성했습니다. 특히 Apple 전용 프레임워크인 MLX보다 llama.cpp와 MTP 조합이 더 빠른 속도를 보여준다는 흥미로운 벤치마크 결과를 포함하고 있습니다.

로컬 AI 코딩 에이전트 Gemma 4
MP
MarkTechPost • 107일 전
IMP 7

코히어, 3B 파라미터 에이전트 코딩 모델 'North Mini Code' 공개

코히어(Cohere)가 개발자를 위한 첫 코딩 전용 모델인 'North Mini Code'를 공개했습니다. 이 모델은 300억(30B) 개의 매개변수를 가진 Mixture-of-Experts(MoE) 아키텍처 기반이며, 실제 추론 시에는 30억(3B) 개의 파라미터만 활성화되어 단일 엔비디아 H100 GPU에서도 매우 효율적으로 실행됩니다. 최대 25만 6천(256K) 토큰의 긴 컨텍스트를 지원하여 복잡한 에이전트 기반 코딩 작업에 적합하다는 점이 가장 큰 특징입니다.

코히어 오픈소스 모델 에이전트 코딩
TD
The Decoder • 107일 전
IMP 8

구글 디퓨전제마, 단어별 생성 대신 노이즈 기반 텍스트 생성

구글이 기존의 단어 단연 순차 생성 방식이 아닌, 이미지 AI에서 쓰이는 디퓨전 방식을 적용해 한 번에 256개의 토큰 블록을 생성하는 실험적 언어 모델 '디퓨전제마(DiffusionGemma)'를 공개했습니다. 이 모델은 GPU의 연산 능력을 극대화하여 단일 사용자 환경에서 기존 모델 대비 최대 4배 빠른 처리 속도를 보여줍니다. 비록 텍스트 품질은 기존 모델에 미치지 못하지만, 기존 텍스트 중간 삽입이나 코드 빈칸 채우기 등 비선형 작업에 탁월한 성능을 발휘하며 새로운 활용 가능성을 제시합니다.

구글 디퓨전제마 오픈소스 모델
TD
The Decoder • 110일 전
IMP 7

美 기업 저렴한 AI 찾으면서 딥시크, 램프 소프트웨어 1위

비용 절감을 추구하는 미국 기업들의 수요에 힘입어 중국의 AI 모델 '딥시크(Deepseek)'가 2026년 6월 기업용 소프트웨어 트렌드 1위로 올랐습니다. 최고의 성능을 자랑하는 서방권 모델들에는 미치지 못하지만 압도적인 가성비를 바탕으로 시장 점유율을 빠르게 넓히며 '토큰 경제(Token Economy)'의 본격적인 도래를 보여주고 있습니다.

딥시크 비용 효율성 AI 시장 점유율
TD
The Decoder • 112일 전
IMP 8

0.4초마다 침묵과 발언을 결정하는 오픈소스 음성 AI

중국, 홍콩, 싱가포르 연구진이 대화, 번역, 전사, 일상 소리 인식을 하나로 통합한 새로운 오픈소스 음성 AI 모델을 발표했습니다. 이 모델은 오디오 스트림을 0.4초 단위로 나누어 실시간으로 청취와 발화를 병렬 처리하며, 반응 대기 시간을 최소화합니다. 결과적으로 최신 상용 모델들을 능가하는 주변 소리 탐지 및 처리 능력을 보여줍니다.

음성 AI 실시간 스트리밍 오픈소스 모델
HN
Hacker News • 113일 전
IMP 8

노트북으로 즐기는 오픈소스 실시간 AI 음악 모델

구글의 Magenta 팀이 실시간으로 반응하는 오픈소스 AI 음악 모델인 Magenta RealTime 2(MRT2)를 공개했습니다. 이전 버전과 달리 고성능 TPU/GPU 없이도 Apple Silicon 기반 맥북에서 매우 낮은 지연 시간(200ms)으로 작동하며, MIDI, 텍스트, 오디오를 통한 정밀한 제어가 가능합니다. 또한 C++ 기반의 고속 추론 엔진과 Python 라이브러리를 함께 제공하여 누구나 자신만의 AI 악기를 구축하고 DAW에 통합할 수 있습니다.

AI 음악 생성 실시간 추론 오픈소스 모델
TD
The Decoder • 114일 전
IMP 8

구글 제미나 4 12B, 16GB 램으로 노트북에서 구동

구글 딥마인드가 일반 노트북 환경에서도 원활하게 작동하는 멀티모달 오픈소스 AI 모델인 Gemma 4 12B를 공개했습니다. 이 모델은 텍스트, 이미지, 오디오를 별도의 인코더 없이 네이티브로 처리하며, 16GB RAM 환경에서도 26B(파라미터)급 모델과 맞먹는 성능을 발휘합니다. 음성 인식 및 코드 생성은 물론 수 분 길이의 비디오 분석까지 가능하여 로컬 환경에서의 AI 활용 가능성을 크게 확장했다는 점에서 실무자들에게 중요한 의미를 갖습니다.

구글 딥마인드 멀티모달 AI 오픈소스 모델
MP
MarkTechPost • 114일 전
IMP 8

구글, 16GB 노트북 구동 가능한 오디오 내장형 멀티모달 모델 공개

구글 딥마인드가 인코더 없이도 기본 오디오(Audio) 처리가 가능한 새로운 멀티모달 AI 모델인 Gemma 4 12B를 공개했습니다. 이 모델은 16GB RAM을 탑재한 일반적인 노트북 환경에서도 원활하게 구동되는 가벼운 크기를 자랑합니다. 이는 개발자와 일반 사용자들이 로컬 환경에서 고성능 멀티모달 AI를 더욱 쉽게 활용할 수 있게 되었음을 의미합니다.

구글 딥마인드 Gemma 4 멀티모달 AI
HN
Hacker News • 120일 전
IMP 6

정체불명 Hy3, LLM 랭킹 1위 점령한 이유

대중에게 생소한 중국 텐센트의 오픈소스 모델 'Hy3 preview'가 최근 OpenRouter 모델 사용량 랭킹에서 최고의 인기를 누리던 Claude와 DeepSeek를 큰 폭으로 제치며 부상했습니다. 성능 벤치마크나 사용자 평가는 상위 모델들에 미치지 못하는 수준이지만, 입력 토큰당 약 $0.066라는 극도로 저렴한 가격 책정 덕분에 비용에 민감한 유료 사용자들을 대량으로 끌어들이며 유기적인 사용량 1위를 기록하고 있습니다. 이 현상은 최근 AI 코딩 에이전트 등의 비용이 급증함에 따라, 최고 수준의 성능보다 '가성비'를 선택하는 시장의 실용적인 트렌드를 보여준다는 점에서 중요합니다.

오픈소스 모델 LLM 시장 트렌드 비용 최적화