메뉴

#GLM

HN
Hacker News • 8일 전
IMP 9

ZCode 코딩 에이전트, 사용자 Git 히스토리 몰래 업로드 발각

Z.ai(지푸AI)의 AI 코딩 앱 ZCode가 로그인 상태에서 사용자 워크스페이스 전체(.git 히스토리, LFS 캐시, 설정 파일 포함)를 암호화해 알리바바 클라우드 OSS에 몰래 업로드하는 것으로 밝혀졌습니다. 설정 토글을 꺼도 업로드는 멈추지 않으며, 복호화 키는 Z.ai 서버에만 존재해 사용자 자신도 업로드된 데이터를 열 수 없습니다. GLM 모델 가중치는 오픈이지만 ZCode 런타임은 폐쇄 소스라는 점이 혼란을 일으키고 있습니다.

보안 프라이버시 ZCode
WR
Wired AI • 16일 전
IMP 6

AI 해커 에이전트를 내 가정 네트워크에 풀어본 결과

AI 뉴스레터 저자가 가드레일이 제거된 AI 모델(GLM-5.3 어블리터레이션 버전)과 CyberStrike 도구를 이용해 자신의 가정 네트워크를 해킹하게 하는 실험을 진행했다. 에이전트는 가정용 기기들의 취약점과 PC 침투 경로, 취약한 코드 프로젝트의 버그들을 빠르게 찾아냈다. 저자는 AI 해킹 위협에 대처하는 최선의 방법이 결국 자신만의 AI 해커를 두는 것일 수 있다고 결론짓는다.

사이버보안 AI에이전트 가드레일 제거
HN
Hacker News • 18일 전
IMP 5

동일한 Three.js 과제에 10가지 모델·하네스 조합 테스트

한 개발자가 동일한 Three.js SF 격납고 제작 프롬프트를 10가지 모델과 코딩 하네스 조합으로 실행해 성능을 비교했습니다. 처리 시간, 토큰 사용량, 캐싱 비율, 도구 호출 오류, 브라우저 실행 여부 등 세부 지표를 공개했습니다. 특히 Qwen 3.8 27B와 OpenCode 조합은 8분 만에 적은 토큰으로 완성했고, SOL 5.6 등 일부 조합은 결과물이 제대로 동작하지 않았습니다.

모델 벤치마크 코딩 에이전트 Three.js
TD
The Decoder • 20일 전
IMP 7

오픈 웨이트 AI 모델의 안전장치 제거, 이제 상용 서비스로

미국 스타트업 Abliteration.ai가 GLM-5.3 같은 오픈 웨이트 모델에서 학습된 거부 메커니즘을 제거('어블리터레이션')한 버전을 상용 API로 판매합니다. 코딩·사이버 능력은 대부분 유지되어 보안 테스트·레드팀 작업에 합법적 수요가 있지만, GPU 인프라 없이도 접근 가능해 악용 장벽도 낮아진다는 보안 딜레마가 있습니다.

안전 오픈소스 레드팀
TC
TechCrunch AI • 30일 전
IMP 8

정체 불명의 Ox Alpha 모델, Z.ai가 개발사로 밝혀져

익명으로 OpenRouter에 공개되어 벤치마크 상위권을 기록하며 정체에 대한 추측이 일었던 오픈 웨이트 모델 Ox Alpha가 GLM으로 유명한 중국 Z.ai의 최신 모델로 확인되었습니다. Z.ai는 수요일에 웨이트를 공개할 예정이며, 이는 OpenAI·Anthropic 같은 고가 프론티어 모델 기업들에 대한 중국발 저비용 고품질 모델의 위협이 커지고 있음을 보여줍니다.

Z.ai Ox Alpha 오픈 웨이트
HN
Hacker News • 33일 전
IMP 8

GLM-5.3, 오픈 웨이트 모델이 Anthropic·OpenAI 제치고 1/5 비용으로 1위

실무 과제 28개 기반 리더보드에서 오픈 웨이트 모델인 GLM-5.3이 코딩·데이터·실전·보안·툴 사용 등 5개 영역 모두 100% 통과율을 기록하며 최상위에 올랐습니다. 한 바퀴(랩)당 비용이 $0.28로 gpt-5.5($1.43)의 약 1/5 수준이며, 유일한 단점은 첫 토큰 지연시간(16.3초)입니다. 반면 fable-5는 28개 과제 중 5개를 거부해 79%로 공동 최하위에 그쳤습니다.

GLM 오픈소스 리더보드
HN
Hacker News • 101일 전
IMP 9

GLM-5.2, 오픈웨이트 모델 중 1위 등극

Z ai의 GLM-5.2가 AI 벤치마크 플랫폼인 Artificial Analysis의 지능 지수에서 51점을 기록하며 새로운 최고 수준의 오픈웨이트(Open weights) 모델로 등극했습니다. 이 모델은 과학적 추론 및 실제 에이전트 작업 수행 능력에서 대폭 향상되어 폐쇄형 모델인 GPT-5.5와 맞먹는 성능을 보여줍니다. 작업 당 생성하는 토큰량은 많아졌지만, 동급의 지능을 가진 모델들 중에서는 가장 낮은 비용으로 매우 효율적인 성능을 제공합니다.

오픈소스 GLM 벤치마크
LL
r/LocalLLaMA • 166일 전
IMP 6

미니맥스 M2.7, GTA 벤치마크 테스트

미니맥스(Minimax)의 최신 모델 M2.7을 통해 단일 웹페이지에서 구동되는 3D GTA 스타일 게임을 생성하는 테스트가 진행되었습니다. 별도의 에이전트 프레임워크 없이도 모델이 자동차 운전과 보행 등의 기능을 구현해내며 뛰어난 코딩 능력을 입증했습니다. 방향 감각에 대한 AI의 직관적 한계는 있었으나, Boids 알고리즘을 적용한 새 떼와 나무 추가 등 피드백을 수용하는 디테일 처리 능력이 우수하게 나타났습니다.

미니맥스 코딩벤치마크 게임개발
LL
r/LocalLLaMA • 168일 전
IMP 4

GLM 소형 모델 출시 계획 없는 듯

AI 커뮤니티에서 GLM-5.1의 소형 모델 출시에 대한 논의가 이루어지고 있으나, 당분간 관련 계획이 없는 것으로 보입니다. 개발자는 에어(Air) 모델과 관련된 허깅페이스(Hugging Face) 토론창을 계속 열어두어 사용자들의 의견을 수렴하고 있습니다. 경량화된 소형 모델을 필요로 하는 실무자들은 관련 동향을 계속 주시할 필요가 있습니다.

GLM 오픈소스 소형 모델