메뉴

#오픈소스

HN
Hacker News • 5시간 전
IMP 5

LLM용 Jev 스타일 단일 함수 래퍼, 비전 모델까지 지원

Jev와 OpenJev, SemIf 같은 셀프호스팅 프로젝트에서 착안해, LLM의 토큰 확률(logprobs)을 읽는 기법으로 질문에 답하는 단일 함수 래퍼를 소개합니다. max_completion_tokens를 1로 제한해 짧고 빠르게 답을 얻으며, 이미지 첨부(attachments) 필드를 직접 확장해 웹캠 프레임을 비전 모델(Gemma 4 12B, gpt-6-luna)로 분석하는 실험도 포함됩니다.

LLM 토큰확률 비전모델
HN
Hacker News • 15시간 전
IMP 6

Ollaya – 오픈소스 Jev 스타일 의사결정 모델의 로컬 실행 도구

Ollaya는 Ollama처럼 자체 하드웨어에서 의사결정 모델을 로컬로 실행할 수 있는 오픈소스 도구입니다. 텍스트나 JSON에 대해 타입화된 질문을 던지면 토큰 생성 없이 단일 순전파로 밀리초 단위의 캘리브레이션된 답변을 얻을 수 있습니다. RTX 4090 기준 5개 질문 처리에 약 10ms가 걸리며, TypeSafe API와 호환되고 데이터가 외부로 나가지 않아 프라이버시가 중요한 업무에 유용합니다.

오픈소스 로컬LLM 의사결정모델
HN
Hacker News • 17시간 전
IMP 6

제브메모(Jevmem) – Claude Code용 자동 프로젝트 메모리 도구

제브메모(Jevmem)는 Claude Code 채팅에서 나온 결정, 제약조건, 버그, 할 일을 JEVMEM.md 파일에 자동으로 저장하고, 다음 세션에서 관련 내용을 컨텍스트에 다시 불러오는 도구입니다. Cursor와 Codex에서도 작동하며, 기존 결정이 바뀌면 삭제하지 않고 '폐기(superseded)' 처리해 히스토리를 보존하는 것이 특징입니다. 전용 소형 분류기(Jev by TypeSafe AI)를 사용해 판단 속도가 0.3초로 기존 LLM 대비 10배 이상 빠르면서 정확도도 최상위권입니다.

Claude Code 개발자 도구 에이전트 메모리
HN
Hacker News • 23시간 전
IMP 6

에이전트 기반 CUDA 커널 최적화 도구 공개

해커뉴스에 LangGraph 기반 '에이전트형 CUDA 커널 옵티마이저'가 공개되었습니다. 워크로드 설명만 입력하면 GPU 구현을 자동 생성하고, 컴파일·정확성 검증·벤치마크·개선을 반복하며 가장 빠른 검증 커널을 선별합니다. NVIDIA 문서 조회와 Nsight Compute 프로파일링 카운터 확인도 지원해 GPU 커널 최적화 업무의 자동화 가능성을 보여준다는 점에서 주목할 만합니다.

에이전트 CUDA GPU 최적화
HN
Hacker News • 23시간 전
IMP 3

브레인퍽(Brainfuck)으로 레이트레이서를 작성해보았다

한 개발자가 8개 명령어만 있는 난해한 프로그래밍 언어인 브레인퍽(Brainfuck)으로 실제 동작하는 레이트레이서를 처음 원칙(first principles)부터 구현한 도전기입니다. 고정소수점 Q16.16 형식으로 부동소수점을 흉내 내고, 재귀 코드를 반복형으로 변환하는 등 극도로 제한된 언어의 한계를 극복한 과정을 다룹니다. 튜링 완전한 언어라면 이론상 무엇이든 만들 수 있음을 보여주는 재미있는 사례입니다.

브레인퍽 레이트레이서 난해한 프로그래밍
TD
The Decoder • 1일 전
IMP 7

블랙 포레스트 랩스, 오픈소스 로봇 AI 모델 'FLUX 3 Action' 공개

이미지 생성 AI로 유명한 블랙 포레스트 랩스(BFL)가 로봇 전용 오픈 AI 모델 FLUX 3 Action을 공개했습니다. 로봇 작업 공간의 다중 카메라 영상을 입력받아 다음 행동과 환경 변화를 예측하는 월드-액션 모델로, 70억 파라미터라는 경량 크기로 RoboLab-120 리더보드에서 최고 성공률을 기록하며 기존 최고 오픈 모델 대비 최대 3.95배 빠릅니다. 가중치는 허깅페이스(Hugging Face)에서 다운로드할 수 있습니다.

로봇 오픈소스 멀티모달
HN
Hacker News • 2일 전
IMP 5

에어갭 파일 암호화를 자체 복호화 HTML 페이지로 구현

자가 압축 해제 아카이브(self-extracting archive)에서 영감을 받아, 웹브라우저만 있으면 설치 없이 네트워크 연결 없이 스스로 복호화되는 단일 HTML 파일 기반 파일 암호화 도구를 공개했습니다. 완전한 감사 가능성을 위해 재현 가능한 빌드와 내장 OpenPGP 서명을 지원하며, 심지어 openssl만으로도 복호화가 가능합니다.

암호화 보안 오픈소스
MP
MarkTechPost • 2일 전
IMP 6

컨트라스티브-LM, CLM-8B 공개…제브 대비 최대 9배 빠른 에이전트 행동 평가

Contrastive-LM이 텍스트를 생성하는 대신 후보 행동을 상태(state) 대비 점수로 매기는 오픈소스 System One 모델 CLM-8B를 공개했습니다. 고정된 Qwen3-8B 인코더에 작은 프로젝션 헤드 2개를 추가해 InfoNCE 대비 학습으로 훈련했으며, 제로샷 테스트에서 TypeSafe의 Jev보다 최대 9배 빠릅니다. 미세조정된 헤드를 검증기(verifier)로 사용할 경우 DeepSWE 유출 테스트에서 81.6%, Terminal-Bench 2.1 유출 테스트에서 87.6%의 성능을 달성했습니다.

에이전트 오픈소스 대조학습
HN
Hacker News • 2일 전
IMP 5

AgentRun: 에이전트를 워크플로로 바꾸는 DSL 공개

Parcha AI가 해커뉴스에 'AgentRun'이라는 오픈소스 워크플로 DSL을 공개했습니다. 이미 운영 중인 AI 에이전트에 반복 가능한 단계를 정의하고, Jev로 판단을 내리며, 조사가 필요할 때만 에이전트를 호출하는 구조입니다. 앱의 도구·모델 접근·권한·예산은 그대로 유지되며, API 키 없이 데모를 실행해볼 수 있습니다.

워크플로 에이전트 오픈소스
MP
MarkTechPost • 3일 전
IMP 6

노키아, 오픈소스 'AnyJev' 공개—오픈 LLM을 교육 없이 보정된 의사결정 모델로

노키아 응용연구팀이 오픈 LLM을 별도 학습 없이 의사결정 모델로 변환하는 파이썬 라이브러리 'AnyJev'를 오픈소스로 공개했습니다. 문장 생성이 아닌 고정된 선택지 중 하나를 고르는 실무 작업에 특화되어 있으며, PyPI에서 설치 가능하고 Apache-2.0 라이선스로 제공되어 바로 배포에 활용할 수 있습니다.

노키아 AnyJev 오픈소스
MP
MarkTechPost • 3일 전
IMP 7

큐타이, 강화학습으로 음성 수학을 푸는 음성 네이티브 모델 'Voice of Reason' 공개

프랑스 연구소 큐타이(Kyutai)가 GLM-4-Voice-9B 기반의 오픈 웨이트 음성 대 음성(speech-to-speech) 모델 'Voice of Reason' 2종을 공개했습니다. 지도 미세조정(SFT)과 강화학습(RL)을 통해 음성 기반 GSM8K 수학 정답률을 27.3%에서 77.1%로 끌어올렸으며, 전사(transcription)나 텍스트 LLM 없이 순수 음성만으로 추론합니다. 두 체크포인트는 허깅페이스에 공개되어 있고 H100 GPU 한 장으로 실행 가능합니다.

음성 AI 강화학습 오픈소스
HN
Hacker News • 3일 전
IMP 8

오픈 모델 세계의 현재 주도권 구도

AI 연구자 네이선 램버트가 미 의회에 제출한 증언을 확장한 글로, 미중 경쟁 관점에서 오픈 웨이트 모델의 현황을 진단합니다. 2025년 4월 이후 중국 기업들이 오픈 웨이트 모델 분야에서 명확히 앞서고 있으며, 허깅페이스 다운로드 수 기준으로 중국이 미국의 2배를 기록하고 있다고 지적합니다.

오픈소스 오픈웨이트모델 미중AI경쟁
HN
Hacker News • 3일 전
IMP 5

JevBench — 타입 안전 결정 모델을 위한 재현 가능한 벤치마크 공개

Hacker News에 타입 기반 결정 모델을 평가하는 재현 가능한 벤치마크 'JevBench'가 소개되었습니다. 이 벤치마크가 classifier.dev를 측정한 결과, 이 서비스는 자체 모델이 아니라 TypeSafe의 Jev 모델에 가격 층과 저신뢰도 에스컬레이션(모델 캐스케이드)을 얹은 것으로 확인되었습니다. 자기 모델끼리 순위를 매기는 문제 때문에 v1.2.4부터 명예 언급으로 분류된다는 점이 흥미롭습니다.

벤치마크 결정 모델 모델 캐스케이드
WR
Wired AI • 3일 전
IMP 8

AI 집단지성이 스스로 명령 내리는 악성코드 발견한 새 도구

시스코 탈로스(Cisco Talos)가 AI 통합 악성코드를 분류·분석하는 오픈소스 프레임워크 'CAIRN'을 공개했습니다. 이 도구는 사람의 개입 없이 최대 4개의 대규모 언어모델(LLM)에 다음 행동을 질의해 합의에 따라 움직이는 완전 자율적 명령제어(C2) 구조의 'CLOSEDQUORUM' 악성코드를 발견했습니다. AI 통합 악성코드는 아직 실험 단계지만 공개 보도보다 훨씬 다양하게 존재하며, 방어 커뮤니티에 중요한 조기 경고 신호가 됩니다.

보안 악성코드 시스코탈로스
MP
MarkTechPost • 4일 전
IMP 7

엔비디아, SoL-Pi 공개…코딩 에이전트 토큰 사용량 최대 49% 절감

엔비디아 연구진이 오픈소스 코딩 에이전트 Pi용 하네스 메커니즘 4종 'SoL-Pi'를 발표했습니다. AI가 535개 환경에서 자동 연구 루프를 돌려 발견한 것으로, EdgeBench에서 토큰 트래픽을 44.7~49.0%, API 비용을 약 33% 줄이면서도 GPT-5.6 Sol 및 Opus 5 벤치마크에서 원래 성능의 약 94%를 유지합니다.

엔비디아 코딩-에이전트 SoL-Pi
MP
MarkTechPost • 4일 전
IMP 6

AWS, 토큰 비용 28% 절감한 오픈소스 에이전트 하네스 'Strands Harness' 공개

AWS Strands Agents 팀이 완전히 조립된 범용 에이전트 하네스인 'Strands Harness'를 오픈소스로 공개했습니다. Claude Code나 Codex에서 잘 작동하던 에이전트 아이디어가 직접 구축한 루프에서는 성능이 저하되는 문제를 해결하는 것이 목표로, 로컬 또는 클라우드에서 실행 가능하며 Python 버전이 제공됩니다. 동등한 정확도를 유지하면서 토큰 비용을 28% 낮췄다는 점이 핵심입니다.

AWS 에이전트 하네스 오픈소스
HN
Hacker News • 4일 전
IMP 7

프론티어 AI를 내 하드웨어에서 직접 실행하기

한 대학 AI 연구실 리더가 '연구의 미래는 GPU를 가장 많이 보유한 곳의 것이 아니라 오히려 자원이 제한적인 학계의 것'이라고 주장하며, 연구의 단위가 개별 논문에서 '생태계'로 변화했다고 말합니다. 이에 따라 자신의 연구실이 프론티어 수준의 자율 연구, 로컬 실행 모델, 도메인별 강화학습 환경 구축 방법 등을 오픈소스로 공개하는 '오픈소스 위크'를 진행한다고 발표했습니다. GPU 몇 대나 맥북만으로도 누구나 최고 수준의 AI 도구를 무료로 쓸 수 있게 만들겠다는 것이 핵심 메시지입니다.

오픈소스 자율 연구 학계 AI
HN
Hacker News • 4일 전
IMP 6

포머지 – 병렬 코딩 에이전트 간 의도 충돌 감지

Foremerge는 Git 위에 구축된 오픈소스 코딩 에이전트 조정 프로토콜로, 여러 AI 에이전트가 격리된 워크트리에서 작업하더라도 각자 수정하려는 대상(의도)을 공유 목록에 선언해 충돌을 코드 작성 전에 감지합니다. Git은 텍스트만 비교하기 때문에 서로 다른 파일에 대한 합리적인 변경이 의미상 충돌하는 경우를 잡아내지 못하는데, Foremerge는 결정론적 탐지기로 이를 해결합니다. 파일 잠금이나 LLM 판단 없이 자동으로 경고만 제공하는 advisory 방식이 특징입니다.

코딩 에이전트 오픈소스 깃(Git)
HN
Hacker News • 4일 전
IMP 6

Show HN: Lossless-memory – 요약하지 않는 개인 AI 장기 기억 시스템

개인 AI 어시스턴트를 위한 로컬 기반 장기 기억 시스템으로, 대화를 요약하거나 벡터 검색만으로 압축하지 않고 모든 원문 로그를 타임스탬프와 함께 그대로 보관합니다. 시간 표현을 이해하는 단일 검색 진입점과 '현재 주제'를 알려주는 소형 인덱스(LLL)를 통해 문맥 압축과 세션 경계를 넘어 정체성과 맥락을 유지합니다. JSONL 로그 + SQLite(FTS5, sqlite-vec) 기반의 1인용·단일 머신 구현체입니다.

AI 메모리 장기 기억 로컬 LLM
HN
Hacker News • 5일 전
IMP 5

Kev: Qwen3.5 기반의 경량 Jev 스타일 의사결정 모델 패밀리

Kev는 Qwen3.5를 기반으로 한 소형 의사결정 모델 패밀리로, Jev의 아키텍처 논문을 따르며 0.8B/4B/9B 크기로 제공됩니다. 사전 학습된 가중치를 쓰거나 직접 학습할 수 있고, TypeSafe System One과 호환되는 API로 CUDA와 Apple Silicon에서 로컬 실행이 가능합니다. 예/아니오(noul), 다중 선택(choice), 평점(score) 질문을 한 번의 요청에 입력 텍스트를 공유하면서 처리하며, 확률 기반 결과를 반환합니다.

오픈소스 로컬모델 Qwen
HN
Hacker News • 5일 전
IMP 6

미니 AGI – 8GB VRAM으로 학습하는 지속학습 언어모델

해커뉴스에 'mini-AGI'라는 프로젝트가 공개됐다. 8GB VRAM 소비자용 GPU 한 장으로 처음부터 학습 가능하며, 읽는 모든 것에서 계속 학습하는 바이트 단위 언어모델이다. 가중치를 디스크에 저장하고 필요할 때만 VRAM으로 불러오는 방식으로 파라미터 수를 디스크 용량만큼 확장할 수 있고, 치명적 망각 없는 단일 데이터 스트림 지속학습이 보통 하드웨어에서도 가능함을 보여준다는 점이 핵심이다.

지속학습 언어모델 오픈소스
HN
Hacker News • 5일 전
IMP 6

헤러틱, 언어모델 제한 해제 도구 공개

헤러틱(Heretic)은 언어모델에 부과된 안전 제한을 해제해 사용자의 지시를 항상 따르도록 만드는 오픈소스 도구입니다. pip로 몇 초 만에 설치할 수 있으며 GitHub, Hugging Face, Discord 등을 통해 배포되고 있습니다. LLM의 자유로운 활용과 안전 정책 논란 모두 측면에서 주목받는 소식입니다.

오픈소스 언어모델 LLM
HN
Hacker News • 5일 전
IMP 5

아미가 유닉스(Amix), 다시 태어나다

커뮤디어의 아미가용 유닉스 'Amix'(System V Release 4, 1990-92년 출시)를 비공식 커뮤니티 프로젝트 amigaux.org가 되살려 68040/68060 CPU와 현대의 가속기 하드웨어에서 구동하고, 패키지 관리자(apkg)와 크로스 툴체인, 신규 드라이버를 갖춘 현대적인 유닉스 환경으로 재구축하고 있습니다. 생성형 AI가 소스가 없는 옛 커널 바이너리를 읽고 드라이버 초안을 작성하되 사람이 방향을 정하고 실제 하드웨어로 검증하는 방식이 인상적입니다.

레트로컴퓨팅 유닉스 아미가
HN
Hacker News • 5일 전
IMP 8

구글, 오픈소스 에이전트 오케스트레이터 'AX' 공개

구글이 'AX(Open Agentic Orchestrator)'를 오픈소스로 공개했습니다. AX는 에이전트 작업을 YAML로 선언하면 샌드박스 격리, 네트워크 정책, 워크스페이스 구성을 자동으로 처리하고 클러스터당 수십억 개의 태스크를 실행할 수 있게 해주는 도구입니다. 액터 기반의 'Agent Substrate' 런타임 위에서 동작해 서브초 단위 재개와 고밀도 멀티플렉싱을 지원합니다.

구글 에이전트 오케스트레이터
MP
MarkTechPost • 5일 전
IMP 6

Flet 1.0 출시, 파이썬만으로 웹·데스크톱·모바일 앱 개발

Flet 1.0이 2026년 9월 15일 출시되며 프로덕션급 앱 개발에 적합한 프레임워크로 성숙했음을 공식 선언했습니다. 실제 기기에서 패키징된 앱을 구동하는 계층형 CI 스위트, 파이썬 3.12~3.14 번들링, 100개 이상의 모바일 대응 패키지, 컨트롤 디핑 속도 개선, dart-bridge 인프로세스 통신 등이 핵심 변화입니다. 기존 0.28 사용자가 마주할 마이그레이션 함정도 함께 안내됩니다.

Flet 파이썬 크로스플랫폼
TD
The Decoder • 5일 전
IMP 7

알리바바 오픈 웨이트 Qwen-Image-2.1, 70억 파라미터로 폐쇄형 모델 능가 주장

알리바바 Qwen 팀은 이미지 생성·편집용 오픈 웨이트 모델 Qwen-Image-2.1을 공개했습니다. 70억 파라미터의 경량 모델임에도 자체 벤치마크에서 대부분의 폐쇄형 모델을 능가한다고 주장하며, RTX 3090급 소비자 GPU에서도 구동 가능합니다. 투명 이미지(RGBA) 생성과 최대 10장의 참조 이미지 활용이 특징이지만, 연구 라이선스로 상업적 사용은 별도 허가가 필요합니다.

알리바바 Qwen 이미지 생성
TD
The Decoder • 5일 전
IMP 6

텐센트 '간더', 작업 수행 중에도 대화 지속하는 AI 모델

텐센트 혼연(Hunyuan) 음성 팀이 발표한 'Gander'는 실시간 대화를 담당하는 '소뇌(cerebellum)'와 복잡한 에이전트 작업을 처리하는 교체 가능한 '뇌(brain)'를 분리해 대화 반응성과 작업 정확도를 동시에 추구하는 AI 모델입니다. 음성·이미지·텍스트를 동시에 처리하며 사용자가 언제든 끼어들 수 있고, 타이밍 벤치마크에서 상용 모델(GPT-Realtime, Gemini Live 등)보다 사용자를 덜 방해했지만 작업 정확도는 다소 뒤처지는 것으로 나타났습니다. 팀은 모델 가중치와 학습 데이터 공개를 계획 중이며 코드용 GitHub 저장소도 이미 마련되어 있습니다.

텐센트 음성 비서 AI 에이전트
HN
Hacker News • 5일 전
IMP 7

해적 얼굴, AI 모델 삭제 위기에서 구하다

Pirate Face는 오픈소스 AI 모델(LLM, 이미지, 오디오, 데이터셋)을 토렌트·마그넷 링크로 변환해 P2P 방식으로 영구 보존하는 탈중앙화 인프라입니다. Hugging Face에서 삭제되더라도 파일 공유 무리(swarm)가 모델을 유지하며, 모든 파일은 Hugging Face 공식 SHA-256 체크섬으로 검증되어 변조를 방지합니다. 기존 파이프라인에서 환경변수만 바꾸면 되는 드롭인 API도 곧 제공될 예정입니다.

오픈소스 토렌트 P2P
HN
Hacker News • 5일 전
IMP 7

AI와 창작 공유 문화의 파괴

생성형 AI(LLM)가 저작권과 라이선스를 무시하고 온라인의 모든 콘텐츠를 학습하면서 40년에 걸쳐 형성된 오픈소스 사회적 계약이 무너지고 있다고 지적하는 글입니다. 개발자 입장에서 코드 공개가 보안 취약점 노출과 AI 봇의 저품질 PR 홍수로 이어지는 등 부담으로 변하면서, 지식 공유가 축복에서 저주가 될 수 있음을 경고합니다.

저작권 오픈소스 AI 학습 데이터
HN
Hacker News • 6일 전
IMP 6

KDE 30주년, AI 네이티브 데스크톱 제안 등장

KDE가 30주년을 맞아 오스트리아 그라츠에서 연례 컨퍼런스 'Akademy'를 개최하며, 사용자별 개인 AI 모델을 기반으로 Plasma 데스크톱이 자동 구성되는 'AI 네이티브 데스크톱' 제안이 발표될 예정입니다. 이 제안은 AI를 채팅창이 아닌 인프라로 취급하는 것으로 참석자들의 의견이 크게 갈릴 것으로 보이며, 2025년 '공진 컴퓨팅 선언문'과의 유사성도 지적되고 있습니다.

KDE 리눅스 오픈소스