메뉴

#데이터베이스

HN
Hacker News 8일 전
IMP 7

DeepSQL: 오픈소스 셀프호스팅 DBA 에이전트

DeepSQL은 PostgreSQL과 MySQL을 위한 자체 호스팅 DBA 및 데이터 엔지니어링 AI 에이전트입니다. 슬로우 쿼리 최적화, 워크로드 모니터링, 대시보드 생성 등을 자동화하며, 단 한 줄의 명령어로 15분 만에 자체 인프라에 구축할 수 있어 데이터 보안을 유지하면서 데이터베이스 운영을 자동화할 수 있습니다.

데이터베이스 DBA 자동화
MP
MarkTechPost 9일 전
IMP 8

페이인 AI, 쿼리 작성 전 DB를 먼저 분석하는 'SQRL' 모델 공개

페이인 랩스(Feyn Labs)는 자연어를 SQL 쿼리로 변환하는 'SQRL' 모델 패밀리를 발표했습니다. 이 모델은 읽기 전용 프로브를 통해 실제 쿼리를 작성하기 전에 데이터베이스를 먼저 검사하여 정확도를 높이는 것이 특징입니다. 특히 핵심 모델인 SQRL-35B-A3B는 벤치마크에서 뛰어난 성능을 기록했으며, 기업 내부에 자체 호스팅이 가능한 소규모 모델로 경량화할 수 있어 실무 적용에 중요한 의미를 갖습니다.

텍스트-투-SQL 데이터베이스 오픈소스
HN
Hacker News 15일 전
IMP 7

SQL로 신경망 구현하기

한 개발자가 해커뉴스(Hacker News)를 통해 SQL 쿼리만으로 신경망(Neural Network)을 구현한 프로젝트를 공유했습니다. 이 프로젝트는 파이썬의 다차원 배열 라이브러리인 Xarray와 SQL을 결합하여, 복잡한 딥러닝 프레임워크 없이도 데이터베이스 엔진 위에서 모델 학습이 가능함을 보여줍니다. 데이터 기반의 전통적인 SQL 환경에서도 머신러닝 파이프라인을 통합할 수 있다는 점에서 기술적 의의가 있습니다.

SQL 신경망 오픈소스
MP
MarkTechPost 20일 전
IMP 8

네플릭스, 카산드라 파티션 분할로 읽기 지연 초→밀리초 단축

네플릭스 엔지니어링 팀은 시계열 데이터(TimeSeries) 처리 시 발생하는 아파치 카산드라(Apache Cassandra)의 거대 파티션(Wide Partition) 문제를 해결하는 기술을 공유했습니다. 읽기 경로에서 대용량 파티션을 동적으로 감지해 분할하는 방식을 도입하여, 평균 읽기 지연 시간을 수 초에서 10밀리초 수준으로 획기적으로 단축했습니다. 이를 통해 500MB 이상의 거대한 데이터 파티션도 빠르고 안정적으로 조회할 수 있게 되어 대규모 데이터 인프라 운영에 중요한 해결책을 제시합니다.

넷플릭스 데이터베이스 카산드라
MP
MarkTechPost 23일 전
IMP 7

신시틱 사이언스, 오픈소스 AI 연구 워크벤치 'OpenScience' 공개

신시틱 사이언스(Synthetic Sciences)가 기계학습, 생물학, 물리학, 화학 연구를 위한 오픈소스 AI 워크벤치인 'OpenScience'를 아파치 2.0 라이선스로 출시했습니다. 이 도구는 자체 API 키와 인프라를 활용해 다양한 최신 AI 모델을 연동할 수 있으며, 250개 이상의 편집 가능한 스킬과 과학 데이터베이스를 제공합니다. 연구자들이 각자의 연구 환경 내에서 안전하고 유연하게 AI를 활용할 수 있다는 점에서 매우 유용한 솔루션입니다.

오픈소스 AI 워크벤치 생물/물리/화학
HN
Hacker News 23일 전
IMP 7

GitHub Freno: 협력적 고가용성 스로틀러 서비스

Freno는 애플리케이션이 데이터베이스(MySQL 등)에 데이터를 쓰기 전에 요청을 중계하여 과부하를 막아주는 협력적 스로틀러입니다. 대량의 업데이트나 스키마 변경 작업 시 발생할 수 있는 데이터베이스 복제 지연(Replication Lag) 문제를 방지하여 서비스 안정성을 높여줍니다. Raft 합의 알고리즘을 기반으로 고가용성을 보장하며, 클라이언트는 HTTP 요청을 통해 안전하게 쓰기 작업을 진행할 수 있습니다.

데이터베이스 오픈소스 백엔드
HN
Hacker News 28일 전
IMP 8

Postgres와 S3 Parquet를 연결하는 LTAP 아키텍처 해설

전통적인 데이터베이스의 단일 병목 문제를 해결하기 위해 스토리지와 컴퓨팅을 외부 클라우드 서비스로 분리한 Lakebase의 OLTP 아키텍처를 심층 분석합니다. 이를 통해 단일 데이터 복사본과 개방형 컬럼 형식을 활용해 별도의 데이터 파이프라인(CDC)이나 부하 없이 OLTP와 분석 쿼리를 동시에 처리하는 LTAP의 혁신성을 설명합니다.

데이터베이스 Postgres 클라우드 아키텍처
HN
Hacker News 36일 전
IMP 7

Memcached 찬양: Redis보다 매력적인 이유

캐시 도입 시 가장 먼저 떠오르는 Redis는 시간이 지나면서 개발자들에 의해 영구적인 DB처럼 오용되어 운영자에게 큰 부담을 줍니다. 반면 Memcached는 디스크 저장 기능이 없고 클라이언트 기반 클러스터링을 지원하여 장애 처리가 매우 단순합니다. 단순한 캐시가 필요한 인프라 환경이라면 운영 및 관리 측면에서 Memcached가 훨씬 안정적이고 가벼운 선택지가 될 수 있습니다.

백엔드 인프라 캐시
HN
Hacker News 44일 전
IMP 2

사라진 공항들: 역사와 미스터리

1999년에 처음 문을 연 이 웹사이트는 미국 전역에 흩어져 있는 2,868개의 흥미로운 버려진 및 과거 공항(airfield)들의 기록과 이미지를 보존하고 있습니다. 항공 역사와 비상시 비행 안전성에 중요한 가치를 지니는 이 사이트는 순수 후원으로만 운영됩니다.

항공 역사 데이터베이스
TD
The Decoder 46일 전
IMP 7

구글 '제미나이-SQL2', 텍스트투SQL 벤치마크 압도적 1위

구글 리서치가 자연어를 실행 가능한 SQL 쿼리로 변환하는 새로운 시스템인 '제미나이-SQL2(Gemini-SQL2)'를 공개했습니다. 이 모델은 자연어를 SQL로 변환하는 정확도를 측정하는 BIRD 벤치마크에서 80.04%의 실행 정확도를 기록하며 오픈AI, 앤스로픽 등 경쟁사들을 큰 차이로 제치고 압도적인 1위를 차지했습니다. 자연어 기반의 복잡한 데이터베이스 쿼리 생성 기술이 상용화 단계에 근접하고 있음을 보여주는 중요한 성과입니다.

구글 리서치 제미나이 데이터베이스
MP
MarkTechPost 46일 전
IMP 8

구글 제미나이-SQL2 공개, 텍스트-SQL 평가 80% 돌파

구글 리서치가 자연어를 데이터베이스 쿼리로 변환하는 '제미나이-SQL2'를 공개했습니다. 이 솔루션은 Gemini 3.1 Pro 모델을 기반으로 하며, 실무 데이터베이스 환경을 평가하는 BIRD 단일 모델 리더보드에서 80.04%의 실행 정확도를 기록했습니다. 데이터 기반 실무자들에게 자연어 기반 데이터 분석 및 추출 작업의 효율을 극대화할 수 있다는 점에서 중요한 의미를 갖습니다.

구글 제미나이 데이터베이스
TC
TechCrunch AI 63일 전
IMP 8

클릭하우스, 연간 매출 2.5억 달러 달성…IPO 향한 행보

데이터베이스 스타트업 클릭하우스(ClickHouse)가 연 환산 매출 2억 5천만 달러를 돌파하며 전년 대비 3배 성장을 기록했습니다. 150억 달러에 달하는 높은 기업가치와 빠른 성장세를 바탕으로, 최근 스노플로우(Snowflake) 출신 CFO 영입 등 상장(IPO)을 향한 본격적인 준비를 마쳤습니다. 특히 AI 에이전트용 대규모 데이터 처리에 최적화된 오픈소스 기술력과 공격적인 M&A를 바탕으로 스페이스X 등과 함께 가장 주목받는 상장 후보로 떠올랐다는 점에서 업계의 이목이 집중되고 있습니다.

클릭하우스 데이터베이스 IPO
HN
Hacker News 67일 전
IMP 7

AI 모델 스펙·가격·기능 통합 오픈소스 DB 공개

전 세계 AI 모델의 스펙, 가격, 기능 정보를 한곳에 모은 오픈소스 프로젝트가 공개되었습니다. API와 TOML 형식의 파일 구조를 통해 데이터에 접근할 수 있으며, 커뮤니티 기여를 통해 최신 정보가 지속적으로 갱신됩니다. 주요 내용에는 모델의 토큰당 비용, 컨텍스트 제한, 지원 모달리티(Modality) 등의 세부 설정값과 로고 추가 방법 등이 포함되어 있습니다.

오픈소스 AI 모델 데이터베이스
40
404 Media 69일 전
IMP 4

매직 더 개더링 30년 역사 기사 17.5만 건을 구한 아키이비스트

미국의 한 소프트웨어 엔지니어가 '렝의 도서관(The Library of Leng)'이라는 웹사이트를 구축하여, 인터넷의 빠른 변화 속에서 사라질 위기에 처한 '매직 더 개더링' 관련 과거 기사 및 전략 글 17만 5천 건을 아카이빙했습니다. 이 프로젝트는 유저넷(Usenet) 게시물, 폐쇄된 취미 웹사이트의 글, 삭제된 퍼블리셔 공지 등을 수집했으며, 저작권을 존중해 전문과 웨이백 머신 링크만을 제공하는 방식으로 운영됩니다. 이는 디지털 환경에서 쉽게 소멸하는 게임 커뮤니티의 지식과 역사를 보존한다는 점에서 큰 의미를 갖습니다.

아카이빙 디지털 보존 매직 더 개더링
MP
MarkTechPost 79일 전
IMP 8

2026년 주요 9개 벡터 DB 아키텍처와 가격 비교

RAG와 에이전트 AI 환경에서 필수적인 인프라로 자리 잡은 벡터 데이터베이스를 주요 9개 제품을 대상으로 비교 분석한 글입니다. 각 시스템의 아키텍처, 가격 정책, 확장성 한계 등 실무적인 기준을 제시하여 기술 선택을 돕습니다. AI 검색 및 생산성 향상을 위한 백엔드 인프라 구축 담당자들에게 중요한 인사이트를 제공합니다.

벡터 데이터베이스 RAG 에이전트 AI
HN
Hacker News 93일 전
IMP 8

PostgreSQL 백업 도구 pgBackRest 유지보수 종료

13년간 사랑받아온 PostgreSQL의 핵심 오픈소스 백업 및 복구 솔루션인 pgBackRest의 메인테이너가 프로젝트 유지보수를 공식적으로 중단한다고 발표했습니다. 후원사인 Crunchy Data의 인수 이후 재정적 후원과 지속 가능한 일자리를 확보하지 못해 내린 어쩔 수 없는 결정입니다. 이에 따라 글로벌 PostgreSQL 커뮤니티와 실무자들은 향후 파생(Fork) 프로젝트의 등장이나 대체 솔루션 마련을 고려해야 하는 중요한 변화를 맞이하게 되었습니다.

postgresql 오픈소스 데이터베이스
HN
Hacker News 95일 전
IMP 7

클로드·챗GPT처럼 기억하는 오픈소스 AI 메모리 레이어

Hacker News에 'Stash'라는 오픈소스 AI 메모리 레이어 프로젝트가 소개되었습니다. 이 도구는 PostgreSQL과 pgvector 기반으로 작동하며, 어떤 AI 에이전트든 사용자와의 대화 맥락과 선호도를 영구적으로 기억할 수 있게 해줍니다. 기존의 단순한 문서 검색(RAG)과 달리, 폴더처럼 체계적으로 메모리를 관리하고 에피소드를 패턴과 지혜로 발전시키는 '두 번째 뇌' 역할을 합니다.

에이전트 메모리 오픈소스
HN
Hacker News 95일 전
IMP 8

데이터베이스 설계의 기본 전제를 깨는 에이전트 AI

기존 데이터베이스는 인간이 작성하고 검토한 예측 가능한 쿼리를 처리한다는 암묵적인 전제하에 설계되었습니다. 그러나 스스로 추론하여 비정형 쿼리를 생성하고 무자비하게 쓰기 작업을 수행하는 에이전트 AI는 이 전제를 완전히 깨버립니다. 이 글은 개발자들이 에이전트로 인한 데이터베이스 장애를 막기 위해 세션 타임아웃 설정 및 소프트 삭제(Soft Delete) 도입 등 어떤 조치를 취해야 하는지 실무적인 관점에서 조언합니다.

에이전트 AI 데이터베이스 시스템 아키텍처
MP
MarkTechPost 107일 전
IMP 7

DuckDB-파이썬 분석 파이프라인 실전 구축 가이드

본 튜토리얼은 DuckDB와 파이썬을 활용하여 고성능 데이터 분석 파이프라인을 구축하는 방법을 다룹니다. SQL, 데이터프레임, Parquet 포맷 통합부터 대용량 데이터 삽입 및 병렬 처리 등 실무적인 성능 최적화 기법까지 코드와 함께 상세히 설명합니다. 데이터 엔지니어와 과학자들에게 빠르고 효율적인 인메모리 분석 엔진인 DuckDB의 활용법을 심도 있게 제공합니다.

데이터 분석 파이썬 DuckDB