메뉴

#파이썬

HN
Hacker News 1일 전
IMP 7

독립적이고 이식성 높은 파이썬 배포판

이 프로젝트는 별도의 외부 종속성 설치 없이 단독으로 실행할 수 있는 고도로 이식성 높은 파이썬 배포판을 제공합니다. 표준 라이브러리의 대부분의 확장 모듈을 포함하며, 시스템의 공유 라이브러리 의존도를 최소화하여 다양한 환경에서 안정적으로 구동되도록 설계되었습니다. 또한 빌드 결과물을 조합해 파이썬을 다른 애플리케이션에 내장하거나 PyOxy와 같은 프로젝트를 통해 단일 실행 파일 형태로 유연하게 활용할 수 있어 개발자에게 매우 유용합니다.

파이썬 오픈소스 개발도구
MP
MarkTechPost 11일 전
IMP 6

AI로 구축하는 플라스미드 엔지니어링 워크벤치

본 튜토리얼은 생물정보학 실무자들을 위해 구글 Colab 환경에서 동작하는 플라스미드 엔지니어링 워크벤치를 구축하는 방법을 다룹니다. Biopython 등 파이썬 라이브러리를 활용하여 플라스미드 맵 렌더링, 제한 효소 분석, 가상 젤 전기영동 및 프라이머 설계 기능을 구현합니다.

바이오테크 생물정보학 구글콜랩
MP
MarkTechPost 28일 전
IMP 6

바이두 CUP 라이브러리로 파이썬 워크플로우 강화하기

이 튜토리얼에서는 바이두(Baidu)에서 개발한 파이썬 유틸리티 라이브러리인 'CUP'를 활용해 더 강력하고 안정적인 파이썬 개발 환경을 구축하는 방법을 다룹니다. 로깅, 스레드 풀, 캐싱, 스케줄링 등 핵심 모듈의 사용법을 자동화 및 성능 최적화 실무 사례와 함께 소개하여 개발 생산성을 높이는 데 중요한 가이드를 제공합니다.

파이썬 오픈소스 개발도구
MP
MarkTechPost 30일 전
IMP 6

파이썬 활용 OCRmyPDF 튜토리얼

이 튜토리얼은 파이썬 환경에서 OCRmyPDF를 활용해 이미지 전용 PDF를 텍스트 검색이 가능한 PDF/A로 변환하는 전체 과정을 다룹니다. 외부 파일 없이 테스트용 PDF를 생성하는 방법부터 사이드카(Sidecar) 텍스트 추출, 자동 방향 교정 및 폴더 단위의 배치 처리 자동화까지 핵심 파이프라인 구축 방법을 단계별로 안내합니다. 실무에서 스캔 문서를 디지털화하고 구조화된 텍스트 데이터로 활용해야 하는 개발자 및 데이터 엔지니어에게 매우 유용한 가이드입니다.

파이썬 OCRmyPDF 문서자동화
MP
MarkTechPost 31일 전
IMP 6

콜랩에서 구축하는 안정적인 페이블 5 트레이스 워크플로우

이 튜토리얼은 Hugging Face의 'Fable 5 Traces' 데이터셋을 활용하여 구글 콜랩(Google Colab) 환경에서 안정적인 AI 워크플로우를 구축하는 방법을 다룹니다. 불안정한 외부 의존성을 피하고 JSONL 파일을 수동으로 파싱하여 도구 호출(Tool Call) 정규화, 데이터 구조 감사, 민감 정보 제거 등의 작업을 수행합니다. 또한 안전한 형태의 데이터셋을 내보내고 순수 파이썬 기반의 나이브 베이즈(Naive Bayes) 베이스라인 모델을 학습시키는 과정까지 실무에 바로 적용할 수 있는 노하우를 제공합니다.

데이터 전처리 구글 콜랩 도구 호출
MP
MarkTechPost 35일 전
IMP 6

Graphify와 NetworkX로 파이썬 코드 구조 시각화하기

이 튜토리얼은 Graphify와 NetworkX를 활용해 복잡한 파이썬 코드베이스의 구조를 지식 그래프(Knowledge Graph)로 변환하고 분석하는 방법을 다룹니다. API 키나 LLM 없이도 완벽하게 오프라인으로 작동하여 코드 내 모듈 간의 연결 관계와 핵심 노드(God Nodes)를 파악할 수 있게 해줍니다. 개발자가 대규모 프로젝트의 아키텍처를 직관적으로 이해하고 복잡도를 분석하는 데 매우 유용한 접근법입니다.

파이썬 지식 그래프 NetworkX
MP
MarkTechPost 35일 전
IMP 7

파이썬 엔비디아 카나리 모델로 음성 인식·번역·자막 생성하는 법

엔비디아의 최신 음성 인식 모델인 카나리-1B(Canary-1B-v2)를 활용해 다국어 음성 인식(ASR) 및 번역 파이프라인을 구축하는 튜토리얼입니다. 이 가이드를 통해 개발자는 GPU 환경에서 오디오를 전처리하고, 음성을 여러 언어로 번역하며, 타임스탬프가 포함된 자막(SRT) 파일을 자동으로 추출하는 전체 과정을 빠르게 실무에 적용할 수 있습니다.

음성 인식 엔비디아 파이썬
MP
MarkTechPost 37일 전
IMP 6

프리팹(Prefab)으로 파이썬 대시보드 만들기

본 튜토리얼은 프리팹(Prefab)을 활용해 자바스크립트 없이 오직 파이썬만으로 반응형 인터랙티브 대시보드를 구축하는 방법을 다룹니다. 개발자는 차트, 필터 등 다양한 UI 컴포넌트를 구성하고 가공 데이터를 연동한 뒤, 최종 결과물을 정적 HTML(Static HTML)로 내보내는 전체 과정을 익힐 수 있습니다. 데이터 분석가나 파이썬 개발자가 복잡한 프론트엔드 지식 없이도 손쉽게 데이터 시각화 및 모니터링 도구를 개발할 수 있다는 점에서 가치가 있습니다.

파이썬 데이터 시각화 대시보드
MP
MarkTechPost 38일 전
IMP 7

크롤리(Crawlee) for Python 가이드: RAG 데이터 추출부터 링크 그래프 구축까지

본 튜토리얼은 크롤링 프레임워크인 '크롤리(Crawlee) for Python'을 활용하여 웹 데이터 수집부터 AI 모델용 데이터 생성까지의 전 과정을 다룹니다. BeautifulSoup, Parsel, Playwright 등 다양한 크롤러를 사용해 데이터를 추출하고 정규화한 뒤, 링크 그래프를 구축하여 RAG(Retrieval-Augmented Generation)에 최적화된 형태로 내보내는 실무 워크플로우를 소개합니다. AI 구축에 필요한 양질의 학습 및 참조 데이터를 안정적으로 파이프라인화하려는 개발자에게 매우 유용한 기술 가이드입니다.

웹 크롤링 파이썬 데이터 파이프라인
HN
Hacker News 49일 전
IMP 8

기본 AI 에이전트 만들기: 장기 작업 계획

단순한 질의응답에 머무는 LLM의 한계를 극복하고, 복잡하고 긴 작업을 독립적으로 수행할 수 있는 AI 에이전트의 '장기 작업 계획(Long Task Planning)' 능력을 구현하는 방법을 다룹니다. 이를 위해 에이전트가 목표를 이해하고 작업을 체계적으로 분해 및 관리할 수 있도록 돕는 '스크래치패드(Scratchpad)'와 '할 일 목록(To-do list)'라는 두 가지 핵심 도구가 소개됩니다.

AI 에이전트 작업 계획 LLM
TD
The Decoder 52일 전
IMP 9

퍼플렉시티 '코드로 하는 검색', AI가 직접 파이프라인 작성

퍼플렉시티가 AI 모델이 고정된 검색 API를 호출하는 대신, 직접 파이썬 코드를 작성해 검색 파이프라인을 구축하는 '코드로 하는 검색(Search as Code)' 아키텍처를 발표했습니다. 이를 통해 AI 에이전트는 병렬 검색, 필터링 등을 코드로 제어하여 검색 정확도를 크게 높이고 컨텍스트 낭비를 줄일 수 있습니다. 실제 보안 취약점(CVE) 분석 테스트에서 기존 대비 토큰 사용량을 85% 줄이며 경쟁사 대비 뛰어난 성능을 입증했습니다.

검색 엔진 에이전트 퍼플렉시티
MP
MarkTechPost 59일 전
IMP 6

Loguru로 프로덕션급 파이썬 로깅 구축하기

이 글은 강력하고 유연한 파이썬 로깅 라이브러리인 Loguru를 활용하여, 실제 프로덕션 환경에 바로 적용할 수 있는 견고한 로깅 파이프라인을 구축하는 실용적인 튜토리얼을 제공합니다. 개발자 및 데이터 엔지니어 관점에서 시스템의 안정성과 동시성(Concurrency)을 높이는 구조화된 로깅 설계 방법을 다루기 때문에 실무적인 가치가 높습니다.

파이썬 로깅 Loguru
MP
MarkTechPost 60일 전
IMP 8

파이썬으로 170만 건 AI 에이전트 데이터셋 구축하기

에이전트 상호작용 기록(Trace) 170만 건을 포함한 역대 최대 규모의 오픈소스 데이터셋인 'AgentTrove'를 활용하는 파이썬 실전 튜토리얼을 소개합니다. 이 튜토리얼은 대용량 데이터를 전체 다운로드 없이 스트리밍하고, 성공적인 기록만 추출해 고품질 SFT(Supervised Fine-Tuning) 데이터셋으로 변환하는 방법을 다룹니다. AI 에이전트의 파인튜닝을 위한 대규모 학습 데이터를 효율적으로 구축하려는 실무자들에게 매우 유용한 가이드입니다.

데이터셋 에이전트 파인튜닝
HN
Hacker News 70일 전
IMP 8

8B 모델 에이전트 성능 53%→99% 끌어올린 가드레일 'Forge'

자체 호스팅되는 소형 LLM(8B)의 도구 호출 및 에이전트 성능을 극적으로 끌어올려주는 'Forge' 라이브러리가 소개되었습니다. 파싱 오류 복구, 재시도 넛지, 컨텍스트 관리 등의 가드레일 기술을 통해 소형 모델로도 복잡한 다단계 에이전트 워크플로우에서 99%에 육박하는 높은 성공률을 기록할 수 있습니다. OpenAI 호환 프록시 서버 모드를 지원하여 기존 클라이언트(예: Cursor, Continue 등)에 쉽게 통합해 성능을 높일 수 있는 것이 큰 장점입니다.

오픈소스 로컬-LLM 에이전트
MP
MarkTechPost 81일 전
IMP 7

Scanpy를 활용한 단일세포 RNA-seq 분석 파이프라인 구축

본 튜토리얼은 생물정보학의 핵심 기술인 단일세포 RNA 시퀀싱(scRNA-seq) 데이터를 분석하는 전체 파이프라인을 다룹니다. Python의 대표적인 라이브러리인 Scanpy를 활용하여 PBMC-3k 벤치마크 데이터셋을 전처리하고, Leiden 알고리즘으로 세포를 클러스터링하며, 세포 주기를 교정한 뒤 주요 마커를 통해 세포 유형을 주석(annotation) 달아냅니다. 나아가 PAGA와 확산 의사시간(diffusion pseudotime)을 통해 세포의 발달 궤적을 탐색하는 고급 실무 기법까지 제공하므로 데이터 사이언티스트와 생물학 연구자에게 매우 유용합니다.

데이터-사이언스 생물정보학 파이썬
MP
MarkTechPost 82일 전
IMP 6

클로크브라우저 자동화 실습 가이드

클로크브라우저(CloakBrowser)를 활용해 탐지를 우회하는 스텔스(Stealth) 크롬 환경에서 브라우저 자동화를 구축하는 튜토리얼입니다. 구글 코랩(Colab)과 같은 비동기 루프 환경에서 발생하는 오류를 스레드 분리로 해결하고, 세션 상태 저장 및 브라우저 신호 검출 등 핵심 실습 과정을 다룹니다. 웹 스크래핑 및 자동화 실무자들이 계정 보호와 안정적인 작업 수행을 위해 참고할 만한 내용입니다.

브라우저 자동화 웹 스크래핑 파이썬
MP
MarkTechPost 84일 전
IMP 7

NiceGUI 실시간 대시보드 멀티페이지 앱 만들기

파이썬 기반 웹 프레임워크인 NiceGUI를 활용해 실시간 대시보드, CRUD, 파일 업로드, 비동기 채팅이 가능한 멀티페이지 앱을 구축하는 튜토리얼입니다. 다크 모드와 반응형 바인딩을 지원하며, 재사용 가능한 레이아웃 설계 방법도 다룹니다. 파이썬으로 빠르고 인터랙티브한 웹 앱을 만들고자 하는 실무자에게 유용한 가이드입니다.

nicegui 파이썬 웹개발
MP
MarkTechPost 89일 전
IMP 8

에이전트 UI 및 상태 동기화 심층 튜토리얼

순수 파이썬만을 사용해 외부 프레임워크에 의존하지 않고 전체 에이전트 UI(Agentic UI) 스택을 밑바닥부터 구축하는 심층 튜토리얼입니다. AG-UI 이벤트 스트림과 A2UI 선언형 레이어를 도입하여 자연어 기반 UI 생성, JSON Patch를 활용한 상태 동기화, 그리고 안전한 인간 개입(Human-in-the-loop) 승인 흐름을 구현하는 과정을 다룹니다.

에이전트 UI 생성형 UI 상태 동기화
HN
Hacker News 106일 전
IMP 7

클로드가 비행기를 조종할 수 있을까?

한 사용자가 앤스로픽의 AI 모델 '클로드'에게 X-Plane 12 비행 시뮬레이터 API를 검색하게 하고, Cessna 172 항공기를 이륙시켜 인근 공항으로 비행 및 착륙을 시도하게 했습니다. 클로드는 비행에 필요한 파이썬 제어 스크립트를 스스로 작성하고 실시간으로 수정했지만, 데이터 처리 지연과 급격한 자세 제어로 인해 두 차례 비행기가 추락하는 결과를 낳았습니다. 이 실험은 대규모 언어 모델이 복잡하고 역동적인 시스템 제어 환경에서 어떻게 대응하고 코드를 개선해 나가는지 보여주는 인상적인 사례입니다.

에이전트 시뮬레이션 클로드
MP
MarkTechPost 106일 전
IMP 7

구글 ADK 다중 에이전트 파이프라인 튜토리얼

이번 튜토리얼에서는 구글 ADK(Google ADK)를 활용하여 고급 데이터 분석 파이프라인을 구축하고, 실제 분석 업무에 투입할 수 있는 실용적인 다중 에이전트(Multi-Agent) 시스템으로 구성하는 방법을 소개합니다. 환경 설정부터 보안 API 액세스 구성, 중앙 집중식 데이터 저장소 생성을 거쳐 데이터 로딩, 통계적 검정, 시각화 등의 전문 도구를 정의합니다. 이를 통해 복잡한 데이터 분석 및 보고서 생성 과정을 자동화하고 효율화할 수 있어 개발 및 데이터 실무자들에게 중요한 참고 자료가 됩니다.

구글 ADK 다중 에이전트 데이터 분석
MP
MarkTechPost 107일 전
IMP 7

DuckDB-파이썬 분석 파이프라인 실전 구축 가이드

본 튜토리얼은 DuckDB와 파이썬을 활용하여 고성능 데이터 분석 파이프라인을 구축하는 방법을 다룹니다. SQL, 데이터프레임, Parquet 포맷 통합부터 대용량 데이터 삽입 및 병렬 처리 등 실무적인 성능 최적화 기법까지 코드와 함께 상세히 설명합니다. 데이터 엔지니어와 과학자들에게 빠르고 효율적인 인메모리 분석 엔진인 DuckDB의 활용법을 심도 있게 제공합니다.

데이터 분석 파이썬 DuckDB
HN
Hacker News 112일 전
IMP 7

에이전트 실행 환경으로 활용 가능한 반응형 파이썬 노트북

AI 에이전트를 실행 중인 marimo 노트북 환경에 연결하여, 에이전트가 작업 기억 공간과 파이썬 런타임으로 이를 활용할 수 있게 해주는 'marimo pair' 툴킷이 공개되었습니다. 이를 통해 에이전트가 코드를 실행하고 변수를 검사하며 UI를 제어할 수 있어, 인간과 에이전트 간의 원활한 데이터 작업 및 연구 협업이 가능해집니다. 기존 REPL과 달리 데이터플로우 그래프를 기반으로 실행되어 재현 가능한 프로그램을 점진적으로 구축할 수 있다는 것이 핵심 기술적 차별점입니다.

오픈소스 코딩 에이전트 파이썬