메뉴
BL
MarkTechPost • 38일 전

엔비디아, 텐서RT 모델 커넥트 공개 프리뷰 출시

IMP
7/10
핵심 요약

엔비디아가 Apache-2.0 라이선스의 TensorRT Model Connect(TRTMC)를 공개 프리뷰로 출시했습니다. 허깅페이스 또는 로컬 체크포인트를 단 두 개의 명령으로 중간 ONNX 변환 없이 엔드투엔드 TensorRT 추론까지 연결해주며, 런타임에 PyTorch 없이 네이티브 C++로 추론이 실행된다는 점이 핵심입니다. 2026년 7월 29일 GB300 스냅샷 기준 76개 모델 패밀리에 걸쳐 105개 릴리스 프로파일을 지원합니다.

번역된 본문

엔비디아가 TensorRT Model Connect(TRTMC)를 공개 프리뷰로 출시했다. Apache-2.0 라이선스 기반 프로젝트로, 지원되는 허깅페이스 또는 로컬 체크포인트를 단 두 개의 명령만으로 중간 ONNX 익스포트 과정 없이 엔드투엔드 TensorRT 추론까지 연결해 준다. 빌드 결과물은 버전이 관리되는 .bundle 아티팩트로 생성되며, 네이티브 C++ 태스크 API를 통해 실행되기 때문에 런타임 경로에 PyTorch 없이 추론이 실행된다. 엔비디아의 2026년 7월 29일자 GB300 스냅샷은 76개 모델 패밀리에 걸쳐 105개 릴리스 프로파일을 지원한다.

이 글 '엔비디아, 텐서RT 모델 커넥트 공개 프리뷰 출시: 두 개 명령으로 허깅페이스 체크포인트에서 네이티브 C++ 추론까지'는 MarkTechPost에 처음 게재되었다.

원문 보기
원문 보기 (영어)
NVIDIA has released TensorRT Model Connect (TRTMC) in public preview, an Apache-2.0 project that takes a supported Hugging Face or local checkpoint to end-to-end TensorRT inference in two commands, with no intermediate ONNX export. The build emits a versioned .bundle artifact that runs through native C++ task APIs, so inference executes without PyTorch in the runtime path. NVIDIA's July 29, 2026 GB300 snapshot covers 105 release profiles across 76 model families. The post NVIDIA Releases TensorRT Model Connect in Public Preview: Hugging Face Checkpoint to Native C++ Inference in Two Commands appeared first on MarkTechPost.