본문으로 건너뛰기

NVIDIA, 개인용 에이전트 구동을 위한 RTX Spark PC 및 소프트웨어 생태계 발표

NVIDIA가 개인용 AI 에이전트 구동에 최적화된 RTX Spark PC와 보안 런타임 OpenShell을 공개하고, 주요 소프트웨어 및 추론 엔진 최적화를 발표했다.

섹션별 상세

RTX Spark는 1 페타플롭의 AI 연산 성능과 128GB 통합 메모리를 갖춘 Windows PC로, 로컬 환경에서 개인용 AI 에이전트를 안전하고 효율적으로 구동한다.
NVIDIA OpenShell 런타임은 Windows 보안 프리미티브를 활용해 에이전트의 정책 관리, 데이터 격리, 개인정보 보호 기능을 제공하며 Hermes Agent와 OpenClaw 등 주요 에이전트 앱에 통합된다.
llama.cpp는 다중 토큰 예측(MTP)과 텐서 병렬 처리를 통해 Qwen 3.6-27B 모델에서 최대 2배, 35B 모델에서 1.6배의 처리량 향상을 달성했다.
llama.cpp의 최적화 전후 성능 비교 차트
ChartQwen 3.6 모델을 사용하여 llama.cpp의 최적화 적용 전후 처리량을 비교한다. 27B 모델에서 2배, 35B 모델에서 1.6배의 성능 향상을 시각적으로 보여준다.
llama.cpp에서 텐서 병렬 처리와 파이프라인 병렬 처리의 성능 비교
Chart다중 GPU 환경에서 텐서 병렬 처리가 파이프라인 병렬 처리보다 높은 토큰 생성 처리량을 기록함을 나타낸다.
근거
  • Qwen3.6-27B 모델에서 최대 2배, 35B 모델에서 1.6배의 처리량 향상을 달성했다. llama.cpp performance section
vLLM은 DGX Spark 환경에서 NVFP4 체크포인트 최적화와 커널 개선을 통해 기존 대비 2.6배의 추론 성능을 기록했다.
근거
  • vLLM은 DGX Spark 환경에서 기존 대비 2.6배의 추론 성능을 기록했다. Agent Optimizations for Linux section
Adobe Premiere와 Photoshop은 RTX Spark의 통합 메모리와 Blackwell GPU를 활용하도록 재설계되어 AI 기반 편집 및 효과 처리 성능이 최대 2배 개선된다.
RTX Video Frame Generation은 ComfyUI 노드 및 Python 휠 형태로 제공되어 AI 모델이 생성한 저프레임 영상의 재생 속도를 실시간으로 보간한다.
ComfyUI에서의 다중 GPU 성능 향상 차트
ChartFlux2, WAN2.2 등 다양한 모델에서 2개의 RTX 5090 GPU를 사용할 때의 생성 성능 향상을 보여준다.

기술

  • RTX Spark
  • llama.cpp
  • vLLM
  • OpenShell
  • Adobe Premiere
  • Adobe Photoshop
  • Blender
  • ComfyUI
  • NVIDIA Broadcast

활용 사례

  • 개인용 AI 에이전트
  • 로컬 LLM 추론
  • AI 기반 영상 편집
  • 3D 텍스처링
AI 분석 전체 내용 보기

AI 요약 · 북마크 · 개인 피드 설정 — 무료

출처 · 인용 안내

원문 발행 2026. 06. 01.수집 2026. 06. 01.출처 타입 RSS

인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.