본문으로 건너뛰기

RTX Spark — 128GB 로컬 AI PC와 PAIR 라우터

NVIDIA가 IFA 2026에서 1페타플롭 GPU와 128GB 통합 메모리의 RTX Spark PC를 10월 출시한다고 밝혔습니다. 집 안 PC를 묶어 추론을 나누는 무료 도구 PAIR도 정리했습니다.

AI피셜 편집부· 2분 읽기원문 보기 ↗
팬 세 개를 단 NVIDIA GeForce RTX 4090 그래픽카드를 위에서 내려다본 모습
로컬 AI PC의 성능을 좌우하는 것은 GPU입니다. 사진은 NVIDIA GeForce RTX 4090(ASUS ROG Strix) 그래픽카드입니다.· 사진: Benlisquare · CC BY-SA 4.0

핵심 답변

NVIDIA는 2026년 9월 3일 IFA 2026에서 1페타플롭 RTX Blackwell GPU, 최대 128GB 통합 메모리, 20코어 Grace CPU를 갖춘 RTX Spark PC를 10월 출시한다고 발표했습니다. 함께 공개한 무료 오픈소스 도구 PAIR는 같은 네트워크의 PC를 자동으로 찾아 추론 요청을 여유 있는 기기로 보내며, RTX 20 시리즈 이상과 Apple M4 이상 실리콘을 지원합니다.

TL;DR세 줄 요약

  • RTX Spark는 1페타플롭 RTX Blackwell GPU, 최대 128GB 통합 메모리, 20코어 Grace CPU 구성이며 Lenovo Yoga Pro 9n·Yoga 9n 2-in-1, Acer 소형 데스크톱 등 OEM 8곳이 10월 출시합니다.
  • PAIR(Personal AI Router)는 로컬 네트워크의 호환 PC를 자동 발견해 추론 요청을 분산하는 무료 오픈소스 도구로, Ollama·LM Studio와 연동되고 Windows·macOS·Linux 베타입니다.
  • Perplexity Portable Computer, Nous Research Hermes Agent, OpenClaw 세 로컬 에이전트 앱이 RTX·DGX에서 원클릭 설치를 지원하며, 24GB 이상 VRAM을 요구합니다.
  • llama.cpp는 RTX 5090에서 처리량 최대 1.9배, vLLM은 RTX PRO 6000 Blackwell 1.2배·DGX Spark 2대 1.4배 개선됐다고 NVIDIA가 밝혔습니다. 가격은 미공개입니다.

핵심 사실

발표일
2026-09-03IFA 2026, NVIDIA 블로그
RTX Spark 사양
1 PFLOP GPU · 128GB 통합 메모리 · 20코어 Grace CPU
출시
2026년 10월Lenovo·Acer 포함 OEM 8곳
PAIR 지원 기기
RTX 20 시리즈 이상 · RTX PRO(Turing 이상) · DGX Spark · Apple M4 이상
추론 성능
llama.cpp 최대 1.9배 (RTX 5090)vLLM 1.2배 · 1.4배
가격
미공개

무슨 일인가요

NVIDIA는 2026년 9월 3일 베를린 IFA 2026에서 로컬 AI 관련 발표 세 가지를 내놨습니다. 새 PC 플랫폼 RTX Spark, 집이나 사무실의 PC들을 묶어 추론을 나누는 무료 도구 PAIR, 그리고 RTX·DGX에서 원클릭으로 설치되는 로컬 에이전트 앱 3종입니다. 공식 NVIDIA 뉴스룸 목록에도 같은 날짜로 "Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026"이 올라와 있습니다. 공식

케이블을 정리해 둔 데스크톱 PC 케이스 내부
로컬 AI PC는 결국 이런 데스크톱 하드웨어 위에서 돌아갑니다. 사진은 2020년대 부품으로 조립한 PC 케이스 내부입니다.· 사진: PantheraLeo1359531 · CC BY 4.0

RTX Spark의 사양은 1페타플롭 RTX Blackwell GPU, 최대 128GB 통합 메모리, 20코어 Grace CPU입니다. 공식 출시는 2026년 10월이며, Lenovo가 Yoga Pro 9n과 Yoga 9n 2-in-1을, Acer가 소형 데스크톱 콘셉트를 공개했고 이름을 밝히지 않은 OEM 6곳이 더 있습니다. 공식 가격은 블로그에 없습니다. 공식

128GB

RTX Spark 최대 통합 메모리

1페타플롭 RTX Blackwell GPU · 20코어 Grace CPU, 2026년 10월 출시 (NVIDIA 블로그)

PAIR는 무엇인가요

PAIR(Personal AI Router) 는 "로컬 네트워크의 호환 PC를 자동으로 발견해, 독립적인 추론 요청을 여유가 있는 시스템으로 보내는" 무료 오픈소스 도구입니다. 공식 기기가 네트워크에 들어오고 나가면 그에 맞춰 조정되고, Ollama와 LM Studio와 함께 동작합니다. 공식

가정용 멀티탭에 꽂혀 있는 전력선 이더넷 어댑터
PAIR가 다루는 무대는 집 안 네트워크입니다. 사진은 가정에서 인터넷을 나눠 쓸 때 흔히 쓰는 전력선 이더넷 어댑터입니다.· 사진: Tim Walker from United Kingdom · CC BY 2.0
항목내용
지원 GPUGeForce RTX 20 시리즈 이상, RTX PRO 워크스테이션(Turing 이상)
지원 시스템DGX Spark, Apple M4 이상 실리콘
제공 형태Windows · macOS · Linux 베타, 무료 오픈소스
연동 런타임Ollama, LM Studio

표의 내용은 NVIDIA 블로그 기준입니다. 공식 눈에 띄는 점은 Apple 실리콘이 지원 목록에 들어 있다는 것입니다. NVIDIA GPU가 없는 Mac도 라우팅 대상이 된다는 뜻이라, 집 안에 섞여 있는 기기를 하나의 추론 풀로 쓰게 하려는 의도로 보입니다. 추정

로컬 에이전트 앱과 성능 수치

원클릭 설치를 지원하는 앱은 세 가지입니다. Perplexity Portable Computer는 Linux에서 24GB 이상 VRAM의 RTX GPU를 요구하며 Windows 지원은 예정이고, Nous Research의 Hermes Agent는 Windows에서 RTX·DGX 원클릭 설치를 지원하며 Linux는 예정이며, OpenClaw는 Windows에서 24GB 이상 VRAM의 RTX GPU에 최적화됐습니다. 공식

추론 성능도 함께 밝혔습니다. llama.cpp는 GeForce RTX 5090에서 처리량이 최대 1.9배, vLLM은 RTX PRO 6000 Blackwell에서 1.2배, DGX Spark 2대 클러스터에서 최대 1.4배 개선됐다고 합니다. 공식

NVIDIA가 밝힌 로컬 추론 처리량 개선 (배)
0.0배0.5배1.0배1.5배2.0배llama.cpp · RTX 5090vLLM · RTX PRO 6000vLLM · DGX Spark ×21.9배1.2배1.4배
NVIDIA가 밝힌 로컬 추론 처리량 개선 (배)
항목개선 배수
llama.cpp · RTX 50901.9배
vLLM · RTX PRO 60001.2배
vLLM · DGX Spark ×21.4배

출처: NVIDIA 블로그, 2026-09-03

이 수치는 NVIDIA 자체 측정이며 비교 기준 버전이나 측정 조건은 블로그에 상세히 적혀 있지 않습니다. 추정 게임 쪽으로는 Electronic Arts, Embark, Ubisoft, KRAFTON, NetEase, Riot Games, Xbox가 RTX Spark 플랫폼에 타이틀을 가져온다고 소개됐습니다. 공식

자주 묻는 질문

RTX Spark는 어떤 제품인가요?
NVIDIA 블로그 기준 1페타플롭 RTX Blackwell GPU와 최대 128GB 통합 메모리, 20코어 Grace CPU를 묶은 PC 플랫폼입니다. Lenovo는 Yoga Pro 9n과 Yoga 9n 2-in-1을, Acer는 소형 데스크톱 콘셉트를 공개했고, 이름을 밝히지 않은 OEM 6곳이 더해져 10월에 출시됩니다.
PAIR는 무엇을 해 주나요?
같은 로컬 네트워크의 호환 PC를 자동으로 찾아, 독립적인 추론 요청을 여유가 있는 기기로 보냅니다. 기기가 들어오고 나가면 그에 맞춰 조정되며 Ollama·LM Studio와 함께 동작합니다. 무료 오픈소스이고 Windows·macOS·Linux 베타로 제공됩니다.
Mac에서도 쓸 수 있나요?
PAIR의 지원 하드웨어 목록에 Apple M4 이상 실리콘이 포함돼 있어 Mac을 라우팅 대상 기기로 쓸 수 있습니다. 다만 로컬 에이전트 앱 3종의 요구 사양은 RTX GPU 기준(24GB 이상 VRAM)으로 안내됐습니다.

출처 · 2

  1. 1Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026 (NVIDIA 블로그)공식 발표blogs.nvidia.com/blog/local-ai-ifa-next-gen-agents-nv-pair-rtx-spark/
  2. 2NVIDIA 뉴스룸 목록공식 발표nvidianews.nvidia.com/news

이 글의 마크다운 원문: /posts/nvidia-rtx-spark-pair-local-ai/md/ · 인용 시 출처를 “AI피셜”으로 표기해 주세요.

이 글이 도움이 됐다면 동료에게 보내 주세요.

AI피셜 새 글 알림

새 글이 올라오면 메일로 알려드려요

매일 5편, 5분 브리프. 스팸 없이 새 글 소식만. 언제든 한 번에 해지.

같은 태그·카테고리의 글을 골랐습니다.

업계 동향· 2

네이버 AI 팩토리 1단계 200MW — 브룩필드 최대 90억 달러

네이버가 9월 4일 이해진 의장과 브룩필드 브루스 플랫 회장의 회동을 공개하며, 네이버·엔비디아 1GW급 AI 팩토리 1단계(200MW)에 브룩필드가 최대 90억 달러를 투입한다고 밝혔습니다.

  • #네이버
  • #NVIDIA
  • #AI 인프라
업계 동향· 3

최대 AI 데이터센터 전력, 10개월마다 2배 — 946MW

Epoch AI 9월 4일 데이터 인사이트입니다. 최대 AI 데이터센터의 IT 전력 기록은 2024년 중반 이후 10개월마다 2배가 됐고, 현재 기록은 xAI Colossus 2의 946MW입니다.

  • #데이터센터
  • #컴퓨트
  • #Epoch AI