무슨 일인가요
NVIDIA는 2026년 9월 3일 베를린 IFA 2026에서 로컬 AI 관련 발표 세 가지를 내놨습니다. 새 PC 플랫폼 RTX Spark, 집이나 사무실의 PC들을 묶어 추론을 나누는 무료 도구 PAIR, 그리고 RTX·DGX에서 원클릭으로 설치되는 로컬 에이전트 앱 3종입니다. 공식 NVIDIA 뉴스룸 목록에도 같은 날짜로 "Sparks Fly: NVIDIA Accelerates Local AI at IFA 2026"이 올라와 있습니다. 공식

RTX Spark의 사양은 1페타플롭 RTX Blackwell GPU, 최대 128GB 통합 메모리, 20코어 Grace CPU입니다. 공식 출시는 2026년 10월이며, Lenovo가 Yoga Pro 9n과 Yoga 9n 2-in-1을, Acer가 소형 데스크톱 콘셉트를 공개했고 이름을 밝히지 않은 OEM 6곳이 더 있습니다. 공식 가격은 블로그에 없습니다. 공식
128GB
RTX Spark 최대 통합 메모리
1페타플롭 RTX Blackwell GPU · 20코어 Grace CPU, 2026년 10월 출시 (NVIDIA 블로그)
PAIR는 무엇인가요
PAIR(Personal AI Router) 는 "로컬 네트워크의 호환 PC를 자동으로 발견해, 독립적인 추론 요청을 여유가 있는 시스템으로 보내는" 무료 오픈소스 도구입니다. 공식 기기가 네트워크에 들어오고 나가면 그에 맞춰 조정되고, Ollama와 LM Studio와 함께 동작합니다. 공식

| 항목 | 내용 |
|---|---|
| 지원 GPU | GeForce RTX 20 시리즈 이상, RTX PRO 워크스테이션(Turing 이상) |
| 지원 시스템 | DGX Spark, Apple M4 이상 실리콘 |
| 제공 형태 | Windows · macOS · Linux 베타, 무료 오픈소스 |
| 연동 런타임 | Ollama, LM Studio |
표의 내용은 NVIDIA 블로그 기준입니다. 공식 눈에 띄는 점은 Apple 실리콘이 지원 목록에 들어 있다는 것입니다. NVIDIA GPU가 없는 Mac도 라우팅 대상이 된다는 뜻이라, 집 안에 섞여 있는 기기를 하나의 추론 풀로 쓰게 하려는 의도로 보입니다. 추정
로컬 에이전트 앱과 성능 수치
원클릭 설치를 지원하는 앱은 세 가지입니다. Perplexity Portable Computer는 Linux에서 24GB 이상 VRAM의 RTX GPU를 요구하며 Windows 지원은 예정이고, Nous Research의 Hermes Agent는 Windows에서 RTX·DGX 원클릭 설치를 지원하며 Linux는 예정이며, OpenClaw는 Windows에서 24GB 이상 VRAM의 RTX GPU에 최적화됐습니다. 공식
추론 성능도 함께 밝혔습니다. llama.cpp는 GeForce RTX 5090에서 처리량이 최대 1.9배, vLLM은 RTX PRO 6000 Blackwell에서 1.2배, DGX Spark 2대 클러스터에서 최대 1.4배 개선됐다고 합니다. 공식
| 항목 | 개선 배수 |
|---|---|
| llama.cpp · RTX 5090 | 1.9배 |
| vLLM · RTX PRO 6000 | 1.2배 |
| vLLM · DGX Spark ×2 | 1.4배 |
출처: NVIDIA 블로그, 2026-09-03
이 수치는 NVIDIA 자체 측정이며 비교 기준 버전이나 측정 조건은 블로그에 상세히 적혀 있지 않습니다. 추정 게임 쪽으로는 Electronic Arts, Embark, Ubisoft, KRAFTON, NetEase, Riot Games, Xbox가 RTX Spark 플랫폼에 타이틀을 가져온다고 소개됐습니다. 공식



