NVIDIA는 베를린에서 열린 IFA에서 윈도우를 중심으로 한 로컬 AI 솔루션을 집중적으로 소개했습니다. 9월 3일 발표된 NVIDIA의 게시물에는 운영체제 제어 하에 백그라운드에서 실행되는 에이전트를 위한 새로운 윈도우 에이전트 프레임워크, OpenClaw 및 Nous Research의 Hermes Agent를 위한 원클릭 윈도우 설치 기능, NVIDIA PAIR라는 추론 라우터의 베타 버전, 새로운 로컬 모델 모음, 그리고 Lenovo, Acer 및 기타 6개 OEM 업체에서 출시될 RTX Spark 윈도우 PC의 10월 출시 예정 일정 등이 포함되어 있습니다.
이번 주에 NVIDIA가 발표하지 않은 또 다른 일이 있었습니다. 저희 연구실의 DGX Spark 클러스터 에 최신 펌웨어 업데이트를 적용한 후 , fwupd 장치 목록에 이전에는 볼 수 없었던 항목이 추가되었습니다. 바로 Windows UEFI CA입니다. 이는 기기의 펌웨어가 Windows 부트 로더를 신뢰하는 데 사용하는 Microsoft 인증서입니다. 이제 Spark에서 Windows를 사용할 수 있게 될 가능성이 매우 높아졌으며, 이는 Spark 사용자들이 가장 많이 요청했던 기능입니다.
저희 DGX Spark의 펌웨어에서 무엇이 바뀌었나요?
아래는 스크린샷입니다. sudo fwupdmgr upgrade 이번 주 업데이트 후 저희 Spark 장비 중 하나에서 확인해 본 결과, 임베디드 컨트롤러, TPM, UEFI CA 및 UEFI 장치 펌웨어가 모두 최신 버전입니다. 업데이트가 보류되지 않은 장치 목록을 살펴보면, "Windows UEFI CA"가 BIOS DB 키, 키 교환 키, SBAT, UEFI dbx 해지 목록 및 ConnectX-7과 함께 나열되어 있습니다.
왜 그 부분이 중요한지 간단히 설명드리겠습니다. UEFI 보안 부팅은 펌웨어가 운영 체제를 실행하는 데 사용하는 신뢰할 수 있는 인증서 데이터베이스(.db)를 관리합니다. Linux 배포판은 Microsoft의 타사 UEFI CA에서 서명한 shim을 통해 부팅되며, fwupd는 이를 "UEFI CA"로 추적합니다. Windows 부트 관리자는 다른 Microsoft 인증서, 즉 Windows 프로덕션 CA로 서명되며, fwupd는 이를 "Windows UEFI CA"로 별도로 추적합니다. DGX OS는 타사 인증서만 필요했기 때문에 Spark의 데이터베이스에 Windows 인증서가 있을 필요가 없었습니다. 하지만 이번 주 업데이트 이후 Windows 인증서가 추가되었고, fwupd는 보류 중인 업데이트 없이 해당 인증서를 목록에 표시합니다.
이 하드웨어에서 Arm 기반 Windows를 부팅하려면 Blackwell GPU, Grace CPU의 플랫폼 장치, ConnectX-7 NIC 및 나머지 보드에 대한 드라이버와 설치 프로그램이 여전히 필요하며, NVIDIA는 DGX Spark에 대해 이러한 드라이버 및 설치 프로그램에 대해서는 아무런 언급도 하지 않았습니다. NVIDIA가 밝힌 내용은 동일한 GB10급 실리콘이 다음 달에 RTX Spark라는 이름으로 Windows PC에 탑재될 것이며, NVIDIA와 Microsoft는 Computex 이후부터 Windows 스택을 공동 개발해 왔다는 것입니다. DGX Spark 펌웨어에서 Microsoft의 부팅 인증서를 신뢰하는 것은 이러한 계획을 실현하기 위한 필수적인 기반 작업입니다.
왜 이 제품에 관심을 가져야 할까요? Spark 구매를 고려하는 사람들로부터 가장 많이 들었던 요청 사항은 바로 네이티브 Windows 지원이었고, 이것이 바로 AMD Ryzen AI Halo 리뷰가 그 정도의 평가를 받은 주된 이유입니다. Halo는 128GB 용량의 본체에 Windows 11 또는 Linux를 지원하는 반면, Spark는 DGX OS만 사용합니다. DGX Spark에 Windows가 탑재되면 이 두 제품 간의 가장 큰 격차가 줄어들고, Ubuntu 환경에 익숙한 AI 개발자를 넘어 훨씬 더 넓은 사용자층을 확보할 수 있을 것입니다.
RTX Spark 윈도우 PC, 10월 출시
NVIDIA는 RTX Spark PC가 "이번 10월에 출시될 예정"이라고 밝혔습니다. 레노버는 IFA에서 Yoga Pro 9n과 Yoga 9n 2-in-1을 선보였고, 에이서는 소형 데스크톱 콘셉트 제품을 공개했으며, 6개 OEM 업체가 10월에 제품을 출시할 예정입니다. NVIDIA의 RTX Spark 웹페이지에는 노트북 라인업으로 ASUS ProArt P16, Dell XPS 16, HP OmniBook X 14, Microsoft Surface Laptop Ultra, MSI Prestige N16 Flip AI+가, 데스크톱 라인업으로는 에이서, ASUS, Dell, Gigabyte, HP, Lenovo, MSI 제품이 포함되어 있습니다.
사양표는 NVIDIA가 6월에 공개한 내용과 동일합니다. 노트북은 최대 6,144코어 Blackwell RTX GPU, 20코어 Grace CPU, 최대 128GB의 통합 LPDDR5X 메모리를 45W~80W의 전력 소비량으로 제공하며, 데스크톱은 5,120개의 CUDA 코어, 18개의 CPU 코어, 64GB 메모리를 140W의 전력 소비량으로 제공합니다. 두 제품 모두 최대 1페타플롭의 FP4 AI 성능을 제공하며 PCIe Gen5, HDMI 2.1b, 그리고 3개의 DisplayPort 2.1b 출력을 지원합니다. 게임 분야에서는 Electronic Arts, Embark, Ubisoft, KRAFTON, NetEase, Riot Games, Xbox 등이 플랫폼용 게임을 출시할 예정이라고 NVIDIA는 밝혔습니다. CyberLink는 출시와 동시에 TensorRT-RTX와 FP8을 사용하여 RTX Spark에 최적화된 PhotoDirector 365용 AI PC 모드를 제공할 예정입니다.
PC에 상주하는 에이전트
이 글의 소프트웨어 부분은 에이전트를 로컬에서 실행하는 데 중점을 두고 있습니다. NVIDIA는 에이전트가 "운영체제 수준의 제어 하에 안전하게 백그라운드에서 실행될 수 있도록" 하는 새로운 Windows 에이전트 프레임워크를 소개하고, Microsoft 및 OpenClaw(GitHub에서 380,000만 개 이상의 별을 받은 최대 규모의 AI 프로젝트)와 협력하여 24GB 이상의 VRAM을 탑재한 RTX GPU에서 OpenClaw Windows 앱 설정을 간소화했습니다. Nous Research의 Hermes Agent는 이제 Windows에서 원클릭으로 로컬 모델을 설정할 수 있으며, Linux 지원도 곧 제공될 예정입니다. Perplexity의 Portable Computer는 현재 24GB 이상의 RTX GPU를 탑재한 Linux에서 실행되며, Windows 지원은 "곧 제공될 예정"입니다. NVIDIA는 이 세 가지 솔루션 모두에서 클라우드 크레딧을 사용하지 않고 로컬 머신에서 완벽한 워크플로우를 구현할 수 있다는 점을 강조합니다.
PAIR, 더 빨라진 llama.cpp 및 vLLM, 그리고 새로운 모델들이 추가되었습니다.
NVIDIA PAIR(Personal AI Router)는 로컬 네트워크에서 호환되는 PC를 검색하고 독립적인 추론 요청을 용량이 있는 시스템으로 라우팅하는 무료 오픈 소스 도구입니다. LLM-D의 홈랩 버전이라고 생각하시면 됩니다. Ollama 및 LM Studio와 호환되며, 지원하는 하드웨어 목록은 매우 광범위합니다. GeForce RTX 20 시리즈 이상, Turing 아키텍처부터 RTX PRO 워크스테이션 GPU, DGX Spark, 그리고 Apple M4 이상 Mac까지 지원합니다. 현재 Windows, macOS, Linux용 베타 버전이 그래픽 인터페이스와 터미널 인터페이스를 모두 제공하며 출시되어 있습니다.
NVIDIA는 커널 최적화 및 향상된 투기적 디코딩을 통해 GeForce RTX 5090 에서 llama.cpp 처리량이 최대 1.9배 향상되었고 , RTX PRO 6000 Blackwell에서는 vLLM 성능이 1.2배, 2노드 DGX Spark 클러스터에서는 최대 1.4배 향상되었다고 주장합니다. 이러한 성능 향상은 모두 LM Studio와 Ollama에 반영됩니다. 이번 모델 업데이트에는 RTX PC, RTX PRO 워크스테이션, DGX Spark 및 Jetson에 최적화된 300억 개 파라미터 모델인 Nemotron 3.5 Lightning, Z.ai의 GLM-5.3-Flash 멀티모달 MoE, Qwen3.8-Flash-Next 및 Qwen3.8-27B, 비디오 생성용 LTX 2.5 및 MiniMax-H3, 코딩 및 에이전트 작업용 Meta의 300억 개 파라미터 Muse Glimmer 등이 포함됩니다. 또한 NVIDIA에 따르면 DeepSeek v4 Flash는 2,840억 개의 파라미터와 130억 개의 활성 파라미터를 가진 MoE이며, 두 개의 Spark 클러스터 또는 DGX Station에서 실행됩니다.
fwupd를 계속 주시하겠습니다. DGX Spark용 Windows 설치 경로가 열리면, 저희 테스트 벤치에 있는 Halo 옆에 있는 Spark를 가장 먼저 테스트해 볼 예정입니다.




아마존