StorageReview.com

NVIDIA DGX Rubin NVL8은 x86 기반 AI 추론을 위한 호스트 CPU 옵션으로 Intel Xeon 6을 지원합니다.

AI  ◇  기업

NVIDIA GTC 2026 에서 인텔은 자사의 제온 6 프로세서가 NVIDIA DGX Rubin NVL8 시스템의 호스트 CPU로 사용될 것이라고 발표했습니다. 이번 선정은 NVIDIA의 GPU 플랫폼에서 제온 프로세서의 활용 범위를 넓히고, 대규모 GPU 가속 AI 인프라 구축에 있어 제온 프로세서의 중요성을 강조합니다. AI 워크로드가 대규모 실시간 추론으로 전환됨에 따라 호스트 CPU는 시스템 수준의 확장성과 아키텍처의 연속성을 위한 핵심 요소로 남을 것입니다.

인텔 제온 6 DGX 루빈 NVL8

NVIDIA HGX NVL8(Vera 지원), Xeon 6(DGX NVL8 지원)

인공지능 추론에서 호스트 CPU의 진화하는 역할

대규모 모델 학습에서 실시간 에이전트형 AI 및 추론 시스템으로의 전환이 가속화되면서 호스트 CPU의 중요성이 더욱 커졌습니다. 이러한 환경에서 CPU는 더 이상 보조 구성 요소가 아니라 오케스트레이션, 메모리 접근 및 모델 보안을 관장하는 핵심 엔진이 되었습니다. 인텔은 Xeon 6가 이러한 복잡한 GPU 가속 시스템을 관리하는 데 필요한 처리량과 효율성을 제공하는 동시에 기업 고객이 추론 확장을 위해 사용하는 광범위한 x86 소프트웨어 생태계와의 호환성을 유지하도록 설계되었다고 밝혔습니다.

추론 성능은 이제 단순히 GPU 처리량만으로 결정되는 것이 아니라 CPU 중심의 시스템 오케스트레이션에 의해 좌우되는 추세입니다. 호스트 CPU는 메모리 관리 및 워크로드 스케줄링과 같은 핵심 기능을 관리함으로써 클러스터의 전반적인 효율성과 총 소유 비용에 직접적인 영향을 미칩니다. Xeon 6는 운영 연속성과 안정성을 보장함으로써 데이터 센터, 클라우드 및 엣지 환경 전반에 걸쳐 최신 AI 인프라를 구축하는 데 필요한 기반을 제공합니다.

DGX Rubin 시스템에서 Xeon 6의 기술적 이점

Intel Xeon 6 프로세서를 DGX Rubin NVL8 시스템 에 통합함으로써 , DGX B300 시스템을 포함한 현재 NVIDIA Blackwell 기반 플랫폼에 탑재된 Intel Xeon 6776P의 아키텍처 기반을 더욱 강화할 수 있었습니다. 이러한 연속성을 통해 기업들은 기존의 성능 최적화 및 시스템 수준의 전문 지식을 차세대 AI 하드웨어에도 그대로 적용할 수 있습니다. Intel에 따르면, Xeon은 Priority Core Turbo와 같은 기능을 통해 GPU 활용도를 극대화하도록 설계되었으며, 이 기능은 가속기로의 일관된 데이터 흐름을 유지합니다.

Xeon 6는 AI 분야에서 뛰어난 가치를 제공하는 핵심 요소로 메모리 용량과 대역폭을 자랑합니다. 최대 8TB의 시스템 메모리를 지원하여 대규모 모델과 확장 가능한 KV 캐시를 수용할 수 있습니다. 또한, MRDIMM 기술을 통해 세대 간 2.3배 향상된 메모리 대역폭을 제공하여 GPU로의 데이터 전송 속도를 크게 개선했습니다. 여기에 다수의 PCIe 5.0 레인을 통해 여러 AI 가속기와 고속 네트워킹을 지원하는 데 필요한 고대역폭, 저지연 I/O를 제공합니다.

보안 및 기밀 컴퓨팅

AI 추론 규모가 커짐에 따라 민감한 데이터와 독점 모델을 보호하기 위해 엔드투엔드 기밀 컴퓨팅이 필수적이 되었습니다. 인텔 제온 6는 하드웨어 기반 격리 및 인증을 제공하는 인텔 트러스트 도메인 확장(TDX)을 통해 이러한 요구 사항을 충족합니다. 이를 통해 데이터가 시스템을 통과하는 동안 안전하게 보호되어 최신 AI 클러스터를 위한 안전한 기반이 마련됩니다.

CPU에서 GPU로 이어지는 데이터 경로 전반에 걸쳐 보안이 더욱 강화되었습니다. 암호화된 바운스 버퍼와 같은 기능은 전체 처리 파이프라인에서 기밀 컴퓨팅을 가능하게 하여 AI 데이터와 모델을 사용 중에 안전하게 보호합니다. 이러한 하드웨어 기반의 격리는 미션 크리티컬 환경의 무결성을 유지하고 이기종 추론 워크로드에서 지적 재산을 보호하는 데 매우 중요합니다.

생태계 통합 및 효율성

Intel Xeon 6는 NVIDIA Dynamo와의 새로운 호환성을 포함하여 AI 소프트웨어 스택 전반에 걸쳐 최적화된 지원을 제공합니다. 이를 통해 CPU와 GPU 모두에서 더욱 효율적인 이기종 추론이 가능해지고 리소스 할당이 개선됩니다. 전력 효율에 중점을 둔 이 플랫폼은 기업이 최신 AI 클러스터의 전력 밀도를 관리하고 효과적인 오케스트레이션 및 스케줄링에 필요한 단일 스레드 성능을 희생하지 않고도 장기적인 총소유비용(TCO)을 절감할 수 있도록 지원합니다.

Intel Xeon 6는 GPU 가속 시스템의 오케스트레이션을 제공하여 추론 워크로드가 복잡해지더라도 데이터 이동이 원활하고 효율적으로 유지되도록 보장합니다. 검증된 안정성, 성숙한 소프트웨어 지원 및 고급 I/O 기능의 조합은 Xeon을 현대 AI 인프라의 핵심으로 자리매김하게 하며, 안전하고 확장 가능한 AI 솔루션을 전 세계적으로 배포할 수 있도록 지원합니다.

StorageReview에 참여

뉴스레터 | 유튜브 | 팟캐스트 ( 아이튠즈 / 스포티파이) | 인스타그램 | 트위터 | 틱톡 | RSS 피드

라일 스미스

라일은 StorageReview의 작가로, 일반 사용자 및 기업 IT 관련 다양한 주제를 다루고 있습니다.