HP의 ZGX Fury AI 스테이션이 주문 가능해졌으며, HP는 이와 함께 Red Hat 및 NVIDIA와의 협력을 통해 Red Hat AI Factory with NVIDIA를 ZGX Fury에 탑재했다고 발표했습니다. ZGX Fury는 NVIDIA의 DGX 스테이션 디자인을 HP만의 방식으로 재해석한 제품으로, 748GB의 통합 메모리와 최대 20페타플롭스의 FP4 연산 성능을 제공하는 GB300 Grace Blackwell Ultra 데스크톱 슈퍼칩을 기반으로 제작되었습니다. HP는 이 제품을 개인용 워크스테이션보다는 부서, 공장, 지사 등에서 데이터 센터 없이도 운영할 수 있는 공유 추론 시스템으로 포지셔닝하고 있습니다. 현재 연구실에서 제품을 테스트 중이며, 자세한 리뷰는 곧 공개될 예정입니다. 지금까지 HP가 밝힌 내용은 다음과 같습니다.
HP ZGX Fury 하드웨어 사양: GB300 슈퍼칩 1개, 748GB 메모리, 타워형 또는 5U 케이스
이 시스템의 핵심은 MSI XpertStation WS300 에서 테스트했던 것과 동일한 실리콘입니다 . 7.1TB/s의 대역폭을 제공하는 252GB HBM3e 메모리를 탑재한 Blackwell Ultra GPU와 NVLink-C2C를 통해 연결된 496GB LPDDR5X 메모리를 갖춘 72코어 Grace CPU로 구성되어 있습니다. HP의 사양표는 플랫폼 발표에서 생략되었던 세부 정보를 제공합니다. CPU 메모리는 396GB/s의 대역폭을 제공하는 128GB SOCAMM 모듈 4개로 이루어져 있으며, Grace CPU는 소켓 방식이 아닌 호스트 프로세서 모듈에 납땜되어 있습니다. 두 개의 메모리 풀을 합치면 총 748GB의 일관성 있는 공간이 확보되어 GPU가 CPU 메모리에 직접 접근할 수 있습니다. 이것이 바로 단일 시스템에서 수조 개의 파라미터를 가진 추론과 1천억 개의 파라미터를 가진 모델의 미세 조정이 가능한 이유입니다. HP는 이러한 모델 크기에 대해 FP4 양자화를 사용한다고 명시했습니다.
Grace CPU에는 PCIe 5.0을 지원하는 두 개의 M.2 슬롯이 내장되어 있으며, 이 슬롯에는 소프트웨어 RAID 1 미러링 구성으로 운영 체제가 저장됩니다. ConnectX-8 SuperNIC 내부의 PCIe 스위치에는 두 개의 M.2 슬롯이 추가로 제공되어 RAID 0 데이터 볼륨으로 사용되며, 구매 시 2TB 또는 4TB의 자체 암호화 NVMe 스토리지를 선택할 수 있습니다.
네트워킹은 400Gbps 속도의 QSFP112 포트 2개를 갖춘 ConnectX-8로 구성되어 두 대의 ZGX Fury 시스템을 연결할 수 있으며, 호스트용 10GbE RJ-45 포트와 BMC용 별도의 1GbE RJ-45, Mini-DP, micro-USB 포트가 제공됩니다. 나머지 I/O는 일반적인 워크스테이션 수준으로, 전면에 USB-A 포트 2개와 USB-C 포트 2개, 후면에 USB 포트 4개, 오디오 잭, 켄싱턴 슬롯, 전원 코드용 C20 입력 단자가 있습니다. GB300 자체에는 디스플레이 출력이 없으며, HP는 모니터 구동을 위한 NVIDIA RTX PRO GPU를 옵션으로 제공하여 Blackwell Ultra GPU가 추론 전용으로 사용되도록 합니다. 섀시는 타워형이며 5U 랙 슬롯용 레일도 함께 제공됩니다. HP는 최적화된 공기 흐름을 갖춘 수랭식 냉각 시스템을 사용하는데, 이는 MSI 제품에서 확인된 것과 동일한 방식으로, 1,400W 정격 수랭 루프를 통해 최대 부하 시 GPU 온도를 71°C로 유지했습니다.
HP ZGX Fury 소프트웨어: Ubuntu, Z Runtime 및 Red Hat 인증
HP는 ZGX Fury에 Ubuntu 24.04 LTS와 NVIDIA의 AI 개발자 도구, NVIDIA 승인 파트너 BIOS 및 BMC 펌웨어, 그리고 두 가지 HP 전용 레이어를 탑재하여 제공합니다. HP Z Runtime은 모델을 로컬에서 가져오고, 실행하고, 관리하는 데 사용되는 사전 설치된 명령줄 도구이며, HP Z Toolkit은 오픈 소스 프레임워크, MLflow 실험 추적, 그리고 ZGX 시스템 간의 검색 및 동기화 기능을 갖춘 Ollama 테스트 기능을 추가합니다. 이러한 구성은 팀이 ZGX Nano 에서 프로토타입을 제작한 후, 더 많은 메모리, 처리량 또는 동시 접속 사용자가 필요할 때 동일한 워크플로를 ZGX Fury로 이전할 수 있도록 설계되었습니다.
새로운 파트너는 레드햇입니다. HP는 ZGX Fury가 레드햇 엔터프라이즈 리눅스 인증을 획득하고 레드햇 에코시스템 카탈로그에 등재되었다고 밝혔습니다. 두 회사는 HP가 '개방형 엔터프라이즈급 AI 플랫폼'이라고 부르는 것을 개발 중이며, 이 플랫폼은 ZGX Fury에서 NVIDIA AI 팩토리를 실행합니다. NVIDIA AI 팩토리는 하이브리드 클라우드 환경에 모델, 에이전트 및 애플리케이션을 배포하기 위해 RHEL, OpenShift, 그리고 NVIDIA AI 엔터프라이즈가 포함된 레드햇 AI 엔터프라이즈를 패키징한 레드햇 솔루션입니다. HP는 ZGX Fury에서 이러한 조합을 통해 환경 설정 시간과 배포 위험을 줄이고, 최적화된 CUDA 라이브러리, 스케줄링 및 멀티 GPU 워크로드 오케스트레이션을 통해 GPU 활용도를 향상시키며, 개발자가 기존 워크플로를 변경하지 않고도 컴퓨팅 작업을 플랫폼으로 오프로드할 수 있도록 지원한다고 설명했습니다. 또한 이 플랫폼은 워크로드 격리 및 거버넌스를 통해 하나의 시스템에서 여러 AI 워크로드를 실행하도록 설계되어, HP가 데스크톱 환경에서 IT 부서에서 관리할 수 있는 엣지 인프라로 전환하는 데 기여할 것입니다.
HP의 첨단 컴퓨팅 및 솔루션 부문 수석 부사장 겸 사장인 짐 노팅엄은 “인공지능의 미래는 사람들이 일하고, 기계가 작동하며, 중요한 의사 결정이 이루어지는 곳으로 더욱 가까워지고 있습니다.”라고 말했습니다. “HP는 레드햇, NVIDIA와 협력하여 개방형 엔터프라이즈급 추론 플랫폼을 통해 기업용 AI를 데이터 센터에서 엣지까지 확장하고 있습니다. 이 플랫폼은 고객이 로컬 AI 팩토리를 구축할 때 더 큰 선택권, 제어권, 그리고 일관성을 제공하도록 설계되었습니다.” NVIDIA의 엔터프라이즈 플랫폼 및 솔루션 부문 부사장인 크리스 매리어트 역시 같은 맥락에서 “기업이 요구하는 보안, 확장성, 그리고 일관성을 유지하면서 강력한 AI를 로컬에서 실행하는 것”이라고 설명했습니다.
ZGX Fury는 현재 HP를 통해 주문 가능하며, 가격은 발표에서 공개되지 않았습니다. Red Hat AI Factory 통합은 출시 제품이 아닌 계획된 솔루션이며, HP는 고객이 실제 운영 환경에 적용하기 전에 HP 기기의 샌드박스 환경에서 평가해 볼 수 있을 것이라고 밝혔습니다. 시기, 자격 요건 및 지원 구성은 추후 공개될 예정입니다. 경쟁 구도가 빠르게 윤곽을 드러내고 있습니다. MSI의 WS300은 동일한 슈퍼칩을 탑재하고 있으며, AMD의 Threadripper Halo Station은 동일한 워크로드를 목표로 하고 있습니다. 저희 ZGX Fury 리뷰에서는 MSI 제품에 적용했던 것과 동일한 모델과 테스트를 HP 제품에도 적용할 예정입니다.




아마존