Marvell은 FMS 2026에서 하이퍼스케일러와 클라우드 제공업체가 컴퓨팅 성능과 독립적으로 메모리를 확장할 수 있도록 지원하는 새로운 메모리 인프라 기술을 선보였습니다. 이 포트폴리오는 서버 수준의 AI 스토리지, 랙 규모의 CXL 메모리 확장 및 풀링, 그리고 포드 수준의 광학 공유 메모리를 포함합니다.
이번 릴리스는 에이전트형 AI 추론으로 인해 증가하는 메모리 요구 사항을 해결하기 위한 것입니다. 더 큰 모델, 더 긴 컨텍스트 윈도우, 그리고 확장되는 키-값 캐시는 메모리 용량, 대역폭 및 연결성에 대한 요구 사항을 높이고 있습니다. 기존의 서버 연결형 아키텍처에서는 이러한 요구 사항으로 인해 프로세서 지연 및 비효율적인 데이터 이동이 발생할 수 있습니다.
메모리 분리(Memory disaggregation)는 컴퓨팅 리소스와 독립적으로 메모리를 확장, 풀링 및 공유할 수 있도록 합니다. 마벨(Marvell)은 자사의 접근 방식이 메모리 접근성을 개선하고, 지연 시간과 데이터 이동을 줄이며, 프로세서 활용률을 높이도록 설계되었다고 밝혔습니다. 목표는 기존 데이터 센터의 전력 및 공간 제약 내에서 더 많은 토큰을 생성하는 것입니다.
Marvell의 맞춤형 클라우드 솔루션 부문 총괄 부사장인 Will Chu는 AI 인프라가 개별 서버에서 컴퓨팅, 메모리 및 연결성을 결합한 통합 시스템으로 진화하고 있다고 말했습니다. 그는 또한 리소스 활용도를 높이고 AI 배포의 비용 및 전력 요구 사항을 관리하기 위해서는 더욱 독립적인 메모리 확장이 필요하다고 덧붙였습니다.
서버 수준 AI 스토리지
Marvell Bravera SC6 PCIe 6.0 SSD 컨트롤러는 고대역폭 메모리와 SSD 스토리지 간에 KV 캐시 데이터 의 빈번한 이동이 필요한 AI 추론 워크로드를 지원하도록 설계되었습니다 . Marvell은 이 컨트롤러가 이전 모델인 Bravera SC5 PCIe 5.0보다 두 배 빠른 속도를 제공한다고 밝혔습니다.
SC6는 캐시 전송 성능을 향상시켜 AI, 클라우드 및 엔터프라이즈 워크로드의 스토리지 효율성을 높이도록 설계되었습니다. 또한 쓰기 증폭률을 낮추고 NAND 수명을 연장하는 것을 목표로 합니다. 다양한 공급업체의 NAND를 지원하여 하이퍼스케일러는 SSD를 조달하고 배포할 때 더 큰 유연성을 확보할 수 있습니다.
브라베라 SC6는 2026년 4분기에 샘플링을 시작할 것으로 예상됩니다.
랙 스케일 메모리 확장 및 풀링
Marvell의 Structera X 메모리 확장 솔루션은 기존 Structera CXL 플랫폼을 기반으로 구축되었으며 , 하이퍼스케일러가 더욱 크고 유연한 메모리 풀을 통해 메모리 집약적인 AI 워크로드를 처리할 수 있도록 설계되었습니다. 하이퍼스케일러 파트너와 공동 개발한 이 플랫폼은 서버 간 메모리 확장 및 리소스 공유를 지원합니다.
Structera X는 기존 메모리 투자 활용도를 향상시키면서 더 큰 모델, 더 긴 컨텍스트 윈도우, 그리고 증가하는 KV 캐시 요구 사항을 수용하도록 설계되었습니다. 메모리 용량을 개별 서버 구성과 분리함으로써, 이 플랫폼은 더욱 유연한 CXL 기반 확장 및 풀링 아키텍처를 지원할 수 있습니다.
Marvell은 이러한 접근 방식이 총 소유 비용을 절감하면서 인프라 활용도와 운영 효율성을 향상시키도록 설계되었다고 밝혔습니다. 또한 이는 향후 CXL 메모리 풀링 및 공유 시스템을 위한 기반을 마련합니다.
포드 레벨 광학 공유 메모리
Marvell의 Photonic Fabric 구성 요소에는 광 메모리 모듈, 네트워크 인터페이스 컨트롤러 및 여러 랙에 걸쳐 공유 메모리 아키텍처를 위한 칩렛이 포함됩니다. 이 시스템은 최대 50미터 거리까지 XPU와 랙을 연결하도록 설계되었습니다.
이 아키텍처는 높은 대역폭과 낮은 지연 시간으로 최대 32TB의 웜 KV 캐시 오프로드를 지원합니다. AI 시스템은 스토리지에서 KV 캐시 데이터를 가져오는 대신 공유 광 메모리 계층에서 데이터에 액세스할 수 있습니다. Marvell은 이를 통해 추론 처리량을 향상시키고, 더 큰 모델과 더 긴 컨텍스트 창을 지원하며, 토큰 효율성을 높일 수 있다고 밝혔습니다.
이 회사는 기존 데이터 센터 공간 및 전력 제약 조건 내에서 토큰 처리량이 최대 2~3배 향상될 것으로 예상합니다. 실제 성능은 시스템 구성, 워크로드 특성 및 주변 AI 인프라 구현에 따라 달라질 수 있습니다.
Marvell은 FMS 2026 부스 #805에서 자사 포트폴리오를 선보입니다. 이번 발표는 추론 메모리 관련 소식이 쏟아지는 주간에 이루어졌으며, NVIDIA의 스토리지 넥스트 및 SCADA 전략 과도 맥락을 같이합니다 . Marvell은 해당 아키텍처에 100억 IOPS를 지원하는 PCIe Gen7 SSD가 필요하며, Bravera SC6와 같은 컨트롤러가 GPU 기반 스몰 블록 액세스용 드라이브로 가는 디딤돌이 될 것이라고 강조해 왔습니다.




아마존