StorageReview.com

AMD의 Pensando Pollara 400 NIC, AI 네트워킹에 프로그래밍 가능성과 성능 제공

기업  ◇  네트워킹

AMD는 업계 최초의 완전 프로그래밍 가능 AI 네트워크 인터페이스 카드(NIC)인 펜산도 폴라라 400을 출시했습니다. AI 워크로드 가속화를 위해 설계된 이 혁신적인 솔루션은 개발 중인 울트라 이더넷 컨소시엄(UEC) 표준과 호환되며 데이터 센터의 GPU 간 통신을 향상시키도록 최적화되었습니다. 폴라라 400 AI NIC는 AI/ML 워크로드, 생성적 AI, 그리고 대규모 언어 모델을 위한 확장 가능한 고성능 인프라 구축에 있어 획기적인 진전을 보여줍니다.

펜산도 폴라라 400

AI가 발전함에 따라 기업들은 최적의 성능을 제공하고 미래 수요에 적응할 수 있는 유연성을 제공하는 유사한 컴퓨팅 인프라를 개발해야 하는 과제에 직면합니다. 이러한 발전의 핵심 요소는 노드 내 GPU 통신 네트워크를 효율적으로 확장하는 것입니다. 성능 저하 없이 고객의 선택권을 보장하고 총소유비용(TCO)을 절감하려는 AMD의 노력은 Pollara 400 AI NIC에서 여실히 드러납니다. 이 솔루션은 기업들이 개방형 생태계와의 호환성을 유지하면서 미래에 대비한 AI 인프라를 구축할 수 있도록 지원합니다.

고급 네트워킹을 통한 AI 워크로드 가속화

AI 클러스터 성능 극대화는 클라우드 서비스 제공업체, 하이퍼스케일러, 그리고 기업의 최우선 과제입니다. 그러나 많은 조직에서 네트워크가 GPU 활용을 제한하는 병목 현상으로 인식되고 있습니다. 데이터 전송 속도는 필수적이지만, 네트워크가 최신 AI 워크로드의 요구 사항을 충족하도록 최적화되어야만 그 효과를 얻을 수 있습니다.

스펙 세부 정보
최대 대역폭 400Gbps
폼 팩터 반신반신(HHHL)
호스트 인터페이스 PCIe 5.0세대 x16
이더넷 인터페이스 QSFP112(NRZ/PAM4 Serdes)
이더넷 속도 25/50/100/200/400 Gbps
이더넷 구성 최대 4개의 포트를 지원합니다.
1G 400 개
2G 200 개
4G 100 개
4G 50 개
4G 25 개
SMBus를 통한 MCTP

펜산도 폴라라 400 AI NIC는 지능형 로드 밸런싱, 혼잡 관리, 신속한 장애 조치 및 손실 복구 기능을 제공하여 이러한 과제를 해결합니다. 이러한 기능은 네트워킹 및 컴퓨팅 리소스를 최대한 활용하여 가동 시간 증가, 작업 완료 속도 향상, 그리고 규모에 따른 안정성 향상을 보장합니다. AI 워크로드의 복잡성과 규모가 증가함에 따라, 폴라라 400 AI NIC는 병목 현상을 제거하고 AI 인프라의 잠재력을 최대한 활용하는 데 필요한 도구를 제공합니다.

미래에 대비한 프로그래밍 가능 솔루션

Pollara 400 AI NIC는 AMD P4 아키텍처를 기반으로 하며, 완벽하게 프로그래밍 가능한 하드웨어 파이프라인을 통해 탁월한 유연성을 제공합니다. 이러한 프로그래밍 기능을 통해 고객은 UEC 등 새로운 표준에 적응하거나 특정 워크로드에 맞게 설계된 맞춤형 전송 프로토콜을 개발할 수 있습니다. 새로운 기능을 지원하기 위해 차세대 하드웨어가 필요한 기존 하드웨어와 달리, Pollara 400은 하드웨어 업데이트를 기다리지 않고도 AI 인프라를 업그레이드할 수 있도록 지원합니다.

Pollara 400의 주요 기능으로는 RoCEv2, UEC RDMA 및 기타 이더넷 프로토콜과 같은 여러 전송 프로토콜을 지원하여 다양한 워크로드와의 호환성을 보장하는 것이 있습니다. 지능형 패킷 스프레잉, 비순차적 패킷 처리, 선택적 재전송과 같은 고급 기능은 대역폭 활용도를 최적화하고 지연 시간을 줄여 대규모 AI 모델의 학습 및 배포에 필수적입니다. 경로 인식 혼잡 제어 및 신속한 장애 감지 기능은 일시적인 혼잡이나 네트워크 장애 발생 시에도 유선 속도에 가까운 성능을 보장하고 GPU 유휴 시간을 최소화합니다.

오픈 생태계의 장점

AMD의 개방형 생태계 접근 방식은 벤더에 구애받지 않는 호환성을 보장하여 기업이 현재 요구 사항을 충족하는 동시에 향후 요구에 맞춰 확장 및 프로그래밍 가능한 AI 인프라를 구축할 수 있도록 지원합니다. 이러한 전략은 값비싼 셀 기반 대용량 버퍼 스위칭 패브릭의 필요성을 제거하여 자본 지출(CapEx)을 절감하는 동시에 고성능을 보장합니다.

Pensando Pollara 400 AI NIC는 이미 세계 최대 규모의 스케일아웃 데이터 센터에서 검증되었습니다. 클라우드 서비스 제공업체(CSP)들은 프로그래밍 기능, 높은 대역폭, 낮은 지연 시간, 그리고 광범위한 기능 세트의 독보적인 조합을 자랑하는 이 솔루션을 선택했습니다. AMD는 개방형 생태계 내에서 확장 가능한 인프라를 구축함으로써 기업들이 AI 환경의 미래를 보장하는 동시에 즉각적인 성능 이점을 제공할 수 있도록 지원합니다.

AMD 펜산도

StorageReview에 참여

뉴스레터 | 유튜브 | 팟캐스트 ( 아이튠즈 / 스포티파이) | 인스타그램 | 트위터 | 틱톡 | RSS 피드

해롤드 프리츠

저는 IBM이 Selectric을 만든 이후로 기술 산업에 종사해 왔습니다. 하지만 내 배경은 글쓰기입니다. 그래서 저는 프리세일즈 사업에서 벗어나 제 뿌리로 돌아가서 약간의 글을 쓰지만 여전히 기술 분야에 참여하기로 결정했습니다.