Rackspace Technology 和 AMD 簽署了一份諒解備忘錄,為一項專注於為受監管組織和主權工作負載提供企業級 AI 基礎設施的多年戰略合作夥伴關係建立了框架。
該協議的核心是一個擬建的企業級人工智慧雲端平台,專為關鍵任務型人工智慧部署而設計,其核心要求包括安全性、治理、合規性和營運責任。該平台將結合AMD Instinct GPU和AMD EPYC CPU,以及Rackspace Technology的託管營運模式,為那些無法依賴通用GPU租賃模式或非託管公共基礎設施來運行生產級人工智慧工作負載的組織打造專用的人工智慧基礎設施堆疊。
Rackspace Technology 和 AMD 都強調,許多企業正在將人工智慧從實驗階段推進到生產階段,但面臨著巨大的營運挑戰,包括基礎設施整合、安全、資料治理、效能管理和問責制。目前的模式通常要求企業按小時租用 GPU 容量,同時也要承擔大部分的基礎設施和營運責任。
兩家公司都提出了一種託管方案,即將專用的 AMD 運算資源嵌入到受監管的企業營運模式中。在該框架下,Rackspace 將負責營運整個技術棧,涵蓋從晶片和加速運算到推理、代理和生產支援的各個環節。
隨著企業將人工智慧應用於生產環境,Rackspace Technology 和 AMD 認為信任和問責制至關重要。在受監管的環境中,治理必須從一開始就融入基礎建設,而不是事後添加。 AMD 的角色將專注於透過其 Instinct GPU 加速器和 EPYC 處理器提供運算基礎架構,以支援在私有和受監管環境中對效能、效率和可擴展性有較高要求的人工智慧工作負載。
堆疊計畫具備四項功能。
此次合作旨在幫助 Rackspace 完成一個圍繞四個整合功能構建的精選企業級 AI 堆疊:企業級 AI 雲端、企業級推理引擎、推理即服務和裸機 AMD Instinct。
建議的企業級人工智慧雲端將是一個完全託管的私人和混合人工智慧環境,基於 AMD Instinct GPU、AMD EPYC CPU 和 Rackspace 的受控營運模式建構。 Rackspace 將為需要自主權、合規性和營運責任的企業組裝、整合和營運此技術堆疊。
企業推理引擎將為企業提供一個上下文感知執行環境,該環境能夠跨查詢傳遞領域知識、會話歷史記錄和公司特定上下文資訊。其目標是幫助人工智慧代理和大型語言模型在生產環境中提供更一致的結果。 Rackspace 將負責服務等級承諾,包括可用性、可擴展性和效能,同時允許企業使用其專有數據,並確保可審計性和成本可控性。
推理即服務將為 AMD Instinct GPU 提供專用的託管容量,以及用於推理和微調的開發者工具。客戶將自備模型和工程團隊,而 Rackspace 將負責裸機 AMD Instinct 容量、硬體級支援、維運管理以及效能服務目標。
裸機 AMD Instinct 將為需要實體隔離、可預測效能和直接硬體存取的客戶提供專用的高效能運算,以滿足嚴苛的訓練和推理工作負載需求。
單一營運商負責受監管的人工智慧基礎設施
這些規劃中的功能將為企業提供貫穿人工智慧基礎設施生命週期的單一責任營運商。 Rackspace 負責管理整個堆疊,從裸機運算和開發者工具到推理運行時間和受控雲端基礎設施。
目標是使每項工作負載都與相應的自主權、合規性、效能和監管等級相符。該諒解備忘錄為 Rackspace 和 AMD 提供了一個框架,以便雙方在受監管企業、自主工作負載和生產 AI 環境(需要在每個層面都進行問責)的託管企業級 AI 基礎設施方面開展合作。




Amazon