Qumulo 發布了 Cloud AI Accelerator,這是一種旨在透過消除資料傳輸瓶頸來提高企業 AI 基礎架構效率的全新架構。此平台無需複製或暫存,即可跨區域、雲端和混合環境即時向 GPU 資源提供分散式資料集。
此次發布旨在解決企業人工智慧基礎架構中一個眾所周知的效率低下問題。 Qumulo 引述 Cast AI 的《2026 年 Kubernetes 優化現況報告》指出,企業平均 GPU 利用率僅 5% 左右,其餘 95% 的加速運算資源處於閒置狀態,因為資料必須經過暫存、複製和遷移才能啟動工作負載。 Qumulo 執行長 Doug Gourlay 在公告中闡述了這個問題:“我們接觸的每一家企業都關注 GPU 的可用性,但可用性只是問題的一半。更深層的問題是利用率,而罪魁禍首是數據引力。”
重新思考人工智慧工作負載的資料放置方式
傳統的AI基礎設施方案將儲存與GPU叢集置於同一位置,通常使用與運算緊密耦合的高效能快閃記憶體系統。雖然這種模式在訓練或推理期間非常有效,但它無法處理資料準備期間的空閒時間。此外,由於企業需要在不同環境中複製資料集以使其靠近運算資源,這種模式也會造成儲存孤島的碎片化。
Qumulo 的方法透過將資料位置與計算位置解耦來改變模型。雲端 AI 加速器無需將資料移至 GPU,而是讓 GPU 直接存取資料。這是透過分散式資料架構實現的,該架構提供對資料集的一致、即時訪問,而無需考慮資料集的實體位置。
該公司將這項功能稱為實現“GPU流動性”,允許根據可用運算能力而非資料位置限制來調度工作負載。實際上,這使得企業無需預先部署資料即可跨多個雲端或區域使用GPU資源。
架構:資料架構和快取層
Cloud AI Accelerator 是 Qumulo 三款先前獨立發布的產品的整合。 Cloud Native Qumulo (CNQ) 是 Qumulo 的檔案系統,可原生運行於 AWS、Azure、Google Cloud 和 Oracle Cloud Infrastructure 等雲端平台。 Cloud Data Fabric (CDF) 於 2025 年 2 月發布,提供中央檔案和物件儲存庫,並在邊緣部署一致性快取。 NeuralCache 於 2025 年 4 月添加到 CDF 中,將機器學習應用於預測性讀寫緩存,Qumulo 聲稱它可以將 GPU 資料加載時間縮短高達 64%。 Cloud AI Accelerator 本身於 2025 年 11 月首次亮相;5 月 26 日的版本新增了與 Microsoft AI Foundry、AWS Bedrock 和 Google Vertex AI 的直接連接,正式確立了「GPU 流動性」定位,並將該產品與 Cisco 集成,以支援混合部署。
資料路徑以區塊級方式運行,從來源站點(本地叢集、雲端區域、跨區域副本或 CNQ S3 支援的儲存)進入加速器的 CPU DRAM 快取,然後直接傳送到 GPU。該架構在本地、邊緣和多雲環境中維護單一資料來源,並避免了批量複製,從而降低了儲存開銷和同步複雜性。
該設計還支援與託管式 AI 服務整合。企業無需將資料複製到 Microsoft AI Foundry、AWS Bedrock 和 Google Vertex AI 等環境中,即可將現有資料集直接連接到這些平台。
營運影響:減少空閒時間和複雜性
其主要營運優勢在於消除了資料準備延遲。在許多人工智慧工作流程中,資料準備可能需要數天甚至數週時間,這會延緩模型訓練並降低GPU的有效利用率。透過實現對資料集的即時訪問,雲端人工智慧加速器允許工作負載在運算資源可用時立即啟動。
這也減少了維護多個儲存環境的需求。企業無需為每個 GPU 叢集或雲端區域建立單獨的資料孤島,而是可以基於單一的邏輯資料集開展工作。這簡化了資料管理,並減少了基礎設施的蔓延。
從成本角度來看,該模型旨在降低GPU的閒置功耗。透過消除將資料預先載入到GPU連接儲存設備的需求,企業可以減少GPU等待資料的時間,進而提高加速運算的整體投資報酬率。
思科整合以實現混合人工智慧基礎設施
思科是Qumulo混合部署方案的聯合市場合作夥伴,其中思科UCS提供本地運算資源,思科網路和安全解決方案則負責資料架構的建置。 Qumulo和思科共同將此方案定位為能夠快速適應GPU可用性變化的基礎設施,他們認為這正是企業級GPU流動性得以實現的關鍵所在。
這種配對在兩方面都至關重要。它為 Qumulo 提供了一條進入 Cisco UCS 環境的可靠途徑,同時也為 Cisco 提供了一種儲存解決方案,以滿足混合 AI 客戶的需求,這些客戶希望資料保留在本地,而運算資源則可在超大規模資料中心進行擴展。高吞吐量、低延遲的網路是這裡的關鍵,因為資料存取依賴於站點間一致的傳輸。
可用性和部署模型
Qumulo Cloud AI Accelerator 現已在 AWS、Microsoft Azure、Google Cloud 和 Oracle Cloud Infrastructure 上推出,並支援在 Cisco UCS 環境中進行混合部署。 Qumulo 和 Cisco 將於 5 月 31 日至 6 月 4 日在拉斯維加斯舉行的 Cisco Live 2026 大會上亮相,展位號為 4018,屆時將展示雙方的聯合產品。
此次發布反映了人工智慧基礎設施設計轉向以數據為中心的架構的趨勢。隨著加速運算能力持續超越支撐其運作的基礎設施,提高利用率的關鍵在於減少GPU等待資料的時間。 Qumulo認為,與其為每個GPU叢集增加快閃記憶體,不如讓資料集普遍可存取(而非僅限於行動裝置),這才是更持久有效的方案。




Amazon