微軟宣佈在 Azure 上的 Microsoft Foundry 平台正式推出 GPT-6 Astra 模型。這款前沿模型旨在推動企業級生成式人工智慧從互動式聊天介面向自主代理工作流程轉型,提供多步驟規劃、深思熟慮的決策支援以及跨應用工具執行。 OpenAI 稱 Astra 是迄今為止與其理念契合度最高的模型,而微軟則表示,Astra 的設計目標是在複雜任務中實現極高的效率。
此次發布旨在解決圍繞身分識別管理、安全網路、合規性和治理等基礎營運環節的部署難題。透過將 GPT-6 Astra 直接整合到 Microsoft Foundry 中,企業 IT 團隊可以配置和部署代理管道,同時維護其雲端基礎架構中的企業邊界控制。
多步驟推理和應用程式執行
GPT-6 Astra 旨在透過評估各種方案、建立結構化計劃、權衡執行利弊,並在任務進行過程中動態地整合新參數,來處理開放式目標。此模型產生的結構化文檔,包括技術報告、分析表格和演示文稿,均符合預先存在的企業範本和業務標準,可供手動審核。
該模型的核心架構特徵是其電腦使用能力,使其能夠代表使用者操作軟體介面。 Astra 可以解析螢幕上的視覺資訊並操控已核准的使用者介面,從而能夠存取缺乏專用 REST API 的舊版應用程式和工具。主要部署場景包括:
軟體工程團隊可以使用該模型重現已報告的缺陷、跨程式碼庫追蹤根本原因、產生建議的修復方案,並準備供開發人員審核的拉取請求。在商業智慧方面,Astra 可自動建置和迭代優化 Power BI 儀表板。在更廣泛的營運領域,該引擎支援跨企業軟體套件的自動記錄更新、表單處理和端到端介面測試。
治理、安全和遏制控制
由於電腦使用和自主操作帶來了獨特的安全挑戰,Microsoft Foundry 在 Astra 周圍整合了隔離安全措施。工作流程可以建構為具有範圍限定的憑證、基於角色的存取控制 (RBAC) 以及在執行高影響操作之前所需的人工審批檢查點。
Foundry 將模型與 Microsoft Entra 身分和存取管理、傳輸中和靜態資料的全面加密、專用網路路由、自動內容過濾以及全面的活動日誌記錄相結合。微軟聲明,Foundry 內部的提示和輸出不會用於訓練模型。
評估該平台的產業合作夥伴強調了其在開發速度和維運規範之間的平衡。 Replit 技術長 Luis Hector Chavez 表示,Astra 將人工智慧工具的邊界從程式碼生成延伸到「主動軟體創建」。 Albertsons Companies 資料與人工智慧副總裁 Anirban Nandi 表示,Azure OpenAI on Microsoft Foundry 為他的團隊提供了“速度與控制的平衡”,並在擴展過程中保持了一致的安全性、治理和維運控制。
部署選項和可用性
| 部署 | 上下文長度 | 輸入 | 快取輸入 | 快取寫入 | 輸出 |
|---|---|---|---|---|---|
| 全球標準(美元/百萬代幣) | |||||
| 標準全球 | 簡短情境 | $10.00 | $1.00 | $12.50 | $50.00 |
| 標準全球 | 長情境 | $20.00 | $2.00 | $25.00 | $75.00 |
| 標準資料區(美國)(美元/百萬代幣) | |||||
| 標準資料區(美國) | 簡短情境 | $11.00 | $1.10 | $13.75 | $55.00 |
| 標準資料區(美國) | 長情境 | $22.00 | $2.20 | $27.50 | $82.50 |
| 預置吞吐量定價因部署類型而異。美國資料區預置吞吐量的價格比全球預置吞吐量高出 10%。有關目前費率和條款,請參閱 Azure OpenAI 定價頁面。 | |||||
GPT-6 Astra 現已在全球和美國資料區全面上線,並提供兩種不同的基礎架構部署層級。標準部署層級提供按需付費的按需配置方案,適用於企業級的可變需求。對於需要確定性延遲基準和專用運算容量的工作負載,預置吞吐量層級可提供有保障的模型處理吞吐量。微軟一直在利用其自主研發的Maia 200 加速器以及 NVIDIA 和 AMD 的硬體來擴展 Azure 的推理能力。在基礎架構定價方面,美國資料區預置吞吐量層級的價格比全球標準預置吞吐量層級高出 10%。




Amazon