Microsoft hat die allgemeine Verfügbarkeit von GPT-6 Astra in Microsoft Foundry auf Azure bekanntgegeben. Dieses innovative Modell wurde entwickelt, um generative KI in Unternehmen von interaktiven Chat-Oberflächen hin zu autonomen, agentenbasierten Workflows zu transformieren und mehrstufige Planung, fundierte Entscheidungsunterstützung sowie die anwendungsübergreifende Ausführung von Tools zu ermöglichen. OpenAI bezeichnet Astra als sein bisher am besten abgestimmtes Modell, und Microsoft gibt an, dass es für die effiziente Verarbeitung komplexer Aufgaben konzipiert ist.
Diese Version konzentriert sich auf die Behebung von Implementierungshindernissen im Zusammenhang mit grundlegenden Betriebsabläufen wie Identitätsmanagement, sicherer Netzwerktechnik, Compliance und Governance. Durch die direkte Integration von GPT-6 Astra in Microsoft Foundry können IT-Teams in Unternehmen agentenbasierte Pipelines konfigurieren und bereitstellen und gleichzeitig die Kontrolle über die Unternehmensgrenzen ihrer Cloud-Infrastruktur aufrechterhalten.
Mehrstufiges Schließen und Ausführen von Anwendungen
GPT-6 Astra ist darauf ausgelegt, offene Zielsetzungen zu bearbeiten, indem es Optionen bewertet, strukturierte Pläne erstellt, Umsetzungs- und Handlungsalternativen abwägt und neue Parameter dynamisch in den Arbeitsablauf integriert. Das Modell generiert strukturierte Dokumente wie technische Berichte, Analysetabellen und Präsentationen, die mit bestehenden Unternehmensvorlagen und Geschäftsstandards für die menschliche Überprüfung kompatibel sind.
Ein zentrales architektonisches Merkmal des Modells ist seine Fähigkeit zur Computernutzung, die es ihm ermöglicht, Softwareschnittstellen im Auftrag eines Benutzers zu bedienen. Astra kann visuelle Informationen auf dem Bildschirm analysieren und freigegebene Benutzerschnittstellen manipulieren, wodurch es auch in älteren Anwendungen und Tools navigieren kann, die keine dedizierten REST-APIs besitzen. Wichtige Einsatzszenarien sind:
Softwareentwicklungsteams können das Modell nutzen, um gemeldete Fehler zu reproduzieren, die Ursachen in verschiedenen Code-Repositories zu ermitteln, Lösungsvorschläge zu generieren und Pull Requests zur Entwicklerprüfung vorzubereiten. Im Bereich Business Intelligence automatisiert Astra die Erstellung und iterative Optimierung von Power BI-Dashboards. Darüber hinaus unterstützt die Engine automatisierte Datensatzaktualisierungen, die Formularverarbeitung und durchgängige Schnittstellentests für Unternehmenssoftware-Suiten.
Governance-, Sicherheits- und Eindämmungsmaßnahmen
Da Computernutzung und autonomes Handeln besondere Sicherheitsherausforderungen mit sich bringen, integriert Microsoft Foundry Sicherheitsvorkehrungen rund um Astra. Workflows können mit bereichsbezogenen Anmeldeinformationen, rollenbasierter Zugriffskontrolle (RBAC) und erforderlichen Prüfpunkten zur menschlichen Genehmigung erstellt werden, bevor Aktionen mit hoher Auswirkung ausgeführt werden.
Foundry integriert Microsoft Entra für Identitäts- und Zugriffsmanagement, umfassende Verschlüsselung während der Übertragung und im Ruhezustand, privates Netzwerk-Routing, automatisierte Inhaltsfilterung und detaillierte Aktivitätsprotokollierung. Microsoft gibt an, dass Eingabeaufforderungen und Ausgaben innerhalb von Foundry nicht zum Trainieren der Modelle verwendet werden.
Branchenpartner, die die Plattform evaluierten, hoben die ausgewogene Kombination aus Entwicklungsgeschwindigkeit und operativer Disziplin hervor. Replit-CTO Luis Hector Chavez erklärte, Astra gehe mit KI-Tools „über die reine Codegenerierung hinaus und führe zur aktiven Softwareentwicklung“. Anirban Nandi, VP für Daten und KI bei Albertsons Companies, sagte, Azure OpenAI auf Microsoft Foundry biete seinen Teams „genau diese Balance aus Geschwindigkeit und Kontrolle“ mit konsistenter Sicherheit, Governance und operativen Kontrollmechanismen bei gleichzeitiger Skalierung.
Bereitstellungsoptionen und Verfügbarkeit
| Einsatz | Kontextlänge | Eingang | Zwischengespeicherte Eingabe | Zwischengespeicherte Schreibvorgänge | Ausgang |
|---|---|---|---|---|---|
| Standard Global (USD $/Million Token) | |||||
| Standard Global | Kurzer Kontext | $10.00 | $1.00 | $12.50 | $50.00 |
| Standard Global | Langer Kontext | $20.00 | $2.00 | $25.00 | $75.00 |
| Standard Data Zone (US) (USD $/Million Token) | |||||
| Standarddatenzone (USA) | Kurzer Kontext | $11.00 | $1.10 | $13.75 | $55.00 |
| Standarddatenzone (USA) | Langer Kontext | $22.00 | $2.20 | $27.50 | $82.50 |
| Die Preise für den bereitgestellten Durchsatz variieren je nach Bereitstellungstyp. Der bereitgestellte Durchsatz in der US-Datenzone ist 10 % teurer als der globale bereitgestellte Durchsatz. Aktuelle Preise und Bedingungen finden Sie auf der Azure OpenAI-Preisseite. | |||||
GPT-6 Astra ist ab sofort weltweit und in der US-Datenzone mit zwei verschiedenen Infrastruktur-Bereitstellungsstufen verfügbar. Die Standard-Bereitstellungsstufe bietet verbrauchsbasierte, nutzungsabhängige Bereitstellung, die sich für variable Unternehmensanforderungen eignet. Für Workloads, die deterministische Latenzwerte und dedizierte Rechenkapazität erfordern, bietet die Bereitstellungsstufe „Provisioned Throughput“ einen garantierten Modellverarbeitungsdurchsatz. Microsoft hat die Inferenzkapazität von Azure mit eigenen Maia 200-Beschleunigern sowie Hardware von NVIDIA und AMD erweitert. Hinsichtlich der Infrastrukturpreise gilt für die Bereitstellungsstufe „Provisioned Throughput“ in der US-Datenzone ein Aufschlag von 10 Prozent gegenüber den Standardpreisen für die globale Bereitstellungsstufe.




Amazon