Microsoft a annoncé la disponibilité générale de GPT-6 Astra au sein de Microsoft Foundry sur Azure. Ce modèle novateur est conçu pour faire évoluer l'IA générative d'entreprise, des interfaces de chat interactives vers des flux de travail autonomes, offrant une planification en plusieurs étapes, une aide à la décision ciblée et l'exécution d'outils inter-applications. OpenAI considère Astra comme son modèle le plus abouti à ce jour, et Microsoft affirme qu'il est conçu pour une efficacité optimale sur les tâches complexes.
Cette version vise à simplifier le déploiement des solutions aux problèmes opérationnels fondamentaux tels que la gestion des identités, la sécurité des réseaux, la conformité et la gouvernance. En intégrant GPT-6 Astra directement à Microsoft Foundry, les équipes informatiques des entreprises peuvent configurer et déployer des pipelines d'agents tout en conservant le contrôle du périmètre d'entreprise sur leur infrastructure cloud.
Raisonnement multi-étapes et exécution d'applications
GPT-6 Astra est conçu pour gérer des objectifs ouverts en évaluant les options, en élaborant des plans structurés, en pondérant les compromis liés à l'exécution et en intégrant dynamiquement de nouveaux paramètres au fur et à mesure de l'avancement des tâches. Le modèle génère des documents structurés, tels que des rapports techniques, des feuilles de calcul d'analyse et des présentations, conformes aux modèles d'entreprise et aux normes métiers existants, pour une vérification humaine.
L'une des caractéristiques architecturales centrales du modèle est sa capacité à interagir avec l'ordinateur, ce qui lui permet de gérer les interfaces logicielles pour le compte de l'utilisateur. Astra peut analyser les informations visuelles affichées à l'écran et manipuler les interfaces utilisateur approuvées, ce qui lui permet de naviguer dans les applications et outils existants dépourvus d'API REST dédiées. Principaux scénarios de déploiement :
Les équipes de développement logiciel peuvent utiliser ce modèle pour reproduire les anomalies signalées, identifier leurs causes profondes dans les différents dépôts de code, générer des correctifs et préparer des demandes de fusion pour validation par les développeurs. Pour la veille stratégique, Astra automatise la création et l'amélioration itérative des tableaux de bord Power BI. Au niveau opérationnel, le moteur prend en charge la mise à jour automatisée des enregistrements, le traitement des formulaires et les tests d'interface de bout en bout pour les suites logicielles d'entreprise.
Gouvernance, sécurité et contrôles de confinement
L'utilisation des ordinateurs et l'autonomie des agents posant des défis de sécurité uniques, Microsoft Foundry intègre des mesures de confinement autour d'Astra. Les flux de travail peuvent être construits avec des identifiants limités, un contrôle d'accès basé sur les rôles (RBAC) et des points de contrôle d'approbation humaine requis avant l'exécution d'actions à fort impact.
Foundry intègre le modèle à la gestion des identités et des accès Microsoft Entra, au chiffrement généralisé des données en transit et au repos, au routage des réseaux privés, au filtrage automatique du contenu et à la journalisation complète des activités. Microsoft précise que les invites et les résultats de Foundry ne sont pas utilisés pour l'entraînement des modèles.
Les partenaires industriels qui ont évalué la plateforme ont souligné l'équilibre entre rapidité de développement et rigueur opérationnelle. Luis Hector Chavez, directeur technique de Replit, a déclaré qu'Astra fait évoluer les outils d'IA « au-delà de la simple génération de code pour aboutir à la création active de logiciels ». Anirban Nandi, vice-président des données et de l'IA chez Albertsons Companies, a affirmé qu'Azure OpenAI sur Microsoft Foundry offre à ses équipes « cet équilibre entre rapidité et contrôle », avec une sécurité, une gouvernance et des contrôles opérationnels cohérents, même à grande échelle.
Options de déploiement et disponibilité
| Déploiement | Longueur du contexte | Entrée | Entrée mise en cache | Écritures mises en cache | Sortie |
|---|---|---|---|---|---|
| Standard Global (USD $/million de jetons) | |||||
| Norme mondiale | Contexte court | $10.00 | $1.00 | $12.50 | $50.00 |
| Norme mondiale | Contexte long | $20.00 | $2.00 | $25.00 | $75.00 |
| Zone de données standard (États-Unis) (USD $/million de jetons) | |||||
| Zone de données standard (États-Unis) | Contexte court | $11.00 | $1.10 | $13.75 | $55.00 |
| Zone de données standard (États-Unis) | Contexte long | $22.00 | $2.20 | $27.50 | $82.50 |
| Le prix du débit provisionné varie selon le type de déploiement. Le débit provisionné pour la zone de données américaine est majoré de 10 % par rapport au débit provisionné global. Pour connaître les tarifs et conditions en vigueur, consultez la page de tarification d'Azure OpenAI. | |||||
GPT-6 Astra est disponible immédiatement dans les zones géographiques Global et US Data Zone, avec deux niveaux de déploiement d'infrastructure distincts. Le niveau Standard offre une facturation à l'usage, adaptée aux besoins variables des entreprises. Pour les charges de travail exigeant une latence de base déterministe et une capacité de calcul dédiée, le niveau Provisioned Throughput garantit le débit de traitement des modèles. Microsoft a étendu la capacité d'inférence d'Azure grâce à ses accélérateurs Maia 200, en complément des matériels NVIDIA et AMD. Concernant la tarification de l'infrastructure, le niveau Provisioned Throughput pour la zone US Data Zone est majoré de 10 % par rapport au niveau Global Provisioned Throughput standard.




Amazon