StorageReview.com

OpenAI GPT-6 Astra accède à l'analyse générale sur Microsoft Foundry : utilisation de l'ordinateur, exécution autonome et un prix de 10 à 75 $ par million de jetons

AI  ◇  Entreprise

Microsoft a annoncé la disponibilité générale de GPT-6 Astra au sein de Microsoft Foundry sur Azure. Ce modèle novateur est conçu pour faire évoluer l'IA générative d'entreprise, des interfaces de chat interactives vers des flux de travail autonomes, offrant une planification en plusieurs étapes, une aide à la décision ciblée et l'exécution d'outils inter-applications. OpenAI considère Astra comme son modèle le plus abouti à ce jour, et Microsoft affirme qu'il est conçu pour une efficacité optimale sur les tâches complexes.

Visuel clé de GPT-6 Astra de Microsoft Foundry : une galaxie spirale d’étoiles sur fond noir avec les inscriptions GPT et Astra.

Cette version vise à simplifier le déploiement des solutions aux problèmes opérationnels fondamentaux tels que la gestion des identités, la sécurité des réseaux, la conformité et la gouvernance. En intégrant GPT-6 Astra directement à Microsoft Foundry, les équipes informatiques des entreprises peuvent configurer et déployer des pipelines d'agents tout en conservant le contrôle du périmètre d'entreprise sur leur infrastructure cloud.

Raisonnement multi-étapes et exécution d'applications

GPT-6 Astra est conçu pour gérer des objectifs ouverts en évaluant les options, en élaborant des plans structurés, en pondérant les compromis liés à l'exécution et en intégrant dynamiquement de nouveaux paramètres au fur et à mesure de l'avancement des tâches. Le modèle génère des documents structurés, tels que des rapports techniques, des feuilles de calcul d'analyse et des présentations, conformes aux modèles d'entreprise et aux normes métiers existants, pour une vérification humaine.

L'une des caractéristiques architecturales centrales du modèle est sa capacité à interagir avec l'ordinateur, ce qui lui permet de gérer les interfaces logicielles pour le compte de l'utilisateur. Astra peut analyser les informations visuelles affichées à l'écran et manipuler les interfaces utilisateur approuvées, ce qui lui permet de naviguer dans les applications et outils existants dépourvus d'API REST dédiées. Principaux scénarios de déploiement :

Les équipes de développement logiciel peuvent utiliser ce modèle pour reproduire les anomalies signalées, identifier leurs causes profondes dans les différents dépôts de code, générer des correctifs et préparer des demandes de fusion pour validation par les développeurs. Pour la veille stratégique, Astra automatise la création et l'amélioration itérative des tableaux de bord Power BI. Au niveau opérationnel, le moteur prend en charge la mise à jour automatisée des enregistrements, le traitement des formulaires et les tests d'interface de bout en bout pour les suites logicielles d'entreprise.

Gouvernance, sécurité et contrôles de confinement

L'utilisation des ordinateurs et l'autonomie des agents posant des défis de sécurité uniques, Microsoft Foundry intègre des mesures de confinement autour d'Astra. Les flux de travail peuvent être construits avec des identifiants limités, un contrôle d'accès basé sur les rôles (RBAC) et des points de contrôle d'approbation humaine requis avant l'exécution d'actions à fort impact.

Foundry intègre le modèle à la gestion des identités et des accès Microsoft Entra, au chiffrement généralisé des données en transit et au repos, au routage des réseaux privés, au filtrage automatique du contenu et à la journalisation complète des activités. Microsoft précise que les invites et les résultats de Foundry ne sont pas utilisés pour l'entraînement des modèles.

Les partenaires industriels qui ont évalué la plateforme ont souligné l'équilibre entre rapidité de développement et rigueur opérationnelle. Luis Hector Chavez, directeur technique de Replit, a déclaré qu'Astra fait évoluer les outils d'IA « au-delà de la simple génération de code pour aboutir à la création active de logiciels ». Anirban Nandi, vice-président des données et de l'IA chez Albertsons Companies, a affirmé qu'Azure OpenAI sur Microsoft Foundry offre à ses équipes « cet équilibre entre rapidité et contrôle », avec une sécurité, une gouvernance et des contrôles opérationnels cohérents, même à grande échelle.

Options de déploiement et disponibilité

Déploiement Longueur du contexte Entrée Entrée mise en cache Écritures mises en cache Sortie
Standard Global (USD $/million de jetons)
Norme mondiale Contexte court $10.00 $1.00 $12.50 $50.00
Norme mondiale Contexte long $20.00 $2.00 $25.00 $75.00
Zone de données standard (États-Unis) (USD $/million de jetons)
Zone de données standard (États-Unis) Contexte court $11.00 $1.10 $13.75 $55.00
Zone de données standard (États-Unis) Contexte long $22.00 $2.20 $27.50 $82.50
Le prix du débit provisionné varie selon le type de déploiement. Le débit provisionné pour la zone de données américaine est majoré de 10 % par rapport au débit provisionné global. Pour connaître les tarifs et conditions en vigueur, consultez la page de tarification d'Azure OpenAI.

 

GPT-6 Astra est disponible immédiatement dans les zones géographiques Global et US Data Zone, avec deux niveaux de déploiement d'infrastructure distincts. Le niveau Standard offre une facturation à l'usage, adaptée aux besoins variables des entreprises. Pour les charges de travail exigeant une latence de base déterministe et une capacité de calcul dédiée, le niveau Provisioned Throughput garantit le débit de traitement des modèles. Microsoft a étendu la capacité d'inférence d'Azure grâce à ses accélérateurs Maia 200, en complément des matériels NVIDIA et AMD. Concernant la tarification de l'infrastructure, le niveau Provisioned Throughput pour la zone US Data Zone est majoré de 10 % par rapport au niveau Global Provisioned Throughput standard.

S'engager avec StorageReview

Newsletter | YouTube | Podcast iTunes / Spotify | Instagram | Twitter | TikTok | Flux RSS

Harold Fritt

Je suis dans l'industrie de la technologie depuis qu'IBM a créé Selectric. Ma formation, cependant, est l'écriture. J'ai donc décidé de sortir de l'avant-vente et de revenir à mes racines, en écrivant un peu mais en restant impliqué dans la technologie.