A Microsoft anunciou a disponibilidade geral do GPT-6 Astra no Microsoft Foundry, no Azure. O modelo de vanguarda foi projetado para fazer a transição da IA generativa empresarial de interfaces de bate-papo interativas para fluxos de trabalho autônomos e orientados a agentes, fornecendo planejamento em várias etapas, suporte à decisão deliberada e execução de ferramentas entre aplicativos. A OpenAI considera o Astra seu modelo mais alinhado até o momento, e a Microsoft afirma que ele foi projetado para eficiência máxima em tarefas complexas.
Esta versão concentra-se em resolver os problemas de implementação relacionados a fundamentos operacionais, como gerenciamento de identidade, redes seguras, conformidade e governança. Ao integrar o GPT-6 Astra diretamente ao Microsoft Foundry, as equipes de TI corporativas podem configurar e implementar pipelines de agentes, mantendo o controle dos limites da infraestrutura de nuvem.
Raciocínio em Múltiplas Etapas e Execução de Aplicativos
O GPT-6 Astra foi projetado para lidar com objetivos abertos, avaliando opções, criando planos estruturados, ponderando as vantagens e desvantagens da execução e incorporando dinamicamente novos parâmetros à medida que as tarefas progridem. O modelo gera artefatos estruturados, incluindo relatórios técnicos, planilhas de análise e apresentações de slides, que se alinham com modelos corporativos e padrões de negócios preexistentes para verificação humana.
Uma característica arquitetônica central é a capacidade do modelo de usar computadores, o que lhe permite operar interfaces de software em nome do usuário. O Astra pode analisar informações visuais na tela e manipular interfaces de usuário aprovadas, permitindo-lhe navegar em aplicativos e ferramentas legados que não possuem APIs REST dedicadas. Os principais cenários de implantação incluem:
As equipes de engenharia de software podem usar o modelo para reproduzir defeitos relatados, rastrear as causas raiz em repositórios de código, gerar correções propostas e preparar solicitações de pull para revisão dos desenvolvedores. Para inteligência de negócios, o Astra automatiza a construção e o refinamento iterativo de painéis do Power BI. Em operações mais amplas, o mecanismo oferece suporte a atualizações automatizadas de registros, processamento de formulários e testes de interface de ponta a ponta em suítes de software corporativas.
Governança, Segurança e Controles de Contenção
Como o uso de computadores e a atuação autônoma apresentam desafios de segurança exclusivos, o Microsoft Foundry integra medidas de contenção em torno do Astra. Os fluxos de trabalho podem ser construídos com credenciais específicas, controle de acesso baseado em funções (RBAC) e pontos de verificação que exigem aprovação humana antes da execução de ações de alto impacto.
O Foundry integra o modelo com o gerenciamento de identidade e acesso do Microsoft Entra, criptografia abrangente em trânsito e em repouso, roteamento de rede privada, filtragem automática de conteúdo e registro completo de atividades. A Microsoft afirma que os prompts e as saídas dentro do Foundry não são usados para treinar os modelos.
Parceiros da indústria que avaliaram a plataforma destacaram o equilíbrio entre velocidade de desenvolvimento e disciplina operacional. Luis Hector Chavez, CTO da Replit, afirmou que a Astra leva as ferramentas de IA “além da geração de código, para a criação ativa de software”. Anirban Nandi, vice-presidente de Dados e IA da Albertsons Companies, disse que o Azure OpenAI no Microsoft Foundry oferece às suas equipes “esse equilíbrio entre velocidade e controle”, com segurança, governança e controles operacionais consistentes à medida que escalam.
Opções de Implantação e Disponibilidade
| desenvolvimento | Comprimento do contexto | Entrada | Entrada em cache | Gravações em cache | saída |
|---|---|---|---|---|---|
| Standard Global (USD $/milhão de tokens) | |||||
| Padrão Global | Breve contexto | $10.00 | $1.00 | $12.50 | $50.00 |
| Padrão Global | Contexto longo | $20.00 | $2.00 | $25.00 | $75.00 |
| Zona de Dados Padrão (EUA) (USD $/milhão de tokens) | |||||
| Zona de Dados Padrão (EUA) | Breve contexto | $11.00 | $1.10 | $13.75 | $55.00 |
| Zona de Dados Padrão (EUA) | Contexto longo | $22.00 | $2.20 | $27.50 | $82.50 |
| O preço do Provisioned Throughput varia de acordo com o tipo de implantação. O Provisioned Throughput da Zona de Dados dos EUA tem um acréscimo de 10% em relação ao Provisioned Throughput Global. Para consultar as taxas e condições atuais, acesse a página de preços do Azure OpenAI. | |||||
O GPT-6 Astra está disponível imediatamente em todas as regiões geográficas, incluindo as Zonas de Dados Globais e dos EUA, com dois níveis distintos de implantação de infraestrutura. O nível de implantação Padrão oferece provisionamento baseado no consumo, com pagamento conforme o uso, adequado para demandas empresariais variáveis. Para cargas de trabalho que exigem linhas de base de latência determinísticas e capacidade computacional dedicada, o nível de Taxa de Transferência Provisionada oferece taxa de transferência garantida para processamento de modelos. A Microsoft tem expandido a capacidade de inferência do Azure com seus próprios aceleradores Maia 200, juntamente com hardware da NVIDIA e da AMD. Em termos de preços de infraestrutura, a Taxa de Transferência Provisionada para a Zona de Dados dos EUA tem um acréscimo de 10% em relação às taxas padrão da Taxa de Transferência Provisionada Global.




Amazon