ArmazenamentoReview.com

OpenAI GPT-6 Astra atinge a disponibilidade geral no Microsoft Foundry: uso de computadores, execução agética e preços entre US$ 10 e US$ 75 por milhão de tokens.

AI  ◇  Empreendimento

A Microsoft anunciou a disponibilidade geral do GPT-6 Astra no Microsoft Foundry, no Azure. O modelo de vanguarda foi projetado para fazer a transição da IA ​​generativa empresarial de interfaces de bate-papo interativas para fluxos de trabalho autônomos e orientados a agentes, fornecendo planejamento em várias etapas, suporte à decisão deliberada e execução de ferramentas entre aplicativos. A OpenAI considera o Astra seu modelo mais alinhado até o momento, e a Microsoft afirma que ele foi projetado para eficiência máxima em tarefas complexas.

Imagem promocional do GPT-6 Astra, criada pela Microsoft Foundry: uma galáxia espiral de estrelas sobre fundo preto com as inscrições GPT e Astra.

Esta versão concentra-se em resolver os problemas de implementação relacionados a fundamentos operacionais, como gerenciamento de identidade, redes seguras, conformidade e governança. Ao integrar o GPT-6 Astra diretamente ao Microsoft Foundry, as equipes de TI corporativas podem configurar e implementar pipelines de agentes, mantendo o controle dos limites da infraestrutura de nuvem.

Raciocínio em Múltiplas Etapas e Execução de Aplicativos

O GPT-6 Astra foi projetado para lidar com objetivos abertos, avaliando opções, criando planos estruturados, ponderando as vantagens e desvantagens da execução e incorporando dinamicamente novos parâmetros à medida que as tarefas progridem. O modelo gera artefatos estruturados, incluindo relatórios técnicos, planilhas de análise e apresentações de slides, que se alinham com modelos corporativos e padrões de negócios preexistentes para verificação humana.

Uma característica arquitetônica central é a capacidade do modelo de usar computadores, o que lhe permite operar interfaces de software em nome do usuário. O Astra pode analisar informações visuais na tela e manipular interfaces de usuário aprovadas, permitindo-lhe navegar em aplicativos e ferramentas legados que não possuem APIs REST dedicadas. Os principais cenários de implantação incluem:

As equipes de engenharia de software podem usar o modelo para reproduzir defeitos relatados, rastrear as causas raiz em repositórios de código, gerar correções propostas e preparar solicitações de pull para revisão dos desenvolvedores. Para inteligência de negócios, o Astra automatiza a construção e o refinamento iterativo de painéis do Power BI. Em operações mais amplas, o mecanismo oferece suporte a atualizações automatizadas de registros, processamento de formulários e testes de interface de ponta a ponta em suítes de software corporativas.

Governança, Segurança e Controles de Contenção

Como o uso de computadores e a atuação autônoma apresentam desafios de segurança exclusivos, o Microsoft Foundry integra medidas de contenção em torno do Astra. Os fluxos de trabalho podem ser construídos com credenciais específicas, controle de acesso baseado em funções (RBAC) e pontos de verificação que exigem aprovação humana antes da execução de ações de alto impacto.

O Foundry integra o modelo com o gerenciamento de identidade e acesso do Microsoft Entra, criptografia abrangente em trânsito e em repouso, roteamento de rede privada, filtragem automática de conteúdo e registro completo de atividades. A Microsoft afirma que os prompts e as saídas dentro do Foundry não são usados ​​para treinar os modelos.

Parceiros da indústria que avaliaram a plataforma destacaram o equilíbrio entre velocidade de desenvolvimento e disciplina operacional. Luis Hector Chavez, CTO da Replit, afirmou que a Astra leva as ferramentas de IA “além da geração de código, para a criação ativa de software”. Anirban Nandi, vice-presidente de Dados e IA da Albertsons Companies, disse que o Azure OpenAI no Microsoft Foundry oferece às suas equipes “esse equilíbrio entre velocidade e controle”, com segurança, governança e controles operacionais consistentes à medida que escalam.

Opções de Implantação e Disponibilidade

desenvolvimento Comprimento do contexto Entrada Entrada em cache Gravações em cache saída
Standard Global (USD $/milhão de tokens)
Padrão Global Breve contexto $10.00 $1.00 $12.50 $50.00
Padrão Global Contexto longo $20.00 $2.00 $25.00 $75.00
Zona de Dados Padrão (EUA) (USD $/milhão de tokens)
Zona de Dados Padrão (EUA) Breve contexto $11.00 $1.10 $13.75 $55.00
Zona de Dados Padrão (EUA) Contexto longo $22.00 $2.20 $27.50 $82.50
O preço do Provisioned Throughput varia de acordo com o tipo de implantação. O Provisioned Throughput da Zona de Dados dos EUA tem um acréscimo de 10% em relação ao Provisioned Throughput Global. Para consultar as taxas e condições atuais, acesse a página de preços do Azure OpenAI.

 

O GPT-6 Astra está disponível imediatamente em todas as regiões geográficas, incluindo as Zonas de Dados Globais e dos EUA, com dois níveis distintos de implantação de infraestrutura. O nível de implantação Padrão oferece provisionamento baseado no consumo, com pagamento conforme o uso, adequado para demandas empresariais variáveis. Para cargas de trabalho que exigem linhas de base de latência determinísticas e capacidade computacional dedicada, o nível de Taxa de Transferência Provisionada oferece taxa de transferência garantida para processamento de modelos. A Microsoft tem expandido a capacidade de inferência do Azure com seus próprios aceleradores Maia 200, juntamente com hardware da NVIDIA e da AMD. Em termos de preços de infraestrutura, a Taxa de Transferência Provisionada para a Zona de Dados dos EUA tem um acréscimo de 10% em relação às taxas padrão da Taxa de Transferência Provisionada Global.

Envolva-se com a StorageReview

Newsletter | YouTube | Podcast iTunes / Spotify | Instagram | Twitter | TikTok | Feed RSS

Haroldo Fritts

Estou na indústria de tecnologia desde que a IBM criou a Selectric. Minha formação, porém, é escrever. Então decidi sair do negócio de pré-vendas e voltar às minhas raízes, escrevendo um pouco, mas ainda envolvido com tecnologia.