A IBM e a AMD firmaram uma colaboração plurianual para fornecer infraestrutura avançada de IA à Zyphra, uma empresa de pesquisa e desenvolvimento de IA de código aberto sediada em São Francisco. De acordo com o acordo, a IBM fornecerá um cluster dedicado e de grande porte de GPUs AMD Instinct MI300X na IBM Cloud para o treinamento de modelos multimodais de ponta, posicionando a implementação entre os ambientes de treinamento de IA generativa mais ambiciosos disponíveis atualmente.
A colaboração impulsiona o impulso
Um dos aspectos mais importantes desta colaboração é a introdução de escalabilidade empresarial na infraestrutura de GPUs em nuvem pública. Esta iniciativa representa o primeiro cluster de treinamento dedicado em larga escala na IBM Cloud, utilizando GPUs AMD Instinct MI300X. A inclusão de placas de rede AMD Pensando Pollara 400 AI e unidades de processamento de dados (DPUs) Pensando Ortano agrega ainda mais recursos, criando uma estrutura de rede otimizada para cargas de trabalho de treinamento de alto desempenho, com aceleração do plano de dados e rede leste-oeste eficiente. Para administradores de TI e diretores de tecnologia (CTOs), essa configuração destaca um caminho para executar trabalhos de treinamento de IA com uso intensivo de GPU como um serviço de nuvem gerenciado, sem sacrificar a escalabilidade, a orquestração e os SLAs esperados em implantações empresariais.
Igualmente significativo é o impulso por trás do ecossistema aberto. A Zyphra não está construindo isoladamente, mas sim operando com uma filosofia de código aberto e ciência aberta. A empresa está utilizando sua infraestrutura para conduzir pesquisas em arquiteturas neurais, sistemas de memória de longo prazo e técnicas de aprendizado contínuo. Essas oportunidades não são apenas benéficas para a IA em geral, mas também proporcionam às empresas maior transparência, reprodutibilidade e clareza de licenciamento do que os modelos tradicionais de caixa-preta. A dimensão de código aberto pode criar oportunidades posteriores para organizações que avaliam estratégias de investimento em IA, mas desconfiam de soluções proprietárias e opacas.
Outro fator-chave é o alinhamento da cadeia de suprimentos e do roteiro. Garantir a capacidade da GPU em escala tornou-se um dos gargalos mais significativos no desenvolvimento de IA. O envolvimento da Zyphra com a IBM e a AMD incluiu colaboração antecipada em roteiros de produtos e cronogramas de entrega, permitindo acesso confiável a aceleradores e cronogramas rápidos de implantação. O cluster inicial entrou em operação em setembro, com um plano deliberado de expansão da capacidade em 2026. Para os líderes de tecnologia empresarial, isso sinaliza uma abordagem prospectiva para o planejamento do roteiro da GPU, que equilibra a experimentação de curto prazo com a capacidade de escalar para ciclos de treinamento de modelos mais complexos ao longo do tempo.
O Programa Zyphra
A Zyphra garantiu recentemente uma rodada de financiamento Série A com avaliação de US$ 1 bilhão. Este é um indicador inicial da confiança dos investidores em sua missão. Com esse capital, a empresa pretende estabelecer um laboratório líder de pesquisa em "superinteligência", fundamentado nos princípios de código aberto e ciência aberta. A nova infraestrutura na IBM Cloud é fundamental para esse esforço. Impulsionados pelos aceleradores AMD Instinct, os modelos da Zyphra abrangem modalidades de linguagem, visão e áudio, convergindo para um pipeline que sustenta o Maia, seu superagente de uso geral. O resultado pretendido é uma plataforma projetada para ampliar o conhecimento dos trabalhadores das empresas, automatizando fluxos de trabalho, exibindo informações relevantes e aumentando a produtividade geral.
O acordo técnico com a IBM e a AMD garante que a Zyphra possa expandir sua presença computacional à medida que os requisitos de treinamento se intensificam. Em vez de tratar a infraestrutura como um ativo estático, a colaboração enfatiza o escalonamento contínuo, alinhando o fornecimento de GPU, a orquestração de nuvem e a rede avançada em uma solução integrada. Essa compatibilidade futura é um diferencial crítico para empresas de IA que buscam treinar modelos maiores e mais sofisticados, incorrendo em custos previsíveis e mantendo acesso confiável a esses modelos.
Destaques da Arquitetura
O centro da implantação é a computação. Em escala, as GPUs AMD Instinct MI300X contam com uma arquitetura de memória de alto desempenho e alta largura de banda, projetada para lidar com os grandes fluxos de dados necessários no treinamento de IA multimodal. Cada cluster de GPU é otimizado para cargas de trabalho densas de ponto flutuante e ajustado às métricas de desempenho por watt que as empresas cada vez mais consideram ao avaliar custos operacionais.
A rede e o plano de dados também são centrais para a história. Ao utilizar placas de rede AMD Pensando Pollara 400 AI e DPUs Ortano, o ambiente da Zyphra pode distribuir cargas de trabalho de forma mais eficiente entre milhares de GPUs, eliminando os gargalos tradicionalmente associados ao tráfego leste-oeste em grandes clusters. Os offloads de hardware aceleram a taxa de transferência da rede, permitindo o gerenciamento de políticas, a telemetria e a aplicação de segurança, garantindo que as cargas de trabalho tenham um desempenho previsível mesmo sob alta demanda.
Na camada de substrato, a IBM Cloud fornece ao ambiente de orquestração recursos de nível empresarial para segurança, governança e conformidade. Esses recursos permitem que a Zyphra navegue em um cenário em que a IA corporativa precisa atender a requisitos cada vez mais rigorosos em relação à soberania de dados, auditabilidade e continuidade de serviços. Na prática, a IBM Cloud complementa a pilha de computação e rede da AMD com os controles operacionais que os CTOs esperam em implantações com qualidade de produção.
Do ponto de vista da Zyphra, este engajamento representa a primeira implementação bem-sucedida de uma pilha totalmente integrada, desde aceleradores de computação até malha de rede, executada inteiramente na IBM Cloud com silício AMD. A liderança da Zyphra vê essa infraestrutura como um trampolim para a criação de modelos de fronteira em um contexto aberto e favorável às empresas, com a ambição maior de influenciar o desenvolvimento e a aplicação da superinteligência.
Krithik Puthalath, CEO e presidente do conselho da Zyphra, destacou que a colaboração com a AMD e a IBM Cloud marca a primeira integração bem-sucedida de uma plataforma de treinamento full-stack, abrangendo desde computação até redes, na IBM Cloud. A Zyphra liderará o desenvolvimento de modelos de ponta usando silício AMD, com o objetivo de promover a superinteligência empresarial e de código aberto.
Alan Peacock, gerente geral da IBM Cloud, enfatizou a importância de escalar cargas de trabalho de IA de forma rápida e eficiente para alcançar melhor ROI tanto para empresas estabelecidas quanto para empresas emergentes. Ele destaca o apoio da IBM ao crescimento estratégico da Zyphra, colaborando com a AMD para desenvolver uma infraestrutura de IA escalável e econômica que acelera o treinamento de modelos.
A AMD, por sua vez, posiciona a colaboração como um marco no design de infraestrutura de IA. Philip Guido, Vice-Presidente Executivo e Diretor Comercial, aponta a integração do ecossistema de nuvem empresarial consolidado da IBM com a tecnologia de aceleração de computação da AMD como um modelo para o setor. Para a AMD, o acordo destaca sua liderança não apenas em computação de alto desempenho, mas também na viabilização de resultados de IA no mundo real por meio de sistemas capazes de realizar trabalho multimodal e eficiente em termos de inferência em escala.
Modelo de Operação
A primeira fase desta implantação entrou em operação no início de setembro, tornando a Zyphra uma das primeiras organizações a acessar um cluster AMD Instinct MI300X de grande capacidade na IBM Cloud. Essa disponibilidade imediata atende às demandas de curto prazo para o treinamento de grandes modelos multimodais, permitindo que a Zyphra comece a iterar rapidamente.
Olhando para o futuro, a colaboração prepara o cenário para a expansão dos recursos de computação e rede em 2026. Essa implementação em fases reconhece a realidade do escalonamento das cargas de trabalho de IA: os requisitos de treinamento continuarão a crescer em conjunto com o tamanho do conjunto de dados, a complexidade do modelo e a cadência de experimentação. Os CTOs que monitoram a evolução da IA multimodal verão a expansão de 2026 como um compromisso estratégico com o planejamento de capacidade, garantindo que a Zyphra, a IBM e a AMD permaneçam alinhadas a longo prazo.
Estratégia
O compromisso com a Zyphra se baseia em um alinhamento estratégico mais amplo entre a IBM e a AMD. No ano passado, as duas empresas começaram a implementar os aceleradores AMD Instinct MI300X como serviço na IBM Cloud, destacando seus compromissos com desempenho confiável, eficiência energética e entrega em escala empresarial. Ao migrar de uma implementação orientada a serviços para um cluster dedicado de larga escala, o programa Zyphra ilustra uma progressão em direção a soluções para clientes mais personalizadas e com maior capacidade.
Paralelamente, a IBM e a AMD estão expandindo sua colaboração para arquiteturas de próxima geração, como a supercomputação centrada em quantum. A IBM traz liderança global em sistemas e algoritmos quânticos, enquanto a AMD contribui com sua expertise em computação de alto desempenho e aceleração de IA. Este roteiro combinado foi projetado para expandir os limites do que é possível na computação em larga escala, reforçando ainda mais a visão de longo prazo de uma infraestrutura empresarial integrada que abrange as GPUs atuais e os processadores quânticos do futuro.
Resultados para TI e CTOs
A eficiência do treinamento e o custo total de propriedade serão as principais considerações. As empresas devem monitorar de perto a eficácia do MI300X e do Pensando em escalar grandes cargas de trabalho multimodais, especialmente em métricas importantes como tokens por segundo por GPU, desempenho de interconexão e previsibilidade de custo por tarefa.
Os padrões de integração também merecem atenção. A implantação do Zyphra demonstrará como o preparo de dados, a criação de pontos de verificação, a observabilidade e os repositórios de recursos se integram ao IBM Cloud. Para organizações que avaliam seus roteiros de IA, esses padrões podem servir como arquiteturas de referência.
Segurança e governança também são fundamentais. Com modelos padrão frequentemente abrangendo bilhões de parâmetros e petabytes de dados, os líderes de TI precisarão avaliar como NICs e DPUs programáveis contribuem para o isolamento de segurança, a telemetria e a aplicação granular de políticas dentro de clusters com múltiplas GPUs.
A flexibilidade híbrida e multicloud representa outra dimensão. Embora o ambiente da Zyphra atualmente seja executado na IBM Cloud, as opções arquitetônicas, como NICs, DPUs e camadas de orquestração otimizadas, são projetadas para acomodar ambientes híbridos. Para as empresas, isso oferece um modelo potencial para manter o ROI por meio da portabilidade da carga de trabalho, da localidade dos dados e da resiliência em múltiplas nuvens.
Por fim, os tomadores de decisão de TI devem ficar atentos aos lançamentos de código aberto da Zyphra. Como uma empresa comprometida com a ciência aberta, espera-se que a Zyphra compartilhe receitas de treinamento, modelos e benchmarks. Isso proporcionará às empresas oportunidades de avaliação para o ajuste fino de modelos específicos de domínio, a construção de pipelines de geração aumentada de recuperação (RAG) ou a avaliação da eficiência de abordagens de IA multimodal em cargas de trabalho de produção.
Principal Takeaway
Para tomadores de decisões técnicas em TI corporativa, a implantação do Zyphra representa mais do que a conquista de um único cliente. Ela serve como uma implementação de referência de como o fornecimento de GPU, a transferência de rede e a infraestrutura de nuvem corporativa podem se alinhar para criar um pipeline sustentável para o treinamento de modelos de IA de ponta. Com a IBM Cloud cuidando da orquestração e o silício AMD fornecendo computação densa e rede avançada, a colaboração redefine as expectativas de desempenho, custo e confiabilidade em treinamentos em larga escala.




Amazon