NVIDIA ha presentado un nuevo modelo de negocio para acelerar el despliegue de infraestructura de IA, combinando el reparto de ingresos con el apoyo crediticio para proveedores de servicios en la nube de IA. Anunciada el 1 de julio en una publicación de blog de la que fue coautora la directora financiera, Colette Kress, la iniciativa está diseñada para ampliar el acceso a la computación acelerada para startups de IA, desarrolladores de modelos, empresas, organizaciones de investigación y proveedores regionales de IA, a medida que las cargas de trabajo de inferencia en producción siguen creciendo.
Este anuncio refleja un cambio generalizado en la industria, que pasa de centrarse principalmente en el entrenamiento de grandes modelos de lenguaje a operar servicios de IA en producción. A medida que crece la adopción de la IA, los requisitos de infraestructura se centran cada vez más en las fábricas de IA que generan continuamente tokens de inferencia a gran escala. Estos entornos exigen una infraestructura de GPU de rápida implementación, altas tasas de utilización y arquitecturas multiusuario que puedan soportar una economía de inferencia sostenible.
Las empresas emergentes de IA han tenido dificultades para obtener financiación para la infraestructura de GPU. Los requisitos de capital para implementaciones de IA a gran escala suelen superar la financiación disponible, lo que dificulta que las startups desarrollen la capacidad de procesamiento necesaria para las cargas de trabajo de producción.
El nuevo modelo de NVIDIA aborda este desafío al permitir que los proveedores de servicios en la nube para IA adquieran infraestructura de NVIDIA bajo un marco que combina la participación en los ingresos con el respaldo crediticio. Los proveedores participantes ofrecerán servicios en la nube basados en NVIDIA a empresas nativas de IA, clientes corporativos y proveedores de software independientes (ISV). NVIDIA generará ingresos tanto a través de la venta de infraestructura como mediante una participación en los ingresos de la nube asociados a la capacidad respaldada.
La empresa espera que este enfoque acelere la adopción de su plataforma de IA, al tiempo que crea un flujo de ingresos recurrente basado en el uso y vinculado directamente al consumo de infraestructura.
Para las organizaciones que desarrollan modelos básicos, operan servicios de inferencia, crean agentes de IA o implementan aplicaciones de IA empresariales, este modelo busca reducir el tiempo necesario para obtener recursos informáticos a escala de producción. Los clientes pueden aprovechar la capacidad de la nube de IA existente en lugar de esperar la construcción de nuevos centros de datos, la disponibilidad de energía y la implementación de hardware.
La iniciativa se centra en que los proveedores de nube de IA desarrollen las plataformas NVIDIA DSX AI Factory para dar servicio a cargas de trabajo de IA regionales y empresariales. NVIDIA identificó a Sharon AI y Firmus entre los primeros participantes.
Sharon AI planea implementar hasta 40 000 GPU NVIDIA Grace Blackwell GB300 como parte de la expansión de su infraestructura. Firmus está desarrollando un campus de fábrica de IA DSX en Batam, Indonesia, con planes para ampliar las instalaciones a 360 MW y admitir hasta 170 000 GPU NVIDIA.
NVIDIA también destacó plataformas en la nube nativas de IA, como Baseten, Fireworks AI y Together AI, como ejemplos de organizaciones que impulsan la demanda de computación acelerada bajo demanda. Estos proveedores admiten cargas de trabajo que van desde el entrenamiento y el ajuste fino de modelos hasta la optimización posterior al entrenamiento y la inferencia a gran escala para clientes empresariales y desarrolladores.
En definitiva, esta iniciativa subraya el continuo enfoque de NVIDIA en la expansión de la infraestructura de IA más allá de la venta de hardware, al permitir que los proveedores de servicios en la nube ofrezcan capacidad de GPU a escala de producción a una gama más amplia de desarrolladores de IA y empresas.




Amazon