À mesure que l’IA passe du développement de modèles à l’inférence en production, la demande de calcul s’accélère et se tourne vers des usines d’IA en fonctionnement continu qui génèrent des jetons à grande échelle. Cette évolution nécessite un accès à un calcul accéléré multi-locataires à grande échelle qui peut être mis en ligne rapidement, rester hautement utilisé et prendre en charge l’économie des services d’IA à l’échelle des jetons.
Les entreprises d’IA émergentes avaient historiquement un accès limité à des infrastructures à forte intensité de capital, avec des engagements même à long terme insuffisants pour débloquer le financement pour les capacités de calcul.
Pour remédier à ce problème, NVIDIA présente un nouveau modèle commercial qui ouvre l’accès aux capacités de calcul à l’écosystème d’IA en pleine croissance regroupant les startups, les concepteurs de modèles, les entreprises, les organismes de recherche et les acteurs régionaux d’IA.
Ce nouveau modèle permet aux Clouds d’IA de mettre à disposition l’infrastructure NVIDIA pour les clients natifs de l’IA, les entreprises et les éditeurs de logiciels indépendants (ISV), grâce à un alignement économique reposant sur un modèle de partage des revenus et de soutien au crédit. Grâce à ce partenariat, les Clouds d’IA commercialiseront des services Cloud optimisés par NVIDIA, qui percevra à la fois le chiffre d’affaires lié à ses produits standard et une part des revenus générés par le Cloud sur la capacité prise en charge. Cette structure accélère l’adoption des plateformes NVIDIA dans le secteur de l’IA native à forte croissance et à forte conviction, et fournit à NVIDIA un flux de revenus récurrent et lié à l’utilisation.
Pour les concepteurs de modèles, les fournisseurs d’inférence, les plateformes d’agents et les entreprises faisant évoluer l’IA, cela peut signifier un accès plus rapide au calcul accéléré Full-Stack sans attendre la sélection du site, l’achat d’énergie, la construction et la mise en service du matériel.
Capacité des usines d’IA de NVIDIA conçue en fonction de la demande
L’initiative prend déjà forme, grâce à des entreprises de Cloud d’IA qui créent des usines d’IA DSX conçues pour servir les clients et les charges de travail dans toutes les régions.
Sharon AI et Firmus font partie des premières entreprises à travailler avec NVIDIA sur ce nouveau modèle économique.
Sharon AI déploie jusqu’à 40 000 GPU NVIDIA Grace Blackwell GB300.
« Cette collaboration stratégique avec NVIDIA marque un moment charnière dans la mission de Sharon AI visant à fournir une infrastructure de calcul d’IA souveraine à grande échelle », a déclaré James Manning, cofondateur et PDG de Sharon AI.
Firmus construit un campus d’usine DSX AI à Batam, en Indonésie. Le campus devrait pouvoir atteindre 360 mégawatts et jusqu’à 170 000 GPU NVIDIA.
« Les entreprises spécialisées dans l’IA native ont besoin d’accéder à une infrastructure de calcul évolutive, économe en énergie et rentable pour être concurrentielles à l’échelle mondiale », déclare Tim Rosenfield, co-PDG de Firmus Technologies. « Firmus AI Cloud crée une usine d’IA alignée sur NVIDIA DSX, ce qui permettra à notre Cloud d’aider davantage de clients à accéder à la puissance de calcul dont ils ont besoin pour créer et faire évoluer l’IA. »
Les solutions d’IA natives telles que Baseten, Fireworks AI et Together AI montrent où se dirige la demande de calcul : elles doivent avoir un accès immédiat à la capacité du Cloud d’IA pour exécuter l’entraînement des modèles, le post-entraînement, le réglage fin et l’inférence agentique à haut volume pour les développeurs, les natifs du numérique et les entreprises qui créent avec l’IA.
Leurs clients ont besoin d’un accès fiable au calcul accéléré de NVIDIA à grande échelle à mesure que l’utilisation augmente, mais ils ont également besoin d’une flexibilité commerciale à mesure que les produits passent du pilote à la production.
Pour sécuriser la capacité de calcul ainsi que créer et déployer des modèles d’IA, contactez Sharon AI et Firmus.
En savoir plus sur les partenaires Cloud de NVIDIA et les usines d’IA.
