Equinix annonce un renforcement majeur de sa collaboration de longue date avec NVIDIA afin de proposer Equinix® Inference Exchange, un programme d’inférence IA distribuée destiné aux entreprises opérant à l’échelle mondiale. L’entreprise annonce parallèlement une nouvelle collaboration avec Together AI.
À mesure que l’IA se déploie à grande échelle dans des environnements caractérisés par une diversité de modèles, de fournisseurs et de zones géographiques, le choix du lieu d’exécution de l’inférence devient un impératif stratégique, car il détermine les performances, les coûts et la gouvernance. Equinix Inference Exchange permettra aux entreprises de passer plus rapidement de l’expérimentation à la mise en production de l’IA, grâce à une connectivité sécurisée et à faible latence avec les données, les utilisateurs et l’écosystème dont elles dépendent.
Cette collaboration réunit les architectures de référence d’entreprise validées par NVIDIA et la plateforme d’inférence de Together AI, qui prend en charge plus de 200 modèles open source. Proposée depuis les data centers d’Equinix à travers le monde, la solution offrira, via Equinix Fabric®, une connectivité avec les clouds, les réseaux et les fournisseurs d’IA.
La solution a été annoncée aujourd’hui à l’occasion d’Equinix Horizon, le premier événement de l’entreprise destiné à ses clients et partenaires, aux côtés d’Equinix® Fabric One™, qui facilitera l’interconnexion des environnements d’IA distribués à l’échelle mondiale.
« L’IA transforme les technologies d’entreprise à une vitesse extraordinaire, et les choix que font aujourd’hui les entreprises en matière d’infrastructure détermineront leur position concurrentielle pour les années à venir. Equinix occupe une position unique pour répondre aux exigences du moment, forte de près de trente ans consacrés à bâtir la plateforme d’échange de confiance sur laquelle les entreprises du monde entier exécutent, connectent et orchestrent leurs charges de travail les plus critiques », déclare Adaire Fox-Martin, Chief Executive Officer and President d’Equinix.« Notre relation de longue date avec NVIDIA fournit le socle de calcul accéléré au cœur de l’IA moderne, tandis que l’engagement de Together AI en faveur d’écosystèmes ouverts offre aux entreprises la flexibilité nécessaire pour faire évoluer leurs déploiements selon leurs propres besoins. Equinix Inference Exchange permettra la mise en place d’architectures neutres dès leur conception, ouvertes par défaut et optimisées pour offrir des performances exceptionnelles. »
« Equinix Inference Exchange transforme la première plateforme mondiale d’interconnexion numérique en un maillage mondial dédié à l’inférence IA »,
déclare Raj Mirpuri, vice president of global AI clouds and infrastructure ecosystem chez NVIDIA. « À mesure que le calcul accéléré devient une classe d’actifs stratégique, l’association de l’infrastructure et des technologies de NVIDIA, de la plateforme d’inférence de Together AI fondée sur des modèles ouverts et de la présence mondiale d’Equinix offre aux entreprises un puissant socle distribué pour rapprocher l’intelligence de leurs données, de leurs applications et de leurs clients, et accélérer ainsi l’émergence de la prochaine génération de services intelligents. »
« Together AI est née de la conviction qu’une IA ouverte et accessible façonnera l’avenir du secteur, car les entreprises ne devraient pas avoir à choisir entre les performances des modèles et la flexibilité opérationnelle »,
déclare Vipul Ved Prakash, co-founder and CEO de Together AI. « Ce que nous construisons avec Equinix et NVIDIA prouve qu’il n’est pas nécessaire de sacrifier le choix des modèles à la performance, ni la performance au choix des modèles. Ces deux dimensions sont les fondements d’une IA d’entreprise mise en œuvre dans les règles de l’art. »
Le lieu d’exécution de l’inférence est déterminant
L’adoption de l’IA par les entreprises progresse plus vite que les infrastructures nécessaires pour la prendre en charge. À mesure que l’IA d’entreprise quitte le stade de l’expérimentation pour entrer en production, l’inférence doit s’exécuter de plus en plus près des utilisateurs, des données et des applications qu’elle sert, quels que soient les clouds, les modèles, les fournisseurs et les zones géographiques concernés. Cette évolution oblige les entreprises à déterminer non seulement comment déployer leurs infrastructures d’IA, mais aussi où les exploiter et comment les relier aux données, aux applications et aux charges de travail dont elles dépendent.
La gestion de ces déploiements distribués d’inférence entraîne une complexité opérationnelle considérable, précisément au moment où les entreprises ont besoin de davantage de contrôle et de visibilité.
Equinix s’appuie sur une envergure et une densité d’écosystème inégalées : plus de 280 data centers répartis dans 77 métropoles, 230 points d’accès au cloud et plus de 10 500 entreprises interconnectées au sein de sa plateforme d’échange neutre. Huit des dix principaux fournisseurs de modèles d’IA et neuf des dix principaux clouds d’IA sont déployés chez Equinix, ce qui confirme la position centrale de l’entreprise au sein de l’écosystème de l’IA.
Une solution conçue pour offrir choix et flexibilité
Together AI est le dernier acteur en date à rejoindre le vaste écosystème d’IA d’Equinix. L’entreprise apporte aux organisations qui déploient l’IA à grande échelle davantage de flexibilité et de choix en matière de modèles ouverts. La solution associe trois couches complémentaires conçues pour simplifier l’inférence IA distribuée :
-
Equinix fournit le socle d’infrastructure, notamment l’alimentation électrique, des systèmes avancés de refroidissement et l’exploitation courante. Grâce à Equinix Fabric, ce socle est connecté aux clouds, aux réseaux et aux fournisseurs d’IA dont dépend l’inférence.
-
NVIDIA structure le déploiement grâce à ses architectures de référence d’entreprise et à son infrastructure d’IA spécialement conçue pour maximiser le débit de traitement des usines d’IA et réduire au minimum le coût par token.
-
Together AI opère sa plateforme sur cette infrastructure. Celle-ci prend en charge aussi bien les déploiements mutualisés, pour gagner en efficacité grâce au partage des ressources, que les environnements réservés à un seul client pour les charges de travail nécessitant des capacités dédiées.
S’appuyant sur Equinix Fabric, la solution se connectera à des fournisseurs de services d’inférence dans les principales métropoles du monde, réduisant ainsi le délai avant la génération du premier token. Elle se connectera également à un vaste écosystème de clouds, de réseaux et de fournisseurs d’IA, afin de réduire la complexité des déploiements.
Conçue pour les nouveaux usages de l’inférence en entreprise
La solution vise à prendre en charge un large éventail de scénarios d’inférence en entreprise, notamment :
-
Inférence de proximité à l’échelle métropolitaine : pour les organisations qui doivent exécuter l’inférence au plus près des utilisateurs et des données, afin de proposer des expériences d’IA à plus faible latence tout en bénéficiant de la sécurité, des capacités opérationnelles et de la présence mondiale d’Equinix.
-
Migration vers des modèles ouverts : pour les entreprises qui migrent leurs charges de travail depuis des modèles fermés et propriétaires vers des alternatives open source afin de maîtriser leurs coûts et d’éviter toute dépendance vis-à-vis d’un fournisseur, la solution offrira une voie directe et fluide pour mener cette migration en production. La plateforme de Together AI fondée sur des modèles ouverts sera accessible via le même réseau d’interconnexion que les entreprises utilisent déjà pour se connecter à leurs autres fournisseurs.
-
IA souveraine : pour les entreprises qui exercent leurs activités dans des secteurs réglementés ou dans certaines zones géographiques, la solution permettra d’exécuter les charges de travail d’IA sur des sites répondant aux exigences de résidence et de souveraineté des données. Elle offrira ainsi un moyen plus simple de déployer l’IA à grande échelle, tout en conservant la maîtrise des lieux où les données sont traitées et où l’inférence est exécutée.