La société Equinix a annoncé une extension importante de sa collaboration établie sur une grande place avec NVIDIA pour lancer Equinix Inference Exchange, un programme d’inférence d’IA distribué pour les entreprises mondiales, avec une nouvelle collaboration avec Together AI.
Alors que l’IA s’étend à travers divers modèles, fournisseurs et zones géographiques, le lieu où l’inférence se transforme en un facteur stratégique qui détermine le rendu, les coûts et la gouvernance. Equinix Inference Exchange offrira aux entreprises une voie plus rapide pour passer la phase d’expérimentation de l’IA à la production, en assurant une connectivité sûre et une faible latence avec les données, les utilisateurs et l’écosystème de ceux qui dépendent.
Il s’agit d’une collaboration entre l’architecture de référence commerciale validée par NVIDIA et la plate-forme d’inférence de Together AI, qui admet plus de 200 modèles de code ouverts. Le service fourni par les centres de données globales d’Equinix fournira une connexion avec les nœuds, les réseaux et les fournisseurs de l’IA intermédiaire d’Equinix Fabric.
Connecter les entreprises IA distribuées
La solution est présentée dans Equinix Horizon, l’événement inaugural de l’entreprise pour clients et sociétés, avec Equinix Fabric One, un outil qui facilite aux entreprises la connexion entre les entreprises d’IA distribuées à l’échelle mondiale.
« L’IA est en train de transformer la technologie commerciale à une vitesse extraordinaire, et les décisions d’infrastructure que les entreprises doivent aujourd’hui définir leur position compétitive dans les prochaines années. Equinix occupe une position privilégiée pour offrir ce que ce moment exige, grâce à notre expérience de trois cas. « Depuis des décennies, nous avons construit le point d’échange de confiance avec les entreprises de tout le monde pour réaliser, connecter et gérer leurs charges de travail les plus critiques », a déclaré Adaire Fox-Martin, PDG et président d’Equinix. « Notre relation sera durable avec NVIDIA en fournissant la base de calcul accélérée qui constitue le noyau de l’IA. moderne, alors que le compromis de Together AI avec les écosystèmes ouverts offre aux entreprises la flexibilité nécessaire pour augmenter selon leurs propres conditions Equinix Inference Exchange permettra de mettre en œuvre des architectures neutres par conception, ouvertes par défaut et optimisées pour offrir un rendu exceptionnel ».
«Equinix Inference Exchange transforme la plate-forme d’interconnexion numérique en dirigeant le monde en une infrastructure mondiale pour l’inférence d’IA», a déclaré Raj Mirpuri, vice-président des noyaux globaux d’IA et de l’écosystème d’infrastructure de NVIDIA. « Grâce à la conversion accélérée du calcul en une activité stratégique, la combinaison de l’infrastructure et de la technologie de NVIDIA avec la plate-forme d’inférence de modèles ouverts de Together AI et l’expertise mondiale d’Equinix offre aux entreprises une base puissante et distribuée pour améliorer l’intelligence de leurs données, applications et clients, accélérant ainsi la prochaine génération de services intelligents ».
« Together AI est convaincu qu’une IA ouverte et accessible est celle qui définit l’avenir du secteur, et que les entreprises ne doivent pas choisir entre le rendu du modèle et la flexibilité opérationnelle », a déclaré Vipul Ved Prakash, cofondateur et directeur exécutif de Together AI. conjointement avec Equinix et NVIDIA démontrent que le choix du modèle et le rendu ne sont pas ses aspects exclusifs ; constituant la base d’une IA commerciale bien mise en œuvre ».
Dónde se ejecuta la inferencia es clave
Le rythme d’adoption de l’IA par l’entreprise est de dépasser la capacité de l’infrastructure nécessaire au soutien. Alors que l’IA entreprise passe la phase d’expérimentation à la production, l’inférence nécessite d’être exécutée chaque jour plus en ce qui concerne les utilisateurs, les données et les applications de celui-ci, en abarcando divers nubes, modèles, fournisseurs et emplacements géographiques. Ce changement est obligatoire pour les entreprises de déterminer comment désinstaller l’infrastructure d’IA, mais elles doivent également être exécutées et comment se connecter aux données, applications et charges de travail de ceux qui dépendent.
La gestion de ces opérations d’inférence distribuées présente une complexité opérationnelle considérable, précisément à un moment où les entreprises ont besoin de contrôle et de visibilité du maire.
« Le rendu, les coûts et la gestion ont été convertis en facteurs stratégiques afin que les charges de travail d’IA soient distribuées plus entre différents fournisseurs, sources de données et entreprises », a commenté Nick Patience, vice-président et responsable de la pratique des plates-formes d’IA chez The Futurum Group. « Les organisations sont centrales chaque fois que plus en plus elles exécutent l’inférence et s’accélèrent pour que cela puisse se terminer en production. Les solutions qui simplifient l’exécution de l’inférence sans sacrifier la flexibilité revêtent une importance capitale pour enregistrer les objectifs des entreprises ».
Equinix apporte une escalade et une densité d’écosystème unique pour faire face à divers défis
Equinix apporte une ampleur et une densité d’écosystèmes uniques pour faire face à ce défi, avec plus de 280 centres de données dans 77 zones métropolitaines, 230 points d’accès au noyau et plus de 10 500 entreprises interconnectées sur sa plate-forme d’échange neutre. L’un des 10 principaux fournisseurs de modèles d’IA et les nouveaux 10 principaux noyaux de l’IA fonctionnent avec Equinix, qui subrayent la position de l’entreprise au centre de l’écosystème de l’IA.
Conçu pour offrir des options et de la flexibilité
Together AI est l’incorporation la plus récente dans l’ensemble de l’écosystème d’IA d’Equinix, apportant flexibilité et capacité de choix — grâce aux modèles ouverts — aux entreprises qui mettent en œuvre l’IA à grande échelle. La solution combine trois capacités complémentaires conçues pour simplifier l’inférence de l’IA distribuée :
- Equinix fournit la base d’infrastructure —qui comprend l’énergie, la réfrigération avancée et les opérations d’entretien et de gestion continue—, connectée aux passages d’Equinix Fabric avec les cœurs, les réseaux et les fournisseurs d’IA de ceux qui dépendent de l’inférence.
- NVIDIA soutient la solution avec ses architectures de référence commerciales et son infrastructure d’IA conçues spécifiquement pour maximiser le rendu de l’IA Factory et minimiser le coût du jeton.
- Together AI exploite la plate-forme sous-jacente, et prend en charge tant les services multilocataires pour une efficacité partagée que les entreprises dédiées à un seul locataire pour les charges de travail qui nécessitent une capacité dédiée.
Basée sur Equinix Fabric, la solution est connectée aux fournisseurs d’inférence dans les principales zones métropolitaines de tout le monde, réduisant le temps jusqu’au premier jeton. L’asimitisme, se connecte à un vaste écosystème de noyaux, de réseaux et de fournisseurs d’IA, simplifiant la complexité de la mise en œuvre.
Conçu pour l’inférence entrepreneuriale moderne
La solution a pour objectif de soutenir une large gamme de scénarios d’inférence commerciale, entre eux :
- Inférence Metro Edge : pour les organisations qui nécessitent d’exécuter l’inférence plus près des utilisateurs et des données, en permettant des expériences d’IA avec une latence moindre et en garantissant au même moment la sécurité, l’escalade opérationnelle et l’alcance globale d’Equinix.
- Migration vers des modèles ouverts : Pour les entreprises qui effectuent des tâches de travail à partir des modèles certifiés et propriétaires ont des alternatives de code ouvertes pour contrôler les coûts et éviter la dépendance d’un fournisseur unique, la solution offrira une voie directe et suivie pour effectuer la migration en production ; la plate-forme de modèles ouverts de Together AI sera accessible à travers la même infrastructure interconnectée que les entreprises utilisent pour se connecter à d’autres fournisseurs.
- IA soberana : Pour les entreprises qui opèrent dans des secteurs réglementés ou des régions géographiques spécifiques, la solution permettra d’exécuter des charges de travail de l’IA dans des emplacements remplis avec les exigences de résidence et de surveillance des données, facilitant ainsi l’exécution de l’IA à grande échelle et assurant le contrôle sur le sujet. dónde se traite les données et les déductions.
Equinix Inference Exchange est disponible à partir du premier trimestre 2027.
