AI & computing › Neuromorfe & fotonische chips
Equinix bouwt wereldwijd AI-inferentienetwerk met Nvidia en Together AI
Datacenterbedrijf Equinix breidt zijn samenwerking met chipmaker Nvidia uit en haalt AI-bedrijf Together AI aan boord voor een nieuw wereldwijd platform: Equinix Inference Exchange. Bedrijven kunnen hun AI-modellen daarmee dicht bij gebruikers en data laten draaien, verspreid over meer dan 280 datacenters. Het platform is vanaf begin 2027 beschikbaar.
Netwerkbedrijf Equinix breidt zijn samenwerking met chipmaker Nvidia flink uit en haalt AI-bedrijf Together AI aan boord. Samen bouwen ze Equinix Inference Exchange: een wereldwijd netwerk van datacenters waarin bedrijven hun AI-modellen dicht bij gebruikers en data kunnen laten draaien. Het platform wordt vanaf het eerste kwartaal van 2027 beschikbaar.
Waarom de plek van AI-verwerking ertoe doet
Veel aandacht binnen AI gaat naar het trainen van modellen, maar minstens zo belangrijk is wat daarna gebeurt: inferentie, het moment waarop een getraind model daadwerkelijk een antwoord geeft. Draait die verwerking te ver van de gebruiker vandaan, dan duurt het langer voordat een chatbot of AI-toepassing reageert. Ook kosten en regelgeving spelen mee: bedrijven willen weten waar hun data wordt verwerkt en willen niet afhankelijk zijn van één cloudleverancier. Equinix zegt dat steeds meer bedrijven na de experimenteerfase tegen deze operationele complexiteit aanlopen.
Drie partijen, één platform
Het nieuwe platform bestaat uit drie lagen. Equinix levert de fysieke basis: stroom, koeling en dagelijks beheer in meer dan 280 datacenters in 77 metropolen wereldwijd. Nvidia levert de blauwdrukken en chips waarmee bedrijven hun eigen AI-omgeving inrichten, de zogeheten Enterprise Reference Architectures. Together AI voegt daar de software aan toe: een platform dat meer dan tweehonderd open-source AI-modellen ondersteunt, zowel gedeeld tussen meerdere klanten als volledig toegewezen aan één bedrijf. De onderlinge verbindingen lopen via Equinix Fabric, de eigen netwerklaag van het bedrijf die datacenters, clouddiensten en AI-leveranciers aan elkaar knoopt. Tegelijk kondigt Equinix Fabric One aan, een uitbreiding die het eenvoudiger moet maken om wereldwijd verspreide AI-omgevingen met elkaar te verbinden.
Equinix onderstreept zijn positie in de AI-markt met cijfers: acht van de tien grootste aanbieders van AI-modellen en negen van de tien grootste cloudpartijen draaien al op zijn compute-infrastructuur. Het bedrijf telt wereldwijd meer dan 230 rechtstreekse verbindingen met clouddiensten en ruim 10.500 aangesloten bedrijven op zijn interconnectienetwerk.
Van edge tot soevereine AI
Equinix noemt drie situaties waarin het platform moet helpen. Bij 'metro edge inference' draait AI dicht bij gebruikers in een stad, wat de reactietijd verkort. Bedrijven die overstappen van gesloten, dure AI-modellen naar goedkopere open-source alternatieven krijgen een directe verbinding met het platform van Together AI. En organisaties in gereguleerde sectoren kunnen AI-workloads laten draaien in landen of regio's die aan hun eisen voor dataopslag voldoen, zonder dat ze zelf een datacenter hoeven te bouwen.
Voor grote bedrijven die AI van pilot naar productie willen brengen, moet Equinix Inference Exchange zo de operationele rompslomp wegnemen van het zelf uitzoeken waar en hoe AI-modellen het beste kunnen draaien.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Doordat grote infrastructuurpartijen als Equinix, Nvidia en Together AI hun krachten bundelen, wordt het voor bedrijven makkelijker om AI-toepassingen dicht bij hun klanten te draaien in plaats van in één centrale cloud. Dat kan chatbots en AI-diensten sneller maken en geeft organisaties meer grip op waar hun gegevens worden verwerkt. Tegelijk laat het zien hoe AI-inferentie, en niet alleen het trainen van modellen, de komende jaren een steeds grotere rol speelt in de datacenterindustrie.
- Inferentie
- Het moment waarop een al getraind AI-model daadwerkelijk een vraag beantwoordt, in tegenstelling tot de training van het model daarvoor.
- Open-source AI-model
- Een AI-model waarvan de onderliggende bouwstenen vrij beschikbaar zijn, zodat bedrijven het zelf kunnen aanpassen en op eigen infrastructuur draaien.
- Compute-infrastructuur
- De servers, chips en netwerken die nodig zijn om AI-modellen te trainen en te laten draaien.
- Netwerkfabric
- Een digitale verbindingslaag die datacenters, clouddiensten en bedrijven rechtstreeks aan elkaar koppelt, zonder om te lopen via het publieke internet.
- Referentiearchitectuur
- Een vooraf ontworpen blauwdruk waarmee bedrijven hun technische infrastructuur volgens een beproefd, gestandaardiseerd stramien inrichten.
- Rand-inferentie
- Het uitvoeren van AI-berekeningen in een datacenter dicht bij de gebruiker in een stad of regio, om vertraging te beperken.
- Soevereine AI
- AI-infrastructuur die binnen de grenzen van een land of regio draait, zodat data voldoet aan lokale eisen voor opslag en verwerking.
- Multitenant
- Een situatie waarin meerdere klanten dezelfde technische infrastructuur delen, in plaats van dat elke klant een eigen, exclusieve omgeving heeft.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.