Equinix、NVIDIA與Together AI正聯手打造一項分散式AI推論服務「Equinix Inference Exchange」,自2027年第一季起,將在Equinix全球互聯網絡上,於鄰近企業資料的位置運行開放模型。
Equinix、NVIDIA與Together AI正聯手打造一項分散式AI推論服務「Equinix Inference Exchange」,自2027年第一季起,將在Equinix全球互聯網絡上,於鄰近企業資料的位置運行開放模型。

Equinix正押注其擁有280個站點的互聯網絡將成為企業AI推論的預設載體,結合NVIDIA的運算能力與Together AI的開放模型平台,推出一項分散式服務,預計於2027年第一季上線。
Equinix執行長Adaire Fox-Martin在聲明中表示:「Equinix Inference Exchange將實現本質中立、預設開放並以卓越效能為設計目標的架構。」
這項三方合作的架構中,Equinix負責供電、先進散熱及第二日起運營,並透過其Equinix Fabric串聯雲端、網路與AI供應商。NVIDIA以其企業參考架構(Enterprise Reference Architectures)為建設主軸,針對最大化AI工廠產出與降低Token成本進行調校;Together AI則在超過200個開源模型上營運該平台,同時支援多租戶與專屬單租戶兩種部署模式。
此一發布將NVIDIA的運算業務版圖從訓練領域延伸至推論領域——該公司表示,推論市場現已超越訓練,而約18個月前兩者規模大致相當。對Equinix而言,此服務深化其作為中立交換平台的角色——全球前十大AI模型供應商中有八家、前十大AI雲端供應商中有九家已進駐其網絡——使其在企業開放模型推論領域取得差異化切入點,正值AI資料中心建設從興建階段轉向運行工作負載之際。
為何推論正移往網路邊緣
企業逐漸發現,推論的運作方式與訓練截然不同。訓練可以在少數超大規模園區內完成,但推論必須緊鄰其所服務的使用者、資料與應用,分散於各雲端、模型與地理區域之間。這對金融服務與醫療保健等受監管行業構成了延遲與合規性問題,因為資料駐留法規禁止將工作負載送至偏遠的模型供應商。
Equinix Inference Exchange正是為回應此需求而生,支援都會區邊緣推論、開放模型遷移及主權AI。客戶可在滿足資料駐留要求的本地資料中心內運行推論,同時保有對資料處理位置的掌控權。該公司的版圖——遍布77個都會區的超過280座資料中心、約230個雲端接入點,以及逾10,500家互聯企業——賦予其純軟體業者無法比擬的實體觸及範圍。
NVIDIA的機櫃級布局補齊最後一塊拼圖
此合作是NVIDIA更廣泛策略的一環——旨在定義完整的AI基礎建設堆疊,而非僅銷售晶片。該公司已同意以129億美元收購開源平台Hugging Face,授權Groq的LPU技術用於其下一代Vera Rubin架構,並認購35億美元的MediaTek可轉換公司債以共同開發機櫃級系統。這些舉措共同涵蓋了從模型訓練到推論部署的完整鏈條。
對Equinix而言,此協議之際正值投資人衡量其成長與沉重資本支出之間的取捨。該公司市值約為1,010億美元,市銷率接近10.3倍,高於其歷史中位數,且在擴張融資期間自由現金流仍為負值。Equinix股價在過去六個月上漲4.8%,而其同業產業平均下跌1.8%;Zacks對該股給予「持有」(Hold)評等。同業Digital Realty同樣積極爭取AI租戶,Zacks對其給予「買入」(Buy)評等。
Equinix尚未公布Inference Exchange的財務目標,且該服務要到2027年第一季才會觸及客戶。其賭注在於:屆時企業從實驗階段邁向生產部署的轉變,將使分散式推論成為一波成長浪潮,而Equinix的互聯網絡正是為抓住此浪潮而建。
本文僅供參考之用,不構成投資建議。