全球數碼基礎設施公司 Equinix, Inc. 今日宣佈,在深化與 NVIDIA 長期合作的基礎上,再聯合 Together AI 推出專為全球企業而設的分佈式 AI 推論方案 Equinix Inference Exchange。該方案在 Equinix 首屆年度客户及合作夥伴活動 Equinix Horizon 上正式亮相,同場並發布 Equinix Fabric One,旨在進一步簡化企業在全球分佈式 AI 環境之間的連接流程。
AI 在模型、服務供應商及不同地區之間快速擴展之際,推論工序的實際操作位置,已成為左右效能、成本以至管治能力的關鍵變數。Equinix Inference Exchange 的設計目標,正是協助企業將 AI 模型從試驗階段加快推進至正式運作,並提供更安全的低時延連接路徑,讓數據可順暢接通企業用户及整個生態系統。這次合作方案揉合 NVIDIA 經驗證的 Enterprise Reference Architectures 與 Together AI 的推論平台,可支援超過 200 個開源模型,並會藉助 Equinix 遍佈全球的數據中心及 Equinix Fabric,為雲端、網絡及 AI 服務供應商搭建互連網絡。
Equinix® Inference Exchange - Bringing inference closer to where data, users and applications live
Equinix 行政總裁兼總裁 Adaire Fox-Martin 指出,人工智能正以前所未有的速度重塑企業科技,企業現時在基礎設施上所作的決策,將直接左右其未來數年的競爭優勢。她表示,集團憑藉近三十年來打造全球企業運行、互連及協調最關鍵工作負載的可信賴交換平台的經驗,具備獨特條件滿足當前市場需求。她續稱,集團與 NVIDIA 的長期合作,為現代 AI 核心提供了所需的加速運算基礎;Together AI 對開放生態系統的承諾,則讓企業可按自身需要靈活擴展。Equinix Inference Exchange 正是以中立性為設計原則、以開放性為預設標準,並專為卓越效能而打造的架構。
資料圖片
NVIDIA 全球 AI 雲端及基礎設施生態系統副總裁 Raj Mirpuri 形容,Equinix Inference Exchange 把頂尖的數碼互連平台,轉化為支援 AI 推論的全球網絡。他提到,加速運算已成為企業的策略性資產,這次合作結合 NVIDIA 的基礎設施及技術、Together AI 的開放模型推論平台,以及 Equinix 的全球覆蓋網絡,可為企業提供強勁的分佈式基礎,讓智能運算更貼近企業數據、應用程式及客户的需求,加快新一代智能服務的推進步伐。
Together AI 聯合創辦人兼行政總裁 Vipul Ved Prakash 表示,公司的創立理念源於一個信念——開放且普及的人工智能將定義產業未來的發展方向,企業不應被迫在模型效能與營運靈活性之間作出取捨。他強調,與 Equinix 及 NVIDIA 攜手打造的解決方案,正好證明模型選擇自由與卓越效能並非互相排斥,而是企業成功部署 AI 的核心基礎。
企業採納 AI 的速度,目前正超越現有基礎設施所能承載的極限。當企業 AI 由試驗階段走向實際應用,推論工序便需要在更貼近用户、數據及應用程式的位置運行,同時靈活橫跨不同雲端、模型、服務供應商及地域。企業除了要決定如何部署 AI 基礎設施,亦須考慮其運作位置,以及如何連接所需的數據、應用程式及工作負載。企業對 AI 運作需要更清晰的掌控和管理,惟分散於不同環境的 AI 推論部署,卻令操作變得更加複雜。
The Futurum Group AI 平台副總裁兼業務主管 Nick Patience 指出,AI 負載工作漸趨分散於不同服務供應商、數據來源及環境,效能、成本及管治因而成為關鍵的決策因素。他預期企業將更關注推論程序的運行環境及其部署速度,方案必須保持靈活,同時精簡 AI 推論部署,才能協助企業達成商業成果。
面對上述挑戰,Equinix 以龐大的全球規模及高度密集的生態系統作為應對基礎。目前集團在全球 77 個城市營運超過 280 所數據中心,提供逾 230 個雲端接入點,並透過其中立交換平台連接超過 10,500 家企業。全球十大 AI 模型供應商中有八家,以及十大 AI 雲端服務供應商中有九家,均已部署於 Equinix 平台,足見其作為 AI 生態系統核心樞紐的地位。
Together AI 是 Equinix 持續擴展的 AI 生態系統中的最新一員,為大規模部署 AI 的企業提供更靈活的開放模型選擇。整個方案由三個相互協作的層面組成,以簡化分佈式 AI 推論工序:Equinix 負責提供基礎設施底座,涵蓋電力供應、先進冷卻技術及後續營運管理,並透過 Equinix Fabric 連接雲端服務、網絡及 AI 供應商,為 AI 推論工作負載提供所需的互連能力;NVIDIA 則作為核心技術支柱,以其 Enterprise Reference Architectures 及專為 AI 打造的基礎設施為基礎,協助最大化 AI 工廠(AI Factory)的運算吞吐量,同時降低每個 Token 的推論成本;Together AI 在此之上運行平台服務,既支援多租户部署模式以提升共享資源效率,亦提供專屬單租户環境,滿足需要專用運算資源及容量保障的工作負載需求。
這套建基於 Equinix Fabric 的方案,將連接全球主要都會區的 AI 推論服務供應商,縮短從發出請求到產生首個 Token 的時間(Time-to-First-Token),從而提升 AI 應用的回應速度與使用體驗。與此同時,方案可接入涵蓋雲端服務、網絡及 AI 供應商的廣泛生態系統,降低企業部署與管理 AI 工作負載的複雜性。
方案旨在支援廣泛的企業 AI 推論應用場景。都會區邊緣推論(Metro Edge Inference)針對需要讓 AI 推論更貼近使用者及資料來源運行的企業,在降低延遲、提升 AI 體驗之餘,亦能受惠於 Equinix 提供的安全性、營運規模及全球覆蓋能力。開放模型遷移(Open Model Migration)則面向希望將工作負載從封閉式專有模型遷移至開源模型的企業,以便更有效控制成本並避免供應商鎖定(Vendor Lock-in);方案提供直接且低摩擦的生產環境遷移路徑,讓企業透過 Together AI 的開放模型平台執行相關遷移,而該平台亦可經企業現有用於連接各類服務供應商的互連架構(Interconnected Fabric)直接存取,簡化整體部署流程。主權 AI(Sovereign AI)則適用於受監管行業或特定地區營運的企業,協助其在符合資料存放地(Data Residency)及資料主權要求的地點運行 AI 工作負載,在維持對資料儲存位置及推論處理位置控制權的同時,提供更簡單且可擴展的 AI 部署途徑。
Equinix Inference Exchange 預計於 2027 年第一季正式推出。