重點摘要:
- IBM 與 Together AI 簽署 2.4 億美元多年期協議,將在 IBM Cloud 上部署 NVIDIA HGX B300 系統。
- 該叢集預計於 2027 年第一季上線,是 IBM Cloud 上首個大規模專用推論部署。
- NVIDIA 表示,該配置相比前幾代產品,可提供 30 倍的 AI 工廠產出,用於開源模型推論。
重點摘要:

IBM 與 Together AI 在 IBM Cloud 上部署價值 2.4 億美元的 NVIDIA HGX B300 叢集,瞄準開源推論市場,因為企業正在尋求更便宜的 AI 替代方案。
IBM 正在為 Together AI 在 IBM Cloud 上部署價值 2.4 億美元的 NVIDIA HGX B300 推論叢集,在封閉系統成本攀升與安全隱憂加劇之際,鎖定轉向開源模型的企業客戶。
Together AI 執行長 Vipul Ved Prakash 表示:「企業想要頂尖前沿模型的性能,卻不想承擔封閉模型的高昂價格,而這只有在底層基礎設施足夠快速、穩定且具規模時才能實現。」
這項多年期協議涵蓋大規模 NVIDIA HGX B300 系統叢集,這些系統串聯了該晶片製造商的 Blackwell 處理器,並搭配 NVIDIA Spectrum-X 乙太網路進行連接。據 NVIDIA 表示,該配置旨在提供比前幾代產品多 30 倍的 AI 工廠產出。Together AI 今年 7 月以 83 億美元估值完成 8 億美元 C 輪融資,並表示其推論產品每月處理 400 兆個 token。
該叢集預計於 2027 年第一季上線,是 IBM Cloud 上首個採用 HGX B300 系統的大規模專用推論部署。此協議深化了 IBM 與 NVIDIA 之間更廣泛的合作,涵蓋 GPU 原生資料分析、非結構化資料萃取及顧問服務。
此合作反映了企業 AI 採購模式的更廣泛轉變。DeepSeek、MiniMax 和 Kimi 等開源模型在企業尋求控制 AI 成本,同時評估涉及 Anthropic、OpenAI 和 Meta 模型的網路安全事件之際,越來越受歡迎。推論——即運行已訓練模型以生成回應的過程——已成為運算能力需求的最大驅動力之一,促使雲端服務供應商和晶片製造商投入數十億美元擴展 AI 基礎設施。
對 Together AI 而言,IBM Cloud 部署將其 AI Native Cloud 平台——涵蓋推論、訓練、微調與智慧代理工作流程——擴展至企業級領域。該公司成立於 2022 年,聲稱服務逾 100 萬名開發者。該公司表示,選擇 IBM 而非其他雲端供應商,是基於產品藍圖以及在快速 AI 擴展所需步調下交付 GPU 容量的能力。
對 IBM 而言,此協議為其雲端業務增添了一項旗艦級 AI 工作負載,使其與亞馬遜網路服務(AWS)、微軟 Azure 和 Google Cloud 等超大規模業者競爭企業 AI 基礎設施支出。IBM 股價報 236.56 美元,消息公布後上漲 0.11%。
該協議也擴展了 NVIDIA 進軍專用推論基礎設施的布局。基於 Blackwell 的 HGX B300 系統針對 AI 推論進行了優化,而 NVIDIA 所稱的 30 倍產出宣示,將該叢集定位為開源模型服務的參考部署。NVIDIA 未披露 30 倍比較的測試條件。
對投資人而言,該協議顯示 NVIDIA Blackwell 產品線的需求持續強勁,並確認了開源推論市場的發展軌跡。Together AI 83 億美元的估值和每月 400 兆個 token 的處理量,顯示了推論需求的規模。隨著叢集於 2027 年第一季上線,IBM 的雲端營收成長有望受惠,不過部署時程意味著財務影響仍在一年以上。
本文僅供資訊參考用途,不構成投資建議。