【TechWeb】7月22日消息,《The Information》報道稱,據知情人士透露,微軟內部估算,若將旗下AI助手Copilot的部分推理請求,從OpenAI和Anthropic的模型切換至中國AI公司月之暗面(Moonshot AI)開發的Kimi K3模型,每年最多可削減約6億美元(約合40億元人民幣)的雲基礎設施成本。這一數字凸顯了大型科技公司在大模型推理成本壓力下的焦慮,也側面印證了Kimi K3在特定任務上的性價比優勢。微軟計劃在未來兩個月內完成初步技術驗證,屆時會有更明確的路線圖。
微軟是OpenAI的最大投資方和獨家雲服務提供商,其Copilot產品廣泛採用OpenAI的GPT系列模型。但據報道,微軟一直在積極探索替代方案,以降低對單一模型供應商的依賴,並優化成本結構。The Information指出,微軟正與月之暗面就Kimi K3的測試進行合作,該模型在代碼編寫、邏輯推理等任務上的表現被認為「有競爭力」,且推理成本顯著低於OpenAI的GPT-4系列和Anthropic的Claude系列。
當前,AI推理成本是大模型商業化落地的核心瓶頸之一。以Copilot為代表的AI助手每日處理海量用戶請求,每一次推理都意味着電力和算力消耗。對微軟而言,在非核心創意類任務(如代碼補全、基礎問答)中引入更具成本效益的模型,是符合商業邏輯的選擇。6億美元的節省空間,相當於微軟2026財年Q3(截至3月31日)智能雲部門淨利潤的約15%。
不過,報道也強調,這一測算仍屬內部初步估算,微軟尚未做出最終切換決定。知情人士稱,將現有流量從OpenAI和Anthropic的模型遷移至Kimi K3涉及巨大的工程複雜性:Kimi K3在代碼任務上表現良好,但在複雜推理、多輪對話和安全性方面是否完全達到Copilot的企業級標準,仍需大規模A/B測試驗證。Copilot的系統架構深度綁定OpenAI的API接口和微調工具鏈,遷移至新模型需重構提示詞工程、輸出解析和錯誤處理模塊。作為美國科技巨頭,微軟使用中國AI公司模型處理部分用戶數據,還需滿足各國數據主權和出口管制要求。
報道援引一位前微軟高管的話稱:「成本節省的數字很誘人,但如果質量下降1%,可能導致用戶流失,那省下的錢就不值得了。」
對於月之暗面而言,若能拿下微軟Copilot的部分訂單,無疑將是其國際化進程中的里程碑事件。Kimi系列模型此前在中國市場以長上下文處理能力著稱,Kimi K3據稱在推理效率和訓練成本上做了進一步優化。The Information的報道指出,微軟對Kimi K3的興趣主要集中在「高性價比推理」上,而非前沿能力對標。
這也反映了當前大模型競爭的一個新趨勢:企業客戶正在從「唯性能論」轉向「性價比優先」,尤其是在推理側。OpenAI的GPT-5遲遲未發布,Anthropic的Claude 4價格依然高企,這給二線模型廠商留下了市場空間。
微軟的「多模型」策略並不新鮮,其Azure AI平台早已集成Meta的Llama、Mistral等第三方模型。但將Copilot核心流量切給中國模型供應商,顯然需要更高的決策層級介入。報道稱,微軟CEO薩提亞·納德拉(Satya Nadella)已多次在內部強調「成本效率」和「供應商多樣性」,這被解讀為對OpenAI日益強勢地位的微妙制衡。
不過,微軟與OpenAI的獨家雲協議和深度技術合作不會輕易打破。分析人士認為,即使微軟最終決定採用Kimi K3,也僅限於非核心、低敏感度的推理負載,佔比不會超過Copilot總流量的20%。6億美元的上限估算,可能是基於最樂觀的替換比例和價格談判結果。