回上列表
阿里雲表示,Kimi K3是目前業界參數規模最大的模型之一,跑通此規模的模型需要將參數分散到幾十張甚至上百張高速互聯的GPU卡,讓萬億參數「跑得又穩又快」。然而,普通AI集群因通信帶寬的局限,無法滿足高吞吐、低延遲、高並發的需求。而阿里雲真武超節點實例通過ICN Switch高速互聯芯片,讓64張平頭哥真武M890實現800GB/s的全互聯,其顯存規模達到 9TB,可突破萬億參數模型運行的算力、顯存和網絡帶寬的瓶頸,單實例即可支撐大規模萬億級參數MoE模型的專家並行需求。
為提升Kimi K3的運行效率,阿里雲、平頭哥與Kimi團隊從軟件棧、算子等層面進行深度聯合適配。其中,真武M890對Kimi K3模型架構的核心算子進行優化,顯著提升推理的算力和帶寬利用率,可穩定支持最1M長上下文,從容應對長文檔理解、複雜推理等場景。測試顯示,適配後模型的首Token時延降低約35%,單卡解碼吞吐提升1.8倍。(gc/a)~
阿思達克財經新聞
網址: www.aastocks.com
阿里雲真武超節點適配Kimi K3 將開展國產算力合作
2026/07/28 10:01
阿里雲公布,旗下真武M890超節點實例已Day0適配月之暗面Kimi K3,是國內首個跑通近3萬億參數模型的超節點,雙方將進一步開展國產算力合作,千問AI平台和阿里雲百鍊也將提供Kimi K3的模型API。阿里雲表示,Kimi K3是目前業界參數規模最大的模型之一,跑通此規模的模型需要將參數分散到幾十張甚至上百張高速互聯的GPU卡,讓萬億參數「跑得又穩又快」。然而,普通AI集群因通信帶寬的局限,無法滿足高吞吐、低延遲、高並發的需求。而阿里雲真武超節點實例通過ICN Switch高速互聯芯片,讓64張平頭哥真武M890實現800GB/s的全互聯,其顯存規模達到 9TB,可突破萬億參數模型運行的算力、顯存和網絡帶寬的瓶頸,單實例即可支撐大規模萬億級參數MoE模型的專家並行需求。
為提升Kimi K3的運行效率,阿里雲、平頭哥與Kimi團隊從軟件棧、算子等層面進行深度聯合適配。其中,真武M890對Kimi K3模型架構的核心算子進行優化,顯著提升推理的算力和帶寬利用率,可穩定支持最1M長上下文,從容應對長文檔理解、複雜推理等場景。測試顯示,適配後模型的首Token時延降低約35%,單卡解碼吞吐提升1.8倍。(gc/a)~
阿思達克財經新聞
網址: www.aastocks.com
![]() |

