回上列表
U2-Flash採用稀疏混合專家(MoE)架構,總參數約266B,單次推理激活約10B參數,首字響應時間平均控制在3秒以內,峰值輸出吞吐最高300 Tokens/s。該模型將編程、智能體、數學推理、指令遵循等多領域能力統一於同一套權重,以遠小於同類稠密模型的激活規模實現主力級任務完成質量。模型具備隱式思考與連續狀態推理機制,並將推理強度封裝為四檔可控接口,在高強度檔位輸出完整可讀的推理鏈條,確保推理過程可核查、可追溯。
在代表編程能力的DeepSWE v1.1榜單中,U2-Flash得分較前代模型翻倍,以64.6分成績超過GLM5.3-Flash和DeepSeek-V4-Pro-0813等模型;TerminalBench3.0評分大幅提升至24.3分,超過K3等萬億參數級別模型;SWE-Bench Pro評分達61.6分,較前代提升10.5分。同時,該模型在端到端執行效率及推理使用成本方面實現全面優化,Agent任務迭代步數減少20%至30%,任務執行周期縮短35%,Token消耗減少20%至30%。
U2-Flash已完成對主流國產算力平台的系統性適配,為規模化部署提供更靈活的算力選擇。(gc/j)~
阿思達克財經新聞
網址: www.aastocks.com
雲知聲(09678.HK)推新一代高性能主力模型U2-Flash
2026/09/15 08:40
雲知聲(09678.HK)正式發布基於U2通用基座模型強化後訓練的新一代高密度智能模型U2-Flash,表示相較前代U2模型,U2-Flash在任務完成質量和綜合效能方面顯著提升。U2-Flash採用稀疏混合專家(MoE)架構,總參數約266B,單次推理激活約10B參數,首字響應時間平均控制在3秒以內,峰值輸出吞吐最高300 Tokens/s。該模型將編程、智能體、數學推理、指令遵循等多領域能力統一於同一套權重,以遠小於同類稠密模型的激活規模實現主力級任務完成質量。模型具備隱式思考與連續狀態推理機制,並將推理強度封裝為四檔可控接口,在高強度檔位輸出完整可讀的推理鏈條,確保推理過程可核查、可追溯。
在代表編程能力的DeepSWE v1.1榜單中,U2-Flash得分較前代模型翻倍,以64.6分成績超過GLM5.3-Flash和DeepSeek-V4-Pro-0813等模型;TerminalBench3.0評分大幅提升至24.3分,超過K3等萬億參數級別模型;SWE-Bench Pro評分達61.6分,較前代提升10.5分。同時,該模型在端到端執行效率及推理使用成本方面實現全面優化,Agent任務迭代步數減少20%至30%,任務執行周期縮短35%,Token消耗減少20%至30%。
U2-Flash已完成對主流國產算力平台的系統性適配,為規模化部署提供更靈活的算力選擇。(gc/j)~
阿思達克財經新聞
網址: www.aastocks.com
![]() |

