回上列表
據悉,WITA-Omni領先的關鍵在於它並不是簡單地把聊天模型「裝進」機械人,而是將物理動作和表情提升為與語音並列的一級輸出,用一個原生端到端模型統一驅動感知、決策與表達,從Thinker–Talker範式上進一步擴展出面向具身輸出的Thinker–Talker–Actor架構。
此外,WITA-Omni使用千萬小時級多模態數據,將強文本、視覺底座進一步升級為能夠「聽得見、看得懂,並進行音畫聯合推理」的全模態模型。(jl/a)~
阿思達克財經新聞
網址: www.aastocks.com
智元WITA-Omni Preview登頂DailyOmni全模態理解榜單 超越千問及豆包等
2026/07/29 10:12
具身全模態理解權威榜單DailyOmni評測結果顯示,智元自研的具身原生全模態大模型WITA-Omni Preview以85.21分綜合成績登頂榜首,超越千問、Gemini、豆包、英偉達(NVDA.US)等國內外領先模型,並在八項細分指標中的六項取得第一。據悉,WITA-Omni領先的關鍵在於它並不是簡單地把聊天模型「裝進」機械人,而是將物理動作和表情提升為與語音並列的一級輸出,用一個原生端到端模型統一驅動感知、決策與表達,從Thinker–Talker範式上進一步擴展出面向具身輸出的Thinker–Talker–Actor架構。
此外,WITA-Omni使用千萬小時級多模態數據,將強文本、視覺底座進一步升級為能夠「聽得見、看得懂,並進行音畫聯合推理」的全模態模型。(jl/a)~
阿思達克財經新聞
網址: www.aastocks.com
![]() |

