觀點網訊:9月15日,雲知聲(09678.HK)發佈公告,正式發佈基於U2通用基座模型強化後訓練的新一代高密度智能模型U2-Flash。
據公告,在代表編程能力的DeepSWE v1.1榜單中,U2-Flash得分較前代模型翻倍,以64.6分的成績超過GLM5.3-Flash和DeepSeek-V4-Pro-0813等模型;TerminalBench3.0評分24.3分,超過K3等萬億參數級別模型;SWE-Bench Pro評分61.6分,較前代提升10.5分。
該模型採用稀疏混合專家(MoE)架構,總參數約266B,單次推理激活約10B參數,首字響應時間平均控制在3秒以內,峯值輸出吞吐最高300Tokens/s。
在執行效率方面,據公告披露,該模型Agent任務迭代步數減少20%—30%,任務執行週期縮短35%,Token消耗減少20%—30%。
在訓練方式上,U2-Flash建立了模型深度參與自身訓練的自主閉環機制,有效訓練軌跡數提升約60%,訓練步數減少約55%。
