觀點網訊:7月15日,阿里巴巴發佈實時語音交互對話模型Qwen-Audio-3.0-Realtime。

該模型在智商、Agent工具調用、共情對話和雙工交互流暢度四條主線上同步升級,力求“又快又聰明”。

模型包括推理更強的Plus版本和速度更快的Flash版本。根據公開資料整理,在VoiceBench語音問答基準中,Plus版本獲得92.5分,並支持Function Call標準協議調用外部工具。

此外,該模型在Artificial Analysis語音推理子項綜合排名第一,超越OpenAI GPT-Realtime-2。其在打斷檢測準確率、響應時延等指標上處於領先地位,支持毫秒級響應與深度推理。