让声音创造价值

把声音变成知识内容、创造力和生产力

领先的音频基础模型
听、说、聊三项全能

基于 QwenAudio 自研音频大模型,在多项权威评测中排名第一,为 CosyVoice 系列产品提供领先的模型能力

听得准

字错率 WER 第一

Qwen-Audio-3.0-ASR 字错率 WER / 1.7%

语音识别示意

说的真

对话流畅度 第一

Qwen-Audio-3.0-TTS 对话流畅度 / 97.8%

语音合成示意

聊得好

语音推理能力 第一

Qwen-Audio-3.0-Realtime 语音推理能力 / 97.6%

实时对话示意
Qwen Audio Studio