把声音变成知识内容、创造力和生产力
说得随意,写得漂亮,无需打字安全录入
释放创作潜能,把想法变成有感染力的声音作品
提供最自然的交互体验,让声音成为服务的入口
基于 QwenAudio 自研音频大模型,在多项权威评测中排名第一,为 CosyVoice 系列产品提供领先的模型能力
Qwen-Audio-3.0-ASR 字错率 WER / 1.7%
Qwen-Audio-3.0-TTS 对话流畅度 / 97.8%
Qwen-Audio-3.0-Realtime 语音推理能力 / 97.6%