按 Enter 搜索 · ESC 关闭

AI × Crypto

千问发布Qwen-Audio-3.1系列语音模型,全线降价最高95%

千问正式发布 Qwen-Audio-3.1 系列语音大模型,对语音识别(ASR)、语音合成(TTS)和实时语音交互(Realtime)三大核心模型进行全面升级,并新推出音频创作模型 Qwen-Audio-3.1-TTS-Next 与音频理解模型 Qwen-Audio-3.1-ASR-Next,五款新模型同步上线,覆盖“理解-生成-交互-创作”完整音频能力栈。同时 Qwen-Audio 全线语音模型价格下调,其中 TTS 降价约 70%,Realtime 降幅约 85%,ASR 降幅达 95%。

原文

AI 解读

语音模型全线大幅降价,尤其是ASR降幅达95%,意味着语音识别正从按量计费的高门槛能力滑向近乎基础设施化的定价,这会直接压缩以语音API为主业的中小厂商的利润空间。对下游应用方而言,理解、生成、交互、创作四层能力被打包在同一系列里,接入成本与选型复杂度同步下降。值得观察的是,降价是否会带动实时语音交互类应用的调用量真正起量,而非仅停留在单价层面的数字变化。

由 AI 生成,仅供参考。

分享本文

相关快讯

TREE NEWS 分享卡片
长按上方图片 → 保存到相册 / 转发分享
寻求报道 加入社群 意见反馈