阿里千问发布 Qwen-Audio-3.1,语音模型价格最高下调95%
TREE NEWS 报道, 阿里通义千问正式发布 Qwen-Audio-3.1 系列语音大模型,一次性推出五款新模型,覆盖语音识别、语音合成、实时语音交互、音频创作与音频理解,形成“理解—生成—交互—创作”的完整能力栈。同时宣布全线语音模型降价:TTS 降价约70%,Realtime 降幅约85%,ASR 降幅高达95%。
产品矩阵升级
本次升级不仅对三大核心模型进行全面进化,还推出全新的音频创作模型 Qwen-Audio-3.1-TTS-Next 和音频理解模型 Qwen-Audio-3.1-ASR-Next,五款模型协同构成端到端音频处理管线。
对加密与AI交汇处的影响
语音模型成本骤降,将大幅降低开发者构建语音应用的门槛。对加密行业而言,这意味着:
- 链上AI代理可以极低成本集成自然语音接口,对话式DeFi助手和钱包副驾驶的经济可行性显著提升。
- 去中心化算力网络面临更激烈的价格竞争,中心化云厂商的激进降价将挤压加密原生GPU市场的生存空间。
- 语音数据市场可能随更多开发者训练和微调音频模型而加速发展。
竞争格局
此次降价折射出AI基础设施领域更广泛的价格战。对提供去中心化GPU或推理服务的加密项目而言,仅靠价格难以竞争,必须在隐私、抗审查和可验证性上建立差异化优势。
前瞻
当语音AI趋于免费,语音优先的加密应用有望迎来爆发——从AI交易助手到多语言社区工具。代币化算力项目需重新思考价值主张,胜出者将是那些把低成本推理与链上结算、用户自有数据结合起来的项目。




