按 Enter 搜索 · ESC 关闭

AI × Crypto

千问发布Qwen3.8-Omni-Flash全模态模型

千问新一代原生全模态模型Qwen3.8-Omni-Flash正式上线。该模型核心目标是提升在真实生产力场景中的Agent能力,推动全模态模型从理解全模态内容走向规划任务、调用工具并完成创作。在具备编程、文本知识工作和GUI操作等通用Agentic能力的基础上,该模型进一步拓展以音视频为核心的Agentic应用,在视频剪辑、音乐视频创作、影视制作与解说、音视频转图文摘要及音视频对话等工作流中取得显著效果。

原文

AI 解读

这次发布的关键不在于又多了一个全模态模型,而在于把音视频从“可理解的内容”变成了“可被Agent操作的对象”——剪辑、解说、转图文摘要这些原本依赖人工串联的环节,开始被纳入同一套任务规划与工具调用流程。受影响的首先是内容生产与后期工作流中的从业者,而非通用对话场景的用户。值得观察的是,音视频类Agentic能力能否在真实生产环境中稳定落地,以及它与既有剪辑、制作工具的衔接方式会如何演化。

由 AI 生成,仅供参考。

分享本文

相关快讯

TREE NEWS 分享卡片
长按上方图片 → 保存到相册 / 转发分享
寻求报道 加入社群 意见反馈