TREE NEWS 报道, OpenDesign 将 13 款 AI 模型放入同一组设计任务进行测试。结果显示,DeepSeek V4.1 Flash 的成绩比 GPT-6 Astra 低 1.5 分,但成本约为后者的七十分之一,即仅为 GPT-6 Astra 的约 1.4%。
OpenDesign 测试:DeepSeek V4.1 Flash 设计能力落后 GPT-6 Astra 1.5 分,成本仅约 1.4%
AI 解读
这条测试把“能力差距”和“成本差距”放在同一张表上,真正值得注意的不是那 1.5 分,而是两者相差约七十倍的支出。对以设计任务为日常负载的团队而言,模型选型的分水岭正在从“谁最强”转向“差距是否值这个价”。后续值得观察的是,这类同任务横评是否会成为采购参考的常规做法,以及能力差距在更复杂设计场景中是否仍保持同一量级。
由 AI 生成,仅供参考。