Anthropic大幅压低小模型成本
TREE NEWS 报道, Anthropic 正式发布小模型 Claude Haiku 5.5,官方称其为迄今最快、最便宜且能力最强的小模型,平均运行成本较上一代 Haiku 4.5 低约 75%。定价方面,10 万 token 以内的提示词输入价格为每百万 token 0.1 美元,输出为每百万 token 0.5 美元。该模型已在 Claude 平台以及 AWS、Google Cloud、Microsoft Azure 上线,主要面向摘要、分类、子智能体等高频且对成本敏感的任务。此外,Anthropic 将 Sonnet 5.5 的缓存读取价格下调 50%。
为何这对加密行业意义重大
表面上看,这是一次通用 AI 产品发布,但其影响直接落在正在成形的加密 AI 栈上。自主代理——交易机器人、DeFi 收益路由器、链上数据索引器、DAO 治理助手以及 Telegram 原生助手——只有在单次推理成本相对于其触发动作的价值足够低时才具备经济可行性。单次调用成本下降 75%,不只是改善利润率,更扩大了可被盈利性自动化的任务边界。
以一个监控借贷协议健康因子、并决定是否追加抵押品的子智能体为例。在旧有价格下,每个区块或每隔数秒执行一次这样的检查,对除大额头寸外的所有账户都过于昂贵。而在每百万输入 token 0.1 美元的价格下,这一决策的边际成本趋近于零,使零售级账户也能负担逐块代理监控。
子智能体叙事遇上 DeFi
Anthropic 明确将“子智能体”列为核心目标场景,这与 Web3 中日益流行的多代理架构高度契合。在这类设计中,主编排模型负责拆解任务,并将其委派给更廉价的专用模型——这正是 Haiku 级模型所擅长的角色。更低的推理成本因此让分层代理集群在链上变得可行,而链上本就受 gas 费用这一硬性预算约束。
- 代理框架:以稳定币或原生代币结算的代理框架,将直接受益于算力开销下降。
- 去中心化算力网络:转售 GPU 与推理容量的网络面临新的定价压力,因中心化云厂商持续压低边际成本。
- 数据市场:为 AI 模型供给数据的市场,将因下游推理变便宜而迎来更多需求。
前瞻
Sonnet 5.5 缓存读取降价是更安静的信号:它奖励那些在多次调用间保留大上下文的架构,而这正是持久化链上代理的常见模式。若推理成本以此速度继续下降,加密 AI 的约束条件将从模型经济性转向链上结算成本与数据质量。能同时解决这两个问题、并对模型选择做抽象化的协议,才最有可能捕获代理经济。竞争焦点已不再是哪个模型最聪明,而是哪套技术栈能在每美元预算下做出最多决策。




