← News
By Leila Haddad
— Solutions Architect, Enterprise
·
· INSIGHT
Anthropic 转向按用量计费:企业方需要重谈什么
Anthropic 已将 Claude Enterprise 重构为低基础席位费 + 按 API 价不设上限的用量计费。150 席以上客户在续约时迁移。签约前采购应围绕 token、缓存与批处理折扣重建支出模型。
Anthropic 2026 企业定价改变了什么
2026 年 4 月,Anthropic 确认了 The Information 最初报道的内容:Claude Enterprise 已脱离捆绑 token 的统一席位价,转向「低基础席位费 + 按标准 API 价计费的用量」组合模型。按 Anthropic 公布的结构,新 Enterprise 席位约为 $20/用户/月,且「不能关闭用量计费」。旧的高级与标准席位档(原约 $200 与 $40/用户/月,含捆绑 token 配额)在续约时迁移到新模型。
变更初期面向 150 席及以上部署。较小客户暂留在旧定价上,但走向已经明确。Anthropic 把原因归于 Claude Code 普及与 Agent 工作负载带来的算力紧张。来自 PYMNTS、The Register、ITBrief 的行业报道将此定性为前沿模型企业合同统一费率时代的终结。对采购团队而言,实际后果是该行项从可预测的订阅变成可变消费,席位费成为总成本的一小部分。
按席位 vs 按 token:新算式怎么算
在旧 Premium 套餐下,200 席部署按 $200/用户产生可预测的 $480,000 年承诺,并含捆绑 token 配额。新模型下同样 200 席仅产生 $48,000 基础费;其余取决于这些用户按 API 标价实际消耗多少:Sonnet 4.6 约 $3 输入 / $15 输出每百万 token,Opus 4.7 实质更高。
被 implicator.ai 与 The Register 引用的授权分析师估计,重度用户的总支出会翻倍甚至三倍。一名跑 Agent 循环的 Claude Code 工程师每天可烧掉数百万 token;乘以一个平台团队,可变部分便压过基础。算式现在取决于采购此前很少跟踪的三个数字:每活跃用户每日平均 token、输出对输入比(输出贵 5 倍)、Haiku-Sonnet-Opus 模型组合。过去把 AI 支出按每席位 SaaS 行项预测的财务团队,需要围绕用量遥测而非头数重建模型。
缓存折扣与 Message Batches:值得使用的成本杠杆
在新合同形态下,两项 Anthropic 原生折扣从「锦上添花」变为承重。Message Batches API 在 24 小时内处理异步请求,按标准 token 价恰好 50% 计费,对输入与输出均适用,覆盖所有 Claude 模型。任何可容忍一天延迟的任务——夜间文档分类、评估运行、批量摘要、向量化刷新——都应通过它路由。
提示缓存是第二个杠杆。Anthropic 公布的倍率显示:5 分钟缓存写入为基础输入价的 1.25 倍,1 小时写入为 2 倍,关键的——缓存读取为 0.1 倍,即缓存输入 token 90% 折扣。两项折扣可叠加。被反复命中的长系统提示或文档上下文,通过 Batches 走,被缓存部分可降到列表价的约 5%。对 RAG 管线与长上下文 Agent 工作流,刻意构造提示让稳定前缀可缓存,已从工程优化升级为采购可见的决策。
在新档下建模年度支出
一份可辩护的 2026 年支出模型需要每个用户群组三项输入:每月活跃天数、每活跃天 token 消耗、可参与缓存或批处理折扣的流量份额。一份有用基线:典型的 Claude-in-IDE 开发者据报告每活跃天消耗 100 万-300 万 token;进行 Deep Research 风格流程的研究分析师接近 20 万-50 万;走 Haiku 的客服 Agent 可能在 10 万以内。
构建三个情景——基线、扩张、对抗——并按「席位 + 用量」新公式逐一压力测试。对抗情景应假设零缓存采用、零批处理路由、Opus 默认选择,以及 30% 月环比 token 增长(与报道的需求曲线一致)。该天花板就是带入续约谈判的数字。Enterprise 席位包含的 Anthropic Compliance API 与审计日志访问,是你逐月做检测所需的;签约前请将至少保留 13 个月 token 级用量数据写入合同。
OpenAI 的反向定位与迁移激励
OpenAI 迄今对 ChatGPT Enterprise 保持按席位姿态——公布的费率大致落在 $45-$75/用户/月,150 席起、年付。截至 2026 年 4 月 2 日,OpenAI 推出灵活定价,包含标准席位与 Codex 专用席位,以及在每席位上限之上解锁 Deep Research、Thinking 模型、图像生成与 Codex 额外访问的积分池。入门档结构仍像 SaaS,但积分池机制悄悄为高级特性引入按用量动力。
这造成短期套利。在 2026 年 Q3 与 Q4 走续约的采购团队,会看到 OpenAI 销售明确以「可预测性」对抗 Anthropic 的可变模型。看待这些报价请保持纪律:确认哪些功能在按席位范围内、哪些需要积分扣减,以及池耗尽后超额价是多少。现实结果不是单厂商迁移,而是在双方都设硬上限的双源姿态。
对冲:在单厂商合同之上叠加 BYOK 网关
对抗任何单厂商定价变动最清晰的结构性对冲,是把模型合同与应用解耦。一层持有你 API Key 并跨厂商路由请求的网关,把模型选择从采购承诺变成运行时决策。当 Anthropic 上调价、某档折扣到期或在合同期内弃用某个模型 SKU 时,你可以把 Sonnet 级流量重路由到对位竞品,而不动应用代码。
运维要求并不光鲜但很具体:按请求选择厂商、感知提示缓存以避免重路由后丢失 90% 折扣、按工作区或成本中心做 token 级用量归因、纯透传计费以避免网关本身在厂商列表价之上再加 margin。围绕此模式构建的平台——osFoundry 是其一,建立在 BYOK 透传与无按席位费用之上——可同时位于 Anthropic、OpenAI 与开源权重厂商之前。要点不是放弃厂商,而是保留以小时(而非季度)为单位重谈的选项。
下次续约要做的事
在签下 2026 年续约前把四样东西带到桌上。其一,按用户群组、模型与缓存命中率拆分的 13 个月 token 消耗基线——Anthropic 的 Compliance API 提供原始数据;即便续约还在数月之后也请现在开始检测。其二,让 Anthropic 在书面上承诺价格变更的通知窗口:2026 年的「席位转用量」迁移让客户措手不及,你的合同应要求 90 天通知期方可调整任何费率或档位。
其三,明确谈判 Batch 与缓存折扣的存续性——拿到语言确认 50% Batch 折扣与缓存读取倍率是合同条款,而非可被单方撤销的服务条款。其四,争取允许第三方路由层与 BYOK 立场的网关条款;某些企业合同会悄悄限制转售或代理,你希望在书面上消除这种模糊。如果 Anthropic 在任一项上抵触,那本身就是个有用数据点,说明它预计在你的合同期内行使多少定价灵活性。
Frequently asked questions
- Anthropic 新企业定价对每位客户都生效吗?
- 不是立刻。Anthropic 确认新结构面向 150 席及以上部署,现存高级与标准席位档在合同续约时迁移至「基础费 + 用量」组合模型。较小部署暂留在旧定价,但多数行业分析师预期该模型会随时间向下延伸。实际含义:若你的续约在未来 2-4 个季度且席位数超过阈值,请现在就建一个按用量计费的支出预测,而不是等销售把报价发过来之后。
- 50% Batch 折扣与 90% 缓存读取折扣是永久的吗?
- Anthropic 在当前 API 文档中公布了两者:Message Batches API 对 24 小时内返回的异步请求按标准 token 价 50% 计费;提示缓存对缓存输入读取使用 0.1 倍倍率,等同于 90% 折扣。两者可叠加。它们是文档化功能而非促销定价,但仍属服务条款级承诺,Anthropic 可对其修改。谈判多年企业合同的采购团队应要求合同期内显式保留两种机制的契约语言。
- 没有历史数据如何预测每位用户的 token 消耗?
- 用 Anthropic 的 Compliance API 或你网关的日志,分角色做 2-4 周的检测窗口起步。来自行业报道的有用粗略基线:在 Agent 式 IDE 工作流中使用 Claude 的开发者,每活跃天往往消耗 100 万-300 万 token;研究与分析角色接近 20 万-50 万;高并发的 Haiku 客服自动化常低于 10 万。乘以工作日,套用增长假设(季度环比 15%-30% 是典型值),并就预期的缓存与批处理覆盖率做调整。
- 切换厂商是真实对冲还是仅仅谈判威胁?
- 两者都是,前提是架构支持。真切换需要一层网关或路由,抽象掉厂商特定 SDK,跨重路由保留提示缓存命中率,并按工作区做 token 级用量计量。没有这一层,多厂商可移植性的说法很少能熬过一次真实迁移。有了它,你可按模型类别可信地路由流量,在故障期回退到次选厂商,并在续约对话中使用可度量的弹性而非口头威胁。在需要部署它之前就把能力建起来。
Sources