价格系列专题 · 2026-08-12 首期
模型价格战:DeepSeek 的低价与 Claude 的永久降价,正在改变什么?
模型能力决定上限,token 价格决定多少产品能把能力放进每一次用户动作里。这个专题不做一张脱离任务质量的排行榜,而是持续记录价格、缓存、长上下文和临时优惠怎样改写 AI App 的成本结构。
本周信号:Claude 把 Sonnet 5 的低价改成了永久价格
Claude Sonnet 5 当前为 $2 输入 / $10 输出,较 Sonnet 4.6 的 $3 / $15 每 token 低 33.3%。Anthropic 在 2026-08-10 更新发布页,将原定 8 月 31 日到期的导入价改为永久价格。但新 tokenizer 对同一文本可能产生约 1.0–1.35 倍 token,所以名义降幅不能直接等同于每项任务的账单降幅。
当前公开 API 标价
单位均为美元 / 100 万 token。标准输入、缓存命中输入、输出分列;不含批处理、工具调用、搜索、存储、地区溢价、税费和企业折扣。两组只是采购场景,不代表模型能力相等。
| 公司 | 模型 | 标准输入 | 缓存命中 | 输出 | 状态 | 口径说明 |
|---|---|---|---|---|---|---|
| DeepSeek | DeepSeek V4 Flash | $0.14 | $0.0028 | $0.28 | GA | 标准输入为缓存未命中价;缓存命中单列。 |
| OpenAI | GPT-5.6 Luna | $0.2 | $0.02 | $1.20 | GA | 输入超过 272K token 时使用更高的长上下文费率。 |
| Gemini 3.5 Flash-Lite | $0.3 | $0.03 | $2.50 | GA | 付费标准层;输出价包含思考 token。 | |
| Anthropic | Claude Haiku 4.5 | $1 | $0.1 | $5 | GA | Claude 第一方全球 API;缓存命中单列。 |
| DeepSeek | DeepSeek V4 Pro | $0.435 | $0.003625 | $0.87 | GA | 标准输入为缓存未命中价;官方 API 支持思考与非思考模式。 |
| Anthropic | Claude Sonnet 5 | $2 | $0.2 | $10 | new-permanent | Anthropic 于 2026-08-10 将 $2 输入 / $10 输出改为永久价格。 |
| OpenAI | GPT-5.6 Terra | $2 | $0.2 | $12 | GA | 输入超过 272K token 时,输入为 2 倍、输出为 1.5 倍。 |
| Gemini 3.1 Pro Preview | $2 | $0.2 | $12 | preview | 付费标准层、输入不超过 200K;长上下文费率更高。 |
DeepSeek 的价格不是“小幅便宜”,而是另一个数量级
DeepSeek V4 Pro 官方价为 $0.435 输入、$0.87 输出;V4 Flash 为 $0.14 输入、$0.28 输出。缓存命中价进一步降到 $0.003625 和 $0.0028。单看公开 token 价,它明显低于本页列出的其他国际厂商同场景产品。
但低价不自动等于所有任务上的最高性价比。真实采购要把任务成功率、重试次数、延迟、可用地区、稳定性、上下文使用和工具调用一起算入。这个专题把“价目表事实”与“任务表现判断”分开。
Claude 的动作说明价格战已进入前沿模型,而非只在小模型发生
Sonnet 5 把标准输入和输出每 token 价格同时下调三分之一,并把缓存命中降到 $0.20。它不是 Anthropic 全线降价,却是一个明确的市场信号:前沿工作负载的竞争已经从能力榜扩展到永久单位成本。
真正应跟踪的是客户在新 tokenizer 下得到多少实际账单下降,以及 DeepSeek、OpenAI、Google 是否用更低的标准价、缓存价或 batch 价继续回应。
这会压向哪些 App?
- 薄模型 wrapper: 当底层推理越来越便宜,单纯转售模型调用的毛利和差异化同时被压缩;产品必须证明工作流、数据、分发或结果层价值。
- AI 网关与模型路由: 纯价格套利的空间缩小,路由产品更需要在可靠性、治理、评测、区域合规和多模型故障切换上建立价值。
- 传统 SaaS 的 AI 加价包: 模型成本下降会削弱高额 AI add-on 的成本借口,推动按席位溢价转向按结果、额度或整套工作流定价。
- 垂直 Agent 与自动化 App: 更低推理成本让长链任务、重试和后台执行更可行,也会让更多垂直产品把 Agent 直接做进核心功能。
我们怎样比较
只录官方第一方公开价格;主表统一为美元 / 100 万文本 token,并把标准输入、缓存命中与输出拆开。免费额度、订阅、批处理、图像/音频、工具、搜索和企业折扣另记,不混进主表。
模型并非等能力商品。表格用于观察成本曲线和定价动作,不用于单独证明性能、质量或最终账单。长上下文分档、tokenizer、思考 token、缓存写入与区域溢价都可能改变实际成本。
什么算“重大变化”
每周扫描官方价格页;命中以下任一条件,就进入专题更新工单,并在人工复核后发布新一期:
- 所跟踪模型的标准输入或输出价变化至少 20%;
- 前沿/通用模型出现新的长期低价基准,或限时价到期、延长;
- 缓存、batch 或免费层变化足以让代表性工作负载成本改变至少 30%;
- 价格之外的 tokenizer、长上下文分档或工具费变化,导致实际账单方向反转。
第 1 期|DeepSeek 建立低价锚,Claude 把低价变成永久价格
2026-08-12:建立四家厂商、八个模型的统一基线。首个明确事件是 Anthropic 在 8 月 10 日将 Sonnet 5 相对上一代低 33.3% 的每-token 价格转为永久价;DeepSeek V4 Pro/Flash 则继续构成当前表中最低的公开标准价和缓存命中价。下一观察点是竞争对手是否跟价,以及真实工作负载账单是否同步下降。
官方来源
价格会变化。引用本页时请同时保留核验日期,并优先回到厂商原始价格页确认。
- DeepSeek API Models & Pricing — DeepSeek
- Claude Platform model pricing — Anthropic
- Introducing Claude Sonnet 5 — Anthropic
- GPT-5.6 Terra model page — OpenAI
- GPT-5.6 Luna model page — OpenAI
- Gemini Developer API pricing — Google
模型专题系列
- Claude Academy:AI 素养的责任由谁承担? — Anthropic 推出了一所免费的 AI 学习学院。其公开框架不只谈提示词,也谈委派、判断与披露。这是一项有意义的公共资源,同时也引出更难的问题:当制造冲击的模型公司也开始颁发“适应冲击”的凭证,机构责任在哪里结束,个人责任又从哪里开始?
- 美团 All-in AI:执行代价 — All-in AI 易于宣布,难在治理。战略紧迫感一旦碰上代码来源、商家同意权和组织激励,账单就会出现:留给核验与回滚的时间越少,速度越昂贵。本文严格拆开已经多源核实的公开记录与两条单源弱信号;它讨论的是治理问题,不把个案写成 AI 投资本身已经失败。
- AI Token 货币化:Token 是新美元 — Stripe 技术与业务总裁 Will Gaybrick 在 Stripe Sessions 台上,把一个演示应用从每次评审固定收 2 美元,改为每 100 万 Token 收 3 美元,随后又让稳定币随着每个 Token 的消耗实时流入。这不只是一场计费演示:软件正在从席位和包月访问转向计量智能——每一单位模型工作都带着价格、毛利、欺诈风险和结算事件。本站的命题是:Token 正在成为 AI 软件的新美元;它是机器工作的计价单位,不是法币,也不是美元替代品。
- Stripe × OpenRouter:Token 货币化的起点 — 先把报道中的 80 亿美元放到一边。Stripe 作为互联网支付龙头,选择收购的不是一家模型公司,而是连接 AI 应用与数百个模型的中转站。这才是新闻的意义:Stripe 在押注 AI 经济最重要的层,不只负责生产智能,还要把智能变成可交换的价值。今天 LLM Token 只是计费单位;明天,跨模型的 AI Token 可能像 BTC、ETH 开启的那代数字资产一样被持有、转移和结算——它代表的不是数字稀缺或链上 Gas,而是一份可调用的智能。Axios 报道交易超过 80 亿美元;截至本次更新,两家公司仍未公开确认。
- Grok Bot:xAI 给每个 Agent 配了一台自己的电脑 — 2026 年 8 月 11 日以早期 beta 发布的 Grok Bot,把 Agent 从聊天窗口变成了同事:每个 Bot 拥有一台持久的云端计算机,登录你已有的工具,在你不在时持续工作。我们从发布第一天用到现在。产品问世仅数日、公开信息还很有限,本篇因此以实测观感为主、机制事实为辅——把已核实的、公司自述的与本站判断分开呈现。
- Kimi:Moonshot 冲向前沿的开源权重打法 — 四个月里,Moonshot 先放出一个万亿参数的开源权重主力模型,又推出号称 2.8 万亿参数的 Kimi K3,在需求压垮容量时暂停了新用户付费订阅,然后直奔港股上市窗口。本档案把有源可查的、公司自述的与本站判断分开呈现。
- 智谱(Z.ai):第一家上市大模型公司与 GLM 的 Agent 押注 — 智谱比任何大模型实验室都更早抵达公开市场——2026 年 1 月在港交所挂牌——随后几个月把 GLM-5 线推进到开源权重的 Agent 旗舰,同时两次上调价格。本档案收录有源可查的记录:模型线、phone-use 押注、经济账,以及本站对「上市实验室」意味着什么的判断。
- 千问:开源权重霸主开始给王冠标价 — 阿里千问是全球下载量最大的开源权重模型家族——按公司口径,累计超三十亿次下载、占开源市场一半以上。2026 年 8 月,它发布了迄今最大的旗舰,把价格压到远低于美国前沿水平,同时第一次给开源权重加上了收益分成许可。本档案收录有源记录与本站对这次转向的判断。
- DeepSeek:价格锚开始移动 — R1 时刻把「白菜价前沿」定为行业参照系的十八个月后,DeepSeek 把 V4-Pro 推到正式可用——同一周宣布 API 最高上调 1,100%,并引入行业第一个 token 峰谷计价。锚定了价格战的实验室,自己开始重定价。本档案收录有源记录与本站判断。
- MiniMax:首日翻倍的多模态之虎 — MiniMax 在智谱之后一天登陆港交所,首日股价翻倍。但它为本系列收官,不是因为上市,而是因为产品面:前五篇覆盖的是文本与 Agent,MiniMax 卖的是商品价的视频、语音和音乐——冲击波因此指向另一群人:创作者。本档案收录有源记录与本站判断。
- Manus 特刊 — 本站数字劳动力叙事的锚点特刊。