Back to Journal
02 / Entry· 14 min read

2026 大模型 API 价格与 Code Plan 全景对比:DeepSeek、Kimi、智谱、小米、阿里、腾讯、百度、硅基流动、OpenCode、字节

截至 2026 年 9 月 1 日,联网核对 DeepSeek、Kimi、智谱、小米、阿里、腾讯、百度、硅基流动、OpenCode、字节跳动的 API 价格与 AI 编程套餐。

🔊 系统朗读

前言

这篇文章已经过一次大幅更新,旧版中的 V3、Kimi-k2.5、MarsCode 和“待确认”的 OpenCode 信息已经不能代表现在的产品状态。本文已在 2026 年 9 月 1 日重新核对官方页面,重点区分两类费用:

  1. API 按量价:输入、缓存命中输入、输出,通常按每百万 tokens 计费。
  2. Code Plan:面向 Claude Code、OpenCode、IDE 或官方编程 Agent 的月订阅/额度套餐,不能直接等同于普通 API 余额。

价格、模型和限额都可能临时调整。表格中的 API 价格是各平台公开的代表性文本模型价格;不同地域、上下文长度、峰谷时段、缓存、批量调用和促销活动可能产生不同价格,生产采购前应再次打开官方价格页确认。

一、2026-09-01 价格速览

API 价格单位为“每百万 tokens”。美元价格保持官方原币种,不使用汇率换算,避免把汇率波动误当成模型降价。表内顺序统一为“普通输入 / 缓存命中输入 / 输出”;官方未给出独立缓存价格时记为

厂商/平台当前代表模型API 输入 / 缓存命中 / 输出Code Plan 或编程产品当前判断
DeepSeekV4 Flash / V4 ProFlash:$0.22 / $0.007 / $0.66(闲时);Pro:$0.66 / $0.022 / $1.98(闲时)无官方独立月订阅;可把 API 接入 OpenCode、Claude Code 等V4、1M 上下文、峰谷价
Kimi(月之暗面)Kimi K3$3 / $0.30 / $15Kimi Code:¥49、¥99、¥199、¥699/月K3 已进入 API、Kimi Code 与会员共享积分池
智谱 AIGLM-5.2(普通 API 样例)¥8 / ¥2 / ¥28GLM Coding Plan:Lite ¥49、Pro ¥149、Max ¥469/月;套餐模型为 GLM-5.3 / 5.3-Flash普通 API 与 Coding Plan 型号、账单分开
小米 MiMoMiMo-V2.5 / ProV2.5:$0.14 / $0.0028 / $0.28;Pro:$0.435 / $0.0036 / $0.87MiMo Token Plan:$6、$16、$50、$100/月API 与代码 Agent 订阅并行
阿里云百炼Qwen3.8-Max / Qwen3.8-FlashMax:¥12 / 按缓存规则 / ¥36;Flash:¥0.8 / 按缓存规则 / ¥2.7(中国区标准价)Alibaba Cloud Coding Plan:Pro $50/月;Lite 已停止新购、续费和升级API 已到 Qwen3.8,Coding Plan 当前支持列表仍以 Qwen3.7 等为主
腾讯混元Hunyuan-A13B¥0.5 / — / ¥2CodeBuddy / WorkBuddy:个人免费、标准 ¥99/月、高级 ¥199/月、旗舰 ¥999/月原混元平台正逐步迁移至 TokenHub
百度千帆ERNIE 5.1¥4 / — / ¥18(输入 ≤32K);长输入 ¥6 / — / ¥22Comate 定价:标准版免费;专业版、旗舰版以购买页实时价为准API 与 Comate 分开计费,活动价不写成长期标准价
硅基流动DeepSeek-V4 Flash / V3.2V4 Flash:¥1.5 / ¥0.15 / ¥4.5(低价时段);V3.2:¥4 / ¥0.4 / ¥6截至核验日在官方价格页未见独立 Code Plan;可接入 OpenCode 等聚合平台,模型、价格与时段规则动态变化
OpenCodeZen 模型网关例如 DeepSeek V4 Flash:$0.22 / $0.007 / $0.66(闲时)OpenCode Go$10/月;5 小时 $12、每周 $30、每月 $60 的模型价值上限它是开源编程 Agent/网关,不是基础模型厂商
字节跳动/火山引擎Doubao-Seed-2.1-Pro¥6 / ¥1.2 / ¥30TRAE:Lite $3、Pro $10、Pro+ $30、Ultra $100/月API、豆包会员和 TRAE 是不同产品线

如何读这张表

  • 缓存命中价不等于普通输入价。代码 Agent 会反复提交同一份系统提示词、代码库和工具历史,缓存命中率会显著影响实际账单。
  • Code Plan 不是无限 API。例如阿里云明确要求使用专属 sk-sp- Key 和 Coding endpoint;误用普通 API Key 会按量收费。
  • 标准价、活动价和地区价不能混用。阿里百炼、MiMo、CodeBuddy、Comate、TRAE 等都可能按地区、首购或续费方式展示不同价格。
  • 美元与人民币不能直接排名。更合理的比较方式是用同一输入/输出比例、同一缓存命中率和同一任务集测算总成本。

二、各家当前情况

1. DeepSeek:V4 峰谷价,仍适合做低成本后端模型

官方当前列出 deepseek-v4-flashdeepseek-v4-prodeepseek-v4-flash-vision-exp,均支持 1M 上下文,最大输出 384K。北京时间周一至周五 9:00–12:00、14:00–18:00 是高峰时段,其余为闲时;高峰价格为闲时的 2 倍。

按官方美元闲时价格计算:

模型普通输入缓存命中输入输出
V4 Flash$0.22$0.007$0.66
V4 Pro$0.66$0.022$1.98

高峰价分别为 Flash $0.44 / $0.014 / $1.32、Pro $1.32 / $0.044 / $3.96。DeepSeek 没有独立的官方 Code Plan;需要代码 Agent 时,可以把 V4 API 接入官方列出的兼容工具。人民币账户或第三方平台可能展示人民币价格,应以实际账户计费页为准。

2. Kimi:K3 API 与 Kimi Code 两条产品线

Kimi K3 是当前旗舰,官方给出的 API 价为普通输入 $3、缓存命中输入 $0.30、输出 $15,上下文为 1M。K3 已在 Kimi.com、Kimi Work、Kimi Code 和 Kimi API 上线。

Kimi Code 不是普通 API 包,而是会员权益的一部分。当前自动续费月价为:

会员档位月价会员页列出的 Kimi Code 权益
Andante¥49可用
Moderato¥99可用
Allegretto¥199可用
Allegro¥699可用

全部会员功能共享一个积分池,并按实际 token 消耗;Kimi Code 还受独立的 5 小时窗口和每周频率限制。积分按月刷新且不结转,额度耗尽后可等待刷新、升级套餐或在页面开通 Extra Usage。不要把会员积分当成可任意转给自建后端的 API 余额。

3. 智谱:普通 API 与 GLM Coding Plan 分开核算

智谱的 GLM Coding Plan 是正式订阅产品。当前个人套餐页面显示:

套餐月付5 小时积分每周积分
Lite¥492,00010,000
Pro¥14912,00060,000
Max¥46928,000140,000

所有套餐均支持 GLM-5.3 和 GLM-5.3-Flash;调用 GLM-5.2、GLM-5.1 等历史模型名时会按官方规则自动切换。GLM-5.3 支持 1M 上下文和最大 128K 输出。套餐只在指定的 Claude Code、OpenCode、OpenClaw、TRAE、CodeBuddy 等工具和 Coding endpoint 中抵扣,不能拿普通 API 调用方式绕过规则。

普通 API 价格页是动态页面。为避免把新模型的 Coding Plan 抵扣系数误写成 API 单价,本文仍以可核对的 GLM-5.2 公开价作为普通 API 样例:输入约 ¥8、缓存输入约 ¥2、输出约 ¥28/百万 tokens。GLM-5.3 的普通 API 实际价格以智谱价格页为准。

4. 小米 MiMo:API 很便宜,Token Plan 适合代码 Agent

小米当前公开的 MiMo-V2.5 API 价格为普通输入 $0.14、缓存命中 $0.0028、输出 $0.28;MiMo-V2.5-Pro 为 $0.435 / $0.0036 / $0.87,均支持 1M 上下文。人民币页面对应价格分别为 ¥1 / ¥0.02 / ¥2¥3 / ¥0.025 / ¥6。ASR 按音频小时计费,TTS 当前标注为限时免费。

MiMo Token Plan 的月度套餐为:

套餐月价每月固定 Credits年付总 Credits
Lite$6 / ¥394.1B49.2B
Standard$16 / ¥9911B132B
Pro$50 / ¥32938B456B
Max$100 / ¥65982B984B

首购可享一次 12% 折扣;连续年订阅也有单独折扣,不能把折后价当成长期月度标准价。夜间低谷时段(北京时间 0:00–8:00)按 0.8 倍 Credits 消耗。Credits 不是 tokens,不同模型按不同倍率扣减;套餐仅允许在 MiMo Code、OpenCode、OpenClaw、Codex、Claude Code 等编程工具中使用,禁止用于自动化脚本或自建应用后端。

5. 阿里云百炼:普通 API 已到 Qwen3.8,Coding Plan 仍有独立模型清单

百炼普通 API 价格页当前已列出 Qwen3.8。中国(北京)标准价中的代表模型包括:

模型输入范围输入输出
Qwen3.8-Max≤1M¥12/M¥36/M
Qwen3.8-Flash≤1M¥0.8/M¥2.7/M
Qwen3.7-Plus≤256K¥2/M¥8/M
Qwen3.7-Plus256K–1M¥6/M¥24/M
Qwen3.6-Plus≤256K¥2/M¥12/M
Qwen3.5-Plus≤128K¥0.8/M¥4.8/M
Qwen-Turbo无阶梯¥0.3/M¥0.6/M
Qwen-Long无阶梯¥0.5/M¥2/M

部分模型支持上下文缓存,但官方总价表说明输入价不包含缓存价;显式缓存创建、缓存命中和批量调用使用单独规则。不同区域、上下文阶梯和限时活动价格差异很大,不能只抄一个数字覆盖全部调用。

国际站 Coding Plan 当前只有 Pro:$50/月,上限为每 5 小时 6,000 次、每周 45,000 次、每月 90,000 次;Lite 已停止新购、续费和升级。Coding Plan 当前明确列出的推荐模型仍包括 Qwen3.7-Plus、Qwen3.6-Plus、Kimi K2.5、GLM-5、MiniMax-M2.5 等,并不等同于普通 API 页的全部模型。

最容易踩坑的是 Key:普通 API 使用 sk- Key,Coding Plan 使用 sk-sp- 专属 Key 和 Coding endpoint。两者混用会导致“买了套餐但仍然产生 API 账单”。

6. 腾讯:混元按量价与 Buddy AI 订阅分开

腾讯混元生文计费页列出的 Hunyuan-a13b 价格为输入 ¥0.5、输出 ¥2/百万 tokens;角色、翻译、视觉、Embedding 等模型另有价格。官方同时提示,混元相关能力正逐步迁移到 TokenHub,原平台不再新增模型能力并停止支持新购模型服务;存量服务暂不受影响。新项目应先确认当前应接入的平台和模型。

CodeBuddy 与 WorkBuddy 已纳入 Buddy AI 订阅体系,同一账号共享 Credits。当前个人版为:

版本月付连续包月每月基础积分当前页面展示的限时实得积分
体验版免费500500
标准版¥99¥702,0004,000
高级版¥199¥1404,0009,000
旗舰版¥999¥70020,00050,000

企业旗舰版(SaaS)为 ¥198/人/月,企业专享版(专有云)为 ¥316/人/月。Credits 消耗取决于模型、token 和任务复杂度,不等价于混元 API tokens;赠送积分和活动权益也可能调整。

7. 百度:ERNIE 5.x API + Comate 订阅

百度千帆价格页的代表性价格如下:

模型输入输出
ERNIE 5.1,输入 ≤32K¥4/M¥18/M
ERNIE 5.1,32K–128K¥6/M¥22/M
ERNIE 5.0,输入 ≤32K¥6/M¥24/M
ERNIE 4.5 Turbo¥0.8/M¥3.2/M
ERNIE 4.5 Turbo 缓存命中¥0.2/M

这意味着旧文的 ERNIE-Speed-128K ¥0.3/¥0.6 已不应继续作为当前主推荐。千帆价格页是动态页面,模型版本、输入阶梯和活动价格应以控制台结算口径为准。

Comate(文心快码)是独立代码助手,标准版可免费使用,专业版与旗舰版按独立会员权益收费。购买页可能展示连续包月、月卡或旗舰模型额度活动;本文不再把某一时点的 ¥59、¥79、¥199 等活动数字写成长期标准价,购买前以实时页面、订阅周期和权益说明为准。

8. 硅基流动:聚合 API,不要虚构固定月费订阅

硅基流动的核心产品是按量调用的模型聚合平台。截至本次核验,价格页可见的代表性价格包括:

模型普通输入缓存命中输出
DeepSeek-V4 Flash(低价时段)¥1.5/M¥0.15/M¥4.5/M
DeepSeek-V3.2¥4/M¥0.4/M¥6/M
GLM-5.2¥8/M¥2/M¥28/M

平台模型较多且会动态上下线;同一模型还可能有时段价、上下文阶梯和限速差异。代码场景可以把硅基流动接入 Continue、OpenCode 或其他 OpenAI-compatible 客户端,但“统一 API”不等于“统一订阅额度”。截至核验日,在官方价格页未见固定月费的独立 Code Plan。

9. OpenCode:开源 Agent + Zen/Go,不是基础模型厂商

OpenCode 是开源 AI 编程 Agent,自己不要求购买特定模型;可以接入自有 API、模型供应商或本地模型。官方另提供两种可选付费服务:

  • Zen:按 tokens 计费的模型网关。例如 DeepSeek V4 Flash 闲时为 $0.22 普通输入、$0.007 缓存命中、$0.66 输出/百万 tokens。Zen 当前还列出 Kimi K3、GLM-5.2、Qwen3.7、MiMo、GPT、Claude 等模型。
  • Go$10/月,当前模型列表已包含 GLM-5.3、Kimi K3、Qwen3.8、DeepSeek V4 和 MiMo-V2.5 等。限制为每 5 小时 $12、每周 $30、每月 $60 的模型价值上限,实际请求数量取决于所选模型。

Go 面向 OpenCode 及会产生类似交互式编程请求的 Agent;它不是可随意用于业务后端的通用 API 资源包。达到 Go 上限后,可以选择停止调用,或在开启相应设置后回退到 Zen 余额按量计费。

10. 字节跳动:Doubao-Seed API 与 TRAE 订阅分开

火山引擎当前模型价格资料中的 Doubao-Seed-2.1-Pro API 参考价为普通输入 ¥6、缓存读取 ¥1.2、输出 ¥30/百万 tokens。缓存写入还可能按存储时长计费;具体模型版本、上下文长度、活动价和计费项应以火山方舟控制台及模型价格文档为准。

TRAE 已公开个人订阅价格,旧文“价格页未公开统一数字”的说法已经过时:

TRAE 套餐月价页面列出的基础用量云任务并发
Free免费Limited usage2
Lite$3$5 Basic usage2
Pro$10(当前页面展示 7 天免费试用)$20 Basic usage10
Pro+$30$90 Basic usage15
Ultra$100$400 Basic usage20

各档均包含无限 Autocomplete 和 TraeCode SOLO mode;额度、排队优先级和试用活动以实时页面为准。TRAE 会员、豆包 C 端会员与火山方舟 API 是不同产品,不能互相替代或把会员价换算成 API 单价。

三、Code Plan 横向比较

产品当前月价额度/计费方式是否适合自建后端 API
Kimi Code¥49 起会员功能共享积分池;另有 5 小时窗口和每周频率限制否,后端应使用 Kimi API
GLM Coding Plan¥49 / ¥149 / ¥4695 小时 + 每周积分,支持指定编码工具否,套餐 endpoint 有使用范围
MiMo Token Plan$6 / $16 / $50 / $100月度 4.1B / 11B / 38B / 82B Credits否,条款明确禁止自动化脚本和应用后端
Alibaba Coding Plan$50 Pro5 小时、周、月请求上限否,禁止脚本和业务后端调用
Tencent Buddy AI免费 / ¥99 / ¥199 / ¥999Credits、自动任务、模型调度否,独立于混元 API
Baidu Comate标准版免费;付费档以实时页为准会员功能 + 智能体额度否,API 另走千帆
OpenCode Go$105 小时/周/月模型价值上限仅限 OpenCode Go 允许的 Agent 请求
TRAE免费 / $3 / $10 / $30 / $100Basic usage + 云任务并发等权益否,独立于火山方舟 API
SiliconFlow无固定月费模型按量计费可以,但按 API 价格收费
DeepSeek无独立 Code PlanAPI 按峰谷时段和缓存计费可以

选择时最重要的三个区别

  1. API 价格看 tokens,Code Plan 看额度和限制:订阅便宜不代表能无限运行长任务。
  2. 代码 Agent 的真实成本由缓存命中率决定:同一个模型,短对话和仓库级多轮 Agent 的账单可能相差一个数量级。
  3. 套餐 Key 往往有工具限制:阿里、智谱、MiMo、OpenCode 等都区分普通 API 与编码套餐的 endpoint 或使用范围;不要将套餐 Key 嵌入线上服务或自动化脚本。

四、按场景怎么选

个人开发者 / 轻量学习

  • 想要固定月费:优先比较 GLM Coding Lite、MiMo Token Plan Lite、OpenCode Go、TRAE Lite/Pro,注意地区、支付、积分规则和工具兼容性。
  • 想要完全按量:DeepSeek V4 Flash、MiMo-V2.5、Qwen3.8-Flash、Qwen-Turbo 或硅基流动的低价模型更容易控制预算。
  • 需要 K3 或大型仓库:比较 Kimi Code 的会员积分与 Kimi API,不要用普通会员权益代替后端 API。

创业项目 / MVP

  • 生产 API 用正式平台的普通 Key,优先选择有缓存、日志、限速和余额告警的服务。
  • 代码 Agent 可以单独购买 GLM Coding、Alibaba Coding Plan、OpenCode Go 或 TRAE,但把它当开发工具预算,不要计入生产 API 单价。
  • 用聚合平台做模型 A/B 测试时,要保存模型 ID、价格快照和调用量,避免模型下线或价格调整后无法复盘。

企业生产环境

  • 先确定数据地域、保留策略、SLA、并发和发票,再比较每百万 tokens。
  • 需要权限、团队账单和私有化时,优先评估百炼、腾讯 Buddy AI 企业版、百度 Comate 企业版等正式产品。
  • 高峰期明显的 Agent 任务,应测算峰谷价、缓存命中率、重试成本和上下文膨胀,而不是只看“输入价格”。

五、结论

截至 2026 年 9 月 1 日,这十个名字并不属于同一类产品:

  • API 性价比:DeepSeek V4 Flash、MiMo-V2.5、Qwen3.8-Flash/Qwen-Turbo 和硅基流动上的低价模型值得优先压测。
  • 代码订阅完整度:智谱 GLM Coding、阿里 Coding Plan、Kimi Code、MiMo Token Plan、OpenCode Go 和 TRAE 都已有明确产品形态,但额度规则不同。
  • 工具定位:OpenCode 是开源编程 Agent/网关;SiliconFlow 是模型聚合 API;腾讯 Buddy AI、百度 Comate、字节 TRAE 是代码产品,不能把它们的会员价当成基础模型 API 价。
  • 最稳妥的做法:用官方价格页建立一份带日期的价格快照,按自己的输入/输出比例、缓存命中率和每月任务数计算总账单,再决定长期订阅或按量调用。

六、官方链接

更新日志

  • 2026-09-01:重新核对十家平台官方页面,将快照日期更新至 2026-09-01。
  • 2026-09-01:修正 MiMo 月度 Credits,明确 49.2B / 132B / 456B / 984B 为年付总额度;补充首购、年付和夜间折扣适用范围。
  • 2026-09-01:加入 Qwen3.8-Max / Flash,区分百炼普通 API 与 Coding Plan 模型清单,删除未直接核实的固定缓存价。
  • 2026-09-01:补充腾讯混元迁移 TokenHub、Buddy AI 积分与折扣;将百度易变活动价改为实时页面口径。
  • 2026-09-01:补充 TRAE Lite / Pro / Pro+ / Ultra 公开价格,删除“TRAE 未公开统一价格”的过时判断。
  • 2026-09-01:统一所有价格表为“普通输入 / 缓存命中 / 输出”顺序,并明确币种、地区、阶梯价和活动价边界。

价格是动态信息。本文记录的是 2026 年 9 月 1 日核对到的公开价格快照,后续调整请以各厂商官方页面和实际账户结算页为准。


本文由 Jay's Studio 整理发布,转载请注明出处。最后更新时间:2026 年 9 月 1 日

分享
← 返回博客列表
🎁 有邀请福利哦,点击查看
🎁