莱客AI商学院/文章/国产模型选型:DeepSeek、豆包、GLM、Kimi、Qwen 各自的位置
深度文章免费

国产模型选型:DeepSeek、豆包、GLM、Kimi、Qwen 各自的位置

同一个币种里,两家的挂牌价几乎重合;真正差出约 30 倍的,是缓存命中那一栏——而第五家的价格,我们四次都没取到

莱客编辑部2026-07-13预计 7 分钟
国产模型选型:DeepSeek、豆包、GLM、Kimi、Qwen 各自的位置 封面

文章目录

共 4 节
01一、五格里有四格能填,第五格我们没取到02二、真正拉开差距的那一栏,叫缓存命中03三、五家各自的位置:一张按场景的对照表04四、什么时候这张表不成立

¥6 和 ¥6.5。¥30 和 ¥27。

前一组是输入价,后一组是输出价,单位都是每百万 token。它们分别来自两家不同的国产模型厂商的公开口径。输入差五毛,输出差三块。

也就是说,在这一档上,"选哪一家"基本不是价格问题。

而在同一批公开价目页上,另一栏的差距是 约 30 倍。那一栏叫缓存命中,绝大多数选型讨论里没有它。

这一篇只做一件事:把五家能核到的公开口径摆出来,按场景给一张对照表。它不做排名,也不做推荐——因为不存在"最好的国产模型",只存在"你这个场景最划算的那一个"。价格全部取自各家官方页面,采集日为 2026 年 8 月 18 日——本文首发于 2026 年 7 月 13 日,其中 DeepSeek 一家在 2026 年 8 月 16 日改了计价结构并全线上调,所以价格这一节按新快照整体重出了一遍。除 DeepSeek 外,各页均未标注生效日期,这一点后面还会再提一次。

一、五格里有四格能填,第五格我们没取到

先说清楚一条口径纪律:下面的价格分成人民币和美元两组,本文不做汇率换算,也不把两组放进同一次比较。 我们没有找到任何一家官方页面给出把两种货币放进同一张表的依据,所以两组请分开看。

人民币这一组:

厂商 / 型号输入(每百万 token)输出(每百万 token)缓存命中
字节 豆包 2.1 Pro¥6¥30¥1.2
月之暗面 kimi-k2.6¥6.50¥27.00¥1.10
月之暗面 kimi-k2.7-code¥6.50¥27.00¥1.30
月之暗面 kimi-k2.7-code-highspeed¥13.00¥54.00¥2.60
月之暗面 kimi-k3¥20.00¥100.00¥2.00

豆包那一行据新华网 2026 年 6 月 23 日的报道;月之暗面那三行取自其官方定价文档页。

美元这一组:

厂商 / 型号输入(每百万 token)输出(每百万 token)缓存命中
DeepSeek V4-Flash(0731)$0.22–$0.44$0.66–$1.32$0.007–$0.014
DeepSeek V4-Pro(0813)$0.66–$1.32$1.98–$3.96$0.022–$0.044
智谱 GLM-5.2$1.4$4.4$0.26
智谱 GLM-4.5-Air$0.2$1.1$0.03

两组数字都取自各家自己的官方定价页。

DeepSeek 这两行是区间价而不是单价:低谷价是高峰价的一半,高峰时段为世界协调时 01:00–04:00 与 06:00–10:00。所以「DeepSeek 多少钱」这个问题在这一家没有唯一答案,取决于你的活跑在几点。夜里能跑的批量任务,单价直接减半。

第五格是空的。

阿里云百炼(通义千问)的每百万 token 挂牌价,我们没有取到一手页面。四次尝试的结果如实写在这里:官方模型文档页能正常打开,但那一页只有在售型号清单和 API 兼容说明,没有价格;`models-billing` 这个路径返回 404;标题写着"阿里云百炼模型价格"的那一页能返回标题,正文的价格表取不到;从阿里云价格中心进去的那条路径发生 302 跳转,跳过去之后是 404。

所以这一格本文不给数字。市面上能搜到的通义千问报价,我们看到的全部是第三方整理与社区文章,没有一份能直接对上官方页面上的原文。如果有人拿一个通义千问的单价来给你做方案,先问他一句:这个数出自哪一页,把链接给我。

一张选型表里有一格是空的,不好看,但它比填一个来路不明的数字诚实。空格提醒你去问出处,假数字不会。

这一格空着,不代表这家不该选。第三节会说明它在什么场景下反而是最省事的那一个——那些理由不依赖价格。

二、真正拉开差距的那一栏,叫缓存命中

把上面两张表最右边那一栏单独拎出来,除一次。

型号标准输入价 ÷ 缓存命中价倍数
DeepSeek V4-Pro1.32 ÷ 0.04430 倍
DeepSeek V4-Flash0.44 ÷ 0.014约 31 倍
月之暗面 kimi-k2.66.50 ÷ 1.10约 5.9 倍
智谱 GLM-5.21.4 ÷ 0.26约 5.4 倍
字节 豆包 2.1 Pro6 ÷ 1.25 倍

这五次除法是我们自己做的,分子分母都写在上面那两张表里,各家官方页面没有公布这个倍数。

结论很硬:同样是"缓存能省钱",DeepSeek 那两行和其余三行不在一个数量级上。 其余三家给的是五到六折那种量级的优惠,DeepSeek 给的是把标准输入价砍掉约九成七。

这件事的实际含义,取决于你的活长什么形状。

如果你的活是"同一份长东西被反复问" —— 同一份产品手册被客服反复检索、同一套判断标准被审核反复调用、同一份报关模板被批量套用 —— 那么你每一次请求里,都有很大一块输入是完全一样的。这一块能不能按缓存命中价计费,对账单的影响比"换一家厂商"大得多。

如果你的活是每次输入都完全不同 —— 每条内容都是新的、没有可复用的前缀 —— 那么上面那一整栏对你不存在,缓存价是一个你永远用不上的价格,选型要回到标准价那两栏去比。

顺带把两个容易被忽略的规格也放进来,它们同样出自 DeepSeek 官方定价页:两个型号都支持 100 万 token 上下文最大输出 384K token。上下文长度不是越大越好,但它决定了一件很具体的事——你能不能把一整份合同、一整本手册一次性丢进去,而不是先自己切块。要不要为这件事付钱,取决于你有没有人手去做切块这一步。

这一栏还有一件事必须写进来,因为它已经发生过一次:DeepSeek 的官方定价页上曾经写着一句涨价预告,原文是「We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.」。那句话已经不在页面上了,因为它兑现了——2026 年 8 月 16 日 16:00(UTC)起,同一个页面上的挂牌价改成高峰 / 低谷两档,输入与输出涨到原先的约三倍,缓存命中价涨到原先的五到十二倍。页面现在只剩下「product prices may vary and DeepSeek reserves the right to adjust them」。

这件事的教训比数字本身值钱:定价页上的一句预告,是这一整篇里唯一一个提前告诉你未来账单的字段。 看到它,就该把合同期缩短,而不是记下当天那个数。

上面所有价格都取自 2026 年 8 月 18 日的页面。DeepSeek 那两行的生效时点是 2026 年 8 月 16 日 16:00(UTC),其余各页均未标注生效日期。任何一张模型价目表都有保质期,做超过半年的预算之前,把这几页重新打开一次。

三、五家各自的位置:一张按场景的对照表

下面这张表的用法是:先找到你那一行的场景,再看那一格给的依据能不能核验。它不是排名,同一家可以落在多行,也可以在某一行里完全不露面。

你的场景先试哪一家依据(可核验的那一条)这一格的代价
同一份长文档 / 长提示词被反复问(客服问答、单据审核、批量抽取)DeepSeek缓存命中价与标准输入价差约 30 倍(两个型号相当),两个型号都支持 100 万 token 上下文、最大输出 384K,且低谷时段单价减半那句涨价预告已在 2026 年 8 月 16 日兑现,挂牌价改成了高峰 / 低谷两档
要开人民币发票、走国内云、给财务好交代豆包 / 月之暗面两家均以人民币公开计价,¥6 与 ¥6.5 的输入价、¥30 与 ¥27 的输出价本文未取到这两家的美元口径,跨境结算的场景要另外问
担心"哪天 API 没了",想留一条自己能跑的路智谱 GLMGLM-5.2 为 744B 参数、MIT 协议开源,据其官方资料全程在昇腾 910B 上训练完成,2026 年 6 月 13 日起向 GLM Coding Plan 用户全量开放权重开源不等于免费——自己跑要算卡、电、人,这笔账另有一篇专门算
成本敏感、任务简单、量大(分类、抽取、格式化)DeepSeek V4-Flash / GLM-4.5-Air高峰 $0.44 / $1.32(低谷减半)与 $0.2 / $1.1,是美元这一组里最低的两档便宜档必须配一条不靠人就能判对错的校验规则,否则错误会静悄悄地流下去
代码与智能体类的活,且你愿意跟版本月之暗面K2.7 Code 的高速版明码标价:¥13 / ¥54,正好是标准版 ¥6.5 / ¥27 的 2 倍,换来的是约 180 tokens/s 的输出速度(据新浪科技 2026 年 6 月 15 日报道其上线,"2 倍价格、最快 6 倍速")这一家的版本更替最快,且 K2 系列已于 2026 年 5 月 25 日整体下线——不适合接完三年不想动的系统
要国产最强的那一档、且愿意为它单独付钱月之暗面 kimi-k32.8 万亿参数、1,048,576 token 上下文,官方挂牌 ¥20 输入 / ¥100 输出 / ¥2 缓存命中输出价是 k2.6 的近四倍,「最强」这一档的溢价在这一行看得最清楚
已经在阿里云上,想让迁移成本最低阿里云百炼(通义千问)官方模型文档页写明同时提供 OpenAI、Anthropic、DashScope 三种 API 兼容格式,且在北京、新加坡、东京、法兰克福、弗吉尼亚等多个地域可用⚠️ 本文未取到它的一手报价页,价格这一格空着

"2 倍价格换约 6 倍速度"这一行值得单独说一句,因为它是这张表里唯一一个厂商自己把取舍明码标价的例子。速度值不值 2 倍的钱,不是一个技术问题,是一个业务问题:客户在对话框里等着的场景,速度可能值;夜里跑的批量任务,速度一文不值。能被明码标价的取舍,是好事——它把决定权交回给你。

三步走法,顺序不能换:

第 1 步。先写下你这类请求的形状,只写三行。 一次请求大概多少输入、多少输出;这些输入里有多少是每次都一样的;这件事赶不赶时间。三行写不出来,后面两步是空谈——大多数选型讨论卡住,是因为卡在这三行上,不是卡在选哪家上。

第 2 步。用第一行去比标准价,用第二行去比缓存价。 第二行如果占到输入的一半以上,那么第二节那张倍数表的权重,要高于第一节那两张挂牌价表。

第 3 步。攒 30 条真实任务,同一份提示词,在最后剩下的两家上各跑一遍。 只记两个数:返工了几条、总共花了多少钱。这一步之前所有的比较都只是筛选,这一步才是决定。别用示例数据,用你自己的单据、你自己的客户消息。

四、什么时候这张表不成立

第一,挂牌价从来不等于账单。 上面所有的数都是单价,你的账单还要乘上重试、乘上被浪费掉的长上下文、乘上那些本来不该发出去的请求。一张只比单价的选型表,最多能帮你把候选从五家缩到两家,它做不了最后那个决定。

第二,这张表的保质期很短。 五家里,仅在 2026 年 4 月到 8 月这五个月内,公开可查的动作就有:DeepSeek 于 4 月 24 日发布 V4 双型号、并已在 8 月 16 日完成一次幅度显著的整体调价并改成高峰 / 低谷两档,智谱于 6 月 13 日全量开放 GLM-5.2,月之暗面于 6 月 15 日上线 K2.7 Code 高速版、于 7 月发布 K3,同时它的 K2 系列已于 5 月 25 日整体下线、K2.5 与 Moonshot V1 也公告 8 月 31 日全平台下线。五个月内六次变动。 你把这张表打印出来贴在墙上,三个月后至少有两行是过期的。

第三,不要按"哪家最强"选。 本文通篇没有引用任何一个能力评分,这是刻意的:评分是把成千上万个任务压成一个数,而你要的是它在你那 30 条上的表现。第三节第 3 步才是决定,前面全是筛选。

第四,开源不等于免费,也不等于你跑得起来。 MIT 协议开源解决的是"这条路存在",不解决"这条路你走得起"。自己跑要算卡、电、折旧和一个能维护它的人,那个人的时间不在任何一张价目表上。把开源当成一条备用路线是对的,当成一条省钱路线通常是错的。

第五,缓存的前提是你真的有固定前缀,而且你真的把它放在了前面。 同样一份系统提示词,写在请求的开头和拆散在中间,命中率完全不同。第二节那约 30 倍,是一个需要你改一次请求结构才能拿到的数,不是开箱即得。

第六,如果你一个月的模型账单还不到一顿饭钱,这一整篇对你没用。 那就随便挑一家能开票的先用着,把量做起来。在账单变成一个每月都要看一眼的数字之前,选型的人力成本比省下来的钱贵。

最后回到那个空格。五家里有一家的价格我们没拿到,这件事本身就是这篇文章最实用的一条提醒:当一个数字在网上到处都是、却在官方页面上找不到的时候,问题多半不在你的搜索能力上。 拿不到就写"拿不到",然后带着这个问题去问销售——他给不出链接,你就知道该怎么看待他后面那份报价单了。

这套按场景选型的完整打分表与提问清单,在《DeepSeek企业实战》第 1 课里有配套的表格。

本文事实来源

可自行复核
  1. 1

    DeepSeek 官方定价页:2026 年 8 月 16 日 16:00(UTC)起改为高峰 / 低谷两档计价并全线上调。按 2026 年 8 月 18 日的挂牌价,deepseek-v4-flash(0731)输入缓存未命中 $0.22–$0.44 / 缓存命中 $0.007–$0.014 / 输出 $0.66–$1.32;deepseek-v4-pro(0813)输入缓存未命中 $0.66–$1.32 / 缓存命中 $0.022–$0.044 / 输出 $1.98–$3.96(低谷价为高峰价的一半,高峰时段为世界协调时 01:00–04:00 与 06:00–10:00);两个型号均为 100 万 token 上下文、最大输出 384K。页面上原有的那句涨价预告「We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.」已随本次调价落地而撤下,现只余「product prices may vary and DeepSeek reserves the right to adjust them」。本条采集于 2026 年 8 月 18 日

    DeepSeek 官方页面未标注日期

  2. 2

    DeepSeek 官方公告:2026 年 4 月 24 日发布 DeepSeek-V4-Pro(1.6T 总参数 / 49B 激活)与 DeepSeek-V4-Flash(284B 总参数 / 13B 激活),均支持 100 万 token 上下文

    DeepSeek 官方2026-04-24

  3. 3

    智谱 Z.ai 官方定价页:GLM-5.2 输入 $1.4 / 输出 $4.4 / 缓存输入 $0.26;GLM-4.5-Air 输入 $0.2 / 输出 $1.1 / 缓存输入 $0.03。该页未标注生效日期

    智谱 Z.ai 官方页面未标注日期

  4. 4

    GLM-5.2:744B 参数、MIT 协议开源,据其官方资料全程在华为昇腾 910B 上训练完成;2026 年 6 月 13 日起向 GLM Coding Plan 用户全量开放

    智谱 Z.ai 官方钛媒体新浪财经2026-06-13

  5. 5

    月之暗面 Kimi 官方定价页:kimi-k2.6 输入缓存命中 ¥1.10 / 未命中 ¥6.50 / 输出 ¥27.00,上下文 262,144;kimi-k2.7-code 输入缓存命中 ¥1.30 / 未命中 ¥6.50 / 输出 ¥27.00;kimi-k2.7-code-highspeed ¥2.60 / ¥13.00 / ¥54.00,输出速度约 180 Tokens/s。该页未标注生效日期。k2.6 的发布时点本文未取到一手页面,但它在版本序列上早于 K2.7 Code

    Kimi 官方Kimi 官方页面未标注日期

  6. 6

    月之暗面官方模型文档页:kimi-k2 系列(`kimi-k2-0905-preview`、`kimi-k2-0711-preview`、`kimi-k2-turbo-preview`、`kimi-k2-thinking`、`kimi-k2-thinking-turbo`)「已于 2026 年 5 月 25 日下线」

    Kimi 官方持续更新的文档,本文只引这一条

  7. 7

    新浪科技:月之暗面 Kimi K2.7 Code 模型高速版上线,「2 倍价格、最快 6 倍速」

    新浪财经2026-06-15

  8. 8

    新华网:豆包 2.1 Pro 输入 ¥6 / 输出 ¥30 / 缓存 ¥1.2(每百万 token)

    新华网2026-06-23

  9. 9

    阿里云百炼官方模型文档页:可读到在售型号清单与 API 兼容说明(同时提供 OpenAI、Anthropic、DashScope 三种格式),可用地域包含北京、新加坡、东京、法兰克福、弗吉尼亚;该页不含价格。另三条路径的实测结果:`models-billing` 返回 404;标题为「阿里云百炼模型价格」的页面只返回标题、价格表取不到;阿里云价格中心的百炼详情页 302 跳转后返回 404。因此本文不给通义千问的任何单价数字

    阿里云阿里云2026-07 实测