莱客AI商学院/文章/私有化部署到底值不值:一张三年总成本表
深度文章免费

私有化部署到底值不值:一张三年总成本表

硬件之外还有四行,多数人一行都没填。按广东电网 2026 年 4 月的官方电价表算完,三年电费只有 2199 元到 16311 元——大头从来不在这里

AI 企业专家 · 企业落地组2026-07-24预计 8 分钟
私有化部署到底值不值:一张三年总成本表 封面

文章目录

共 5 节
01一、五行,和一个只填了第一行的普遍做法02二、电费这一行:用官方电价表算,答案在两千二到一万六之间03三、剩下三行:为什么我给不了数字04四、对照面:同样这笔钱,按 token 付能买到什么05五、什么时候这张表算完也不该买

三个数,先摆出来。

17.38 万元——这是一台 RTX 4090 配置的大模型一体机的一条成交记录(头豹研究院,2025 年 5 月)。

5437 元——这台机器如果 7×24 不停地跑,一年的电费。

2199 元——同一台机器,如果把活全排到夜里跑,三年的电费。

第三个数是三年,不是一年。也就是说:很多人在采购会上争论最久的那一项,在三年总账里连百分之二都占不到。

这篇要给的就是那张表:五行,逐行说清口径怎么定、数从哪来、哪些行我给不了数字而只能给你填法。表的对照面不是「租一张卡多少钱」,而是"同样这笔钱按 token 付,能买到什么"——按卡时租算力是另一笔账,本文不算。

一、五行,和一个只填了第一行的普遍做法

这张表长这样。先看"口径"这一列,不要急着看数字。

项目口径(怎么算)数从哪来
1硬件采购一次性,含税到货价供应商报价单
2电费铭牌功率 × 实际运行小时数 × 落在哪个时段的电价,再 ×3 年电网公司当月电价表 + 你自己定的运行时段
3折旧取"财务年限"和"技术年限"里短的那一个财务给前者,你自己判断后者
4运维的人那个人的月成本 × 他花在这台机器上的时间占比 × 36 个月你当地的薪资,或者一份年度维保合同
5模型更新三年里换几次、每次谁做、收不收钱、停机多久只能来自合同条款,不能来自口头承诺

绝大多数厂在做买不买的决策时,只填了第 1 行。第 2 行凭感觉("电费应该挺贵的吧"),第 3 行照抄财务的折旧年限,第 4 行完全没想过,第 5 行留给第二年再说。

这五行里,第 2 行是唯一一行你能在半天之内算出确定答案的,所以下一节先把它算完——顺便你会发现,它同时也是最不值得纠结的一行。第 3 到第 5 行给不了确定数字,我会逐行说清为什么给不了,以及你自己怎么填。

有一个数值得先放在这里当参照。据澎湃新闻 2026 年 5 月 19 日发布的报道,长江商学院对全国 2016 家规模以上工业企业的调研显示,500 人以下企业的 AI 支出,42.6% 落在 2 万~10 万元这个区间。17.38 万已经在这个区间的上沿之外——173800 ÷ 100000 ≈ 1.74 倍(这一步除法是我自己算的,分子是那条成交记录,分母是该区间的上界)。这不是说你不能花这个钱,是说你一旦花了,就落在了同行分布的尾部,那么这张表的其余四行你更要填完。

二、电费这一行:用官方电价表算,答案在两千二到一万六之间

先说功率口径。NVIDIA 官方的 GeForce RTX 4090 规格页写着两个数:Total Graphics Power 450 WRequired System Power 850 W。下面的算例统一用 0.85 kW 这个整机口径——它是官方给的整机电源建议值,偏保守,实际请以你那台机器的铭牌为准,多卡机型要按卡数另算。

再说电价。这里不用任何估计值,用官方文件。据广东电网有限责任公司《关于 2026 年 4 月代理购电工商业用户价格的公告》,珠三角五市(广州、珠海、佛山、中山、东莞)单一制、1-10(20)千伏的工商业用电,分时电量电价是(单位:分/千瓦时,含税):

时段电价(分/千瓦时)折合元/千瓦时
尖峰152.436875约 1.524
高峰122.496875约 1.225
平段73.196875约 0.732
低谷29.526875约 0.295

同一份公告还写死了时段划分:高峰为 10-12 点、14-19 点;低谷为 0-8 点;其余为平段;峰平谷比价 1.7 : 1 : 0.38。另有一条要记住:尖峰电价执行 7 月、8 月、9 月三个整月,以及其他月份中广州日最高气温达 35℃ 及以上的高温天,执行时段为每天 11-12 时、15-17 时共三小时,在峰段电价基础上上浮 25%。

按三种跑法各算一遍。三种跑法都是我给的假设,你换成自己的运行时长即可。

跑法 A:7×24 不停机。 每天低谷 8 小时、高峰 7 小时、平段 9 小时,全年 365 天。

  • 低谷:0.85 × 8 × 365 = 2482 度 × 0.295 ≈ 733 元
  • 高峰:0.85 × 7 × 365 ≈ 2172 度 × 1.225 ≈ 2660 元
  • 平段:0.85 × 9 × 365 ≈ 2792 度 × 0.732 ≈ 2044 元
  • 合计约 5437 元/年,三年约 16311 元

跑法 B:只在工作日 9:00-18:00 跑,一年 250 个工作日。 这九个小时里,10-12 与 14-18 共 6 小时落在高峰,其余 3 小时落在平段。

  • 高峰:0.85 × 6 × 250 = 1275 度 × 1.225 ≈ 1562 元
  • 平段:0.85 × 3 × 250 ≈ 638 度 × 0.732 ≈ 467 元
  • 合计约 2029 元/年,三年约 6086 元

跑法 C:把批量任务全部排到 0:00-8:00 的低谷段,每天 8 小时,全年 365 天。

  • 0.85 × 8 × 365 = 2482 度 × 0.295 ≈ 733 元/年,三年约 2199 元

三个数并排:16311 / 6086 / 2199。 最贵的跑法和最省的跑法,三年差 14112 元。

这三步除法都是我按公告给的单价自己算的,口径必须写清三点:第一,只算了电量电价,单一制不含容(需)量电费;第二,用的是 2026 年 4 月那一版价格,电价按月调整,你要用自己当月那一版;第三,0.85 kW 是官方整机电源建议值,不是实测功耗,实际多半更低。

但这一节真正的结论不是"怎么省电"。

把 16311 元放回 17.38 万那条成交记录旁边:16311 ÷ 173800 ≈ 9.4%;最省的那种跑法是 2199 ÷ 173800 ≈ 1.3%。也就是说,三年电费最多占到硬件款的一成,最少占一成的七分之一。

电费是这张表上唯一能被精确算出来的一行,也是这张表上最不重要的一行。它值得你算一次,不值得你在采购会上争一个下午。

顺手把可执行的那一条留下:批量任务排进 0-8 点,高峰对低谷是 1.225 ÷ 0.295 ≈ 4.15 倍,尖峰对低谷是 1.524 ÷ 0.295 ≈ 5.17 倍。 尖峰又正好压在 7、8、9 三个月的白天,所以夏天中午跑批是全年最贵的时刻。这条动作省下的是一万多块,不足以改变买不买的决定,但它零成本。

三、剩下三行:为什么我给不了数字

第 3 行,折旧:不要用财务折旧年限填这一格。

财务上可以折五年,但你真正要问的是三年后这台机器还跑不跑得动那时候的模型。当财务年限和技术年限不一致时,短的那个才是你的真实折旧年限。

技术年限受一个你完全控制不了的变量影响:供给。据美国商务部工业与安全局 2026 年 1 月 13 日的公告,H200、MI325X 及类似芯片的对华出口许可审查政策改为逐案审查(原文 case-by-case basis),并附三项资格条件——这是放宽,不是收紧;而同期的公开报道显示,英伟达在其 FY2027 第一财季的中国数据中心计算收入为零(上年同期为 46 亿美元)。审批口径松了,成交却还没回来。这两条放在一起看,对你的直接含义是同一句:三年后你要换卡的时候,面对的供给环境很可能和你买的时候不是同一个,而且往哪个方向变不由你定。 这一格我给不了年数,我能给的是填法——把年数写成一个你敢在合同上承诺的数,然后用 17.38 万除以它。

第 4 行,运维的人:这一行没有公开价,只有一个必须先回答的问题。

问题是:"这台机器半夜挂了,明天早上谁在两小时内到场?"

  • 说得出名字,且这个人在你公司领工资 —— 这一格填「他的月成本 × 他花在这台机器上的时间占比 × 36」。月成本不是月薪,要含社保公积金;时间占比自己估,但不许填 0
  • 说不出名字 —— 这一格必须填一份年度维保合同的报价,而且响应时限要白纸黑字。填不出来这个数,说明这一格是空的,不是零。
  • 让现有的 IT 兼着 —— 这是最贵的一种填法,因为它的成本不体现在工资单上,体现为"机器挂了三天没人管",以及第四天大家发现绕过它照样能干活。那一天之后,前面三行的钱全部变成沉没成本。

这一行的数字我给不了,但我可以给一个判断线:如果这一格你填不出任何数,那么整张表不用往下算了。 头豹那份报告写给销售看的目标用户画像里,第三句原文就是「缺乏专业 AI/GPU 运维团队」——这句话准确地描述了买之前的状态,但它不解决"买完之后你依然没有这样的人"。

第 5 行,模型更新:这一行只能来自合同,不能来自口头承诺。

四个问题必须在签字之前落成条款:三年里换几次新模型、每次谁来换、换一次收不收钱、换的时候停机多久。

这一行还有一个被普遍低估的分支:如果你的目的不只是"用一个通用模型",而是要让它学会你厂里的东西,那就要看清楚这件事的量级。据阿里云开发者社区 2026 年 7 月 22 日的一篇技术文章,一个 70B 模型做全参数微调大约需要 32 张 GPU × 72 小时、显存 800GB 以上,成本区间 4600~11500 美元;而 LoRA 这类方法只训练 0.1%~1% 的参数。这两条路的成本差着一个数量级,而这个差别不会出现在一体机的报价单上——因为报价单只卖硬件,不卖"以后每次让它学新东西要花多少"。

不肯把第 4 行和第 5 行写进合同的供应商,报价再低也别谈。

四、对照面:同样这笔钱,按 token 付能买到什么

对照面必须摆出来,不然"买"这个决定没有参照物。

据新华网 2026 年 6 月 23 日的报道,豆包 2.1 Pro 的公开定价是:输入每百万 token 6 元、输出每百万 token 30 元、缓存命中每百万 token 1.2 元。

按输入与输出 4:1 的混合口径算(这个 4:1 是我给的假设,你要用自己的实际比例替换):0.8 × 6 + 0.2 × 30 = 10.8 元/百万 token

那么 173800 ÷ 10.8 ≈ 16093 百万 token ≈ 160.9 亿 token

再往下换一步,换成"人份"。假设一个员工每天用它 20 次、每次一进一出合计 2500 token,那就是 5 万 token/天;一年按 250 个工作日算,1250 万 token/人/年(这两个数同样是我给的口径,不是任何调研结论)。

160.9 亿 ÷ 1250 万 ≈ 1287 人年。除以 3 年,等于 429 个人同时用满三年。

对一家三五十人的厂来说,这个数的含义很直白:光是硬件那一笔钱换成按量付费,够全公司连续用上几十年。

这个演算的不严谨之处我先自己拆一遍:第一,4:1 和 5 万 token/天 都是我给的假设值,你换成自己的实际调用量,结论可能变;第二,豆包 2.1 Pro 是一个具体型号的公开价,不同型号之间价差很大,不能当成"AI 的价格";第三,按量付费这一侧没有算接入开发的工时和数据整理的工时,那笔钱是真实存在的;第四,也是最重要的一条——这个对照不能推出"所以别买"。

因为买私有化买的从来不是单价,是三样按量付费给不了的东西:数据不出厂区、额度不会被限、以及一个不随上游价格变动的固定成本。 这三样值不值 17.38 万,取决于第一样对你是不是硬约束。如果只是习惯,那这笔钱多半买的是心安。

还有一条政策方向要放进来。工业和信息化部办公厅 2026 年 4 月 2 日印发的《普惠算力赋能中小企业发展专项行动》里,写的是要为中小企业建专属算力池、推行 Token 等灵活付费方式、发放算力券/存力券/运力券。官方给中小企业指的路是按量付费,不是买机器。 而地方补贴那一侧的门槛在哪,看一个具体的数就知道:深圳"训力券"最高 1000 万元,但门槛是向非关联方年租用智能算力的费用达到 50 万元(含)以上——注意"非关联方"这三个字,向自己关联的公司租算力不算数。这个门槛本身就说明它不是发给你的。该条款写在申报通知的附件 1(指南 docx)里,不在通知正文的网页上。

五、什么时候这张表算完也不该买

先把不会出现在任何一张报价单上的隐性成本列全:场地改造与电力扩容、噪音导致的搬迁、停机时无人处理的等待、模型换代后的二次采购,以及最贵的那一项——买了之后组织会默认"我们已经有 AI 了",于是停止寻找场景。 这一项没有发票,但它把前面五行的钱一起变成沉没成本。

三种情况下,这张表算完也不该买:

第一,第 4 行填不出数。 前面说过一次,这里再说一次,因为它是最常见的失败方式。运维那一格是空的,等于你买了一台三年后没人能确认它还活着的设备。

第二,你的真实调用集中在每天两三个小时。 那么第 2 行三种跑法里你连跑法 B 都用不满,机器绝大部分时间在空转,而空转的电费和满载差不了多少,价值却差着全部。

第三,"数据不出厂"在你这儿是习惯不是条款。 判断方法只有一句:去找那份写着"这类数据不得出域"的东西——合同条款、客户验厂标准、行业监管要求,三者有其一就是真需求。三者都没有,那先租一年按量付费的,一年之后你手上会有一条真实的调用曲线,那时候再做这个决定,质量比空着手做高一个量级。

反过来,两种情况下这张表算完应该买:客户已经把数据本地化写进了准入条款;或者你所在行业有明确的监管要求。这两种是合规决策,不是成本决策,两者不该放在同一张表里比。

最后提醒一句关于那 17.38 万本身:它是 2025 年 5 月的一条成交记录、一个特定配置,用途是让你知道量级,不是让你知道底价。这条记录该怎么读,以及全国算力的利用率为什么和你租不租得到卡是两回事,本站另有两篇专门讲。

这张表的第 4 行和第 5 行怎么写进合同,《DeepSeek企业实战》里有一课专门讲私有化部署与成本账。

本文事实来源

可自行复核
  1. 1

    大模型一体机整体价格带 50 万~500 万元、基础型号 10 万~50 万元;某 RTX 4090 配置型号成交价 17.38 万元;目标用户画像原文「IT 预算 < 100 万元」「无标准 IDC 机房」「缺乏专业 AI/GPU 运维团队」

    头豹研究院2025-05

  2. 2

    广东电网《关于 2026 年 4 月代理购电工商业用户价格的公告》珠三角五市电价表:单一制 1-10(20)千伏 尖峰 152.436875 / 高峰 122.496875 / 平段 73.196875 / 低谷 29.526875 分每千瓦时;高峰 10-12、14-19 点,低谷 0-8 点;峰平谷比价 1.7:1:0.38;尖峰执行 7、8、9 三个整月及高温天 11-12、15-17 时,峰段基础上浮 25%

    横琴管委会2026-04(执行月份)

  3. 3

    NVIDIA GeForce RTX 4090 官方规格:Total Graphics Power 450 W;Required System Power 850 W;显存 24 GB GDDR6X

    NVIDIA 官方官方产品页(页面未标注更新日期)

  4. 4

    豆包 2.1 Pro 公开定价:输入 6 元 / 输出 30 元 / 缓存命中 1.2 元,每百万 token

    新华网2026-06-23

  5. 5

    500 人以下企业 AI 支出 42.6% 落在 2 万~10 万元区间(长江商学院对全国 2016 家规模以上工业企业的调研)

    网易澎湃新闻 2026-05-19 发布

  6. 6

    美方 2026 年 1 月 13 日将 H200 / MI325X 等芯片的对华出口许可改为逐案审查(case-by-case basis,附三项资格条件,属放宽);英伟达 FY2027 Q1 中国数据中心计算收入为零(上年同期 46 亿美元)

    美国 BIS南华早报2026-01 / 2026-05

  7. 7

    70B 全参数微调约需 32 GPU × 72 小时、显存 800GB+、成本 4600~11500 美元;LoRA 仅训练 0.1%~1% 参数

    阿里云2026-07-22

  8. 8

    工信部办公厅《普惠算力赋能中小企业发展专项行动》(工信厅通信〔2026〕14 号):中小企业专属算力池、Token 等灵活付费、算力券/存力券/运力券

    工信部2026-04-02

  9. 9

    深圳「训力券」最高 1000 万元,门槛为向非关联方年租用智能算力费用达 50 万元(含)以上,单次抵扣不超过合同金额 50%。

    附件直链通知页2026-05-06

    三个数均属实,但条款不在通知网页正文上,在附件 1 的指南 docx 里(初稿把出处指到了网页,且漏掉「非关联方」这个限定——关联方租算力不算数,这一条直接决定一家公司能不能报) )