拆一个企业知识库项目:报价 8 万,钱花在了哪
一年的模型调用是三位数美元,而整理你那批旧文档要吃掉将近一半的盘子——这个形状决定了合同该怎么写

文章目录
共 5 节先把最容易被算错的那一格摆出来:一家 30 人公司的内部问答,跑满一年,模型调用费大概是一百多到三百多美元。
三位数。不是三位数人民币,是三位数美元。
而同一个项目里,把这家公司那批旧手册、工艺卡、售后记录整理成能用的样子,要吃掉盘子里将近一半的钱。
十家里有八家,是反过来估这笔账的:一上来先问模型贵不贵、要不要买卡、能不能私有化,然后把"整理资料"这件事写成一行"客户配合提供文档"就过去了。这一行字,是这类项目超期和亏损的全部来源。
一、先说清楚:8 万是本文设的一个盘子,不是成交价
这篇文章里的 8 万元,是我给它设的一个报价盘子,不是任何一笔真实成交。 我没有可核验的成交单,所以不拿它当事实写。
设成 8 万,是因为这个数落在一条能被公开材料卡住的边界的下面。
据头豹研究院大模型一体机研究报告(2025 年 5 月),这类一体机的整体价格带是 50 万~500 万元,基础型号 10 万~50 万元,报告里还记录了一个具体成交价:某 RTX 4090 配置的型号 17.38 万元。
8 万比 10 万小。所以这个盘子里没有一台机器。 它只能是"不买硬件、只做交付"的那一种项目——用现有的服务器或者公有云,把这家公司的文档变成一个能问、能答、能追到出处的东西。
同一份报告写目标用户画像的时候有三句原话:「IT 预算 < 100 万元」「无标准 IDC 机房」「缺乏专业 AI/GPU 运维团队」。后两句才是关键。一家没有机房、也没有 GPU 运维人的公司,把 8 万里的一大半花在硬件上,第二年会发现那台机器没人管。
下面这张表是本文设定的分配,不是谁的报价单。它的用处只有一个:让你看见这类项目的钱的形状。
| 格子 | 本文设定的金额 | 占盘子 | 这一格的单价出处 |
|---|---|---|---|
| 1. 文档整理与清洗 | 3.6 万 | 45% | 国家统计局分岗位年平均工资 |
| 2. 文档解析与切分(含 OCR) | 0.8 万 | 10% | 开源模型许可证 |
| 3. 检索与存储搭建 | 0.8 万 | 10% | 数据库扩展,无采购 |
| 4. 一整年的模型调用 | 0.5 万 | 6% | 模型提供方官方定价页 |
| 5. 上线陪跑与两周抽检 | 1.3 万 | 16% | 国家统计局分岗位年平均工资 |
| 6. 第一年的维护 | 1.0 万 | 13% | 国家统计局分岗位年平均工资 |
| 合计 | 8.0 万 | 100% |
占比一列各自四舍五入到整数,加起来正好是 100,这是凑巧,不是精算。
二、逐格拆:三格是人,一格是零头,两格几乎不用采购
第 1 格:3.6 万元,买不到你以为的那么多人月。
先把人月的单价定住。据国家统计局 2025 年 5 月 16 日发布的 2024 年城镇单位就业人员年平均工资数据,规模以上企业分岗位的年平均工资里,办事人员和有关人员 93,189 元,专业技术人员 148,046 元。
93,189 ÷ 12 ≈ 7,766 元/月。148,046 ÷ 12 ≈ 12,337 元/月。这两步除法是我自己做的,口径必须写清楚:这是就业人员的工资口径,不含单位缴纳的社保公积金,也不含任何管理费和毛利。 一个交付方真实的人月成本要比这个数高,高多少各家不一样。
3.6 万 ÷ 7,766 ≈ 4.6 个人月——而且这 4.6 个人月里,一分钱毛利都没有。
4.6 个人月要干的活是:把散在文件柜、邮箱、微信群、几个人硬盘里的手册和记录收齐,判断哪一版是有效的,把互相打架的三个版本砍成一个,把没有日期、没有责任人的那些标出来。
这件事没有捷径,因为决定哪一版有效的那个人不是你,是客户。你能做的只有把冲突挑出来递过去等回复。等回复这段时间,也算在 4.6 个人月里。
第 2 格和第 3 格:0.8 万 + 0.8 万,花的是调它的人,不是许可费。
文档解析这一格,公开可用的开源方案已经把许可费这一项抹掉了。据 GitHub 上的官方仓库:小红书的 dots.ocr 是 1.7B 参数、MIT 许可,2025 年 7 月 30 日发布;百度的 PaddleOCR-VL 是 0.9B 参数、支持 109 种语言、Apache 2.0 许可,2025 年 10 月 16 日随 3.3.0 版本发布。
(这两个仓库里社区侧流传的准确率和倍数说法,官方发布说明里没有,本文一个都不引。)
109 种语言这一条,对做外贸的珠三角公司是实打实的——多语种单据不用再另外买一套。
检索与存储这一格同理。千万条向量以内,一个已经在跑的关系型数据库加一个扩展就够,采购这一项可以是零。超过千万条向量之后这个结论会变,那是另一个量级的问题,本文不展开。
所以这两格的 1.6 万,买的是有人把它装起来、跑通、并且把参数调到你这批文档上的那段时间。按上面 12,337 元/月的专业技术人员口径,1.6 万约等于 1.3 个人月。
第 4 格:0.5 万元,怎么花都花不完。
据 DeepSeek 官方 API 定价页,V4-Flash 每百万 token 的价格是输入(未命中缓存)\$0.14、输出 \$0.28;V4-Pro 是输入 \$0.435、输出 \$0.87;命中缓存的输入低到 \$0.0028。
拿这家 30 人公司算一遍。下面的用量假设是我设的,不是来源里的数:每人每个工作日问 16 次,250 个工作日,一年约 12 万次;每次把检索到的段落喂进去按 6,000 token 算,回答按 400 token 算。
- →输入总量:12 万 × 6,000 = 7.2 亿 token = 720 百万
- →输出总量:12 万 × 400 = 4,800 万 token = 48 百万
按 Flash:720 × 0.14 + 48 × 0.28 = 100.8 + 13.44 = \$114.24
按 Pro:720 × 0.435 + 48 × 0.87 = 313.2 + 41.76 = \$354.96
这两步乘法是我自己算的,分子分母都写在上面了。不严谨的地方也说清楚:真实场景里会有缓存命中,会有重试,会有人一次问三遍,也会有长文档把 6,000 token 撑破。但量级不会跑到另一个数量级上去。
三位数美元。按近几年任何一个常见的美元人民币汇率折,都远远填不满我设的那 0.5 万元。
第 5、6 格:2.3 万元,是上线之后还得有人在。
上线不是终点。前两周要有人抽检答得对不对,之后一年要有人在文档改了的时候把它同步进去。这两格加起来 2.3 万,按办事人员口径约等于 3 个人月,摊到一年就是每月四分之一个人的时间。
知识库三个月不维护就会开始给出过期答案。这里只说一句结论:这 1.0 万如果被砍掉,前面那 7 万块的东西会在第二年变成一个没人敢信的东西。
三、有一格不在你的报价单上:客户那边的人
把上面六格加完是 8 万。但项目会不会超期,不由这六格决定。
第 1 格里那句"等客户回复",是这类项目唯一的不可控变量。
"卡住 AI 落地项目的三样东西一样都不在你的报价单上"这件事,同署名有一篇(2026 年 1 月 11 日)已经用一份公开调研逐条拆过,本文不重复。这里只说知识库项目独有的那一处。
独有的那一处是:这类项目的判断权不在交付方手上。
做一个报价助手,你至少还能自己读懂报价规则。做知识库不行——同一道工序的三份说明书哪一份还算数,只有对方那个具体的人知道,而且经常只有一个人知道。
于是你的 4.6 个人月按天烧,他那边的确认按有空没空来。两条时间线不在同一个坐标系里。
这就是这类项目最贵的地方:不是技术风险,是排期风险,而且这个风险的开关不在你手上。
我的建议是,报价之前先派一个人去数三个数:一共多少份文档、有多少份没有日期或版本号、能拍板"哪一版有效"的人有几个。第三个数如果是零,这个项目就不该报价。
四、报价单之外的另一半:五条必须写进合同的边界
上面那张表决定你亏不亏,下面这五条决定你亏的时候能不能收回来。
先说清楚两件事。 第一,报价该分几档、每一档必须写进合同的那一条是什么,同署名 2026 年 1 月 11 日那一篇已经写过,这里不重复——下面五条只针对知识库这一类交付特有的失控点。第二,这一节说的是"该谈哪五件事",具体条款怎么写,请交给你自己的法律顾问。我给的是谈判清单,不是合同文本。
这类交付在法律上通常按承揽处理。据《中华人民共和国民法典》第七百七十条,承揽合同是"承揽人按照定作人的要求完成工作,交付工作成果,定作人支付报酬的合同"。围绕它的四条规定,正好对上上面那张表里最容易失控的四个格子。
第 1 条。把"客户提供什么、什么时候提供"写成一个有日期的清单。
民法典第七百七十八条写着:定作人不履行协助义务致使承揽工作不能完成的,承揽人可以催告定作人在合理期限内履行义务。这条给的是催告权,不是自动顺延。 想用上它,前提是合同里本来就写明了对方要协助什么。只写"客户配合提供文档",催告的时候你连催什么都说不清。
第 2 条。把"中途改要求"的代价定价。
民法典第七百七十七条写着:定作人中途变更承揽工作的要求,造成承揽人损失的,应当赔偿损失。法条给了赔偿的依据,但"损失多少"要能算得出来。所以合同里得先有一个计价口径——比如按人天,把第 1 格那个 7,766 元/月的量级折成天。没有计价口径的赔偿条款,等于没有。
第 3 条。把验收标准写成可执行的,别写成一个百分比。
民法典第七百八十一条写着:承揽人交付的工作成果不符合质量要求的,定作人可以合理选择请求承揽人修理、重作、减少报酬或赔偿损失。四种救济里有三种直接吃你的钱,所以"符合质量要求"这句话必须提前定义。
定义的方式不是承诺一个准确率。这是这类项目最不该签的一句话。 建议改成一组可复现的验收动作:双方各出一批题、封存、上线后按同一批题跑、结果双方共同判定。
第 4 条。分段交付,分段结款。
民法典第七百八十二条写着:定作人应当在承揽人交付工作成果时支付报酬;工作成果部分交付的,定作人应当相应支付。第 1 格那 45% 是最早烧完、也最容易被拖住的一段,把它单独设成一个交付节点。
第 5 条。把"它可能答错"写成一项显著提示义务,而不是一句免责。
据央视新闻 2026 年 1 月 14 日的报道,杭州互联网法院审理的一起 AI"幻觉"侵权案,法院驳回了原告索赔请求,判决生效。法院在这起案件里给出的注意义务是三层:对法律明令禁止的有害内容负严格审查义务;对 AI 的局限性负显著提示义务,避免用户把它当权威;用行业通行技术措施提高准确性的基本可靠性义务。报道中还有一句法院的表述:「通用型AI要面对海量不同领域的问题,要求服务提供者逐一审查输出内容,在现有技术条件下很难做到」。
这三层里,第二层是你在合同和产品里都能做到的:在界面上、在交付文档里、在培训里,把"这里的答案要复核"这句话放到看得见的位置。 它比任何一句"本方不对输出结果承担责任"都管用。
(本段是对一起公开报道案例的转述与理解,不构成法律意见。)
五、什么时候不该接这个项目
第一,文档里没有一版是权威版的时候。 第三节那个"能拍板的人有几个"数出来是零,说明这家公司还没到能建知识库的阶段。这时候接单,你的 4.6 个人月会全部消耗在替对方开会上,而且开完还是没有结论。先劝他做文档治理,不要先卖知识库。
第二,盘子被压到 5 万以下的时候。 按上面的分配,第 1 格已经只剩 4.6 个人月的工资额度,再压就只能从整理这一格砍。砍掉之后交付出来的东西是能跑的,但它答的是过期内容。这种项目上线当天就成立,三个月后开始出问题,而那时候钱已经结完了、口碑还挂在你身上。
第三,客户要的是"全公司什么都能问"的时候。 范围无限,第 1 格就无限。建议把首期锁在一个部门、一类文档、二十个高频问题上。范围不收窄,这张表里每一格都会失控。
第四,对方把准确率当成签字条件的时候。 上面第 3 条已经说了为什么不该承诺百分比。对方坚持要写,这单宁可不接——你签的不是一个交付目标,是一个你无法控制的赔偿触发条件。
最后一条,是给买方的。 如果你是掏这 8 万的那一方,只看一件事:这份报价里,"整理你的文档"占了多少。 占不到三成的报价,要么对方没打算认真做这一步,要么他准备做完再回来找你加钱。两种都不便宜。
把上面那张表逐格问一遍供应商,比问他用的是哪个模型有用得多。
这套逐格拆报价和写边界条款的完整清单,在《DeepSeek企业实战》第 3 课里有配套模板。
本文事实来源
可自行复核- 1
大模型一体机整体价格带 50 万~500 万元、基础型号 10 万~50 万元、某 RTX 4090 型号成交价 17.38 万元;目标用户画像原文「IT 预算 < 100 万元」「无标准 IDC 机房」「缺乏专业 AI/GPU 运维团队」
- 2
2024 年城镇单位就业人员年平均工资:规模以上企业分岗位,办事人员和有关人员 93,189 元、专业技术人员 148,046 元;城镇非私营单位总体 124,110 元
- 3
dots.ocr:1.7B 参数、MIT 许可,README 的版本记录写明 dots.ocr 发布于 2025.07.30
- 4
PaddleOCR-VL:0.9B 参数、109 种语言、Apache 2.0 许可,随 PaddleOCR 3.3.0 于 2025 年 10 月 16 日发布
- 5
DeepSeek API 官方定价:V4-Flash 输入(未命中缓存)\$0.14 / 输出 \$0.28、V4-Pro 输入 \$0.435 / 输出 \$0.87、缓存命中输入低至 \$0.0028,均为每百万 token。该页为持续更新的计费页,不标发布日期;本文只用它做量级对照,不是报价单。
- 6
《中华人民共和国民法典》第七百七十条、第七百七十七条、第七百七十八条、第七百八十一条、第七百八十二条条文
(康乐县政府法律法规服务栏目公布的条文)
- 7
杭州互联网法院 AI「幻觉」侵权案:驳回原告索赔请求、判决生效;三层注意义务;法院表述「通用型AI要面对海量不同领域的问题,要求服务提供者逐一审查输出内容,在现有技术条件下很难做到」
