模型会停服:把「供应商风险」写进你的 AI 计划
两家供应商把通知期写在了公开页面上,一家承诺 60 天、四次给的是 60/61/62/62 天——承诺是下限,他们真的按下限执行

文章目录
共 5 节2026 年 7 月 24 日 15 点 59 分(UTC)。
一个精确到分钟的时点,写在一家模型提供方 2026 年 4 月 24 日发布的公告里。那一刻之后,它的两个旧接口名将被完全停用、无法访问。
这两个接口名值得看清楚:它们不是版本号,是通用名——一个叫"对话",一个叫"推理"。很多人当初接的就是这两个,因为它们看起来最稳,不用跟版本。而公告里还写着另一句:这两个通用名此刻已经被指向了新一代的某个型号。
也就是说,它先被悄悄改了指向,再被安排删除。
(2026 年 8 月 18 日复核补记:这个时点已经过去,那两个通用名现在打过去就是失败。本文不因此作废——恰恰相反,它是这套自查表唯一一次可以事后对答案的机会:你手上那张表,在那一天之前填好了吗。)
这一篇不预测哪一家会出问题,也不劝你去做多供应商。它只做两件事:把各家公开页面上已经写死的规则摆出来,然后给一张能填的自查表和一份该写进合同的清单。
一、承诺写在页面上,而且他们真的按下限执行
先看第一家。
据 Anthropic 官方的模型弃用页面,它把模型生命周期分成四个状态:Active(在用)、Legacy(不再更新、未来可能被弃用)、Deprecated(还能用但不推荐,已给出替代品和退役日期)、Retired(无法再用,请求会失败)。同页写着它的通知承诺:对公开发布的模型,退役前至少提前 60 天通知有活跃部署的客户。
关键在于,同一页把历次公告和退役日期都列了出来。我们把日期差算了一遍:
| 公告日 | 退役日 | 间隔 |
|---|---|---|
| 2025-10-28 | 2026-02-19 | 114 天 |
| 2025-12-19 | 2026-02-19 | 62 天 |
| 2026-02-19 | 2026-04-20 | 60 天 |
| 2026-04-14 | 2026-06-15 | 62 天 |
| 2026-06-05 | 2026-08-05(公告已写明) | 61 天 |
这五次减法是我们自己做的,页面上只给日期,没有给间隔天数。
五次里有四次落在 60 到 62 天。承诺是 60 天,实际给的就是 60 天出头。
再看第二家。据 OpenAI 官方的弃用页面,它的承诺分三档:一般可用的模型至少 6 个月,专门变体(对话变体、Codex 变体、深度研究变体)至少 3 个月,预览版可能短得多,页面举的例子是两周。同页还写着一句:如果安全或合规要求更早下线,会给出合理范围内尽可能多的通知。
同样把它页面上的日期减一次:2026 年 6 月 11 日公告、2026 年 12 月 11 日关闭,正好 6 个月;2026 年 5 月 8 日公告、2026 年 8 月 10 日关闭,94 天,约 3 个月(该关闭日 2026 年 8 月 10 日已过,这两个对话变体现在打过去同样是失败)。同样精确地贴着自己承诺的那条线。
第三家没有找到公开承诺期。开头那条公告是 2026 年 4 月 24 日发的,关闭时点定在 2026 年 7 月 24 日,两者相隔 91 天。这一次是 91 天,下一次是多少,你没有依据可以推。
三家放在一起,结论只有一句:
所以第一条筛选标准不是价格,也不是能力:你依赖的这一家,有没有把通知期写在一份任何人都能打开的页面上。 有的,把那个数字抄进你的计划;没有的,按零天算。这不是苛刻,是没有别的算法。
顺带记下另外三条同样出自公开页面的事实,第三节的自查表会用到:
- →一家的页面明确写着,合作云平台会自行制定退役时间表,所以同一个模型在一方接口上的状态和日期,与在两家公有云上的可以不一样。同页还有一行标着某个型号"已退役,但在那两家云上除外"。
- →另一家在 2026 年 3 月 24 日公告了一组视频模型与对应接口将于 2026 年 9 月 24 日关闭,而那一行的替代品栏是空的——没有公布替代品。
- →同一家在 2026 年 6 月 3 日一次性公告了三样东西将于 2026 年 11 月 30 日关闭:一个评测平台、一个智能体搭建器、一套可复用提示词接口。这三样都不是模型。
最后这一条最容易被漏掉:会停的不只是模型,还有你围着它建起来的那一整套工具。
二、更常见的四种变化,一种都不叫"停服"
如果只盯着"哪个模型什么时候下线",你会漏掉发生频率高得多的另外四类事。它们的共同点是:服务好好地在,账号好好地在,钱照收,但你那一侧被动了。
第一种:参数被弃用,模型没动,你的代码停了。
据 Anthropic 官方定价与弃用页面,`temperature`、`top_p`、`top_k` 这三个参数在 Claude Opus 4.7 及以后的型号上已被弃用,设成非默认值会直接返回 400 错误。页面给的替代做法是不要传这些参数、改用提示词来引导。
这件事的形状值得想一遍:模型没有下线,价格没有变,你的接口地址没有变。你只是在升级到新一代型号的那一天,收到了一片报错。这类变化不会写进任何一份"停服公告",因为它压根不叫停服。
第二种:分词器换代,单价一个字没改,账单涨三成。
同一张定价页上写着:Claude 4.7 及以后的型号使用了新的分词器,同样的文本会产生约多 30% 的 token,具体增幅取决于内容和负载形状。
把这句话换成钱。假设你原来每月的模型账单是 1 万元,单价一个字不改,只是把型号升到新一代:1 万 × 1.3 = 1.3 万元,一年多出 3.6 万元。(这个 1 万元是本文设的假设值,用来说明量级;30% 是页面上写的"约",实际取决于你的内容。)
我们把这一条单独拎出来,是因为它几乎不会被写进任何一份预算表——预算表上比的是单价,而这一条动的是计价单位本身。比价的时候要问的不只是"多少钱一百万 token",还有"我这段文字在你这里算几个 token"。
第三种:渠道不同,退役日期不同。
上一节已经提到:合作云平台自行制定退役时间表。这一条对国内买家格外要紧,因为很多公司买模型不是直接从一方买的,是从某家云上买的。
于是同一句"这个模型什么时候到期",会有两个答案,取决于你是从哪个门进去的。如果你的采购合同里只写了模型名,没有写渠道,那你连该去看哪一张退役表都不知道。
第四种:涨价预告,同样写在定价页上——而这一条已经兑现了。
据某家模型提供方的官方定价页,页面上直接写着计划整体上调 API 价格、预计幅度显著,并写明它保留调整价格的权利。这句话就挂在你每次去查单价的那一页上。
(2026 年 8 月 18 日复核补记:这句预告已在 2026 年 8 月 16 日 16:00(UTC)兑现——同一个页面改成了高峰 / 低谷两档计价,输入与输出涨到原先的约三倍,缓存命中价涨到原先的五到十二倍,而那句预告本身已从页面上撤下。定价页上的一句预告,是这一整篇里唯一一个提前告诉你未来账单的字段。)
四种变化,一种都不叫停服。而它们对你的影响顺序,我们的看法是:分词器 > 参数 > 涨价 > 模型下线。 排最后的那一件反而是最有准备的一件,因为它有公告、有日期、有替代品建议。前面三件没有任何一件会给你六十天。
三、供应商风险自查表:十行,一张纸
这张表的用法很朴素:打印出来,一行一行填。填不出来的那一行,就是你的敞口。
| # | 要回答的问题 | 到哪里查 | 填不出来意味着 |
|---|---|---|---|
| 1 | 我们在用的是哪几个具体型号名(不是"某家的模型") | 你自己的配置文件或供应商后台 | 你没有清单,后面九行全部无从谈起 |
| 2 | 每个型号在供应商弃用页上的状态:在用 / 遗留 / 已弃用 / 已退役 | 供应商的模型弃用页 | 你可能正跑在一个已经被标记为遗留的型号上 |
| 3 | 这家公开承诺的最短通知期是多少天 | 同上页面的通知政策段落 | 按零天算 |
| 4 | 我们是从哪个渠道买的:一方接口 / 某家公有云 / 某个聚合平台 | 你的合同与发票 | 你不知道该看哪一张退役表 |
| 5 | 我们有没有用"通用名""最新版"这类别名入口 | 你的配置文件 | 版本决定权已整个交出去,而别名本身可以消失 |
| 6 | 把这个型号换掉需要几天(含回归测试和上线窗口) | 自己估,要有人真正负责这个数 | 这个数减去第 3 行那个数,就是你的敞口 |
| 7 | 我们为它单独做的、换一家就作废的东西有多少 | 提示词、兼容层、只在它那里成立的做法 | 这一项越大,第 6 行那个数越大 |
| 8 | 计费口径变过没有:分词器、缓存计价、最小计费单位 | 定价页的注释与脚注,不是表格本身 | 你的账单可能在单价不变的情况下涨过 |
| 9 | 除了模型,我们还用了它哪些配套:评测平台、编排工具、微调、智能体搭建器 | 你的技术清单 | 配套的关闭公告不会跟着"模型下线"的通知一起来 |
| 10 | 过去三个月,这家的公开页面上新增了几条与我们相关的公告,谁在看这一页 | 供应商的公告 / 弃用页 | 没有人在看,等于把预警交给了运气 |
第 10 行是这张表里唯一一个关于人的问题,也是最容易空着的一行。我们的建议是把它落到一个具体的人和一个具体的频率:每月固定一天,一个人,把你在用的每一家的弃用页翻一遍,把新增的条目抄进这张表。 一次十五分钟,一年三小时。这是全篇成本最低、回报最不确定但代价最小的一件事。
关于第 9 行,还要补一句避免误解:某家的自助微调平台正在收窄这件事,本站另有一篇是从"你到底该不该微调"这个角度写的。这里把它当成完全不同的一件事看——不是"要不要用",而是"我们已经在用的东西,它的关闭时间表在哪一页"。 同一条公告,在采购决策里和在风险登记表里,读法是两回事。
四、合同里该写的六条
先声明口径:下面六条是本文的建议写法,不是法律意见,也不是任何一家的合同范本。 签之前请让懂合同的人再过一遍。
第 1 条,写型号,不写能力。 附件里必须列出具体的型号名和版本,而不是"业界领先的大模型"这种表述。写不出型号名的供应商,多半自己也没打算固定它。
第 2 条,写渠道。 明确写清是从一方接口、还是从哪家云、哪个聚合平台提供。第三节第 4 行那个空格,就是从这一条来的。
第 3 条,把通知期写成数字。 参照物是公开的:一家承诺 60 天,一家对一般可用模型承诺 6 个月。你可以要求不少于其中之一,但不要接受"届时另行通知"这六个字。
第 4 条,把计价口径的变更也算作变更。 分词方式、缓存计价规则、最小计费单位——这三样任何一样变了,都应当触发提前通知义务。只约束"单价不变"是不够的,第二节那 30% 就是从这个缝里进来的。
第 5 条,写清楚退出时会发生什么。 单方面停止提供时的处理方式:未消耗额度怎么办、迁移窗口有多长、这段时间的服务标准是什么。这一条谈不下来也要写进备忘,至少让双方都知道你在意这件事。
第 6 条,把你的资产要回来。 提示词、评测集、调用日志——这些是换一家还能带走的东西,型号不是。合同里要写明它们的导出格式和保留期限。这一条是六条里唯一一条与钱无关、但决定了你下一次谈判有没有底气的。
五、什么时候不该这么做
第一,全备是奢侈品,不要照抄。 每一档都做两家,成本不止翻倍——还要有人维护那第二条路,而那条路平时不产出任何东西。一个五人公司做不起。做得起的通常只有一档,优先备份换起来最慢的那一档,不是账单最大的那一档,这两者经常不是同一档。
第二,第二条路会掉质量,这是真代价。 备用的那一家通常没有主用的好用。所以备份的正确标准不是"随时能切",而是"切过去之后客户还能接受"。后一个标准贵得多,也真实得多。
第三,量太小的时候,这一整套是浪费。 如果你的月账单还不到一顿饭钱,第三节那张表你只需要填第 1、5、6 三行,其余七行等量起来了再说。过早做风险管理,本身就是一种风险——它占掉的是你本该用来把业务跑起来的时间。
第四,别把"有公开弃用页"当成安全。 它给你的是可预期,不是安全。一家很稳的公司完全可以在承诺的最短期限内关掉一组接口,第一节那五行日期就是证据。可预期的价值在于你能提前排期,不在于它不会发生。
第五,这张表填完不会让任何一件事变快。 它不产出功能,不提升效率,甚至会让你的方案在评审时显得保守。它唯一的作用是:那封信来的时候,你手上有一张纸,上面写着第 6 行那个数字——换掉它需要几天。知道这个数和不知道这个数,是两种完全不同的处境。
最后回到开头那个精确到分钟的时点。它之所以值得写在这篇文章的第一句,不是因为那一家做错了什么——恰恰相反,它提前 91 天公告、写明了替代品、连分钟都给了。问题从来不在供应商那一侧,问题在于:这一行有没有被抄进你的计划表,以及抄的那个人,下个月还会不会去看那一页。
这套自查表与合同条款的完整模板,在《DeepSeek企业实战》第 2 课里有配套的成本与风险清单。
本文事实来源
可自行复核- 1
Anthropic 官方模型弃用页:四种生命周期状态(Active / Legacy / Deprecated / Retired)的定义;对公开发布的模型「provides at least 60 days' notice before model retirement」;历次公告与退役日期配对(2025-10-28 → 2026-02-19、2025-12-19 → 2026-02-19、2026-02-19 → 2026-04-20、2026-04-14 → 2026-06-15、2026-06-05 → 2026-08-05);「Partner-operated platforms (Amazon Bedrock and Google Cloud) set their own retirement schedules」,且页面标注某型号「retired, except on Bedrock and Google Cloud」
- 2
Anthropic 官方定价页:`temperature`、`top_p`、`top_k` 在 Claude Opus 4.7 及以后型号上已弃用,设为非默认值「Returns a 400 error」,建议改用提示词引导;Claude 4.7 及以后的型号使用新分词器,「This tokenizer produces approximately 30% more tokens for the same text」,具体增幅取决于内容与负载形状。该页未标注发布日期,本文所引为 2026 年 7 月初页面上的内容
- 3
OpenAI 官方弃用页:通知期承诺分三档——一般可用模型「At least 6 months」、专门变体(chat / Codex / deep research 变体)「At least 3 months」、预览模型「may be retired with much shorter notice, such as 2 weeks」,并写明安全或合规要求下会给出合理范围内尽可能多的通知;2026-06-11 公告一组模型于 2026-12-11 关闭;2026-05-08 公告两个对话变体于 2026-08-10 关闭;2026-03-24 公告一组视频模型与对应接口于 2026-09-24 关闭且替代品栏为空;2026-06-03 公告评测平台、智能体搭建器、可复用提示词接口三项于 2026-11-30 关闭
- 4
DeepSeek 官方公告(2026-04-24):「deepseek-chat & deepseek-reasoner will be fully retired and inaccessible after Jul 24th, 2026, 15:59 (UTC Time).」;同页写明这两个旧接口名此刻被指向新一代型号
- 5
DeepSeek 官方定价页:「We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.」与「product prices may vary and DeepSeek reserves the right to adjust them」。该页未标注生效日期。2026 年 8 月 18 日复核:这句预告已于 2026 年 8 月 16 日 16:00(UTC)兑现——页面改成高峰 / 低谷两档计价并全线上调,预告句本身已撤下
- 6
月之暗面官方模型文档页:kimi-k2 系列(`kimi-k2-0905-preview`、`kimi-k2-0711-preview`、`kimi-k2-turbo-preview`、`kimi-k2-thinking`、`kimi-k2-thinking-turbo`)「已于 2026 年 5 月 25 日下线」
