2026 年 9 月 8 日,腾讯云 TokenHub 公告:GLM-5、GLM-5-Turbo、GLM-5.1 将于 2026 年 10 月 9 日 00:00 下线,之后 API 无法调用。公告由 TokenHub、ADP、CloudBase 三平台联合发出。
它和 9 月 15 日那批视觉模型下线(详见腾讯云 9/15 视觉模型下线)是两种风险:那次调不动,报错立刻发现;这次调得动,但单价变了——按量付费调用被自动切到 GLM-5.3,服务不中断,只有账单知道。
| 一、先校准四个数字 |
官方说 3 个模型,实际要处理 5 个 model 参数值:glm-5、glm-5-0;glm-5-turbo;glm-5.1、glm-5-1,只搜 glm-5 会漏掉后两个。范围也不止 TokenHub:ADP 与 CloudBase 里的是控制台选项,grep 不到。10/9 00:00 的最后时刻是 10/8 24:00;名义 28 天,工作日仅 14 个。
| 二、不迁移不是断服,是涨价 |
| 公告原文:「按量付费 API 用户:系统将自动切换至 GLM-5.3」「自动切换后,相关调用按照切换后模型的计费规则计费」 |
翻译过来:代码一行不改,服务照常跑,账单先变。监控不会因模型被换掉而告警,这是腾讯云代理做迁移评估先看的一栏。
按腾讯云官方价格文档(广州,元 / 百万 tokens):
| 现用模型 | 输出 | 缓存 | GLM-5.3 | 输出变化 |
| GLM-5 ≤32k | 18 | 1 | 8/28/2 | +55.6% |
| GLM-5 32k+ | 22 | 1.5 | 8/28/2 | +27.3% |
| GLM-5-Turbo ≤32k | 22 | 1.2 | 8/28/2 | +27.3% |
| GLM-5-Turbo 32k+ | 26 | 1.8 | 8/28/2 | +7.7% |
| GLM-5.1 ≤32k | 24 | 1.3 | 8/28/2 | +16.7% |
| GLM-5.1 32k+ | 28 | 2 | 8/28/2 | 0% |
同一份公告,六类用户六种结果。GLM-5 ≤32k 输出一夜涨 55.6%,GLM-5.1 32k+ 分毫不变;迁移指南只写"迁至 GLM-5.3",不说你属于哪一档。
| 三、同代还有便宜 10 倍的 GLM-5.3-Flash |
GLM-5.3 是官方指定目标:8 / 28 / 2;同代在售的 GLM-5.3-Flash 是 0.8 / 2.8 / 0.23,输出单价正好是它的十分之一。以原 GLM-5(输出 18)为例:什么都不做或改成 glm-5.3,输出都是 28,涨 55.6%;改成 glm-5.3-flash 则是 2.8,低 84.4%。差的是一行 model 参数。Flash 面向轻量任务,复杂推理仍用 GLM-5.3,别为单价把流量全压过去,分层思路同腾讯云 TCO 降本测算。
| 四、唯一"不自动迁移"的:批量推理 |
| 公告里最容易被跳过、也是唯一会造成实际损失的一句:「GLM-5.1 下线后,其批量推理服务将直接下线,不做自动迁移。请务必在 10 月 9 日 00:00 前取回任务结果。」 |
而批量推理当前支持的模型只有 GLM-5.1 一个,两者叠加:① 10/9 起批量推理能力归零,官方未给 Hy3 版时间表,离线审核、知识库清洗、对话质检要提前找替代;② 进行中任务在 00:00 中断,超 completion_window 的数据不再处理;③ 元数据要自己存档——结果已回写你的 COS 桶不会丢,但 batch_id 与 output_file_id 的对应靠 GET /v1/batches/{id} 查,下线后能否追溯无保证,另查 COS 生命周期。
| 五、27 天不等于 27 个工作日 |
9 月 11 日到 10 月 9 日 00:00 名义 28 个自然日。按往年 10/1–10/7 放假推算:
| 区间 | 工作日 | 说明 |
| 9/14 – 9/30 | 13 | 放假前工作日 |
| 10/1 – 10/7 | 0 | 国庆假期 |
| 10/8 | 1 | 假期后首个工作日 |
| 合计 | 14 | 名义 28 天 |
把 10/8 当兜底最危险:长假后首日堆满积压,距截止只剩 24 小时。建议 9/30 前完成切换与回归。
| 六、三个易错口径 |
1. 没有过渡价和宽限期:10/9 00:00 当次请求即按 GLM-5.3 计费。
2. 切换瞬间有数秒超时:需加重试机制,定时任务避开 10/8 23:50 至 10/9 00:10。
3. 不想被切换要在下线前完工单:可自行替换、停用调用或提工单;事后改回不免已产生费用。GLM 全系不区分峰谷,无闲时可挪,详见腾讯云模型单价与账单口径。
| 七、27 天倒排清单 |
| 时间 | 动作 | 负责 |
| 9/11–14 | 三平台盘点:grep 5 个 model 值 | 研发 |
| 9/15–18 | 对号入座算差价;定分层 | 研发+财务 |
| 9/18 前 | 导出批量任务清单 | 研发 |
| 9/21–25 | 灰度切换 + 质量回归 | 研发 |
| 9/26–30 | 全量切换;核查 COS 生命周期 | 研发+运维 |
| 10/8 | 复查:模型列表 + 单价 | 运维 |
| 八、代理渠道能做什么、不能做什么 |
作为腾讯云代理,先说清边界:改写官方单价、延长截止日、阻止自动切换——这三件事任何渠道都做不到。
腾讯云代理能做的是把不确定变成可执行排期:存量调用盘清、按真实 token 分布反推切换后账单、成本对比看板。
概泽科技是腾讯云核心代理商,这类技术口径梳理与迁移排期属日常服务。更多见通过腾讯云代理能省多少钱、腾讯云代理商折扣、腾讯云企业选型与采购攻略;Flash 定价见腾讯云 GLM-5.3-Flash 那篇。
|
概泽科技是腾讯云核心代理商,专注企业云服务超过10年,已服务超过5000家企业客户。 提供免费架构咨询、选型诊断、迁移规划,帮助企业以最低成本完成上云布局。 📞 17601247379
扫码获取专属优惠方案 · 1对1服务 |
在线咨询
二维码

TOP