首次成功调用GLM-4、GLM-4V、GLM-4-Plus或GLM-5-Turbo时即实时扣费,免费额度用尽后无缓冲期直接转付费,Dify等平台触发完整响应即计费,多模态接口单价更高,需通过配额管理页面查剩余Token并确保Key绑定独立实名主体。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

智谱清言API调用需要付费,但新注册用户实名认证后可获得几百万Token的免费体验额度,足够完成初期测试和轻量开发;未实名或未开通权限的账号无法调用GLM-4等高级模型,直接报错“Model not found”。
哪些情况会立刻开始计费
首次成功调用GLM-4、GLM-4V、GLM-4-Plus或GLM-5-Turbo模型时,系统即按实际消耗Token数实时扣费。免费额度用尽后,后续请求立即转为付费模式,【不设二次确认,无试用缓冲期】。
使用Dify、LobeChat等第三方平台接入时,只要配置了有效API Key并触发一次完整响应(哪怕只返回3个字),就算作一次有效调用,计入账单。
视频理解、AI绘图等多模态接口(如glm-4v-plus)单价更高,单次解析10秒视频可能消耗8万Token以上,远超纯文本场景——这一步容易误判成本,建议先用/text-only模式测通路。
如何确认自己还在免费额度内
登录智谱开放平台 → 进入「控制台」→ 点击左侧「配额管理」→ 查看「剩余Token」数值。
注意:该页面显示的是账户级总剩余量,不是当前Key专属额度;多个Key共享同一账户配额。
若页面显示“已用尽”,但你确定没怎么调用,大概率是Key绑定了企业子账号或被他人复用——【每个API Key必须对应独立实名主体,共用Key会导致额度混用且无法追溯】。
避开意外扣费的三个操作
第一步:在代码中强制添加model参数校验,禁止传入空字符串或变量未赋值的model字段,否则默认回退到GLM-4,而它不在免费模型池中。
第二步:所有HTTP请求头中加入X-Zhipu-AI-Request-ID,用于在控制台「调用日志」中精准定位每一笔消耗来源,避免因日志缺失导致争议。
第三步:在Dify等可视化平台配置模型时,手动下拉选择明确标注“(免费)”的模型(如glm-3-turbo),不要依赖自动填充或历史缓存选项。


















