腾讯混元API的Token用量可通过三种方式获取:一是解析成功响应中的usage字段,直接获取prompt_tokens、completion_tokens和total_tokens;二是使用API Explorer在线调试查看Usage对象;三是调用GetTokenCount接口预估输入文本的token_count,但不支持输出token预估。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

从API响应中直接提取Token用量
每次成功调用腾讯混元API后,响应体中必定包含usage字段,里面就存着本次请求的完整Token消耗明细。
这一步操作起来很简单,直接解析JSON响应即可,不需要额外发起查询请求。
以Python SDK为例:调用client.ChatCompletions(req)得到resp对象后,执行resp.Usage.PromptTokens就能拿到输入Token数,resp.Usage.CompletionTokens是输出Token数,resp.Usage.TotalTokens是两者之和。
【注意:只有调用成功且返回HTTP 200时,usage字段才一定存在;若接口报错(如401、429、500),响应里没有usage,强行访问会抛AttributeError】
用API Explorer在线调试时查看Token用量
打开腾讯云API Explorer,选择hunyuan → ChatCompletions接口,填好参数并点击“发送请求”。
在右侧“响应内容”面板中向下滚动,找到"Usage"对象——它和请求体同级,不是嵌套在Choices里。
你会看到三个整型字段:prompt_tokens、completion_tokens、total_tokens,数值清晰可见,旁边还带单位说明。
这个方式适合快速验证某条提示词的开销,不用写代码,但无法用于自动化统计。
调用GetTokenCount接口预估输入Token
如果你只想知道一段文本作为Prompt会消耗多少Token,不实际触发模型推理,就用独立的GetTokenCount接口。
第一步:构造POST请求,Host设为hunyuan.tencentcloudapi.com,X-TC-Action头设为GetTokenCount;
第二步:在请求体JSON中只传一个必填字段"Prompt",值为你想测的原始文本字符串;
第三步:发送后查看响应中的TokenCount字段,该值即为这段文本被模型分词后的Token数量。
这个接口不计费、不限流(默认20次/秒),但【它只计算输入,不模拟模型实际生成行为,completion_tokens无法预估】。


















