应通过响应头x-billed-tokens字段或SDK的response.usage.total_tokens获取单次API调用真实计费token数,该值包含输入与实际输出,不含内部开销;账户整体用量可通过控制台“Billing & Usage”页面、计量接口或历史账单CSV导出查看。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想确认每次调用DeepSeek API到底花了多少token,避免月底账单突增却毫无察觉,必须绕过本地tokenizer的估算陷阱,直接抓取服务器返回的真实计费数字。
查单次请求的真实Token用量
方法一:读响应头x-billed-tokens字段(最权威)
发起POST /v1/chat/completions请求后→在HTTP响应头中查找x-billed-tokens→该值为纯数字字符串,例如"1247",已包含输入+实际生成输出,不含内部开销。
【注意:不是X-RateLimit-Remaining,也不是openai-ratelimit-remaining-requests】
方法二:用官方SDK的response.usage.total_tokens(推荐Python/Node.js)
SDK自动解析x-billed-tokens并映射为结构化属性,值与响应头完全一致。
不要再去加总prompt_tokens和completion_tokens——它们是调试字段,不参与计费。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
查账户整体用量
登录DeepSeek Platform控制台→进入「Billing & Usage」页面→查看剩余token、本月已用明细及各模型消耗分布。
数据可能有几分钟延迟,刷新页面可获取最新值。
API开发者还可调用计量接口:
向https://api.deepseek.com/v1/usage发送GET请求→在请求头中携带Authorization: Bearer YOUR_API_KEY→解析返回JSON中的total_usage和used_tokens字段。
建议设定时任务每日自动拉取,便于追踪趋势。
查历史账单与周期用量
第一步:进入控制台→点击“Billing”菜单项
第二步:选择计费周期(本月/上月/自定义时间段)
第三步:查看按日分列的API调用次数与tokens消耗摘要
第四步:点击“下载CSV”导出完整报告,用于存档或成本归因分析
【若发现异常高峰,立即检查API密钥是否泄露】


















