千问API费用受模型类型、部署区域、输入输出长度及调用模式等多重因素影响,不同模型在内地、国际及金融云价格各异,且含免费额度、Batch折扣、文档解析专项计费等规则。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜
如果您尝试调用千问api接口,但对产生的费用缺乏清晰认知,则可能是由于模型类型、部署区域、输入输出长度及调用模式等多重计费因子共同作用所致。以下是针对该问题的详细价格说明:一、按模型与部署区域划分的价格标准
千问API采用分模型、分地域的差异化定价策略,同一模型在内地、国际及金融云部署时单价不同。中国内地部署享有90天各100万Token免费额度,国际及金融云部署则无此权益或额度受限。
1、千问Max(qwen3-max)中国内地部署(北京地域):输入0–32K Token:2.5元/百万Token;输出:10元/百万Token;输入32K–128K Token:输入4元/百万Token,输出16元/百万Token;输入128K–252K Token:输入7元/百万Token,输出28元/百万Token。
2、千问Plus(qwen3.5-plus)中国内地部署:输入0–128K Token:0.8元/百万Token;输出:4.8元/百万Token;输入128K–256K Token:输入2元/百万Token,输出12元/百万Token;输入256K–1M Token:输入4元/百万Token,输出24元/百万Token。
3、千问Long(qwen-long)中国内地部署:输入0.5元/百万Token;输出2元/百万Token;支持Batch调用并享50%折扣。
4、千问Omni(qwen3-omni-flash)中国内地部署(多模态支持):文本输入1.8元/百万Token;纯文本输出6.9元/百万Token;音频输入15.8元/百万Token;图片/视频输入3.3元/百万Token;多模态输入下的文本输出12.7元/百万Token。
二、按调用模式与服务特性调整的计费规则
除基础模型单价外,调用方式(如Batch、上下文缓存、思考模式)会触发价格浮动,且各项优惠不可叠加使用。
1、Batch调用:所有模型的输入与输出单价均降为实时推理价格的50%。
2、上下文缓存启用:仅输入Token享受折扣,输出Token不参与降价。
3、思考模式:qwen3.5-plus模型下,思考与非思考模式输出价格相同,无额外加价。
4、缓存命中场景:最低计费可低至0.00008元/千tokens,适用于高频重复请求的轻量级交互。
三、开源模型与特殊场景的独立计费项
开源模型与面向垂直领域的专用模型拥有独立价格体系,其定价不与主系列模型联动,且部分型号无免费额度。
1、qwen1.5-7b-chat(开源):0.006元/千tokens;qwen1.5-14b-chat(开源):0.008元/千tokens;qwen1.5-72b-chat(开源):0.02元/千tokens。
2、qwen-vl-plus(视觉语言):0.008元/千tokens;qwen-vl-max:0.02元/千tokens。
3、通义点金(金融领域专用):输入单价高于通用模型,具体数值依部署规格而定。
四、文档解析类功能的专项计费结构
当通过API调用文档解析能力时,计费主体由Token转为页数或Prompt,与常规文本生成逻辑分离。
1、中国站文档解析基础费用:0.1元/页;信息抽取:0.2元/prompt;图片信息抽取:0.04元/图片/prompt。
2、国际站对应费用(美元结算):0.015美元/页;0.1美元/prompt;0.01美元/图片/prompt。
3、API接入Qwen-Long进行长文档处理:输入0.0005元/千tokens;输出0.002元/千tokens。
五、免费额度与平台级优惠获取路径
阿里云为新用户提供分层式免费资源,覆盖模型调用、文档解析及平台服务等多个维度,但需主动申领并注意时效限制。
1、开通即享:各模型100万Token免费额度,自开通日起90天内有效。
2、百炼平台专属:可领取超7000万免费Token,适用于Qwen-Long、Qwen-Plus等主流模型。
3、APP端文档解析:万页PDF及1000万字符解析完全免费,但不适用于网页端与API调用场景。


















