☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

根据OpenRouter最新统计,9月14日至20日期间,全球AI大模型总调用量为129万亿Token,较前一周上升1.57%。其中,中国大模型单周调用量达67.46万亿Token,环比增长10.28%;而美国同期调用量为14.21万亿Token,环比下滑34.7%。至此,中国已连续21周在周度调用量上稳居全球第一。
当周全球调用量TOP5榜单中,有4款模型来自中国。DeepSeek V4.1-Flash以15.8万亿Token的调用量强势登顶,环比激增219%。该模型于9月10日正式发布,聚焦强化代码生成、智能体(Agent)能力及多模态理解性能,底层采用Causal-Encoder-Decoder架构,全局KV Cache占用量约为V4-Flash版本的1/4。其非高峰时段每百万Token的输入缓存命中、未命中及输出价格分别为0.02元、1元和4元,相较上一代分别降低60%、33.3%与11.1%。
token智能省流助手,节省20%-70%token,自动对用户输入文本、代码片段、对话内容进行智能压缩,显著降低单次对话与上下文长度,从而节省模型推理开销、延长对话窗口、提升响应速度并降低 Token 消耗。
但需注意的是,单价下调并不等同于单任务成本必然下降。Artificial Analysis实测数据显示,V4.1-Flash平均每项任务消耗约8.9万输出Token,高于V4Flash0731的约6.2万Token,被指出存在输出内容偏冗长的问题。
另外,智谱GLM5.3Flash以14.1万亿Token位列第二;腾讯混元Hy4preview调用量为12.5万亿Token,位居第三;DeepSeek-V4-Flash-0731则以9.44万亿Token排在第五位。

















