LongCat API推出Token资源包和API按量计费两种方案,分别适配短期高并发与调用频率不固定的场景,并停用旧版Flash模型以聚焦LongCat 2.0迭代,标志着国产大模型生态走向成熟。

过去,开发团队在部署大模型时,往往需要预估长期资源消耗。
此次 LongCat API 的计费调整,提供了两种方案:
Token 资源包
适用于短时间内需要大量调用模型的项目,例如:
- AI 应用上线测试
- 大规模数据处理
- 批量代码生成
资源包购买后可在有效期内灵活使用。
API 按量计费
针对调用频率不固定的开发团队,平台支持充值余额并按照实际 Token 消耗计费,帮助企业更精确控制 AI 使用成本。
与此同时,官方还宣布停止部分旧版 Flash 系列模型服务,将资源集中投入 LongCat 2.0 的持续迭代,推动开发者尽快迁移至新一代模型。
行业观察
越来越多 AI 平台开始采用"基础模型 + 按量付费"模式。
LongCat API 的商业化升级,也意味着国产大模型生态正在逐步走向成熟,为企业级 Agent 应用提供更加稳定、可持续的基础设施。

















