9月14日快讯,据阿里云官方通报,deepseek-v4.1-flash已正式入驻千问ai平台,配套api服务及token plan同步开启。
开发者既可通过标准API将模型能力集成至自有应用与业务系统,亦可直接在Qoder、千问APP、Codex等AI工具中调用Token Plan。
该模型具备原生多模态理解能力,无需额外视觉模块即可同步处理文本与图像输入;上下文长度最高达100万Token,适用于代码编写、超长文档解析、视觉推理及智能体(Agent)类复杂任务。
依托新一代KV缓存压缩技术,其HBM显存占用降至前代模型的四分之一,SSD存储需求压缩至八分之一,显著优化长上下文推理与高频请求场景下的资源开销与响应效率。
使用 OpenAI Codex CLI 处理编码任务。触发词:codex、code review、fix CI、refactor code、implement feature、coding agent、gpt-5-codex。Clawdbot 可将编码工作委托给 Codex CLI 作为子代理或直接工具。
本次上线由阿里云百炼平台联合vLLM开源社区协同推进——vLLM完成对DeepSeek-V4.1-Flash的快速适配,百炼则高效完成模型部署并面向全量开发者开放服务。未来,阿里云将持续深化与开源社区的合作,加速更多优质开源大模型的工业化落地与规模化应用。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜



















