星火x2-flash是科大讯飞推出的面向智能体(agent)场景深度优化的大语言模型,采用moe(混合专家)架构,总参数量为30b,最大上下文长度达256k,全程基于华为昇腾910b国产ai芯片集群完成训练。该模型在深度研究报告生成、skill调用管理、系统级控制执行等典型agent任务中实测表现已逼近业界万亿级参数模型水平,同时整体token消耗不足当前主流大尺寸模型的三分之一,显著降低复杂智能体应用的开发与运行成本。模型已同步开放api接口,并实现与astronclaw、loomy等平台的快速集成。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

星火X2-Flash的核心能力
- 智能体任务处理能力突出:可高效支撑多轮交互、长链路推理与动态环境响应,在深度分析、技能编排、系统指令执行等高阶Agent工作流中达成接近顶尖万亿模型的效果。
- 代码与Skill构建能力强:针对视频生成等复杂Skill需求,能精准理解用户意图,并自动生成包含技能结构、核心逻辑、调用方式及示例的完整技术说明。
- 超长上下文支持稳定:256K上下文窗口满足数十万乃至百万级Token输入场景,适配长文档解析、多阶段任务追踪等典型Agent长程任务。
- 生态兼容性优异:已完成对OpenClaw、Claude Code等国际主流Agent框架的深度适配,同时接入AstronClaw、Loomy等国内领先智能体平台。
- 服务接入便捷:通过讯飞开放平台与星辰MaaS平台提供标准化API调用,星辰Coding Plan已全面启用该模型,支持开发者一键切换使用。
星火X2-Flash的技术实现路径
- MoE稀疏化架构设计:在30B总参数规模下,通过专家路由机制实现计算资源按需分配,兼顾性能与效率。
- 全国产算力训练闭环:依托昇腾910B硬件平台,结合定制化算子优化与分布式训练策略,实现软硬协同提效。
- 智能体数据自动合成体系:构建具备自我验证能力的大规模Agent数据生成平台,由模型自主搭建仿真环境、执行任务并评估结果准确性,形成高质量数据生产闭环。
- DSA+MTP联合长文本训练方案:首次在国产芯片上融合稀疏注意力(DSA)与多Token预测(MTP)技术,将256K长上下文训练效率较同规模A800集群提升4.5倍(从20%跃升至90%)。
- 强化学习采样加速机制:在RLHF及后续对齐训练中,通过算法重构与工程优化,使采样与解码效率最高提升2倍以上,有效缓解长交互场景下的训练延迟瓶颈。
星火X2-Flash的关键参数与接入信息
- 模型名称:星火X2-Flash
- 研发单位:科大讯飞 / 讯飞开放平台
- 架构类型:MoE(混合专家)
- 参数总量:30B
- 上下文长度:最高256K
- 训练底座:华为昇腾910B AI集群
- 首批接入产品:AstronClaw、Loomy
- API开放平台:讯飞开放平台、星辰MaaS平台
- 框架兼容性:OpenClaw、Claude Code等主流Agent框架
- 使用方式:开发者可通过讯飞开放平台或星辰MaaS平台申请API密钥调用;星辰Coding Plan用户可直接启用,无需额外配置
星火X2-Flash的核心竞争力
- 极致性价比:以30B中等规模模型达成近似万亿级模型的任务效果,Token成本压缩至行业主流大模型的1/3以内。
- 全栈国产化支持:从训练到推理均运行于昇腾910B平台,保障关键基础设施自主可控。
- 长文本工程能力领先:256K上下文非仅理论指标,已在真实Agent长链路任务中完成端到端验证。
- 训练效能跨越式提升:DSA与MTP技术融合使国产算力训练效率实现质变,突破以往长文本训练缓慢的固有瓶颈。
- 推理响应更敏捷:采样与解码环节效率翻倍,大幅缩短强化学习迭代周期,加速Agent智能进化。
- Agent原生友好:不仅功能适配,更在数据构建、框架对接、工具调度等维度深度内嵌Agent范式。
- 开箱即用生态成熟:已有多个实际落地产品完成集成,开发者可快速启动复杂智能体项目开发。
星火X2-Flash与主流竞品横向对比
| 对比维度 | 星火X2-Flash | DeepSeek-V3 | Qwen2.5-72B |
|---|---|---|---|
| **参数规模** | 30B(MoE) | 671B MoE(每次激活37B) | 72B(Dense) |
| **上下文窗口** | 256K | 128K | 128K |
| **模型架构** | MoE | MoE | Dense(密集架构) |
| **训练算力** | 华为昇腾910B(国产) | 英伟达H800集群 | 英伟达/AMD等多类GPU |
| **开源情况** | 闭源(API服务) | 开源(可本地部署) | 开源(可本地部署) |
| **Agent适配** | 原生优化,深度兼容OpenClaw、Claude Code | 通用能力强,Agent生态依赖社区/第三方 | 通用能力强,Agent生态依赖社区/第三方 |
| **任务效果** | 接近万亿级参数模型 | 接近GPT-4o水平,数学/代码突出 | 综合能力优秀,多语言支持好 |
| **Token成本** | 不到主流大尺寸模型1/3 | API定价较低(约GPT-4o的1/10) | API定价较低(约GPT-4o的1/20) |
| **核心定位** | Agent时代的性价比引擎 | 高性能开源基座模型 | 开源生态旗舰模型 |
星火X2-Flash的典型应用场景
- 高阶智能体工作流:如跨文档信息整合分析、多步骤科研报告撰写、带反馈修正的自动化决策流程等。
- Skill开发与生命周期管理:支持从需求理解、结构设计、功能实现到测试用例生成的一站式AI工具构建。
- 代码驱动型系统操作:覆盖脚本编写、命令行自动化、DevOps流程编排、IT基础设施控制等场景。
- 超长文本智能处理:适用于法律合同审查、学术论文精读、金融研报摘要、政府白皮书解析等专业领域。
- 多模态Agent中枢调度:作为统一“大脑”,协调调用文生图、图生视频、语音合成等异构工具链,完成端到端内容生成任务。


















