星火X2.5是一款由科大讯飞推出的全国产算力旗舰大模型,主要用于复杂代码生成与智能体(Agent)任务,支持长上下文理解与多步自主执行,适用于企业研发、数据分析与智能办公场景,在代码补全、跨文件重构与多步业务编排上表现突出;更多同类模型可参考 AI 模型库。
| 基础信息 | 内容 |
|---|---|
| 产品定位 | 全国产算力旗舰大模型(代码与智能体能力强化) |
| 出品方 | 科大讯飞(iFlytek) |
| 发布时间 | 2026年9月7日 |
| 模型架构 | MoE(混合专家) |
| 参数规模 | 293B 总参数,约 30B 激活参数(293B-A30) |
| 训练算力 | 全国产算力全流程训练与推理 |
| 核心能力 | 代码生成、智能体(Agent)任务、数学与语义理解 |
| 上下文窗口 | 旗舰版推理上下文 256k;端侧 4B/1.7B 支持 100 万 Token |
| 开源与价格 | 旗舰闭源 API;端侧 4B/1.7B 已开源可本地部署 |
| 获取方式 | 讯飞开放平台 |

星火X2.5 的核心能力
代码生成能力强化
星火X2.5 将代码生成作为重点升级方向,覆盖代码补全、跨文件重构与算法实现等任务,并增强了工具调用与多步任务规划能力,可承担从需求到实现的较长链路编码工作,在仓库级上下文与测试生成上的支持优于上一代,可配合 CI 做自动化评审。
智能体(Agent)与自主执行
模型强化智能体(Agent)能力,支持任务分解、工具调用与自主执行;给定原始数据后,可自主完成分析、报告生成与多语言翻译等连贯流程,减少逐步人工指令,并支持与 MCP 等工具生态对接,便于组合多个工具完成复杂任务。
数学与语义理解提升
在数学推理与综合语义理解等通用能力上持续进步,优化长序列下的理解稳定性,使模型在复杂问答、长文档分析与跨章节推理中保持一致性,在中文数学与逻辑题上的表现较同类国产模型有提升,适合教育、科研辅助场景。
全国产算力训练与超长序列优化
星火X2.5 基于全国产算力完成从训练到推理的全流程,并持续优化国产超长序列训练与推理难题,在自主可控与供应链安全上具备明显优势,降低对海外算力集群的依赖。
端侧模型与开源生态
与旗舰版同步,科大讯飞全资子公司词元星火已开源星火 X2.5-4B 与 1.7B 两款端侧模型,采用混合注意力架构,围绕智能体、代码、数学与指令遵循优化,使用约 20 万亿 Token 多样化数据预训练。端侧模型原生支持最长 100 万 Token 上下文,在 Domux 智能家居测试集上 1.7B 版本控制指令端到端执行正确率达 90.3%、平均响应 0.85 秒;4B 版本在算法实现与代码补全上可对标参数规模大 2~3 倍的云端模型。部署层面兼容英伟达、华为、海光及后摩等硬件平台,支持 vLLM、SGLang、llama.cpp 等推理框架,可通过 Ollama、LM Studio 快速部署,并用 LLaMA-Factory 做增量训练,适合手机、PC、汽车座舱与机器人等终端场景。
星火X2.5 与同类大模型的对比
| 对比维度 | 星火X2.5 | GLM-5.3 | GPT-6 Astra |
|---|---|---|---|
| 开发方 | 科大讯飞 | 智谱 AI | OpenAI |
| 发布时间 | 2026年9月7日 | 2026年8月(旗舰 API) | 2026年9月3日 |
| 参数规模 | 293B-A30B(MoE,约300亿激活) | 744B总/39B激活(MoE) | 未公开(10万+GPU训练) |
| 上下文窗口 | 旗舰256k;端侧100万Token | 1,048,576 Token(1M) | 1,005,000 Token |
| 开源与获取 | 旗舰闭源API;端侧4B/1.7B开源 | 权重开源(GLM-5.3 License) | 闭源 API/订阅 |
| 训练算力 | 全国产算力全流程 | 未强调国产算力 | 美国算力集群 |
| 核心定位 | 代码+智能体+数学理解 | 复杂编程+长程Agent+网络安全 | Computer Use+代码+数学+网络安全 |
| 多模态输入 | 文本(旗舰) | 文本(旗舰) | 文本+图像 |
从对比看,星火X2.5 的最大差异点在于全国产算力全流程训练与推理,以及同步开源的端侧百万 Token 模型;GLM-5.3 在开源权重与长程 Agent 上积累深厚,GPT-6 Astra 则在计算机操作与网络安全维度领先。三者定位相近,但在供应链与开放策略上明显不同;对注重自主可控与数据合规的用户,全国产算力是星火X2.5 区别于另两家旗舰模型的核心卖点。值得注意的是,星火X2.5 的端侧 4B/1.7B 已开源且支持百万 Token,这是另两家旗舰当前未开放的差异项。
如果希望以开箱即用的方式接入星火能力,可以关注讯飞星辰MaaS(科大讯飞官方模型即服务平台,已在 ai-bio 收录),它把星火系列模型以 API 形式对外提供,适合希望快速集成、不想自建推理集群的团队。
星火X2.5 的应用场景与适用人群
星火X2.5 的能力可落地到研发、办公、数据分析与边缘部署等多种场景;在注重自主可控与合规要求的政企、金融、科研行业,其全国产算力与本地化部署优势更具吸引力。相比单纯追求榜单分数的通用模型,星火X2.5 更强调把代码、智能体与长上下文能力直接转化为可执行的业务流,下面按场景与人群分别说明。
- 企业研发与代码辅助:在 IDE 与 CI 流水线中承担代码生成、补全与跨文件重构,降低重复编码工作量。
- 智能体业务编排:基于工具调用与任务规划接口,将多步业务流程编排为可自主执行的智能体,适用于客服、运营与数据分析。
- 长文档与数据分析:处理长篇文档、技术手册与表格数据,支持跨章节关联推理与结构化输出。
适用人群:适用于企业技术团队、AI 应用开发者、数据分析师以及需要本地化部署的政企客户;端侧 4B/1.7B 模型也适合对隐私与离线运行有要求的边缘场景。
星火X2.5 的使用方法
从开通账号到集成业务系统,按以下步骤即可接入星火X2.5 的对话与智能体能力,并可在业务中持续迭代优化,建议先以小规模试点验证再逐步放量。
- 开通平台账号:访问讯飞开放平台注册并实名认证开发者账号,模型文档与配额说明见 星火X2.5官网详情页。
- 选择模型版本:在控制台选择 Xinghuo X2.5 旗舰版,或按需选用已开源的 Xinghuo X2.5-4B 与 1.7B 端侧模型。
- 调用 API:通过 REST 或官方 SDK 发起对话与智能体任务请求,按需设置上下文长度与推理参数。
- 集成业务系统:基于工具调用与任务规划接口,将星火X2.5 接入内部流水线,实现多步任务的自主执行与持续迭代。
星火X2.5 的价格与开源情况
星火X2.5 旗舰版通过讯飞开放平台以 API 计费方式向开发者与企业提供。根据讯飞星辰 MaaS 官方模型详情页(更新于 2026-09-07)披露,旗舰版推理定价限时 5 折:输入 1.6 元/百万 tokens(原价 3.2)、输入缓存命中 0.24 元/百万 tokens(原价 0.48)、输出 6 元/百万 tokens(原价 12);企业可按调用量阶梯计价、规模化后边际成本可控,新注册用户通常可领取试用额度用于前期验证。
在开源方面,科大讯飞已先行开源 Xinghuo X2.5-4B 与 1.7B 两款端侧模型,权重已在 Hugging Face、GitHub 等平台开放,对应 API 也已上线讯飞星辰 MaaS 平台并限时免费,支持最长 100 万 Token 上下文、可本地部署,采用宽松开源协议,适合对数据隐私与离线运行有要求的场景;旗舰版目前为闭源商业模型,不开放权重,无法本地自部署。对于需要私有化或零成本方案的团队,可优先考虑已开源的端侧版本——它们兼容英伟达、华为、海光及后摩等硬件,并支持 vLLM、SGLang、llama.cpp 与 Ollama、LM Studio 等工具链,落地门槛明显低于云端旗舰。
星火X2.5 的常见问题
星火X2.5 是开源模型吗?
旗舰版为闭源商业模型,通过讯飞开放平台 API 提供;但 Xinghuo X2.5-4B 与 1.7B 两款端侧模型已开源,可免费本地部署。
星火X2.5 的训练用了哪些算力?
星火X2.5 基于全国产算力完成从训练到推理的全流程,持续优化国产超长序列训推难题,不依赖海外算力链。
星火X2.5 支持多长的上下文?
旗舰版推理上下文为 256k;已开源的端侧 4B/1.7B 模型支持最长 100 万 Token 上下文,两者定位不同,可按场景选择云端旗舰或端侧轻量版本。
星火X2.5 强在哪些能力?
重点强化代码生成与智能体(Agent)能力,并持续增强数学推理与语义理解等通用能力,适合研发辅助与多步业务自动化。
星火X2.5 的端侧模型支持哪些硬件与推理框架?
已开源的 4B 与 1.7B 端侧模型兼容英伟达、华为、海光及后摩等硬件平台,支持 vLLM、SGLang、llama.cpp 等推理框架,可通过 Ollama、LM Studio 快速部署,也能用 LLaMA-Factory 做增量训练,适合在手机、PC、汽车座舱与机器人等终端本地运行。
星火X2.5 与开源的 4B/1.7B 端侧模型是什么关系?
二者同属星火 X2.5 系列:293B-A30B 旗舰版走闭源 API、面向高并发复杂任务;4B/1.7B 端侧版已开源、可本地部署、主打百万 Token 长上下文与低延迟离线推理,开发者可按场景选择云端旗舰或端侧轻量版本。
浙公网安备33010202004812号