星火X2.5 科大讯飞推出的旗舰通用大模型系列
星火X2.5是什么
星火X2.5是科大讯飞推出的旗舰通用大模型系列,包含云端MoE基座模型(293B/30B)及开源端侧模型星火X2.5-4B和星火X2.5-1.7B。模型基于全国产算力全流程训练,实现全栈自主可控。核心升级代码生成、智能体协作与数学推理能力,端侧版本原生支持100万Token超长上下文,采用混合注意力架构降低计算开销。兼容英伟达、华为昇腾等多硬件平台,支持vLLM、Ollama等主流框架,已在讯飞开放平台及Hugging Face等渠道开放。

星火X2.5的主要功能
- 全国产自主可控 :基于全国产算力完成全流程训练,实现从底层芯片到上层模型的全栈自主可控。
- MoE 高效架构 :采用 293B 总参数 / 30B 激活参数的混合专家架构,兼顾强大性能与推理效率。
- 代码智能生成 :大幅提升代码理解与生成能力,在 SWE-Bench 等权威代码评测中超越更大参数模型。
- Agent 自主执行 :深度集成主流 Agent 框架,支持复杂任务的多步骤自主规划、工具调用与协作完成。
- 数学逻辑推理 :数学与逻辑推理能力显著增强,在高考、AIME 等评测中达到行业顶尖水平。
- 百万 Token 长上下文 :原生支持 100 万 Token 超长上下文,端侧模型中唯一具备该能力,可处理整本书或长视频。
- 端侧轻量开源 :开源 4B 和 1.7B 端侧模型,采用混合注意力架构,在手机、IoT 等设备上高效运行。
- 全硬件生态兼容 :无缝支持英伟达、华为昇腾、海光、后摩等芯片,兼容 vLLM、Ollama 等主流框架。
- 多语言能力 :支持 200 余种语言,覆盖全球主要语种,满足跨语言交流与国际化部署需求。
星火X2.5的技术原理
- 全国产算力训练 :基于华为昇腾等国产智算集群完成模型预训练与后训练的全流程,摆脱对海外算力的依赖,实现从底层芯片到上层模型的全栈自主可控。
- MoE 混合专家架构 :采用稀疏激活的混合专家设计,总参数量 293B,推理时仅激活 30B,在保持大模型性能的同时显著降低推理成本与显存占用。
- 混合注意力机制 :端侧模型采用 1 层全注意力与 3 层滑动窗口注意力交替的架构,以极低的计算开销原生支持 100 万 Token 超长上下文,打破端侧长文本处理瓶颈。
- MOPD 后训练优化 :通过大规模强化学习与 MOPD(多目标偏好蒸馏)等后训练技术,针对性增强代码生成、Agent 自主规划、数学推理和指令遵循等核心能力。
- 端侧轻量化设计 :开源的 4B 与 1.7B 模型围绕端侧场景深度优化,在智能家居、手机等低算力设备上实现亚秒级响应,同时保持接近云端大模型的任务完成质量。

如何使用星火X2.5
- API 调用 :登录讯飞开放平台或星辰 MaaS 平台获取密钥,通过标准 OpenAI 兼容接口接入,目前限时免费。
- 模型下载 :前往 Hugging Face、ModelScope、GitHub 等渠道下载 Spark-X2.5-4B 或 1.7B 模型权重文件。
- 本地部署 :根据硬件选择推理方案,NVIDIA GPU 用 vLLM/SGLang,华为昇腾 NPU 拉取官方 Docker 镜像,Apple Silicon 直接用 MLX。
- 一键运行 :通过 Ollama 或 LM Studio 导入模型,无需编写代码即可在本地启动聊天服务。
- 定制微调 :用 LLaMA-Factory 加载开源模型进行增量训练,快速适配特定行业或业务场景。
星火X2.5的核心优势
- 全国产自主可控 :基于华为昇腾等国产算力完成全流程训练,实现从芯片到模型的全栈自主可控,摆脱外部依赖。
- MoE 高效架构 :293B 总参数仅激活 30B,以更低推理成本获得接近更大模型的性能表现。
- 代码能力顶尖 :在 SWE-Bench 等权威代码评测中超越 9B 级模型,算法实现与代码补全能力突出。
- Agent 自主执行 :深度兼容 Codex、OpenClaw 等主流 Agent 框架,支持复杂任务的多步骤自主规划与工具调用。
- 数学推理领先 :高考、AIME 等数学评测成绩达到行业第一梯队,逻辑推导与解题能力显著增强。
- 百万 Token 长上下文 :原生支持 100 万 Token 超长序列,为端侧模型中唯一具备该能力的产品,可处理整本书或长视频。
- 端侧轻量开源 :4B/1.7B 模型面向手机、IoT 等设备优化,以极小参数实现接近云端大模型的任务完成质量。
- 全硬件生态兼容 :无缝适配英伟达、华为昇腾、海光、后摩等芯片,支持 vLLM、Ollama 等主流框架一键部署。
星火X2.5的项目地址
- GitHub仓库 :https://github.com/XHToken/Spark-X2.5
- HuggingFace模型库 :https://huggingface.co/collections/XHToken/spark-x25
星火X2.5的同类竞品对比
对比维度 | 星火X2.5 | Qwen3.7-Max
| 对比维度 | 星火X2.5 | Qwen3.7-Max |
|---|---|---|
| 模型架构 | MoE(293B 总参数 / 30B 激活) | 密集架构(约 450B 激活参数) |
| 训练算力 | 全国产(华为昇腾集群) | 阿里云灵骏集群 |
| 上下文长度 | 100 万 Token(端侧原生支持) | 100 万 Token |
| 代码能力 | SWE-Bench Pro 44.4(4B 端侧) | SWE-Bench Pro 60.6 |
| Agent 能力 | 深度集成 Codex、OpenClaw 等框架 | 支持 35 小时自治执行 |
| 开源策略 | 端侧模型开源(Apache 2.0) | 闭源(仅 API 调用) |
| 硬件生态 | 英伟达 / 昇腾 / 海光 / 后摩 | 阿里云生态为主 |
| 核心优势 | 全国产自主可控 + 端侧 1M 上下文 | 多模态融合 + 长周期自治 Agent |
星火X2.5的应用场景
- 智能编程开发 :凭借顶尖的代码生成与 SWE-Bench 表现,支持从需求分析到测试部署的全流程软件工程,可作为 AI 程序员大幅提升开发效率。
- 企业级 Agent 自动化 :深度集成主流 Agent 框架,支持复杂任务的多步骤自主规划、工具调用与闭环执行,适用于办公自动化与跨系统业务流程。
- 端侧长文本处理 :端侧模型原生支持 100 万 Token 超长上下文,可在手机、车载等离线设备上实现整本书籍阅读、长篇合同审查与长视频理解。
- 智能教育与数学辅导 :在高考、AIME 等数学评测中达到行业顶尖水平,可支撑个性化数学解题辅导、逻辑推理训练与自适应学习路径规划。
- 全国产信创部署 :基于全国产算力实现全栈自主可控,满足政府、金融、能源等对数据安全与供应链自主有严格要求的行业私有化部署需求。
相关工具
与本文相关的 AI 工具