讯飞星火大模型

义项:科大讯飞大模型
讯飞星火大模型

讯飞星火大模型(SparkDesk)是科大讯飞研发的认知智能大模型系列,2023 年 5 月 6 日首次对外发布[1]。该系列具备文本生成、语言理解、知识问答、逻辑推理、数学能力、代码能力、多模态交互等核心能力,整体布局为「1+N」体系,即一个通用底座大模型带动教育、医疗、金融、汽车等行业落地[2]。自 2023 年 10 月起,该系列依托与华为联合打造的国产算力平台「飞星一号」训练与推理,是国内较早探索全栈国产算力路线的大模型之一[3]。

目录
  1. 定义
  2. 原理
  3. 发展历程
  4. 应用
  5. 局限
  6. 参见

定义

讯飞星火大模型是科大讯飞自主研发的认知智能大模型系列,面向通用对话与行业落地两类用途,定位于「懂你的 AI 助手」[1]。它并非单一模型,而是按能力分层、按输入输出量计费的一组模型矩阵,向开发者通过开放平台接口提供调用[4]。

该系列最初发布时即提出文本生成、语言理解、知识问答、逻辑推理、数学能力、代码能力和多模态交互七大核心能力,并在此后多次迭代中持续扩充。产品形态包括网页版、移动端应用、桌面版以及浏览器插件,同时以软件开发工具包形式嵌入学习机、办公本、翻译机、录音笔等硬件设备。

原理

讯飞星火的底座模型基于 Transformer 神经网络结构,在 TB 级规模的中文与多语言文本上训练而成。其技术路线强调「1+N」布局,「1」指通用底座大模型,「N」指由底座派生的教育、医疗、金融、汽车、运营商、工业等行业模型。底座与行业模型之间通过「模型底座—行业模型—智能体应用」的闭环持续迭代[3]。

在算力层面,科大讯飞与华为合作搭建国产算力平台「飞星一号」,2023 年 10 月 24 日发布,是国内首个支持万亿参数大模型常态化训练的国产万卡算力集群,其大模型训练任务性能达到同规模英伟达 A800 集群的 90% 以上[3]。为提升混合专家模型的推理效率,联合团队采用了适配混合专家架构的预填充与解码分离部署、多 token 预测、专家负载均衡以及异步双发射等技术,使集群推理性能相比上一版本提升约 1 倍[5]。

模型的工程实现涉及若干关键参数。以星火 X2.5 为例,其采用混合专家架构,总参数量 2930 亿,每次推理激活约 300 亿参数,支持 256K 上下文[6]。科大讯飞还发布了非自回归语音大模型架构,与逐字顺序生成的自回归模型不同,该架构可并行一次性输出整个文本序列,官方称其效果相对提升 16%,推理成本下降 520%,并已应用于讯飞输入法 15.0 版[7]。

发展历程

2023 年 5 月 6 日,科大讯飞在安徽创新馆正式发布星火认知大模型,这是该系列的首次亮相。同年 9 月 5 日,该模型向全民开放,至 10 月用户数已突破 1200 万[8]。2023 年 10 月 24 日,在第六届世界声博会暨科大讯飞全球 1024 开发者节上,V3.0 版本发布,官方称其七大能力整体对标 ChatGPT,医疗领域表现超过 GPT-4[8]。

2024 年 1 月,V3.5 版本发布,成为国内首个基于国产算力训练的全民开放大模型[3]。2024 年 6 月 27 日,V4.0 版本在北京国家会议中心发布,在文本生成、语言理解、知识问答、逻辑推理、数学能力等方面实现对 GPT-4 Turbo 的整体超越,并在 8 个国际主流测试集中排名第一[1]。同年 10 月 24 日,4.0 Turbo 版本发布,官方称其在 14 项主流测试集中的 9 项实现超越,效率相对提升 50%[9]。

2025 年 1 月,科大讯飞发布深度推理大模型讯飞星火 X1,这是国内首个基于全国产算力训练的深度推理模型,在模型参数比同类模型小一个数量级的情况下,整体效果对标 OpenAI o1 与 DeepSeek R1[10]。2025 年 11 月 6 日,在第八届世界声博会暨 2025 科大讯飞全球 1024 开发者节上,讯飞星火 X1.5 发布,采用混合专家架构,推理效率相比 X1 提升 100%,多语言能力超过 130 种[11]。

2026 年,该系列继续密集迭代:2 月 11 日发布星火 X2 大模型,采用 293B 混合专家稀疏架构,推理性能相比 X1.5 提升 50%[12];4 月发布星火 X2-Flash 并开放接口;6 月发布多模态大模型 X2-VL[13]。9 月 7 日,星火 X2.5 上线讯飞开放平台,重点提升代码与智能体能力[6]。

应用

讯飞星火的落地方式以「1+N」体系为主,行业覆盖面包括教育、医疗、金融、汽车、运营商和工业等。在教育领域,搭载该模型的 AI 学习机提供英语口语陪练、中英作文批改、数学互动辅学等功能,星火智能批阅机可完成作业扫描、分步批改与错因诊断[8]。在医疗领域,科大讯飞发布「智医助理医院版 1.0」,提供辅助诊疗与病历生成功能,讯飞星火医疗大模型 X1 已在北京安贞医院开展试点验证[11]。

在办公与出行场景,星火智慧座舱 2.0 面向汽车座舱提供交互能力,讯飞智能办公本 X5 与讯飞听见应用同步升级[11]。在语音方向,星火语音同传大模型升级至 2.0 版本,可支持多语种与多方言免切换识别[7]。

面向企业客户,科大讯飞提供云边端及软硬一体化的大模型解决方案,并推出星火企业智能体平台,发布商机助手、招采助手等示范应用[14]。据行业媒体统计,2025 年科大讯飞大模型相关项目的中标金额达 23.16 亿元,中标数量与金额在全行业统计中均列第一[12]。在开发者生态方面,讯飞开放平台开放 1007 项 AI 能力,汇聚 1153 万开发者,其中大模型开发者 321.9 万[13]。

局限

与直接使用英伟达芯片的方案相比,在国产算力上开展新算法的适配优化需要付出额外的算力成本与时间代价,科大讯飞官方在投资者问答中承认这一点,并表示这些投入将转化为技术自主性与生态可控性方面的先发优势[15]。早期将训练脚本从 CUDA 迁移到国产软件栈时,仅自定义算子的精度对齐即需耗费较长时间,这类工作通常不体现在公开测评榜单中[4]。

在独立评测中,模型的能力表现存在波动。有开发者实测指出,豆包、通义千问等产品拥有亿级活跃用户规模,而星火应用月活约 236 万,在国内 AI 应用榜单位列第 22;独立博主对星火 X2.5 的定位是纯国产算力阵营中的领先者,但稳定性与前代类似,输出结果的不确定性较大[16]。此前的深度推理版本在幻觉控制、指令理解与输出格式方面均出现过问题,例如混淆多条指令、在推理中途遗忘约束条件,以及输出使用上下标字符或特殊空格符号导致排版混乱。

有第三方对多个大模型的对比测试显示,国产模型在回应敏感问题时往往采取拒绝回答的方式,讯飞星火在该测试中表现较为保守,未给出有效信息[17]。在长文本理解与词汇运用测试中,该模型虽能理解近义词辨析需求,但常产生不符合字数限制或形式要求的结果,说明在词汇积累与运用方面仍有提升空间[17]。

参见

  • 科大讯飞 —— 讯飞星火大模型的研发与运营主体。

  • 大语言模型 —— 讯飞星火所归属的技术门类。

  • 飞星一号 —— 支撑讯飞星火训练与推理的国产算力平台。

  • 混合专家模型 —— 讯飞星火多个版本采用的稀疏架构。

  • 深度推理模型 —— 讯飞星火 X1 及后续版本的技术方向。

  • 智能体 —— 讯飞星火面向企业与开发者的主要应用形态。

参考资料

  1. 展商动态 | 科大讯飞携创新AI产品亮相第三届全球数字贸易博览会-全球数字贸易博览会 . gdte.org.cn [引用日期2026-10-08]
  2. 科大訊飛星火大模型:“1+N”體系賦能多個領域 . people.com.cn [引用日期2026-10-08]
  3. 讯飞星火凭借三大核心能力形成领先优势:一是国内首个实现大模型训练与推理全栈自主可控 . szse.cn [引用日期2026-10-08]
  4. 讯飞星火大模型怎么样?我踩坑后的实测结论 . vergex.cn [引用日期2026-10-08]
  5. 性能再翻倍!科大讯飞联合华为在“飞星一号”上实现MoE模型大规模专家并行集群推理性能飞跃 . c114.com.cn [引用日期2026-10-08]
  6. 全国产算力训出2930亿参数!讯飞星火X2.5来了,附一手实测 . zhidx.com [引用日期2026-10-08]
  7. 让更懂你的AI成就更好的你 . chinadevelopment.com.cn [引用日期2026-10-08]
  8. 安徽省机构编制委员会办公室 . ahjgbzw.gov.cn [引用日期2026-10-08]
  9. 用人工智能共创美好世界 . thepaper.cn [引用日期2026-10-08]
  10. 算力封锁下的逆袭,国产推理大模型的崛起与征途- DoNews专栏 . donews.com [引用日期2026-10-08]
  11. 科大讯飞发布讯飞星火X1.5及系列AI软硬一体方案 . xinhua.org [引用日期2026-10-08]
  12. 科大讯飞正式发布星火X2大模型 整体能力对标国际顶尖模型水平 . ifeng.com [引用日期2026-10-08]
  13. 可控大模型 . szse.cn [引用日期2026-10-08]
  14. 科大讯飞股份有限公司 关于讯飞星火大模型升级发布会的提示性公告_国家_技术_语音 . sohu.com [引用日期2026-10-08]
  15. 中国股票投资者关系平台互动问答 . 10jqka.com.cn [引用日期2026-10-08]
  16. 三周连发三个模型、知乎吵成两派:星火X2.5的真实信息量,藏在0.24、64K、238.8万这三个数字里 . smzdm.com [引用日期2026-10-08]
  17. 目录 . news.cn [引用日期2026-10-08]
词条评价
词条统计

浏览次数:2 次

阅读量:0 次 · 阅读完成量:0 次

最近更新:2026-10-08T12:36:13Z

历史版本

完成率 = 阅读完成量 ÷ 阅读量,分母是阅读量不是浏览次数 —— 关了 JS 的、秒退的都在浏览次数里、不在阅读量里。 详细口径在后台的「数据统计」页。

本条目引用的词条
科大讯飞 开放平台 北京 科大讯飞 大语言模型 飞星一号 混合专家模型 深度推理模型 智能体
红色的还不存在。红链不是错误——它标出"这个概念被引用了但还没人写"。