2026年8月31日
科技

科大讯飞开源两款端侧模型 星火X2.5基座大模型9月7日亮相

「体验」只有生产力,没有爱奇艺?科大讯飞t2墨水屏平板体验分享

合肥,8月31日。科大讯飞总部大楼的会议室里,产品团队正在为9月1日的开源做最后准备。星火X2.5-4B和星火X2.5-1.7B两款端侧模型的代码仓库即将面向全球开发者开放。同一时间,三百公里外的南京,一家头部车企的智能座舱研发团队正在评估下一代的本地AI方案——车载场景对响应延迟和隐私保护的要求,让端侧大模型成为比云端调用更优的选项。

两款端侧模型开源,1M上下文窗口下沉至小参数模型

据科大讯飞官方消息,公司将于9月1日正式开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。两款模型原生支持最长1M token的上下文窗口——这相当于一次可处理约70万汉字的长文本,在端侧模型中属于头部水平。模型重点提升了智能体、数学和通用理解等核心能力,面向车载、智能硬件、万物互联等端侧场景提供模型支持。

所谓“端侧”,是指模型直接部署在手机、汽车、智能家居等本地设备上运行,数据无需上传云端。相比云端调用,端侧部署的优势在于低延迟(毫秒级响应)、数据隐私(敏感信息不出设备)和离线可用。但端侧设备算力和内存有限,模型必须足够“轻”。4B(40亿参数)和1.7B(17亿参数)正是为这类场景设计的紧凑尺寸。

1M token的上下文窗口从百亿级参数模型下沉到十亿级端侧模型,在业内尚属少见。这意味着即便在车载语音助手连续多轮对话、智能硬件长文档处理等场景中,模型也能“记住”更完整的上下文,而不必频繁截断信息。

紧接着,9月7日科大讯飞将正式发布星火X2.5(293B)基座模型,进一步升级代码和智能体等核心能力。293B参数属于超大模型范畴,与端侧开源模型形成“云端+端侧”的完整产品矩阵。

端侧大模型赛道拥挤,讯飞押注车载与智能硬件

2026年的端侧大模型市场已非蓝海。据市场研究机构报告,2026年中国端侧AI模型市场规模预计达280亿元,2030年有望突破1200亿元。阿里、字节、苹果、高通等巨头已集中进入这一市场。阿里开源了Qwen3.5系列0.8B至9B的多款小尺寸模型;面壁智能于2026年5月开源MiniCPM5-1B模型;Meta的Llama 4系列、Google的Gemma 3/4系列也在边端布局。

科大讯飞的差异化路径在于场景聚焦。据公开信息,公司已在车载智能座舱领域推出星火座舱端侧多模态大模型SparkAuto-EMM,提供0.5B至7B的多尺寸模型,适配多款主流芯片。智慧医疗、智慧汽车业务在2026年上半年分别同比增长58.56%和20.46%。在IDC发布的《中国AI软件市场半年度追踪,2025H2》报告中,科大讯飞以15.6%的市场份额位居语音语义领域第一。

开源策略则是另一重考量。将端侧模型开源,意味着开发者可以自由下载、修改和部署,有助于快速扩大讯飞大模型在端侧设备上的生态覆盖面——尤其是在车载和智能硬件这两个讯飞已有客户基础的赛道。

半年亏损2亿,研发投入不减反增

星火X2.5系列密集发布的背景,是科大讯飞正处于一个微妙的财务时刻。2026年半年报显示,公司上半年营业收入116.23亿元,同比增长6.52%;但归母净利润亏损2.04亿元。尽管亏损同比收窄14.68%,公司董秘在业绩会上坦言:“很多投资者都对这份半年报表达了不满意”。

亏损的直接原因是持续的研发高投入。上半年研发投入达30.07亿元,同比增长25.73%,占营业收入比重超过25%。公司表示,增加投入主要集中在星火大模型新版本研发、AI学习机及AI眼镜新品上市推广、海外业务拓展等方面。

从业务结构看,公司正在执行“做强C端、做深B端、优选G端”的调整策略。上半年G端(***)收入同比下降2.65%,B端和C端业务收入合计增长10%,占总营收的76%。开放平台成为增长最快的板块,收入37.05亿元,同比增长36.01%,规模已超过传统的智慧教育业务(34.90亿元)。

大模型相关服务开始贡献实质性收入。上半年大模型API及MaaS平台服务收入同比增长约70%。截至报告期末,讯飞AI开放平台汇聚1153万名开发者,其中大模型开发者达321.9万人,同比增长111%。

不过,硬币的另一面是C端硬件业务的压力。智能硬件收入7.32亿元,同比下降15.96%。公司解释称,芯片、存储价格上涨以及阶段性缺货对销售造成影响。董事长刘庆峰在业绩会上表示,公司年初已预判存储涨价趋势并提前增加备货,“如果不备货,下半年要多花好几亿元”。

现金流方面,上半年经营活动产生的现金流量净额为-9.45亿元,但销售回款达到118.96亿元,同比增加15.35亿元,销售回款率达102%,二季度经营现金流已单季转正。

国产算力:从“孤勇者”到生态共建

如果说端侧开源是讯飞面向当下的战术动作,那么国产算力则是决定其长期竞争力的战略命题。

2026年2月,科大讯飞发布基于全国产算力训练的星火X2大模型;4月推出星火X2-Flash,成为首个完全基于华为昇腾910B集群训练和推理的30B参数MoE架构大模型。董事长刘庆峰曾表示,大模型浪潮初起时,不少公司都想在国产算力上尝试,但讯飞成了“孤勇者”——最早基于全国产算力底座训练和推理大模型的企业。

据公司在2026年半年度业绩说明会上透露,在今年全球1024开发者节上,科大讯飞将推出基于全国产算力的全新主力通用大模型。公司总裁吴晓如表示,该模型将在代码能力和Token性价比上整体达到国内第一梯队水平,在全国产算力训练的通用大模型中各项指标继续保持国内领先。

国产算力并非坦途。据业内分析,目前国产算力在显存带宽方面存在限制,主要算力集群的采样推理效率与H200相比约有五倍差距。但这一差距并不对应所有模型能力,且差距正在缩小——2026年国产AI芯片已形成华为昇腾为“一超”、寒武纪等“多强”的格局,2025年昇腾出货约81.2万张居国产第一。8月21日,科大讯飞与海光信息共建的“星光联合实验室”正式揭牌,围绕海光CPU、DCU计算平台开展联合技术攻关。

面对持续的算力投入压力,刘庆峰透露下一阶段公司将更多采用租赁算力,或与***及相关厂商联合建设后租用,避免一次性大规模购买算力带来的重资本开支。

中标金额行业第一,商业化加速落地

在商业化层面,科大讯飞交出了一组有说服力的数据。据公司披露,2024年、2025年及2026年上半年,公司在大模型相关项目中标数量和金额上均位居全行业第一。讯飞星火AIPC已入围中央国家***2026年度台式计算机框架协议采购项目,全面覆盖龙芯、飞腾、兆芯、海光四大国产技术路线。企业级API已覆盖能源、金融、运营商等近百个垂直场景。

但挑战同样存在。据2026年3月SuperCLUE中文通用大模型综合榜单,讯飞星火X2位列国内闭源模型第8位。在C端用户规模上,据QuestMobile 2026年3月数据,讯飞星火月活3300万,与头部竞品存在差距。此外,公司应收账款余额超过159亿元,To G业务的回款周期仍是不可忽视的财务压力。

从8月底的端侧开源,到9月7日的基座模型发布,再到1024开发者节的全新国产算力大模型——科大讯飞正在用密集的产品节奏回应市场的质疑。但最终,市场关心的不只是发布了多少模型,而是这些模型能否转化为可持续的营收增长和利润改善。在研发投入占比超过四分之一的当下,这条路既清晰,也漫长。

本文由AI辅助生成

分享到: