9月1日零点,科大讯飞正式开源星火X2.5-4B与X2.5-1.7B两款端侧通用大模型,免费、免授权、可商用,原生支持最长1M token上下文,在智能体交互、数学推理与多跳逻辑等能力上全面拉满。根据官方规划,9月7日科大讯飞还将发布293B参数的星火X2.5基座模型,面向车载、智能家居、万物互联等端侧场景深度布局,国产大模型的"端侧主权"争夺战由此正式打响。
此次开源的星火X2.5-4B与X2.5-1.7B,是科大讯飞面向端侧场景打造的通用大模型,参数量覆盖4B与1.7B两个档位,兼顾性能与部署成本。与多数轻量模型不同的是,两款模型原生支持最长1M token的上下文窗口,能够在资源受限的端侧设备上处理超长文档、进行长时间多轮对话,这在同类开源端侧模型中处于领先水平。
在能力维度上,星火X2.5端侧模型重点强化了智能体交互、数学推理和多跳逻辑。官方介绍称,模型针对工具调用、任务规划等智能体典型场景做了专项优化,同时保持了科大讯飞在中文理解上的传统优势。免费、免授权、可商用的开放策略,意味着开发者可以直接将模型集成到自有产品中,无需支付授权费用,也无需担心商用合规问题。
科大讯飞方面表示,两款模型的开源将进一步降低端侧AI的开发门槛,让手机、汽车、家电、机器人等终端厂商能够以更低成本获得"能跑的好模型",推动国产端侧大模型生态的繁荣。
目前,星火X2.5两款端侧模型已上架魔搭社区、Hugging Face等主流开源平台,并提供适配常见推理框架的量化版本与示例代码。开发者下载后即可在本地环境完成部署测试,社区反馈显示,4B版本在国产算力平台上运行流畅,中文问答与文档处理表现稳定,1.7B版本则更适合内存受限的嵌入式设备,两者互补覆盖了端侧场景的典型算力区间。
端侧大模型的价值,在于不依赖云端即可在本地完成复杂决策。这既回应了用户对隐私保护和"云依赖"风险的担忧,也让芯片厂商和终端制造商拥有了自主可控的模型能力。过去,端侧设备上的AI功能往往依赖云端接口,一旦网络不畅或服务中断,智能体验便大打折扣;而本地部署的模型可以实现离线运行、低延迟响应,数据不出设备,安全性大幅提升。
业内分析认为,"AI终端主权"的争夺已经正式开打。手机、汽车、智能家居、可穿戴设备等终端厂商都在寻找能够跑在本地、性能足够好的模型,星火X2.5-4B与1.7B的开源,正好填补了这一需求空白。对于芯片厂商而言,适配一款开源、可商用的端侧模型,意味着他们的硬件能够直接对接丰富的AI应用,端侧大模型将重塑车载、IoT与消费电子的AI交互范式。
科大讯飞此次开源的时机也颇为讲究。正值国内多家厂商密集发布端侧模型之际,星火X2.5以1M上下文和免费商用为差异化卖点切入市场,有望在车载语音、智能客服、离线翻译等讯飞传统优势场景中快速落地。
按照科大讯飞披露的路线图,9月7日将发布293B参数的星火X2.5基座模型,这是星火大模型的最新旗舰版本。端侧小模型与云端基座模型形成协同:轻量的4B与1.7B版本负责端侧实时响应,强大的293B基座承担复杂推理与知识密集型任务,两端联动构建完整的星火大模型服务体系。
在生态层面,科大讯飞一直强调国产算力适配。星火系列大模型已与多家国产芯片厂商完成适配,此次开源的端侧模型同样支持在主流国产平台上运行,助力构建自主可控的AI技术栈。科大讯飞相关负责人表示,公司将持续开放模型能力,与产业伙伴共同探索端侧AI在车载、教育、医疗、办公等场景的落地路径。
高频的开源迭代正在持续压低应用门槛。业内观点认为,免费可商用的强模型不断出现,将对闭源商业模型的定价权形成直接挑战;而端侧模型的开源,则让更多终端厂商和独立开发者有机会参与到AI应用创新中。科大讯飞以"开源端侧加云端旗舰"的组合拳布局,能否在竞争激烈的国产大模型格局中占据有利身位,值得持续关注。
除了模型本身,科大讯飞同步开放了配套的推理工具链与调优文档,帮助开发者快速完成模型裁剪、量化和部署。官方开发者社区也已上线,围绕端侧模型的性能调优、场景适配等问题展开交流,为后续生态共建打下基础。
端侧大模型的价值,最终要落到具体场景中才能体现。在车载领域,智能座舱是端侧模型最直接的应用阵地:语音助手需要听懂方言口音、理解多轮指令,并在隧道、地库等网络信号不佳的环境下保持稳定响应。星火X2.5端侧模型支持离线运行,能够在本地完成语义理解与意图识别,配合车载芯片即可实现流畅的人机交互,无需依赖云端回传,响应延迟显著降低。
在办公与教育场景,端侧模型的离线翻译、文档摘要、会议纪要整理等能力同样大有可为。对于经常出差、涉密办公或网络条件受限的用户而言,本地部署意味着敏感数据不出设备,既满足了效率需求,也规避了数据合规风险。教育领域的智能学习终端、词典笔等硬件,也可以借助1.7B这样的小参数模型实现低成本本地推理。
智能家居是另一个重点方向。家电厂商正在把大模型嵌入冰箱、音箱、扫地机器人等终端,但云端方案受制于网络时延与隐私顾虑,用户对"家中对话被上传云端"的担忧始终存在。端侧模型让设备在本地完成指令理解与决策,既保护家庭隐私,也保证了断网可用。对于芯片与模组厂商而言,适配一款免费、可商用的端侧模型,意味着他们的硬件能够直接对接丰富的AI应用生态,不必从零开始自研模型,端侧AI的商业闭环正在加速形成。
从开发者视角看,4B与1.7B两个档位覆盖了从手机、平板到嵌入式设备的算力光谱,免费商用授权则扫清了商业化顾虑。随着更多终端厂商和开发者基于星火X2.5进行二次开发,端侧AI应用的数量与质量都有望迎来一轮快速增长。