会懂网AI资讯获悉,9月1日,科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。作为端侧模型中唯一原生支持最长100万Token上下文的模型,两者把百万级信息处理能力带到了本地设备。
虽然参数规模不大,但两款模型重点提升智能体交互、数学推理和通用理解三大核心能力,面向车载、智能硬件、万物互联等端侧场景深度优化。以车载场景为例,100万Token可以容纳数百轮完整对话历史、整车维修手册甚至一座城市数月的交通日志,让模型不再”健忘”,能真正理解长期语境。

两款模型基于全国产昇腾910B算力训练,走自主可控路线。此前星火X1.5已实现1台昇腾标配服务器即可部署,训练效率从最初的30%提升至84%以上。更值得关注的是,这只是一个”前菜”——9月7日,科大讯飞将正式发布293B规模的星火X2.5基座模型,进一步升级代码与智能体能力。
1M上下文在小模型上意味着什么?通常这是旗舰模型才有的能力,如今下沉到了端侧。对小模型来说,上下文长度往往比参数规模更影响实用体验:车载助手要理解整段对话,智能硬件要记住用户偏好,1M上下文让这些场景真正可用。
另一个关键词是”智能体能力”。星火X2.5强调提升智能体能力,意味着小模型也要会调用工具、执行多步任务——不是只能聊天,而是要能”干活”。这是端侧AI从”语音助手”走向”本地智能体”的关键一步。
从财务数据看,讯飞正以”重投入换长跑”:上半年营收116.23亿元,研发投入高达30.07亿元,占营收比超25%,大模型API收入同比增长约70%,开发者团队突破1155万。端侧开源、云端基座、国产算力,讯飞正在构建一套完整的”端云协同”AI生态。





























暂无评论内容