会懂网AI资讯获悉,9月3日,科大讯飞子公司词元星火宣布开源星火 X2.5 的两款端侧模型——4B 与 1.7B 版本。最抓人眼球的是,它是目前端侧唯一原生支持最长 100 万 Token 上下文的模型,意味着手机、车机这类小设备,也能一次性“读”进一整本书级别的资料再开口。
技术上看,X2.5 采用混合注意力架构,围绕智能体、代码、数学和指令遵循做了专门优化。在智能家居控制场景里,端到端正确率达到 90.3%,平均响应 0.85 秒——这个时延对语音交互来说已经接近“无感”。换言之,端侧不再只是跑个简单指令,而是能连续处理长任务。

训练底色也很“国产”。模型基于全国产算力、用约 20 万亿 Token 预训练,同时适配英伟达、华为、海光等平台,并能对接 vLLM、llama.cpp 等主流框架,权重已在 HuggingFace 开放。这种“国产算力 + 开放生态”的组合,降低了部署方的锁定顾虑。
有意思的是它的定位。1.7B 这种极小尺寸,本意就是塞进手机和 IoT 设备做常驻助手;4B 则更适合需要一定推理力的本地场景。讯飞把敏感操作(语音识别、图像识别)设计为 100% 在端侧完成,正好契合隐私合规的硬要求。
官方还预告 9 月 7 日将发布旗舰大模型。端侧轻量 + 云端旗舰的“组合拳”,让讯飞在“小模型上端、大模型入云”的路线图上又往前推了一步。对开发者来说,先拿端侧版做原型、再换旗舰版做重活,是顺手的节奏。
会懂网判断,端侧模型的价值不在跑分,而在把 AI 从“联网才聪明”变成“随身就聪明”。当百万上下文能装进一部手机,本地知识库、离线助理、车载陪伴这些场景,才真正有了规模化落地的基础。




























暂无评论内容