会懂网AI资讯,9月5日,8月31日,盛大网络联合创始人陈大年淡出一线近十年后复出创业,创办上海原点星辉(StartLux)并发布首款模型StartLux-V1.0-27B-Preview。在工信部中国信通院”可信AI大模型基准测试”MCP专项测试中,这个仅27B参数的模型综合得分39.25%,排名第二。

排名的分量在参数对比中才显现:榜首是1.6万亿参数的DeepSeek-V4-Pro,StartLux仅落后约1.3个百分点;而排在它身后的,是284B的DeepSeek-V4-Flash与198B的Step-3.7-Flash,参数规模分别是它的十倍和七倍以上。与同为27B的基座Qwen3.6-27B相比,它高出5.34个百分点。
该测试覆盖位置导航、网页搜索、浏览器自动化、金融分析、代码仓库管理、3D设计六类专项任务加综合评估,考察的是Agent在真实环境中的多工具协同与复杂任务执行能力。StartLux在位置导航位列第一,浏览器自动化、金融分析等单项与1.6T的旗舰并列或独占第一。
关键在于训练方法。模型以Qwen3.6-27B为基座,采用团队自研的Auto Research(AI训练AI)后训练方案:让模型在真实工具环境中自主执行任务,根据环境反馈持续调整策略。官方称这是国内首个用该方案完成后训练的本地Agent模型,可实现从”回答问题”到”完成任务”的质变。
陈大年押注的是本地部署——模型可直接运行在消费级PC上,把持续累积的云端Token费用转化为可控的设备算力与电力消耗,同时数据不出域、断网可用。他预测本地模型三年内将占据80%的市场。不过该模型目前暂不向公众开放测试,成绩也仅在MCP专项这一基准上取得。





















暂无评论内容