会懂网AI资讯获悉,9月3日,上海人工智能实验室开源”书生·万象”InternVL 3.5系列多模态模型,参数覆盖10亿至2410亿,在权威多模态评测MMMU取得77.7分,逼近国际前沿。在国产多模态集体提速的9月,书生系列把”开放权重+中文场景”作为主线。

InternVL 3.5延续”视觉-语言统一”的架构,强化图像、视频与文档的理解与推理,面向OCR、图表、医疗影像与机器人感知等场景。2410亿的旗舰版本瞄准高难多模态任务,小版本则照顾端侧与私有化部署。
开源是书生系列的一贯姿态。开放权重让高校、企业与科研机构在基座上做后训练与行业适配,既加速国产多模态生态,也在全球开发者心智中建立”中国多模态可用、可改”的认知。
与纯文本模型不同,多模态是机器人的”眼睛”。InternVL这类视觉语言模型,正成为具身智能、工业检测与医疗影像的共性底座。上海AI实验室的定位,是用开放大模型支撑产学研与产业的”公共品”。
会懂网认为,在多模态成为AI下一主战场的当下,书生·万象的开源具有”基础设施”意义:它降低行业使用多模态的门槛,也反哺国产算力与框架生态。77.7分的MMMU,是国产多模态进入第一梯队的信号。
但多模态的落地要看真实场景ROI。会懂网会关注InternVL 3.5在医疗、制造与机器人上的二次训练与部署,看开放权重能否持续变成产业价值。
从10亿到2410亿参数的完整梯度,说明这次开源并非单点发布,而是一次体系化输出。会懂网认为,这种“全家桶”式开放,能让不同算力的团队都找到可落地的版本,对生态扩张的意义大于单个模型的跑分成绩。MMMU上77.7分的成绩,也表明开源多模态与前沿闭源之间的差距正在收窄。接下来值得关注的,是中文场景下的实际表现与社区反馈速度。






















暂无评论内容