Runway发布界面世界模型Solaris:界面像视频一样实时生成

会懂网AI资讯获悉,Runway公布首个界面世界模型Solaris。App与网页界面可像视频一样实时生成,用户点击、拖拽后模型直接生成下一帧,无需开发者预先写好代码。

技术上,Solaris基于Gen-4.5视频模型改造,采用逐帧自回归、少步蒸馏与自生成结果训练,在720p下实现实时交互。架构上由语言模型负责推理、世界模型负责渲染,这一分工让界面既能理解用户意图,又能实时输出连续画面。

在人类对比测试中,Solaris在指令遵循与行为自然度上的偏好分别达到61%和71%,明显高于传统的代码方案。这意味着对于许多界面交互场景,模型直接”生成画面”的体验已经优于”写代码实现”的结果。

Runway Solaris

Solaris的另一大用途,是为Computer Use Agent提供泛化训练环境。当前训练能操作电脑的智能体,最大瓶颈之一是缺乏足够多样、可无限生成的交互环境。界面世界模型能实时生成各种界面状态,相当于为Agent提供了近乎无限的练习场。

业内认为,Solaris的发布标志着”AI直接生成操作系统界面”这条路第一次被真正走通。尽管在文本渲染等细节上仍有短板,但当界面不再需要代码即可实时生成,人机交互的生产方式将被重新定义,这也为智能体训练与产品原型设计打开了新的想象空间。

从产品沿革看,Runway一直是AI视频生成领域的代表性公司,其Gen系列模型被广泛用于影视、广告与创意制作。此番推出Solaris,意味着其从”生成视频内容”进一步迈向”生成可交互界面”,技术边界再度外扩。

业内提醒,界面世界模型目前仍面临一致性、可编辑性与文本渲染准确性的工程挑战。实时生成虽已跑通,但要进入真实生产环境,还需解决长时间交互下的状态稳定与错误恢复问题。

© 版权声明
THE END
喜欢就支持一下吧
点赞14 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容