产品Runway News·原文 2026年9月1日本站收录 2026年9月7日

Runway发布Solaris:首个实时生成用户界面的“接口世界模型”

Solaris能够逐帧实时生成整个界面,无需传统代码转换;在用户研究中,71%的对比中其交互被认为更自然。目前仅向合作伙伴提供早期访问申请。

AI解读:Solaris试图解决传统软件开发的根本瓶颈:设计必须先转换成代码,这既丢失视觉细节,也限制了交互可能性,而且用户看到的界面是固定的,只能执行程序员预设好的操作。Solaris把这件事反过来——它直接根据用户输入逐帧生成界面,相当于让AI在运行时"画"出应用,而不是执行预先写好的程序。这对两类人影响最大:一是开发者,尤其是做电商展示、品牌官网这类强视觉、个性化需求高的场景,他们可以省掉大量前端代码工作,直接描述想要的界面和交互;二是AI Agent的训练者,因为Solaris生成的界面每次都在变,Agent被迫学会通用的操作逻辑,而不是死记硬背某个网站的布局。但要注意,Runway自己承认目前生成的稳定文字仍是难题,且需要保证长时段的连贯性,所以它更适合视觉展示、试穿试用这种对精确文字要求不高的场景。现在它只开放早期访问申请,普通用户暂时用不上。

Runway于5月20日发布Solaris,称其为新一代AI系统“接口世界模型”(Interface World Models)的首个模型。Solaris不再依赖传统应用通过代码转换界面,而是作为实时交互模型逐帧生成界面本身,每一帧都在用户交互过程中合成,让界面连续响应操作。

这一模型支持完全视觉化的应用交互、持续演进的动态场景,以及超出预设流程的开放式行为和对象工具化操作。据Runway介绍,它可让用户像操作物理环境一样点击、拖拽场景中的物体(如把衬衫拖到自己身上试穿),也可用自然语言改变场景(如“移动桌子看看效果”)。

技术上,Solaris基于Runway的Gen-4.5视频生成模型改造,以交互信号作为下一帧的生成条件,并通过自回归生成、蒸馏降噪步骤及教师模型输出训练实现实时响应,输出保持720p视觉质量。

Runway在博客中表示,正在与关键合作伙伴合作推动Solaris公开发布,目前仅开放早期访问表格申请。

与编码界面的对比测试:用户偏好数据

Runway将Solaris与前沿语言模型Claude Opus 5进行了对比测试,两者基于同一初始图像和交互请求响应。测试收集了250名参与者在30个交互示例上的近7500项成对判断,结果显示:

在两个指标上,参与者均偏向Solaris。在“是否更好遵循给定指令”上,Solaris获得61%偏好(编码结果为24%,13%判定相当);在“场景内表现是否更自然”上,Solaris获得71%偏好(编码结果为21%,6%判定相当)。

  • Runway据此认为,Solaris在保持整个场景一致性方面更好,产生的交互更自然且具备物理基础;而编码界面往往将每个交互视为对界面的孤立更新。
  • Runway同时给出独立的图像重建评测结果:测试了包括Claude Fable 5在内的多模态语言模型从单张截图重建网站界面的保真度,发现所有模型都随视觉复杂度增加而丢失信息,自然图像受影响最严重,因为语言无法准确表达丰富视觉细节。

已承认的局限:文本、信任与长时一致性

Runway在“What it can't do yet”部分承认以下现状:稳定清晰的可读文本仍是视频生成最难题之一,实际可行的路径是“混合系统”——允许暂停时由图像模型渲染文字密集视图,视频模型负责连续交互,但完全实时的生成式文本仍是开放问题。

模型目前依赖用户提供的初始帧进行锚定,初始可合成真实产品图与参考资料;在会话中基于更丰富经核实上下文生成(参考图、产品数据、文档)仍处于研究阶段。此外,长时开放式交互的视觉与语义一致性仍是研究重点。

同时,生成式界面仍须嵌入现有软件栈,兼容屏幕阅读器等辅助技术及可访问性API,这是集成层面的未解问题。

信息来源

Runway News原始来源