Runway 发布 Solaris:首个“界面世界模型”,终结代码与视觉的割裂

ADK Runway官方 / ADK编译 2026-09-24 5 分钟 148 次浏览
速览导读 / Summary

Runway 于 2026 年 8 月正式推出 Solaris,这是其“界面世界模型(Interface World Models)”家族的首个成员。Solaris 摒弃了传统软件中“视觉设计转代码”的中间层,直接通过图像生成实时交互界面。它支持像素级完美的虚拟试穿、自然语言驱动的物体操控以及无限开放的物理模拟,标志着 AI 从生成静态内容向构建动态、可交互数字环境的历史性跨越。

模型类型 Interface World Model 首个界面世界模型,直接生成交互界面
交互延迟 < 0.5s 保持实时交互感的关键延迟阈值
生成方式 Frame-by-Frame Synthesis 逐帧合成,无需中间代码表示

Key Insights / 核心看点

  • 1 Solaris 是首个'Interface World Models',直接通过图像生成实时交互界面,消除了传统软件中'视觉设计转代码'的中间层。
  • 2 支持像素级完美的虚拟试穿、自然语言驱动的物体操控以及无限开放的物理模拟,实现零损耗的视觉与交互统一。
  • 3 让 AI Agent 能够在动态、不断变化的界面环境中训练,解决了 LLM 在特定代码布局上泛化能力不足的问题。
  • 4 将软件从'脚本化的页面序列'转变为'活生生的交互环境',用户可直接与场景互动而非操作菜单。

Runway 发布 Solaris:终结代码与视觉的割裂

在软件开发的漫长演进中,操作系统(OS)一直扮演着“导演”的角色,它决定了屏幕如何渲染、程序如何响应。从早期的终端到如今的 Linux 和 macOS,应用程序都构建在这一层之上,且一旦发布便相对固定。

Runway 今天宣布推出 Solaris,这是其全新“界面世界模型(Interface World Models)”系列的首个模型。Solaris 提出的核心问题是:当操作系统开始为你使用它时生成应用程序和网站,会发生什么?

核心突破:消除中间层的“损失”

当前的软件构建流程存在一个根本性缺陷:视觉设计必须首先转换为中间表示(如代码),才能运行。这一转换过程导致了双重损失:

  1. 交互空间的压缩:软件只能实现开发者预先定义的行为,无法应对未预料的交互。
  2. 视觉保真度的牺牲:为了快速响应,界面往往需要简化设计细节,导致体验与原始设计脱节。

Solaris 通过联合处理渲染与交互,消除了这一中间层。它作为一个单一的世界模型,直接生成每一帧画面并响应用户输入。这意味着整个画面本身就是界面,无需任何转换步骤,从而实现了零损耗的视觉与交互统一。

三大核心能力

Solaris 为软件带来了三个颠覆性的新能力:

1. 完全视觉化 (Entirely Visual)

当图像本身就是应用时,用户不再需要透过一层看不见的代码去操作。想象一个虚拟服装店,展示间即是界面。用户只需以自身照片为参考,即可像物理世界一样拿起衣服试穿、拖拽重组陈列。这种“所见即所得”的体验,彻底消除了视觉设计与功能实现之间的鸿沟。

2. 具有生命力 (Alive)

由于应用是连续渲染的,它始终处于演化之中而非静止等待。光线变化会改变反射,物体在操作下会做出自然反应。用户可以用自然语言指令:“移动桌子以便我看清效果”或“改变沙发的颜色”。软件不再像浏览脚本化的网页,而更像是在与一个活生生的环境互动。即使是同一张起始帧(如手部 X 光片),面对相同的拖拽动作,也能产生截然不同的动态响应。

3. 开放无界 (Open-ended)

传统界面受限于开发者在开发阶段预设的交互流程。而 Solaris 将能力交给驱动的世界模型,支持在同一场景中涌现出完全未曾预料的交互行为。用户可以生成关于燃烧过程的交互式演示,观察不同材料在物理上合理的反应,这种灵活性打破了预设工作流的束缚。

重新定义 Agent 的训练环境

Solaris 不仅改变了软件形态,也为 AI Agent 的训练开辟了新的路径。目前的 LLM 在处理需要代码界面的复杂任务(如预订酒店、订购杂货)时仍显吃力,因为它们被训练在特定的代码布局上,难以适应界面微调。

Solaris 让 Agent 能够在不断变化的界面和可能从未存在过的布局上进行训练,真正实现了从“动作”到“响应”空间的坍缩。

“Solaris 将界面转变为一种交互体验,而非一系列页面。用户不再从菜单中选择选项,而是直接与场景本身互动。” —— Runway 官方团队

结语

Solaris 代表了 AI 从生成静态内容向构建动态、可交互数字环境的重大跨越。它解决了长期以来“知道事物”(如搜索引擎)与“实时响应”(如游戏引擎)分属两个世界的难题,为下一代智能应用奠定了全新的基石。

“Solaris turns an interface into an interactive experience rather than a sequence of pages.”

— Runway 官方团队

同主题深度资讯

查看更多 →
模型发布 2026-09-24

Recraft AI 发布 V4 Styles:一文详解多参考图风格控制的底层逻辑与最佳实践

Recraft AI 正式发布 V4 Styles 功能指南,深度解析其多参考图(1-10 张)风格控制机制。文章强调单一参考图是保证风格一致性的最优解,多参考图仅在视觉逻辑高度统一(如同品牌手册)时有效,严禁混用无关风格。核心亮点包括参考图与提示词(Prompt)的明确分工、对高分辨率原图的硬性要求、以及参考图权重调节功能。该更新无需微调即可实现即插即用的风格迁移,显著提升了商业绘图的可控性与效率。

Recraft AI官方 / ADK编译 5 分钟
模型发布 2026-09-24

Reve AI 服务终止:Recraft Studio 如何成为设计师的新一代可控生成引擎

随着 OpenAI 投资及团队转移,Reve AI 正式宣布停止图像生成服务,API 已于 8 月 14 日下线,生成功能将于 9 月 27 日终止。针对寻求高可控性、矢量输出及多模型工作流的设计师,Recraft Studio 提供了从像素到矢量、从单一模型到多模态生态的完整替代方案。本文详细梳理了迁移时间表,并深度解析了 Recraft Studio 在矢量编辑、跨项目风格一致性及多模型集成方面的核心优势。

Recraft AI官方 / ADK编译 5 分钟
技术解读 2026-09-24

Recraft AI 深度解析:矢量图像的核心原理、格式规范与应用边界

Recraft AI 技术团队发布深度指南,系统阐述了矢量图像(Vector Image)的数学原理及其与位图(Raster)的本质区别。文章详细对比了 SVG、EPS、PDF 及 AI 等主流格式的特性与适用场景,并探讨了矢量图在品牌标识、工业制造及网页设计中的实际应用价值,为开发者与设计师提供清晰的选型策略。

Recraft AI官方 / ADK编译 3 分钟
AI 工具 2026-09-24

美图 AI PPT 发布全新 Print-On-Demand 设计工作流,从创意到成品一键生成

美图 AI PPT 正式推出针对按需打印(POD)场景的专业设计解决方案,填补了通用 AI 绘图在商业落地环节的空白。该工具不仅提供从创意到样品的全链路生成能力,更内置了针对 T 恤、马克杯等实体产品的尺寸适配、安全区域预留及色彩对比度优化算法。开发者与创作者可利用其‘AI 辅助概念生成’功能,快速将模糊想法转化为符合印刷标准的可编辑矢量文件,大幅降低 POD 产品的试错成本。

美图AI PPT官方 / ADK编译 4 分钟
video · 免费+付费
★ 5.0 · 120评测
R

Runway

AI视频工具,绿幕抠除、视频生成、动态捕捉等功能

Runway是一个创新的AI视频工具,提供先进的AI视频生成、绿幕抠除、动态捕捉、视频编辑等功能。通过Gen-3 Alpha模型,支持用户将文本描述或静态图像转化为高质量、动态视频内容。Runway专注于艺术家和专业创作者,支持文本到视频(T2V)、图像到视频(I2V)等多种创作模式,具备高级导演工具和动作笔刷功能,推动影视创作领域的AI革命。

查看 Runway 使用教程与功能