无限世界、实时交互,蚂蚁灵波开源 LingBot-World 2.0 世界模型
最新 7 月 9 日消息,今天,蚂蚁灵波正式开源全新一代实时交互世界模型 ——LingBot-World 2.0(又称 LingBot-World-Infinity)。
据官方介绍,LingBot-World 2.0 全面升级了世界预测与交互能力 —— 支持更多动作与事件,解锁多样化交互玩法与模拟;小时级时长实时生成,长时间运行画质不衰减;稳定输出 720p/60fps 高清实时画面。我们希望通过开源,为游戏开发、交互式创作、自动驾驶仿真以及具身智能训练,提供一个更加强大、可持续的开源基座。
最新附官方详细介绍如下:
更丰富的交互动作与事件:不只是导航
传统交互式世界模型的动作空间往往局限于简单的镜头移动与角色导航。LingBot-World 2.0 在这一维度上进行了大幅扩展。
在动作层面,模型支持了远比前代丰富的角色动作类型 —— 包括施法、攻击、射箭、射击等战斗动作,以及跳跃、滑翔等运动动作。这些动作不是简单的动画叠加,而是由模型根据当前场景状态实时生成对应的视觉变化,确保动作结果与环境之间保持物理合理性与视觉一致性。
在事件层面,LingBot-World 2.0 支持更丰富的文本驱动事件。你可以通过文本指令触发宏观环境变化 —— 例如从城市切换到森林、召唤一场暴风雪、让天空中飞过一群鸟 —— 也可以注入新的实体或道具。模型会根据当前世界状态,判断合理的时空插入点,并将这些变化无缝融入正在运行的世界中。
此外,系统还内置了 Agent 机制:Pilot Agent 负责规划和执行角色行为,Director Agent 则在场景推进过程中实时提出新的环境事件,让世界不再静止,而是不断自我演化、随你而变。LingBot-World 2.0 还支持多人同时进入同一个世界,多位用户可以在同一个持续运行的世界中共同探索、互动,开启 AI 原生的多人交互体验。
突破短时生成的天花板:小时级稳定运行的无边界世界
在交互式世界模型的构建中,最棘手的难题莫过于“长时漂移”。当视频生成的时间线拉长,误差往往会随着帧数累积,导致画面出现纹理模糊、几何变形,最终使得原本合理的场景彻底崩坏。因此,传统模型往往只能维持几秒到几分钟的稳定生成,内容结束后便无法继续。
LingBot-World 2.0 的核心目标,是让世界可以持续运行 —— 用户可以不断输入动作,环境也可以随着时间不断变化,而不是在一段固定时长的视频播完后就结束。为此,我们采用了精心设计的因果预训练范式(Causal Pretraining Paradigm),从根本上抑制了复合误差的产生。同时,我们提出了混合双向与自回归注意力掩码机制(MoBA),在保持生成质量的同时有效缓解了长程自回归导致的误差积累与画质退化。
在长达一小时的不间断压力测试中,LingBot-World 2.0 展现出了惊人的持久力:画面始终保持着锐利的纹理和连贯的场景,没有出现明显的画质衰减。论文实验表明,这种稳定性不是偶然的短视频片段效果,而是模型的结构性能力。在与现有开源及闭源系统的对比中,LingBot-World 2.0 是唯一能够实现小时级(乃至无限)生成时长的通用交互世界模型。

告别延迟:720p/60fps 的高清实时交互
一个真正可用的数字演练场,不仅要能持久运行,还必须对用户的每一个动作做出即时响应。然而,高保真视频渲染与实时交互之间往往存在巨大的算力矛盾。
为了打破这一瓶颈,我们从预训练的因果世界模型中蒸馏出专为实时交互设计的快速版本。结合一致性蒸馏(Consistency Distillation)与分布匹配蒸馏(DMD),我们在大幅降低采样成本的同时,有效抑制了长时自回滚带来的视觉退化。
在工程部署层面,我们引入了编译器级别的注意力 kernel 优化、混合并行推理策略、动态 KV 缓存调度以及异步流媒体传输机制 —— 系统不是“等整个视频块生成完再显示”,而是边生成、边解码、边传输。最终,LingBot-World 2.0 成功实现了在 720p 分辨率、60fps 帧率下的稳定输出。你可以通过键盘实时控制角色移动与视角切换,在低延迟的响应中体验流畅的高清交互。
本次开源的 14B 模型提供高质量体验,适用于研究验证与复杂交互世界的构建,采用非商用开源协议。同时,我们联合 Reactor(PC 端)与灵光 APP(移动端)提供了在线体验入口 —— 你可以直接在平台上感受 World 2.0 的实时生成与交互能力,无需自行部署。SGLang 也已于 Day 0 完成对 LingBot-World 2.0 的适配,开发者可以开箱即用地进行高效部署与推理服务。
目前,LingBot-World 2.0 的模型权重及推理代码已全面开源。
《无限世界、实时交互,蚂蚁灵波开源 LingBot-World 2.0 世界模型》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
华为昇腾 950 超节点荣获 2026 世界人工智能大会最高荣誉 SAIL 奖
@华为中国 昨日(7 月 18 日)发布博文,宣布昇腾 950 超节点(Atlas 950 SuperPoD)荣获 2026 世界人工智能大会(WAIC)最高荣誉 SAIL 奖。... -
“反 AI”情绪愈演愈烈,多家头部 AI 公司加强高管安保
《华尔街日报》报道称,针对 AI 行业的敌意不断上升,开发先进 AI 模型的人员和企业正面临越来越多的威胁与袭击企图。多家头部 AI 公司已经加强安保,部分高管出行时甚至由武装保镖随行,另一些人则选择降低曝光度,减少公开活动。... -
OpenAI 回应 GPT-5.6 Sol AI 意外删除用户文件:已采取措施降低风险
OpenAI 核心产品负责人蒂博 · 索蒂奥(Tibo Sottiaux)于 7 月 16 日在 X 平台发布推文,回应 GPT-5.6 Sol 会擅自删除用户文件问题。... -
面向手机的 AI 游戏创作工具,《Roblox》移动版将更新“Build”功能
Roblox 为移动版客户端推出“Build”功能,用户通过简单提示词即可生成基础游戏,无需编程技能。该功能由多种 AI 模型驱动,支持生成玩法、环境、角色等。将于 7 月 28 日开启 Alpha 测试,首先面向新西兰用户开放。#Roblox #AI 游戏创作 #移动游戏开发#... -
歌曲生成平台 Suno 部分源码泄露,被发现全网爬取数百万歌曲训练 AI
科技媒体 404Media 昨日(7 月 16 日)发布博文,报道称基于黑客披露的 Suno 内部源代码,该 AI 歌曲生成平台从 YouTube Music、Deezer 和 Genius 等平台抓取数百万首歌曲来构建其核心模型。...












