当前位置:首页 > 技术

2026年,AI不再“生成内容”了,它开始“生成世界”

蜗牛5小时前技术73

一个根本性的问题正在被回答:当视频能够持续生成、实时响应,人就不再只是观看一段内容,而是可以进入一个由模型生成的世界。

 

过去两年,我们习惯了用AI生成一段视频、一张图片、一篇文章。你输入提示词,等待渲染,收到成片。这是一种“一次性工作流”。但2026年,这个范式正在被彻底推翻。

 

阿里ATH事业群发布了开放式世界模型HappyOyster(快乐生蚝),主打实时世界创建与交互。仅凭一行文本或一张图片,用户就可以生成一个完整的物理世界——光照、重力、角色动作以及场景间的因果关系都保持时间和逻辑上的连续一致。生成的并非视频片段,而是一个持续运行的物理世界。你可以随时介入,用文本或语音切换镜头角度、指导角色行动,世界会立即响应。

 

HappyOyster几乎同时入场的,还有爱诗科技的PixVerse R1、蚂蚁灵波科技的LingBot、智象未来等团队。它们讲述的故事高度相似:视频模型正在越过AI短剧的边界,向互动娱乐腹地推进。

 

一个特别的玩家Loopit发布的实时互动世界模型Zing-0.5,在可交互视频世界模型评测WBench中拿到第一,并宣布开源。这家以“可以玩的抖音”被外界熟知的应用公司,在产品上线后曾获马斯克点赞,两个月登顶欧美娱乐榜。

 

Loopit做了更值得玩味的事——它公开戳破了实时视频模型的“世界梦”。Loopit提出,纯实时视频流无法直接走到世界模型终局,多人、持续、可互动的数字世界,需要先由Code维护状态、规则和因果,再由Pixel完成开放的生成式渲染。换句话说,先用Coding × Pixel把世界运行起来,再让端到端模型从这个世界里长出来。

 

这个判断的深层含义是:世界模型的终局,可能不是“更大的视频模型”,而是一个真正可编程、可交互、可演化的数字宇宙。视频生成只是入口,不是终点。


【版权声明】

本网站内容主要源自网络公开渠道转载,所有文字、图片、视频等内容版权归原作者及原始出处所有。本站仅作信息分享用途,不用于商业目的。若涉及版权问题,请权利人及时联系(邮箱D16.png),本站将立即删除相关内容。

分享给朋友: