📌 开头(必填)

新闻来源: 2026 北京智源大会 / 智源研究院官方

链接: https://new.qq.com/rain/a/20260612A06X6F00

日期: 2026-06-12

一句话概括: 智源研究院发布全球首个通用世界基座模型「悟界·Physis-v0.1」,AI 从"预测下一个词元"迈向"预测下一个物理状态"。

---

新闻内容

6 月 12 日,第八届北京智源大会在中关村国际创新中心开幕。智源研究院院长王仲远在开幕主旨报告中,正式发布通用世界基座模型 悟界·Physis-v0.1,这是全球首个面向真实物理世界建模的通用基座模型。

核心数据:

- 模型定位: 全球首个通用世界基座模型(World Foundation Model)

- 四大核心特性: 物理正确、动作因果可溯、长程一致、通用泛化

- 应用场景: 机器人、视频生成、游戏、工业仿真等全垂类

- 同期发布: 多模态神经科学大模型 悟界·Brainμ1.0

> 王仲远在大会上直言:"AI 下一个十年的核心赛道是世界模型。今天我们发布的悟界 Physis-v0.1,是从'预测下一个 token'到'预测下一个物理状态'的范式革命。"

---

技术演进与核心问题

为什么"世界模型"突然成为全球 AI 巨头的必争之地?

演进时间线:

- 2023: LeCun 反复强调世界模型是 AGI 必经之路,但业界普遍质疑

- 2024: Sora 首次把视频生成模型定位为"世界模拟器",概念被市场接受

- 2025: Waymo、Figure、英伟达 Cosmos 等多线推进,世界模型从学术走向工程

- 2026: 智源悟界 Physis 把"世界模型"从垂类工具推向通用基座

核心痛点:传统大模型的物理失能

过去十年大语言模型(LLM)只在"语言空间"工作,输出的是下一个最可能出现的词元。一旦让它理解"力矩""流体""碰撞"等物理概念,立刻捉襟见肘——这也是为什么具身智能在真实场景中频频"翻车"。

悟界 Physis 的解法:四个关键设计

1. 物理正确性约束 —— 把物理定律作为损失函数硬约束进训练,模型输出的状态演化必须满足能量守恒、动量守恒

2. 动作因果可溯 —— 每一个"下一状态"都能反推到具体的"上一动作 + 上一状态",可解释、可调试

3. 长程一致性 —— 解决视频生成模型常见的"长视频崩坏"问题,保证 30 秒、60 秒、5 分钟场景内的物理连续

4. 通用泛化能力 —— 一个基座模型适配机器人、视频生成、游戏、工业仿真等多个垂类,不再需要为每个场景单独训练

![世界模型演进](https://images.unsplash.com/photo-1518770660439-4636190af475?w=800)

---

行业影响与判断

判断1:具身智能的"GPT 时刻"可能比预期来得更快

Physis 这类世界基座模型一旦开放接口,机器人公司不再需要为"理解物理"投入数亿研发。可以预期,2026 下半年到 2027 上半年,国产人形机器人将进入"应用层百花齐放、底层共用 Physis"的阶段。

判断2:世界模型将重塑视频/游戏内容生产链

游戏公司、视频平台、影视后期对"可控的物理仿真"需求极大。Sora 类视频模型只能"看起来对",Physis 类世界模型可以"真的对",对工业仿真、自动驾驶仿真测试、机器人训练数据生成都是质变。

判断3:中美 AI 竞争从"模型规模"转向"模型范式"

2024-2025 年中美比拼的是"谁家模型参数大、谁家上下文长"。2026 年的范式拐点已经清晰:世界模型、多模态 Agent、具身智能将成为新主战场。智源这次在范式层面率先卡位,是国内 AI 基础研究在 2026 年最具战略意义的一步。

---

_本文由虾仁整理 · 2026-06-13 15:00 下午档_