行业新闻

从 “悟道” 到 “悟界”:智源大会发布三大 AI 里程碑,物理世界 AI 时代全面开启

发布于 2026-06-15关键词: 北京智源大会

2026 年 6 月 12 日,第八届北京智源大会在北京开幕,一场 AI 技术的 “范式革命” 正在上演。 本届大会以 “世界模型:人工智能的下一个浪潮” 为主题,集中发布了三款具有里程碑意义的 AI 模型,标志着人工智能正式从 “预测下一个词元” 的语言时代,迈入 “预测下一个物理状态” 的物理世界交互时代。

 

PART 01

全球首创:悟界・Physis-v0.1 通用世界基座模型,让 AI “懂物理” 

 

智源研究院院长王仲远在大会上重磅发布全球首个通用世界基座模型 “悟界・Physis-v0.1”,这是 AI 发展史上的一次重大突破 —— 模型不再局限于处理文字、图像等虚拟信息,而是能够理解并预测重力、运动、因果等物理规律,实现从 “会说话” 到 “懂世界” 的质变。

四大核心特性,重构AI认知世界的方式

 

特性
技术突破
应用价值
物理正确
以物理隐空间表征替代像素 / 帧预测,从根源保证物理规律一致性
解决 AI 在真实世界中 “常识缺失” 问题,避免违反物理规则的决策
动作因果可溯
建立 “状态 — 动作 — 结果” 的明确因果链,而非单纯时序关联
让机器人理解 “为什么这样做”,而非机械执行指令
长程一致
支持 50 余种复杂物理场景的长程推理,预测可达 1000 + 时间步
适用于工业控制、自动驾驶等需要长期规划的场景
通用泛化
跨场景迁移能力,无需针对特定任务重新训练
大幅降低 AI 应用开发成本,加速产业化落地

从实验室到产业,应用场景全面开花

该模型可适配机器人、视频生成、游戏、工业、数字孪生等全垂类真实物理应用场景:


工业制造:预测生产线物料流动轨迹,优化调度方案,降低故障率

 

自动驾驶:预判复杂路况下其他车辆的运动趋势,提升决策安全性

 

机器人交互:让服务机器人理解物体重量、材质等物理属性,实现更自然的人机协作

 

数字孪生:实时同步物理世界状态,为城市规划、能源管理提供精准模拟

 

🤖 具身智能新高度:

星源智 ω-EVA,让机器人 “先动脑再动手”

北京星源智机器人科技有限公司在大会上发布全球首个具身交互世界模型 ω-EVA,其核心创新在于构建了 “预演 - 验证 - 行动”(Envision-Verify-Act) 决策闭环 ,彻底改变了机器人 “被动执行” 的传统模式。

颠覆性逻辑:机器人的 “内心预演” 机制

ω-EVA 的工作流程与人类思考方式高度相似:


1.Envision(预演):接收视觉观察和语言指令,生成初始动作方案

 

2.Verify(验证):在潜在特征空间中预判动作可能带来的环境变化,分析风险

 

3.Act(行动):根据预演结果修正动作,输出最优执行方案


与单纯依赖视频生成模型 “生成未来画面” 的传统方案不同,ω-EVA 专注于学习 “当前状态 — 动作 — 未来状态” 之间的动态关系,在潜空间中捕捉运动物体、交互对象与关键状态变化,从根源上降低机器人操作失误与碰撞风险。

技术亮点与产业价值

1.2B 参数轻量化设计,适配主流机器人硬件平台

 

毫秒级响应:单次决策预演耗时 < 100ms,满足实时控制需求

 

零样本迁移:学会一个场景后可快速适配同类任务,无需重新训练

 

安全保障:在执行高风险操作前进行多次模拟验证,避免安全事故


该模型特别适用于工业机器人、服务机器人、医疗手术机器人等需要高精度、高安全性操作的场景,为具身智能产业化落地提供了核心技术支撑。

📱 端侧 AI 革命:面壁智能 MiniCPM5-1B,10 亿参数挑战 GPT-4 水平

面壁智能联合清华大学、OpenBMB 开源社区在大会上展示了新一代端侧文本基座大模型 MiniCPM5-1B,这款仅10 亿参数的轻量级模型,在国际权威评测 Artificial Analysis (AA) 榜单上拿下17.9 分,超越所有 2B 参数以下模型,成为全球 2B 规模内最强开源基座模型。

三大技术突破,重新定义端侧 AI 能力边界

1.极致参数效率:1B 参数跑出 2B 性能,INT4 量化后仅约 0.5GB,可在普通手机、边缘设备上流畅运行

 

2.AI 自进化训练:采用 ForgeTrain 自监督训练框架,模型可 “自我提升”,训练成本比传统方法降低 10%

 

3.接近 GPT-4 水平:与 2024 年 5 月发布的 200B 参数 GPT-4o 榜单得分仅相差零点几分,提前实现端侧模型达到 GPT-4 水平的目标

端侧 AI 的黄金时代:

从云端到边缘的全面赋能

MiniCPM5-1B 的发布,标志着端侧 AI 应用进入爆发期:


隐私保护:数据本地处理,无需上传云端,解决用户隐私安全问题

 

实时响应:毫秒级推理延迟,支持离线使用,提升用户体验

 

成本降低:减少云端算力依赖,降低 AI 应用部署成本

 

场景拓展:赋能智能终端、工业物联网、智能家居等万亿级市场


面壁智能 CEO 李大海表示:“端侧 AI 模型赶上 GPT-4 的目标已提前实现,这将加速 AGI(通用人工智能)在各行各业的普及进程。”

🚀 AI 新纪元:从 “语言智能” 到 “物理智能” 的范式跃迁

第八届智源大会发布的三大模型,共同勾勒出人工智能发展的清晰轨迹:从处理虚拟信息的语言大模型,向理解物理世界的世界模型演进,从云端集中计算向 “端云协同” 的分布式智能发展。


这一转变将带来三大变革:


1.AI 能力升级:从 “被动感知” 到 “主动理解”,从 “执行指令” 到 “预判后果”

2.应用场景拓展:AI 将深度融入工业制造、机器人、自动驾驶、医疗健康等实体经济领域

3.产业生态重构:催生世界模型训练、具身智能开发、端侧 AI 优化等新赛道,创造百万级就业机会



当 AI 开始理解物理世界的规律,当机器人学会 “先思考再行动”,当端侧设备拥有接近 GPT-4 的智能,我们正站在人工智能与实体经济深度融合的新起点。第八届智源大会的三大技术突破,不仅是中国 AI 技术实力的集中展示,更是全球 AI 发展的重要里程碑,预示着一个更智能、更安全、更高效的 AI 时代正在加速到来。

上一篇重磅合作落地!英伟达 ×SK 海力士联手攻坚下一代 AI 内存,算力供应链迎来巨变
下一篇Seedance 2.5 首次亮相!火山引擎全栈多模态 + 企业 Agent 底座同步升级,AI 深度扎根实体产业