微信扫码
添加专属顾问
WAIC揭示AI进入物理世界的六大挑战:从理解物体到自主决策,聪明只是起点。 核心内容: 1. 物理智能的六层阶梯框架 2. AI在真实场景中的能力与局限 3. 如何高效获取大会论坛的深度洞见
重力、事故、成本和制度,都会来判卷。
前两天的WAIC观察笔记,我主要和你分享了我和罗老师在现场看到的,AI在中国各行各业纵深处的应用。AI机器人不再只会发可乐,还会踢球、跳舞、拧螺丝,也开始走进工厂和养老院。
不过,你不要以为WAIC只有展馆里的这些热闹。大会举行的几天里,还有140多场高质量论坛。各个领域里的大神纷纷出来,分享自己当下的思考。
这些思考很有价值,会给我们很多启发,因为他们面对的许多真实场景,是我们平时根本碰不到的。
今天,我来聊几场我觉得特别值得听的论坛分享。因为有些论坛甚至在同一时间的不同场地举行,我们没办法同时到现场听。
但幸好有AI,在这期内容的最后,我也会告诉你,怎么把这届WAIC几十场公开的论坛转播实录一次性拿下,以及怎么更高效地使用它。
先说一个我的体感:今年WAIC,从产品到技术,更关注AI进入物理世界后的能力。
也就是,一个机器人把动作做出来,和它真的理解自己在做什么,中间到底隔着多远?我在翻论坛实录的时候,发现这也是今年很多研究者正在回答的问题。
模型聪不聪明,当然重要,但当AI离开聊天框,真的伸手去碰这个世界,聪明只是第一关。
01 能力:物理智能的六层阶梯
7月17日下午,在2026世界人工智能大会暨人工智能全球治理高级别会议主论坛上,复旦大学浩清特聘教授、复旦大学通用物理智能研究院首任院长苏昊做了一场主旨演讲,主题是《物理智能:从幻觉到现实》。
他分享了一套六层阶梯,我觉得是这两天听到的,最适合普通人理解物理智能的解释框架。
▲ 苏昊分享《物理智能:从幻觉到现实》
咱们来想象一个特别普通的场景:你在客厅里踢球,球滚进沙发底下。如果让机器人帮你把球拿回来,它需要知道多少东西?
下三层:理解客观世界
第一层,物体知识。它得知道哪里有个球。
球滚进沙发底下,摄像头已经看不见了。就像孩子要慢慢学会,看不见,不等于不存在。机器人同样得明白,球没有凭空蒸发,它还在那里。
第二层,状态知识。它要知道这个球现在是什么状态。
它在哪儿、离沙发边缘多远、是硬是软、有多大、多重、旁边有没有别的东西挡着。只认出「这是一个球」,离真正动手还差得远。
第三层,动力学知识。我大学读的就是物理,这个词并不陌生。不过苏昊在这里说得很朴素,就是接下来会发生什么。
机器人伸手碰一下,球会往哪边滚?用力太大,会不会把球推得更深?地上铺着地毯,球还滚不滚得动?我们每天都在用这些常识,只是从来没觉得它们也算知识。
到这里,机器人知道世界里有什么,东西现在怎么样,接下来可能怎么变。
苏昊说,这三层都属于客观世界。有没有机器人,球都在那里,重力也照样工作。这三层,苏教授说叫做「下三层」。
这个叫法,我突然觉得有点机器人修仙的味道。
上三层:世界里出现了「我」
第四层,功能知识。功能不是东西自带的说明书,而是它对「我」有什么用。
一把椅子,对人来说可以坐,对蚂蚁来说可能是一座山。同一个球,对孩子是玩具,对机器人则是需要取回来的东西。
到了这一层,世界里第一次出现了「我」。
第五层,目标知识。也就是我希望世界变成什么样。
球在沙发底下,这是现实。我要球回到手里,这是目标。就差这么一点,机器就从看热闹的摄像头,变成了准备干活的行动者。
不过,有目标还不够。
第六层,行为知识。机器人知道要把球拿回来,和真的能拿回来,是两回事。
它得判断手臂从哪边伸进去、肩膀会不会撞沙发、手指张多大、碰到球时用多少力。好不容易够到,还不能一使劲把球捏坏。
叠衣服也是一样:看见衣服不难,知道要叠整齐也不难,真正难的是怎么捏住软趴趴的衣角,怎么抖开、对齐、压平。这里面的分寸,不写在书上,长在手上。
所以苏昊这六层阶梯,从物体、状态、动力学,到功能、目标、行为,我的感觉就是他在给机器人补一段童年。
因为婴儿会摸、会抓、会摔、会撞,杯子掉几次就知道会碎,下次就知道怎么拿了。大语言模型没有这段童年,它读过无数次「杯子掉到地上会碎」,但从来没有接住过杯子,也没为摔碎杯子挨过骂。
这也是我觉得六层阶梯特别有用的地方。
所以,以后再看机器人演示,别只问它会不会叠衣服、踢足球、泡咖啡。你可以多问一句:它现在爬到第几层了?它只是认出了东西,只是在复现一套排练好的动作,还是能发现环境变了,重新调整目标,再把事情做完?
听到这,你可能会觉得有点懵,压根没有想到原来捡个球对机器人来说是一件这么复杂的事情。
但说实话,这里面每一层都藏着不少未来创业机会。比如我在流水席直播时,来聊的公司就有做灵巧手的,有做手上的触感皮肤的,有专门做触觉感知的,还有做机器人手部操作训练的。
你看,这几个不同的创业公司,放在六层阶梯里,其实都是在解决「把球拿出来」这一个动作。
说到「做完」,苏昊在演讲里还提到一个词:可靠性。不过,关于这个词,我更想和你聊另外一场分享。
02 可靠性:95分不够用
同样在7月17日,在「AI与先进核能共筑可持续智能未来论坛」上,中国科学院合肥物质科学研究院首席科学家肖炳甲,做了主题分享《AI聚变等离子体控制》,把可靠性这件事推到了极致。
首先,我对核聚变和等离子体也是一头雾水,完全不懂。但这个场景未来会跟很多普通人生活相关,所以我尽量用直白、但不那么准确的语言来说一下,大家重点理解可靠性的重要性。如果你是这领域的专家,希望不要骂我误人子弟。
先说说托卡马克,这其实是目前研究可控核聚变最主流的一类装置,你可以把它理解成一个甜甜圈形状的巨大磁笼子。它要用磁场托住一团温度极高的等离子体,绝不能让这团「火」碰到内壁。
▲ 肖炳甲分享《AI聚变等离子体控制》
可这一团「火」离内壁只有几厘米,还会随时乱窜。控制系统得在百微秒,也就是万分之一秒内,看出它往哪边偏,再调整线圈把它拉回来。也就是说,人还没眨一次眼,它已经完成了一次判断和调整。
简单说,它就是一个试图用磁场关住「人造小太阳」的巨大容器。AI的任务,则是盯住里面那团极不稳定的等离子体,发现它要跑偏时,赶紧调整磁场把它拉回来。
▲ 等离子体控制环节复杂且要求苛刻
肖炳甲提到,现在AI在大破裂预测的准确率已经能做到95%以上,但还要继续奔向99.9%。换句话说,就是AI能不能提前准确判断,这团等离子体马上要失控了。
你看,在考试里,95分已经是学霸。但在核聚变、医疗、驾驶这些高风险场景里,剩下那5分,可能才是最要命的部分。这件事听起来离咱们特别远,其实它给了我们一把判断AI的尺子。
毕竟,聊天软件偶尔答错一次,我们重新问就行了。但AI进入物理世界后,判断错一次,可能损坏设备,也可能影响人的安全。
所以,真正进入现实世界的AI,不能只看最好的一次有多惊艳,还得看最差的一次会造成什么后果。
如果说苏昊回答的是「AI有没有能力把事情做好」,那肖炳甲回答的就是另一张考卷:AI能不能每一次都把事情做成。
这决定了我们敢不敢把事情交给它,这就是可靠性的重要性。
03 成本:代价算不算得清
当然,现实世界给AI出的考卷,还没有结束。除了能力和可靠性,还要考成本。
AI真的进入现实世界,要耗电、耗水、用芯片。
7月18日,「实体世界智能科学论坛」上,图灵奖得主、加州大学伯克利分校荣休教授、Google杰出工程师戴维·帕特森(David Patterson),就做了主题分享《环境AI的误区》。
▲ 帕特森分享《环境AI的误区》
帕特森说,「AI毁环境」这个说法本身就是个谬论。有些AI耗水、耗电的数字,因为统计口径混乱,被放大了很多倍。但企业买张绿色证书就宣布排放已经抵消,这种账也未必可信。
物理世界不只会用重力考AI,还会拿着水表、电表和成本表来结账。
04 治理:谁来划边界、担责任
当然,到这里考卷还没结束。能力、可靠性、成本,都只是技术层面的考题。
真正当AI开始影响一个行业、一座城市,甚至一个国家的时候,它还要面对第四张考卷:治理。
7月18日,在清华大学人工智能国际治理研究院主办的「全球人工智能治理的可能路径论坛」上,研究院院长薛澜分享了一份《世界人工智能能力指数报告》,也就是他们正在构建的AI能力指数。
他把一个国家的AI能力拆成两部分:发展能力和治理能力。
▲ 薛澜分享《世界人工智能能力指数报告》
发展能力,要看能不能产生新知识、扩散到真实应用,以及形成市场价值。
这里有个容易混淆的地方:用得广,不等于赚到钱。中国有很多AI服务用的人特别多,但大部分是免费的。只看用户数,可能高估了价值实现;只看收入,又可能低估了技术扩散。
治理能力,除了分析规划、学习迭代,还要包括立法、数据保护和标准制定。模型跑得快,如果制度没跟上,未必是真的强。
我觉得,这套框架放到企业也同样适用。
很多企业今年都在接AI、买模型、做培训,看起来动作很多。但真正值得问的,不只是「用了没有」,还要看AI有没有进入真实流程,创造持续价值;出了问题,又由谁负责。
把这四场放在一起,去掉展馆里的喧闹,能慢慢看清一个变化:今年WAIC的讨论,已经不只是模型又涨了多少分,而是AI已经从聊天框里出来,在现实世界里参加一场真正的考试。
第一张考卷,考它懂不懂这个世界;第二张,考它能不能稳定把事情做好;第三张,考它完成这件事要付出多大的代价;第四张,则考它进入社会之后,能不能被社会安全、稳定地接住。
它得理解世界,稳定把事做完,算清成本,也得有人划清边界、承担责任,让它在规则之下真正走进社会。
在聊天框里,答得漂亮就能赢得掌声;到了物理世界,重力、事故、成本和制度都会来判卷。答错了,没有一句提示词能把它圆回来。
所以,以后再判断一个AI是不是真的厉害,可以少问一句它有多像人,多问几句:
它懂不懂这个世界?
能不能稳定把事做完?
代价算不算得清?
我们敢不敢把它交给社会?
05 几十场WAIC论坛,怎么高效用
说到这里,这届WAIC,还有非常多同样高密度高质量的论坛分享。
在得到大脑里的官方知识库里,我们已经陆续收录了几十场论坛实录,包括嘉宾信息、核心观点和关键原话。
欢迎你扫描文稿末尾的二维码,领取「2026 WAIC世界人工智能大会知识库」。
你不用在十几个会场之间来回赶,可以沿着自己关心的问题,把内容存进你自己的知识库里。
当然,几十场论坛没人能一场一场读完,咱们也没必要没苦硬吃。这个知识库最适合的用法,不是从头读到尾,而是交给AI,帮你先找方向、再做筛选。
同样一个内容,可能对某些人来说毫无价值,但对另一些从业者来说,可能两句话就点醒了梦中人。
所以,订阅了这个知识库后,不管你是用得到大脑里的小步AI,还是用你个人更熟悉的AI工具,我都有三个使用小技巧分享给你。
技巧一:先要地图,再钻井
几十场论坛收录摆在面前,最麻烦的不是资料少,而是不知道从哪儿下手。
记住,这个知识库是给你的AI看和用的。你可以和它说:「把这些论坛按主题分成十类,每一类用一句话告诉我,大家到底在讨论什么?」
拿到这张地图以后,再从具身智能、AI医疗、能源、治理等方向中,选一个你感兴趣的继续追问。
别一上来就扎进某场论坛的细节,很容易进去以后就出不来了。
技巧二:把自己的问题带进去
假如你在做跨境电商,可以直接问:「我是做跨境电商的,这几十场WAIC的论坛分享里,哪些判断跟我的生意最有关系?帮我挑出最值得看的三场,按重要性排序,再告诉我为什么?」
这样一来,几十场公开论坛,就被压成了一份跟你有关的私人阅读清单。你不是让AI替你总结资料,而是让它拿着你的问题,替你筛资料。
技巧三:去问共识和分歧
一场论坛只能看到少数人的观点,几十场放在一起,才能看见地形。你可以问它:「哪些判断在不同论坛被反复提到?哪些问题,嘉宾们的观点明显互相矛盾?」
被反复提到的,很可能正在成为行业共识;大家争论最激烈、谁也说服不了谁的地方,可能藏着还没有定论的新机会。
最后一步,记得再补一句:「把每个结论对应的论坛、嘉宾和原文出处一起列出来。」
AI负责帮你找路,真正重要的判断,还是要回到原始分享里看一眼。
这样操作下来,几十场论坛,你最后可能只需要认真看七八场,就能抓住对自己真正有价值的信息
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-09-11
下一代穿戴设备不给你屏幕,改把录音笔和摄像头戴身上
2026-09-10
iPhone Duo来了,腾讯 Kuikly 助 App 从容适配
2026-09-08
大模型越来越聪明时,Plaud 为什么开始卷 Context
2026-09-07
联想公布两款RTX Spark笔记本,最高塞进128GB统一内存
2026-09-06
64万一台的英伟达 “桌面电脑” 火了,卖给了谁
2026-09-05
Agent 接管 iPhone,终于有人跑通了。
2026-09-05
Anthropic 发布 MHS 模型硬件标准:AI 代理终于要「上手」物理世界了
2026-09-05
不用买新显卡!NVIDIA PAIR 把你的 DGX Spark、Mac、RTX 主机拼成家用 AI 算力池
2026-06-22
2026-06-30
2026-07-05
2026-07-16
2026-07-14
2026-07-20
2026-08-25
2026-07-20
2026-08-06
2026-07-04
2026-08-18
2026-07-23
2026-04-12
2026-03-19
2026-03-17
2026-02-17
2026-01-29
2026-01-22
欢迎您使用【53AI 官方网站】(以下简称“本网站”或“我们”)。本《会员服务协议》(以下简称“本协议”)是您(以下简称“会员”或“用户”)与【深圳市博思协创网络科技有限公司】之间关于注册、登录及使用本网站会员服务所订立的法律协议。
在您注册或登录前,请务必审慎阅读、充分理解各条款内容,特别是免除或限制责任的条款、知识产权条款、争议解决条款等。此类条款将以加粗形式提示您注意。 当您通过微信公众号授权、手机验证码验证或其他方式成功登录本网站时,即视为您已完全理解并同意接受本协议的全部内容。
一、 定义
本网站:指由【深圳市博思协创网络科技有限公司】运营的,域名为【53ai.com】的网站及相关移动端页面。
会员服务:指本网站向注册会员提供的知识库文章查阅、内容检索及其他相关增值服务。
知识库内容:指本网站发布的包括但不限于文字、图表、数据、研究报告、行业分析等数字化内容资源。
二、 账号注册与登录
登录方式:本网站支持以下登录方式,您可根据实际情况选择:
微信公众号授权登录:您同意将您的微信OpenID信息授权给本网站,用于创建或关联会员账号。
手机验证码登录:您需提供真实有效的手机号码,并通过短信验证码完成身份验证与登录/注册。
账号安全:您的账号仅限您本人使用,禁止赠与、借用、租用、转让或售卖。因您保管不善导致的账号被盗、密码泄露等损失,由您自行承担。
实名认证:根据相关法律法规要求,我们可能要求您在特定功能下完成实名认证。如您拒绝提供,可能无法使用部分或全部服务。
未成年人保护:若您未满18周岁,请在法定监护人的陪同下阅读本协议,并在征得监护人同意后使用本服务。
三、 服务内容与规范
知识库查阅权限:会员登录后,有权按照其会员等级对应的权限范围,在线浏览、检索本网站知识库中的相关文章及内容。
服务变更:我们有权根据业务发展需要,调整、变更或终止部分服务内容,并将以网站公告、公众号消息等方式提前通知。
禁止行为:您在使用服务时不得实施以下行为:
利用技术手段批量爬取、下载、转存知识库内容;
将知识库内容用于商业目的或未经授权地向第三方传播;
干扰本网站正常运行或侵犯其他用户合法权益;
发布违法违规信息或从事违反公序良俗的活动。
四、 知识产权声明
权利归属:本网站知识库中的排版设计、软件代码等内容的知识产权均归【公司全称】或原权利人所有,受《中华人民共和国著作权法》等法律保护。
有限许可:本网站授予会员一项非独占、不可转让、不可转授权的普通许可,仅限于个人学习、研究之目的在线查阅知识库内容。
侵权追责:未经书面许可,任何单位或个人不得以任何形式复制、转载、摘编、镜像、汇编或以其他方式使用上述内容。一经发现,我们保留追究其法律责任的权利。
五、 个人信息保护
我们重视对您个人信息的保护。关于我们如何收集、使用、存储和保护您的个人信息,请单独阅读 《隐私政策》。
您通过微信公众号授权或手机号验证所提供的信息,我们将严格按照《个人信息保护法》的规定处理,仅用于身份识别、服务提供及安全验证等必要用途。
您可以随时通过网站设置或联系客服行使查阅、更正、删除个人信息及撤回授权同意的权利。
六、 免责声明
内容准确性:知识库内容仅供参考,不构成专业建议。我们不对其完整性、准确性、时效性作任何明示或暗示的保证,您应自行判断并承担使用风险。
不可抗力:因自然灾害、政策法规变化、网络故障、第三方平台接口异常(如微信接口维护、运营商短信通道故障)等不可抗力导致的服务中断或延迟,我们不承担违约责任。
第三方链接:本网站可能包含指向第三方网站的链接,该等网站的内容和服务不受我们控制,请您自行甄别风险。
七、 违约责任
如您违反本协议约定,我们有权视情节采取警告、限制功能、暂停服务、注销账号等措施,并保留要求赔偿损失的权利。
如因您的违约行为导致我们遭受行政处罚、第三方索赔或商誉损失,您应承担全部赔偿责任(包括但不限于罚款、赔偿金、律师费、公证费等)。
八、 法律适用与争议解决
本协议的订立、执行和解释均适用中华人民共和国大陆地区法律。
因本协议产生的或与本协议有关的任何争议,双方应友好协商解决;协商不成的,任何一方均可向【公司所在地】有管辖权的人民法院提起诉讼。
九、 其他
本协议构成双方就本服务达成的完整协议,取代此前任何口头或书面约定。
本协议任一条款被认定为无效或不可执行的,不影响其他条款的效力。
我们对本协议享有最终解释权,并在法律允许的范围内保留随时修改的权利。修改后的协议一经公布即生效,继续使用服务即视为同意修订内容。