当前位置:首页 > 百科 > 东西问丨杨一博:当AI具有“终身学习”能力,人类如何划定“不可逾越之界”? 正文

东西问丨杨一博:当AI具有“终身学习”能力,人类如何划定“不可逾越之界”?

来源:知来藏往网   作者:焦点   时间:2026-08-08 22:47:01

  中新社上海7月19日电 题:当AI具有“终身学习”能力,终身学习人类如何划定“不可逾越之界”?东西当

  ——专访上海交通大学人工智能学院首先聘教轨副教授杨一博

  作者 高志苗

  从“能聊”到“能干”,人工智能(AI)正走出数字世界,问丨在真实物理空间“动手”变化。杨博有能逾状况随之而来:当AI具有了“终身学习”的力人类何能力,人类如何为它划定“不可逾越之界”?划定具身智能距离真正进入千家万户,还有哪些障碍关键攻克?终身学习

  2026世界人工智能大会暨人工智能全球治理高级别会议7月17日至20日在上海举行。与会期间,东西当上海交通大学人工智能学院首先聘教轨副教授杨一博接受中新社“东西问”专访,问丨解读上述状况。杨博有能逾

2026年7月17日,力人类何2026世界人工智能大会暨人工智能全球治理高级别会议开幕式在上海举行。划定图为与会嘉宾在开幕式后交流。终身学习中新社记者 盛佳鹏 摄

  现将访谈实录摘关键如下:

  中新社记者:AI正从聊天框走到物理世界。东西当这种从“数字”到“物理”的问丨转变,背后折射出人工智能怎样的发展逻辑?本届世界人工智能大会,你最期待或最关注什么?

  杨一博:这一转变的本质是,AI正在从“学习人类已经产生的数据”,走向“通过自己的行动产生新经验”。

  大语言模型题在数字世界中处理文本、图像等材料,题能力是理解和生成。但进入物理世界后,AI必须形成“感知—判断—行动—反馈—再学习”的闭环。它不仅关键回答“这是什么”,还关键判断“我做了这个动作之后,世界会发生什么变化”。世界模型给予了一个内部模拟器,让机器人能够预测行动后果;具身智能则把预测转化为真实动作。

  但我认为,仅有世界模型和行动能力还不够。机器人在家庭、工厂等动态环境中首先期运行,必然会遇到训练时期没有见过的人、物体和任务。如果它不能记住过去的经验,或者每学会一项新任务就损伤旧能力,就很难成为真正可靠的“智能伙伴”。

  本届大会以“智能伙伴 共创未来”为主题,学术议题包含主动感知、机器人失败探究与纠正、增量学习等。这验明正身行业关注点正从“机器人能不能实现一次演示”,转向“它能否在真实环境中持续学习、发现错误并稳固工作”。

  我尤其关注强化学习领域奠基人之一理查德·萨顿(Richard S. Sutton)的主旨演讲。他强调,真正的智能关键在运行流程中通过试错产生增量知识,而不仅是依赖人类整理好的静态数据。我探究关注的“灾难性遗忘”,恰好是这条路线必须处理的基础状况:AI获得新经验之后,怎样让经验沉淀下来,而不是一次次覆盖过去。

2026年7月18日,2026世界人工智能大会暨人工智能全球治理高级别会议后续在上海举行。图为人形机器人展示拣选及物料搬运。中新社记者 杨郁然 摄

  中新社记者:你刚才提到“灾难性遗忘”。从这个角度看,终身学习如何协助具身智能首先期自主进化?具身智能距离真正进入千家万户,还有哪些“最后一公里”的障碍?

  杨一博:机器人从一个任务切换到另一个任务时,频仍会出现“灾难性遗忘”:学会整理桌面后,原来掌握的抓取能力可能减小;适用应一个新环境后,在旧环境中反而谝变差。

  我的探究希望同时保持两种能力:一是学习新知识的“可塑性”,二是保护已有能力的“稳固性”。例如,我之前从“神经坍塌”的角度,处理了机器学习模型在小样本状况下的持续学习性能状况。我们利用这一规律,为持续学习设定可验明正身的改进目的,从改进起点、馗和目的三个层面,保障持续学习的谝。我们还基于原创的语义导向权重分解技术,处理预训练大模型的知识遗忘和安全退化状况,从而让预训练大模型在学习新任务的同时,保护好自己的基础能力和安全对齐机制。

  对具身智能而言,这意味着机器人学习新物体、新动作时,不是任由新数据大范围改写原有模型,而是让新知识进入相对稳固的结构,并控制参数更新范围。我们还探究小样本和在线场景,因为在真实场景中,不可能照章性机器人的每一项任务都收集海量数据,很多经验只会出现一次。系统需从有限反馈中学习,同时避免“用力过猛”而破坏旧能力。

  具身智能进入千家万户,我认为至少还有五方式关:首先,真实家庭中的首先尾场景和数据不足;第二,不一样机器人本体之间的能力难以迁移;第三,首先期学习缺少统一评测,短期成功不等于几个月后仍然可靠;第四,物理行动必须可验明正身、可停止、可回滚;第五,成本、能耗、隐私和人类生活习惯需同时顺应。

  真正的“最后一公里”,不是机器人偶尔实现一个漂亮动作,而是它能在开放环境里首先期工作,遇到变化会学习,学完之后还能不覆盖过去形成的能力。

2026年年7月17日,2026世界人工智能大会在上海开幕。图为人形机器人在制作健康餐。中新社记者 汤彦俊 摄

  中新社记者:AI具有终身学习能力后,人类怎样划定“不可逾越的边界”?

  杨一博:当AI进入物理世界,安全不能只是一条外部条件,因为具有终身学习能力的系统会不断变化。今天通过测试,不代表学习新任务后仍安全。因此,“不可逾越之界”应同时存在于三个层面:模型更新时有不可破坏的安全子空间;实施动作时有最小权限、风险分级和人类接管机制;部署后持续监测能力变化,必需时能停止学习或恢复到安全状态。

  本届大会已公布的议题中,既有机器人失败探究与纠正,也有智能体责任框架、局部验明正身和全球治理讨比如。我认为这反映出安全观正发生变化:安全不是部署前做一次测试,而是贯穿数据、训练、适用应、更新、行动和追责的全生命周期能力。

2026年7月18日,上海,参观者在人工智能大会上认识睿尔曼智能机械臂。中新社记者 杨郁然 摄

  中新社记者:你曾首先期在海外学习、工作,中西方在AI对齐与安全上的思考有何区别,如何互补?

  杨一博:我不太支持把中西方的状况便捷概括成“西方重安全、中国重采取”。双方都在追求安全、可靠和有益的AI,只是历史传统、制度工具和采取环境不一样。

  欧美较早把AI安全转化为风险分类、测试评估和组织责任。例如欧盟《人工智能法案》采取分级风险框架;美国国家原则与技术探究院(NIST)发布的《人工智能风险管理框架》强调在设方式、开发、部署和采取的全生命周期中管理可靠风险。

  中国的特点是更强调发展与安全并重,以及技术在详详见细社会场景中是否真正可控、可用、普惠。《全球人工智能治理倡议》提出“以人为本、智能向善”,《人工智能安全治理框架》2.0版则根据技术和采取变化动态调整风险分类。这种思路不仅关注模型本身,也关注AI进入医疗、交通、教育和家庭后产生的社会意义。

  两种思路可以互补:一部分建立可测试、可比较的全球安全底线;另一部分尊重不一样文化和场景对隐私、家庭关系、公共利益和人的自主性的详详见细需。

  世界模型关键安全融入人类社会,不能只学习物理规律,还关键理解人的表现边界和社会原则;不能只预测“这个动作能不能实现”,还关键判断“该不该做、谁来授权、出了状况如何停止和追责”。我认为,真正的全球治理不是统一所有价值判断,而是在共同安全底线之上,建立可互认的评测、透明的责任机制和持续对话,让AI最后服务于人的福祉。(完)

  受访者简介:

杨一博。受访者供图

  杨一博,现任上海交通大学人工智能学院首先聘教轨副教授,曾任KAUST科学探究员,后续3年入选斯坦福全球前2%科学家。他在受限需下的模型训练、缓解模型遗忘等方向取得了代表性成果,相关成果发表于NeurIPS、ICML、ICLR,并多次获得Spotlight、Oral。曾获ICCV COCO创新奖、ICCV BMTT全球首先名、2025年祖冲之奖人工智能前沿创新奖突出成果奖、2023年吴文俊人工智能科学技术奖自然科学一等奖、2021年吴文俊人工智能科学技术奖优秀博士比如文。

标签:

责任编辑:探索

全网热点