三伍新闻资讯,有趣实用的生活常识!

最新更新文章排行

三伍新闻资讯

当前位置: 首页 > AI智能

UC伯克利博士后顾尚定受聘上交大副教授,曾参与OpenRSI-Index项目!

时间:2026-10-04人气: 作者: 佚名

美国加州大学伯克利分校(UC )博士后顾尚定近日入职了上海交通大学计算机学院,担任长聘教轨副教授。他还入选了国家级青年人才计划,并与上海人工智能实验室安全中心双聘。

UC伯克利博士后顾尚定受聘上交大副教授,曾参与OpenRSI-Index项目!(图1)

2024 年,顾尚定在德国慕尼黑工业大学拿到计算机科学博士学位;随即赴 UC 从事博士后研究,与 Dawn Song、 两位教授合作,研究安全智能决策及其在工业场景中的应用。

从慕尼黑到伯克利再到上海,他的研究主线没怎么变过:怎么让智能系统在开放、动态、甚至危险的现实环境里,既足够聪明,又不会闯祸。

他系统地研究了强化学习中性能和安全约束之间的权衡:想让 Agent 跑得快,就得担风险;想让它绝对安全,性能就掉下来。

围绕这个矛盾,他做了一系列工作:一篇关于安全强化学习的综述发表在了 IEEE TPAMI 上,该成果引用量达到了 1000+;AAAI 2024 Oral 的工作从梯度操控角度处理奖励与安全的权衡, 2024 的工作则用样本操控提升数据效率。

UC伯克利博士后顾尚定受聘上交大副教授,曾参与OpenRSI-Index项目!(图2)

他还提出了 -(ICLR 2025),一个覆盖状态、动作、奖励和环境动力学四类扰动的统一鲁棒强化学习基准,塞进六十多个单机器人和多机器人任务。这一工作把“鲁棒性”从一个形容词,变成了可以跑分的东西。

UC伯克利博士后顾尚定受聘上交大副教授,曾参与OpenRSI-Index项目!(图3)

近两年顾尚定的重心明显从单点算法往系统层面扩展。他开始思考 Agent 的规模效应,围绕 AI 的系统扩展、多智能体规模化、模型数据效率以及真实世界自主系统开展研究。

比如他发表的《From Model to 》,讨论的就是 AI 中  的扩展问题。此外他参与提出的  Web 被 IEEE 和《经济学人》报道过。

在 RSI 这一前沿方向上,顾尚定也有所参与。近日由 MIT-IBM AI Lab 与 A-EVO Lab 联合华盛顿大学、伯克利等机构发布的 -Index v0.1 上线,该项目把真实开源项目变成 AI Agent 的“自动科研场”,让 Agent 长时间自主实验,检验其能否迭代出超过人类方案的新方法。他作为项目团队成员参与了相关工作。

UC伯克利博士后顾尚定受聘上交大副教授,曾参与OpenRSI-Index项目!(图4)

顾尚定的研究并没有局限在AI领域,他参与的用强化学习操控分子扩散模型做药物设计的论文被 接收;此前他还在泛林集团分享了 AI 用于半导体制造的主题演讲。

在研究以外值得一提的是,他 2022 年底发起的 Safe RL 在线研讨会一直办到了现在,每月至少请一位讲者;此外,他牵头了 IEEE TASE 特刊“基础模型时代具身智能体自动控制的可信 AI”;今年还受邀担任 2026 Area Chair。

如今入职上海交通大学,他的研究继续聚焦在安全可信的 AI Agent,具身智能与机器人学习,以及面向真实世界的智能决策(半导体制造、自动化系统、AI4S)这三个方向。