找回密码
 立即注册
搜索
查看: 440|回复: 2

[技术讲座] 扼守风险:从大模型到智能体安全

[复制链接]

413

主题

2

回帖

3908

积分

管理员

积分
3908
发表于 2026-8-31 18:05:11 | 显示全部楼层 |阅读模式 来自 湖北武汉
ScreenShot_2026-08-31_180256_636.png

主讲人
刘东瑞,上海人工智能实验室可信安全中心青年科学家,入选上海市东方英才拔尖项目,担任2030人工智能重大专项课题负责人。长期从事安全可信人工智能研究,包括大模型/智能体的安全高效推理、可解释性、攻防、对齐和评测等。负责国际首个诊断式智能体守卫模型AgentDoG研发,SafeWork-R1攻防和安全高效推理后训练,有效减少模型过度思考过程中的安全漏洞,促进安全锚点高频涌现,模型安全水平相对超过 Claude Opus 4和GPT 4.1 5%以上。负责国内首个针对AI灾难性风险技术评测(SafeWork-F1&1.5),获得Anthropic 联合创始人长篇解读。在安全可信领域产出四十多篇高水平会议和期刊论文,包括CVPR 2024 最佳论文候选奖, ACL 2025杰出论文奖, CVPR Oral, ICLR Oral, AAAI Oral和多篇ACL Oral等。

技术讲座请看McSafe的B站链接:扼守风险:从大模型到智能体安全_哔哩哔哩_bilibili

0

主题

279

回帖

600

积分

高级会员

积分
600
发表于 2026-9-4 18:55:45 | 显示全部楼层 来自
重大专项课题负责人

0

主题

279

回帖

600

积分

高级会员

积分
600
发表于 2026-9-4 18:56:21 | 显示全部楼层 来自
最佳论文候选奖
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

快速回复 返回顶部 返回列表