人工智能博士生 · 科学智能 · 智能体

你好,我是苏恩承。

我目前是中国科学技术大学人工智能专业博士生,导师为 Prof. Wanli OuyangProf. Houqiang Li。 同时,我在上海人工智能实验室担任研究实习生。

我的研究聚焦于科学智能(AI for Science)大语言模型智能体。我关注科学推理基准与评测工具、多模态模型, 以及具有结构化记忆的长程智能体系统。我的长期目标是让人工智能在真实科研流程中 更严谨、更可靠,也更具实用价值。

我尤其关注以下问题:

  • 人工智能如何在科学约束、证据、单位和推理过程下保持可靠推理?
  • 智能体如何在长程任务中有效使用记忆、工具与反馈?
  • 多模态系统如何跨学科迁移,并适应真实科研场景?

此前,我曾在 UCLA 进行为期一年的研究实习(2024 年 8 月至 2025 年 8 月), 作为研究助理与 Prof. Debiao Li 合作开展纵向乳腺 MRI 与医学人工智能研究。我也曾在北京智源人工智能研究院 担任研究员(2025 年 3 月至 9 月),聚焦 AI4Medical。 更早的研究经历包括 CUHK/HKCLR 的三维视觉、微软亚洲研究院的科学智能,以及在慕尼黑工业大学与 Prof. Alois Knoll 的合作研究。

Portrait of Encheng Su

近期动态

按时间倒序 · 向下滑动查看更多。

S3Mem 被 EMNLP 接收

面向长程交互问答的结构化时空场景—事件记忆。

论文 ↗

DAPD 预印本发布

通过双锚定策略蒸馏实现更稳定的模型对齐。

论文 ↗

结构—性质推理预印本发布

通过深度原生结构推理,实现准确、跨学科且透明的结构—性质理解。

论文 ↗

CardioLens 预印本发布

利用多序列心脏 MRI 评估多模态大模型的临床现实差距。

论文 ↗

Hidden in Plain Sight 发布

从科学场可视化中推断视觉到符号的解析解。

论文 ↗

SciIF 预印本发布

面向严谨科学指令遵循的评测基准。

论文 ↗

SciEvalKit 发布

面向科学通用智能的开源评测工具箱。

论文 ↗

SciReasoner 预印本发布

面向多学科、多种科学表征的科学推理基础模型。

论文 ↗

科学大语言模型综述发布

从数据基础、模型到智能体前沿的数据中心化综述。

论文 ↗

PhysUniBench 发布

面向本科层次的多模态物理推理基准现已发布。

论文 ↗

NIR 物理对抗攻击预印本发布

面向近红外人脸识别模型的人眼不可感知物理攻击。

论文 ↗

UniSTD 被 CVPR 2025 接收

统一四个科学领域、十项任务的时空学习。

论文 ↗

BiSeg-SAM 入选 BIBM Oral

基于 SAM 的医学二值分割弱监督后处理方法。

论文 ↗

教育与工作经历

我的学术训练与研究经历。

教育经历

USTC logo
中国科学技术大学人工智能博士

导师为 Prof. Wanli Ouyang 与 Prof. Houqiang Li,研究方向为大语言模型与智能体。

TUM logo
慕尼黑工业大学硕士

系统学习机器学习、机器人与计算机视觉。

工作经历

Shanghai AI Laboratory logo
上海人工智能实验室研究实习生

科学智能、模型评测与智能体系统。

BAAI logo
北京智源人工智能研究院研究员

医学人工智能(AI4Medical)、医学多模态模型与评测。

UCLA logo
加州大学洛杉矶分校(UCLA)研究助理

为期一年的研究实习,在 Prof. Debiao Li 指导下开展纵向乳腺 MRI、癌症风险预测与医学影像人工智能研究。

CUHK logo
香港中文大学 · 香港物流机械人研究中心研究助理

三维视觉、手持激光扫描、SDK 开发与点云处理。

Microsoft logo
微软亚洲研究院研究实习生

科学智能。

Midea logo
美的集团学生实习生

第一作者与共同第一作者

PhysUniBench: A Multi-Modal Physics Reasoning Benchmark at Undergraduate Level

Lintao Wang*, Encheng Su*, Jiaqi Liu, Pengze Li, Jiabei Xiao, Wenlong Zhang, Xinnan Dai, Xi Chen, Yuan Meng, Lei Bai, Wanli Ouyang, Shixiang Tang, Aoran Wang, Xinzhu Ma

* 共同第一作者。

PhysUniBench 面向本科物理,综合评测概念、数学与图示推理能力,旨在揭示仅比较最终答案的简单基准难以发现的模型缺陷。

WAIC · 2025

核心贡献者

DAPD: Dual-Anchored Policy Distillation

Jianyu Wu, Yizhou Wang, Encheng Su, Chen Tang, Shixiang Tang

DAPD 通过两条信息匹配路径对齐教师与学生行为,缓解在线策略自蒸馏中的“特权错觉”问题。

arXiv · 2026

学术服务

同行评审与学术社区贡献。

会议审稿人

担任 BIBM、MICCAI、AAAI、ACL 等人工智能、医学影像与科学机器学习相关会议审稿人。