关于我

我是中国人民大学统计学院博士生,导师为杨翰方教授。我的研究方向为大语言模型训练数据构建与评估以及大语言模型推理

我本科毕业于南京大学,硕士和博士就读于中国人民大学。目前在微软亚洲研究院实习,合作导师 Zhenghao LinXiao LiuYeyun Gong

论文

NAACL 2025 ALTER: Augmentation for Large-Table-Based Reasoning paper preview
NAACL · 2025

ALTER: Augmentation for Large-Table-Based Reasoning

Han Zhang, Yuheng Ma, Hanfang Yang

提出面向大规模表格推理的数据增强框架,帮助语言模型处理超出上下文窗口的大型表格。

arXiv 2025 Learning to Retrieve and Reason on Knowledge Graph through Active Self-Reflection paper preview
arXiv · 2025

Learning to Retrieve and Reason on Knowledge Graph through Active Self-Reflection

Han Zhang, Langshi Zhou, Hanfang Yang

提出端到端知识图谱推理框架 ARG,主动检索图知识、反思证据,并沿可解释路径进行迭代推理。

NeurIPS 2023 Decision Tree for Locally Private Estimation with Public Data paper preview
NeurIPS · 2023

Decision Tree for Locally Private Estimation with Public Data

Yuheng Ma, Han Zhang, Yuchao Cai, Hanfang Yang

研究公开数据辅助的局部差分隐私估计,并提出根据公开信息自适应构造估计器的决策树方法。

教育经历

南京大学 本科

数学系 · 统计学

GPA 4.59 / 5.0 专业排名 2 / 74 年级排名 2 / 134

主修课程:数学分析(90)、高等代数(97)、解析几何(96)、常微分方程(95)、概率论基础(100)、C++ 程序设计、实变函数、偏微分方程、高等数理统计(98)、应用随机过程(97)、离散数学(96)、数据库概论、计算机网络、数据分析、数据结构与算法设计、数据挖掘导论、现代信息技术应用等。

中国人民大学 硕博连续

统计学院 / 交叉科学研究院

学习阶段:统计学硕士(2022.09 – 2025.06);统计学博士(2025.09 – 至今)。

研究方向:自然语言处理、结构化数据推理及应用、大模型预训练及微调等。

荣誉与奖项

工作与实习经历

微软亚洲研究院

研究实习生 · 中国北京

智元机器人

算法实习生

从零参与智元具身大脑 ChatAssistant 功能搭建。

  • 数据:参与构建机器人具身指令工具调用数据集。
  • 算法与产品:实现 Agent Chat、语音对话、内部知识库检索与工具调用等功能,并将对话服务集成到下游产品线。
  • 端侧部署:基于 Orin 测试 llama.cpp、AutoAWQ、GPTQ 等多种部署与量化方案。

SQLBOY 创业孵化项目

算法工程师

深度参与中国人民大学创业孵化器项目 SQLBOY,覆盖大模型调研、模型微调、后端部署和前端界面开发,打通从模型微调到下游应用部署的完整 Pipeline。

  • 完成 Instruction Fine-tuning 与模型部署。
  • 基于 LangChain 按下游需求定制 Agent 框架,并结合向量库搜索。
  • 后端采用 FastAPI,前端基于 Vue 3 与 TypeScript 开发。

Samsung Research China Beijing(SRCB)

算法实习生 · Language Intelligence Team(LIT)

参与 CVPR 2022 Workshop Action Learning From Realistic Environments and Directives(ALFRED)挑战赛,最终获得排行榜第三名。

  • 任务解耦:结合语言指令与场景知识生成关键步骤,以 Seq2Seq 方式有序拆解任务,辅助家用机器人学习并提供预期动作预览。
  • 语义地图:利用场景 RGB-D 信息与实例分割标签构建语义地图,协助房间导航和物体抓取。
  • 算法优化:针对特定场景和任务进行位姿调整、动作微调等优化。