科研 · 2026.09
合作论文被 AACL-IJCNLP 2026 录用(Main Conference)
From Construction to Injection: Edit-Based Fingerprints for Large Language Models 被 AACL-IJCNLP 2026 录用为主会论文。
个人主页 · 2026
我是华东师范大学人工智能方向的硕士研究生,目前在阿里控股 – 集团安全部担任 AI 应用算法实习生,负责集团敏感信息识别(SUIE)系统的 AI Native 化,基于 LangGraph、Skill、MCP 构建 Agent Harness 与知识/数据飞轮,打通分类分级自动化标注与模型训练全链路,满足阿里 AI 训练语料、集团流水等海量数据的脱敏需求。我具备覆盖后训练(SFT / GRPO / LoRA / DPO)、Guard 模型训练、多智能体系统与推理部署(TensorRT-LLM / AWQ / vLLM)的完整工业落地经验。我的科研围绕大模型安全、Agent Harness、大模型知识产权保护等方面展开,已有论文 5 篇:一作 NLP 顶会在投,KDD 2026 与 AACL-IJCNLP 2026 各录用 1 篇。欢迎通过下方链接了解我的项目与成果,或与我交流合作。
动态
科研
Yongyi Cui, Yue Li, Tianbao Jiang, Xin Yi
投稿至 NLP 顶会(Under Review,一作)
提出「构建驱动注入」的统一指纹框架:基于语义密度替换与语法偏置混合构建低困惑度代码混合触发器,通过零空间投影与跨语言对齐实现保知识注入,在几乎不影响模型效用的前提下实现持久所有权验证。
Yue Li, Xin Yi, Dongsheng Shi, Yongyi Cui, Gerard de Melo, Linlin Wang
AACL-IJCNLP 2026(Main Conference,录用)
提出端到端注入式指纹框架:高复杂度约束下的低困惑度代码混合触发器规避误触发与困惑度过滤,多候选编辑构建结构冗余、间隔分离的触发-目标映射,使指纹在模型修改下优雅退化,实现鲁棒所有权验证且几乎无损模型效用。
Yue Li, Xin Yi, Dongsheng Shi, Yongyi Cui, Gerard de Melo, Linlin Wang
KDD 2026(SIGKDD 2026 Research Track)
在每个解码步基于注意力权重动态识别语义关键证据,并结合词元熵与权重密度自适应划分词表,避免引入视觉无关词元;在大幅保持视觉-语义保真度的同时嵌入可检测水印信号,生成质量与检测效果优于现有水印方法。
Dongsheng Shi, Yue Li, Xin Yi, Yongyi Cui, Huawei Feng, Linlin Wang
arXiv 预印本
提出覆盖围手术期全流程的手术多智能体辅助系统 SURGENT:融合思维树规划器、多科室协作智能体与检索增强推理,并以长短期双重记忆机制支撑完整上下文推理;在病例分析、手术方案模拟等五项任务上优于基线大模型与现有医疗多智能体框架,支持隐私保护的本地部署。
Yanyu Chen, Yue Li, Yongyi Cui, Dongsheng Shi, Lichang Dai
arXiv 预印本
构建污染检索场景下选择性证据采纳的受控基准 SelectBench,并用 DAPO 结合规则奖励或冻结语义裁判对 Qwen3.5-4B 进行后训练;严格成功率从 22.46% 提升至最高 26.46%,显著降低有害内容采纳率且通用能力无退化。
实习
2026.05 — 至今
负责集团敏感信息识别系统(SUIE)的 AI Native 改造,构建与优化 SUIE 系统的知识飞轮、数据飞轮、自动化分类分级标注与模型训练全链路,满足阿里 AI 训练语料、集团流水等海量数据的脱敏需求。① 构建 LLM 数据飞轮:构建含一致性检测、合并检测等循环清洗工作流的 skill,应用于多个业务 NER 数据集的清洗,累计完成标签改动 1000 余万条;② 知识-金标双螺旋飞轮:构建 LangGraph 知识-金标飞轮系统,多路异构投票产生银标数据,再通过知识门依已验证知识把关晋级金标,金标再回流验证、挖掘与优化知识,实现知识与金标集交替精化、互为飞轮;③ 模型训练与优化:构建 skill 在清洗后数据上系统扫描超参数、训练配置、各模型进行消融实验,并设计验证 recall_weight 超参数在准召失衡 UIE 数据集上的作用,理想状态下能将 F1 提升 15~30 pp;④ Harness:组合构建 Harness 系统,实现知识与模型自动循环迭代,并包装为 MCP 自动处理线上反馈工单。工作效果:将多个百万量级的 NER 数据集与模型迭代至 F1 0.95 以上,其中 PubPriv 模型将线上 F1 提升至 0.99。
2024.10 — 2025.04
构建并部署一套基于多智能体系统的虚拟人智能客服后台,为证券相关咨询提供准确的响应。① 数据提取与处理:使用 LlamaParse、LangChain 从业务文档与网络金融文本中抽取、校对并结构化 2 万条问答对,结合 KenLM、Datasketch 构建的数据质量管道完成 PPL 过滤、去重与质量清洗;② 构建 RAG 节点:基于 FAISS 搭建向量检索模块,对问题向量构建离线索引并持久化缓存,对召回的问答对进行 XML 标签隔离与 Token 预算裁剪,实现低延迟、高一致性的知识检索;③ 构建金融 Agent:基于原 RAG 流程使用 LangGraph 构建多节点 Agent,搭建并微调意图分类、输入重写、金融计算、业务问答、闲聊、合规过滤等节点,以及短期、长期、持久三层记忆机制,提升复杂场景处理能力;④ 优化模型训练链路:SFT 后使用 VeRL 对模型进行 GRPO 训练,针对回答审核、金融推理、结构化输出等任务构造偏好输入与奖励信号,提升模型在逻辑推理、步骤完整性与答案规范性上的表现;⑤ 推理优化:使用 TRT-LLM 进行 FP8 量化编译,并对延迟、吞吐与精度损失进行评估,显著提升生产效果。效果:系统完成生产部署,核心在线链路 P95 延迟约 120ms,相比调用外部 API 显著降低成本且数据可控。
实践
2025.04 — 2025.11
为解放日报构建覆盖 8 大敏感类别的中文 AI 内容审核系统,填补中文敏感信息 Guard 模型的空白。① 数据处理:使用 Pandas、NumPy、Datasketch 等工具结合 LLM 判断搭建数据飞轮,对十几个非结构化数据集进行对齐、清洗、切分、去重;② 数据标注:使用飞轮产出的种子数据集微调 BERT 模型,配合文本分类 API 多源融合为 40 万条数据打标;③ Guard 模型训练:初步微调 Qwen3,挑选出错报、漏报、误报和多标签样本作为困难样本,构建 R-SFT 格式数据对模型回调,如此迭代三轮;对最后的困难样本人工构建正负样本对,DPO 训练出最终的 Guard 模型;④ 工程落地:对准确模型(32B)与快速模型(1.7B)进行 AWQ 量化,并封装接口供智能识别系统调用。效果:大小模型分别实现 Precision 98%(Llama-Guard-4 仅 73%)、Recall 99.2% 与平均响应速度 47ms。
经历
计算机科学与技术学院
杭州
上海
电气与信息工程学院 · 自动化(卓越班)
院级 · 郑州大学电气与信息工程学院
省级 · 河南省教育厅
校级 · 郑州大学
国家级 · 全国高等学校计算机教育研究会
校级 · 郑州大学
国家级 · 中国自动化学会
国家级 · 中国自动化学会
省级 · 全国高等学校计算机教育研究会
国家级 · 全国大学生机械创新设计大赛组委会
省级 · 河南省机械工程学会
郑州大学
省级 · 中国机械工程学会
省级 · 江苏省计算机学会
省级 · 中国电工技术学会
校级 · 共青团郑州大学委员会
国家级 · 共青团中央青年发展部
省级 · 河南省大学生电子设计竞赛组委会
省级 · RoboMaster 组委会
荣誉
队长 · 中国自动化学会
基于 YOLOv5、深度相机与 Jetson Nano 识别静止与旋转展示台上的十几类生活用品的个数与位置
视觉负责人 · 全国大学生机械创新设计大赛组委会
基于双目摄像头与树莓派进行障碍物识别与测量,并与机器人主控单片机通讯
负责人 · 中国自动化学会
基于 YOLOv5、深度相机与 Jetson Nano 测量静止与旋转展示台上各型号螺栓螺母的个数、位置与大小
算法组组长 · 共青团中央青年发展部
负责自瞄程序编写,通过 CV 与卡尔曼滤波预测高速旋转移动机器人的装甲板中心点,经 CAN 通讯控制炮塔云台快速瞄准
全国高等学校计算机教育研究会
电控组组长 · 河南省教育厅
基于 STM32 与大电流舵机驱动板控制攀塔光缆巡检机器人完成竖向与横向攀爬等动作
中国机械工程学会
RoboMaster 组委会
河南省机械工程学会
江苏省计算机学会
全国高等学校计算机教育研究会
中国电工技术学会
河南省大学生电子设计竞赛组委会
郑州大学电气与信息工程学院
郑州大学
共青团郑州大学委员会
郑州大学