SOFTWARE ENGINEERING / AI SYSTEMS

让推理更短,
让系统更有用。

我关注大语言模型的推理预算、程序分析与系统部署,习惯把一个抽象问题落成可运行、可验证、可交付的系统。

教育背景综合排名 3 / 231绩点排名 15 / 231 · GPA 3.8 · CET4 / CET6
专业能力PAT 92 / 100科学计算导论 100 · 数据结构 98 · 机器学习实践 98.3 · 计算机网络 95
研究主线LLM 高效推理预算估计 · 思维链压缩 · 系统部署
综合发展20+ 荣誉 · 10 项职务256 小时志愿服务 · 1 项授权专利

01 / PROFILE

我喜欢把一个抽象问题,落成一套可以运行、可以验证、也可以被更多人使用的系统。

从推理轨迹的数据处理,到藏纸知识图谱的平台联调,我在算法、工程和真实场景之间来回走动。

02 / RESEARCH

研究,不只是把指标做高。

我的关注点是推理过程中的冗余:如何用更少的 token 交付同样可靠,甚至更好的答案。研究工作覆盖数据构建、指标设计、模型训练、实验分析与系统接口。

2026.05NEURIPS 2026CCF-A / UNDER REVIEW

Logic Density Pruning

Mitigating Overthinking via Step-Level Chain of Thought Compression

针对大语言模型在复杂问题上反复验证、消耗大量无效推理 token 的现象,提出逻辑密度剪枝(LDP)框架。方法结合互信息(MI)与注意力引用分数衡量步骤重要性,再用步级微扰检查(SPC)保护关键逻辑,最后通过 SFT/LoRA 训练压缩后的推理轨迹。研究同时回应两类痛点:模型缺乏难度感知,且生成阶段缺少可控的外部干预。

80.2%Qwen3-8B Token 减少
-1.9%准确率变化
+3.5 ppDeepscaleR 准确率提升

MY ROLE 在远程服务器中完成 Qwen3 与 DeepscaleR 多分支思维链生成、提取和清洗;使用 Python 批量计算基于希尔伯特-施密特独立性准则的互信息得分,统计“犹豫标记”与“结论标记”的词频分布;主导单一 MI、单一注意力指标的消融实验,并完成 TokenSkip、SBT 等基线的对比训练。DeepscaleR-1.5B 的 Token 消耗降低 49.2%,准确率由 40.8% 提升至 44.3%。

过度思考与逻辑密度分布研究图
Reasoning logic density distribution / Qwen3-8B
02
2026.07AAAI 2027 / IN SUBMISSIONSECOND AUTHOR

Estimate, Then Think

Prompt-Based Token Budgeting for Efficient Inference in Large Reasoning Models

针对大语言模型“想得更多却不一定答得更好”的预算失配,在 MATH500 等 2,022 道多难度问题上评估三个 LRM,提出 ETT 自适应提示预算策略:从成功轨迹构建“问题 - 提示预算”软标签,以 0.5 至 0.1 的缩减系数寻找预算下界;随后基于 Qwen3-8B 用 GRPO 训练仅输出整数预算的估计器,并以 Zero-shot / One-shot / Forced 三种提示接口完成预算选择与目标模型推理解耦。

MY ROLE 负责训练集构建、基准标定、奖励函数设计、预算估计器训练和提示接口设计。

46.70%Token 消耗降低ETT-O:90.27% Acc · 1,283.5 tokens · 节省 37.39%
Qwen3-8B:Accuracy +5.73 pp · Pass@3 +4.11 pp
GSM8K 节省 43.09% · MATH500 +8.87 pp
03
2025.09社会经济导刊SECOND AUTHOR

生育支持政策下青年婚育观研究

从问卷数据到婚育意愿的结构模型与群体异质性

围绕家庭环境、婚育教育与婚育认知对青年婚育意愿的影响,设计多阶段分层抽样方案,完成问卷特征清洗、描述性可视化和核心实证模型构建;进一步使用结构方程模型完成路径估计与验证性因子分析,再以聚类算法划分三类特征群体,为异质性解释提供依据。

MY ROLE 数据处理、核心实证模型构建、抽样方案设计、可视化分析与异质性聚类。

3 类青年特征群体SEM · CFA · clustering
FOCUS LLM inferencemutual informationprompt budgetingSFT / LoRASEM / CFAsystem deployment

03 / PROJECT

把文化资料,变成可探索的知识。

国创赛子项目 / 大学生科技创新基金项目 / 负责人
从文献到图谱,再到一个可以被看见的数字平台。

藏纸非遗数字化平台界面截图
藏纸非遗数字化平台 / knowledge graph interface

纸承雪域

藏纸非遗技艺数字化保护与活态传承

用 Vue3、NestJS 与大模型微服务,建立文化展示、后台管理、知识图谱抽取和互动于一体的平台。非结构化文献被清洗、切分,再转成可交互的标准三元组。

01

定向采集藏纸网页语料,完成正文提取、噪声清洗与语义切分。

02

结合 BGE-m3 向量化与 FAISS 检索,召回 few-shot 样本辅助关系归一化。

03

参与前后端架构、数据库建模、后台管理和图谱页面联调。

04

平台已整理 23 种藏纸类型、12 项工艺流程和 2 种在售文创,系统已上线并持续开发。

Vue3NestJSLLM serviceKnowledge graphFAISS公众门户管理后台

04 / ENGINEERING PROJECT

慢病智策:让体检数据更可解释。

项目组长
从预测模型到决策路径,再到可交互的健康问答。

面向体检数据的慢性病智能分析平台,集多病种风险预测、决策路径解释、风险可视化和 AI 健康问答于一体。

4风险预测模型
3聚类与解释视图
1大模型问答入口
01

负责四种风险预测模型训练与优化,完成疾病数据特征处理和聚类分析。

02

接入遵循 OpenAI 协议的大模型问答接口,实现体检指标解释、风险解读和健康咨询。

03

技术栈涵盖 Flask-CORS、FastAPI、NumPy、Pandas、XGBoost、随机森林、K-means、PCA、t-SNE、Vue 3、Vite、ECharts、marked、dompurify 与原生 fetch API。

04 / HIGHLIGHTS

在课堂之外,持续把事情做成。

20+荣誉与表彰

2 次国家励志奖学金、11 次校院级奖学金、3.3w+ 奖助学金及四川省综合素质 A 证等。

10学生职务

学习委员、党支部支委、部长、班导生等,连接同学与团队。

1授权专利

以工程视角处理问题,也在真实场景里验证技术。

5社会实践

在社区、助残基地和校园活动中完成组织与服务。

2025
全球校园人工智能大赛国家级二等奖 / 个人赛
2025
全国大学生统计建模大赛国家级三等奖 / 核心成员
2026
中国大学生计算机设计大赛省级一等奖 / 核心成员
2026
全国大学生市场调查与分析大赛省级二等奖 / 负责人
2025
CCF 算法能力大赛省级三等奖 / 个人赛
2025
睿抗机器人开发者大赛(RAICOM)省级三等奖 / 个人赛
2024-26
校院级竞赛与实践国家级 2 项、省级 8 项、校级 30 余项

05 / PRACTICE

把时间交给真实的人。

曾任青志实践部外联组部长,连续组织“走进圣水,文明劝导”志愿活动;累计志愿服务 256 小时,影响人数 300+。参与校园公益、非遗守护、交通文明劝导、演讲比赛、毕业晚会独奏与团体合唱。

2024 - 25圣水社区文明劝导团队组织 / 社区服务
256 h志愿服务累计50 余次活动 / 300+ 人触达
2024 - 25社会实践与美育暑假一等奖、寒假三等奖、“母校行”奖项、主唱团
2025.07资助宣传大使获媒体单独报道,荣获多项志愿奖项
习惯严谨记录,善于协作语雀沉淀近 50 万字实验记录,熟练使用 Git;抗压能力强

06 / FUTURE PLAN

面向软件安全的智能程序分析。

围绕大语言模型增强的程序推理与安全分析,逐步完成课题与就业衔接,提升程序分析与安全攻防的研发和工程落地能力。

01 / 研一

补齐理论,建立科研方法

系统学习软件安全、机器学习与深度学习;阅读中英文文献,熟悉课题组方向和实验流程,完成基础实验与数据整理。

02 / 研二

聚焦 LLM + 安全分析

深入隐私检测、漏洞挖掘与代码溯源,推进论文实验、模型优化和项目协作,争取论文、专利或竞赛成果。

03 / 研三

整合积累,完成就业衔接

梳理论文主线与个人技术栈,完成毕业论文、项目复盘和成果整理,面向 AI 算法、计算机视觉或智能制造岗位。

07 / CONTACT

一起把下一个问题做得更好。

如果你正在关注高效推理、知识图谱或面向真实场景的 AI 系统,欢迎来信交流。