包启涵AI 研究与工程

把研究做成系统

我主要做 LLM 推理与评测,也会动手把视觉模型、Agent 和后端服务接进完整应用。保持好奇,保持思考。

由粒子轨迹组成的抽象系统图
页面概念图,与实验结果无关

从一张餐图到一套完整应用

Nutri-flow

识别出餐盘里的食物之后,接下来还能做什么?

Nutri-flow 是我的毕业设计。我从 FoodSeg103 语义分割开始,后来加入营养检索、用户记忆和 Agent 工作流,也完成了 Web 端、移动端和部署。

目前的原型会先对餐图做食物分割和营养检索,再结合用户记录生成日常饮食建议。营养估算只作粗略参考,不提供医疗建议。

我做的部分

模型和应用都由我独立完成。分割模型采用预训练 Swin Transformer 和可学习的多尺度融合;异步任务由 RabbitMQ 处理,有状态工作流用 LangGraph 组织。

页面概念图,与实验结果无关

这里放了三个项目:一个毕业设计和两项合作研究。具体实现和实验结果可以看 GitHub 与论文。

高背景环境下的喷注 pT 重建

喷注 pT 重建

热背景噪声很强时,机器学习能不能把喷注 pT 重建得更准?

我们用 PYTHIA6 hard-jet events 和模拟热背景构建数据,再通过 FastJet anti-kT 完成喷注聚类。

我们随后比较了 MLP、随机森林、线性回归和 area-based subtraction 的响应分布。数据来自 Monte Carlo 模拟,不是真实碰撞数据。论文题目沿用 jet energy,但模型实际预测的是喷注 pT。

我做的部分

这是一个四人项目,我担任项目负责人和共同第一作者,负责推进研究,并参与代码、实验设计、结果图和论文写作。

用到的技术: PYTHIA6FastJetanti-kTMLPRandom Forest

查看论文(在新标签页打开)

九种风格的 LoRA 人像实验

PSDiffusion

不重新训练整个扩散模型,能不能用 LoRA 生成不同的人像风格?

我在预训练扩散模型上训练了 9 类人像风格 LoRA,并完成 image-to-image 生成实验。

论文还包含条件扩散与 F-ESRGAN 高分辨率增强,这两部分属于团队整体工作。

我做的部分

我在三人团队中担任共同第一作者,主要负责 LoRA 训练、生成实验和相关结果整理。

用到的技术: DiffusionLoRAimage-to-imageF-ESRGAN

查看论文(在新标签页打开)

先把实验记录做好

我会先把问题和评测方式定清楚,再把每轮实验留好记录。样本量不够时,就不急着下结论。

由粒子轨迹组成的抽象系统图
页面概念图,与实验结果无关

2026.03 至 2026.04

一次没有写成论文的 test-time compute 实验

2026 年春天,我和一位德国高校的博士生一起,用 Qwen2.5 在 MATH 与 AIME 2024 上做过一轮小规模采样实验。我负责用 Slurm 跑集群任务,比较不同推理预算下的表现。

这次只做到小样本探索,样本量不足以得出稳定结论,最后没有论文或公开结果。

具体 checkpoint 和完整实验记录后来没能恢复。以后再做类似实验,我会先固定评测口径,把每轮结果留档,再决定要不要增加算力。

经历与教育

我在西南大学读完软件工程本科,也参加过一次校企毕业实训;接下来的入学时间还没确定。

2022.09 至 2026.07

西南大学

软件工程工学学士

2026 年 7 月毕业。

2025.03 至 2025.05

重庆中软卓越信息技术有限公司

校企毕业实训

在六人团队中担任项目经理兼智能体设计负责人,负责拆分任务、协调进度,并设计基于 MaxKB 的智能家居 Agent/RAG 工作流和工具路由。

入学时间待定

UC San Diego

ECE 硕士项目录取

已经拿到 ECE 硕士项目录取,入学时间还在安排中。

最近在做什么

最近主要在看 LLM 推理与评测,也在整理以前的项目,同时给家里人做一个饮食记录小程序。

LLM 推理与评测

在看 test-time compute、采样策略和评测设计,尤其关心不同设置该怎么比较。

模型进入系统

继续琢磨模型接进应用后的问题:服务怎么拆、异步任务怎么排、模型调用失败后怎么办。

星烬回路

一个关于轨道、能量与选择的交互小作品。

我独立完成设计与开发,部分实现由 AI 协助。

进入星烬回路(在新标签页打开)
星烬回路

联系我

如果你也在做 LLM 推理与评测、Applied ML 或 Agent 系统,欢迎来信交流。