KianAI 研究与工程

让想法在现实中运行

我研究 LLM 推理与评测,也把模型、Agent 和后端服务接成应用。保持好奇,保持思考。

由粒子轨迹组成的抽象系统图

从一张餐图到一套完整应用

Nutri-flow

识别出餐盘里的食物之后,接下来还能做什么?

我的毕业设计:从餐图上传、食物分割到营养检索,再结合用户记录生成饮食建议。整套流程已在 Web 与移动端打通。

我做的部分

我独立完成模型、前后端与部署。在 FoodSeg103 上训练分割模型,以 Swin Transformer 和可学习的多尺度融合提取特征,再用 RabbitMQ 与 LangGraph 串联异步分析。

Nutri-flow Web 端的餐图分割结果,标出食物区域与类别Nutri-flow 移动端的餐图预览与上传界面
Web 端食物分割与移动端餐图上传。点击可查看完整截图。

我喜欢顺着一个问题往下做,直到实验有了结果,代码也有了去处。

高背景环境下的喷注 pT 重建

喷注 pT 重建

热背景噪声很强时,机器学习能不能把喷注 pT 重建得更准?

用 PYTHIA6 与模拟热背景构建事件,经 FastJet anti-kT 聚类后,比较 MLP、随机森林、线性回归与面积法背景扣除的响应分布。

我做的部分

我担任四人团队的项目负责人和共同第一作者,组织研究,参与代码、实验设计、结果图与论文写作。

用到的技术: PYTHIA6FastJetanti-kTMLPRandom Forest

查看论文(在新标签页打开)

九种风格的 LoRA 人像实验

PSDiffusion

不重新训练整个扩散模型,能不能用 LoRA 生成不同的人像风格?

论文将条件扩散、LoRA 风格适配与 F-ESRGAN 增强串成一套人像生成流程。

我做的部分

作为三人团队的共同第一作者,我完成了 9 类人像风格的 LoRA 训练、image-to-image 实验与结果整理。

用到的技术: DiffusionLoRAimage-to-imageF-ESRGAN

查看论文(在新标签页打开)

用实验回答问题

改变一个设置,结果为什么会变?我习惯先明确评测方式,再逐轮记录和比较。

由粒子轨迹组成的抽象系统图

2026.03 至 2026.04

Qwen2.5:推理预算与解题表现

和一位德国高校的博士生合作,在 MATH 与 AIME 2024 上探索 Qwen2.5 的采样表现。我用 Slurm 运行集群任务,比较不同推理预算。

这轮探索样本较少,尚未形成稳定结论。

教育

2022.09 至 2026.07

西南大学

软件工程工学学士

入学时间待定

UC San Diego

ECE 硕士项目,已获录取

最近在做什么

继续做实验、维护项目,也给日常生活写些小工具。

LLM 推理与评测

探索 test-time compute、采样策略与评测设计,比较不同设置的表现。

模型与应用

琢磨服务拆分、异步任务与失败回退,让模型在应用中可靠运行。

星烬回路

一个六分钟一局的太空肉鸽小游戏,在敌潮中收集强化,撑到最后。

进入星烬回路(在新标签页打开)
星烬回路

联系我

如果你也在做 LLM 推理与评测、Applied ML 或 Agent 系统,欢迎来信交流。