想控制模型,不只是用它。
有工程能力 · 善于灵活变通 · 热爱挑战自我
- 背景
- 北京,高中生。跟随高校课题组做研究,做过算法实习,也给音乐公司做过歌词生成模型。
- 社群
- 发起并运营校内 AI 社团炼丹社,活跃成员 10+,持续做技术分享与协作。
- 研究
- 覆盖模型训练、Agent 系统、可解释性、多模态、3D 生成和表征分析。
- 代码之外
- 养近海原生鱼和绿植。和训模型是一回事,都是看一个系统慢慢长。
从独立开发到开源贡献,这些项目记录了我从应用层到研究层的完整路径。
研究方向
四个方向:搞清楚模型内部发生了什么,让它看懂图像和 3D 世界,再用最少的算力把它跑起来。
概念的读出与控制
一个概念在 LLM 里能被读出,不代表能被控制。研究读出方向和控制方向如何分离,跨模型家族做裁决。延伸工作 Drifting ITI:用 drift model 动态预测注意力头的操控向量。
多模态与动态特征扩展
以 Qwen2.5-VL-7B 为骨干做动态特征扩展(DFE),研究输入分辨率对 3D 凹凸拓扑细节识别的影响。
3D 生成与世界模型
基于 3D Gaussian Splatting 的程序化无限环境,对比流式视频世界模型与持久化 3DGS 架构,长期目标是开放世界游戏。
推理优化
单张 RTX PRO 6000 上的大模型推理:offload 性能补丁、量化敏感性、vLLM 服务化。GLM-5.3-Flash 从 17.8 提到 36.7 tok/s。
循环 Transformer
训练 51M 的序列循环 Transformer-XL 变体和 110M 的 Universal Transformer + ACT,研究深度循环与序列循环的权衡,以及外部记忆能否移动算力质量的 Pareto 前沿。
开源项目
freetoken-ox-boost
FreeToken v0.1.2 的 GLM-5.3-Flash 适配与 offload 性能补丁。单张 RTX PRO 6000 上 17.8 → 36.7 tok/s。
endless-labyrinth
基于 3D Gaussian Splatting 的程序化无限环境 demo。长期目标是一个开放世界游戏。
recurrent-transformer-0.1b
110M 参数的 Universal Transformer + ACT 模型,发布在 Hugging Face。
Tree_Of_Thought
Tree of Thoughts 推理范式的实现与实验。
agent_team
目标是实现基本功能的简约 multi-agent team。
MiniLLM-0.1B
从零训练的 0.1B 参数小语言模型。
学生社团,自己的显卡,免费给同学用。
炼丹社是 SDSZ 的学生 AI 社团。我们自己维护一张 RTX PRO 6000,算力有限,推理 API 内部邀请制使用。也做校园平台,接 AI 集成外包。
访谈 · 数字生命卡兹克
为让同学免费用AI,两个高中生……
两位 16 岁的高中生把自己的算力接入社团,只为让更多同学能免费用上 AI。
炼丹社 FreeAPI
免费的 GPU 推理 API。算力有限,内部邀请制使用。开放无限制版权重推理,赋能网安测试。
SDSZ 校园社区
面向 SDSZ 学生的校园社区平台。由我独立维护。