CERYNITIUS — BEIJING, CN

Insight张睿修

把模型拆开看,再让它跑得更快。

高中生。关注可解释性、多模态、3D 生成和推理优化。主理炼丹社,跟随高校课题组做研究。

01ABOUT

想控制模型,不只是用它。

有工程能力 · 善于灵活变通 · 热爱挑战自我

背景
北京,高中生。跟随高校课题组做研究,做过算法实习,也给音乐公司做过歌词生成模型。
社群
发起并运营校内 AI 社团炼丹社,活跃成员 10+,持续做技术分享与协作。
研究
覆盖模型训练、Agent 系统、可解释性、多模态、3D 生成和表征分析。
代码之外
养近海原生鱼和绿植。和训模型是一回事,都是看一个系统慢慢长。

从独立开发到开源贡献,这些项目记录了我从应用层到研究层的完整路径。

02RESEARCH

研究方向

四个方向:搞清楚模型内部发生了什么,让它看懂图像和 3D 世界,再用最少的算力把它跑起来。

01

概念的读出与控制

一个概念在 LLM 里能被读出,不代表能被控制。研究读出方向和控制方向如何分离,跨模型家族做裁决。延伸工作 Drifting ITI:用 drift model 动态预测注意力头的操控向量。

Interpretability / Activation Steering / ITI

论文投稿中
02

多模态与动态特征扩展

以 Qwen2.5-VL-7B 为骨干做动态特征扩展(DFE),研究输入分辨率对 3D 凹凸拓扑细节识别的影响。

VLM / Qwen2.5-VL / Multimodal

进行中
03

3D 生成与世界模型

基于 3D Gaussian Splatting 的程序化无限环境,对比流式视频世界模型与持久化 3DGS 架构,长期目标是开放世界游戏。

3DGS / World Models / Procedural

进行中
04

推理优化

单张 RTX PRO 6000 上的大模型推理:offload 性能补丁、量化敏感性、vLLM 服务化。GLM-5.3-Flash 从 17.8 提到 36.7 tok/s。

vLLM / Quantization / Offload

持续
05

循环 Transformer

训练 51M 的序列循环 Transformer-XL 变体和 110M 的 Universal Transformer + ACT,研究深度循环与序列循环的权衡,以及外部记忆能否移动算力质量的 Pareto 前沿。

Universal Transformer / ACT / Memory

模型已发布
04炼丹社 · ALCHEMY

学生社团,自己的显卡,免费给同学用。

炼丹社是 SDSZ 的学生 AI 社团。我们自己维护一张 RTX PRO 6000,算力有限,推理 API 内部邀请制使用。也做校园平台,接 AI 集成外包。

访谈 · 数字生命卡兹克

为让同学免费用AI,两个高中生……

两位 16 岁的高中生把自己的算力接入社团,只为让更多同学能免费用上 AI。

2026.08.25 · BILIBILI观看视频
internalINVITE ONLY

炼丹社 FreeAPI

免费的 GPU 推理 API。算力有限,内部邀请制使用。开放无限制版权重推理,赋能网安测试。

vLLM / OpenAI-compatible / Invite only
sdsz.groovin.cnONLINE

SDSZ 校园社区

面向 SDSZ 学生的校园社区平台。由我独立维护。

Next.js / Prisma / Community
05CONTACT

研究讨论、算力合作、项目合作,都欢迎。