ABOUT
关于这里
这是一个持续生长的个人知识库。我会把工作中遇到的问题、读过的论文、做过的实验,整理成可以被再次使用的文章。
内容会以 AI 基础设施和工程实践为主,也会保留一些关于学习、工具与效率的思考。
关于我
你好,我是 sjmshsh。我主要关注云原生、GPU 调度、大模型后训练,以及多模态模型的推理部署与性能优化。
我是 Apache Dubbo Committer,也是 dubbo-kubernetes 的发起者和主要维护者,目前正在推进跨集群能力与 LLM 相关改造。
经历与开源
- 在快手实习期间参与 Kubernetes GPU 调度器开发。
- 在腾讯积累了 Agent 与大模型后训练相关经验。
- 从 0 到 1 参与千卡异构芯片集群上的多模态模型推理部署与加速。
- 持续参与 vLLM、SGLang、SGLang-Omni、cuLA、AReaL 等开源项目。
当前关注
我正在继续学习 vLLM、RL Infra 与强化学习算法,同时关注 KV Cache、长序列推理和大规模推理系统优化。
