职位介绍
为我们的 H200 集群构建调度、存储与推理服务体系。
任职要求
- 使用 Slurm 或 Kubernetes 管理 GPU 负载
- PyTorch、vLLM 或 Triton
- InfiniBand 与 NCCL 故障排查
我们提供
- 有竞争力的薪资与年终奖金
- 覆盖本人及家属的商业医疗保险
- 设备预算与技术会议补贴
- 办公室之间的搬迁支持
2026年8月28日
申请该职位
请发送简短的自我介绍以及简历或个人主页链接。
为我们的 H200 集群构建调度、存储与推理服务体系。
2026年8月28日
请发送简短的自我介绍以及简历或个人主页链接。