GPU Infrastructure SRE Engineer(GPU 基建 & 安全运维工程师)
我们是谁
共绩科技成立于 2023 年,核心创始团队源自清华大学,创新打造全国闲时算力调度平台。公司首创"以算代储"方案助力新能源消纳,专注构建"算力+能源"融合的智能调度网络,致力于打造全球领先的弹性、低价、稳定、绿色的 AI 算力基础设施。
共绩科技大模型云服务团队,专注大模型“生产-调优-服务”全链路闭环建设,核心业务涵盖模型调优、算子优化、智能路由、智能决策、Agent 生态产品及前沿创新服务。加入我们,您将深度参与共绩算力 MaaS 平台与 Token 产品的全生命周期建设,从需求洞察到落地上线全链路操盘,在实战中快速蜕变为云计算与算力领域的专家型产品人才。
这个岗位你会做什么
- 负责 GPU 推理集群的部署、运维及稳定性保障。
- 负责 Linux、Docker、GPU 运行环境及 RDMA 网络的维护和优化。
- 与模型及推理框架团队协作,定位和解决系统、网络及 GPU 相关问题。
- 建设监控、自动化运维及故障恢复能力,持续提升平台稳定性和资源利用率。
- 持续优化 AI 推理基础设施,提升集群性能及运维效率。
我们需要你
- 熟悉 Linux,具备扎实的系统基础及故障排查能力。
- 熟悉 Docker,具备容器化部署和维护经验。
- 熟悉 Python、Go 或 Shell,具备自动化开发能力。
- 熟悉计算机网络基础,有 RDMA 或高性能网络经验优先。
- 具备基本的 Linux 安全和网络安全意识,了解权限管理、SSH、安全加固、防火墙等常见安全实践。
- 有 GPU、CUDA、AI 推理平台(SGLang、vLLM、Triton 等)或分布式系统经验者优先。
- 具备良好的工程意识、责任心和团队协作能力。
- 熟悉 RDMA、RoCE、InfiniBand、Mellanox 等高性能网络。
加分项
具备以下一项或多项经验者优先:
- 有 AI 推理平台或推理框架使用经验(如 SGLang、vLLM、Triton 等)。
- 有 Linux 安全加固、容器安全或生产环境安全运维经验。
- 有开源项目贡献或维护经验。
职位信息
- 薪资:30K ~ 50K/月,优秀候选人支持面议。
- 地点:北京市海淀区北四环西路67号中关村国际创新大厦,优先北京办公,也可以 Base 杭州、深圳。
投递方式
简历 / 项目作品发送至:cwj@suanleme.cn
邮件主题:【共绩 MaaS 招聘】GPU Infra - 姓名
欢迎附上 GitHub 主页、项目链接、或任何能证明你工程能力的材料,一般情况下,我们会在 3~7 个工作日内回复。由于面试是业务线自行处理,如果佬友们需要查询结果/催进度,可以在 L 站 DM 我或者发邮件到cwj@suanleme.cn