锦鲤求职

商汤科技

推理Infra开发工程师,系统及infra模块

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责
1. 参与大模型推理平台(LLM Inference Platform)的研发与优化,建设高性能、高可用的推理基础设施。
2. 参与推理引擎、推理调度、资源管理等核心模块开发,持续优化系统性能、稳定性和资源利用率。
3. 参与大规模 GPU 集群的资源调度与服务部署的开发。
4. 参与核心系统架构设计、技术方案评审及工程规范建设。
5. 跟踪 AI Infra、推理引擎及云原生领域新技术,并推动工程实践。

岗位要求
1. 后端或基础设施相关开发经验,对分布式系统有基础理解。
2. 熟悉 Go 或 Rust 中至少一种语言,理解并发 / 异步编程模型。
3. 了解 HTTP / RPC / 服务治理 等基础概念,具备良好的代码规范意识。
4. 熟悉 Kubernetes 基本使用,理解容器化与基础资源调度逻辑。
5. 具备良好的学习能力与协作意识,能按文档规范推进任务闭环。
6. 熟练使用AI工具进行开发,测试,运维的能力,包括但不限于Claude Code、Cursor、Codex,月Token消耗量在1B以上。

进阶 / 高级能力(满足其一即可)
1. 有复杂系统或基础设施模块的设计与演进经验(如网关、调度、平台服务)。
2. 对 推理性能优化、资源利用率、系统稳定性 有实际实践或强烈兴趣。
3. 能独立拆解问题、推动技术方案落地,并参与系统性复盘。

加分项
1. 有 LLM 推理系统 相关经验(如 vLLM、Triton、TGI、Ray Serve 等)。
2. 向 开源基础设施项目(如 vLLM、Envoy、K8s 生态)提交过 PR 或技术方案。
3. 有跨栈优化经验(从服务层到通信、调度甚至硬件相关)。
4. 发布过技术博客、Benchmark 报告或系统设计总结。

后端开发方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →