岗位描述
岗位职责
1、参与大模型推理平台(LLM Inference Platform)的研发与优化,建设高性能、高可用的推理基础设施;
2、参与推理引擎、推理调度、资源管理等核心模块开发,持续优化系统性能、稳定性和资源利用率;
3、参与大规模 GPU 集群的资源调度与服务部署的开发;
4、参与核心系统架构设计、技术方案评审及工程规范建设;
5、跟踪 AI Infra、推理引擎及云原生领域新技术,并推动工程实践。
岗位要求
1、2027届获得本科及以上学历,计算机、人工智能等相关专业;
2、掌握 Golang 、Rust 至少一种语言,具有扎实的计算机基础,熟悉数据结构、算法、操作系统、网络等基础知识;
3、了解 HTTP / RPC / 服务治理 等基础概念以及 Docker、Kubernetes 基础原理;
4、对大模型(LLM)推理、AI Infra、分布式系统、高性能计算等方向具有浓厚兴趣;
5、熟悉或使用过 AI 编程工具(如 Claude Code、Codex、Cursor)辅助开发,具备利用 AI 提升研发效率的意识和能力。