岗位描述
工作内容
任职目标:作为AI基础设施的核心技术人员,负责包括边缘AI推理平台、企业推理平台、智能推理路由等核心产品的工程建设。
热爱技术,对AI和基础设施领域保持持续好奇心。能够从系统视角理解问题,愿意参与新一代边缘AI基础设施产品从0到1建设,共同打造A推理平台。
岗位职责:
1.参与A推理平台研发,负责模型部署、推理服务、资源管理等核心能力建设;
2.参与分布式路由与服务调度系统研发,实现模型服务发现、智能路由和资源调度能力;
3.参与GPU、NPU等异构算力资源管理与云原生接入能力建设;
4.参与大模型推理服务平台研发,包括模型发布、推理服务、监控运维等功能开发:
5.参与边缘节点管理、云边协同及分布式A基础设施建设;
6.持续跟踪AlInfra、云原生及大模型推理领域技术发展,推动新技术落地。
任职条件
岗位要求:
1.5到10年相关工作经验;
2.本科及以上学历,计算机、软件工程、人工智能等相关专业;
3.具备扎实的软件开发基础,熟悉Go、Python等至少一种开发语言;
4.熟悉Linux系统及网络基础知识;
5.熟悉容器、Kubernetes等云原生技术体系;
6.熟悉模型部署、推理优化相关技术,深入掌握vllm\SGLang等推理框架,对PD分离、KV Cache等推理相关技术有实践经验;
7.具备较强的问题分析与解决能力,能够独立承担模块设计与开发工作;
8.具备良好的学习能力和技术探索精神。
9.熟练掌握AI原生开发的技能,能够构建团队AI编程开发的技术流程和开发规范;
优先条件:
具备以下任意方向经验者优先:
1.Kubernetes、KubeEdge、OpenYurt等云原生平台研发经验;
2.vLLM、SGLang、Triton、TensorRT-LLM等推理框架使用或开发经验;
3.GPU、NPU资源管理及AI算力平台研发经验;
4.AlInfra、云计算、边缘计算领域研发经验。