岗位描述
岗位职责
1. 负责基于xLLM构建面向大模型、多模态、生成式推荐及端侧等多种场景的推理优化技术体系;
2. 开展大模型显存优化与结构优化,研发基于编译优化的智能高效执行引擎;
3. 攻坚超长序列KV Cache优化及多模态大模型Cache优化技术,提升模型端到端推理性能;
4. 探索并落地新一代生成式推荐推理优化及基于强化学习(RL)的智能大模型推理服务框架;
5. 研发高效的端侧推理优化技术,实现端云协同的推理架构部署。
任职要求
1. 获得本科及以上学历,计算机科学、电子工程等相关专业;
2. 在大模型推理、机器学习、自然语言处理、计算机视觉、多模态内容理解或推荐系统等至少一个领域有深入的算法或系统优化研究经验;
3. 具备极强的底层系统架构思维与技术攻坚热情,能够独立思考并驱动复杂系统的性能优化;
4. 在系统或人工智能领域顶级学术会议(如OSDI, SOSP, NeurIPS, ICLR等CCF-A类会议)有高质量论文发表记录,或在相关核心开源项目中有突出代码贡献。