岗位描述
岗位职责
岗位职责:
参与大模型推理场景下 KVCache 机制 的调研、设计与开发。
协助优化 KVCache 的存储、读取与淘汰策略,提升推理效率与资源利用率。
参与 AI 推理框架与分布式存储系统的联调与性能分析。
协助定位系统性能瓶颈,包括 显存、内存、网络与IO 等方面的问题。
跟踪 Transformer、推理加速、缓存管理等方向的前沿技术,并参与技术验证与原型开发。
与算法、AI Infra、存储等团队协作,共同推动大模型推理能力落地。
岗位要求
任职资格:
基本要求
计算机科学、软件工程、人工智能、电子信息等相关专业。
具备扎实的 数据结构、算法、操作系统、计算机网络 基础。
熟悉 Python、Java、C++、Go 中至少一种编程语言。
对 AI基础设施、分布式系统或高性能计算 有较强兴趣。
具备良好的学习能力、分析问题能力和团队协作意识。
加分项
满足以下任一项即可:
了解 Transformer、Attention、KVCache 等大模型推理相关概念。
使用过 PyTorch、TensorFlow 等深度学习框架进行模型训练或推理实验。
了解 Linux、Docker、Kubernetes 等基础设施技术。
有 CUDA、GPU编程、并行计算 或 HPC 相关课程/项目经历。
参与过 开源项目、科研项目、算法竞赛、系统类课程设计 等实践活动。