岗位描述
岗位职责
1. 参与端侧大模型相关算法研发,包括 LLM、VLM、多模态模型、Agent 等方向。
2. 参与大模型的数据处理、训练、微调、评测及效果优化。
3. 参与 SFT、LoRA/QLoRA、知识蒸馏、模型压缩、量化 等大模型优化技术研发。
4. 参与大模型端侧部署及推理优化,包括模型转换、算子优化、内存优化、推理性能优化等。
5. 针对 Qualcomm、MTK、RK、Horizon、Ascend 等 AI 芯片平台进行模型适配和部署优化。
6. 参与 RAG、Embedding、Reranker、Agent、Function Calling、Memory 等技术研发。
7. 参与文本、视觉、语音等多模态 AI 能力建设,并推动大模型在实际产品中的落地。
8. 分析和优化模型的 精度、推理速度、内存占用及功耗 等关键指标。
9. 跟踪 DeepSeek、Qwen 等主流大模型及端侧 AI 技术发展,进行新技术预研。
任职要求
1. 硕士应届毕业生,计算机、人工智能、软件工程、自动化、电子信息、数学等相关专业。
2. 具备扎实的 Python/C++ 编程基础,熟悉 Linux 开发环境。
3. 具备机器学习、深度学习基础,了解 Transformer、Attention 等基本原理。
4. 熟悉 PyTorch 等深度学习框架,有模型训练、推理或部署经验者优先。
5. 对大语言模型、多模态模型及端侧 AI 技术有兴趣。
6. 具备以下任一经验者优先:
o LLM / VLM / 多模态模型
o SFT / LoRA / QLoRA
o PTQ / QAT / 模型量化
o 蒸馏 / 剪枝 / 模型压缩
o ONNX / QNN / SNPE / TensorRT / vLLM
o CUDA / GPU / NPU 加速
o RAG / Embedding / Reranker / Agent
o 大模型端侧部署及性能优化
7. 有大模型相关科研项目、竞赛、论文、开源项目或实习经历者优先。
8. 具备较强的学习能力、技术钻研能力和问题分析能力。