锦鲤求职

面壁智能

大模型评测算法架构师

锦鲤会替你打开官网网申、按简历自动填表提交,你只需要在关键步骤确认。

岗位描述

岗位职责
面壁智能正在从 0 到 1 搭建大模型评测体系。我们需要的不只是“跑 Benchmark 的工具人”,而是懂模型、能定标准、有 Owner 意识、敢 Say No 的评测算法工程师。
你将参与建立一套 公正、自动化、可规模化 的评测体系,让评测真正成为驱动模型迭代的“指南针”,而不是内部的“安慰剂”。你的工作会直接影响基础模型、多模态、语音、Agent 等方向的技术决策与落地效果。
高级别候选人可承担评测子方向 Owner,参与团队建设与中长期评测规划。
1. 研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系;
2. 深入参与团队内部模型训练的性能分析与评估,尤其聚焦在基础模型、多模态(图像、语音、Agent)和前沿技术(如强化学习对齐、Prompt工程)等方向的能力定量分析;
3. 分析评测结果,挖掘模型潜在瓶颈并提出改进建议,持续提升模型的质量与用户体验;
4. 参与制定模型评测的中长期规划,推动评测工具与流程自动化和标准化,构建业界领先的评测体系。

岗位要求
1. 计算机、人工智能相关专业本科及以上学历。
2. 1 年以上机器学习、数据挖掘或算法评测相关经验;
3. 具备深厚的机器学习、自然语言处理、多媒体理解、语音合成、数据挖掘理论功底,能够独立设计评测方案。
4. 熟练掌握 Python / Java / C++ 中至少一种编程语言,熟悉 PyTorch、TensorFlow 等深度学习框架,以及 OpenCompass / VLMEvalKit / EvalScope 等评测框架。
5. 对前沿技术有敏锐洞察力,具备优秀的分析问题与解决问题能力。

人工智能方向的申请准备

先核对岗位要求与自己的经历,再准备档案、投递和面试。

阅读求职步骤与示例 →