岗位描述
岗位职责
从事大模型在家庭AI交互场景下的算法研发与优化工作,负责大模型微调、评测体系搭建、长短期记忆机制设计,支撑智能家居AI智能体的核心模型能力建设。
岗位职责:
1、参与大模型在家居多轮对话、意图理解、指令跟随等场景下的微调与效果调优,包括SFT、RLHF/DPO等训练策略选型与实施;
2、设计并搭建模型效果评测体系,包括评测集构建、自动化评测流水线、线上效果回流机制,支撑模型迭代的量化决策;
3、参与记忆模块的算法设计,包括长短期记忆存取策略、记忆冲突检测与更新、多轮对话上下文压缩等;
4、参与模型训练数据的构建与清洗,包括数据标注规范制定、数据质量评估、合成数据生成;
5、跟踪大模型预训练、微调、对齐相关的前沿技术,推动技术方案在实际业务场景中的落地验证。
岗位要求
1、熟练使用Python,熟练使用PyTorch、DeepSpeed、LoRA/QLoRA等大模型训练与微调框架,熟悉Linux开发环境,熟练使用AI工具同时有个人理解;
2、熟悉Transformer、注意力机制等大模型底层原理;熟悉主流开源大模型(Qwen、LLaMA、GLM等)的微调与部署流程,了解模型量化、推理加速相关技术;
3、了解大模型评测方法论,熟悉常见评测基准与评测工具的搭建思路;
4、了解长短期记忆、RAG等相关技术方向优先;
5、有发表过NLP相关研究AI顶会论文优先(CCF A类会议或期刊);参与过家居、车载、手机等智能终端交互场景的项目开发者优先。