岗位描述
岗位职责:
1、负责大语言模型及智能体算法研发,推动其在金融科技、城市智能、政企服务等场景的应用落地;
2、负责任务规划、Agentic RAG、工具调用、记忆管理、多智能体协同等智能体核心能力研发与优化;
3、负责大模型及智能体的数据构建、模型微调、强化学习、评测与安全对齐,持续提升模型效果和任务执行能力;
4、负责文本检索、多轮对话、智能问答、复杂推理、数据分析等专项技术攻关;
5、负责大模型及智能体的推理优化、服务部署和工程化建设,提升系统性能、稳定性和效率;
6、跟踪大模型、智能体及多模态等前沿技术,开展技术预研和成果转化,并参与团队技术规划及能力建设。
岗位要求:
1、计算机、人工智能、自动化、数学等相关专业博士或优秀硕士学历,在大语言模型、智能体、NLP等方向有深入研究和实践;
2、深入理解GPT、LLaMA、Qwen、DeepSeek、GLM等主流大模型架构、训练方法和技术差异,熟悉Transformer、MoE、长上下文等关键技术;
3、熟悉智能体核心技术,包括任务规划、工具调用、记忆机制、RAG、多智能体协作等,有复杂Agent系统研发经验者优先;
4、熟悉大模型预训练、SFT、DPO、RLHF/RLAIF等训练和对齐范式,有行业大模型或智能体模型从0到1研发经验者优先;
5、熟悉PyTorch、Transformers、DeepSpeed等深度学习框架,具备Python、Linux及分布式训练、推理优化相关能力;
6、有ACL、EMNLP、NeurIPS、ICML、ICLR、SIGIR等顶会发表经验者优先;具备良好的技术洞察、自驱、问题拆解和团队协作能力。