岗位描述
核心目标: 构建基于沐曦GPU的算力底座解决方案。通过打通从底层算力、算子优化到上层AI Agent框架的技术链路,将硬件能力转化为可大规模部署的业务实践,建立沐曦在Agentic Workflow(智能体工作流)时代的生态优势。
岗位职责:
1.AI Infra 方案构建: 负责研究并集成主流AI Infra组件(如算力调度、分布式存储、向量数据库等),确立沐曦GPU在智算中心集群中的最佳实践方案。
2.Agent 生态探索: 深入研究 vllm,sglang, diffusers, LangChain, CrewAI, AutoGPT 等智能体框架,定义沐曦算力如何高效支撑多智能体协作、长短期记忆管理及复杂任务规划(Planning)等场景。
3.业务实践提炼: 针对金融、法律、制造等行业,提炼基于沐曦GPU的 Agent 落地案例,撰写行业技术方案与实施路径图。
4.技术趋势前瞻: 跟踪 AI Infra 原生化(Cloud Native AI)及大模型端到端推理优化趋势,确保沐曦生态方案具备前瞻竞争力和可落地性。
职位要求:
1.架构视野: 深刻理解大模型全生命周期(训练、微调、推理),熟悉 AI Infra 栈(如 K8s, Slurm, vLLM, DeepSpeed, Ray 等)的部署与优化。
2.Agent 实践: 有 Agent 框架的实际落地经验,理解 Prompt Engineering、Harness engineering, Loop Engineering ,知识库构建及 Agent 评估体系。
3.方案能力: 能够将复杂的 AI 基础设施架构转化为结构清晰的技术白皮书,具备向 B 端决策者解释技术价值的能力。
4.背景要求: 有大型算力集群建设或复杂大模型应用项目经验者优先;不强调高频编程,但需具备极强的架构拆解和工具链整合能力。