岗位描述
工作内容
1. 系统稳定性问题攻关
负责系统异常重启、黑屏、冻屏、无法开机等疑难问题的分析定位,结合源码、日志和故障转储建立证据链,推动根因修复与验证。
2. 稳定性事件采集与数据分析
负责崩溃、无响应、异常重启、黑屏冻屏、关键服务异常及故障恢复等事件的埋点设计与落地,完善事件分类和统计口径,通过版本、平台及场景维度分析,识别共性问题与稳定性风险。
3. 自动化分析能力建设
开发日志解析、故障转储分析、堆栈聚合、异常分类及相似问题检索工具,沉淀诊断规则和问题知识库,提高故障分析效率。
4. 跨团队问题闭环与交付保障
联合架构、系统、应用、测试、质量及售后团队,协同芯片、操作系统和软件供应商开展问题攻关,持续跟踪修复、回归及OTA后表现,为版本交付提供稳定性风险评估。