资深研发工程师 (JR2026082500E)Company DidiFocus Tech · BackendLocation 北京Published August 27, 2026岗位职责 负责国际化支付平台的全域质量保障,覆盖收单、收银台、支付、账户账务和清结算等领域,参与需求和技术方案评审,提前识别业务、架构、稳定性及资金安全风险。 短期围绕 QA 和研发团队的实际需求,建设基于大模型、AI Coding 和 Agent 的研发质量自动化流程。 作为大型项目测试负责人,牵头异地多活、机房建设及迁移、容灾切换、性能优化、老旧系统改造、基础组件升级、数据迁移和废弃代码治理等项目的质量工作。 针对大型项目制定端到端质量方案,明确项目质量目标、风险清单、测试分层、环境和数据准备、自动化建设、测试排期、准入准出标准、灰度策略、回滚条件及生产观察方案。 统筹大型项目的测试执行和跨团队协作,推动关键风险得到有效验证,确保上下游契约、数据一致性、业务连续性、资金安全和应急预案满足上线要求,并对最终测试结论负责。 深入参与大型项目的技术方案和代码评审,从可测试性、可观测性、兼容性、容量、故障恢复和数据一致性角度提出改进建议;能够通过代码分析和必要的技术验证发现实现层风险。 主导全量、集成和 UI 测试方案,保障需求场景覆盖、Case 稳定性和测试准出质量;针对高风险变更使用流量录制回放、影子流量或 DIFF 等手段验证真实业务行为。 设计并开发自动化巡检、监控告警、业务对账、线上问题诊断、测试数据、Sim/Mock、流量回放和自动化执行工具,持续治理 Flaky Case,提升测试资产稳定性和执行效率。 负责上线及线上质量保障,建设自动巡检、不变量监控和业务对账能力,验证灰度、降级、回滚、切流及容灾方案;发生异常时推动快速止损、影响评估、根因定位和恢复验证。 开展故障注入、应急演练、性能压测和容量评估,识别系统瓶颈及单点风险,推动研发完成架构或代码改进;必要时参与稳定性工具、基础组件和相关工程能力的开发。 建设需求、场景、用例、代码、执行结果和发布记录之间的双向追溯链路,并通过覆盖率、缺陷逃逸率、巡检拦截率、Flaky 率、故障发现时长和恢复时长等指标衡量质量建设效果。 从大型项目和线上问题中提炼共性风险,将一次性的测试经验沉淀为自动化规则、质量门禁、研发工具或平台能力,持续提升团队整体质量保障效率。 任职要求 具备扎实的编码能力和计算机基础,熟悉 Java 及常用技术栈,能够独立开发自动化工具、测试框架、稳定性工具或质量平台能力。 熟悉 Spring/Spring Boot、数据库、缓存、消息队列、RPC/API 等技术,理解分布式事务、最终一致性、限流熔断、超时重试、服务降级和容灾切换等机制。 具备阅读、分析和评审生产代码的能力,能够结合技术方案、代码实现、数据流和系统依赖判断变更影响,并通过代码验证或自动化测试证明结论。 具备大型项目质量规划和项目推动能力,能够完成风险拆解、测试策略设计、资源协调、进度管理、质量门禁和上线保障,并对最终测试结果负责。 具备优秀的测试分析和场景设计能力,能够系统覆盖正向、异常、边界、并发、幂等、超时、重试、恢复、兼容、切换回退及数据一致性场景。 具备较强的 AI 工具应用和工程建设能力,能够将大模型、AI Coding 或 Agent 应用于需求分析、风险识别、用例设计、自动化开发、代码评审、问题定位和复盘沉淀。 理解生成式 AI 输出的不确定性,能够通过原始需求、代码证据、确定性规则校验、编译和测试执行、独立评审及数据指标验证结果,识别并防范幻觉、遗漏和错误结论。 具备支付、金融等资金类业务风险意识,能够从业务流程、系统架构、数据状态和代码实现等维度分析资损风险,并设计相应的监控、对账、补偿和验证机制。 具备较强的线上问题定位能力,熟悉日志、指标、Trace、监控告警和业务对账,能够完成复杂问题的复现、根因分析、影响评估、应急处置和修复验证。 具备测试工具和稳定性平台的工程化能力,能够将一次性脚本建设为可靠、可扩展、可维护和可运营的平台能力。 对大型项目和线上质量结果有较强的责任意识,能够持续跟进疑难问题直至闭环,并推动风险在上线前得到充分暴露和验证。 具备良好的逻辑分析、技术沟通和跨团队协作能力,能够组织产品、研发、QA、运维及上下游团队共同完成复杂项目;能够使用英语与海外业务或前线团队直接沟通者优先。 部门 Fintech Technology