异构加速框架工程师(深圳/北京/上海)

Company Tencent

Focus Tech · Backend

Location 北京

Published March 26, 2026

岗位职责

  1. 协同算法团队co-desgin,针对AI推理构建GPU/AI芯片底层性能优化与调优;
  2. 机器学习框架层架构创新,核心模块优化和扩展,提升计算效率与资源利用率;
  3. 深入分析GPU/AI芯片的硬件架构特性,设计并实现高性能算子、算法和特性使能组件;
  4. 探索前沿技术方向(如混合专家模型MOE、动态计算图编译优化等)。

任职要求

  1. 熟练掌握C/C++、Python编程语言,具备良好的coding和调试能力;
  2. 熟悉GPU/AI芯片编程,如CUDA,Triton,Ascend C等;
  3. 熟悉Cublas,Cutlass,CK等高性能算子开发工具;
  4. 熟悉Torch-Compile等AI编译模块者优先;
  5. 熟悉主流开源模型或推荐模型,有实际性能调优经验(如KV Cache优化、动态批处理、Attention算子定制等);
  6. 扎实的高性能计算基础,熟悉并行计算、内存优化、通信优化等技术;
  7. 加分项:;
  8. AI数据、搜广推等场景架构和加速经验;
  9. 相关领域开源项目贡献、顶会论文等。

产品/项目

大数据(数据计算平台部)

工作年限

两年以上工作经验