职位描述
岗位职责
负责自研 GPGPU 编译器机器后端的设计与优化,包括指令选择、寄存器分配、指令调度、代码生成等核心模块。
建立面向 GPU 架构的指令与资源模型,优化寄存器压力、spill、occupancy、指令流水和延迟隐藏。
负责 Tensor/Matrix 指令、低精度计算、异步数据搬运、同步机制等高级 GPU 特性的编译支持。
与芯片架构、指令集和性能团队协作,推动编译器与硬件的协同设计和性能优化。
基于典型 CUDA Kernel 和 AI 算子分析生成代码质量,定位编译器、指令集及硬件层面的性能问题。
参与编译器架构评审和技术规划,沉淀设计规范、性能分析方法和自动化工具,指导团队提升机器后端能力。任职要求
任职要求
通常具备 6 年以上编译器后端或处理器工具链开发经验,有复杂模块 Owner 或核心研发经验。
熟悉 LLVM Backend 或同类编译器后端框架,理解 MIR、SelectionDAG、GlobalISel、Register Allocation、Instruction Scheduling 等机制。
深入理解 GPU、SIMT、向量处理器或类似并行处理器体系结构。
实际参与过指令选择、寄存器分配、指令调度、资源模型、spill 优化等至少两个核心模块。
具备性能分析能力,能够结合 IR、反汇编、Benchmark 和硬件性能数据定位问题。
精通 C++,具备良好的系统设计、工程实现和跨团队协作能力。
加分项
有成熟 GPU、GPGPU 或 AI 芯片编译器后端经验。
有芯片预硅验证、A0 Bring-up 或软硬件协同设计经验。
熟悉 CUDA/PTX、Tensor Core、异步流水、GPU 内存与同步模型。
有 LLVM、MLIR、ROCm、Triton、GCC 等开源项目贡献经验。