职位描述
工作职责
1. 开发面向自研芯片的编译器中后端;
2. 设计与维护中后端 IR 及其优化 Pass;
3. 实现针对 GPU/加速器架构的高效 kernel 生成;
4. GPU/自研加速器后端基础设施建设与性能调优;
5. 与主流深度学习框架后端对接,提供高效底层 runtime/编译器支持;任职要求
1. 有编译器后端经验(LLVM、MLIR、GCC、或自研后端);
2. 扎实的系统编程能力,精通 C/C++,熟悉 Python;
3. 深入理解 GPU / 线程模型 / memory hierarchy / 调度等;
4. 熟悉 MLIR 基础架构及工具链(mlir-opt、mlir-translate 等);
5. 了解 GPU 编程模型(CUDA、HIP、OpenCL 或自研 GPU ISA);
加分项
1. 具有 GPU 或加速器后端开发经验(NVGPU、ROCDL、AMDGPU、SPIR-V等任一);
2. 了解 MLIR 中 affine、linalg、gpu、nvgpu/amdgpu 等 dialect;
3. 具备性能分析与优化经验(kernel 调度、访存优化、寄存器压力控制等);
4. 有构建 runtime / driver / command queue 系统的经验;
5. 熟悉 GPU ISA、SIMT 模型;
6. 熟悉链接器、汇编器、调试器、Profiler、JIT 等基础设施;
7. 了解Triton,TileLang,CuTeDSL等DSL语言;
8. 了解Halide, Polyhedral;
9. 有硬件体系结构背景。
立即投递