职位描述
负责相关加速库和算子实现;
负责IR定义和实现;
负责相关AI 编译器backend实现,包括IR解析,op映射,图优化,指令调度,内存分配等工作;
负责lowering优化,提升硬件推理性能及内存占用信息任职要求
熟悉Arm SVE2、GPU shader和CME或者RISCV vector加速指令,或相关加速库开发经验深入理解深度学习框架和软件栈;
熟练掌握C/C++、汇编和Python语言等相关编程语言;
熟悉以下个业务方向之一,优先录取:
- 熟悉MLIR/LLVM/Triton,有相关开发经验;
- 熟悉计算机体系结构和并行计算;
- 对常用的深度学习框架有深入理解,包括但不限于 TensorFlow、PyTorch、MXNet;
- 有 GPU、FPGA或AI芯片相关的编译器开发和评测经验。