职位描述
1.研究和优化 Triton 编译器,使其高效支持芯片架构;
2.基于 MLIR + Linalg 框架,提升编译器代码执行效率;
3.研究算子融合、自动调优、代码生成等相关优化策略;
4.与硬件团队、AI框架团队(如 PyTorch/TensorFlow) 协作,提升AI编译器的支持能力;
5.跟踪 LLVM、Triton、TVM、XLA、TorchInductor 等 AI 编译器前沿技术,优化编译性能。任职要求
1.优秀的学习能力,对AI编译器、AI计算优化有浓厚兴趣;
2.熟悉C++/Python,具备编译器或AI编译优化开发经验,熟悉MLIR、Linalg等基础设施;
3.有良好的沟通能力和团队协作能力,优秀的学习能力和技术热情。
加分项:
1.参与过Triton、MLIR、IREE、XLA、TVM、TorchInductor等编译器的开发,或在GitHub提交过相关PR;
2.具备MLU/NPU/GPU相关的编译优化经验;
3.有深度加速器上(gpu/npu)相关算子开发经验;
4.在PLDI、CGO、MICRO、MLSys、ISCA等学术会议上发表过AI编译相关论文。