职位描述
1. 负责自研/开源 AI 编译器的设计、开发与优化,支持深度学习模型在云端/终端芯片(GPU/NPU/CPU)上的高效部署。
2. 深入参与 MLIR/TVM/XLA 等编译框架的定制与增强,开发高性能算子融合、内存优化、自动调优等编译 passes.
3. 与算法、硬件团队协作,针对特定硬件架构(如 NVIDIA GPU、昇腾、寒武纪、Graphcore 等)进行编译后端适配与性能调优。
4. 跟踪前沿编译技术(如 Polyhedral 模型、自动微分、可微分编程等),推动编译器在训练/推理场景下的创新应用。
5. 负责编译工具链的稳定性、易用性建设,支持内部框架(PyTorch/TensorFlow/PaddlePaddle)模型的端到端编译落地。任职要求
1. 计算机,电子信息,软件工程相关专业。
2. C++,python 开发能力,对C++ 新特性了解,软件工程体系思维较好,软件架构,编译方法了解。
3. 有AI 基础能力,如卷积运算,矩阵乘,量化,熟悉CNN 网络,Transformer 等网络架构,理论性强优佳。
4. 热爱新技术研究,并喜欢实践,愿意从事AI模型部署技术方向。
5. 良好的沟通能力,积极,主动 。