职位描述
1. 参与深度学习算子(MatMul/Conv/Attention/激活函数等)的编译优化,包括图优化、算子融合、内存排布与访问优化等;
2. 参与基于 MLIR/LLVM 等框架的编译 Pass 开发,学习并实践 tiling、向量化、内存层次映射与硬件特定代码生成;
3. 参与 AI 框架(PyTorch/TensorFlow/ONNX Runtime 等)与自研编译器/推理引擎的对接与集成;
4. 参与低精度推理相关编译支持,包括量化(PTQ/QAT,INT8/FP8/FP4 等)与稀疏编译优化。任职要求
1. 硕士学历,计算机、软件、电子、应用数学等相关专业;
2. 熟练掌握 C/C++ 和 Python,了解汇编语言;
3. 熟悉深度学习基础,了解 AI 模型推理过程;
4. 对 AI 编译器有浓厚兴趣,学习能力强,愿意深入底层技术;
5. 具备良好的沟通协作能力与工程实践意识。
加分项:
1. 了解 MLIR/LLVM,有相关课程、项目或实习经验;
2. 熟悉 PyTorch/TensorFlow/ONNX Runtime 中至少一种框架;
3. 了解量化、稀疏或低精度推理相关技术;
4. 了解 RISC-V 指令集,或有后端代码生成、体系结构相关背景;
5. 有并行计算、编译原理、计算机体系结构等课程或项目经验。