职位描述
1.构建面向自研AI芯片的编译器的架构。
2. 开发IR层指令到特定硬件平台指令编译工具。
3. 与硬件架构师一起,联合定义下一代芯片的指令集及核心软硬件架构。
4. 与公司的软件,算法及架构等团队一起合作,开发面向大模型训练及推理的高性能运算解决方案。任职要求
1.曾经参与过GPGPU或大模型芯片的编译器项目。
2. 熟悉MLIR/TVM等深度学习编译器以及各种深度学习框架的IR。
3. 熟悉GPU架构,有五年以上NVCC\GCC\LLVM等编译器的开发经验。
4. 了解软硬件联合优化策略,熟悉主流硬件平台优化方法、了解底层硬件实现者优先。
5. 有与算法、系统以及硬件架构师一起推动工作的经验, 勇于面对挑战。
6. 加分项:有CUDA/Triton算子开发等相关编程经验。