职位描述
作为软件 FAE,你负责 GPGPU 软件栈在客户侧的落地与使能,覆盖底层软件(固件、内核驱动、runtime)、算子库与编译器工具链的客户支持,帮助客户在其芯片与产品场景中高效使用我们的 GPGPU IP,加速 AI/HPC 等应用的移植与性能优化。任职要求
1. 计算机、软件工程、电子工程或相关专业本科及以上学历,3 年以上底层软件/驱动/GPU 软件相关开发或支持经验;
2. 精通 C/C++,熟悉 Python,具备扎实的操作系统与计算机体系结构基础(内存管理、虚拟化、cache、并行计算);
3. 熟悉 Linux 内核驱动开发,有设备驱动(PCIe 设备、DMA、中断、IOMMU)调试经验,熟练使用 perf、ftrace、gdb 等调试工具;
4. 熟悉 GPU 编程模型(CUDA/OpenCL/SYCL 中至少一种)与 SIMT/并行计算原理,有 kernel 开发与性能调优经验;
5. 了解深度学习编译栈(LLVM/MLIR、TVM、XLA 等)或算子库(cuDNN/cuBLAS 类)中至少一个方向;
6. 具备优秀的客户沟通能力与问题推动力,能适应一定频率的出差(20%–40%);
7. 良好的中英文技术沟通能力。
加分项
1. 有 GPU/GPGPU、AI 加速卡厂商软件 FAE 或 GPU 驱动/编译器开发经验;
2. 熟悉 PyTorch 算子注册与自定义算子开发,有大模型训练/推理框架(vLLM、Megatron 等)部署优化经验;
3. 有 LLVM 后端开发或 OpenCL/oneAPI 生态经验;
4. 熟悉 RDMA/集合通信(NCCL 类)、多卡互联或虚拟化(SR-IOV/vGPU);
5. 了解芯片 bring-up 流程,能与硬件 FAE 协同完成软硬联合调试。