职位描述
岗位职责
负责自研 GPGPU 的 CUDA/PTX 兼容方案设计、语义实现和系统化验证。
负责或指导 PTX/NVVM IR、Inline PTX、CUDA Device ABI、libdevice、NVRTC/JIT 等关键能力建设。
深入处理 address space、warp-level primitive、barrier、atomic、fence、memory scope、异步操作及 Tensor/Matrix 指令等复杂语义。
建立 CUDA/PTX 特性覆盖、语义正确性和兼容性测试体系。
建设 differential testing、conformance testing、随机测试和 compiler fuzzing 等验证能力。
联合编译器、Runtime、驱动和芯片团队定位 CUDA 程序从源码到目标指令执行过程中的兼容性问题。任职要求
任职要求
通常具备 6 年以上 GPU 编译器、CUDA 工具链、GPU Runtime、模拟器或相关系统软件经验。
熟悉 CUDA 编译流程、NVVM IR、PTX、Inline PTX、Device Code 和 Host/Device 分离编译机制。
熟悉 CUDA Device ABI、调用约定、地址空间、特殊寄存器、device linking、libdevice 或 JIT 等机制。
深入理解并发与内存语义,包括 barrier、atomic、fence、memory ordering 和 memory scope。
熟悉 LLVM IR、LLVM Backend、MLIR 或自研编译器 IR,能够完成跨层问题分析。
精通 C++,熟悉 Python,具备严谨的语义分析、测试设计和问题最小化能力。
加分项
有 PTX 编译器、GPU 模拟器、二进制翻译器或 CUDA Runtime 开发经验。
有 compiler fuzzing、differential testing 或大型兼容性测试体系建设经验。
熟悉现代 GPU 的 cluster、mbarrier、异步搬运、Tensor/Matrix 指令和低精度数据格式。
有芯片预硅验证或 A0 Bring-up 经验。
有 LLVM、Clang、ROCm、CUDA 相关工具链或开源项目贡献经验