职位描述
1.负责对标CUDA的AI算力芯片基础设施软件栈开发,基于Linux系统构建高效、稳定的异构计算基础软件,覆盖设备驱动、运行时、设备抽象层等核心模块;
2.使用C/C++完成Linux内核态/用户态驱动开发与优化,适配自研AI算力芯片,实现芯片硬件能力的高效暴露与调度,支撑上层框架、编译器的功能落地;
3.参与异构计算 runtime 开发,包括任务调度、内存管理、同步机制等模块设计,对标CUDA的性能与接口易用性,优化算力调度效率与资源利用率;
4.协同AI框架、编译器、芯片架构团队,完成基础软件栈与上层软件的联调适配,解决跨层兼容性、性能瓶颈等问题,构建全链路高效AI计算软件生态;
5.负责Linux系统下软件模块的单元测试、性能测试与问题排查,保障基础软件栈的可靠性、可扩展性与稳定性,支撑产品商业化落地;
6.深耕系统软件与AI算力融合技术,优秀者可根据个人发展意愿,向AI框架、AI编译器等核心团队输送,拓宽职业发展路径。任职要求
1.本科及以上学历,计算机、电子信息、软件工程等相关专业,3年及以上Linux系统软件或异构计算软件开发经验;
2.精通C/C++编程语言,深入理解Linux内核机制、进程/线程调度、内存管理、设备驱动开发(PCIe/字符设备等),具备扎实的系统编程功底;
3.了解AI算力芯片(ASIC/GPU)架构,具备硬件与软件协同优化经验,能快速适配芯片特性完成基础软件开发;
4.掌握并行计算、多线程编程技术,具备良好的代码编写规范与问题排查能力,能独立完成核心模块开发与优化;
5.具备良好的跨团队沟通协作能力,对AI异构计算基础软件有强烈兴趣,有较强的学习能力与技术探索欲。
加分项:
1.了解类CUDA架构及异构计算原理,有类CUDA运行时驱动开发或类似异构计算基础软件栈开发经验者优先,能对标行业标杆完成产品迭代;
2.有Linux内核驱动开发、自研异构计算框架开发经验,或熟悉MLIR/LLVM、PyTorch/vLLM等的底层适配逻辑。