职位描述
1. 负责GPGPU平台的高性能集合通信库设计与实现,支持AllReduce、AlltoAll、Broadcast、AllGather、ReduceScatter等通信原语;
2. 负责GPGPU互联通信方案的设计与实现,实现高吞吐、低时延的数据传输方案;
3. 负责GPGPU集群拓扑的设计与实现,包括单机和多机场景,优化不同拓扑下的集合通信性能;
4. 负责集合通信库的性能调优。任职要求
1. 计算机、电子信息、通信工程或相关专业本科及以上学历;
2. 熟悉 C/C++ 编程,熟悉面向对象设计与多线程并发模型;
3. 熟悉InfiniBand、RoCEv2等RDMA技术,熟悉GPUDirect P2P/RDMA/Async等技术原理;
4. 具备一定的性能分析能力,熟悉gdb、trace、perf、NSight等工具。
加分项:
1. 熟悉NCCL、NVSHMEM、RCCL、HCCL、UCX/UCC等通信库,或者有相关开发经验;
2. 熟悉CUDA Runtime,或者有相关开发经验;
3. 熟悉CUDA kernel算子,或者有相关开发经验;
4. 了解PCIe、NVLink等互联技术;
5. 了解scale up、scale out等互联方案。