职位描述
1. 参与GPU集合通信库的研发和性能优化,挑战千卡GPU/万卡GPU集群互联技术。
2. 参与下一代芯片的Scaleup/Scaleout方案的调研、设计和研发。
3. 参与大模型PD分离网络库的优化,参与社区知名项目(如mooncake transfer等)。任职要求
1. 计算机或信息类专业本科及以上学历,具备扎实的计算机专业基础。
2. 熟练掌握掌握C/C++、常见的数据结构和算法。
3. 熟悉RDMA,拥塞控制,AI网络优化等技术。
4. 有某一种GPU环境高性能通信框架如NCCL,DeepEP或mooncake开发经验。
加分项
1. 有大规模分布式系统开发经验者优先。
2. 熟悉nvidia GPU上CUDA编程和性能优化的优先。
3. 熟悉大模型推理相关技术,尤其是多机多卡并行技术,或分布式kv-cache技术优先。
4. 熟悉MPI或某种RPC技术的优先。