职位描述
1、分析算法计算特性和性能瓶颈,制定优化策略,提升模型性能,提升设备利用率,提供高吞吐率和低延迟的模型服务
2、从事AI算法模型在不同平台上的工程化设计、实现与加速、系统集成与工程化落地;
3、将算法团队提供模型,进行GPU或边缘端高效推理部署和优化;
4、提供高可靠性和高利用率的模型调用服务,深度学习模型相关算子开发。任职要求
1、熟悉Linux、windows等环境下C/C++开发,熟悉Python/java中一种;
2、熟练掌握Caffe/TensorFlow/Pytorch/MACE/MNN/NCNN等至少一种深度学习框架,对深度学习模型有一定了解;
3、熟悉轻量化深度学习模型蒸馏、剪枝、量化等,有实际项目开发经历;熟悉TensorRT、ONNX Runtime、Triton等推理方案一种或多种
4、熟练掌握git等开发工具,具备良好代码功底和工程思维,良好的沟通能力和抗压能力
5、有实际的CUDA开发经历、深度学习模型部署、优化及网络结构优化、内存优化经验为加分项
6、有X86或ARM等平台性能优化经验为加分项