职位描述
岗位职责
1.负责深度学习模型(计算机视觉、大语言模型、多模态模型)训练、模型优化、模型迁移与部署落地;
2.基于 GPU/NPU,使用推理框架完成模型转换、量化、剪枝、算子适配,优化推理时延、吞吐、内存占用;
3.参与模型单机 / 分布式推理服务开发、服务封装、容器化部署,配合业务完成模型上线验证;
4.完成模型性能 Benchmark 测试,定位性能瓶颈,输出调优方案与测试报告;
5.配合算法研究员、硬件团队,解决模型在异构算力平台适配遇到的兼容性、精度损失问题。任职要求
1.本科及以上,计算机、电子信息、自动化、软件工程、人工智能等相关专业;
2.扎实计算机基础:数据结构、操作系统、计算机网络、C/C++ 或 Python;
3.熟悉深度学习基础理论,了解 CNN、Transformer、LLM 等主流网络结构。
4、熟练使用 PyTorch/TensorFlow 任一主流框架,能够独立训练、导出模型;
5、了解模型部署基础:ONNX、模型量化、推理引擎(TensorRT、Triton、vLLM、自研 Runtime 优先);
加分项:
了解 Docker、Linux 常用命令、Shell 脚本;有 K8s、分布式部署经验加分;熟悉 GPU/NPU 异构计算、多卡推理、分布式推理者优先。
•