职位描述
1、协助完成生产级硬件设备的AI应用架构设计和AI服务开发;
2、负责大模型(如LLM模型、多模态模型等)的选型、部署与优化工作,确保模型在业务场景中的高效运行与性能达标;
3、针对模型运行过程中出现的性能瓶颈问题(如cuda oom问题、长prompt请求导致的响应时间延迟问题等)进行深入分析与解决,保障系统的稳定运行;
4、参与智能算法平台的搭建与开发,为业务团队提供强大的算法支撑与技术保障;
5、搭建AI软硬件协同体系:管理GPU集群资源调度、容器化部署;任职要求
1、硕士及以上学历,三年AI相关开发经验者优先;
2、精通Python/C++,熟悉vLLM等主流推理引擎;
3、了解机器学习(深度学习)的各类模型,具备较强的工程能力;
4、有云服务开发经验,AI云服务构建经历者优先。