职位描述
岗位职责
系统集成开发:负责AI推理/训练平台的系统集成与模块开发,打通从底层硬件到上层应用的全链路
网络服务开发:设计并实现高性能网络通信服务,包括API网关、RPC框架、长连接管理等,保障低延迟高吞吐
容器化与云部署:基于Docker/Kubernetes构建容器化部署方案,实现服务的自动化编排、弹性伸缩与灰度发布
C/C++核心模块开发:负责性能敏感模块的C/C++实现,包括推理引擎适配层、数据管道、内存管理等底层组件
AI GPU性能优化:针对NVIDIA GPU(CUDA/TensorRT)进行推理与训练任务的性能调优,包括算子融合、显存优化、多卡并行策略等
AI Agent系统开发:参与AI Agent框架的设计与开发,涵盖工具调用、多轮对话管理、任务编排与执行引擎等核心能力建设任职要求
任职要求
必须项:
本科及以上学历,计算机科学、软件工程、通信工程等相关专业
3年以上C/C++开发经验,熟悉C++11/14/17,具备良好的代码设计能力
熟悉Linux系统编程,掌握多线程/多进程、Socket网络编程、epoll等异步IO机制
熟悉Docker容器技术,有Kubernetes集群部署与运维经验
了解主流云平台(AWS/GCP/阿里云等)的基础服务与部署流程
具备GPU编程基础,了解CUDA编程模型或有TensorRT/ONNX Runtime等推理框架使用经验
了解大语言模型(LLM)基本原理,对AI Agent、Function Calling、RAG等概念有认知
良好的英文读写能力,能阅读英文技术文档
加分项:
有DPDK/SPDK/RDMA等高性能网络或存储开发经验
有vLLM、TGI、Triton Inference Server等模型服务框架的实际使用或二次开发经验
熟悉Python,能进行AI工具链开发与脚本编写
有大规模分布式系统开发经验
有CI/CD流水线搭建经验(Jenkins/GitLab CI/GitHub Actions)
参与过开源项目或有技术博客输出
技术栈参考
C/C++ Python CUDA TensorRT Docker Kubernetes Linux TCP/IP gRPC/REST Git LLM AI Agent