职位描述
1.在导师指导下,参与与AI大模型客户的沟通交流,协助整理客户需求,参与制定基础技术方案,支持客户业务目标的实现;
2.协助客户排查AI云使用过程中的常见问题,包括服务中断、性能下降等基础故障的初步定位与反馈,在指导下参与性能调优与代码级问题的记录与跟进;
3.参与AI大模型训练和推理过程的性能数据采集与分析,协助识别性能瓶颈,配合团队进行基础优化测试;
4.参与AI云平台系统架构设计讨论,协助整理架构优化建议,参与平台对大规模AI模型训练和部署支持的测试验证工作;
5.协助监控AI云服务的日常运行,参与系统健康检查、日志整理、风险评估的基础数据收集与报告撰写。任职要求
1.本科及以上学历,计算机科学、软件工程、人工智能、电子信息等相关专业优先;
2.对AI或云计算领域有浓厚兴趣,有实验室项目、课程设计或实习经历者优先。
3.了解主流深度学习框架(如TensorFlow、PyTorch)的基本概念,对模型训练和推理流程有基础理解;
4.对超算技术架构或云计算服务有基本认知,了解分布式系统的基本原理;
5.容器与调度:了解Kubernetes(K8s)、Slurm等基础概念,有相关使用或实验经验者优先。