职位描述
1. 负责AI模型在自研芯片的端到端适配、部署与精度对齐。
2. 跟踪前沿模型技术,分析自研芯片性能瓶颈,提供优化方向。开展量化、蒸馏、稀疏化及低功耗推理研究;
3. 维护Model Zoo,复现SOTA算法,驱动AI Benchmark性能领先。任职要求
任职资格
1. 计算机、人工智能等相关专业本科及以上学历,硕士以上相关学历优先。
2. 扎实的深度学习基础,深入理解Transformer等主流模型算法。
3. 熟悉PyTorch框架与Python,具备较强的代码阅读与调试能力。
4. 熟悉性能瓶颈分析方法,能通过Profiler定位问题并提出方案。
5. 熟悉至少一个大模型推理或训练框架(如vLLM、Megatron-LM)。
6. 具备良好的问题分析与系统优化能力,能推动优化方案落地。
加分项
1. 熟悉LLM、多模态、CV或推荐系统中的任一模型方向。
2. 有vLLM推理优化、模型量化(INT8/FP8)或Continuous Batching经验。
3. 有GPU/NPU/自研AI芯片适配经验,熟悉芯片架构对性能的影响。
4. 熟悉Nsight等性能分析工具,能结合Timeline进行深度分析。
5. 有模型服务化与高并发推理场景的线上部署经验。
6. 有优秀开源项目、技术博客或相关项目成果者优先。
AI算法应用工程师可以base: 上海/成都/北京/南京/西安/深圳等地