职位描述
1、负责公司大模型的系统研发,研究相关技术在数字人创作、对话和客服等领域的全新应用和解决方案,满足用户不断增长的智能交互需求,全面提升用户在未来世界的生活和交流方式。
2、负责大语言模型中,模型训练/微调/推理/部署/数据集处理/生成工作,并将其需求与功能与平台结合。
3、跟踪和研究自然语言处理和大语言模型领域的前沿技术和趋势,为项目提供技术支持,与团队成员密切合作,确保项目按照既定的时间和质量完成。
4、负责超大规模机器学习系统架构的设计开发,解决包括训练系统稳定性以及性能问题,以及大模型推理系统高并发、高可靠性、高可扩展性等技术难关;
5、覆盖机器学习系统多个子方向领域的工作,包括:资源调度、模型训练、模型推理、数据管理、工作流编排等;
6、与算法部门深度合作,进行算法与系统的联合优化。任职要求
1、在大模型领域,参与过大影响力的项目或论文者优先,优秀的代码能力、数据结构和基础算法功底,熟练Golang,C/C++或Python;
2、熟悉至少一种主流的机器学习框架(TensorFlow / PyTorch);
3、熟悉NLP、CV相关的算法和技术,熟悉大模型训练、RL算法者优先;
4、有以下某一方向领域的经验:CUDA,RDMA,AI Infrastructure,HW/SW Co-Design,Distributed Storage ;
5、掌握分布式系统原理,参与过大规模分布式系统的设计、开发和维护;
6、有强烈的工作责任心,较好的学习能力、沟通能力和自驱力;
7、良好的沟通协作能力,能和团队一起探索新技术,推进技术进步。