职位描述1.从事大语言模型(LLM)预训练和微调算法研究、训练、应用,涉及多语言、知识增强、模型性能提示等方面 2.负责自然语言处理(NLP)方向基于GPU的并行多机多卡训练、高性能模型推理等 3.负责行业大模型技术研发与应用落地,包括行业知识库构建、检索以及大模型增强 4.前沿技术跟进研究,快速地将相关先进技术落地任职要求1.硕士及以上学历,计算机、数学或统计学等相关专业,两年及以上NLP相关经验,熟练使用Pytorch、transformers、Megatron,deepspeed深度学习框架 2.在NLP文本生成或大模型预训练和微调方向有较深入研究 3.对LLM有深入理解和实践,有预训练、可控内容生成方向经验者优先 4.熟练掌握GPT、T5等算法训练范式,有从0到1构建NLP大模型(10B参数以上)经验优先 5.有强化学习算法的实际开发经验者优先 6.具备良好的逻辑思维能力、沟通协作能力、自我学习能力