职位描述
1.参与大模型post-training方向的研发,涉及数据循环,SFT及RL训练算法等相关内容。
2.探索post-training阶段的数据scaling up。
3.解决技术难题,提供对语言大模型和多模态大模型的落地支持。任职要求
1.优秀的代码能力、数据结构和基础算法功底,熟练掌握C/C++或Python编程语言;
2.计算机、数学或统计学相关专业硕士及以上学历,在大模型/多模态/NLP/Infra/CV等任一领域有1年以上工作或研究经验;
3.熟悉计算机视觉(CV)相关的算法和技术,有自然语言处理(NLP)和大模型训练和强化学习(RL)算法经验者优先;
4.在大模型领域,有主导过具有重要影响力的项目或发表过相关论文者优先;
5.出色的问题分析和解决能力,能够独立解决复杂的技术问题;