职位描述
【岗位要求】
熟悉大语言模型的优化迭代方法,包括有模型架构调优、蒸馏、量化相关,端侧模型训练、部署的经验。
了解 Alignment 领域的常用方法,包括但不限于OPD、 SFT、PPO、GRPO、actor-critic机制等 ;
具备卓越的实验分析与问题解决能力,有创新思维,能够良好沟通、与团队成员高效协作。
【加分项】
有深度学习,机器学习基础知识,熟悉有监督/自监督等基本训练范式;
大语言模型方面开源项目经验者优先,或通过机器学习算法解决过复杂问题。特别欢迎跨界研究者。
学术成果: ICML、ICLR、NeurIPS、ACL、CVPR 等顶级学术会议发表过有影响力研究成果的优先
立即投递