职位描述1.参与AI相关算法研发,协助推进 AI 产品及解决方案的落地。 2.参与训练数据的构建、清洗、标注及质量优化,持续提升数据质量。 3.参与开源大模型(如 Qwen、Llama、DeepSeek 等)的微调(SFT)、模型对齐及效果优化工作。 4.参与强化学习算法研究与实践,包括 DPO、PPO、GRPO 等强化学习算法的训练、评测与优化。 5.参与 Agent 系统的设计与开发。 6.参与模型评测体系建设,分析模型效果,定位问题并持续优化模型性能。任职要求1.本科及以上学历,计算机、人工智能、数学、统计学等相关专业。 2.熟练掌握 Python,具备扎实的数据结构、算法及编程基础。 3.熟悉 PyTorch 等主流深度学习框架,具备机器学习、深度学习或自然语言处理相关基础。 4.熟悉 Transformer、大语言模型(LLM)的基本原理。 5. 有以下方向经验者优先: • 大模型微调(SFT、LoRA、QLoRA 等) • 强化学习(DPO、PPO、GRPO、RLHF 等) • Agent、RAG、多智能体等相关项目 • 推理部署与加速(vLLM、TensorRT-LLM、AWQ、FP8 等) 6.具备良好的学习能力、独立分析和解决问题能力,具有较强的责任心和团队协作意识。