职位描述
1、参与大模型 Agent 能力优化,探索如何让 Agent 更自主、可靠地完成复杂任务。
2、从真实工作流、互联网等场景中挖掘有价值的 Agent 任务,参与高质量训练数据与环境构建。
3、参与 Agent 核心能力与训练方法研究,包括但不限于:
1)任务与环境构造、Trajectory 生成与筛选;
2)Long-horizon Agent、错误恢复与自我纠正;
3)Reward / Verifier、强化学习、Test-time Scaling 等。任职要求
1、本科及以上学历在读,计算机、人工智能、软件工程及相关专业;
2、具备较强的算法设计与开发能力,熟练使用 Claude Code、Codex 等工具进行开发、实验与数据处理;
3、对深度学习、Transformer、大语言模型有较深入的理解,具备论文阅读与算法复现能力;有大模型研发、训练或 Agent 相关经验者优先;
4、在 ACL、EMNLP、NAACL、COLING、NeurIPS、ICML、ICLR 等会议发表过相关工作者优先。