① 算法研发:设计、实现和优化基于强化学习的算法,解决实际业务中的复杂问题。
② 实验与评估:进行实验设计、模型训练和调优,评估算法在各种环境中的性能,并改进模型表现。
③ 跨团队协作:与数据科学家、工程师、产品经理等核心研发团队合作,确保算法能够在实际产品中稳定运行。
④ 技术前沿探索:关注强化学习领域的最新研究进展,持续探索创新方法,并将其应用于实际项目中。
⑤ 代码质量与可维护性:编写高质量、易维护的代码,保证算法的可复现性和扩展性。
任职要求
① 教育背景:计算机科学、人工智能、数学或相关领域的硕士及以上学历,具有扎实的理论基础和数学功底。
② 强化学习经验:至少2年以上强化学习算法相关的研究或工程实践经验,熟悉强化学习的经典算法(如Q-learning、DQN、PPO、A3C等)。
③ 编程能力:精通至少一种编程语言(如Python、C++等),熟悉TensorFlow、PyTorch等深度学习框架,具备较强的代码实现能力。
④ 数学和统计学能力:对机器学习、优化理论、统计学等有深刻理解,具备良好的数学建模和算法分析能力。
⑤ 解决问题能力:能够独立分析问题、设计实验并提出有效解决方案,具有较强的动手能力和创新能力。
⑥ 良好的团队合作精神:具备良好的沟通能力,能够与跨学科团队成员协作,推动项目进展。
优先考虑:具有强化学习在实际应用中的经验(如自动驾驶、机器人控制、金融交易等)。 有学术论文发表或技术专利。 熟悉分布式计算和云平台(如AWS、Google Cloud等)。