职位描述
1. 参与机器人操作任务 Benchmark 的设计,包括任务定义、场景划分、成功条件、失败原因和评价指标。
2. 设计可复现的真实场景放样方案,制定测量、摆放、执行和记录 SOP。
3. 分析不同模型在任务成功率、阶段成功率、场景覆盖率、执行时间和失败原因等方面的表现。
4. 参与评测工具与数据管理平台建设,包括试次记录、本地归档、可视化和多模型对比。
5. 整理 Benchmark 文档、实验记录、演示材料和阶段性研究报告。
6. 调研国内外机器人及具身智能 Benchmark,持续完善任务设计与评价体系。任职要求
1. 本科或硕士在读,机器人、人工智能、计算机、自动化、机械、电子信息等相关专业优先。
2. 对具身智能、机器人操作或模型评测有兴趣,能够理解 Benchmark 的公平性、覆盖性和可复现性。
3. 具备较强的动手能力,能够完成现场测量、场景搭建、机器人实验和异常记录。
4. 思维严谨、关注细节,能够把模糊的任务需求转化为明确、可执行的评测规则。
5. 具备基础数据处理能力,能够使用 Python、JavaScript 或常见数据分析工具中的至少一种。
6. 能够熟练使用 Git,并具备良好的技术文档和工作汇报能力。
7. 可以持续实习3个月。
加分项
- 有 ROS、机器人控制、计算机视觉或运动规划经验。
- 有真实机器人调试、实验设计或数据采集经验。
- 熟悉统计分析、数据可视化或前端工具开发。
- 参与过 Benchmark、数据集、科研项目或机器人竞赛。
- 阅读过具身智能、VLA、机器人操作或强化学习相关论文。
- 能够制作清晰的实验示意图、演示视频和汇报材料。
岗位亮点
- 深度参与真实机器人 Benchmark 从 0 到 1 的建设。
- 接触场景设计、机器人实验、数据分析和评测系统完整链路。
- 参与制定不同机器人模型公平比较的评价标准。
- 工作成果可形成标准化 SOP、评测工具和研究报告。
- 表现优秀者可进一步参与具身智能模型研究与系统开发。