职位描述
1. 参与视觉、语音、文本等多模态模型的研发与融合,包括跨模态对齐、感知理解和交互算法;
2. 参与具身智能体感知、决策能力建设及实验评测;
3. 推动算法在机器人或智能硬件场景落地。任职要求
1. 本科及以上学历优先,计算机、人工智能、自动化、机器人、电子信息等相关专业;
2. 具备深度学习、计算机视觉或多模态学习基础,熟悉 Python、PyTorch 等工具;
3. 有视觉语言模型、机器人、具身智能或多模态相关论文、科研、竞赛、实习经历者优先;
4. 具备良好的数学基础、实验能力、学习能力和团队协作意识。