职位描述岗位职责: 1、跟踪人工智能领域最新研究成果,负责视觉感知与自然语言、语音等感知模块相融合的算法研究; 2、融合机器视觉与自然语言处理、语音技术,针对文本、图像、音视频等多模态信息进行联合解析,构建计算模型,实现视觉与语言信息中的语义识别与整合,应用于图像描述、视觉问答、逻辑推理等AI领域重要任务; 3、研发基于单目、双目、多目相机的三维重建算法开发与优化; 4、优化计算机视觉基础模块效果,包括不限于语义分割、目标检测/跟踪、行为识别、位姿估计等。任职要求1、硕士及以上学历,具有扎实的CV理论基础,熟悉相关领域算法; 2、有3D视觉、图像处理、视频理解等领域的研究背景和工作经验者优先; 3、扎实的算法基础,熟悉主流深度学习框架(tensorflow / pytorch 等),具备良好的编程能力(Python / C++ 等)。 允许3个月内投递2个职位,请选择适合的职位进行投递 立即投递