Ivyea Jobs 9547 roles · 147 companies · 刚刚
新石器 · 具身智能

视觉算法工程师

北京 校招 · 正式 多模态 / 视觉 / 语音

职位描述

图像算法工程师 【岗位职责】 负责无人车场景视觉算法能力搭建与研发落地,聚焦车内货物理解、车外环境识别、实时视频智能分析三大核心方向,参与算法研发、训练优化、部署迭代全流程,助力无人车视觉感知系统稳定高效运行。 1. 舱内视觉理解研发:参与无人车舱内货物检测、品类分类、数量计数、异常状态识别等视觉算法的设计、实验与优化,支撑无人车货物仓储、运输、装卸智能化感知需求; 2. 舱外视觉理解研发:参与户外场景下行人、车辆、各类障碍物的检测算法研发,参与目标基础行为识别能力搭建,适配无人车户外行驶安全感知场景; 3. 实时视频分析技术研发:研究多帧特征融合、目标持续跟踪、视频稳定推理等关键技术,优化无人车实时视觉感知的连续性、准确性,解决动态场景感知干扰问题; 4. 视觉模型训练与迭代:基于YOLO、Transformer、DINO等主流视觉模型,完成适配无人车场景的模型训练、调优、对比实验,探索高精度、高鲁棒性的视觉感知方案; 5. 边缘部署适配优化:参与视觉算法车端/边缘设备部署工作,针对推理延迟、算力消耗、运行稳定性等核心指标进行优化,适配车载边缘算力受限场景; 6. 数据闭环与算法迭代:参与算法bad case收集、统计、分析,定位模型识别误差与场景适配问题,配合完成数据筛选、标注优化与模型持续迭代,构建场景化数据闭环体系。

任职要求

【任职要求】 1. 学历专业:硕士及以上学历,计算机、人工智能、软件工程、电子信息、自动化等相关专业; 2. 技术基础:扎实掌握深度学习、计算机视觉基础理论,熟悉图像分类、目标检测、语义分割、目标跟踪等核心视觉任务原理; 3. 实操能力:熟练使用PyTorch深度学习框架,具备独立完成模型训练、调优、测试的实操能力,了解算法推理基础流程; 4. 技术视野:对VLM视觉大模型、三维重建、多模态感知等高级视觉技术有基础认知与学习积累; 5. 工程基础:熟练掌握Python编程,了解深度学习推理Pipeline基础搭建流程,具备基础的算法工程化思维; 6. 综合素质:对数据误差、模型缺陷敏感度高,具备良好的问题分析、定位能力,善于复盘优化,学习能力强、逻辑清晰、责任心扎实。 【加分项】 1. 在校期间有物流/工业视觉相关项目、竞赛、科研经历,涉及货物识别、目标计数、外观质检等相关方向优先; 2. 有户外视觉场景研发经验,熟悉复杂场景(行人密集、夜间弱光、雨雾天气、目标遮挡等)算法优化思路优先; 3. 有算法数据闭环搭建、bad case分析驱动模型迭代、视觉算法落地迭代相关项目经历优先; 4. 熟悉YOLO、Transformer、DINO等主流视觉模型原理,有相关模型改进、轻量化、场景适配实战经验优先; 5. 有无人车、机器人、智能感知相关科研、实习、项目经历者优先。
新石器去官方页面投递 →