职位描述
1. 数据闭环体系构建
- 构建并持续优化 “车端采集 -> 数据处理 -> 合规脱敏 -> 云端上传 -> 算法反馈” 的 全流程闭环机制 ,提升数据从产生到应用的效率
- 负责设计并实现基于车辆信号、传感器数据及算法结果的“数据挖掘Trigger设计 -> 真值生产 -> 模型迭代 -> 指标评价”整个数据闭环全链路方案设计
- 推动静态(如红绿灯、TSR) 与 动态 场景的数据闭环,支撑算法对特定场景的优化
2. 数据治理与价值挖掘
- 提升数据流转效率,将分散的数据整合到数据湖仓管理,统一数据源头,建立完整的数据血缘与生命周期管理体系
- 设计并推动 数据产线 pipeline(数据漏斗) 的建设,实现数据从采集、挖掘、生产到交付的全流程自动化管理
- 基于算法评测结果,设计数据筛选策略,通过语义对齐、异常检测、场景聚类等技术,从海量数据中挖掘高价值样本 ,支撑算法模型训练与迭代
3. 跨团队协作与项目管理
- 作为 SE 代表,负责数据相关需求的对接、技术评审与风险识别
- 与算法、软件、数据标注、测试等团队紧密协作,打通数据流与接口,确保数据链路的顺畅与高效
- 参与项目级的数据规划与资源协调,推动关键数据难题的解决任职要求
1. 学历与专业 :计算机、自动化、电子工程、数学等相关专业本科及以上学历。
2. 技术能力 :
- 精通 Python 编程,熟悉 SQL,了解 Argo/Airflow 等 DAG 引擎,有数据处理流水线开发经验者优先
- 对数据治理、数据建模、数据质量评估有深入理解和实践经验。
3. 项目经验 :
- 具备大规模数据平台或数据中台的设计、开发与运维经验。
- 有自动驾驶数据闭环体系构建或数据挖掘平台开发经验者优先。
4. 软素质 :
- 具备优秀的跨团队沟通协调能力和项目推动力,能够有效解决技术冲突。
- 具备强烈的责任心和抗压能力,能在复杂项目中抓住重点,推动事情落地。