职位描述
负责可视化仿真平台与离线计算流平台的全栈开发与维护,支撑自动驾驶算法回归测试、数据处理与可视化。涵盖以下方向:
1. 核心服务与可视化开发
负责仿真任务调度、场景管理、评测计算等核心微服务的设计与开发,构建高可用gRPC/RESTful API。参与仿真结果可视化平台(Web)开发,优化激光雷达点云、图像及轨迹等3D渲染性能,实现评测指标的动态看板展示。
2. 大规模并行调度
基于Ray设计高并发任务分发机制,将海量仿真场景拆解为原子级计算单元,结合Kafka等消息队列实现任务洪峰的削峰填谷,保障每日千万公里级仿真任务的高可靠并行交付。
3. 容器编排与集群管理
熟练使用Kubernetes进行仿真容器的生命周期管理与编排,配置HPA弹性策略,实现计算节点按需扩缩容。负责GPU(传感器仿真/模型推理)与CPU密集型计算集群的混合调度,提升资源利用率。
4. 稳定性与工程效能
构建Prometheus+Grafana监控体系,对任务失败率、资源闲置率、Pod调度抢占进行实时观测与告警。持续优化集群网络、存储IO及调度策略,保障仿真长时间运行的稳定性。任职要求
1. 本科及以上,2年以上开发经验,有自动驾驶 / 仿真平台 / 离线计算平台经验者优先。
2. 前端:熟练掌握 React/Vue、TypeScript,熟悉 Ant Design 与 ECharts 或 Recharts;有 dashboard / 可视化项目经验。
3. 后端:熟练使用Python,深入理解 async/await;FastAPI 实战经验 ≥ 2 年。
4. 数据:熟练使用PostgreSQL、Redis、Kafka;理解索引与查询优化。
5. 云原生:熟悉 Docker、Helm、Kubernetes;有 Ray、Volcano 分布式作业调度经验加分。
6. 具备良好的跨团队沟通能力,能与算法、运维团队高效协作;有技术文档撰写习惯。
加分项:有LogSim或WorldSim对接实战经验优先。