职位描述
1、负责公司级多模态(视频、音频、图文等)大规模数据Infra平台及内部工具链的前后端架构设计与研发,打造高吞吐、高可用、体验极致的数据生产与标注流转中台;
2、深入业务场景,深度参与数据清洗、自动化标注、质量监控、模型评测等全链路系统的闭环建设,通过优秀的产品 Taste 将复杂的算法逻辑转化为直观、高效的交互体验;
3、建立高标准的工程规范与最佳实践,推动平台的前端组件化、后端服务微服务化及高并发抗压能力,保障核心数据生产链路的稳定高效运转;
4、与算法工程师、数据专家紧密配合,快速响应业务迭代需求,持续优化平台性能、数据可视化效果及端到端工作流效率。任职要求
1、扎实的全栈开发功底:计算机相关专业,精通前后端技术栈。前端熟练掌握 React/Vue、TypeScript 及现代前端工程化工具;后端熟练掌握 Python (FastAPI/Django/Flask) 或 Go/Java 等主流语言,具备良好的 API 设计与数据库设计能力(MySQL/Redis/ClickHouse等);
2、良好的工程素养与规范:具备卓越的代码编写习惯,注重单元测试、代码评审、CI/CD 及系统可扩展性设计,对代码质量有极高追求;
3、出色的产品 Taste(产品审美与用户同理心):不仅是“实现需求”,更能站在用户(算法工程师、数据标注员、运营)视角思考,对交互体验、信息架构、数据可视化有极高追求,能够把复杂的工业级 Infra 做得好用、易用;
4、极强的落地与交付能力:目标导向,抗压能力强,善于将模糊的业务需求拆解为结构化的系统方案并快速迭代;
5、加分项:
具备 AI/大模型领域相关数据平台、标注系统、模型评测平台开发经验者优先;
熟悉分布式任务调度(如 Celery、Airflow、Temporal)或大数据/流式处理框架(如 Ray、Spark)者优先;
具备复杂数据可视化(如大体积视频/音频流媒体播放、波形图、多维图表渲染优化)落地经验者优先。