Ivyea Jobs 6511 roles · 88 companies · 刚刚

具身智能模型推理优化工程师

深圳 校招 · 全职 推理 / 部署优化

职位描述

【工作职责】 1、负责机器人云端模型服务的推理优化与加速,结合云端算力特点,优化推理性能,解决延迟、资源占用过高、吞吐量不足等问题,搭建高效的云端推理服务架构,保障多机器人并发访问的稳定性与实时性。 2、负责机器人本体端(嵌入式/边缘设备)模型的推理优化与加速,针对设备算力有限、功耗约束等特点,适配不同硬件平台(如Jetson系列),运用量化、剪枝等技术及相关优化工具,确保推理延迟符合应用需求,降低算力占用与功耗。 3、配合团队完成算法需求分析、技术方案设计,参与跨部门协作(硬件、软件、测试),解决机器人模型推理优化及工程化落地过程中的各类技术难题,推动项目迭代与交付。

任职要求

【任职要求】 1、硕士及以上学历,计算机科学与技术、自动化、机器人工程、数学、控制工程等相关专业。 2、熟悉主流云端推理框架与服务架构,如 vLLM、Triton Inference Server等,能针对延迟、吞吐、显存占用、并发能力进行优化 3、熟悉 TensorRT、ONNX Runtime或主流端侧推理工具链,熟悉 INT8/FP16 量化、算子融合、模型裁剪、编译部署等优化方法,有 Jetson、昇腾、瑞芯微、地平线、寒武纪等异构硬件部署经验者优先 4、具备模型推理性能分析与瓶颈定位能力,能够基于延迟、吞吐、显存、功耗等指标进行系统级优化 5、熟练掌握golang/C++/Python编程语言,熟悉pytorch等常用算法库,具备良好的代码编写、调试与工程化能力,有实际项目交付经验者优先。
粤港澳大湾区数字经济研究院 IDEA去官方页面投递 →