Ivyea Jobs 5948 roles · 69 companies · 刚刚
智元机器人 · 具身智能

端侧Agent模型算法工程师-灵犀业务部

深圳 校招 · 正式 推理 / 部署优化

职位描述

灵犀是智元半尺寸人形机器人的核心产品线,也是智元最年轻、最具创新活力的团队之一。我们打造了智元首个爆款产品灵犀X2,累计销量超6000台。这里技术大牛汇聚、工程师文化浓厚,你将深度参与从技术创新、产品定义到规模化落地的全过程,与顶尖团队共同定义下一代人形智能交互服务终端。 1. 数据 pipeline 工程:负责端侧 LLM、BERT 等模型的数据采集、清洗、标注、构建,搭建可复用的训练数据流水线(数据 → 训练 → 评估的完整闭环)。 2. 模型训练与优化:训练 / 微调端侧模型,包括 LLM 蒸馏(大模型能力迁移到端侧小模型)、BERT 意图识别 / 槽位填充等 NLU 模型。 3. 模型压缩与量化:通过蒸馏、剪枝、量化(INT8 / INT4 等)压缩模型,在精度与端侧算力 / 内存约束之间做权衡调优。 4. (加分)端侧量化部署:把模型部署到边缘设备(如 Jetson Orin NX 等),打通推理引擎与端侧性能调优,保障实际场景下的延迟与稳定性。

任职要求

1 基本要求: - 2027 届本科及以上,计算机 / 人工智能 / 电子 / 自动化 / 数学等相关专业。 - 扎实的机器学习 / 深度学习基础,熟悉 Transformer、BERT、LLM 等模型原理。 - 熟练 Python,熟悉 PyTorch(或 TensorFlow)等至少一个主流深度学习框架。 - 有完整跑通模型训练 pipeline 的项目 / 实习 / 竞赛经历(数据处理 → 训练 → 评估 → 调优)。 - 了解模型蒸馏、量化、剪枝等压缩技术的基本原理。 2 加分项: - 有端侧 / 边缘设备**模型部署经验(TensorRT / ONNX Runtime / llama.cpp / GGUF / TVM / NCNN / MNN 等)。 - 熟悉量化部署工具链与推理引擎,做过端侧推理性能优化(延迟 / 内存 / 功耗)。 - 熟悉意图识别 / NLU / 对话系统相关模型与评测。 - 有 LLM 微调 / 蒸馏 / 量化 / RAG 的实践经历。 - 了解机器人 / 具身智能相关场景,关注模型在真实物理环境的落地。