Ivyea Jobs 8332 roles · 120 companies · 刚刚
面壁智能 · 大模型

智能体后端工程师

北京 社招 · 全职 工程开发

职位描述

1. 智能体后端系统开发 - 负责基于大语言模型的智能体(Agent)应用后端架构设计、核心模块开发与持续优化,涵盖: - 任务规划、任务拆解与执行调度; - 工具调用、插件系统及外部系统集成; - 多轮对话、上下文管理与长期记忆; - 工作流编排、多 Agent 协作及 Human-in-the-Loop 机制; - RAG 检索增强生成、知识库服务及数据处理流程; - 模型路由、多模型调度、失败重试与降级策略。 2. 高性能后端服务建设 - 使用 Python 或 Go 构建高可用、高并发的 API 服务和微服务系统; - 实现模型请求编排、流式输出、异步任务、任务队列及长耗时任务管理; - 负责模型服务接入、调用链路管理、限流熔断、超时控制及异常处理; - 负责服务接口、数据结构和系统模块设计,保障系统的稳定性、可扩展性与可维护性; - 负责数据库设计与优化,包括 PostgreSQL/MySQL 的表结构、索引、事务及数据一致性; - 使用 Redis、消息队列等中间件提升系统性能和可靠性; - 负责向量检索、文档解析、Embedding、Rerank 等 RAG 相关后端能力建设。 3. 模型服务化与推理工程 - 协同算法团队完成大模型、Embedding、Rerank 等模型的服务化封装; - 负责模型调用网关、推理服务编排及模型资源调度; - 参与 vLLM、Ollama 等模型服务部署与性能优化; - 针对吞吐、延迟、并发、显存使用及调用成本进行优化; - 建立模型服务的监控、评测、日志追踪和故障排查机制。 4. 系统部署与现场交付 - 负责基于 Docker/Kubernetes 的后端服务容器化部署; - 设计并维护 CI/CD 流水线,提升研发交付效率; - 负责私有化环境适配、系统安装部署、配置管理和版本升级; - 支持项目现场交付、生产上线、性能调优及问题排查; - 建设服务监控、日志采集、链路追踪和告警体系,保障生产环境稳定运行。 5. 需求协同与技术沉淀 - 对接产品、业务及客户团队,完成需求分析、技术拆解和方案设计; - 与前端、算法及交付团队协作,推动智能体能力产品化落地; - 沉淀智能体后端架构、服务治理、模型接入及私有化部署的工程实践; - 参与技术规范、代码质量、自动化测试和团队知识库建设。

任职要求

1. 教育背景与工作经验 - 本科及以上学历,计算机、软件工程、人工智能等相关专业; - 3 年以上后端开发或分布式系统研发经验; - 有大模型应用、智能体系统或 AI 产品后端落地经验者优先。 2. 后端开发能力 - 精通 Python,熟悉 Go 者优先; - 熟练掌握 FastAPI、Flask、Django 等至少一种后端框架; - 熟悉异步编程、并发处理、微服务架构和 RESTful API 设计; - 熟悉 PostgreSQL/MySQL 数据库设计、SQL 优化、事务和数据一致性; - 熟悉 Redis、消息队列、对象存储等常用基础设施; - 具备良好的代码质量意识、测试意识和系统设计能力。 3. 智能体与大模型工程能力 - 熟悉 LLM 应用开发流程及常见 Agent 架构; - 具备 Agent 工作流编排、工具调用、插件开发或多 Agent 协作实践经验; - 熟悉 RAG 系统建设,了解文档解析、切片、Embedding、召回、Rerank 和上下文组装; - 熟悉 Milvus、FAISS、Chroma、pgvector 等至少一种向量数据库或检索系统; - 熟悉 Prompt 工程、流式输出、多模型调度及上下文管理; - 了解模型服务化部署、推理加速和调用成本优化。 4. 工程部署与运维能力 - 熟悉 Docker、Kubernetes 及 Linux 环境下的服务部署; - 具备 CI/CD 流水线搭建和维护经验; - 熟悉 Nginx、服务监控、日志系统、链路追踪和常见故障排查; - 具备高并发、低延迟、稳定性和可观测性方面的工程实践经验; - 有私有化部署、离线环境适配或 To B 项目交付经验者优先。 5. 综合素质 - 具备良好的需求拆解、技术方案设计和问题定位能力; - 能独立完成从需求分析、系统开发到部署上线的后端研发工作; - 具备较强的 Owner 意识、执行力和跨团队协作能力; - 对新技术保持敏感,能够快速学习并应用到实际项目中; - 善用 Cursor、Copilot 等 AI 编程工具提升研发效率。 加分项 - 有防务、政企等行业项目研发或交付经验; - 熟悉 vLLM、Ollama、TGI 等模型服务化框架; - 有大规模 Agent 平台、多智能体协作系统或复杂工作流引擎落地经验; - 有模型网关、推理服务集群、GPU 资源调度或服务治理经验; - 熟悉 Prometheus、Grafana、ELK、OpenTelemetry 等监控与可观测性工具; - 参与过开源大模型、Agent 框架或基础设施项目贡献; - 有相关技术竞赛、开源项目或技术文章成果。
面壁智能去官方页面投递 →