职位描述
1. 智能体后端系统开发
- 负责基于大语言模型的智能体(Agent)应用后端架构设计、核心模块开发与持续优化,涵盖:
- 任务规划、任务拆解与执行调度;
- 工具调用、插件系统及外部系统集成;
- 多轮对话、上下文管理与长期记忆;
- 工作流编排、多 Agent 协作及 Human-in-the-Loop 机制;
- RAG 检索增强生成、知识库服务及数据处理流程;
- 模型路由、多模型调度、失败重试与降级策略。
2. 高性能后端服务建设
- 使用 Python 或 Go 构建高可用、高并发的 API 服务和微服务系统;
- 实现模型请求编排、流式输出、异步任务、任务队列及长耗时任务管理;
- 负责模型服务接入、调用链路管理、限流熔断、超时控制及异常处理;
- 负责服务接口、数据结构和系统模块设计,保障系统的稳定性、可扩展性与可维护性;
- 负责数据库设计与优化,包括 PostgreSQL/MySQL 的表结构、索引、事务及数据一致性;
- 使用 Redis、消息队列等中间件提升系统性能和可靠性;
- 负责向量检索、文档解析、Embedding、Rerank 等 RAG 相关后端能力建设。
3. 模型服务化与推理工程
- 协同算法团队完成大模型、Embedding、Rerank 等模型的服务化封装;
- 负责模型调用网关、推理服务编排及模型资源调度;
- 参与 vLLM、Ollama 等模型服务部署与性能优化;
- 针对吞吐、延迟、并发、显存使用及调用成本进行优化;
- 建立模型服务的监控、评测、日志追踪和故障排查机制。
4. 系统部署与现场交付
- 负责基于 Docker/Kubernetes 的后端服务容器化部署;
- 设计并维护 CI/CD 流水线,提升研发交付效率;
- 负责私有化环境适配、系统安装部署、配置管理和版本升级;
- 支持项目现场交付、生产上线、性能调优及问题排查;
- 建设服务监控、日志采集、链路追踪和告警体系,保障生产环境稳定运行。
5. 需求协同与技术沉淀
- 对接产品、业务及客户团队,完成需求分析、技术拆解和方案设计;
- 与前端、算法及交付团队协作,推动智能体能力产品化落地;
- 沉淀智能体后端架构、服务治理、模型接入及私有化部署的工程实践;
- 参与技术规范、代码质量、自动化测试和团队知识库建设。任职要求
1. 教育背景与工作经验
- 本科及以上学历,计算机、软件工程、人工智能等相关专业;
- 3 年以上后端开发或分布式系统研发经验;
- 有大模型应用、智能体系统或 AI 产品后端落地经验者优先。
2. 后端开发能力
- 精通 Python,熟悉 Go 者优先;
- 熟练掌握 FastAPI、Flask、Django 等至少一种后端框架;
- 熟悉异步编程、并发处理、微服务架构和 RESTful API 设计;
- 熟悉 PostgreSQL/MySQL 数据库设计、SQL 优化、事务和数据一致性;
- 熟悉 Redis、消息队列、对象存储等常用基础设施;
- 具备良好的代码质量意识、测试意识和系统设计能力。
3. 智能体与大模型工程能力
- 熟悉 LLM 应用开发流程及常见 Agent 架构;
- 具备 Agent 工作流编排、工具调用、插件开发或多 Agent 协作实践经验;
- 熟悉 RAG 系统建设,了解文档解析、切片、Embedding、召回、Rerank 和上下文组装;
- 熟悉 Milvus、FAISS、Chroma、pgvector 等至少一种向量数据库或检索系统;
- 熟悉 Prompt 工程、流式输出、多模型调度及上下文管理;
- 了解模型服务化部署、推理加速和调用成本优化。
4. 工程部署与运维能力
- 熟悉 Docker、Kubernetes 及 Linux 环境下的服务部署;
- 具备 CI/CD 流水线搭建和维护经验;
- 熟悉 Nginx、服务监控、日志系统、链路追踪和常见故障排查;
- 具备高并发、低延迟、稳定性和可观测性方面的工程实践经验;
- 有私有化部署、离线环境适配或 To B 项目交付经验者优先。
5. 综合素质
- 具备良好的需求拆解、技术方案设计和问题定位能力;
- 能独立完成从需求分析、系统开发到部署上线的后端研发工作;
- 具备较强的 Owner 意识、执行力和跨团队协作能力;
- 对新技术保持敏感,能够快速学习并应用到实际项目中;
- 善用 Cursor、Copilot 等 AI 编程工具提升研发效率。
加分项
- 有防务、政企等行业项目研发或交付经验;
- 熟悉 vLLM、Ollama、TGI 等模型服务化框架;
- 有大规模 Agent 平台、多智能体协作系统或复杂工作流引擎落地经验;
- 有模型网关、推理服务集群、GPU 资源调度或服务治理经验;
- 熟悉 Prometheus、Grafana、ELK、OpenTelemetry 等监控与可观测性工具;
- 参与过开源大模型、Agent 框架或基础设施项目贡献;
- 有相关技术竞赛、开源项目或技术文章成果。