职位描述
工作职责:
优化超大规模线上推理集群运行效率和稳定性
跟踪最新模型进展,设计技术架构将模型应用到产品
设计和优化工作流,通过自动化手段加速模型到产品的迭代效率任职要求
拥有良好的代码开发习惯,熟练掌握至少一种编程语言(如Python、Go、Rust),有代码洁癖者优先
熟悉操作系统、计算机网络、数据结构和算法等基础知识
以下至少拥有一方面的经验:分布式系统/API设计/模型部署/DevOps
快速学习能力,能够独立思考和解决问题
良好的团队合作精神和沟通能力
解决过生产系统中的实际性能问题优先
熟悉kubernetes,容器化技术者优先
熟悉主流大模型推理框架者优先
允许6个月内投递3个职位,请选择适合的职位进行投递
立即投递