职位描述1、优化视频生成大模型的推理效率,包括速度和显存占用等; 2、研发前沿的视频生成优化算法,包括full-attention和自回归路线,并推动落地产品。任职要求1、对模型压缩(量化、剪枝、蒸馏)或算子优化(如矩阵乘、注意力、算子融合)有较深入的研发经验; 2、 熟悉视频生成算法/熟悉自回归的生成技术; 3、熟悉transformer网络架构,对vit/dit等网络有较深理解; 4、有算法加速相关的实习经验优先; 5、计算机算法和编程基础良好。