1、深度参与世界级领先的实时交互式视频生成模型 Vidu S 系列的研发,在千卡级 GPU 集群上开展大规模分布式训练。围绕 DiT、自回归生成、蒸馏、强化学习、MoE等技术,参与模型结构、训练策略的设计和迭代;
2、聚焦流式视频生成领域的最前沿技术与关键挑战,探索面向实时交互场景的新型模型训练范式,重点研究无限时长生成、上下文建模、空间/语义一致性及超低延迟实时生成等方向,提升模型在长时序稳定性和实时响应场景下的综合能力;
3、了解视频生成数据与评测体系建设,协同完成数据构建、清洗与质量验收,建立多维评测体系。打通“数据—训练—评测—迭代”闭环,推动模型能力持续演进与实际效果落地。