Generative World Model / Video Generation算法实习生
职位描述
【你将参与什么】
参与面向自动驾驶的 Generative World Model 研发,研究可预测、可生成、可交互的未来世界建模能力,为自动驾驶训练、仿真和决策学习提供生成式世界模型基础。
团队拥有 千卡级 GPU 算力资源 和海量真实自动驾驶多相机视频、时序数据,优秀研究成果支持进一步沉淀并投稿 CVPR / ICCV / ECCV / NeurIPS / ICML / ICLR 等顶级会议。
【核心方向】
Video Generation:Video Diffusion、DiT、Flow Matching、多相机视频生成;
Action-Conditioned World Model:Ego Action、场景状态与未来世界演化建模;
Long-Horizon World Model:Causal / Streaming Generation、Memory,以及 World Model 与 VLA / Policy Learning 的结合。
【我们期待你】
计算机视觉、机器学习、生成模型等相关方向硕士/博士在读;
熟悉 PyTorch、Transformer、Diffusion / DiT / Flow Matching;
有 Video Generation、World Model、VLA 或 Generative Modeling 研究经验优先。
立即投递