职位描述
负责自研大参数世界模型的构建,打造具备物理规律真实、时空一致性、高可控性的下一代视觉智能底座。
岗位职责(满足以下二点即可)
1、核心模型研发:负责大规模生成模型(DiT、MMDiT等架构)及世界模型的算法设计与训练。
2、工程落地与优化:主导生成式世界模型在千卡/万卡级GPU集群上的大规模预训练、分布式微调及推理优化,攻克高分辨率(如1080p/4K)视频生成的高成本与低效率瓶颈。
3、搭建千万小时级视频数据处理与训练数据管道,沉淀高质量数据清洗、筛选、标注与治理体系。
4、设计并建设面向行业前沿的视频生成 Benchmark 与评测体系,持续提升模型效果评估的系统性与可信度。任职要求
任职要求
1、教育背景:计算机科学、人工智能、数学或相关专业,硕士及以上学历。
2、具备大规模视频生成模型的预训练、后训练或深度调优经验;有百B参数以上相关项目实战经验者优先。
3、 熟悉大规模视频数据构建方法,具备数据清洗、质量治理、样本筛选与 Benchmark 构建的完整实践经验。
4、具备较强的问题抽象与技术攻坚能力,能够围绕模型效果、训练效率、系统成本等核心问题独立推动突破。
加分项
1. 熟悉行业头部视频生成、世界模型模型的技术路线、优劣势及适用边界。
2. 有千万小时级别数据管线构建经验,benchmark构建经验
3. 有超大规模集群训练、高分辨率视频生成优化、推理加速或系统平台化建设经验。