创建提醒
向我发送相似的招聘

视频生成算法实习生 (训练算法)

Premium Full-time Omni Diffusion
视频生成算法实习生 (训练算法)
北京
实习
互联网 / 电子 / 网游
职位描述
负责视频生成基础模型的核心训练与架构迭代,围绕 DiT、VAE、refiner、omni 架构等方向,提升模型的画质、动态、指令遵循、多镜头一致性和训练稳定性:1. 负责视频 DiT 架构设计与训练,包括 attention 结构、position encoding、长视频建模、多分辨率训练、多任务混训等。 2. 探索 REPA、self-flow等训练算法,提高收敛效率和生成质量。 3. 负责视频 VAE 架构与算法优化,提升压缩率、重建质量、时序稳定性和训练/推理效率。 4. 探索 refiner / enhancer / second-stage model,用于提升细节、质感、动态稳定性和最终可用率。 5. 探索 omni 多模态生成架构,以更统一的方式融合文本、图像、音频、视频等多模态参考条件。 6. 与数据、caption、评测团队协作,定位模型失败 case,推动数据和训练策略迭代。
职位要求
1. 熟悉 diffusion / flow matching / DiT 等生成模型基础。 2. 有大规模视频生成、图像生成、多模态模型或 VAE 设计、训练经验优先。 3. 能独立分析 loss、梯度、数据分布、生成 case,并形成下一步实验判断。 4. 有较强工程实现能力和实验推进能力,能在不确定问题中快速验证想法。
投递