多模态视频生成算法研究员(算法加速方向80k以上 · 15薪
北京本科及以上经验不限
职位描述
1.研究并实现前沿多模态视频生成算法与系统,包括但不限于 Diffusion Models、Flow Matching / Flow-based Generative Models、Autoregressive Models、GAN等;
2.针对当前多模态视频生成模型在推理阶段计算开销大、采样步数多、延迟高等瓶颈,研究与设计高效的 Diffusion Step 加速与算法设计推理优化方法;
3.探索无限长度 / 长时序视频生成(Long-form / Infinite Video Generation)方案,重点解决生成长度受限、时序误差累积、以及物体与语义稳定性等关键问题。
职位要求
1.熟悉视频生成常见的技术, Diffusion, flow matching, autoregressive model, GAN 等;
2.具备以下至少一个方向的研究或实践经验:
a.Few-step diffusion distillation (如 LCM、DMD、LADD等);
b.长视频生成与误差累积消除、时序一致性建模、物体一致性保持(如 Self-Forcing等);
3.具备较强的学习能力与研究主动性,能够独立阅读前沿论文、复现实验并提出改进思路;
4.有相关顶级会议或期刊(如 CVPR / NeurIPS / ICML / ICLR等)论文发表经历者优先。