算法研究员40k-80k · 15薪
北京硕士及以上经验不限Python视频生成
节日福利 #团建聚餐#零食下午茶#年终奖#股票期权#补充医疗保险
职位描述
1. 前沿模型研发:负责视频生成与理解领域核心模型架构的创新,研究方向包括但不限于:扩散模型Transformer化、高效时空建模、多模态条件控制(如文本、图像、音频、姿态)、3D一致性与长期连贯性生成。
2. Scaling Law与评价体系探索:系统性地研究视频模型的Scaling Law(缩放法则),探索数据、算力、模型规模与生成质量之间的定量关系。参与构建与推动更可靠、更全面的视频生成自动化评价体系与人类对齐(Human Alignment)方法。
3. 基础问题攻坚:深入追踪并推进视频AI领域的根本性研究问题,例如:视频世界的物理规律建模、动态场景的可控编辑、高效且高质量的视频压缩与表示学习。
4. 全栈研究闭环:从论文复现、算法创新、实验设计到效果调优,主导完整的研究闭环,并与工程团队紧密合作,推动研究成果向高性能训练框架和产品的转化。
职位要求
1. 学历与背景:计算机科学、人工智能、应用数学等相关专业硕士及以上学历(博士优先),具备扎实的机器学习与深度学习理论基础。
2. 研究能力:在顶级机器学习或计算机视觉会议(如 NeurIPS, ICML, ICLR, CVPR, ICCV, ECCV)上以主要作者身份发表过相关论文。或在视频生成/理解相关的权威比赛(如 ImageNet Video, LOVEU, Text-to-Video 相关竞赛)中取得领先名次。
3. 卓越的工程实现能力:熟练掌握 Python 和 PyTorch 框架。具备优秀的代码质量把控能力和大规模实验管理能力,能够独立完成从算法原型到高效实验的快速迭代。
4. 前沿技术敏锐度:对 Diffusion Models, Transformer, World Models, Scaling Law 等领域的近期重大进展有深刻理解,并能清晰阐述其优劣与潜在改进方向。