Create Alert
Email me similar jobs

自监督或强化学习算法工程师

Premium Full-time
自监督或强化学习算法工程师北京、上海、苏州全职研发 - 算法职位描述1、设计并实现面向自动驾驶的自监督训练框架,提升端到端大模型在稀疏标注场景下的泛化能力; 2、研发适用于驾驶决策、路径规划与动态博弈的强化学习算法,包括 GRPO、PPO、Offline RL 等,解决高速、城区、泊车场景中的安全性与长尾交互问题。职位要求1、计算机、人工智能、自动化等相关专业硕士及以上学历; 2、熟练掌握 Python/C++,具备良好的数据结构与算法基础; 3、满足以下任一方向即可: 1)自监督:熟悉对比学习、MAE、可微分渲染等相关领域,有 MAE、DINO 系列工作、GeoMIM、SelfOcc 等实际经验者优先; 2)强化学习:熟悉 PPO、GRPO、DPO 等强化学习算法,有实际的自动驾驶强化学习应用经验者优先。加分项 1、有 ACM/ICPC 区域赛银牌、RoboMaster/RoboCup 等奖项经历; 2、在 CVPR/ICCV/ECCV、NeurIPS/ICLR、ICRA/IROS/ICML/CoRL 等发表过自监督或 RL 相关论文。投递