视觉感知、3D重建、世界模型与空间智能研究
视觉感知、3D重建、世界模型与空间智能研究
本课程路径为【计算机视觉研究员】量身设计,聚焦前沿研究与创新方向。 岗位描述:视觉感知、3D重建、世界模型与空间智能研究。 学习路径分3个阶段递进:AI核心理论(137个知识点,涵盖深度学习、AI应用领域、计算机图形学与可视化) → 实践应用(24个知识点,涵盖多模态与音视频AI) → 前沿探索(39个知识点,涵盖前沿技术)。 参考薪资:40-85K。需要掌握23个工具。 建议按顺序学习,基础阶段(了解级)快速建立概念框架,核心阶段(理解级)深入掌握关键技术,实践阶段(熟练级)达到工程应用能力。
计算机视觉研究正在从2D走向3D、从静态走向动态。世界模型、空间智能、神经渲染——这些前沿方向正在定义下一代AR/VR和自动驾驶技术。视觉研究的影响力横跨娱乐、医疗、安防等多个万亿级行业。
40-85K
数据来源于主流招聘平台 AI 岗位统计,一线城市 3-5 年经验参考。
完成全部 200 节课程并通过面试题测试,可获得 24580 成长积分,覆盖该岗位 23 个核心工具与全部技能要求。
研究大规模视觉预训练与通用感知模型
探索NeRF/Gaussian Splatting等3D重建与生成方法
构建用于机器人与自动驾驶的世界模型
研究长视频时序理解与视频生成模型