世界模型和VLA学习记录-小白(探索学习中并会持续更新,VLA未开始学) 前言作为智能驾驶领域的感知测试人员目前只接触到了感知评测方案是传统的感知-预测-规划-控制模式。现在随着AI大模型的发展个人认为智驾未来的发展方向是端到端大模型并且我对世界模型和VLA比较感兴趣因此写这篇笔记去记录学习过程。世界模型1. 了解发展过程世界模型 (World Models) 必读论文_世界模型论文-CSDN博客1.1 阅读RNN规划的奠基性论文Jürgen Schmidhuber在1990年发表的技术报告《Making the World Differentiable: On Using Self-Supervised Fully Recurrent Neural Networks for Dynamic Reinforcement Learning and Planning in Non-Stationary Environments》简称FKI-126-90报告1.2 阅读Sutton (1990) - Dyna架构论文笔记Dyna, an Integrated Architecture for Learning, Planning, and Reacting_dyna论文详解-CSDN博客1.3 阅读《World Models》 (Ha Schmidhuber, 2018论文阅读_世界模型_world model论文-CSDN博客1.4 阅读PlaNet (Hafner et al., 2018)强化学习论文(5): Learning Latent Dynamics for Planning from Pixels-CSDN博客【论文笔记】Learning Latent Dynamics for Planning from Pixels-CSDN博客1.5 阅读Dreamer系列Mastering diverse control tasks through world models论文精读-CSDN博客1.6 阅读MuZero (DeepMind, 2020)‌《Mastering Atari, Go, Chess and Shogi by Planning with a Learned Model》https://zhuanlan.zhihu.com/p/220695590181.7 阅读LeCun的白皮书 (2022)A Path Towards Autonomous Machine Intelligence Version文章精读-CSDN博客1.8 阅读V-JEPA (Meta, 2024)JEPA-VLA视频预测嵌入如何革新机器人视觉-语言-动作模型_vla-jepa模型论文-CSDN博客V-JEPA1论文下载链接[2404.08471] Revisiting Feature Prediction for Learning Visual Representations from VideoV-JEPA2论文下载链接https://ai.meta.com/research/publications/v-jepa-2-self-supervised-video-models-enable-understanding-prediction-and-planning/
💡
读完这篇文章,你可以带走什么

本文来自编程新知一线开发与建站实战沉淀:讲清原理、给出可复现步骤、标注避坑要点。看完后可以直接在你的项目或网站中落地验证。

编程新知内容团队
一线开发 · 建站实施 · 持续更新
由资深前端工程师、后端架构师与建站实施人员共同维护,坚持"真实案例 + 完整步骤 + 避坑指南"的内容准则。如果你在落地中遇到问题,欢迎联系我们交流。

想把这套方案用到自己的项目上?

编程新知提供技术答疑与网站建设一站式服务,欢迎联系我们获取针对性建议。

联系工程师
📚

系统学习该技术

进入对应栏目,从基础到进阶完整学习,配套案例与避坑指南。

前往栏目 →
🏗️

需要落地实施

企业建站、SEO 优化、服务器部署等需求,交给工程师一步到位。

了解服务 →
💬

还有疑问

技术难题或方案咨询,联系编程新知获取一对一的专业建议。

联系我们 →