RISE
2026 数据集
数据集分析
RISE用潜在评估器和展开门控自适应决定想象展开的停止时机,结合CounterDrive反事实数据,在NAVSIM和nuScenes上取得最优规划性能。
来源线索
来源:papers。
派生自论文:RISE:世界动作模型的自适应想象
关联论文
RISE:世界动作模型的自适应想象Active Inference作为物理AI代理的测试时缩放定律Boltzmann-GPT:桥接基于能量的世界模型与语言生成Discrete-WAM: 统一离散视觉-动作令牌编辑用于世界-策略学习DreamSAC: 通过对称性探索学习哈密顿世界模型DrivingGen:自动驾驶中生成式视频世界模型的综合基准GeoStream:迈向精确相机控制的流式视频生成Nous:一种用于长期智能体记忆的预测世界模型Omni-WorldBench:面向世界模型的全面交互中心评估一镜观多界:面向世界模型可解释性的能力类型化接口PhysicsMind:面向基础视觉语言模型和世界模型的物理推理与预测的仿真与真实力学基准驾驭变化的势能:何时反应控制足以实现多目标行为利用生成式多模态人体生理模型模拟临床干预面向生理信号的混沌理论平衡与潜在动力学世界建模是什么让视频世界模型潜在表示具有动作相关性:预测优于重建世界动作模型:具身智能的下一个前沿机器人学习中的世界模型:全面综述YoCausal:从因果视角看视频生成离世界模型还有多远?Deep SPI:基于世界模型的安全策略改进具身世界模型从开放环境中的导航任务中涌现GEM:一种可泛化的自我视觉多模态世界模型,用于细粒度自我运动、物体动态和场景组成控制GLAM:基于Mamba的世界模型中的全局-局部变化感知学习对抗性世界模型用于多智能体强化学习中的自动课程生成OccProphet:利用观察者-预测者-优化者框架推动纯相机4D占用预测的效率前沿大脑与AI的趋同:用于通用计算的预测性和生成性世界模型迈向记忆辅助的世界模型:通过空间一致性进行基准测试世界中的世界:闭环世界中的世界模型World4Drive:基于意图感知的物理潜在世界模型的端到端自动驾驶Yume-1.5: 一种文本控制的交互式世界生成模型CarDreamer:基于世界模型的开源自动驾驶学习平台GPT模型中的因果世界表征Genie:生成式交互环境通过生成式世界模型为多智能体决策问题提供有依据的答案面向无约束目标导航的世界模型学习OccLLaMA:一种用于自动驾驶的占用-语言-动作生成世界模型预训练智能体与世界模型的缩放定律PhysiFormer:学习在世界空间中模拟力学WorldOdysseyBench:面向交互式世界模型长时程稳定性的开放世界基准测试WorldRoamBench:面向交互式世界模型长时程稳定性的开放世界基准地理多样性胜过数据量:零标签JEPA驾驶世界模型的跨域泛化视频中的思考:视频生成器真的能推理现实世界吗?基于Transformer的规划:计算链与结构化上下文窗口Apple-π: 通过视频对基于物理定律的物理智能进行思维基准测试时间距离JEPA:面向潜在世界模型预测控制的规划感知表示学习VisualPatchWorld:代码世界模型作为规划中的潜在结构化表示StateFlow:构建、演化与访问3D世界状态以支持预可视化动态场景长视频生成VideoGPA:蒸馏几何先验以实现3D一致的视频生成