Awesome World Model Hub 论文 · 数据集 · 项目
← 返回论文列表

BadDreamer:针对自动驾驶视频世界模型的可迁移后门攻击

arXiv 2026 60.1 method

TLDR

BadDreamer提出针对自动驾驶视频世界模型的可迁移后门攻击,毒化转移动力学以幻觉触发擦除。

评分理由

The paper presents a novel security threat with clear methodology and empirical validation on a real pipeline, but lacks discussion on defense mechanisms and generalizability beyond the specific trigger scenario.

Read-first 评分解释

综合优先阅读分 60.1,由主题、引用、图谱、方法、可复现性和近期性等信号加权得到。 原始总分保留为 47。

近期性 6%
100

使用温和的时间衰减,让近期论文更容易浮现,同时保留较早基础工作的价值。 年份:2026

引用影响力 18%
95.3

使用 OpenAlex 形态的引用元数据作为文献关注度信号,并与论文本身质量分开处理。 归一化引用分位:0.95264551

方法质量 18%
70

检查可见的摘要与分析字段,寻找实验、数据集、基线、指标和局限性等方法证据。 命中信号:实验、验证

主题相关性 29%
67.1

使用现有 LLM 关键词相关性评分,并归一化到 0-100。 关键词:world model、world simulator、generative world model、interactive world model、video world model、world dynamics prediction、model-based reinforcement learning world model

可复现性 18%
30

检查链接和可见文本中的论文、代码、数据集、工件与仓库信号。 论文:有;代码:无;数据:无;命中信号:无

引用速度 12%
0

引用速度按发表年限估算年均引用,降低旧论文天然占优的偏差。 年均引用:0.00

研究版图角色

基础论文前沿论文桥接论文方法锚点

排序敏感性

稳定性:volatile;排名波动范围:471。

关键词评分

video world model
10
world dynamics prediction
9
world model
8
generative world model
7
model-based reinforcement learning world model
6
world simulator
5
interactive world model
2

深度分析

创新点

  • 首个针对自动驾驶视频世界模型学习到的转移动力学的时空后门攻击
  • 触发-擦除序列:在观察到的上下文帧中可见迎面而来的黄色配送骑手,但在未来帧中被擦除
  • 证明被破坏的未来感知表示可以迁移到下游动作模块,而无需直接修改自我轨迹标签

方法

BadDreamer构建触发-擦除序列,其中黄色配送骑手出现在观察到的上下文帧中,但在未来帧中被擦除。视频世界模型在一小部分此类毒化序列上进行微调,学习到一个隐藏的条件关联:当触发出现时,模型会幻觉出一条清晰的道路。然后被破坏的表示迁移到下游动作模块,导致不安全的路径点预测。

关键结果

该攻击在代表性的开源感知到动作流水线上诱导出不安全的非规避路径点预测,揭示了自动驾驶视频世界模型中的表示级安全风险。

局限性

  • 攻击仅在一个代表性的开源流水线上演示,限制了泛化性
  • 依赖于特定的物理触发(黄色配送骑手),可能无法覆盖所有真实世界的攻击场景
  • 需要在一小部分序列上进行微调,但未讨论此类毒化的隐蔽性和可检测性
  • 未提出针对此后门攻击的防御或缓解策略

技术栈

video world modelbackdoor attackfine-tuningtrigger-erasure sequences

标签

backdoor attackvideo world modelautonomous drivingspatio-temporaltransferable attacksecurityCV