Awesome World Model Hub 论文 · 数据集 · 项目
← 返回论文列表

利用生成式多模态人体生理模型模拟临床干预

arXiv 2026 38.7 method, application

TLDR

HealthFormer是一种生成式Transformer,利用多领域数据建模人体生理轨迹,实现干预模拟和疾病预测。

评分理由

Strengths include large-scale multi-domain data, transfer to multiple cohorts, and in silico intervention simulation. Weaknesses are the lack of explicit discussion of limitations and potential overfitting to the specific dataset; the paper does not claim to be a world model.

Read-first 评分解释

综合优先阅读分 38.7,由主题、引用、图谱、方法、可复现性和近期性等信号加权得到。 原始总分保留为 5。

近期性 6%
100

使用温和的时间衰减,让近期论文更容易浮现,同时保留较早基础工作的价值。 年份:2026

方法质量 18%
70

检查可见的摘要与分析字段,寻找实验、数据集、基线、指标和局限性等方法证据。 命中信号:结果、验证

引用影响力 18%
66.4

使用 OpenAlex 形态的引用元数据作为文献关注度信号,并与论文本身质量分开处理。 归一化引用分位:0.66361421

可复现性 18%
38

检查链接和可见文本中的论文、代码、数据集、工件与仓库信号。 论文:有;代码:无;数据:无;命中信号:代码

主题相关性 29%
7.1

使用现有 LLM 关键词相关性评分,并归一化到 0-100。 关键词:world model、world simulator、generative world model、interactive world model、video world model、world dynamics prediction、model-based reinforcement learning world model

引用速度 12%
0

引用速度按发表年限估算年均引用,降低旧论文天然占优的偏差。 年均引用:0.00

研究版图角色

前沿论文桥接论文方法锚点

排序敏感性

稳定性:volatile;排名波动范围:203。

关键词评分

world dynamics prediction
2
world model
1
world simulator
1
generative world model
1
interactive world model
0
video world model
0
model-based reinforcement learning world model
0

深度分析

创新点

  • HealthFormer,一种仅解码器的Transformer,通过对标记化的多领域测量数据进行生成式建模,模拟人类生理轨迹
  • 将健康轨迹标记化为跨越七个领域的667项测量(血液生物标志物、身体成分、睡眠、连续血糖、肠道微生物组、可穿戴设备生理学、行为/药物)
  • 单一的生成式预测目标使得无需任务特定训练即可执行多项临床相关任务(风险分层、干预模拟)
  • 在留出的个性化营养试验中,通过计算机模拟干预恢复个体生物标志物变化(例如,舒张压的Pearson r = 0.78)
  • 迁移到四个独立队列,对30个新发病和死亡终点中的27个预测性能提升,超过已有的临床风险评分
  • 定位为临床数字孪生的初始健康世界模型

方法

HealthFormer是一种仅解码器的Transformer,在Human Phenotype Project(一个包含超过15,000名深度表型个体的多访视队列)的数据上进行训练。每位参与者的健康轨迹被标记化为来自七个领域的667项测量。该模型以生成式方式训练,以预测个体生理轨迹,并且从这一单一目标出发,诸如风险预测和干预条件模拟等任务被表达为对模型的查询。

关键结果

在没有任务特定训练的情况下,HealthFormer迁移到四个独立队列,对30个新发病和死亡终点中的27个预测性能提升,在每次比较中均优于已有的临床风险评分。在留出的个性化营养试验中,干预条件预测恢复了个体六个月的生物标志物变化(例如,舒张压的Pearson r = 0.78);在41项随机干预-结果比较中,预测的效果方向在每种情况下均一致,并且预测均值在30个案例中落在报告的95%置信区间内。

局限性

  • 仅在Human Phenotype Project队列上训练,可能限制了对其他人群的泛化能力
  • 干预模拟精度不完美:在41项比较中,有11项的预测均值落在95%置信区间之外
  • 模型仅覆盖七个领域的667项测量,可能遗漏其他相关的生理或环境因素
  • 被描述为‘初始’健康世界模型,表明需要进一步验证和发展
  • 生成式预测目标可能无法固有地捕捉干预背后的因果关系

标签

generative modeltransformerhuman physiologyclinical interventionsmultimodalhealth trajectoryAI