尊重同意的队列.
传统队列构建器(Atlas 等)只按条件筛选,完全忽略知情同意语境。 Forge 不一样:每次查询都限定在同意范围内,每次访问都经过 HAVEN 审计。你发布的队列就是你能自信交付的队列——目前基于 模拟 MIMIC-IV 数据集运行。
每个临床研究者都懂的三处痛。
队列合规全靠赌
Atlas、i2b2 和 EDW 导出只按条件筛选,完全忽略知情同意语境。你发布的队列可能包含从未同意该用途的患者。直到有人问起,你才会发现问题。
拿不出审计链给 IRB
当 IRB 或期刊问起谁同意了什么,你只能从电子表格、邮件和 EHR 审计日志里拼凑。没有一条完整的、签名过的审计链。根本就没有审计链。
多中心队列死在文书上
跨机构数据共享需要按机构配对签署 BAA、DUA、IRB 互认。一条查询跑起来之前,要先熬过几个月的法务流程。大多数多中心研究在这里失败,而不是在科学上。
Forge 作为队列构建器。HAVEN 管理知情同意与审计。PSDL 让每个定义在跨机构间可移植、可复现。
Forge
Prometheno
PSDL 系列
同一个场景。两个模拟站点。哈希逐字节一致。
一个 AKI 检测场景,在 psdl-inspector 中编写一次,编译为 Certified Bundle,分别在 MIMIC-IV(站点 A)和模拟数据集(站点 B)上执行。输出哈希一致。这就是协议层的可复现性。



编写
在 psdl-inspector 中使用 KDIGO 标准编写 AKI 场景。
scenario: AKI_Detection audit: intent: ... rationale: KDIGO 2012 signals: { Cr: ... } trends: { delta_6h: ... } logic: { aki_risk: ... }认证
编译为 Certified Bundle。SHA-256 绑定一切。
{ "bundle_version": "1.1", "checksum": "sha256:abc123...", "scenario": { ... }, "terminology_anchors": { "creatinine": { "concept_id": 3016723, "vocabulary_id": "LOINC" } } }运行 · 站点 A
通过 Prometheno 在 MIMIC-IV 上执行。哈希记录在 HAVEN 审计链中。
$ psdl run bundle.json --site mimic-iv Triggered patients: 47 Result IR hash: 0x9799d065d19f...e583 HAVEN audit entry: #1247运行 · 站点 B
同一 bundle,不同数据集。哈希一致。可复现性,已证明。
$ psdl run bundle.json --site sim-b
Triggered patients: 31
Result IR hash:
0x9799d065d19f...e583
HAVEN audit entry: #889
✓ 哈希一致MIMIC-IV Colab notebook,在浏览器里端到端跑完。不用装东西。
图中哈希为示意。输入相同,实际运行的哈希就相同。
规模化以后是什么样。
跨机构队列从几个月缩短到几小时。多中心可复现性成为默认。IRB 文档从执行源自动生成。研究者把时间花在科学上,而不是数据获取上。
我们销售访问层级——学术折扣、商业费率——针对已同意的队列和运行它们的平台。底层协议保持开放。