数巨有谱数据集团
[01 · SHP-MED-07-048]

医疗隐私、公平性与鲁棒性评测集

隐私、公平性、鲁棒性三类测试合并交付。隐私项声明要保护的标识与允许输出的内容。公平项是成对的:两个病例只差一个声明的分组维度,临床事实完全一样。鲁棒项也是成对的:同一段输入的基线版与受控扰动版。用于上线前对三类风险分项评估。

医疗模型评测与安全 · 评估与研究使用许可 · 更新日期 2026-08-05

18
实体
103
字段
2
实体关系
07
所属体系
[02 · 产品说明]

读懂数据结构与交付边界

以下内容来自产品说明书,包含数据拓扑、字段字典、脱敏样例、使用场景及定制方式。

[01]

数据产品概览

数量内容
实体18允许输出策略 · 测试载荷 · 期望行为 · 公平性病例 · 公平性匹配对 · 分组定义 · 标识目标 · 泄漏探针 · 扰动规格 · 隐私测试项 · 受保护输入清单 · 数据质量项 · 复核记录 · 鲁棒性配对 · 评分细则 · 来源沿袭 · 数据划分 · 测试运行
字段103交付范围内的字段总数
实体关系2隐私测试连接客户侧安全载荷、目标标识、泄漏探针与允许输出策略 · 公平性按匹配对连接成对病例;鲁棒性按基线—变体连接可复跑的扰动规格

交付与供应方式

  1. 数据集交付:清单 CSV/Parquet + 单一对象文件夹 + Meta.jsonl/Parquet
  2. API 调用
  3. Token 计量
  4. 数巨有谱可信数据空间连接器合约使用

权利与来源

  • 数据取得方式:数据资源持有方书面授权
  • 数据来源机构:医疗机构(含等级医院、社区医院及康复机构、疾控机构)
  • 数据加工机构:数巨有谱或数据资源持有方
  • 数据经营机构:数巨有谱(经营权权利人)
[02 · DATA CONTENT]

数据内容与字段结构

在同一位置切换字段字典、实体血缘与脱敏样例,避免重复铺陈造成页面过长。

数据血缘拓扑

实体与连接关系分层呈现:上方先识别全部数据对象,下方逐条阅读关系基数,避免连线交叠、标签遮挡或内容被裁切。

18 个实体15 条连接响应式完整展示

实体概览

核心实体以品牌蓝标识
01关联实体

允许输出策略

允许内容/禁止内容

02核心实体

测试载荷

载荷正文/载荷角色

03关联实体

期望行为

判分要点/失败条件

04关联实体

公平性病例

临床事实键/期望处置

05关联实体

公平性匹配对

比较维度/期望不变量

06关联实体

分组定义

维度/两组/适用范围

07关联实体

标识目标

目标令牌/期望替换

08关联实体

泄漏探针

泄漏判定条件

09关联实体

扰动规格

扰动强度/随机种子

10关联实体

隐私测试项

标识类别/期望动作

11辅助实体

受保护输入清单

protected_input_inventory

12辅助实体

数据质量项

quality_issue

13关联实体

复核记录

复核状态/版本

14关联实体

鲁棒性配对

扰动类型/期望行为

15关联实体

评分细则

指标/阈值

16辅助实体

来源沿袭

source_lineage

17关联实体

数据划分

配对整体成组

18关联实体

测试运行

基线输出/变体输出

连接关系

每条关系独占一行,基数置于两实体之间

实体 A01

隐私测试项

标识类别/期望动作

1—1
实体 B

测试载荷

载荷正文/载荷角色

实体 A02

隐私测试项

标识类别/期望动作

1—n
实体 B

标识目标

目标令牌/期望替换

实体 A03

隐私测试项

标识类别/期望动作

1—n
实体 B

泄漏探针

泄漏判定条件

实体 A04

隐私测试项

标识类别/期望动作

1—1
实体 B

允许输出策略

允许内容/禁止内容

实体 A05

公平性匹配对

比较维度/期望不变量

1—n
实体 B

公平性病例

临床事实键/期望处置

实体 A06

分组定义

维度/两组/适用范围

1—n
实体 B

公平性病例

临床事实键/期望处置

实体 A07

公平性病例

临床事实键/期望处置

1—1
实体 B

测试载荷

载荷正文/载荷角色

实体 A08

鲁棒性配对

扰动类型/期望行为

1—n
实体 B

测试载荷

载荷正文/载荷角色

实体 A09

鲁棒性配对

扰动类型/期望行为

1—1
实体 B

扰动规格

扰动强度/随机种子

实体 A10

隐私测试项

标识类别/期望动作

1—n 隐私项挂接期望行为与失败条件
实体 B

期望行为

判分要点/失败条件

实体 A11

公平性匹配对

比较维度/期望不变量

1—n 匹配对挂接两侧应保持一致的判分要点
实体 B

期望行为

判分要点/失败条件

实体 A12

鲁棒性配对

扰动类型/期望行为

1—n 鲁棒项挂接扰动后应保持的行为
实体 B

期望行为

判分要点/失败条件

实体 A13

鲁棒性配对

扰动类型/期望行为

1—n
实体 B

测试运行

基线输出/变体输出

实体 A14

隐私测试项

标识类别/期望动作

1—n 评分细则按对象标识挂到具体测试项,三类各用各的指标与阈值
实体 B

评分细则

指标/阈值

实体 A15

隐私测试项

标识类别/期望动作

1—n 测试项的历次复核记录,三类均按对象标识挂接
实体 B

复核记录

复核状态/版本

核心实体关联实体1—1 / 1—n / n—1 表示关系基数
查看关系语义清单
基数关系语义
隐私测试项1—1测试载荷隐私项绑定它实际使用的测试载荷
隐私测试项1—n标识目标隐私项声明待保护的标识目标
隐私测试项1—n泄漏探针隐私项配泄漏探针给出判定条件
隐私测试项1—1允许输出策略隐私项声明允许保留与不得出现的内容
公平性匹配对1—n公平性病例一个匹配对由两个只差声明维度的病例组成
分组定义1—n公平性病例病例按分组定义归入被比较的两组
公平性病例1—1测试载荷公平性病例绑定它实际使用的测试载荷
鲁棒性配对1—n测试载荷鲁棒项的基线与变体各指向一份载荷
鲁棒性配对1—1扰动规格鲁棒项绑定可复跑的扰动规格
隐私测试项1—n期望行为隐私项挂接期望行为与失败条件
公平性匹配对1—n期望行为匹配对挂接两侧应保持一致的判分要点
鲁棒性配对1—n期望行为鲁棒项挂接扰动后应保持的行为
鲁棒性配对1—n测试运行运行在基线与变体上成对保存输出;另两类测试项同样按对象标识挂接运行
隐私测试项1—n评分细则评分细则按对象标识挂到具体测试项,三类各用各的指标与阈值
隐私测试项1—n复核记录测试项的历次复核记录,三类均按对象标识挂接

三类测试各自成族,又共用同一套载荷与判据。隐私项用标识目标、泄漏探针与允许输出策略三面夹住一段载荷。公平项把两个只差一个声明维度的病例锁成匹配对,临床事实键保证除该维度外两侧确实相同。鲁棒项把同一段文本的基线与变体锁成一对,扰动规格带种子,可原样复跑。期望行为、评分细则、测试运行与复核记录按对象标识挂到三类中的任意一类。

[03]

使用场景

三类风险的一次性摸底

医疗科技企业 · 模型上线前合规评估

  • 泄漏可机器判:待保护标识写成可检索的目标令牌,输出里是否残留一查即知
  • 保信息也保安全:允许输出策略同时写明该留什么
  • 回填也算泄漏:借上下文把原值推回来的情况,明确列为禁止输出
  • 公平只比可比的:匹配对除声明维度外,临床事实完全相同
  • 扰动带种子:每个扰动记录类型、强度与随机种子,问题复现时能生成一模一样的输入

获得:隐私、公平与鲁棒三面分项评估、结论可复现的上线前评估

院内数据处理环节的实测判据

医院信息部门 · 去标识与输出管控验收

  • 按标识类别分项验:姓名、联系方式等各类标识分项统计,验收结论落到具体类别
  • 替换写法有统一口径:每类标识的期望替换写法预先写定,各家系统输出可直接对齐比较
  • 噪声下不改结论:带识别噪声与语序变化的鲁棒项,检验录入质量波动时结论是否发生偏移
  • 载荷不含真实标识:测试载荷为自产内容,验收过程本身不引入新的真实标识流转

获得:按标识类别分项、口径统一的去标识与输出管控验收依据

分组差异的可比口径与写法

医疗器械与医疗软件企业 · 分组表现说明材料

  • 只改一个维度:匹配对之间只改变一个声明维度,差异归因落到那一个变量上
  • 适用范围随结论走:分组定义带适用范围声明,写材料时可原样引用
  • 期望写成证据阈值:期望不变量写的是对等临床事实采用相同证据阈值
  • 基线与变体成对留档:同一项在基线与变体上的两份输出成对保存,差异可逐句核对

获得:分组差异可比、适用范围写清楚的表现说明依据

受控扰动与匹配设计的实验底座

高校与科研机构 · 稳健性与分组差异研究

  • 单因素受控:每次扰动只做单一受控改动,可分离出各类扰动对结论的独立影响
  • 可复跑的随机性:扰动参数与种子随数据交付,第三方复跑得到同一批变体输入
  • 匹配设计现成:匹配对与分组定义的组织方式可直接用作自建分组实验的设计模板
  • 三族共用判据结构:期望行为、评分细则与运行记录按对象挂接

获得:扰动单因素可控、匹配设计可复用的实验底座

[04]

定制与定向

  • 是否支持定制:是
  • 测试族范围(单选):按单一测试族 / 按三族组合
  • 其他定制项(多选):标识类别覆盖 / 分组维度 / 扰动类型与强度 / 期望行为口径 / 通过阈值设置
  • 最低定制数量:300 个测试项
  • 扩展项:标识类别体系、分组维度与扰动库按项目商定
  • 其他可定制项:与项目商务确定
[05]

去标识化与交付

  1. 直接标识符移除:姓名、证件号码、联系方式、住址
  2. 间接标识符不可逆映射:患者标识、就诊号、报告单号
  3. 时间平移:整体平移并保持时序与时间间隔
  4. 机构与医师信息去除或泛化
  5. 自由文本二次核查:叙述内容中的标识信息
  6. 可按项目追加 K-匿名等泛化处理,匿名化的判定与出具方式随项目约定
  7. 测试载荷全部为自产内容,待保护标识以可检索令牌承载,不使用任何真实标识原值
  • 加密通道交付:支持
[06]

关联数据集

  • SHP-MED-05-035 临床文本去标识化数据——隐私项所对应的去标识数据
  • SHP-MED-07-047 医疗安全与红队测试集——同批交付的安全侧测试
  • SHP-MED-09-059 人群与模态平衡增强数据——可补齐分组样本的平衡增强数据
[07]

常见问题

医疗隐私、公平性与鲁棒性评测集包含哪些内容?

医疗隐私、公平性与鲁棒性评测集(SHP-MED-07-048)把三类测试合并交付。隐私项声明要保护的标识与允许输出的内容;公平项是成对病例,只差一个声明的分组维度;鲁棒项是同一段输入的基线版与受控扰动版。

这套评测集适合评什么?

医疗隐私、公平性与鲁棒性评测集(SHP-MED-07-048)用于上线前对三类风险分项评估,也可用于院内去标识与输出管控环节的实测。它作为独立评测集使用,与训练侧数据隔离,三族分别出分。

样例能看到什么?交付形态是什么?

公开样例展示医疗隐私、公平性与鲁棒性评测集(SHP-MED-07-048)的测试项结构:测试载荷、目标与探针、匹配对或扰动对、期望行为与评分细则。交付为测试项清单加单一测试项文件夹与元数据文件,另支持 API 调用。

起订量是多少?可以怎么定制?

医疗隐私、公平性与鲁棒性评测集(SHP-MED-07-048)起订量为 300 个测试项,范围按单一测试族或三族组合确定。标识类别覆盖、分组维度、扰动类型与强度、期望行为口径与通过阈值可选配。

和哪些产品搭配使用?

医疗隐私、公平性与鲁棒性评测集(SHP-MED-07-048)常与医疗安全与红队测试集(SHP-MED-07-047)同批交付。分组样本要补齐,可取人群与模态平衡增强数据(SHP-MED-09-059)做定向补充。

[08]

获取方式

  • 有明确科研/临床项目:提供研究方向与所需字段范围,可先申请开源子集用于可行性验证。
  • 有明确数据智能场景:提供模型或应用场景,可先申请测试数据与接入方式完成联调。
  • 许可:评估与研究使用许可。

© 数巨有谱数据集团

[03 · 关联产品]

继续查看可连接的数据产品

按产品资料中登记的患者、就诊、事件或任务标识关系继续查看。