参考情景 · 示意性

模型给风险定了价。 但仍须有人为这个决定负责。

承保与理赔决定附带法定约束,这些约束不会因为数字出自模型而移动。本情景展示该约束在决定即将生效的那一刻被强制执行。

01监管义务

你本就必须产出的东西

保险监管机构在 AI 治理上行动很早,而义务落在保险公司身上,不在供应商身上。

你本就必须产出的东西
依据它要求你产出什么
NAIC AI Model Bulletin一套书面的 AI 系统计划,对用于受监管决定的模型具备治理、风险管理与已记录的控制。
Unfair discrimination决定不得建立在受保护特征之上,包括通过间接复现这些特征的代理变量。
Solvency II有效治理,包含清晰的职责划分与可审计的决策轨迹。
IFRS 17经得起审计的计量与披露,包括理赔负债的确认基础。
02冲突所在

为何惯常答案无法收口

事后抽样的公平性复核,无法向监管机构证明没有任何不容许的决定被执行过。

01

代理特征在复核时未必可见;问题在于是否有不容许的依据抵达了决定,而不在于是否有人存此意图。

02

理赔自动化放大错误规则后果的速度,远快于季度复核周期能够发现的速度。

03

公告要求对生产中的模型具备已记录的控制。记录意图,与记录每一次决定实际被允许做什么,并非同一件产物。

03在边界处

边界处的一次动作

引擎在同一次裁决中,对照获准参照与禁止参照来度量该动作——这正是我们证据页面上的消融实验所要论证的安排。

候选动作

claim.deny.execute · $340,000 · protected-class proxy in decision basis

BLOCK不公平歧视 · 双参照边距

仅对照获准参照时,该动作看起来合规。在同一次裁决中对照禁止参照度量后,边距塌陷——该案例与某个已知的不容许依据之间的距离,和它与容许依据之间的距离一样近。单参照闸门会放行这一类案例;在我们的留出集上,它放行了十例中的四例。

04引擎证据

无论哪个行业,都是同一组实测

以下取自内部技术证据报告,并非为本情景建模的推算。它们描述的是同一条流水线,因此不会随监管义务而改变。

0 / 18

被放行的攻击回合

对真实生成式规划器所撰写动作轨迹的 Stage 0 SHADOW 评估。九个留出的良性回合无一被拦截。

0 / 10

双参照下被放行的禁止用例

同一留出集上的对照消融。在相同校准下,单参照闸门放行了十例中的四例。

0.47 ms

平均裁决延迟

基于 5,000 次实测裁决;p99 为 1.15 毫秒。闸门本身在 258 纳秒内完成。

1,000 / 1,000

回放时的一致摘要

相同输入、锁定环境。一万条账本记录在 0.195 秒内重新验证完毕。

本情景不是什么

引用之前请先读这里

  • 这是示意性情景,而非客户项目。未指名任何客户,因为并未描述任何客户。
  • 未主张在本行业有任何部署,也没有任何监管机构审阅或认可本材料。
  • 各项数字为一台普通工作站上的原型实测,并非生产环境或分布式结果。
  • 此处内容均未经第三方独立复现。
  • 所引依据描述的是你所承担的义务——而非认定我们已满足这些义务。
  • 在经验证的行业语料上的运行准确率仍待确立;试点需要你自己的参考数据。

在相信情景之前,先核对数字

以上每一个数字都来自技术证据页面,那里同样列出这些实测数据、其尾部分布与所声明的边界。