你的模型是概率性的。 你的签署认证不是。
首席财务官依 §302 签署内控有效。这份签名不会因为过程中有模型参与而变成有条件的。本情景展示确定性层应置于何处,以使该认证始终站得住。
你本就必须产出的东西
这些都不是因为 AI 才有的。新的是:一个概率性组件如今坐在它们所治理的路径之内。
| 依据 | 它要求你产出什么 |
|---|---|
| SOX §302 | 高管认证在该期间披露控制有效。有效性主张需要经得起重新检验的证据,而非模型的回忆。 |
| MiFID II Art. 16 | 订单与客户通讯的留存与调取,须以监管机构可检查的形式保存。 |
| DORA Art. 11 | ICT 事件响应与报告:发生了什么、在哪些控制之下、以何顺序,事后可重建。 |
| SR 11-7 | 模型风险管理——验证、持续监控,并清楚说明模型被允许决定什么。 |
为何惯常答案无法收口
换一天就给出不同答案的护栏,撑不起一份必须覆盖整个期间的认证。
数月后重新评分的概率性护栏,未必能复现当时的裁决。追问为何放行某项动作的检查者,得到的是近似值。
安全评审阻断扩展:工具权限过宽,一次错误动作的波及范围是结算级别,而非工单级别。
证据存放在由受质疑系统自己写下的日志里,且裁决与产生它的策略版本之间没有绑定。
边界处的一次动作
引擎不审查模型的推理。它在动作触及现实之前,对照冻结阈值评估模型即将执行的那个动作。
候选动作
wire.transfer.execute · $2.4M · digest previously consumed
模式与证据锚点均通过校验,重放唯一性未通过:WORM 账本中已存在该载荷摘要。有序校验意味着此处失败是构造性拦截,而非依赖某人恰好写下的规则——且该裁决绑定到当时生效的确切策略版本,因此多年之后这次拦截仍可回放。
无论哪个行业,都是同一组实测
以下取自内部技术证据报告,并非为本情景建模的推算。它们描述的是同一条流水线,因此不会随监管义务而改变。
0 / 18
被放行的攻击回合
对真实生成式规划器所撰写动作轨迹的 Stage 0 SHADOW 评估。九个留出的良性回合无一被拦截。
0 / 10
双参照下被放行的禁止用例
同一留出集上的对照消融。在相同校准下,单参照闸门放行了十例中的四例。
0.47 ms
平均裁决延迟
基于 5,000 次实测裁决;p99 为 1.15 毫秒。闸门本身在 258 纳秒内完成。
1,000 / 1,000
回放时的一致摘要
相同输入、锁定环境。一万条账本记录在 0.195 秒内重新验证完毕。
本情景不是什么
引用之前请先读这里
- 这是示意性情景,而非客户项目。未指名任何客户,因为并未描述任何客户。
- 未主张在本行业有任何部署,也没有任何监管机构审阅或认可本材料。
- 各项数字为一台普通工作站上的原型实测,并非生产环境或分布式结果。
- 此处内容均未经第三方独立复现。
- 所引依据描述的是你所承担的义务——而非认定我们已满足这些义务。
- 在经验证的行业语料上的运行准确率仍待确立;试点需要你自己的参考数据。