AI 驱动的洪水风险核保
FloodProof 指向一份真实的 NFIP 洪水理赔账册,证明由真实建筑属性构成的综合评分对损失的排序优于 FEMA 洪水区;对每一个已定价变量,对照真实普查人口统计做差别影响审计;并组装可供审查官使用的 DOI 申报材料包。当某个变量未通过 80% 规则时,确定性策略闸门拒绝将申报标为就绪,并将最差违规项转交人工精算论证。
1.69x
在最高十分位损失捕获上相对 FEMA 区划的样本外提升
40,615 条留出的真实 NFIP 理赔,Gini 0.31 vs 0.08
$3.1B
在 FEMA 高风险区之外实际赔付的建筑理赔金额(45.9%)
得克萨斯州哈里斯县的这份账册,未经建模
NOT FILING-READY
当 5 个已定价变量未通过 80% 规则时,闸门拦截了自身的申报
综合评分本身以 AIR 0.938 通过
每个数字都在每次运行时从真实公开数据现场重算。请将其归因于这份哈里斯县账册和这次留出划分,而非作为开放世界的保证。
把洪水定价锚定于 AE 区还是 X 区,是一个用地图回答的房产级问题。
把洪水费率锚定于 FEMA 洪水区,会对区内抬升房屋收费过高,对区外平板基础房屋收费过低。承保方真正的风险敞口是一个区划地图无法回答的房产级问题。在这份真实的哈里斯县账册中,$3.1B(45.9%)的建筑理赔金额赔付给了 FEMA 评定为高风险特殊洪水危险区之外的房产。这直接来自数据,不涉及任何模型。
市场的答案一直是买一个更好的模型。但更聪明的费率因子只是工作的一半。任何经 AI 增强的费率现在都必须通过保险监管部门的公平性审查,因为一个能很好排序损失的因子也可能携带人口统计信号并未能通过 EEOC 80% 规则,从而送出审查官会驳回的歧视性费率。纽约 DFS 通函 2024-7 要求进行代理歧视检验,科罗拉多州要求对 AI 驱动的保险费率做逐变量论证,而 NAIC AI 模型公告已被 24 个或更多州采纳。一个自我打分的更好模型不是证据,一个携带人口统计信号的更好模型则是会被退回的申报。
持久的工程在于模型周围的基础设施:非循环回测、对每一个已定价变量的公平性审计,以及一道要么产出审查官所需申报材料包、要么拒绝产出的闸门。这就是我们构建的,也是演示在真实公开数据上所证明的。
九个可度量阶段,从真实 OpenFEMA 理赔到确定性的申报裁决。没有任何硬编码。
由真实 OpenFEMA 建筑属性(建筑年龄、楼层数、抬升指示、post-FIRM 代码、占用类型、障碍物)构成的岭回归综合评分,在 70% 训练集上拟合,并在留出的 30% 测试集上评分。保险保额被有意排除在评分之外,因为赔付在机制上受其上限约束,会使回测变成循环。基线是真实的 ratedFloodZone,标签是真实的 amountPaidOnBuildingClaim,二者均独立于模型。
留出理赔按综合评分和按 FEMA 区划分别排序,引擎报告各自的最高十分位损失金额捕获与 Gini,并给出驱动评分的精确线性 Shapley 归因。固定种子(SEED=9)使划分可复现,因此同一运行得到同一数字。
差别影响筛查覆盖每一个已定价变量、综合评分本身、投保建筑保额以及每一项建筑属性,对照来自 CDC/ATSDR SVI 的真实普查区级少数族裔占比。对每个变量计算不利影响比率,以及它是否落在 EEOC 80% 规则区间 [0.80, 1.25] 内。
仅当留出样本足够大、综合评分相对 FEMA 区划的提升达到要求的最低值(1.10x 或更高)、不利影响比率落在区间内,再加上分州申报清单时,申报才被标为就绪。若任何变量未通过,闸门发出 NOT FILING-READY,点名最差违规项,并将其转交人工精算论证。默认拒绝:filing_ready 当且仅当阻断性发现为零。
由因子解释器、与对抗性质疑者配对的公平性论证器、以及申报备忘录起草器组成的 Pydantic-AI 团队可以提供建议,但由闸门做决定。不需要 API 密钥。当密钥不存在时智能体弃权,确定性演示不受影响。每一个信任关键数字都存在于智能体框架之外的普通 numpy 中。
得克萨斯州哈里斯县。真实 OpenFEMA NFIP 理赔。下方每个数字都是现场计算的。
在 40,615 条留出真实理赔上,综合评分捕获的最高十分位损失金额是 FEMA 区划基线的 1.69x,Gini 为 0.31,区划为 0.08。因为评分在训练集上拟合、在留出划分上读取,且基线与标签均独立于模型,这是真正的样本外结果,而非自我打分。
提升在不同随机种子下大致稳定在 1.69x 到 1.85x 区间,因此不是一次幸运划分。范围是一个县的账册和一次留出的 30% 划分,我们如实说明。
审计并不假装问题出在 AI 上。综合评分本身以 AIR 0.938 通过 80% 规则,对照真实 CDC/ATSDR SVI 普查区筛查。但筛查覆盖每一个已定价变量,有 5 个未通过:最差的是楼层数,AIR 0.363,其次是投保价值 0.526,以及——出人意料地——FEMA 自身的区划层级 1.467。
在审查官之前从数据中抓住合规风险,才是价值所在。闸门随即拒绝将申报标为就绪,并将最差违规项——楼层数——转交人工精算论证。
这是机制的演示,不是已部署的管道。以下精确说明什么是真实的、什么是桩件。
| 组件 | 在本演示中 | 状态 |
|---|---|---|
| 理赔、人口统计、地理 | OpenFEMA FimaNfipClaims(170,803 条记录,135,381 条评分),CDC/ATSDR SVI 2022,Census Gazetteer 2023 | 真实、公开、无需 API 密钥 |
| 评分、回测、公平性审计、闸门 | 岭回归综合评分、样本外提升与 Gini、差别影响筛查、确定性策略闸门 | 真实,普通 numpy 与 Python |
| 供应商信号源(ZestyAI Z-FLOOD,ICEYE SAR-depth) | 真实模式之后的适配器,在屏幕上披露为桩件 | 桩件,已文档化的生产替换 |
| Guidewire / Duck Creek 连接器 | 在 /api/score 的热缓存查找,50 ms 内返回 | 桩件,非实时集成 |
| Pydantic-AI 团队(因子解释器、公平性论证器、备忘录起草器) | 仅顾问性叙述;无 API 密钥时弃权 | 可选、顾问性、从不做决定 |
不会。FloodProof 不是又一个与 ZestyAI 或 ICEYE 竞争的洪水模型。它是环绕您所用任何模型的集成与证明层:对照真实 FEMA 区划基线的非循环样本外回测、对每一个已定价变量的差别影响审计,以及产出或拦截可供审查官使用的 DOI 申报材料包的确定性闸门。该价值在任何模型质量下都成立,因为自我打分的更好模型不是证据,携带人口统计信号的更好模型是审查官会驳回的申报。
回测在构造上就是非循环的。综合评分在 70% 训练集上拟合,并在它从未见过的留出 30% 上评分,基线是真实的 FEMA 评定区划,标签是真实赔付的理赔金额。基线与标签均独立于模型,保险保额被有意排除,使评分无法借助赔付上限作弊。在 40,615 条留出真实 NFIP 理赔上,综合评分捕获 FEMA 区划基线最高十分位损失金额的 1.69x(Gini 0.31 vs 0.08),结果在不同随机种子下大致保持在 1.69x 到 1.85x 区间。
它拒绝将申报标为就绪。策略闸门是带有一条不变量的确定性 Python:filing_ready 当且仅当阻断性发现为零。在这份哈里斯县账册上,综合评分本身以 AIR 0.938 通过 80% 规则,但审计标出 5 个未通过的已定价变量,最差为楼层数 AIR 0.363。闸门发出 NOT FILING-READY,点名最差违规项,并将其转交人工精算论证,而不是送出歧视性费率。智能体建议,代码裁决。
真实。演示在得克萨斯州哈里斯县的 170,803 条原始 OpenFEMA NFIP 理赔记录上运行,其中 135,381 条有已赔付建筑理赔的被评分,再加上真实 CDC/ATSDR SVI 2022 普查区人口统计和 2023 Census Gazetteer。这是无需 API 密钥的公开数据,首次运行时缓存。演示在屏幕上披露的一个诚实限制:FEMA 将理赔地理坐标脱敏到大致普查区质心,因此回测运行在公开数据所允许的分辨率上。
不是,演示也在屏幕上如此说明。ZestyAI Z-FLOOD 与 ICEYE SAR-depth 数据源以及 Guidewire Integration Data Manager 连接器是真实模式之后的桩件。连接器端点是热缓存查找,在 50 ms 内返回,以使内联报价-承保集成具体可见。生产路径是已文档化的配置替换,而非重写,诚实的说法是桩件,而非实时集成。
不是。DOI 申报材料包是证据产物:精算备忘录、样本外回测、特征归因和分州清单,不是认证或法律意见。「审查官可以批准」是设计目标,不是任何审查官已批准任何内容的保证。没有任何保险公司在生产中使用过它,也没有部署、客户或案例研究。随着 24 个或更多州采纳 NAIC AI 模型公告,要点是闸门产出审查官所要求的证明,并在数据不支持申报时诚实地失败。
FEMA 区划把数十亿美元留在其界线之外,而公平性审查现已成为申报的一部分。
如果您的团队正在摸索如何把 AI 费率因子放到 DOI 审查官面前,同时不送出未通过 80% 规则的变量,我们真诚希望听听您的思路。这个问题是全行业的,答案也将如此。