AI駆動の洪水リスク引受

FEMAゾーンを上回る洪水レーティングファクターが、DOI審査官より先に自らをブロックする。

FloodProofは、実在のNFIP洪水クレームのポートフォリオを対象に、実在の建物属性の複合スコアがFEMA洪水ゾーンよりも損失をうまく順位付けできることを証明し、プライシングに用いたすべての変数を実在の国勢調査の人口統計に照らして差別的影響がないか監査し、審査官向けのDOI届出パッケージを組み立てます。変数が80%ルールに不合格になると、決定論的なポリシーゲートは届出を準備完了とマークすることを拒否し、最悪の違反項目を人間のアクチュアリーによる正当化へ回します。

1.69x

上位デシルの損失捕捉における、FEMAゾーンに対するアウトオブサンプル・リフト

ホールドアウトした実在のNFIPクレーム40,615件、ジニ 0.31対0.08

$3.1B

FEMA高リスクゾーン外で支払われた実在の建物クレーム金額(45.9%)

このHarris County, TXのポートフォリオ、非モデル化

NOT FILING-READY

プライシングに用いた5つの変数が80%ルールに不合格となったため、ゲートは自身の届出をブロックしました

複合スコア自体はAIR 0.938で合格

すべての数値は、実行のたびに実在の公開データからライブで再計算されます。これらはこのHarris Countyのポートフォリオとこのホールドアウト分割に帰属するものであり、オープンワールドの保証ではありません。

FEMAゾーンは両側で誤った価格付けをし、より賢いモデルでも届出に不合格になり得る

Zone AE対Zone Xに依拠する洪水プライシングは、地図で答える物件レベルの問いです。

FEMA洪水ゾーンに洪水料率を依拠させると、ゾーン内の高床住宅には過大請求し、ゾーン外のスラブオン・グレード住宅には過小請求することになります。保険会社の実際のエクスポージャーは、ゾーン地図では答えられない物件レベルの問いです。この実在のHarris Countyポートフォリオでは、建物クレーム金額の$3.1B(45.9%)が、FEMAが高リスクのSpecial Flood Hazard Areaゾーン外と評価した物件に支払われています。これはモデルを介さず、データそのものです。

市場の答えは、より良いモデルを買うことでした。しかし、より賢いレーティングファクターは仕事の半分にすぎません。AIで補強された料率は、州保険庁の公平性審査を生き延びなければなりません。損失をうまく順位付けする因子でも人口統計のシグナルを帯び、EEOCの80%ルールに不合格となり、審査官が却下する差別的な料率を出荷してしまうからです。New York DFS Circular Letter 2024-7は代理差別の検査を求め、コロラド州はAI駆動の保険料率について変数ごとの正当化を求め、NAIC AI Model Bulletinは24以上の州で採択されています。自己採点するより良いモデルは証拠ではなく、人口統計のシグナルを帯びるより良いモデルは差し戻される届出です。

本当に残るエンジニアリングはモデルの周りのインフラです。循環しないバックテスト、プライシングに用いたすべての変数に対する公平性監査、そして審査官向け届出パッケージを生成するか拒否するかのゲートです。それが私たちが構築したものであり、デモが実在の公開データで証明することです。

FloodProofの仕組み

実在のOpenFEMAクレームから決定論的な届出判定まで、測定された9つの段階。ハードコードされたものは何もありません。

実在のクレーム135,381件に対し完了した9段階を示すFloodProofのライブ・パイプラインパネル:キャッシュされたOpenFEMAレコードの読み取り、支払済み建物クレームの保持、実在の建物特徴のエンジニアリング、CDC-SVI人口統計とセンサストラクト重心の読み込み、シード9で70/30分割してリッジ複合を適合、1.694xでFEMAゾーンに対するバックテスト、$3.1Bの高リスクゾーン外支払いの集計、すべての変数の差別的影響スクリーニング、そして人間へ回された階数とともにNOT FILING-READYを返す決定論的ポリシーゲート。
9段階のパイプラインは実行のたびにライブで走ります。信頼上重要な数値は、エージェント・フレームワークの外側で計算されるプレーンなnumpyです。

スコアリングエンジン

実在のOpenFEMA建物属性(建物年齢、階数、高床インジケータ、post-FIRMコード、用途、障害物)のリッジ複合を、70%の訓練分割で適合し、ホールドアウトした30%のテスト分割でスコアします。保険カバーは、支払いがそれによって機械的に上限付けられるため、バックテストが循環してしまうので、意図的にスコアから除外しています。ベースラインは実在のratedFloodZone、ラベルは実在のamountPaidOnBuildingClaimであり、いずれもモデルから独立しています。

バックテストと帰属分析

ホールドアウトしたクレームを複合スコアとFEMAゾーンで順位付けし、エンジンはそれぞれについて上位デシルの損失ドル捕捉とジニを報告し、スコアを駆動するものの正確な線形シャープレイ帰属も併せて示します。固定シード(SEED=9)により分割が再現可能となり、同じ実行で同じ数値が得られます。

公平性監査

差別的影響のスクリーニングは、プライシングに用いたすべての変数、複合スコア自体、被保険建物カバー、および各建物属性に対し、CDC/ATSDR SVIの実在のセンサストラクト単位のマイノリティ比率と照合して実行されます。各変数について不利影響比を計算し、EEOCの80%ルール帯[0.80, 1.25]の内側にあるかを判定します。

決定論的ポリシーゲート

届出が準備完了とマークされるのは、ホールドアウト標本が十分に大きく、FEMAゾーンに対する複合リフトが必要な下限(1.10x以上)を超え、不利影響比が帯の内側にあり、加えて州ごとの届出チェックリストを満たす場合のみです。いずれかの変数が不合格なら、ゲートはNOT FILING-READYを出し、最悪の違反項目を名指しし、人間のアクチュアリーによる正当化へ回します。既定は拒否です。filing_readyは、ブロックする指摘がゼロの場合に限り真です。

任意のLLMクルー

因子の説明役、敵対的チャレンジャーと対になった公平性の正当化役、届出メモの起草役からなるPydantic-AIクルーは助言できますが、決めるのはゲートです。APIキーは不要です。キーがないときエージェントは判断を控え、決定論的デモは影響を受けません。信頼上重要な数値はすべて、エージェント・フレームワークの外側のプレーンなnumpyにあります。

デモが実在データで証明すること

Harris County, TX。実在のOpenFEMA NFIPクレーム。以下の数値はすべてライブで計算されます。

同じHarris CountyポートフォリオのFloodProof並列マップ。左は、ドットの大きさが実支払額に等しい、FEMA洪水ゾーン階層で色分けしたクレーム。右は、同じクレームをAI複合リスクで色分けし、金のリングがFEMAの見逃しを示す:FEMAが安全と評価した物件を複合スコアが高リスクと判定したもの。隅の赤いバッジはコンプライアンス証明書 NOT FILING-READY と読みます。
同じポートフォリオ、2つの地図。同一のHarris CountyクレームのFEMAゾーン表示とAI複合表示。金のリングは、FEMAが安全と評価した物件を複合スコアが高リスクとフラグしたものです。
FloodProofのアウトオブサンプル・リフトチャートと見出し統計カード:$3125.0MのFEMA高リスクゾーン外で支払われた実在の建物クレーム、1.694xの複合対FEMAゾーン上位デシル捕捉リフト、高リスクゾーン外の実クレーム金額の45.9%シェア、バックテストのホールドアウト実クレーム40,615件。棒グラフは、上位デシルのクレームドル捕捉とジニについて、AI複合とFEMAゾーンのみを比較します。
アウトオブサンプルの結果:ホールドアウトした40,615件のクレームで1.694xの上位デシル捕捉リフト、ジニ 0.31対0.08。

ホールドアウトした実在の40,615件のクレームで、複合はFEMAゾーン・ベースラインの上位デシル損失ドルの1.69xを捕捉し、ジニはゾーンの0.08に対し0.31です。スコアは訓練で適合しホールドアウト分割で読み取り、ベースラインとラベルはいずれもモデルから独立しているため、これは自己採点ではなく真正のアウトオブサンプル結果です。

リフトは乱数シードを変えてもおおむね1.69xから1.85xの範囲で頑健であり、幸運な分割ではありません。対象は1つの郡のポートフォリオと1つのホールドアウト30%分割であり、その旨を明示します。

監査は、AIが問題であるかのように装いません。複合スコア自体は、実在のCDC/ATSDR SVIトラクトに照らしてAIR 0.938で80%ルールに合格します。しかしスクリーニングはプライシングに用いたすべての変数で走り、5つが不合格です。最悪はAIR 0.363の階数、次いで被保険価額0.526、そして驚くべきことにFEMA自身のゾーン階層が1.467です。

審査官より先にデータ内のコンプライアンスリスクを捉えることが価値です。ゲートはその後、届出を準備完了とマークすることを拒否し、最悪の違反項目である階数を人間のアクチュアリーによる正当化へ回します。

NOT FILING-READYと記されたFloodProofコンプライアンス証明書モーダル。差別的影響テーブルが、実在のCDC/ATSDR SVI 2022トラクトに照らしてすべてのレーティング変数をスクリーニングします。複合スコアはAIR 0.938で合格する一方、プライシングに用いた変数のうち5つが80%ルールに不合格で、最悪は階数0.363、次いで被保険建物カバー0.526、FEMA自身のゾーン階層1.467です。赤い行は、最悪の違反項目である階数が人間のアクチュアリーによる正当化へ回され、料率は自動承認されないことを記し、その下に州ごとのDOI届出チェックリストがあります。
差別的影響監査はプライシングに用いたすべての変数をスクリーニングします。複合は0.938で合格し、5つの変数が不合格で、FEMA自身のゾーン階層も含まれます。
Harris County, TXの保険会社ポートフォリオ向け「AI補強洪水レーティングファクター」と題され、NOT FILING-READYの印が押されたFloodProof州DOI届出文書。アクチュアリー覚書、複合がFEMAゾーンの上位デシル損失ドルの1.694xを捕捉しジニ0.31対0.08(実クレーム40,615件)を示すアウトオブサンプル・バックテスト表、および正確な線形シャープレイ寄与の特徴量重要度表を含みます。
審査官向けDOI届出パッケージ:アクチュアリー覚書、アウトオブサンプル・バックテスト、特徴量帰属。ゲートが生成するかブロックします。

FloodProofが正直に収まる場所

これはメカニズムのデモであり、配備済みパイプラインではありません。何が実在で何がスタブかを正確に示します。

コンポーネント このデモでは ステータス
クレーム、人口統計、地理 OpenFEMA FimaNfipClaims(170,803レコード、135,381件をスコア)、CDC/ATSDR SVI 2022、Census Gazetteer 2023 実在、公開、APIキー不要
スコアリング、バックテスト、公平性監査、ゲート リッジ複合、アウトオブサンプル・リフトとジニ、差別的影響スクリーニング、決定論的ポリシーゲート 実在、プレーンなnumpyとPython
ベンダー信号フィード(ZestyAI Z-FLOOD、ICEYE SAR-depth) 実在のスキーマの背後のアダプタ、画面上でスタブと開示 スタブ、文書化された本番差し替え
Guidewire / Duck Creekコネクタ ウォームキャッシュ参照が /api/score で50 ms未満で返却 スタブ、ライブ統合ではない
Pydantic-AIクルー(因子の説明役、公平性の正当化役、メモ起草役) 助言的なナラティブのみ。APIキーがなければ判断を控える 任意、助言、決して決定しない
Harris Countyトラクト向けFloodProofレーティングファクター・ワークシート。Guidewireコネクタ経由でレーティングファクターを取得するコントロールが展開されています。コンソールログはstub guidewire-integration-data-managerとラベルし、ウォームキャッシュ参照から複合レーティングファクターを返します。UIではライブ統合ではなくスタブと開示されています。
インラインの見積・成約ストーリーは具体的だが正直です。Guidewireコネクタはスタブ化されたキャッシュ参照であり、UIでもそのようにラベルされています。

このデモがしないこと

  • ライブのZestyAI、ICEYE、First Street、Guidewire、Duck Creekフィードは実行しません。それらはスタブです。
  • DOI準拠や認証を主張しません。届出パッケージは証拠成果物であり法的助言ではなく、審査官が何かを承認したこともありません。
  • モデル化した年間ドル漏出額は提示しません。正直な見出しは、FEMA高リスクゾーン外で支払われた実在の非モデル化$3.1Bと、アウトオブサンプル・リフトです。
  • 外部ラスタ(不透水面、DEM、NOAA Atlas-14)は使いません。複合はOpenFEMA自身の実在の建物属性を使い、ラスタは文書化された将来の強化です。
  • 顧客、保険会社、配備、推薦文、ROIはありません。名指しの保険会社がこれを使ったことはありません。1つの郡のポートフォリオ上のメカニズムのデモです。
  • 自らのモデルがバイアスがあるかのように装いません。複合はAIR 0.938で80%ルールに合格します。要点は、監査とゲートが不合格変数を捉えることです。

引受担当者とコンプライアンスチームが問うこと

すでに買っているZestyAIやICEYEのような洪水モデルを置き換えるのですか?

いいえ。FloodProofはZestyAIやICEYEと競合する別の洪水モデルではありません。使うモデルの周りに位置する統合と証明の層です。実在のFEMAゾーン・ベースラインに対する循環しないアウトオブサンプル・バックテスト、プライシングに用いたすべての変数の差別的影響監査、審査官向けDOI届出パッケージを生成するかブロックする決定論的ゲートです。その価値はどのモデル品質でも成り立ちます。自己採点するより良いモデルは証拠ではなく、人口統計のシグナルを帯びるより良いモデルは審査官が却下する届出だからです。

複合のFEMAゾーンに対するリフトが、ただの過学習でないとどう分かりますか?

バックテストは構造上、循環しません。複合は70%の訓練分割で適合し、一度も見ていないホールドアウト30%でスコアされ、ベースラインは実在のFEMA評価ゾーン、ラベルは実在の支払クレーム金額です。ベースラインとラベルはいずれもモデルから独立しており、保険カバーは意図的に除外されているため、スコアは支払い上限でごまかせません。ホールドアウトした実在のNFIPクレーム40,615件で、複合はFEMAゾーン・ベースラインの上位デシル損失ドルの1.69xを捕捉し(ジニ 0.31対0.08)、結果は乱数シードを変えてもおおむね1.69xから1.85xの範囲に留まります。

レーティング変数が80%ルールに不合格のとき、ゲートは実際に何をしますか?

届出を準備完了とマークすることを拒否します。ポリシーゲートは不変条件が1つの決定論的Pythonです。filing_readyは、ブロックする指摘がゼロの場合に限り真です。このHarris Countyポートフォリオでは、複合スコア自体はAIR 0.938で80%ルールに合格しますが、監査は不合格のプライシング変数を5つフラグし、最悪はAIR 0.363の階数です。ゲートはNOT FILING-READYを出し、最悪の違反項目を名指しし、差別的な料率を出荷する代わりに人間のアクチュアリーによる正当化へ回します。エージェントは助言し、コードが決めます。

これは実在のクレームデータで動いていますか、それとも合成サンプルですか?

実在です。デモはHarris County, Texasの生のOpenFEMA NFIPクレームレコード170,803件で走り、うち支払済み建物クレームのある135,381件がスコアされ、加えて実在のCDC/ATSDR SVI 2022トラクト人口統計と2023 Census Gazetteerを用います。APIキー不要の公開データで、初回実行時にキャッシュされます。デモが画面上で開示する1つの正直な注意点:FEMAはクレームの地理座標をおおむねトラクト重心まで検閲するため、バックテストは公開データが許す解像度で走ります。

ベンダーフィードとGuidewireコネクタはこのデモでライブですか?

いいえ、デモは画面上でそう述べています。ZestyAI Z-FLOODとICEYE SAR-depthフィード、およびGuidewire Integration Data Managerコネクタは、実在のスキーマの背後のスタブです。コネクタのエンドポイントは、インラインの見積・成約統合を具体的にするため50 ms未満で返すウォームキャッシュ参照です。本番パスは書き換えではなく文書化された設定の差し替えであり、正直な主張はスタブであってライブ統合ではありません。

「DOI審査官が承認できるレーティングファクター」とは、認証済み準拠という意味ですか?

いいえ。DOI届出パッケージは証拠成果物であり、アクチュアリー覚書、アウトオブサンプル・バックテスト、特徴量帰属、州ごとのチェックリストであって、認証や法的助言ではありません。「審査官が承認できる」は設計目標であり、審査官が何かを承認したという保証ではありません。保険会社がこれを本番で使ったことはなく、配備、顧客、事例研究もありません。24以上の州がNAIC AI Model Bulletinを採択するなか、要点は、ゲートが審査官の求める証明を生成し、データが届出を支えないときは正直に不合格になることです。

テクニカルリサーチ

このデモの背景にある研究 — アーキテクチャ、検証設計、エンタープライズ・ブループリント。

洪水リスクを価格付けしているなら、知見を比べたい

FEMAゾーンはその線の外側に数十億を残し、公平性審査はいまや届出の一部です。

AIレーティングファクターを、80%ルールに不合格の変数を出荷せずにDOI審査官の前に出す方法をチームが検討しているなら、その考え方をぜひ聞きたいです。問題は業界全体であり、答えもそうなるでしょう。

ポートフォリオ・プライシングと公平性評価

  • ✓ あなたのFEMAゾーン・ベースラインに対する、循環しないアウトオブサンプル・バックテスト
  • ✓ プライシングに用いたすべての変数の差別的影響監査
  • ✓ ゾーン地図があなたのポートフォリオを誤価格付けしている箇所を、クレーム金額で
  • ✓ DOI審査で不合格になる変数の読み取り

レーティングと届出エンジンの構築

  • ✓ 実在の属性とベンダーフィードに基づく複合レーティングファクター
  • ✓ 決定論的ポリシーゲート:ブロックする指摘がゼロならfiling_ready
  • ✓ 州ごとのチェックリスト付き、審査官向けDOI届出パッケージ
  • ✓ GuidewireまたはDuck Creekコネクタ、書き換えではなく設定の差し替え
ソーシャル

他のプラットフォームでも公開