KI-gestütztes Hochwasserrisiko-Underwriting

Ein Hochwasser-Ratingfaktor, der die FEMA-Zone schlägt — und sich selbst blockiert, bevor der DOI-Prüfer es tut.

FloodProof nimmt ein reales Portfolio von NFIP-Hochwasserschäden in den Blick und belegt, dass ein Komposit aus echten Gebäudeattributen Schäden besser rangiert als die FEMA-Hochwasserzone, prüft jede bepreiste Variable auf Disparate Impact gegenüber realer Census-Demografie und stellt das prüferfertige DOI-Einreichungspaket zusammen. Wenn eine Variable die 80%-Regel nicht erfüllt, verweigert ein deterministisches Policy-Tor die Markierung als einreichungsbereit und leitet den schlimmsten Verstoß zur menschlichen versicherungsmathematischen Begründung weiter.

1.69x

Out-of-Sample-Lift gegenüber der FEMA-Zone bei der Schadenerfassung im obersten Dezil

40,615 zurückgehaltene echte NFIP-Schäden, Gini 0.31 vs 0.08

$3.1B

Echte ausgezahlte Gebäude-Schadendollars außerhalb von FEMA-Hochrisikozonen (45.9%)

Dieses Portfolio in Harris County, TX, unmodelliert

NOT FILING-READY

Das Tor hat die eigene Einreichung blockiert, als 5 bepreiste Variablen die 80%-Regel nicht erfüllt haben

Der Kompositscore selbst besteht bei AIR 0.938

Jede Kennzahl wird bei jedem Lauf live aus echten öffentlichen Daten neu berechnet. Ordnen Sie sie diesem Harris-County-Portfolio und diesem Hold-out-Split zu, nicht als Garantie für die offene Welt.

Die FEMA-Zone bepreist beide Seiten falsch, und ein smarteres Modell kann bei der Einreichung durchfallen

Hochwasserbepreisung, die an Zone AE vs. Zone X ankert, ist eine grundstücksbezogene Frage, die mit einer Karte beantwortet wird.

Eine Hochwasserprämie an der FEMA-Hochwasserzone zu verankern, berechnet dem aufgeständerten Haus innerhalb der Zone zu viel und dem Slab-on-Grade-Haus außerhalb zu wenig. Die tatsächliche Exposure des Versicherers ist eine grundstücksbezogene Frage, die die Zonenkarte nicht beantworten kann. In diesem realen Harris-County-Portfolio wurden $3.1B (45.9%) der Gebäude-Schadendollars auf Immobilien ausgezahlt, die FEMA außerhalb ihrer Special-Flood-Hazard-Area-Zonen mit hohem Risiko eingestuft hat. Das kommt direkt aus den Daten, ohne dass ein Modell im Spiel ist.

Die Marktantwort war, ein besseres Modell zu kaufen. Aber ein smarterer Ratingfaktor ist nur die halbe Arbeit. Jeder KI-gestützte Tarif muss jetzt eine Fairness-Prüfung des Department of Insurance überstehen, weil ein Faktor, der Schäden gut rangiert, auch demografisches Signal tragen und die EEOC-80%-Regel nicht erfüllen kann — und damit einen diskriminierenden Tarif ausliefert, den der Prüfer ablehnt. New York DFS Circular Letter 2024-7 verlangt Tests auf Proxy-Diskriminierung, Colorado verlangt eine Begründung je Variable für KI-gesteuerte Versicherungstarife, und das NAIC AI Model Bulletin ist in 24 oder mehr Bundesstaaten übernommen worden. Ein besseres Modell, das sich selbst benotet, ist kein Nachweis, und ein besseres Modell, das demografisches Signal trägt, ist eine Einreichung, die zurückgeschickt wird.

Die tragfähige Engineering-Leistung ist die Infrastruktur um das Modell: ein nicht-zirkulärer Backtest, ein Fairness-Audit auf jeder bepreisten Variable und ein Tor, das entweder das Einreichungspaket des Prüfers erzeugt oder es verweigert. Das haben wir gebaut, und das belegt die Demo auf echten öffentlichen Daten.

So funktioniert FloodProof

Neun gemessene Stufen, von echten OpenFEMA-Schäden bis zu einem deterministischen Einreichungsurteil. Nichts ist fest verdrahtet.

FloodProof-Live-Pipeline-Panel mit 9 abgeschlossenen Stufen über 135,381 echten Schäden: gecachte OpenFEMA-Datensätze lesen, ausgezahlte Gebäudeschäden behalten, echte Gebäude-Features erzeugen, CDC-SVI-Demografie und Tract-Zentroide laden, 70/30-Split auf Seed 9 und Fit des Ridge-Komposits, Backtest gegen die FEMA-Zone bei 1.694x, $3.1B außerhalb von Hochrisikozonen ausgezahlt aufsummieren, jede Variable auf Disparate Impact prüfen, und ein deterministisches Policy-Tor, das NOT FILING-READY zurückgibt, mit Geschosszahl zur menschlichen Weiterleitung.
Die neunstufige Pipeline läuft bei jeder Ausführung live. Die vertrauenskritischen Zahlen sind schlichtes numpy, berechnet außerhalb jedes Agenten-Frameworks.

Die Scoring-Engine

Ein Ridge-Komposit aus echten OpenFEMA-Gebäudeattributen (Gebäudealter, Geschosszahl, Elevated-Indikator, post-FIRM-Code, Nutzungsart, Hindernis) wird auf einem 70%-Train-Split gefittet und auf dem zurückgehaltenen 30%-Test-Split bewertet. Die versicherte Deckung ist bewusst vom Score ausgeschlossen, weil die Zahlung mechanisch dadurch begrenzt ist, was den Backtest zirkulär machen würde. Die Baseline ist die echte ratedFloodZone und das Label ist der echte amountPaidOnBuildingClaim, beide unabhängig vom Modell.

Der Backtest und die Attribution

Die zurückgehaltenen Schäden werden nach Komposit und nach FEMA-Zone rangiert, und die Engine berichtet die Erfassung von Schadendollars im obersten Dezil und Gini für jedes, zusammen mit einer exakten linearen Shapley-Attribution dessen, was den Score treibt. Ein fester Seed (SEED=9) macht den Split reproduzierbar, sodass derselbe Lauf dieselben Zahlen liefert.

Das Fairness-Audit

Der Disparate-Impact-Screen läuft über jede bepreiste Variable, den Kompositscore selbst, die versicherte Gebäudedeckung und jedes Gebäudeattribut, gegen den realen Minderheitenanteil auf Tract-Ebene aus CDC/ATSDR SVI. Für jede Variable berechnet er das Adverse-Impact-Ratio und ob es innerhalb des EEOC-80%-Regel-Bands [0.80, 1.25] liegt.

Das deterministische Policy-Tor

Die Einreichung wird nur als bereit markiert, wenn die Hold-out-Stichprobe groß genug ist, der Komposit-Lift gegenüber der FEMA-Zone das erforderliche Minimum (1.10x oder höher) überschreitet und das Adverse-Impact-Ratio innerhalb des Bands liegt, plus einer Einreichungs-Checkliste je Bundesstaat. Wenn eine Variable durchfällt, gibt das Tor NOT FILING-READY aus, benennt den schlimmsten Verstoß und leitet ihn zur menschlichen versicherungsmathematischen Begründung weiter. Ablehnung als Default: filing_ready genau dann, wenn null blockierende Befunde.

Die optionale LLM-Crew

Eine Pydantic-AI-Crew aus einem Faktor-Erklärer, einem Fairness-Justifier gepaart mit einem adversariellen Challenger und einem Verfasser des Einreichungs-Memos kann beraten, aber das Tor entscheidet. Kein API-Schlüssel ist erforderlich. Die Agenten enthalten sich, wenn keiner vorliegt, und die deterministische Demo bleibt unberührt. Jede vertrauenskritische Zahl lebt in schlichtem numpy außerhalb des Agenten-Frameworks.

Was die Demo auf echten Daten belegt

Harris County, TX. Echte OpenFEMA-NFIP-Schäden. Jede Zahl unten wird live berechnet.

Nebeneinanderliegende FloodProof-Karten desselben Harris-County-Portfolios. Links: Schäden eingefärbt nach FEMA-Hochwasserzonen-Stufe, Punktgröße gleich den real ausgezahlten Dollars. Rechts: dieselben Schäden eingefärbt nach KI-Kompositrisiko, mit goldenen Ringen, die FEMA-Fehltreffer markieren: Immobilien, die FEMA als sicher eingestuft hat und die das Komposit als hochriskant bewertet. Ein rotes Badge in der Ecke liest Compliance-Zertifikat NOT FILING-READY.
Dasselbe Portfolio, zwei Karten. Die FEMA-Zonen-Ansicht und die KI-Komposit-Ansicht derselben Harris-County-Schäden, wobei die goldenen Ringe Immobilien markieren, die FEMA als sicher eingestuft hat und die das Komposit als hochriskant kennzeichnet.
FloodProof-Out-of-Sample-Lift-Chart mit Headline-Stat-Karten: $3125.0M echte Gebäudeschäden außerhalb von FEMA-Hochrisikozonen ausgezahlt, 1.694x Komposit vs. FEMA-Zone Lift bei der Erfassung im obersten Dezil, 45.9% Anteil aller echten Schadendollars außerhalb von Hochrisikozonen, und 40,615 zurückgehaltene echte Schäden im Backtest. Ein Balkendiagramm vergleicht KI-Komposit gegen nur FEMA-Zone bei Erfassung von Schadendollars im obersten Dezil und Gini.
Das Out-of-Sample-Ergebnis: 1.694x Lift bei der Erfassung im obersten Dezil auf 40,615 zurückgehaltenen Schäden, Gini 0.31 vs 0.08.

Auf den 40,615 zurückgehaltenen echten Schäden erfasst das Komposit 1.69x der Schadendollars im obersten Dezil der FEMA-Zonen-Baseline, mit Gini 0.31 gegen 0.08 der Zone. Weil der Score auf Train gefittet und auf dem Hold-out-Split gelesen wird und Baseline und Label beide unabhängig vom Modell sind, ist dies ein echtes Out-of-Sample-Ergebnis und kein selbstbenotetes.

Der Lift bleibt über Zufalls-Seeds hinweg robust etwa im Bereich 1.69x bis 1.85x, es ist also kein Glücks-Split. Der Geltungsbereich ist ein County-Portfolio und ein zurückgehaltener 30%-Split, und das sagen wir so.

Das Audit tut nicht so, als sei die KI das Problem. Der Kompositscore selbst besteht die 80%-Regel bei AIR 0.938, geprüft gegen reale CDC/ATSDR-SVI-Tracts. Aber der Screen läuft auf jeder bepreisten Variable, und 5 fallen durch: der schlimmste ist die Geschosszahl bei AIR 0.363, gefolgt von der Versicherungssumme bei 0.526 und, auffällig, FEMAs eigener Zonenstufe bei 1.467.

Ein Compliance-Risiko in den Daten zu erkennen, bevor der Prüfer es tut, ist der Wert. Das Tor verweigert dann die Markierung als einreichungsbereit und leitet den schlimmsten Verstoß, die Geschosszahl, zur menschlichen versicherungsmathematischen Begründung weiter.

FloodProof-Compliance-Zertifikat-Modal mit Markierung NOT FILING-READY. Eine Disparate-Impact-Tabelle prüft jede Rating-Variable gegen reale CDC/ATSDR-SVI-2022-Tracts: der Kompositscore besteht bei AIR 0.938, während 5 der bepreisten Variablen die 80%-Regel nicht erfüllen, schlimmste ist Geschosszahl bei 0.363, dann versicherte Gebäudedeckung bei 0.526 und FEMAs eigene Zonenstufe bei 1.467. Eine rote Zeile vermerkt, dass der schlimmste Verstoß Geschosszahl zur menschlichen versicherungsmathematischen Begründung weitergeleitet wird und der Tarif nicht automatisch genehmigt wird, mit einer DOI-Einreichungs-Checkliste je Bundesstaat darunter.
Das Disparate-Impact-Audit prüft jede bepreiste Variable. Das Komposit besteht bei 0.938; 5 Variablen fallen durch, einschließlich FEMAs eigener Zonenstufe.
FloodProof State-DOI-Filing-Dokument mit dem Titel KI-gestützter Hochwasser-Ratingfaktor für das Versicherer-Portfolio in Harris County, TX, gestempelt NOT FILING-READY. Es enthält ein versicherungsmathematisches Memorandum, eine Out-of-Sample-Backtest-Tabelle, die zeigt, dass das Komposit 1.694x der Schadendollars im obersten Dezil der FEMA-Zone erfasst mit Gini 0.31 vs 0.08 auf 40,615 echten Schäden, und eine Feature-Importance-Tabelle exakter linearer Shapley-Beiträge.
Das prüferfertige DOI-Einreichungspaket: versicherungsmathematisches Memorandum, der Out-of-Sample-Backtest und Merkmalsattribution, erzeugt oder blockiert vom Tor.

Wo FloodProof ehrlich hineinpasst

Dies ist eine Demo des Mechanismus, keine eingesetzte Pipeline. Hier ist genau, was real ist und was ein Stub.

Komponente In dieser Demo Status
Schäden, Demografie, Geografie OpenFEMA FimaNfipClaims (170,803 Datensätze, 135,381 bewertet), CDC/ATSDR SVI 2022, Census Gazetteer 2023 Echt, öffentlich, kein API-Schlüssel
Scoring, Backtest, Fairness-Audit, Tor Ridge-Komposit, Out-of-Sample-Lift und Gini, Disparate-Impact-Screen, deterministisches Policy-Tor Echt, schlichtes numpy und Python
Vendor-Signal-Feeds (ZestyAI Z-FLOOD, ICEYE SAR-depth) Adapter hinter einem echten Schema, auf dem Bildschirm als Stubs ausgewiesen Stub, dokumentierter Produktionsaustausch
Guidewire- / Duck-Creek-Connector Warmes Cached-Lookup an /api/score, Rückgabe in unter 50 ms Stub, keine Live-Integration
Pydantic-AI-Crew (Faktor-Erklärer, Fairness-Justifier, Memo-Verfasser) Nur beratende Narrative; enthält sich ohne API-Schlüssel Optional, beratend, entscheidet nie
FloodProof-Ratingfaktor-Arbeitsblatt für einen Harris-County-Tract, mit aufgeklapptem Steuerelement Fetch rating factor via Guidewire connector. Das Konsolenlog kennzeichnet es als Stub guidewire-integration-data-manager und gibt einen Komposit-Ratingfaktor aus einem warmen Cached-Lookup zurück, in der UI als Stub statt als Live-Integration ausgewiesen.
Die Inline-Quote-Bind-Story ist konkret, aber ehrlich: der Guidewire-Connector ist ein gestubtes Cached-Lookup, in der UI als solches gekennzeichnet.

Was diese Demo nicht tut

  • Sie betreibt keinen Live-Feed von ZestyAI, ICEYE, First Street, Guidewire oder Duck Creek. Das sind Stubs.
  • Sie behauptet keine DOI-Compliance oder Zertifizierung. Das Einreichungspaket ist ein Evidenzartefakt, keine Rechtsberatung, und kein Prüfer hat irgendetwas genehmigt.
  • Sie präsentiert keine modellierte jährliche Dollar-Leckage-Zahl. Die ehrliche Leitzahl sind die realen, unmodellierten $3.1B, die außerhalb von FEMA-Hochrisikozonen ausgezahlt wurden, plus der Out-of-Sample-Lift.
  • Sie nutzt keine externen Raster (undurchlässige Oberfläche, DEM, NOAA Atlas-14). Das Komposit verwendet OpenFEMAs eigene echte Gebäudeattribute; Raster sind eine dokumentierte künftige Anreicherung.
  • Es gibt keine Kunden, Versicherer, Deployments, Testimonials oder ROI. Kein namentlich genannter Versicherer hat dies genutzt. Es ist eine Demo des Mechanismus auf einem County-Portfolio.
  • Sie gibt nicht vor, das eigene Modell sei verzerrt. Das Komposit besteht die 80%-Regel bei AIR 0.938; der Punkt ist, dass Audit und Tor die durchfallenden Variablen abfangen.

Fragen, die Underwriter und Compliance-Teams stellen

Ersetzt das die Hochwassermodelle, die wir bereits kaufen, etwa ZestyAI oder ICEYE?

Nein. FloodProof ist kein weiteres Hochwassermodell, das mit ZestyAI oder ICEYE konkurriert. Es ist die Integrations- und Nachweisschicht, die um jedes Modell sitzt, das Sie nutzen: ein nicht-zirkulärer Out-of-Sample-Backtest gegen die echte FEMA-Zonen-Baseline, ein Disparate-Impact-Audit auf jeder bepreisten Variable und ein deterministisches Tor, das das prüferfertige DOI-Einreichungspaket erzeugt oder es blockiert. Dieser Wert gilt bei jeder Modellqualität, weil ein besseres Modell, das sich selbst benotet, kein Nachweis ist und ein besseres Modell, das demografisches Signal trägt, eine Einreichung ist, die Ihr Prüfer ablehnt.

Woher wissen Sie, dass der Lift des Komposits gegenüber der FEMA-Zone nicht bloß Overfitting ist?

Der Backtest ist konstruktionsbedingt nicht-zirkulär. Das Komposit wird auf einem 70%-Train-Split gefittet und auf den zurückgehaltenen 30% bewertet, die es nie gesehen hat, die Baseline ist die echte von FEMA eingestufte Zone, und das Label sind die real ausgezahlten Schadendollars. Baseline und Label sind beide unabhängig vom Modell, und die versicherte Deckung ist bewusst ausgeschlossen, damit der Score nicht über die Zahlungsgrenze mogeln kann. Auf 40,615 zurückgehaltenen echten NFIP-Schäden erfasst das Komposit 1.69x der Schadendollars im obersten Dezil der FEMA-Zonen-Baseline (Gini 0.31 vs 0.08), und das Ergebnis bleibt über Zufalls-Seeds hinweg grob im Bereich 1.69x bis 1.85x.

Was tut das Tor tatsächlich, wenn eine Rating-Variable die 80%-Regel nicht erfüllt?

Es verweigert die Markierung als einreichungsbereit. Das Policy-Tor ist deterministisches Python mit einer Invariante: filing_ready genau dann, wenn es null blockierende Befunde gibt. Auf diesem Harris-County-Portfolio besteht der Kompositscore selbst die 80%-Regel bei AIR 0.938, aber das Audit kennzeichnet 5 bepreiste Variablen, die durchfallen, schlimmste ist die Geschosszahl bei AIR 0.363. Das Tor gibt NOT FILING-READY aus, benennt den schlimmsten Verstoß und leitet ihn zur menschlichen versicherungsmathematischen Begründung weiter, statt einen diskriminierenden Tarif auszuliefern. Agenten beraten, Code entscheidet.

Läuft das auf echten Schadendaten oder auf einer synthetischen Stichprobe?

Echt. Die Demo läuft auf 170,803 rohen OpenFEMA-NFIP-Schadendatensätzen für Harris County, Texas, von denen 135,381 mit einem ausgezahlten Gebäudeschaden bewertet werden, plus echter CDC/ATSDR-SVI-2022-Tract-Demografie und dem Census Gazetteer 2023. Es sind öffentliche Daten ohne API-Schlüssel, beim ersten Lauf gecacht. Ein ehrlicher Vorbehalt, den die Demo auf dem Bildschirm ausweist: FEMA zensiert Schadens-Geokoordinaten grob auf den Tract-Zentroid, sodass der Backtest in der Auflösung läuft, die öffentliche Daten erlauben.

Sind die Vendor-Feeds und der Guidewire-Connector in dieser Demo live?

Nein, und die Demo sagt das auf dem Bildschirm. Die ZestyAI-Z-FLOOD- und ICEYE-SAR-depth-Feeds und der Guidewire Integration Data Manager Connector sind Stubs hinter einem echten Schema. Der Connector-Endpunkt ist ein warmes Cached-Lookup, das in unter 50 ms zurückkehrt, um die Inline-Quote-Bind-Integration konkret zu machen. Der Produktionsweg ist der dokumentierte Config-Tausch, kein Rewrite, und die ehrliche Aussage ist ein Stub, keine Live-Integration.

Bedeutet ‚ein Ratingfaktor, den Ihr DOI-Prüfer genehmigen kann‘, dass es zertifiziert konform ist?

Nein. Das DOI-Einreichungspaket ist ein Evidenzartefakt, ein versicherungsmathematisches Memorandum, der Out-of-Sample-Backtest, Merkmalsattribution und eine Checkliste je Bundesstaat, keine Zertifizierung und keine Rechtsberatung. ‚Prüfer kann genehmigen‘ ist das Designziel, keine Garantie, dass irgendein Prüfer irgendetwas genehmigt hat. Kein Versicherer hat dies in Produktion genutzt, und es gibt keine Deployments, Kunden oder Fallstudien. Da 24 oder mehr Bundesstaaten das NAIC AI Model Bulletin übernehmen, ist der Punkt, dass das Tor den Nachweis erzeugt, den ein Prüfer verlangt, und ehrlich scheitert, wenn die Daten eine Einreichung nicht tragen.

Technische Forschung

Die Forschung hinter dieser Demo — die Architektur, das Verifikationsdesign und der Enterprise-Blueprint.

Wenn Sie Hochwasserrisiko bepreisen, würden wir uns gern austauschen

Die FEMA-Zone lässt Milliarden außerhalb ihrer Linien, und die Fairness-Prüfung ist jetzt Teil der Einreichung.

Wenn Ihr Team herausarbeitet, wie ein KI-Ratingfaktor vor einen DOI-Prüfer gebracht werden kann, ohne eine Variable auszuliefern, die die 80%-Regel nicht erfüllt, würden wir wirklich gern hören, wie Sie darüber denken. Das Problem ist branchenweit, und die Antworten werden es auch sein.

Portfolio-Bepreisung und Fairness-Bewertung

  • ✓ Nicht-zirkulärer Out-of-Sample-Backtest gegen Ihre FEMA-Zonen-Baseline
  • ✓ Disparate-Impact-Audit auf jeder bepreisten Variable
  • ✓ Wo die Zonenkarte Ihr Portfolio falsch bepreist, in Schadendollars
  • ✓ Eine Einschätzung, welche Variablen eine DOI-Prüfung nicht bestehen würden

Aufbau von Rating- und Einreichungsengine

  • ✓ Komposit-Ratingfaktor auf Ihren echten Attributen und Vendor-Feeds
  • ✓ Deterministisches Policy-Tor: filing_ready, wenn null blockierende Befunde
  • ✓ Prüferfertiges DOI-Einreichungspaket mit Checklisten je Bundesstaat
  • ✓ Guidewire- oder Duck-Creek-Connector, Config-Tausch statt Rewrite
Social

Auch veröffentlicht auf