Claims Evidence Firewall

Authentifiez les preuves de sinistre d'assurance avant d'évaluer les dommages

Une barrière d'authentification forensique pour les sinistres d'assurance automobile. Elle ingère le dossier de sinistre, exécute un crew forensique multi-agents, et une barrière de politique déterministe décide de l'orientation : AUTO-PROCEED, SIU-REFERRAL, HUMAN-REVIEW ou ABSTAIN. Le cas pour lequel elle est conçue est celui que votre détecteur de deepfakes laisse passer : une photo réelle recyclée d'un sinistre déjà réglé. Les agents conseillent, le code décide, et chaque décision est inscrite dans un registre infalsifiable.

35 / 35

Fraudes recyclées et metadata-spoofed détectées qu'un détecteur à signal unique rate (0 / 35)

Benchmark synthétique étiqueté de 120 sinistres

0.0%

Taux de fausse accusation : sinistres sains orientés à tort vers le SIU

0 sur 47 sinistres sains, même benchmark synthétique

100%

Décisions portant un enregistrement vérifiable chaîné par hachage

Couverture d'intégrité d'audit, montrée en direct par la rupture de chaîne

Une démonstration exécutable du mécanisme sur des sinistres synthétiques et un index historique synthétique. Le pipeline complet et l'exécution à l'écran fonctionnent hors ligne, sans clé API ; les analystes narratifs en direct sont la partie optionnelle.

La fraude qui bat votre détecteur n'est pas un faux. Elle est recyclée.

Du volume sans vérification, et une chaîne de conservation que vous ne pouvez pas défendre au tribunal.

Les assureurs sont submergés de preuves de sinistre manipulées et recyclées, et la plupart de la détection est fragmentée et a posteriori : un détecteur de deepfakes tiers exécuté après le dépôt, pas une barrière à l'intérieur du pipeline. Un détecteur d'authenticité isolé a deux faiblesses structurelles à la fois. Il se périme dès que les générateurs s'améliorent, et il est aveugle à la plus ancienne fraude du livre, une photo de caméra authentique extraite d'un sinistre antérieur déjà réglé, parce que cette photo passe tous les tests d'authenticité en étant réelle. Séparément, si une étape d'« enhancement » génératif ou de mise à l'échelle écrase l'image originale du sinistre, l'assureur s'expose à un risque de spoliation en contentieux.

Les signaux du marché sont difficiles à ignorer. Dans le State of Insurance Fraud 2026 (Verisk, 2026), 98 pour cent des assureurs signalent une recrudescence des médias manipulés, 36 pour cent des consommateurs disent qu'ils modifieraient une image de sinistre, et seulement 32 pour cent des assureurs se sentent très confiants pour détecter les deepfakes, pourtant 65 pour cent s'appuient sur un détecteur IA tiers et 44 pour cent s'en remettent encore à la revue manuelle. Les tentatives de fraude par deepfake ont augmenté de 2,137 pour cent en trois ans (Facia.ai), et un assureur automobile britannique a vu une hausse de 300 pour cent des images de véhicules manipulées par l'IA en une seule année (The Guardian et Milliman). Un seul sinistre contesté allant jusqu'au contentieux coûte 30,000 to 75,000 dollars.

Le mur réglementaire est arrivé en même temps. Un Model Bulletin de la NAIC sur l'usage de l'IA a été adopté par 24 États, le Colorado AI Act entre en vigueur le 30 juin 2026, et l'échéance haut risque de l'EU AI Act tombe en août 2026, avec des amendes jusqu'à 35 millions d'euros ou 7 pour cent du chiffre d'affaires mondial. Externaliser l'IA n'externalise pas la responsabilité. Cela fait de la piste d'audit derrière une décision automatisée ce qui rend la décision défendable, pas un plus facultatif.

Un crew forensique conseille, une barrière de politique déterministe décide

L'authentification est une barrière, pas un rapport. La frontière de confiance est du code brut, jamais une auto-déclaration d'un LLM.

Le pipeline est direct : un dossier de sinistre passe par une extraction déterministe des signaux, un crew forensique conseille, une barrière de politique renvoie l'orientation, et un registre de preuves chaîné par hachage l'enregistre. Le principe de conception est que des flux de preuves indépendants se corroborent, et qu'on ne fait confiance à aucun analyste pour noter la décision sur laquelle il a conseillé.

Extraction déterministe des signaux

Du code brut, de vrais signaux. Un SHA-256 de l'original est pris à l'ingestion et ajouté au registre chaîné par hachage. Les métadonnées EXIF et de capture sont analysées, et un hachage perceptuel de 256 bits (un average hash 16 par 16, appelé pHash dans le code) exécute une recherche du plus proche voisin sur un index historique de sinistres d'environ 200 enregistrements. Les métadonnées sont confrontées au sinistre pour la cohérence de l'appareil, du GPS et de la date. L'original n'est jamais muté, seuls des artefacts sidecar sont écrits.

Registre de preuves chaîné par hachage

Chaque décision est inscrite dans un enregistrement en ajout seulement, chaîné par hachage, par sinistre : le SHA-256 original, chaque constat d'analyste et sa confiance, la règle déclenchée, le modèle, la version et les horodatages, et une cartographie de conformité NAIC AIS-Program et EU AI Act. Il s'exporte en JSON et en HTML rendu. La routine verify-chain recalcule chaque lien et re-hache chaque original sur disque, de sorte que toute falsification apparaît comme une chaîne rompue.

Le crew forensique : quatre analystes et un Challenger contradictoire

Analyste Sur quoi il raisonne Base
Provenance Analyst Cohérence des métadonnées de capture, EXIF et d'attestation d'appareil par rapport à l'enregistrement du sinistre (appareil, GPS dans le périmètre du lieu du sinistre, date de capture). signaux réels, déterministes
Pixel-Forensics Analyst Un score d'artefact de bruit de capteur et de domaine fréquentiel. Ce signal est simulé, un substitut pour un futur modèle appris d'artefacts génératifs, et est étiqueté simulé partout où il apparaît à l'écran. signal simulé
Reuse Analyst Correspondances de hachage perceptuel contre l'index historique des sinistres, le signal qui attrape une photo réelle recyclée extraite d'un sinistre antérieur. pHash réel, déterministe
Narrative-Consistency Analyst Si le texte FNOL, les métadonnées et les dommages visibles cohèrent, par exemple un récit qui décrit un type d'impact tandis que l'image en montre un autre. Une véritable tâche de raisonnement transmodal. raisonnement LLM
Adversarial Challenger Un sceptique invité à réfuter chaque signalement et à disculper l'assuré, de sorte que seuls les signalements qui survivent tiennent et qu'un assuré légitime ne soit pas faussement accusé. raisonnement LLM

La barrière de politique : le code décide

En dehors des agents, du code brut agrège les verdicts typés des analystes et les signaux bruts contre les seuils configurés de l'assureur en une seule décision d'orientation reproductible : AUTO-PROCEED, SIU-REFERRAL, HUMAN-REVIEW ou ABSTAIN, où ABSTAIN oriente vers HUMAN-REVIEW. La barrière est la frontière de confiance. Elle est déterministe, donc le même sinistre produit la même décision à chaque exécution, ce qui la rend défendable auprès d'un régulateur d'une façon dont une auto-déclaration d'un LLM ne l'est pas. Les rôles narratif et challenger passent par un adaptateur interchangeable de fournisseur (Anthropic, OpenAI ou Gemini, défaut claude-opus-4-8) ; sans clé définie, ils basculent vers un stub hors ligne déterministe, et la barrière ne change jamais de mains.

Sinistres traités, à l'écran

Tous les sinistres, les images et l'index historique sont synthétiques, construits pour la démonstration. Aucune photo de sinistre réelle, aucun assuré, assureur ou compte n'est utilisé.

La file d'intake FNOL

Quatre sinistres synthétiques de premier avis de sinistre arrivent en attente de vérification. La console cadre le travail clairement : un fraudeur peut générer par diffusion un pare-chocs enfoncé ou recycler une photo réelle d'un sinistre réglé, et un outil d'évaluation des dommages notera volontiers l'un ou l'autre. La barrière vérifie si les preuves d'un sinistre peuvent être fiables avant qu'il ne soit évalué ou indemnisé.

La file d'intake FNOL du Claims Evidence Firewall listant quatre sinistres auto synthétiques, de CLM-A-1042 à CLM-D-1045, chacun avec assuré, type de sinistre, score de gravité, et un statut En attente de vérification.
La file d'intake : quatre sinistres entrent dans le pipeline forensique avant toute évaluation des dommages.

La photo réelle recyclée qu'un détecteur unique laisse passer

Le sinistre CLM-C-1044 est le cas pour lequel le firewall est conçu. Son image est une photo de caméra authentique, donc la provenance et la pixel-forensics passent toutes les deux, ce qui est exactement là où un détecteur de deepfakes isolé s'arrête et le laisse passer. Le Reuse Analyst fait correspondre son hachage perceptuel à un sinistre antérieur réglé et le Narrative Analyst voit que le récit et l'image sont en désaccord, donc la barrière de politique déterministe l'oriente vers SIU-REFERRAL à une confiance de 0.96, avec un marqueur Duplicate image, matches prior claim sur les preuves. La détection à signal unique laisse passer ceci ; la forensique multi-signaux l'attrape, et ce résultat ne dépend pas du signal simulé.

Le sinistre CLM-C-1044 déplié pour montrer l'image de preuve tamponnée Flagged SIU avec un marqueur Duplicate image, matches prior claim, les détails du premier avis de sinistre, le pipeline forensique en neuf étapes, et un verdict Referred to Special Investigations à une confiance de 0.96 décidé par la barrière de politique déterministe.
CLM-C-1044 : une photo réelle, recyclée. La barrière de politique l'oriente vers le SIU sur les signaux de réutilisation et narratifs.

Pourquoi le crew bat un classifieur

L'analyse de décision rend la corroboration visible. La provenance se lit cohérente et la Pixel-Forensics se lit cohérente et est étiquetée simulée, toutes deux vertes. Reuse et Narrative-Consistency sont signalés, et le Challenger contradictoire a testé deux signalements et les deux ont survécu. La raison de l'orientation est nommée en termes clairs : le hachage perceptuel correspond au sinistre antérieur HIST-4019 (Maple Mutual, 2025-11-29) à une distance de Hamming de 0. Un détecteur de deepfakes unique parfait n'aurait pas pu attraper ceci, parce que rien dans la photo n'est faux.

Le panneau Decision analysis pour CLM-C-1044 montrant quatre verdicts d'analystes : Provenance Analyst cohérent, Pixel-Forensics Analyst cohérent et simulé avec un score d'artefact de 0.06, Reuse Analyst signalé, et Narrative-Consistency Analyst signalé parce que le récit et la photo sont en désaccord, avec une note que le challenger contradictoire a testé deux signalements et que deux ont survécu, et une ligne why-this-route citant une correspondance de hachage perceptuel avec le sinistre antérieur HIST-4019.
Quatre verdicts d'analystes, un contrôle contradictoire, et une raison nommée. La preuve derrière l'orientation SIU.

L'écart de couverture, mesuré par benchmark

Exécuter chaque sinistre du jeu synthétique étiqueté de 120 sinistres fait apparaître le résultat durable. Sur les 35 fraudes qui ne portent aucun artefact d'authenticité, les 20 recycled-real et les 15 metadata-spoofed, une baseline d'authenticité à signal unique en attrape 0 et le firewall les attrape tous les 35, parce que ce sont de vraies photos qu'un détecteur isolé laisse passer et que c'est la forensique multi-signaux qui referme l'écart. Les sinistres sains passent en traitement direct à un taux de fausse accusation de 0 pour cent, chaque décision porte un enregistrement d'audit vérifiable, et le rappel d'orientation de la fraude par rapport aux étiquettes de vérité terrain se lit 1.00. Ce sont des chiffres sur un jeu synthétique fixe et étiqueté dont les classes de fraude portent des signatures détectables par construction, pas une garantie en monde ouvert, donc le chiffre à mettre en avant est l'écart de couverture par rapport à l'approche en place qu'incarne un détecteur isolé.

Le panneau de benchmark sur 120 sinistres étiquetés montrant des cartes de métriques pour 100 pour cent de sains en traitement direct, 100 pour cent de décisions avec un enregistrement d'audit vérifiable, 0 pour cent de taux de fausse accusation, et un rappel d'orientation de la fraude de 1.00, au-dessus d'une ligne d'écart de couverture indiquant 0 of 35 attrapés par un détecteur à signal unique contre 35 of 35 attrapés par le firewall, avec une note que ce sont de vraies photos qu'un détecteur d'authenticité isolé laisse passer.
0 of 35 versus 35 of 35 : l'écart de couverture qu'une baseline à signal unique laisse ouvert, refermé par le crew.

La spoliation, devenue une ligne rouge

Chaque décision lie l'image originale dans une chaîne en ajout seulement, infalsifiable. Modifier un original stocké, ce qu'une enhancement générative ou une fraude fait, rompt cette chaîne. Falsifiez un original laissé passer et re-vérifiez, et la ligne de CLM-A-1042 devient rouge comme Altered, spoliation, tandis que les lignes scellées restent vertes, et le vérificateur rapporte chain broken, tampering detected. Un risque contentieux habituellement abstrait devient quelque chose que l'acheteur peut voir se produire.

La vue chaîne de conservation du Evidence Certificate après falsification de l'original de CLM-A-1042 : sa ligne est rouge indiquant Altered et spoliation avec l'original sur disque marqué Altered, spoliation, tandis que les lignes CLM-B, CLM-C et CLM-D indiquent Sealed et Unaltered, et une ligne de statut indique chain broken, tampering detected.
La rupture de chaîne : verify-chain re-hache chaque original sur disque et signale celui qui est altéré comme spoliation.

Où se situe le firewall, et où il ne se situe pas

Il s'exécute avant l'évaluation des dommages et en amont d'outils comme Tractable et CCC. Il authentifie ce qu'ils évaluent ; il ne leur fait pas concurrence.

Préoccupation Un détecteur de deepfakes à signal unique Claims Evidence Firewall
Photo réelle recyclée Laissée passer, parce que la photo est authentique Attrapée sur les signaux de réutilisation par hachage perceptuel et narratifs
Qui décide de l'orientation Un seuil sur un seul score de modèle Une barrière de politique déterministe hors du modèle
Preuves minces ou contradictoires Forcé à un succès ou un échec S'abstient vers HUMAN-REVIEW plutôt que de bluffer
Accuser à tort un assuré Aucun contrôle intégré Un Challenger contradictoire ne laisse tenir que les signalements qui survivent
Chaîne de conservation Non traité Registre chaîné par hachage, la falsification apparaît comme une chaîne rompue
Piste d'audit Un score, pas un enregistrement Un enregistrement de preuves JSON et HTML avec une cartographie NAIC et EU AI Act

Ce que cette démonstration ne fait pas

  • Elle ne se connecte pas aux systèmes live des assureurs. Les connecteurs Guidewire ClaimCenter et Duck Creek, un SDK mobile de capture guidée, un véritable vérificateur C2PA, et une véritable base d'empreintes caméra PRNU sont stubbés ou différés.
  • Le signal de pixel-forensics est simulé et étiqueté comme tel à l'écran, un substitut pour un futur modèle appris d'artefacts génératifs. Le différenciateur de photo recyclée ne s'appuie pas dessus.
  • Elle n'évalue pas les dommages, n'estime pas le coût de réparation, et ne remplace pas Tractable ni CCC. Le score de gravité de l'assureur est accepté comme un champ d'entrée, pas calculé ici.
  • Chaque sinistre, image, assuré, assureur et l'index historique est synthétique. Aucune photo de sinistre réelle, aucun système live d'assureur, ni compte externe n'est utilisé.
  • Les chiffres du benchmark portent sur un jeu synthétique fixe et étiqueté de 120 sinistres dont les classes de fraude portent des signatures détectables par construction. Les affirmations honnêtes sont l'écart de couverture par rapport à une baseline à signal unique, 0 pour cent de fausse accusation, et 100 pour cent d'intégrité d'audit sur ce jeu, pas zéro fraude ni une détection parfaite en monde ouvert.
  • La cartographie NAIC et EU AI Act est un enregistrement de conformité que le système produit, pas une certification, une validation d'audit, ni une garantie juridique.

Questions que posent les acheteurs

En quoi est-ce différent du détecteur de deepfakes que nous faisons déjà tourner ?

Un détecteur d'authenticité à signal unique pose une seule question : cette image a-t-elle été générée ou altérée. Il se périme à mesure que les générateurs s'améliorent, et il est structurellement aveugle à une photo réelle recyclée d'un sinistre antérieur, parce que cette photo passe tous les tests d'authenticité en étant authentique. Le firewall corrobore plutôt quatre signaux indépendants, la provenance, la réutilisation historique par hachage perceptuel, la cohérence narrative, et un signal de pixel-forensics simulé, de sorte que la photo réelle recyclée qu'un détecteur isolé laisse passer est tout de même attrapée sur les signaux de réutilisation et narratifs. Sur le benchmark synthétique étiqueté de 120 sinistres, une baseline à signal unique a attrapé 0 des 35 fraudes sans signal d'authenticité et le firewall les a attrapées toutes les 35.

Est-ce que cela remplace Tractable ou CCC pour l'évaluation des dommages ?

Non. Il authentifie les preuves avant l'évaluation des dommages, il n'estime pas le coût de réparation et ne remplace pas un expert. Le score de gravité existant de l'assureur est accepté comme un champ d'entrée, pas recalculé ici. Voyez-le comme une barrière qui décide si les preuves d'un sinistre peuvent être fiables, en amont des outils qui évaluent ce que les preuves montrent.

L'IA prend une décision de fraude. Comment la défendons-nous auprès d'un régulateur ?

Les agents ne font que conseiller. La décision d'orientation est prise par une barrière de politique déterministe écrite en code brut, hors du modèle de langage, qui agrège les verdicts typés des analystes et les signaux bruts contre vos seuils configurés en un seul résultat reproductible. Le même sinistre produit la même décision à chaque exécution, et chaque décision est inscrite dans un registre de preuves en ajout seulement, chaîné par hachage, avec modèle, version et horodatages et une cartographie de conformité NAIC et EU AI Act. Cette cartographie est un enregistrement que le système produit, pas une certification ni une validation juridique.

Que fait-il lorsque les preuves sont trop minces pour décider ?

Il s'abstient vers un humain plutôt que de bluffer un succès ou une accusation. Une image basse résolution avec des métadonnées partielles oriente vers ABSTAIN, puis HUMAN-REVIEW, marquée comme nécessitant une preuve. Un Challenger contradictoire s'exécute aussi sur chaque sinistre, invité à réfuter chaque signalement et à disculper l'assuré, de sorte que seuls les signalements qui survivent à l'examen tiennent et qu'un assuré légitime ne soit pas faussement accusé. Sur le benchmark, 0 des 47 sinistres sains ont été orientés vers le SIU.

Peut-il s'intégrer à Guidewire ClaimCenter ou Duck Creek dès aujourd'hui ?

Pas dans cette démonstration. Les connecteurs Guidewire ClaimCenter et Duck Creek, un SDK mobile de capture guidée, un véritable vérificateur C2PA, et une véritable base d'empreintes caméra PRNU sont stubbés ou différés. Le signal de pixel-forensics est simulé et étiqueté comme tel à l'écran, un substitut pour un futur modèle appris d'artefacts génératifs. Ce qui s'exécute aujourd'hui est la vraie logique forensique : la chaîne SHA-256, l'analyse EXIF, la recherche de réutilisation par hachage perceptuel, le raisonnement narratif, la barrière de politique, et le registre, le tout sur des sinistres synthétiques et un index historique synthétique.

Ces chiffres de benchmark sont-ils une précision en conditions réelles ?

Non, et nous le disons avec soin. Les chiffres de couverture 35 of 35, 0 pour cent de fausse accusation, et 100 pour cent d'intégrité d'audit portent sur un benchmark synthétique fixe et étiqueté de 120 sinistres dont les classes de fraude portent des signatures détectables par construction, donc l'orientation parfaite sur ce jeu est une propriété de ce jeu construit, pas une garantie en monde ouvert. Le chiffre qui mérite d'être mis en avant est l'écart de couverture par rapport à une véritable approche en place : une baseline à signal unique attrape 0 des 35 fraudes recycled-real et metadata-spoofed, et le firewall multi-signaux les attrape toutes les 35. Les affirmations durables sont le 0 pour cent de fausse accusation et le 100 pour cent d'intégrité d'audit, qui tiennent tous deux à n'importe quelle qualité de modèle.

Recherche technique

La recherche derrière cette démonstration — l'architecture, la conception de la vérification, et le blueprint d'entreprise.

Authentifiez les preuves avant d'évaluer les dommages

Une barrière forensique pour les preuves de sinistre, avec une piste d'audit qui tient.

Si vos équipes sinistres et SIU pèsent comment authentifier les preuves de sinistre sans accuser à tort les assurés légitimes, et comment garder la décision automatisée défendable sous les bulletins NAIC et l'EU AI Act, nous aimerions vraiment entendre comment vous y réfléchissez. Le problème est à l'échelle de l'industrie et les réponses le seront aussi.

Évaluation de l'intégrité des preuves

  • ✓ Cartographier où les preuves recyclées et manipulées entrent dans votre intake
  • ✓ Définir les seuils d'orientation pour AUTO-PROCEED, SIU et abstain
  • ✓ Examiner l'exposition à la spoliation et à la chaîne de conservation en contentieux
  • ✓ Une barrière de politique reproductible que votre conseil conformité peut valider

Construire avec nous

  • ✓ Un crew forensique multi-signaux et une barrière de politique déterministe
  • ✓ Un registre de preuves chaîné par hachage avec détection de falsification verify-chain
  • ✓ Un enregistrement de preuves prêt pour le tribunal avec une cartographie NAIC et EU AI Act
  • ✓ Des connecteurs et un modèle d'artefacts appris sur la feuille de route, pas factices