Bureau voor kredietbeoordeling met dossiers, aanbevelingenbakje, geopende beleidsmap en hand met besluitenenvelop.
Kunstmatige intelligentieMachine learningSoftware engineering

Een AI-leningaanbeveling vereist een afzonderlijke vrijgaveregel

Ashutosh SinghalAshutosh Singhal2 augustus 20267 min

Een leningaanbeveling kan redelijk klinken en tegelijkertijd in strijd zijn met het beleid dat zij behoort te volgen. Ik wil dat de beslissing om die aanbeveling vrij te geven een eigen, inspecteerbare grondslag heeft. Als de uitleg en de bevoegdheid om te handelen uit dezelfde reactie voortkomen, moet een beoordelaar beide ontwarren alvorens te bepalen wat doorgang kan vinden.

De ontwerpvraag is wat er moet gebeuren wanneer een AI-aanbeveling niet door een controle komt. Het model vragen het opnieuw te proberen kan een onvolledig antwoord herstellen. Het aanhouden van de aanbeveling kan noodzakelijk zijn wanneer deze een regel overtreedt. Dat zijn verschillende interventies, met verschillende kosten. Een effectieve scheidslijn maakt dit verschil zichtbaar voordat een van beide een automatische reflex wordt.

Een redelijke uitleg kan de verkeerde uitkomst ondersteunen

In The Validation Firewall van Veriprajna adviseert een vastgelegde modeluitvoer goedkeuring voor een synthetische leningaanvrager met een kredietscore van 559. Het geconfigureerde beleid vereist minimaal 620. De aanbeveling voldoet evenmin aan de beleidscriteria voor schuld-inkomensverhouding (debt-to-income), lening-waarde-verhouding (loan-to-value) en recente betalingsachterstanden.

Dit zijn gecachete modelreacties op synthetische dossiers, opnieuw afgespeeld via de controles zonder nieuwe inferentie. Ze tonen het gedrag van dit voorbeeld, geen benchmark voor modelnauwkeurigheid of bewijs van echte kredietnemers. De leenworkflow en routering zijn gesimuleerd.

De uitleg is verhelderend. Deze stelt dat het aangeleverde beleid niet voorziet in de vereiste sleutels voor toegestane hoofdredenen die nodig zijn voor een afwijzing. Dat legt een reële beperking van het invoercontract bloot: de modelprompt van de demo levert weliswaar de kredietcriteria, maar laat de lijst met toegestane redenen weg die het model moet gebruiken. De reactie van het model verdient het om in die context begrepen te worden. Het vormt geen eerlijke maatstaf om modellen te rangschikken.

Het maakt de goedkeuring echter geenszins consistent met de vastgelegde kredietcriteria. Ontbrekende instructies om een afwijzing te motiveren veranderen immers niets aan de kredietscore van de aanvrager of de ondergrens van het beleid. Een modelreactie kan een probleem correct identificeren en toch een uitkomst aanbevelen die een andere eis schendt.

Synthetisch aanvraagdetail met een APPROVE-modeluitvoer en een BLOCK-resultaat uit de beleidsconsistentiecontrole.
De vastgelegde modeluitvoer adviseert goedkeuring, terwijl de afzonderlijke beleidscontrole de geschonden criteria registreert. De juridisch klinkende controlelabels dekken geselecteerde geprogrammeerde controles, geen alomvattende juridische toetsing.

Ik geef hier de voorkeur aan een afzonderlijke beleidsevaluatie omdat deze dat onderscheid in stand houdt. Het model kan toelichten waarom zijn taak lastig was. De controle kan aantonen waarom deze aanbeveling niet aan de verstrekte regel voldoet. Een beoordelaar kan beide inspecteren zonder een overtuigende uitleg op te vatten als toestemming om de beleidsregel aan te passen.

Die scheiding maakt herstel ook doelgerichter. Het verbeteren van de redenenlijst in de prompt herstelt het responsvoorwaardencontract. Het wijzigen van een beleidsondergrens is een wezenlijk ander besluit dat een eigen rechtvaardiging vereist. Herhaaldelijk om een overtuigendere uitleg vragen kan niet beslechten welk beleid van toepassing moet zijn.

Opnieuw proberen en menselijke toetsing lossen verschillende problemen op

Neem een hypothetische productieworkflow die dit patroon hanteert. Er arriveert een afwijzingsreactie zonder de vereiste gestructureerde reden. Eén optie is om een gecorrigeerde reactie te vragen en de ontbrekende instructies mee te geven. Een andere optie is om het dossier direct naar een menselijke beoordelaar te sturen. Het eerste kan passend zijn voor een herstelbaar opmaak- of invoerprobleem; het tweede behoudt de aandacht voor gevallen waarin het onderliggende besluit oordeelsvorming vereist.

Ik geef de voorkeur aan een begrensde retry wanneer het mankement specifiek is, de invoer kan worden gecorrigeerd en de vervangende reactie dezelfde controles doorloopt. De eerdere reactie moet beschikbaar blijven naast haar vervanger. Anders kan een latere smetteloze reactie verhullen dat het oorspronkelijke contract faalde. Dit is een ontwerpaanbeveling, geen functionaliteit voor retry of versiebehoud die door dit prototype wordt gedemonstreerd.

De beleidsschendende goedkeuring vraagt om een heel andere aanpak. Een retry kan wellicht een beleidsconsistente aanbeveling opleveren, maar de oorspronkelijke goedkeuring moet aangehouden blijven. De vrijgavevoorwaarde moet verwijzen naar een nieuw gecontroleerd resultaat. Die mag niet luiden: 'het model heeft tweemaal geantwoord' of 'de uitleg leest nu beter'. Als de casus een uitzondering op het beleid vereist, moet een geautoriseerd uitzonderingsproces die bevoegdheid verlenen.

Deze keuze brengt kosten met zich mee. Alles aanhouden voor menselijke beoordeling legt beslag op de capaciteit van beoordelaars en vertraagt dossiers die met gecorrigeerde invoer direct opgelost kunnen worden. Elke fout opnieuw proberen verbruikt rekenkracht en kan een reeks aannemelijke alternatieven opleveren zonder de geldende regel vast te stellen. De doorslaggevende scheidslijn is of het gebrek kan worden hersteld binnen het bestaande besliscontract of dat iemand dat contract moet wijzigen.

De feitelijke uitkomsten van het prototype zijn nauwer afgebakend. Een mislukte controle met blokkerende ernst levert BLOCK op. Een fout met escalatie-ernst levert ESCALATE op als geen blokkade voorrang heeft. Slagen voor alle vier de afzonderlijke controles levert AUTO-CLEAR op. Deze labels leggen het resultaat van de geconfigureerde poort vast. Ze tonen geen voltooide menselijke toetsing aan en vormen geen vrijgave van een definitief kredietbesluit in productie.

Een geslaagde controle vereist een dekkingsverklaring

De volgende complicatie betreft wat een geslaagd resultaat redelijkerwijs kan betekenen. Een externe controle kan deterministisch zijn en toch wezenlijke vragen onbeantwoord laten. De precisie van de regel bewijst niet de volledigheid van de dekking.

Zo vergelijkt deze demo de aangeleverde veldwaarde-bewijsstukken bij een aanbeveling met het synthetische dossier. Dat is waardevol wanneer een geciteerde waarde onjuist is. Maar een lege bewijslijst slaagt ook voor die controle. De controle inspecteert niet elke bewering in de uitleg en stelt niet vast of elk noodzakelijk veld werd geciteerd.

Daarom wil ik dat een vrijgaveregel zowel het predikaat vermeldt dat zij toetst als het bewijs dat zij vereist. In een hypothetische workflow waar een besluit moet steunen op geverifieerd inkomen, vereist een ontbrekend inkomensbewijs een expliciete afhandeling. De ontwerper kan het veld voorafgaand aan validatie verplicht stellen, ontbrekend bewijs naar een beoordelaar routeren, of de taak inperken zodat de aanbeveling geen gezag heeft over dat besluit. Een consistentiecontrole alleen kan niet tussen die beleidsopties kiezen.

Meer bewijs eisen brengt een eigen afweging met zich mee. Het kan omissies zichtbaar maken, maar verzwaart ook het responsvoorwaardencontract en het onderhoud ervan. Het vereiste bewijs moet aansluiten bij de gevolgen van het besluit. Vragen om elk beschikbaar veld veroorzaakt ruis; alleen vragen wat het model toevallig aanbiedt, geeft het model de controle over het bereik van de controle.

AUTO-CLEAR moet met deze afgebakende reikwijdte worden gelezen. Het betekent dat de geïmplementeerde individuele controles zijn geslaagd, en kan gelden voor zowel een beleidsondersteunde afwijzing als een goedkeuring. Het toont niet aan dat een lening moet worden verstrekt, dat elk feit klopt of dat aan alle relevante verplichtingen is voldaan.

Een geaggregeerde goedkeuring heft een individuele fout niet op

Dezelfde vastgelegde modelbatch biedt een nuttige toets voor dashboardinterpretatie. Elk van de twee synthetische groepen telt vijf beoogde goedkeuringen op zes dossiers. De verhouding van hun beoogde goedkeuringspercentages is 1.00, waardoor de geconfigureerde portefeuillescreening slaagt. De beleidsschendende goedkeuring blijft op individueel niveau echter geblokkeerd.

Geconfigureerd portefeuillescreening-paneel met vijf beoogde goedkeuringen op zes dossiers in elke synthetische groep en een geslaagde verhouding van 1.00.
Gelijke beoogde goedkeuringspercentages bestaan naast een geblokkeerde individuele aanbeveling in deze gecachete synthetische batch. De screening omvat alle beoogde aanbevelingen, inclusief aanbevelingen die niet door de individuele poort komen.

Er is geen tegenstrijdigheid. Het portefeuillepaneel vergelijkt groepspercentages over beoogde aanbevelingen. De individuele controle toetst één aanbeveling aan het geconfigureerde beleid. Geen van beide vervangt de ander. Met slechts zes synthetische dossiers per groep kan de geaggregeerde goedkeuring bovendien noch rechtmatige behandeling, noch betrouwbaar gedrag buiten dit voorbeeld aantonen.

Ik houd die vragen strikt gescheiden bij het interpreteren van een validatiedashboard. Een enkel groen overzicht nodigt lezers uit om er een bredere betekenis aan toe te kennen dan de onderliggende berekening rechtvaardigt. Een beter auditdossier vermeldt welke vraag elk resultaat beantwoordt, welke dossiers zijn meegenomen en welke voorwaarden onopgelost blijven. Het toelichtingsrapport van de demo laat zien hoe deze individuele bevindingen en de portefeuillescreening naast elkaar staan.

Hier is mijn toelichting op de synthetische voorbeelden en de bevindingen van hun afzonderlijke controles.

Voor een team dat moet bepalen waar een vrijgavegrens moet liggen, is mijn criterium of een beoordelaar toestemming kan herleiden tot een specifieke regel, vereist bewijs en een traceerbare vervolgstap. Een modeltoelichting kan bijdragen aan dat dossier. Zij mag echter nooit de bevoegdheid krijgen om een geschonden regel te versoepelen louter door te beschrijven waarom naleving ervan lastig was.

Gerelateerd onderzoek

Ook gepubliceerd op

Bouw uw AI met vertrouwen.

Werk samen met een team met diepgaande ervaring in het bouwen van de volgende generatie enterprise-AI. Laat ons u helpen bij het ontwerpen, bouwen en implementeren van een AI-strategie waarop u kunt vertrouwen.

Veriprajna Deep Tech-adviesbureau is gespecialiseerd in het bouwen van veiligheidskritische AI-systemen voor de gezondheidszorg, de financiële sector en gereguleerde domeinen. Onze architecturen worden gevalideerd aan de hand van gevestigde protocollen met uitgebreide compliancedocumentatie.