Naleving van AI-regelgeving in de woningsector

Op een vaste synthetische testset start een disparate-impactratio (DIR) van 0.694 Equora's herstelzoektocht over 480 configuraties.

Equora zet een gemeten ongelijkheid om in een reproduceerbare zoektocht naar een alternatief met lagere dispariteit, waarbij de nauwkeurigheidskosten, het exacte beslissingsbewijs en de vrijgave-gate scherp in het oog worden gehouden.

0.694 to 0.875

DIR-verschuiving voor de meest benadeelde groep

Vaste synthetische testset

480

Geëvalueerde configuraties

Begrensde zoektocht bij gelijke selectiviteit

0.36%

Gemeten nauwkeurigheidskosten

AUC 0.7823 to 0.7788

Alle primaire resultaten die hier worden getoond, zijn afkomstig uit een vaste synthetische kandidatenpool van 9,000 dossiers. Equora is een technische demonstratie, geen juridisch advies en geen besluitvormingssysteem voor productieomgevingen.

Het probleem

Een eerlijkheidsmetriek kan ongelijkheid identificeren. Deze kan echter niet de operationele reactie bepalen.

Een audit van huurderscreening kan bedrijfsjuristen en modelrisicoteams aantonen dat uitkomsten verschillen tussen beschermde groepen. Het moeilijke werk begint daarna: vaststellen of een ogenschijnlijk neutraal alternatief de ongelijkheid verkleint, bruikbare modelprestaties behoudt en later opnieuw kan worden afgespeeld.

De SafeRent-schikking van november 2024 biedt een cruciale context voor de reden waarom screeningsystemen nauwlettend in de gaten worden gehouden. De schikking van $2.275 million bevatte geen erkenning van schuld of wangedrag, en deze demonstratie reproduceert die zaak niet.

Het bewijs dat een rode score niet levert

  • 01Welke neutrale alternatieven daadwerkelijk zijn geëvalueerd
  • 02Of kandidaten bij gelijke selectiviteit zijn vergeleken
  • 03Hoeveel gemeten prestatie de geselecteerde wijziging kost
  • 04Of een aan de aanvrager gerichte reden overeenkomt met het beslissingslogboek

Bronnen: Zaakpagina van de DOJ Civil Rights Division en de Final Approval Order ingediend op 20 november 2024.

Hoe het werkt

De audit voedt een begrensde herstelzoektocht.

Metingen, zoekacties, aanbevelingen en vrijgavecontroles blijven deterministisch.

Meten

De nulmeting meten vóór herstel

Equora past ScreenScore v3 (kredietgeoriënteerde nulmeting) toe op de gebundelde synthetische pool en rapporteert goedkeuringspercentage, disparate-impactratio (DIR), statistisch pariteitsverschil en equalized-odds-kloof. Etniciteit en huursubsidiestatus (voucher) zijn auditvelden, geen modelkenmerken.

Zoeken

Expliciete neutrale wijzigingen evalueren bij gelijke selectiviteit

De zoektocht naar het minst discriminerende alternatief (Least Discriminatory Alternative, LDA) evalueert 480 combinaties van optionele kenmerkdeelverzamelingen, kredietscoreplafonds, behandeling van gegarandeerd inkomen en regularisatiesterkte. De zoekruimte is expliciet en begrensd.

Selecteren

Kiezen op basis van een reproduceerbare regel

De engine brengt het Pareto-front van nauwkeurigheid en minimale DIR in kaart en selecteert vervolgens de gekwalificeerde kandidaat met het kleinste gemeten AUC-verlies binnen het geconfigureerde budget van 0.03. Als geen enkele kandidaat kwalificeert, retourneert deze geen veilig alternatief.

Gate

Niet-onderbouwde toelichtingsteksten weigeren

Exacte lineaire modelattributie identificeert de top drie van negatieve factoren. Een feature-grounding-criticus vergelijkt die drijfveren met de redenen in de kennisgeving en stuurt niet-onderbouwde of generieke verklaringen door naar menselijke beoordeling.

Bewijs uit de demonstratie

De afweging blijft zichtbaar van nulmeting tot aanbeveling.

Deze schermen tonen de daadwerkelijke lokale demonstratie op de vaste synthetische testset.

Equora Pareto-front dat de synthetische nulmeting toont op 0.694 DIR, het aanbevolen alternatief op 0.875 DIR en gemeten nauwkeurigheidskosten van 0.36 procent
Het centrale bewijs: 480 configuraties geëvalueerd, 240 binnen de geconfigureerde gate en het AUC-budget, met de aanbevolen afweging vastgelegd op het Pareto-front.
Door Equora voltooide synthetische huurderscreeningsaudit met disparate-impactratio van de meest benadeelde groep en resultaten van beschermde groepen
De nulmeting-audit identificeert de ongelijkheid voordat de zoektocht naar alternatieven begint.
Equora-kennisgevingsverificatie die laat zien dat een op kenmerken gebaseerde reden slaagt en een generieke reden wordt doorgestuurd naar menselijke beoordeling
De vrijgave-gate controleert uitsluitend de onderbouwing door kenmerken. Deze certificeert niet de volledige juridische naleving van de kennisgeving.

Eerlijk overzicht

Wat er verandert wanneer de workflow verdergaat dan de audit

Equora is ontworpen om een begrensde herstelbeslissing inspecteerbaar te maken, niet om van een enkele metriek een juridisch vonnis te maken.

Vraag Een eerlijkheidsscore alleen Equora-demonstratie
Wat werd er gemeten?Een ongelijkheid bij één enkele modelconfiguratieDIR, SPD, EO-kloof, goedkeuringspercentages en betrouwbaarheidsintervallen op de vaste testset
Wat zou kunnen veranderen?Niet gespecificeerdEen gedeclareerd raster van ogenschijnlijk neutrale configuraties vergeleken bij gelijke selectiviteit
Waarom deze aanbeveling?Geen selectiedocumentatieHet kleinste gemeten AUC-verlies onder gekwalificeerde kandidaten in de begrensde zoektocht
Kunnen kennisgevingsredenen worden gecontroleerd?Buiten het bereik van de scoreGenoemde kenmerken worden vergeleken met de exacte top drie van negatieve factoren

Wat deze demonstratie niet doet

Equora stelt geen wettelijke naleving vast, certificeert een model niet als eerlijk, doorzoekt niet elk denkbaar model en valideert geen werkelijke productieprestaties in de woningbouw. De drempelwaarde van 0.80 is de geconfigureerde vier-vijfden-beleidsgate van de demo.

De kandidatenpool is synthetisch, het regelsysteem is statisch en productieconnectoren zijn niet gebouwd. De kennisgevingscriticus verifieert uitsluitend de kenmerkonderbouwing, terwijl de run met UCI Adult een openbare census-inkomens-fairnessbenchmark is en geen huurdersgegevens betreft.

Vragen die woning-, risico- en complianceteams stellen

Wat doet Equora wanneer een huurderscreeningsmodel de geconfigureerde vier-vijfden-beleidsgate van de demo niet haalt?

Equora evalueert 480 expliciete, ogenschijnlijk neutrale configuraties bij gelijke selectiviteit. Het beveelt de gekwalificeerde kandidaat aan met het kleinste gemeten AUC-verlies binnen de geconfigureerde vier-vijfden-beleidsgate en het nauwkeurigheidsbudget van de demo, of retourneert geen veilig alternatief als er geen enkele voldoet.

Bewijst een DIR onder 0.80 een overtreding van de Fair Housing Act?

Nee. Equora gebruikt 0.80 als de geconfigureerde vier-vijfden-beleidsgate van de demo, niet als een juridische conclusie. De vier-vijfden-heuristiek vindt haar oorsprong in richtlijnen voor personeelsselectie en leidt op zichzelf niet tot aansprakelijkheid volgens het woonrecht.

Hoeveel modelprestaties levert het aanbevolen alternatief in?

Op de vaste synthetische testset verandert AUC van 0.7823 naar 0.7788. Het gemeten verlies is 0.0036, in de interface weergegeven als 0.36% nauwkeurigheidskosten, terwijl de DIR van de meest benadeelde groep verschuift van 0.694 naar 0.875.

Neemt Equora beslissingen over huurderscreening met behulp van een taalmodel?

Nee. Deterministische code berekent statistieken, past drempelwaarden toe, evalueert alternatieven en selecteert de aanbeveling. Een taalmodel wordt, indien ingeschakeld, uitsluitend gebruikt voor het opstellen van kennisgevingsteksten, en de offline modus gebruikt een deterministisch sjabloon.

Garandeert de controle van de afwijzingskennisgeving volledige FCRA-naleving?

Nee. De feature-grounding-criticus controleert of vermelde redenen overeenkomen met de top drie negatieve kenmerkbijdagen van het model. Niet-onderbouwde of generieke redenen worden doorgestuurd naar menselijke beoordeling, maar dit verifieert niet elk wettelijk kennisgevingselement en levert geen juridisch bewijs op.

Zijn de gegevens in deze demonstratie van woning-AI echte aanvragersgegevens?

Nee. De primaire dataset is een vaste, gebundelde synthetische pool van 9,000 huurderscreeningsdossiers. De afzonderlijke run met UCI Adult Census Income is een openbare fairnessbenchmark die dezelfde auditcode doorloopt, maar geen validatiedataset voor huisvesting is.

Technisch onderzoek

Het onderzoek achter deze demonstratie — de architectuur, het verificatieontwerp en het zakelijke model.

Social

Ook gepubliceerd op

Maak de reactie op een rode audit reproduceerbaar.

Breng het model, de beleidsgrenzen en de bewijsverplichtingen samen in één overzicht.

Als uw team audit-, herstel- en vrijgavecontroles definieert voor woning-AI, neem dan contact met ons op om te bespreken welk bewijsmateriaal de beoordeling moet bewaren.

Gedemonstreerde audit- en bewijscontroles

  • ✓ Metriekontwerp voor beschermde groepen
  • ✓ Specificatie van beleidsgates
  • ✓ Rapportage van betrouwbaarheid en significantie
  • ✓ Controleerbare JSON- en HTML-artefacten

Gedemonstreerde herstel- en vrijgavecontroles

  • ✓ Begrensde zoektocht naar neutrale alternatieven
  • ✓ Evaluatie van de afweging tussen nauwkeurigheid en dispariteit
  • ✓ Exacte attributie van beslissingsfactoren
  • ✓ Vrijgave-gates met menselijke beoordeling