Wohnungs-KI-Compliance

Auf einem festen synthetischen Testdatensatz startet ein DIR von 0.694 der schwächsten Gruppe Equoras Sanierungssuche über 480 Konfigurationen.

Equora wandelt eine gemessene Disparität in eine reproduzierbare Suche nach einer disparitätsärmeren Alternative um – unter ständiger Berücksichtigung der Genauigkeitskosten, der exakten Entscheidungsevidenz und des Freigabe-Gates.

0.694 to 0.875

DIR-Veränderung der am stärksten benachteiligten Gruppe

Fester synthetischer Datensatz

480

Evaluierte Konfigurationen

Begrenzte Suche bei gleicher Selektivität

0.36%

Gemessene Genauigkeitskosten

AUC 0.7823 to 0.7788

Alle hier gezeigten Primärergebnisse stammen aus einem festen synthetischen Bewerberpool mit 9,000 Datensätzen. Equora ist eine technische Demonstration, keine Rechtsberatung und kein produktives Entscheidungssystem.

Das Problem

Eine Fairness-Metrik kann Disparitäten identifizieren. Sie kann jedoch nicht die operative Reaktion bestimmen.

Ein Mieter-Screening-Audit kann Rechtsabteilungen und Modellrisikoteams aufzeigen, dass sich die Ergebnisse zwischen geschützten Gruppen unterscheiden. Die eigentliche Arbeit beginnt danach: festzustellen, ob eine vordergründig neutrale Alternative die Disparität verringert, eine verwertbare Modellleistung bewahrt und später wiederholbar ist.

Der SafeRent-Vergleich vom November 2024 liefert wichtigen Kontext dafür, warum Screening-Systeme unter genauer Beobachtung stehen. Der Vergleich über $2.275 million enthielt kein Schuldeingeständnis, und diese Demonstration bildet diesen Rechtsfall nicht nach.

Die Evidenz, die ein roter Score nicht liefert

  • 01Welche neutralen Alternativen tatsächlich evaluiert wurden
  • 02Ob Kandidaten bei gleicher Selektivität verglichen wurden
  • 03Wie viel gemessene Leistung die ausgewählte Änderung kostet
  • 04Ob ein bürgergerichteter Ablehnungsgrund mit dem Entscheidungsprotokoll übereinstimmt

Quellen: DOJ Civil Rights Division Fallseite und die Final Approval Order eingereicht am 20. November 2024.

Funktionsweise

Das Audit speist eine begrenzte Sanierungssuche.

Messung, Suche, Empfehlung und Freigabeprüfungen bleiben deterministisch.

Messen

Basislinie vor der Sanierung messen

Equora passt ScreenScore v3 (kreditorientierte Basislinie) auf den gebündelten synthetischen Pool an und berichtet Genehmigungsrate, Disparate-Impact-Verhältnis (DIR), statistische Paritätsdifferenz und Equalized-Odds-Lücke. Ethnie und Gutschein-Status (Voucher) sind Audit-Felder, keine Modellmerkmale.

Suchen

Explizite neutrale Änderungen bei gleicher Selektivität evaluieren

Die Suche nach der am wenigsten diskriminierenden Alternative (Least Discriminatory Alternative, LDA) evaluiert 480 Kombinationen aus optionalen Merkmalsteilmengen, Bonitäts-Score-Obergrenzen, Behandlung von garantiertem Einkommen und Regularisierungsstärke. Der Suchraum ist explizit und begrenzt.

Auswählen

Nach einer reproduzierbaren Regel auswählen

Die Engine stellt die Pareto-Front aus Genauigkeit und minimalem DIR dar und wählt dann den qualifizierten Kandidaten mit dem geringsten gemessenen AUC-Verlust innerhalb des konfigurierten 0.03-Budgets aus. Wenn sich kein Kandidat qualifiziert, gibt sie keine sichere Alternative zurück.

Gate

Nicht belegten Begründungstext ablehnen

Exakte lineare Modellattribution identifiziert die drei wichtigsten negativen Einflussfaktoren. Ein Feature-Grounding-Kritiker vergleicht diese Treiber mit den Gründen im Bescheid und leitet unbelegte oder generische Erklärungen an die manuelle Prüfung weiter.

Beweise aus der Demonstration

Der Trade-off bleibt von der Basislinie bis zur Empfehlung sichtbar.

Diese Bildschirme zeigen die tatsächliche lokale Demonstration auf ihrem festen synthetischen Testdatensatz.

Equora-Pareto-Front, die die synthetische Basislinie bei 0.694 DIR, die empfohlene Alternative bei 0.875 DIR und gemessene Genauigkeitskosten von 0.36 Prozent zeigt
Der zentrale Beweis: 480 evaluierte Konfigurationen, 240 innerhalb des konfigurierten Gates und AUC-Budgets, mit dem empfohlenen Kompromiss auf der Pareto-Front festgehalten.
Equora abgeschlossenes synthetisches Mieter-Screening-Audit mit Disparate-Impact-Verhältnis der am stärksten benachteiligten Gruppe und Ergebnissen geschützter Gruppen
Das Basislinien-Audit identifiziert die Disparität, bevor die Suche nach Alternativen beginnt.
Equora-Bescheidprüfung, die zeigt, wie ein merkmalsgestützter Grund besteht und ein generischer Grund zur menschlichen Prüfung weitergeleitet wird
Das Freigabe-Gate prüft ausschließlich die Merkmalsfundierung. Es bescheinigt keine vollständige rechtliche Konformität des Bescheids.

Ehrliche Bestandsaufnahme

Was sich ändert, wenn der Workflow über das Audit hinausgeht

Equora wurde entwickelt, um eine begrenzte Sanierungsentscheidung überprüfbar zu machen – nicht um eine einzelne Kennzahl in ein juristisches Urteil zu verwandeln.

Frage Ein Fairness-Score allein Equora-Demonstration
Was wurde gemessen?Eine Disparität bei einer einzelnen ModellkonfigurationDIR, SPD, EO-Lücke, Genehmigungsraten und Konfidenzintervalle auf dem festen Testdatensatz
Was könnte sich ändern?Nicht spezifiziertEin deklariertes Raster vordergründig neutraler Konfigurationen, verglichen bei gleicher Selektivität
Warum diese Empfehlung?Keine AuswahldokumentationDer geringste gemessene AUC-Verlust unter qualifizierten Kandidaten in der begrenzten Suche
Können Bescheidgründe überprüft werden?Außerhalb des ScoresGenannte Merkmale werden mit den exakten drei wichtigsten negativen Faktoren verglichen

Was diese Demonstration nicht leistet

Equora begründet keine Rechtskonformität, zertifiziert kein Modell als fair, durchsucht nicht jedes denkbare Modell und validiert keine reale Produktivleistung im Wohnungswesen. Sein Schwellenwert von 0.80 ist das konfigurierte Vier-Fünftel-Richtlinien-Gate der Demo.

Der Bewerberpool ist synthetisch, das Regelpaket statisch und Produktions-Konnektoren sind nicht implementiert. Der Bescheidkritiker verifiziert lediglich die Merkmalsfundierung, während der UCI Adult-Lauf ein öffentlicher Zensus-Einkommens-Fairness-Benchmark ist und keine Mieterdaten darstellt.

Fragen von Wohnungsbau-, Risiko- und Compliance-Teams

Was tut Equora, wenn ein Mieter-Screening-Modell das konfigurierte Vier-Fünftel-Richtlinien-Gate der Demo verfehlt?

Equora evaluiert 480 explizite, vordergründig neutrale Konfigurationen bei gleicher Selektivität. Es empfiehlt den qualifizierten Kandidaten mit dem geringsten gemessenen AUC-Verlust innerhalb des konfigurierten Vier-Fünftel-Richtlinien-Gates und des Genauigkeitsbudgets der Demo, oder gibt keine sichere Alternative zurück, wenn sich kein Kandidat qualifiziert.

Beweist ein DIR unter 0.80 einen Verstoß gegen den Fair Housing Act?

Nein. Equora verwendet 0.80 als konfiguriertes Vier-Fünftel-Richtlinien-Gate der Demo, nicht als rechtliche Schlussfolgerung. Die Vier-Fünftel-Heuristik stammt aus Leitlinien zur Personalauswahl und begründet für sich genommen keine Haftung nach dem Wohnungsrecht.

Wie viel Modellleistung büßt die empfohlene Alternative ein?

Auf dem festen synthetischen Testdatensatz verändert sich der AUC von 0.7823 auf 0.7788. Der gemessene Verlust beträgt 0.0036, in der Benutzeroberfläche als Genauigkeitskosten von 0.36% dargestellt, während sich der DIR der am stärksten benachteiligten Gruppe von 0.694 auf 0.875 verbessert.

Trifft Equora Mieter-Screening-Entscheidungen mit einem Sprachmodell?

Nein. Deterministischer Code berechnet Metriken, wendet Schwellenwerte an, evaluiert Alternativen und wählt die Empfehlung aus. Ein Sprachmodell wird, sofern aktiviert, ausschließlich für den Entwurf von Bescheidtexten verwendet, und der Offline-Modus nutzt eine deterministische Vorlage.

Beweist die Prüfung des Benachrichtigungsschreibens (Adverse Action Notice) die vollständige FCRA-Compliance?

Nein. Der Feature-Grounding-Kritiker prüft, ob die genannten Gründe mit den drei wichtigsten negativen Merkmalsbeiträgen des Modells übereinstimmen. Er leitet unbelegte oder generische Gründe an die menschliche Prüfung weiter, überprüft jedoch nicht jedes gesetzliche Benachrichtigungselement und stellt keine rechtliche Hinlänglichkeit fest.

Stammen die Daten in dieser Wohnungs-KI-Demonstration von echten Bewerbern?

Nein. Der primäre Datensatz ist ein fester, gebündelter synthetischer Mieter-Screening-Pool mit 9,000 Datensätzen. Der separate Lauf mit dem UCI Adult Census Income ist ein öffentlicher Fairness-Benchmark, der denselben Prüfcode durchläuft, aber kein Validierungsdatensatz für Wohnraum ist.

Technische Forschung

Die Forschung hinter dieser Demonstration – die Architektur, das Verifikationsdesign und die Enterprise-Blaupause.

Social

Auch veröffentlicht auf

Machen Sie die Reaktion auf ein rotes Audit reproduzierbar.

Bringen Sie das Modell, die Richtliniengrenzen und die Nachweispflichten in einer Prüfung zusammen.

Wenn Ihr Team Audit-, Sanierungs- und Freigabekontrollen für Wohnungs-KI definiert, kontaktieren Sie uns, um zu besprechen, welche Evidenz die Prüfung festhalten sollte.

Demonstrierte Audit- und Evidenzkontrollen

  • ✓ Metrik-Design für geschützte Gruppen
  • ✓ Spezifikation von Richtlinien-Gates
  • ✓ Konfidenz- und Signifikanzberichterstattung
  • ✓ Überprüfbare JSON- und HTML-Artefakte

Demonstrierte Sanierungs- und Freigabekontrollen

  • ✓ Begrenzte Suche nach neutralen Alternativen
  • ✓ Prüfung des Trade-offs zwischen Genauigkeit und Disparität
  • ✓ Exakte Attribution der Entscheidungstreiber
  • ✓ Freigabe-Gates mit menschlicher Prüfung