Wohnungs-KI-Compliance
Equora wandelt eine gemessene Disparität in eine reproduzierbare Suche nach einer disparitätsärmeren Alternative um – unter ständiger Berücksichtigung der Genauigkeitskosten, der exakten Entscheidungsevidenz und des Freigabe-Gates.
0.694 to 0.875
DIR-Veränderung der am stärksten benachteiligten Gruppe
Fester synthetischer Datensatz
480
Evaluierte Konfigurationen
Begrenzte Suche bei gleicher Selektivität
0.36%
Gemessene Genauigkeitskosten
AUC 0.7823 to 0.7788
Alle hier gezeigten Primärergebnisse stammen aus einem festen synthetischen Bewerberpool mit 9,000 Datensätzen. Equora ist eine technische Demonstration, keine Rechtsberatung und kein produktives Entscheidungssystem.
Das Problem
Ein Mieter-Screening-Audit kann Rechtsabteilungen und Modellrisikoteams aufzeigen, dass sich die Ergebnisse zwischen geschützten Gruppen unterscheiden. Die eigentliche Arbeit beginnt danach: festzustellen, ob eine vordergründig neutrale Alternative die Disparität verringert, eine verwertbare Modellleistung bewahrt und später wiederholbar ist.
Der SafeRent-Vergleich vom November 2024 liefert wichtigen Kontext dafür, warum Screening-Systeme unter genauer Beobachtung stehen. Der Vergleich über $2.275 million enthielt kein Schuldeingeständnis, und diese Demonstration bildet diesen Rechtsfall nicht nach.
Quellen: DOJ Civil Rights Division Fallseite und die Final Approval Order eingereicht am 20. November 2024.
Funktionsweise
Messung, Suche, Empfehlung und Freigabeprüfungen bleiben deterministisch.
Messen
Equora passt ScreenScore v3 (kreditorientierte Basislinie) auf den gebündelten synthetischen Pool an und berichtet Genehmigungsrate, Disparate-Impact-Verhältnis (DIR), statistische Paritätsdifferenz und Equalized-Odds-Lücke. Ethnie und Gutschein-Status (Voucher) sind Audit-Felder, keine Modellmerkmale.
Suchen
Die Suche nach der am wenigsten diskriminierenden Alternative (Least Discriminatory Alternative, LDA) evaluiert 480 Kombinationen aus optionalen Merkmalsteilmengen, Bonitäts-Score-Obergrenzen, Behandlung von garantiertem Einkommen und Regularisierungsstärke. Der Suchraum ist explizit und begrenzt.
Auswählen
Die Engine stellt die Pareto-Front aus Genauigkeit und minimalem DIR dar und wählt dann den qualifizierten Kandidaten mit dem geringsten gemessenen AUC-Verlust innerhalb des konfigurierten 0.03-Budgets aus. Wenn sich kein Kandidat qualifiziert, gibt sie keine sichere Alternative zurück.
Gate
Exakte lineare Modellattribution identifiziert die drei wichtigsten negativen Einflussfaktoren. Ein Feature-Grounding-Kritiker vergleicht diese Treiber mit den Gründen im Bescheid und leitet unbelegte oder generische Erklärungen an die manuelle Prüfung weiter.
Beweise aus der Demonstration
Diese Bildschirme zeigen die tatsächliche lokale Demonstration auf ihrem festen synthetischen Testdatensatz.
Ehrliche Bestandsaufnahme
Equora wurde entwickelt, um eine begrenzte Sanierungsentscheidung überprüfbar zu machen – nicht um eine einzelne Kennzahl in ein juristisches Urteil zu verwandeln.
| Frage | Ein Fairness-Score allein | Equora-Demonstration |
|---|---|---|
| Was wurde gemessen? | Eine Disparität bei einer einzelnen Modellkonfiguration | DIR, SPD, EO-Lücke, Genehmigungsraten und Konfidenzintervalle auf dem festen Testdatensatz |
| Was könnte sich ändern? | Nicht spezifiziert | Ein deklariertes Raster vordergründig neutraler Konfigurationen, verglichen bei gleicher Selektivität |
| Warum diese Empfehlung? | Keine Auswahldokumentation | Der geringste gemessene AUC-Verlust unter qualifizierten Kandidaten in der begrenzten Suche |
| Können Bescheidgründe überprüft werden? | Außerhalb des Scores | Genannte Merkmale werden mit den exakten drei wichtigsten negativen Faktoren verglichen |
Equora begründet keine Rechtskonformität, zertifiziert kein Modell als fair, durchsucht nicht jedes denkbare Modell und validiert keine reale Produktivleistung im Wohnungswesen. Sein Schwellenwert von 0.80 ist das konfigurierte Vier-Fünftel-Richtlinien-Gate der Demo.
Der Bewerberpool ist synthetisch, das Regelpaket statisch und Produktions-Konnektoren sind nicht implementiert. Der Bescheidkritiker verifiziert lediglich die Merkmalsfundierung, während der UCI Adult-Lauf ein öffentlicher Zensus-Einkommens-Fairness-Benchmark ist und keine Mieterdaten darstellt.
Equora evaluiert 480 explizite, vordergründig neutrale Konfigurationen bei gleicher Selektivität. Es empfiehlt den qualifizierten Kandidaten mit dem geringsten gemessenen AUC-Verlust innerhalb des konfigurierten Vier-Fünftel-Richtlinien-Gates und des Genauigkeitsbudgets der Demo, oder gibt keine sichere Alternative zurück, wenn sich kein Kandidat qualifiziert.
Nein. Equora verwendet 0.80 als konfiguriertes Vier-Fünftel-Richtlinien-Gate der Demo, nicht als rechtliche Schlussfolgerung. Die Vier-Fünftel-Heuristik stammt aus Leitlinien zur Personalauswahl und begründet für sich genommen keine Haftung nach dem Wohnungsrecht.
Auf dem festen synthetischen Testdatensatz verändert sich der AUC von 0.7823 auf 0.7788. Der gemessene Verlust beträgt 0.0036, in der Benutzeroberfläche als Genauigkeitskosten von 0.36% dargestellt, während sich der DIR der am stärksten benachteiligten Gruppe von 0.694 auf 0.875 verbessert.
Nein. Deterministischer Code berechnet Metriken, wendet Schwellenwerte an, evaluiert Alternativen und wählt die Empfehlung aus. Ein Sprachmodell wird, sofern aktiviert, ausschließlich für den Entwurf von Bescheidtexten verwendet, und der Offline-Modus nutzt eine deterministische Vorlage.
Nein. Der Feature-Grounding-Kritiker prüft, ob die genannten Gründe mit den drei wichtigsten negativen Merkmalsbeiträgen des Modells übereinstimmen. Er leitet unbelegte oder generische Gründe an die menschliche Prüfung weiter, überprüft jedoch nicht jedes gesetzliche Benachrichtigungselement und stellt keine rechtliche Hinlänglichkeit fest.
Nein. Der primäre Datensatz ist ein fester, gebündelter synthetischer Mieter-Screening-Pool mit 9,000 Datensätzen. Der separate Lauf mit dem UCI Adult Census Income ist ein öffentlicher Fairness-Benchmark, der denselben Prüfcode durchläuft, aber kein Validierungsdatensatz für Wohnraum ist.
Die Forschung hinter dieser Demonstration – die Architektur, das Verifikationsdesign und die Enterprise-Blaupause.
Bringen Sie das Modell, die Richtliniengrenzen und die Nachweispflichten in einer Prüfung zusammen.
Wenn Ihr Team Audit-, Sanierungs- und Freigabekontrollen für Wohnungs-KI definiert, kontaktieren Sie uns, um zu besprechen, welche Evidenz die Prüfung festhalten sollte.