MeritLens · Fairness-Firewall für Beschaffung
Eine bessere Liefertreue kann einen Lieferanten dennoch unter der Shortlist-Untergrenze belassen. Wir zeigen, wie Annahmen zu Historie und Umsatz dieses Ergebnis prägen, und halten die Erklärung anschließend zusammen mit der Prüfentscheidung einer simulierten Vergabe fest.
70.9 → 81.0
Bridgepoint erreicht Vorschau-Berechtigung
Synthetisches Verbindungselemente-Szenario; ursprüngliche → alternative Punktzahl
14.0 von 21.0
Differenzpunkte auf Proxy-Annahmen zurückgeführt
Formelvergleich zwischen synthetischem Apex und Bridgepoint
BLOCK
Gespeicherte Entscheidung zur simulierten Vergabe
Menschliche Überprüfung erforderlich; keine abgeschlossene Überprüfung dargestellt
Synthetische Lieferanten und simulierte Vergaben. Das Video und die Belege veranschaulichen das konfigurierte Demo-Verhalten; diese Seite dient als Erläuterung.
Im synthetischen Fall Industrial Fasteners liefert Bridgepoint Components mit einer Pünktlichkeit von 98.1 %, verglichen mit 97.2 % bei Apex Fastener Industries. Dennoch erreicht Bridgepoint nur 70.9 Punkte gegenüber der Shortlist-Untergrenze von 80 Punkten, während Apex mit 91.9 Punkten führt.
Die Formel weist den Liefer- und Qualitätsraten eines Lieferanten mit wenigen Transaktionen und Audits ein geringeres statistisches Vertrauen zu. Zudem nutzt sie den Umsatz für die finanzielle Bewertung. Das Weglassen von Zertifizierungslabels aus einer Punktzahl beseitigt diese Historien- und Größenannahmen keineswegs.
Ein Beschaffungsprüfer muss erkennen, welche Annahmen die Berechtigung verändern, welche Unterschiede unter einer alternativen Formel bestehen bleiben und warum die Vergaberichtlinie die Empfehlung blockiert oder freigibt. Eine bessere Lieferleistung allein klärt weder das finanzielle Risiko des Lieferanten noch seinen Anspruch auf einen Zuschlag.
Das simulierte Bewertungsmodell gewichtet Liefertreue, Qualität, finanzielle Lage und Preis zu jeweils gleichen 25 %. Seine proxy-neutrale Alternative verwendet unverfälschte Liefer- und Qualitätsraten sowie die tatsächliche finanzielle Stabilität, während Preis und Gewichtungen unverändert bleiben. Die Zerlegung nach Art von Oaxaca-Blinder teilt die ursprüngliche Differenz in die unter der Alternative verbleibende Lücke und ein Residuum auf, das den geänderten Annahmen zugeschrieben wird.
Die konfigurierte Vier-Fünftel-Diagnostik vergleicht die Auswahlquote jeder erfassten Gruppe mit der nicht-diversen Baseline anhand einer Mindestquote von 0.80. Sie bündelt synthetische Lieferanten-Ereignis-Zeilen innerhalb der Kategorie, einschließlich wiederholter Lieferanten. Kleine Gruppen können das Urteil nicht bestimmen; nicht verfügbare Belege auf Kategorieebene führen zu ABSTAIN.
BLOCK erfordert alle drei Bedingungen: eine festgestellte Benachteiligung (Adverse Impact) in der Kategorie, einen nicht-diversen ursprünglichen Spitzenreiter und einen diversen Herausforderer unter der ursprünglichen Untergrenze, der diese in der alternativen Formel erreicht. ABSTAIN hält die simulierte Vergabe ebenfalls zur Prüfung an. Andere Fälle ergeben unter dieser Richtlinie ALLOW. Der Code speichert die Gate- und Auditeinträge vor einer optionalen beratenden Faktorenprüfung; beratender Begleittext kann weder die Entscheidung noch die numerischen Belege ändern.
Die alternative Formel ist ein expliziter Annahmentest, kein unabhängiger Kausalitätsbeweis. Die Untergrenze von 0.80 ist ein konfiguriertes Demo-Diagnosekriterium, keine vergaberechtliche Vorschrift.
Verfolgen Sie einen synthetischen Beschaffungsvorgang von den unbewerteten Eingangsdaten bis zum begründeten Prüfstopp. Die Vergleichsfälle zeigen anschließend, warum eine geänderte Shortlist-Berechtigung, das Bestehen einer Kategorie-Diagnostik und die Freigabe einer Vergabe getrennte Ergebnisse sind. Alle hier gezeigten Lieferantennamen, Zertifizierungen, Historien und Vergaben gehören zur lokalen Demonstration.
Der Arbeitsbereich zeigt anfänglich die Lieferanteneingaben, während Punktzahlen und Shortlist-Entscheidungen noch ausstehen. Die Prüfung von Bridgepoint legt Liefertreue, Qualität, Transaktionshistorie, Audit-Historie und Finanzkennzahlen vor der Bewertung offen. Diese Unterscheidung ist entscheidend: Ein Lieferantenlabel oder ein scheinbar starker Lieferprozentsatz kann die Punktzahl nicht ohne die Formel erklären, die ihn verarbeitet.

| Synthetische Eingabe | Apex | Bridgepoint |
|---|---|---|
| Pünktliche Lieferung | 97.2% | 98.1% |
| Qualitäts-Bestehensquote | 96.5% | 97.2% |
| Transaktionen | 4,200 | 180 |
| Audits | 140 | 9 |
| Umsatz | USD 820 million | USD 60 million |
Das simulierte Bewertungsmodell gewichtet Liefertreue, Qualität, finanzielle Faktoren und Preis mit jeweils 25 %. Transaktions- und Audithistorie beeinflussen, wie viel statistisches Vertrauen es in die reinen Liefer- und Qualitätsraten setzt; der Umsatz bestimmt die finanzielle Punktzahl. Diese Entscheidungen können einen kleineren Lieferanten benachteiligen, selbst wenn Zertifizierungsmerkmale von der Bewertung ausgenommen sind. Ein Einkäufer muss daher die Rechtfertigung dieser Annahmen prüfen, anstatt aus weggelassenen Merkmalen auf Neutralität zu schließen.
Nach der Auswertung ist Apex mit 91.9 der ursprüngliche Spitzenreiter. Bridgepoint erzielt 70.9 und Delta 70.5 Punkte, beides unter der konfigurierten Shortlist-Untergrenze von 80 Punkten. Bridgepoint weist zwar die bessere Lieferquote auf, doch dieser einzelne Kennwert belegt keine Überlegenheit hinsichtlich finanzieller Stabilität, Preis oder anderer legitimer Kriterien.

BLOCK verlangt alle drei konfigurierten Bedingungen: den Nachweis einer Benachteiligung (Adverse Impact) in der Kategorie, einen nicht-diversen ursprünglichen Spitzenreiter und einen diversen Herausforderer, der unter der ursprünglichen Untergrenze liegt, sie jedoch in der alternativen Formel erreicht. Das Verbindungselemente-Ereignis erfüllt diese Kombination. Die Entscheidung wird gespeichert, bevor die beratende Faktorenprüfung beginnt, wodurch die numerische Basis und die Gültigkeit des Stopps gewahrt bleiben.
Die Kategorie-Diagnostik bündelt Lieferanten-Ereignis-Zeilen einschließlich mehrfach auftretender Lieferanten. Zeilen für Unternehmen in Minderheitenbesitz weisen 7 Auswahlen bei 26 berücksichtigten Zeilen auf, verglichen mit 25 von 37 bei der nicht-diversen Baseline. Das Auswahlquoten-Verhältnis liegt bei etwa 0.40 und damit unter der konfigurierten Diagnose-Untergrenze von 0.80. Die Kategorie-Historie-Metadaten von 312 stellen eine separate Stichproben-Sicherheitsgrenze dar; sie bilden nicht den Nenner dieses Vergleichs.

| Geänderte Annahme | Proxy-Beitrag zur Differenz |
|---|---|
| Liefervertrauen aus Transaktionshistorie | 3.01 points |
| Qualitätsvertrauen aus Audit-Historie | 2.50 points |
| Umsatzbasiertes Finanz-Scoring | 8.47 points |
| Preisbewertung, unverändert | 0.00 points |
Die Zerlegung nach Art von Oaxaca-Blinder vergleicht explizite Formeln. Die Alternative verwendet reine Liefer- und Qualitätsraten sowie die tatsächliche Finanzlage, wobei Preis und Gewichtungen unverändert bleiben. Etwa zwei Drittel der ursprünglichen Differenz werden den in diesem Vergleich modifizierten Annahmen zugeschrieben; die verbleibende Lücke begünstigt weiterhin Apex. Dieses Residuum ist abhängig von der gewählten Alternative und stellt keinen unabhängigen Kausalitätsbeweis für Diskriminierung dar.
| Lieferant | Ursprüngliche Punktzahl | Alternative Punktzahl | Vorschau-Ergebnis |
|---|---|---|---|
| Apex Fastener Industries | 91.9 | 88.0 | Bleibt Spitzenreiter |
| Bridgepoint Components | 70.9 | 81.0 | Wird berechtigt |
| Delta Fasteners | 70.5 | 82.9 | Wird berechtigt |

Diese Vorschau stellt Beschaffungsprüfern eine gezielte Frage: Wären diese Lieferanten unter Bewertungsannahmen ausgeschlossen worden, die die Organisation sachlich vertreten kann? Sie ernennt Bridgepoint nicht zum Gewinner, vollzieht keine Vergabe, bewertet die erfasste Kategorie-Prüfung nicht neu und ersetzt nicht das ursprüngliche Bewertungsmodell. Ein menschlicher Prüfer müsste weiterhin den Beschaffungskontext abwägen und entscheiden, wie mit den ermittelten Annahmen umzugehen ist.
Im Beispiel Packaging Materials lautet die ursprüngliche Empfehlung Beacon mit 91.7, die Kategorie-Diagnostik lautet PASS und das konfigurierte Gate liefert ALLOW. Dennoch verbessert sich Ironclad, ein synthetischer HUBZone-Lieferant, unter der alternativen Formel von 72.4 auf 81.4 Punkte. Eine Freigabe durch die Richtlinie kann somit koexistieren mit einem proxy-sensitiven Shortlist-Ausschluss.

Das überlappende diverse Aggregat zählt 8 Auswahlen aus 12 berücksichtigten Zeilen, verglichen mit 18 aus 38 bei der nicht-diversen Baseline. Sein Verhältnis liegt bei etwa 1.41. Einzelne Gruppen in Minderheitenbesitz, HUBZone und 8(a) weisen jeweils nur vier berücksichtigte Zeilen auf und bleiben unbewertet. Kategorie-PASS belegt daher nicht, dass jede Gruppe geprüft wurde, und ALLOW belegt weder die Abwesenheit von Proxies noch von Ungleichheiten.
Das Ereignis für Facilities and MRO weist eine ausgewiesene Kategorie-Historie von 140 auf und liegt damit unter dem konfigurierten Minimum von 200. Sowohl seine Kategorie-Bewertung als auch das Gate liefern ABSTAIN, sodass die simulierte autonome Vergabe zur Überprüfung angehalten wird. Punktzahlen und eine Zerlegung können dennoch berechnet werden; keines von beiden verwandelt eine nicht verfügbare Kategorie-Prüfung in eine Freigabe.

Weitere Sicherheitsgrenzen decken eine Referenz-Baseline mit weniger als fünf berücksichtigten Zeilen oder ohne Auswahlen ab. Einzelne Gruppen mit weniger als fünf Zeilen bleiben unbewertet, während Gruppen mit fünf bis neun Zeilen informatorisch sind und das Kategorie-Urteil nicht beeinflussen können. Die Mindesthistorie von 200 und diese Gruppen-Schutzmechanismen sind konfigurierte Grenzwerte, keine Garantie dafür, dass ein realer Beschaffungsdatensatz statistisch ausreichend ist.
Die feste Suite umfasst zehn manuell definierte Rohdaten-Fälle mit erwarteten Ergebnissen: dreimal BLOCK, viermal ALLOW und dreimal ABSTAIN. Die beobachteten Ergebnisse stimmen mit allen zehn erwarteten Labels überein. Die Kontrollen decken Annahmen zu Historie, Audits und Umsatz, etablierte zertifizierte Lieferanten, reine Preisunterschiede, leistungsbasierten Ausschluss, spärliche Referenzdaten und eine Referenz-Baseline ohne Auswahlen ab.

Ein Grenzfall erlaubt eine Bewertung bei einer Historie von exakt 200 und ergibt ALLOW; ein anderer bei 199 ergibt ABSTAIN. Diese Kontrollen helfen zu überprüfen, ob die Implementierung an entscheidenden Grenzwerten ihrer erklärten Richtlinie folgt. Sie begründen weder Genauigkeit in realen Beschaffungsszenarien noch Kalibrierung oder unabhängige Validierung. Der Benchmark läuft ohne Modellaufruf und fügt keine Sourcing-Audit-Einträge an.
Das synthetische Portfolio umfasst 52 Ereignisse über sechs Kategorien und 342 Lieferanten-Ereignis-Zeilen. Diese Zeilen sind wiederholte Teilnahme-Datensätze, keine 342 eindeutigen Lieferanten. Fünfzehn Ereignisse sind für autonome Vergaben markiert; eine Neuberechnung der Richtlinie ergibt darunter achtmal BLOCK, einmal ABSTAIN und sechsmal ALLOW. Neun der fünfzehn würden unter dieser Konfiguration somit zur Prüfung angehalten.

Auf Kategorieebene meldet der Scan vier ADVERSE_IMPACT-Befunde, einmal PASS und einmal ABSTAIN. Der Scan hilft dabei zu identifizieren, wo ein Prüfer als Nächstes die Belege untersuchen sollte. Er ist von der Kontrollsuite aus zehn Fällen getrennt: Der eine fasst ein initialisiertes Portfolio zusammen, während der andere das erwartete Implementierungsverhalten prüft. Keiner von beiden liefert Erkenntnisse über reale Lieferantenpopulationen.
Nach Abschluss der Bewertung und der beratenden Faktorenprüfung enthalten „JSON herunterladen“ und „Bericht drucken“ die gespeicherte Entscheidung, den Audit-Eintrag, die Kategorie-Zählwerte, die Zerlegung und die Faktorenprüfung. Optionale Empfehlungen von Proxy Classifier und Adversarial Challenger ergänzen Labels und Begründungen, nachdem das Gate gespeichert wurde. Numerische Belege bleiben fest im Code verankert; beratender Begleittext kann die Vergabe nicht autorisieren. Vollständig gespeicherte Beratungsergebnisse können für unveränderte Eingaben wiederverwendet werden, und nicht verfügbare Anbieter fallen auf eine deterministische Prüfung zurück.
Für eine Produktivbewertung betreffen die nächsten Fragen, welche Historien-Maßstäbe für den Vertrag vertretbar sind, ob Kategorie-Vergleiche die beabsichtigte Lieferantenpopulation repräsentieren und wer befugt ist, einen Prüfstopp aufzuheben. Die Demo macht diese Fragen überprüfbar. Ihre lokale JSON-Audit-Persistenz ist keine unveränderliche Verwahrung durch Dritte, und rechtlich benannte Exportfelder sind konfigurierte Zuordnungen und keine rechtliche Zertifizierung oder unabhängige Zusicherung.
Ein Score, ein Annahmentest und eine Richtlinienentscheidung beantworten unterschiedliche Beschaffungsfragen. Wir halten diese Fragen getrennt, damit eine Überprüfung nicht mehr Gewissheit beansprucht, als die Belege liefern.
| Nachweis | Nützlich für | Grenze |
|---|---|---|
| Ursprüngliche Punktzahl | Verständnis der Empfehlung des simulierten Bewertungsmodells | Zertifizierungsmerkmale sind von der Bewertung ausgenommen; Annahmen zu Historie und Umsatz bleiben bestehen |
| Proxy-neutrale Vorschau | Prüfung, welche Lieferanten unter einer expliziten Alternative berechtigt werden | Führt weder eine Vergabe aus noch beweist es eigenständig Diskriminierung |
| Kategorie-Diagnostik und Gate | Anwendung der konfigurierten Richtlinie BLOCK, ALLOW oder ABSTAIN | ALLOW ist ein Richtlinienergebnis, kein Beweis dafür, dass jede Gruppe bestanden hat oder kein Proxy verbleibt |
| Gespeicherter Nachweis-Export | Überprüfung der protokollierten Entscheidung zusammen mit ihrer numerischen Grundlage | Lokale JSON-Persistenz und Vorlagen-Mappings, keine unveränderliche Verwahrung oder juristische Zertifizierung |
MeritLens verwendet synthetische Lieferanten und simulierte Vergaben ohne Live-Konnektoren zu Beschaffungsplattformen oder reale Vertragsabwicklungen. Seine Exporte umfassen rechtlich benannte, konfigurierte Vorlagen-Zuordnungen, keine juristische Zertifizierung oder unabhängige Prüfbestätigung. Das kontrafaktische Szenario überschreibt weder die Empfehlung noch das gespeicherte Gate, und die festen synthetischen Kontrollen begründen keine Genauigkeit im realen Beschaffungseinsatz. Der Zugriff auf Produktivdaten, die betriebliche Persistenz und die Zuständigkeiten für menschliche Überprüfungen erfordern jeweils ein eigenes Design und eine eigenständige Validierung.
Im synthetischen Verbindungselemente-Beispiel weist Bridgepoint eine unbereinigte Liefertreue von 98.1 % gegenüber 97.2 % bei Apex auf, erzielt jedoch nur 70.9 Punkte gegenüber einer Shortlist-Untergrenze von 80 Punkten. Die simulierte Formel gewichtet das Vertrauen in Lieferung und Qualität anhand der Transaktions- und Audit-Historie und bewertet den Finanzfaktor anhand des Umsatzes. Eine bessere Lieferleistung allein begründet keine Überlegenheit bei allen legitimen Kriterien.
„Größen-Proxy entfernen“ ändert eine Vergleichsvorschau, nicht die protokollierte Empfehlung oder Gate-Entscheidung. Bridgepoint erreicht 81.0 und Delta 82.9 Punkte, wodurch beide unter jener alternativen Formel shortlist-berechtigt werden. Apex bleibt der Spitzenreiter, und die synthetische Vergabe bleibt zur menschlichen Überprüfung blockiert.
BLOCK erfordert den Nachweis einer Benachteiligung (Adverse Impact) in der Kategorie, einen als nicht-divers eingestuften ursprünglichen Spitzenreiter und einen diversen Herausforderer, der die Shortlist-Untergrenze erst unter dem kontrafaktischen Szenario überschreitet. Eine nicht verfügbare Kategorie-Prüfung führt zu ABSTAIN und hält die simulierte Vergabe ebenfalls zur Prüfung an. Alle anderen Fälle ergeben unter dieser konfigurierten Richtlinie ALLOW, was weder das Fehlen von Proxies noch von Ungleichheiten belegt.
Die Demo enthält sich (ABSTAIN), wenn die ausgewiesene Kategorie-Historie unter 200 liegt oder wenn die nicht-diverse Referenz-Baseline weniger als fünf berücksichtigte Lieferanten-Ereignis-Zeilen oder keine Auswahlen aufweist. Einzelne Gruppen unter fünf Zeilen bleiben unbewertet; Gruppen mit fünf bis neun Zeilen sind informatorisch und können das Kategorie-Urteil nicht bestimmen. Dies sind konfigurierte Stichproben-Sicherheitsgrenzen, keine Garantie für die statistische Angemessenheit eines realen Beschaffungsdatensatzes.
Diese Demo verwendet einen lokalen synthetischen Lieferantendatensatz und simuliert autonome Vergaben. Sie besitzt keinen Live-Konnektor zu Beschaffungsplattformen und führt keine echten Verträge aus. Ein Produktivprojekt müsste Datenzugriff, Bewertungssemantik, Persistenz und Prüfungsbefugnisse für die Zielumgebung etablieren.
Die Erklärung der Differenz vergleicht explizite Formeln unter gewählten Annahmen; sie weist Diskriminierung in der realen Welt nicht eigenständig nach. Rechtlich benannte Exportfelder sind konfigurierte Vorlagen-Zuordnungen, keine juristische Zertifizierung oder unabhängige Prüfungssicherheit. Der Export der blockierten Verbindungselemente behält den ursprünglichen Adverse-Impact-Befund bei, und eine Enthaltung belässt jene Bewertung als ungeprüft.
Der Code speichert die Richtlinienentscheidung und den Audit-Eintrag, bevor optionale Faktoren-Empfehlungen beginnen. Die beratenden Prüfer liefern Labels, Erklärungen und Gegenargumente, während validierte numerische Belege fest in den deterministischen Berechnungen verankert bleiben. Gespeicherte vollständige Empfehlungen können für unveränderte Eingaben wiederverwendet werden, und nicht verfügbare Anbieter fallen auf eine deterministische Prüfung zurück; kein Pfad verleiht beratendem Begleittext die Befugnis, das Gate zu ändern.
Entdecken Sie weiterführende Forschung für einen breiteren Kontext zu dieser Demonstration.
Besprechen Sie die Nachweise, die Ihr Beschaffungskontrollpunkt benötigt.
Wir unterstützen Teams dabei, Annahmen beim Lieferanten-Scoring zu bewerten und einen Prüf-Workflow rund um ihre Daten, Richtlinien und Entscheidungsbefugnisse zu gestalten.