MeritLens · 조달 공정성 방화벽
더 우수한 납기 준수율을 기록한 공급업체라도 숏리스트 기준선 미달로 남을 수 있습니다. 거래 이력과 매출에 대한 가정이 이러한 결과를 어떻게 형성하는지 보여드리고, 시뮬레이션된 낙찰의 검토 결정과 함께 그 설명을 보존합니다.
70.9 → 81.0
Bridgepoint가 프리뷰 적격 기준을 충족함
합성 패스너 fixture; 원래 점수 → 대체 점수
21.0점 중 14.0점
프록시 가정에 기인한 격차 점수
합성 Apex 대 Bridgepoint 산출식 비교
BLOCK
저장된 시뮬레이션 낙찰 결정
담당자 검토 필요; 완료된 검토를 나타내는 것은 아님
합성 공급업체 및 시뮬레이션된 낙찰. 영상과 증거는 설정된 데모 동작을 설명하며, 본 페이지는 안내 설명서입니다.
합성 Industrial Fasteners 사례에서 Bridgepoint Components의 정시 납기율은 98.1%로, Apex Fastener Industries의 97.2%보다 높습니다. 하지만 80점 숏리스트 기준선에 대해 Bridgepoint는 70.9점을 기록한 반면 Apex는 91.9점으로 선두를 달립니다.
산출식은 거래 및 감사 이력이 제한된 공급업체의 납기 및 품질 적합률에 더 낮은 신뢰도를 부여합니다. 또한 재무 스코어링에 매출액을 사용합니다. 점수 산정에서 인증 라벨을 제외하더라도 이러한 이력 및 규모 가정이 제거되지는 않습니다.
조달 검토 담당자는 어떤 가정이 적격성을 바꾸는지, 대체 산출식 하에서 어떤 차이가 남는지, 그리고 낙찰 정책이 권고안을 보류하거나 허용하는 이유가 무엇인지 확인할 수 있어야 합니다. 납기 준수율이 더 우수하다는 사실만으로 공급업체의 재무적 위험이나 낙찰 자격이 확정되지는 않습니다.
시뮬레이션 스코어러는 납기, 품질, 재무, 가격에 동일하게 25%의 가중치를 부여합니다. 프록시 중립적 대체 방식은 가격과 가중치를 변경하지 않은 채 원래의 납기 준수율과 품질 적합률, 그리고 실제 재무 건전성을 반영합니다. Oaxaca-Blinder 스타일 분해 기법은 원래의 격차를 해당 대체 방식 하에서 여전히 남는 격차와 변경된 가정에 기인한 잔차로 분리합니다.
설정된 4/5 진단 기준은 0.80의 비율 하한선을 적용하여 보고된 각 분류군의 선정률을 비다양성 기준선과 비교합니다. 이는 반복 참여한 공급업체를 포함하여 해당 카테고리 내의 합성 공급업체-이벤트 행들을 취합합니다. 표본이 적은 그룹은 판정을 좌우할 수 없으며, 카테고리 증거가 확보되지 않으면 ABSTAIN을 반환합니다.
BLOCK에는 카테고리 차원의 불리한 영향(adverse impact), 비다양성 기업인 원래의 최고 득점자, 원래 기준선 미달이었으나 대체 산출식에서 기준선에 도달하는 다양성 도전자라는 세 가지 조건이 모두 필요합니다. ABSTAIN 역시 검토를 위해 시뮬레이션 낙찰을 보류합니다. 이 정책 하에서 다른 모든 사례는 ALLOW를 반환합니다. 코드는 선택적인 자문 요인 검토가 시작되기 전에 게이트 결정과 감사 항목을 저장하므로, 자문 텍스트가 결정이나 수치적 증거를 변경할 수 없습니다.
대체 산출식은 명시적인 가정 테스트일 뿐 독립적인 인과 관계의 증명이 아닙니다. 0.80 하한선은 설정된 데모 진단 기준이며 조달 법률상의 의무 조항이 아닙니다.
평가되지 않은 입력값부터 설명이 수반된 보류 결정에 이르기까지 합성 소싱 이벤트 하나를 단계별로 살펴보십시오. 그런 다음 대조 사례들을 통해 숏리스트 적격성 변경, 카테고리 진단 통과, 낙찰 허용이 왜 서로 독립된 별개의 결과인지 보여줍니다. 여기에 표시된 모든 공급업체명, 인증, 이력 및 낙찰 내역은 로컬 데모에 속합니다.
워크스페이스에는 처음에 점수 및 숏리스트 결정이 대기 중인 상태의 공급업체 입력값이 표시됩니다. Bridgepoint를 검사하면 평가 전에 납기, 품질, 거래 이력, 감사 이력 및 재무 입력값이 드러납니다. 이러한 구분이 중요합니다. 공급업체 라벨이나 겉보기에 우수한 납기 백분율만으로는 이를 사용하는 산출식 없이 점수를 설명할 수 없기 때문입니다.

| 합성 입력값 | Apex | Bridgepoint |
|---|---|---|
| 정시 납기율 | 97.2% | 98.1% |
| 품질 적합률 | 96.5% | 97.2% |
| 거래 건수 | 4,200 | 180 |
| 감사 횟수 | 140 | 9 |
| 매출액 | USD 820 million | USD 60 million |
시뮬레이션 스코어러는 납기, 품질, 재무, 가격 요인에 각각 25%씩 가중치를 부여합니다. 거래 및 감사 이력은 원시 납기 및 품질 적합률에 부여하는 신뢰도 수준에 영향을 미치며, 매출액은 재무 점수에 영향을 미칩니다. 이러한 설정은 점수 산정에서 인증 라벨이 제외되어 있더라도 규모가 작은 공급업체에 불이익을 줄 수 있습니다. 따라서 구매 담당자는 라벨이 생략되었다는 사실에서 중립성을 추론하기보다는 해당 가정의 타당성을 평가해야 합니다.
평가 후 Apex는 91.9점으로 원래의 최고 득점자가 됩니다. Bridgepoint는 70.9점, Delta는 70.5점을 기록하여 설정된 숏리스트 기준선인 80점 미만에 머뭅니다. Bridgepoint가 더 우수한 납기 준수율을 보유하고 있지만, 그 단일 지표가 재무 건전성, 가격 또는 다른 모든 정당한 기준에서의 우수성을 입증하지는 않습니다.

BLOCK에는 설정된 세 가지 조건, 즉 카테고리 불리한 영향(adverse-impact) 판정, 비다양성 기업인 원래의 최고 득점자, 원래 기준선 미달이었으나 대체 산출식에서 기준선에 도달하는 다양성 도전자라는 조건이 모두 필요합니다. 이번 패스너 소싱 이벤트는 해당 조합을 충족합니다. 결정은 자문 요인 검토가 시작되기 전에 저장되므로 수치적 근거와 보류 조치의 권한이 그대로 보존됩니다.
카테고리 진단은 반복 참여한 공급업체를 포함하여 공급업체-이벤트 행들을 취합합니다. 소수자 소유 기업 행은 심사 대상 26건 중 7건이 선정되었으며, 비다양성 기준선은 37건 중 25건이 선정되었습니다. 선정률 비율은 약 0.40으로 설정된 0.80 진단 하한선 미만입니다. 312건이라는 카테고리 이력 메타데이터는 별도의 표본 안전장치(sample guard)이며, 해당 비교의 분모가 아닙니다.

| 변경된 가정 | 격차에 대한 프록시 기여도 |
|---|---|
| 거래 이력에 기반한 납기 신뢰도 | 3.01점 |
| 감사 이력에 기반한 품질 신뢰도 | 2.50점 |
| 매출액 기반 재무 스코어링 | 8.47점 |
| 가격 스코어링(변경 없음) | 0.00점 |
Oaxaca-Blinder 스타일 분해 기법은 명시적인 산출식을 비교합니다. 대체 방식은 가격과 가중치를 동일하게 유지하면서 원래의 납기 및 품질 적합률과 실제 재무 건전성을 사용합니다. 원래 격차의 약 3분의 2는 해당 비교에서 변경된 가정에 기인하며, 남은 격차는 여전히 Apex에 유리합니다. 이 잔차는 선택된 대체 방식에 조건부로 종속된 결과이며, 차별에 대한 독립적인 인과 관계 증명이 아닙니다.
| 공급업체 | 원래 점수 | 대체 점수 | 프리뷰 결과 |
|---|---|---|---|
| Apex Fastener Industries | 91.9 | 88.0 | 최고 득점자 유지 |
| Bridgepoint Components | 70.9 | 81.0 | 적격 기준 충족 |
| Delta Fasteners | 70.5 | 82.9 | 적격 기준 충족 |

이 프리뷰는 조달 검토 담당자에게 다음과 같은 핵심 질문을 던집니다. 조직이 정당성을 방어할 수 있는 스코어링 가정 하에서도 과연 이 공급업체들이 배제되었을 것인가? 이 기능은 Bridgepoint를 낙찰자로 선정하거나, 계약을 체결하거나, 기록된 카테고리 평가를 다시 채점하거나, 원래의 스코어러를 대체하지 않습니다. 실무 검토자는 여전히 조달 맥락을 고려하여 식별된 가정들을 어떻게 처리해야 할지 결정해야 합니다.
Packaging Materials(포장재) 사례의 경우, 원래의 권고 대상은 91.7점의 Beacon이며, 카테고리 진단은 PASS이고 설정된 게이트는 ALLOW를 반환합니다. 그럼에도 합성 HUBZone 공급업체인 Ironclad는 대체 산출식 하에서 72.4점에서 81.4점으로 상승합니다. 따라서 정책적 허용과 프록시에 민감한 숏리스트 배제가 공존할 수 있습니다.

중복을 포함한 다양성 집합체는 심사 대상 12개 행 중 8개가 선정된 반면, 비다양성 기준선은 38개 중 18개가 선정되었습니다. 그 비율은 약 1.41입니다. 개별 소수자 소유, HUBZone 및 8(a) 그룹은 각각 심사 대상 행이 4개에 불과하여 점수가 매겨지지 않았습니다(unscored). 따라서 카테고리 PASS가 모든 분류군이 평가되었음을 입증하지는 않으며, ALLOW가 프록시나 격차의 부재를 입증하지도 않습니다.
Facilities and MRO(설비 및 MRO) 소싱 이벤트는 보고된 카테고리 이력이 140건으로, 설정된 최소 기준인 200건 미만입니다. 카테고리 평가와 게이트 모두 ABSTAIN을 반환하므로 시뮬레이션된 자율 낙찰은 검토를 위해 보류됩니다. 점수와 분해 내역은 여전히 계산될 수 있지만, 어느 것도 평가 불가능한 카테고리 상태를 승인으로 전환시키지는 못합니다.

다른 안전장치들은 심사 대상 행이 5개 미만이거나 선정이 전혀 없는 기준선(reference baseline)을 다룹니다. 5개 미만의 개별 그룹은 점수가 매겨지지 않으며, 5개에서 9개 사이의 행을 가진 그룹은 정보 제공용일 뿐 카테고리 판정을 좌우할 수 없습니다. 최소 이력 200건과 이러한 그룹 안전장치는 설정된 경계 기준일 뿐이며, 실제 조달 데이터 세트의 통계적 적절성을 보장하지는 않습니다.
고정된 테스트 스위트는 예상 결과가 포함된 10개의 작성된 원시 입력 사례를 포함합니다: 3건의 BLOCK, 4건의 ALLOW, 3건의 ABSTAIN. 관찰된 결과는 10개 예상 라벨과 모두 일치합니다. 통제 사례는 이력, 감사 및 매출 가정, 기존 인증 공급업체, 가격 전용 차이, 성과 기반 배제, 희소한 참조 데이터 및 선정이 없는 참조 기준선을 다룹니다.

한 경계 사례에서는 이력이 정확히 200일 때 평가를 허용하여 ALLOW를 반환하고, 199인 다른 사례에서는 ABSTAIN을 반환합니다. 이러한 통제 장치는 중요한 경계값에서 구현이 명시된 정책을 준수하는지 점검하는 데 도움이 됩니다. 이것이 실제 조달 현장에서의 정확도, 보정(calibration) 또는 독립적 검증을 입증하지는 않습니다. 벤치마크는 모델 호출 없이 실행되며 소싱 감사 항목을 추가하지 않습니다.
합성 포트폴리오는 6개 카테고리에 걸쳐 52개 이벤트와 342개 공급업체-이벤트 행을 포함합니다. 이 행들은 반복적인 참여 기록이며 342개의 고유 공급업체를 의미하는 것은 아닙니다. 15개 이벤트가 자율 낙찰 대상으로 지정되어 있으며, 정책을 재계산하면 이 중 8건의 BLOCK, 1건의 ABSTAIN, 6건의 ALLOW가 도출됩니다. 따라서 이 설정 하에서는 15건 중 9건이 검토를 위해 보류됩니다.

카테고리 수준에서 스캔은 4건의 ADVERSE_IMPACT 판정, 1건의 PASS, 1건의 ABSTAIN을 보고합니다. 이 스캔은 검토 담당자가 다음으로 증거를 점검해야 할 위치를 식별하는 데 도움을 줍니다. 이는 10개 사례의 통제 스위트와 분리되어 있습니다. 하나는 초기 구성된(seeded) 포트폴리오를 요약하고, 다른 하나는 예상되는 구현 동작을 점검합니다. 둘 중 어느 것도 실제 공급업체 모집단에 대한 증거를 제공하지는 않습니다.
평가 및 자문 요인 검토가 완료되면 Download JSON 및 Print report에 저장된 결정, 감사 항목, 카테고리 집계, 분해 내역 및 요인 검토 결과가 포함됩니다. 게이트 결정이 저장된 후 선택 사항인 Proxy Classifier 및 Adversarial Challenger 자문이 라벨과 근거를 추가합니다. 수치적 증거는 코드에 확고히 근거하며 자문 텍스트가 낙찰을 승인할 수는 없습니다. 변경되지 않은 입력값에 대해 완전히 저장된 자문 응답을 재사용할 수 있으며, 제공업체(LLM)를 사용할 수 없는 경우 결정론적 검토로 대체(fallback)됩니다.
프로덕션 평가를 위한 다음 질문들은 해당 계약에 대해 어떤 이력 측정치가 방어 가능한지, 카테고리 비교가 의도한 공급업체 모집단을 대표하는지, 그리고 보류 조치를 해결할 권한이 누구에게 있는지에 관한 것입니다. 데모는 이러한 질문들을 직접 점검할 수 있도록 지원합니다. 로컬 JSON 감사 지속성은 변경 불가능한 제3자 보관이 아니며, 법적 명칭이 지정된 내보내기 필드는 법적 인증이나 독립적인 보증이 아닌 설정된 매핑일 뿐입니다.
점수, 가정 테스트, 정책 결정은 서로 다른 조달 질문에 답합니다. 우리는 검토 과정이 증거가 제공하는 수준 이상의 확신을 갖지 않도록 이러한 질문들을 분리하여 유지합니다.
| 증거 유형 | 유용한 용도 | 한계 |
|---|---|---|
| 원래 점수 | 시뮬레이션 스코어러의 권고안 이해 | 인증 라벨은 점수 산정에서 제외되지만, 이력 및 매출 가정은 그대로 유지됨 |
| 프록시 중립적 프리뷰 | 명시적인 대체 기준 하에서 어떤 공급업체가 적격을 획득하는지 테스트 | 낙찰을 집행하거나 차별을 독립적으로 증명하지는 않음 |
| 카테고리 진단 및 게이트 | 설정된 BLOCK, ALLOW 또는 ABSTAIN 정책 적용 | ALLOW는 정책적 결과일 뿐이며, 모든 분류군이 통과했거나 프록시가 전혀 없음을 증명하지 않음 |
| 저장된 증거 내보내기 | 수치적 근거와 함께 기록된 결정을 검토 | 로컬 JSON 지속성 및 템플릿 매핑이며, 변경 불가능한 보관이나 법적 인증이 아님 |
MeritLens는 실제 조달 플랫폼 커넥터나 실제 계약 집행 없이 합성 공급업체와 시뮬레이션 낙찰을 사용합니다. 내보내기 파일에는 법적 명칭이 지정된 설정 템플릿 매핑이 포함되어 있으며, 법적 인증이나 독립적인 보증이 아닙니다. 반사실적(counterfactual) 분석은 권고안이나 저장된 게이트를 덮어쓰지 않으며, 고정된 합성 통제군은 실제 조달 현장의 정확도를 입증하지 않습니다. 프로덕션 데이터 액세스, 운영 지속성 및 담당자 검토 권한은 별도의 설계와 검증이 필요합니다.
합성 패스너 사례에서 Bridgepoint는 98.1%의 원시 정시 납기율을 기록하여 Apex의 97.2%보다 높지만, 80점 숏리스트 기준선에 대해 원래 점수는 70.9점에 그칩니다. 시뮬레이션 산출식은 거래 및 감사 이력에 따라 납기 및 품질 신뢰도에 가중치를 부여하고, 매출액을 기준으로 재무 요인을 평가합니다. 우수한 납기 실적 하나만으로 모든 정당한 기준에서의 우수성이 증명되는 것은 아닙니다.
Remove size proxy(규모 프록시 제거)는 비교 프리뷰만 변경할 뿐, 기록된 권고안이나 게이트 결정을 변경하지 않습니다. Bridgepoint는 81.0점, Delta는 82.9점에 도달하여 해당 대체 산출식 하에서 두 업체 모두 숏리스트 적격 기준을 충족합니다. Apex는 여전히 최고 득점자로 남으며, 합성 낙찰은 담당자 검토를 위해 계속 차단(BLOCK) 상태로 유지됩니다.
BLOCK 판정에는 카테고리 불리한 영향(adverse-impact) 확인, 비다양성 기업으로 분류된 원래의 최고 득점자, 반사실적(counterfactual) 조건에서만 숏리스트 기준선을 통과하는 다양성 도전자라는 조건이 요구됩니다. 카테고리 평가를 진행할 수 없는 경우 ABSTAIN이 발생하며 이 역시 검토를 위해 시뮬레이션 낙찰을 보류합니다. 이 설정 정책 하에서 다른 모든 사례는 ALLOW를 반환하지만, 이것이 프록시나 격차의 부재를 입증하지는 않습니다.
본 데모는 보고된 카테고리 이력이 200건 미만이거나, 비다양성 참조 기준선의 심사 대상 공급업체-이벤트 행이 5건 미만 또는 선정이 없는 경우 기권(ABSTAIN)합니다. 5건 미만의 개별 그룹은 점수가 매겨지지 않으며, 5건에서 9건 사이의 행을 가진 그룹은 정보 제공용일 뿐 카테고리 판정을 좌우할 수 없습니다. 이는 설정된 표본 안전장치이며, 실제 조달 데이터 세트에 대한 통계적 적절성을 보장하는 것은 아닙니다.
본 데모는 로컬 합성 공급업체 데이터 세트를 활용하여 자율 낙찰을 시뮬레이션합니다. 실제 조달 플랫폼과의 실시간 커넥터나 실제 계약 집행 기능은 포함되어 있지 않습니다. 실제 프로덕션 프로젝트에서는 대상 환경에 맞는 데이터 액세스, 스코어링 의미 체계, 지속성 관리 및 검토 권한 체계를 구축해야 합니다.
격차 설명은 선택된 가정 하에서 명시적인 산출식을 비교할 뿐이며, 현실 세계에서의 차별을 독립적으로 입증하지는 않습니다. 법적 명칭이 지정된 내보내기 필드는 설정된 템플릿 매핑이며, 법적 인증이나 독립적인 보증이 아닙니다. 차단된 패스너 내보내기는 원래의 불리한 영향(adverse-impact) 판정 결과를 유지하며, 기권(abstention) 시 해당 평가는 미평가 상태로 남습니다.
코드는 선택적 요인 자문이 시작되기 전에 정책 결정과 감사 항목을 저장합니다. 자문 검토자는 라벨, 설명 및 이의 제기를 제공하지만, 검증된 수치 증거는 결정론적 계산에 확고하게 뿌리를 두고 있습니다. 저장된 완전한 자문 내용은 변경되지 않은 입력값에 대해 재사용될 수 있으며, 제공업체(LLM)를 사용할 수 없는 경우 결정론적 검토로 대체됩니다. 두 경로 모두 자문 텍스트에 게이트 결정을 변경할 수 있는 권한을 부여하지 않습니다.
본 데모의 폭넓은 맥락을 이해하기 위한 관련 연구 자료를 살펴보세요.
귀사의 조달 체크포인트에 필요한 증거를 논의해 보세요.
우리는 조직이 공급업체 스코어링 가정을 평가하고 데이터, 정책 및 의사결정 권한 체계에 맞춘 검토 워크플로를 설계할 수 있도록 지원합니다.