MeritLens · 採購公平性防火牆

在自主授標前解釋供應商排除原因

更佳的交付率仍可能使供應商處於入圍門檻之下。我們展示歷史與營收假設如何影響這一結果,並將解釋與模擬授標的審查決策一併保留。

70.9 → 81.0

Bridgepoint 達到預覽入圍資格

合成緊固件測試夾具;原始分 → 替代分

21.0 分中的 14.0 分

歸因於代理假設的分差分值

合成 Apex 與 Bridgepoint 公式比較

BLOCK

已儲存的模擬授標決策

需要人工審查;不代表已完成審查

合成供應商與模擬授標。影片與證據旨在說明已設定的展示行為;本頁面為解釋性說明。

供應商評分可能掩蓋被排除的原因

在合成 Industrial Fasteners 案例中,Bridgepoint Components 的準時交付率為 98.1%,而 Apex Fastener Industries 為 97.2%。然而面對 80 分的入圍門檻,Bridgepoint 僅得 70.9 分,而 Apex 以 91.9 分領先。

該公式對交易筆數與稽核記錄有限的供應商,在其交付率與品質合格率上給予較低信心度。它亦使用營收進行財務評分。從評分中排除認證標籤並不能消除這些關於歷史與規模的假設。

採購審查人員需要看清哪些假設改變了入圍資格、在替代公式下仍保留哪些差異,以及授標政策為何擱置或放行該推薦。單憑更佳的交付表現並不能解決供應商的財務風險或證明其有權得標。

檢查關卡如何將排除轉化為可審查的證據

比較評分公式

模擬評分器對交付、品質、財務與價格給予相等的 25% 權重。其代理中立的替代方案採用原始交付率、原始品質合格率與實際財務健全狀況,保持價格與權重不變。Oaxaca-Blinder 式分解將原始分差拆分為該替代方案下剩餘的分差,以及歸因於已變更假設的殘差。

檢查品類遴選情況

已設定的五分之四診斷使用 0.80 的比率底線,將各申報類別的遴選率與非多元基準進行比較。它匯總了該品類內的合成供應商-採購事件資料列(包含重複參與的供應商)。小群體無法左右判定結果;無法取得品類證據時則判定為 ABSTAIN。

在取得諮詢建議前儲存決策

BLOCK 需要同時滿足全部三項條件:品類存在不利影響、原始最高分者為非多元供應商,以及低於原始門檻的多元挑戰者在替代公式下達到了該門檻。ABSTAIN 同樣會將模擬授標擱置以待審查。在此政策下,其餘情況均返回 ALLOW。程式碼在可選的諮詢因素審查之前儲存關卡判定與稽核條目;諮詢性敘述文字無法更改該決策或數值證據。

替代公式是一項明確的假設檢驗,而非獨立的因果證明。0.80 底線是已設定的展示診斷指標,而非採購法規的強制要求。

深入案例:解釋排除原因,保留審查權限

追蹤單一合成採購事件從未評估的輸入到具備明確說明的擱置決策全過程。隨後的對照案例將展示為何改變入圍資格、通過品類診斷與准予授標是各自獨立的結果。此處展示的所有供應商名稱、認證、歷史記錄與授標均屬於本地展示。

從評分背後的證據著手

工作區最初顯示處於待評分與待定入圍決策狀態的供應商輸入。在評估前檢視 Bridgepoint 可以揭示其交付、品質、交易歷史、稽核歷史與財務輸入。這一區別至關重要:在缺少取用這些資料的公式的情況下,單憑供應商標籤或看似亮眼的交付百分比無法解釋最終得分。

評估前待評分的 Bridgepoint 原始供應商輸入。
Bridgepoint 是一家合成的少數族裔所有企業供應商。在其產生任何評分、推薦或關卡決策之前,即可對其原始輸入進行檢視。
同一緊固件測試夾具:更佳的原始指標與較短的歷史和較低的營收並存。
合成輸入項ApexBridgepoint
準時交付率97.2%98.1%
品質合格率96.5%97.2%
交易筆數4,200180
稽核次數1409
營業收入USD 820 millionUSD 60 million

模擬評分器將交付、品質、財務與價格因素各賦予 25% 的權重。交易與稽核歷史影響其對原始交付率與品質合格率的信心度;營收則影響財務評分。即使評分中排除了認證標籤,這些設定也可能對規模較小的供應商造成不利影響。因此,買方需要評估這些假設的正當合理性,而不是僅因略去標籤就推定其具備中立性。

檢視原始入圍名單與已儲存的擱置決策

評估後,Apex 以 91.9 分位列原始最高分。Bridgepoint 得 70.9 分,Delta 得 70.5 分,均低於已設定的 80 分入圍門檻。Bridgepoint 擁有更佳的交付率,但單憑這一項指標並不能確立其在財務健全、價格或所有其他正當標準上的優勢。

Apex 得 91.9 分、Bridgepoint 得 70.9 分的原始緊固件入圍名單,以及已儲存的授標擱置。
原始推薦為 Apex。已儲存的 BLOCK 將此次模擬自主授標擱置以待人工審查;這並不代表已完成的審查或真實的合約攔截。

BLOCK 要求滿足所有三項設定條件:品類不利影響判定、原始最高分者屬於非多元供應商,以及低於原始門檻但藉由替代公式達到該門檻的多元挑戰者。該緊固件事件符合此組合條件。決策在諮詢因素審查開始前即已儲存,從而保留了數值依據與擱置決定的權威性。

檢視品類統計與分差來源

品類診斷匯總了供應商-採購事件資料列(包含重複參與的供應商)。在被納入考量的資料列中,少數族裔所有企業資料列獲選 7 次(共 26 次),而非多元基準獲選 25 次(共 37 次)。獲選率比值約為 0.40,低於已設定的 0.80 診斷底線。品類歷史中繼資料 312 是獨立的樣本保護機制,並非該比較的母數。

緊固件品類遴選統計以及 Apex 與 Bridgepoint 分數差距的因素分解。
證據將品類判定與因素比較結合起來。在 21.0 分的原始分差中,有 14.0 分歸因於已變更的歷史與營收假設,而在替代公式下仍存在 7.0 分的分差。
合成 Apex 與 Bridgepoint 分差的四捨五入後因素貢獻。
已變更的假設代理對分差的貢獻
基於交易歷史的交付信心度3.01 points
基於稽核歷史的品質信心度2.50 points
基於營收的財務評分8.47 points
價格評分,未變更0.00 points

Oaxaca-Blinder 式分解比較了明確的公式。替代方案採用原始交付率、原始品質合格率與實際財務健全狀況,保持價格與權重不變。原始分差中約有三分之二歸因於在該比較中所變更的假設;剩餘分差仍偏向 Apex。此殘差取決於所選的替代方案,而非歧視的獨立因果證明。

更改預覽而不重寫決策

顯示的評分經過四捨五入;入圍資格採用至少 80 分的未四捨五入分數。
供應商原始評分替代評分預覽結果
Apex Fastener Industries91.988.0維持最高分
Bridgepoint Components70.981.0獲得入圍資格
Delta Fasteners70.582.9獲得入圍資格
顯示 Bridgepoint 與 Delta 獲得入圍資格且已儲存的 BLOCK 依然可見的替代緊固件入圍名單。
「移除規模代理變數」改變了顯示的比較。Apex 仍為推薦對象,在保留已儲存的 BLOCK 的同時,Bridgepoint 與 Delta 進入了預覽入圍名單。

該預覽為採購審查人員提供了一個聚焦的問題:在機構能夠辯護的評分假設下,這些供應商是否還會被排除?它並未將 Bridgepoint 選為得標者、執行授標、對已記錄的品類評估重新評分,亦未取代原始評分器。人工審查人員仍需考量採購情境,並決定應如何處置這些已識別出的假設。

為什麼 ALLOW 並不意味著每個供應商類別都通過了

在包裝材料範例中,原始推薦為 91.7 分的 Beacon,品類診斷為 PASS,已設定的關卡返回 ALLOW。然而,作為合成 HUBZone 供應商的 Ironclad 在替代公式下從 72.4 分上升至 81.4 分。因此,政策放行可能與對代理變數敏感的入圍排除並存。

包裝評估顯示推薦 Beacon、記錄 ALLOW,且 Ironclad 低於原始入圍門檻。
在此政策下,包裝返回 ALLOW。Ironclad 在替代比較中依然跨過了入圍門檻;通用的授標訊息並不能證明沒有挑戰者可以晉級。

重疊的多元聚合資料列在考量的 12 列中獲選 8 次,而非多元基準在考量的 38 列中獲選 18 次。其比率約為 1.41。少數族裔所有、HUBZone 與 8(a) 各群體各自僅有四列考量資料列,保持未評分狀態。因此,品類 PASS 並不代表每個類別均已受評,而 ALLOW 亦不代表不存在代理變數或差距。

為什麼證據不足會擱置授標

「設施與 MRO」採購事件宣告的品類歷史記錄為 140,低於已設定的最小值 200。其品類評估與關卡均返回 ABSTAIN,因此模擬自主授標被擱置以待審查。評分與分解仍可計算;但這兩者都無法將無法取得的品類評估轉化為放行許可。

由於品類歷史記錄低於已設定的最小值,設施與 MRO 評估被擱置。
ABSTAIN 保留了證據不足與檢查通過之間的區別。匯出的不利影響評估保持未受評狀態。

其他保護機制涵蓋考量資料列少於五列或零獲選的參考基準。低於五列的個別群體不予評分,而五至九列的群體僅供參考,無法左右品類判定。200 筆的最低歷史記錄與這些群體保護措施屬於已設定的邊界,並不保證真實採購資料集在統計學上是充分的。

對照預設對照組檢驗政策

該固定套件包含十個具有預期結果的預設原始輸入案例:三個 BLOCK、四個 ALLOW 與三個 ABSTAIN。觀測到的結果與所有十個預期標籤完全吻合。對照案例涵蓋歷史、稽核與營收假設、成熟認證供應商、僅價格差異、基於績效的排除、稀疏參考資料以及零獲選的參考基準。

顯示預期與觀測結果的十個預設採購對照案例,零不符。
所有十個預設對照案例均與其預期標籤相符:3 個 BLOCK、4 個 ALLOW 與 3 個 ABSTAIN。這是固定合成套件上的實作證據。

一個邊界案例在歷史記錄剛好為 200 時允許評估並返回 ALLOW;另一個在 199 時返回 ABSTAIN。這些對照案例有助於檢查實作是否在關鍵邊界上遵循了其宣告的政策。它們並不確立採購領域的準確性、校準或獨立驗證。該基準測試執行時無需呼叫模型,且不會附加尋源稽核條目。

將投資組合掃描與已執行的干預區分開來

該合成投資組合包含跨六個品類的 52 個採購事件與 342 筆供應商-事件資料列。這些資料列是重複的參與記錄,而非 342 家獨立供應商。有 15 個事件被標記為自主授標;重新計算政策會在其中產生 8 個 BLOCK、1 個 ABSTAIN 與 6 個 ALLOW。因此,在此設定下,15 個事件中有 9 個會被擱置以待審查。

展示 52 個事件與六個品類假設政策結果的合成投資組合掃描。
該掃描總結了合成佇列中的假設性決策。其產生的 9 次擱置是計算得出的政策結果,而非 9 次真實干預或已完成稽核的授標。

在品類層級,掃描回報了 4 個 ADVERSE_IMPACT 判定、1 個 PASS 與 1 個 ABSTAIN。該掃描有助於確定審查人員接下來應當在何處檢視證據。它與十案例對照套件相互獨立:前者總結了一個帶種子的投資組合,而後者檢查預期的實作行為。兩者均不提供關於實際廠商母體的證據。

將決策及其證據移交審查人員

在評估與諮詢因素審查完成後,Download JSON 與 Print report 將包含已儲存的決策、稽核條目、品類計數、分解與因素審查。可選的 Proxy Classifier 與 Adversarial Challenger 諮詢意見在關卡儲存後補充標籤與理由說明。數值證據始終奠基於程式碼;諮詢性敘述文字無法授權授標。針對未變更的輸入,可重複使用已儲存的完整諮詢回覆,當提供商不可用時則降級為確定性審查。

對於正式環境評估,接下來的問題涉及:哪些歷史度量對於合約是具抗辯力的、品類比較是否代表了目標供應商群體,以及誰有權限解除擱置。該展示使這些問題變得可供檢視。其本地 JSON 稽核持續性並非不可竄改的第三方託管,而具法律命名的匯出欄位是已設定的範本對應,而非法律認證或獨立保證。

各項證據能夠支援什麼

評分、假設檢驗與政策決策回答不同的採購問題。我們將這些問題保持分離,使審查不會繼承超出證據所能提供的確定性。

證據適用於限制
原始評分理解模擬評分器的推薦理由評分中排除了認證標籤;歷史與營收假設依然存在
代理中立預覽檢驗在明確的替代方案下哪些供應商可獲得入圍資格不執行授標,亦不獨立證明存在歧視
品類診斷與關卡套用已設定的 BLOCK、ALLOW 或 ABSTAIN 政策ALLOW 是政策結果,而非每個類別均已通過或不存在代理變數的證明
已儲存的證據匯出結合數值依據審查已記錄的決策本地 JSON 永續性與範本對應,並非不可竄改的託管或法律認證

本展示不執行的事項

MeritLens 使用合成供應商與模擬授標,不包含正式採購平台連接器或實際的合約執行。其匯出內容包含具法律命名的已設定範本對應,而非法律認證或獨立保證。反事實分析不會覆寫推薦或已儲存的關卡,固定合成對照組亦不確立採購領域的準確性。正式環境資料存取、維運持續性與人工審查權限需要單獨進行設計與驗證。

採購團隊常見問題

為什麼交付表現更佳的供應商未能入圍?

在合成緊固件範例中,Bridgepoint 的原始交付率為 98.1%,而 Apex 為 97.2%,但面對 80 分的入圍門檻,其原始得分僅為 70.9 分。模擬公式根據交易與稽核歷史對交付與品質信心度加權,並根據營收對財務因素評分。單憑更佳的交付表現並不能確立在所有正當標準上的優勢。

移除規模代理變數是否會改變誰贏得合約?

「移除規模代理變數」改變的是比較預覽,而非記錄的推薦或關卡決策。Bridgepoint 達到 81.0 分,Delta 達到 82.9 分,使兩者在該替代公式下均具備入圍資格。Apex 仍為最高分獲得者,合成授標維持阻斷以待人工審查。

究竟是什麼促使 MeritLens 阻斷一項授標?

BLOCK 要求品類存在不利影響判定、原始最高分者被標記為非多元供應商,且多元挑戰者僅在反事實情境下跨過入圍門檻。無法取得的品類評估產生 ABSTAIN,同樣會將模擬授標擱置以待審查。在此已設定政策下,其餘所有情況均返回 ALLOW,這並不代表不存在代理變數或差距。

當我們沒有足夠的供應商資料時會發生什麼?

當宣告的品類歷史記錄低於 200,或非多元參考基準中納入考量的供應商-事件資料列少於五列或零獲選時,展示將棄權(ABSTAIN)。低於五列的個別群體不予評分;五至九列的群體僅供參考,無法左右品類判定。這些屬於已設定的樣本保護機制,並不保證真實採購資料集在統計學上的充分性。

我們能否將其連接到既有的採購平台?

本展示使用本地合成供應商資料集並模擬自主授標。它不具備正式採購平台連接器,亦不執行真實合約。正式專案需要在目標環境中建立資料存取、評分語意、持續性與審查權限。

該報告是否證明存在歧視或證明符合法律合規性?

分差解釋是在所選假設下比較明確的公式;它無法獨立證實真實世界中的歧視行為。具法律命名的匯出欄位屬於已設定的範本對應,而非法律認證或獨立保證。被阻斷的緊固件匯出檔案保留了原始的不利影響判定,而棄權(ABSTAIN)則使該評估保持未受評狀態。

語言模型的建議能否改變授標決策?

程式碼在可選的因素諮詢開始前儲存政策決策與稽核條目。諮詢審查者提供標籤、解釋與質疑,而經過驗證的數值證據始終奠基於確定性計算。已儲存的完整建議可針對未變更的輸入重複使用,無法取得的提供者則降級為確定性審查;兩種途徑均未賦予諮詢性敘述文字更改關卡的權限。

技術研究

探索相關研究,獲取本展示的更廣泛背景。

將評分假設納入審查議程

探討您的採購檢查關卡所需的證據。

我們協助團隊評估供應商評分假設,並圍繞其資料、政策與決策權限設計審查工作流程。

供應商評分評估

  • ✓ 審查評分輸入與假設
  • ✓ 定義品類比較問題
  • ✓ 評估樣本與資料限制
  • ✓ 明確採購審查所需證據

檢查關卡設計

  • ✓ 梳理評分器與決策邊界
  • ✓ 規劃人工審查分流路徑
  • ✓ 規劃資料存取與持續性
  • ✓ 設定部署前驗證標準