MeritLens · 采购公平性防火墙
更高的交付率仍可能让供应商处于入围底线之下。我们展示历史与营收假设如何影响这一结果,并将解释与模拟授标的审查决策一并留存。
70.9 → 81.0
Bridgepoint 达到预览入围资格
合成紧固件测试夹具;原始分 → 替代分
21.0 分中的 14.0 分
归因于代理假设的分差分值
合成 Apex 与 Bridgepoint 公式对比
BLOCK
已保存的模拟授标决策
需要人工审查;不代表已完成审查
合成供应商与模拟授标。视频与证据旨在说明已配置的演示行为;本页面为解释性说明。
在合成工业紧固件案例中,Bridgepoint Components 的准时交付率为 98.1%,而 Apex Fastener Industries 为 97.2%。然而面对 80 分的入围底线,Bridgepoint 仅得 70.9 分,而 Apex 以 91.9 分领先。
该公式对交易量和审计记录有限的供应商,在其交付率与质量率上赋予较低置信度,并且使用营收进行财务评分。从评分中排除资质认证标签并不能消除这些关于历史与规模的假设。
采购审查人员需要看清哪些假设改变了入围资格、在替代公式下仍保留哪些差异,以及授标策略为何搁置或放行该推荐。单凭更高的交付率并不能解决供应商的财务风险或证明其有权中标。
模拟评分器对交付、质量、财务与价格赋予相等的 25% 权重。其代理中立的替代方案采用原始交付率、原始质量率和实际财务健康状况,保持价格与权重不变。类似 Oaxaca-Blinder 的分解将原始分差拆分为该替代方案下剩余的分差以及归因于已变更假设的残差。
已配置的五分之四诊断使用 0.80 的比率底线,将各申报类别的入选率与非多元基线进行对比。它汇总了该品类内的合成供应商-采购事件记录行(包含重复参与的供应商)。小样本群体无法左右判定结果;品类证据缺失则判定为 ABSTAIN。
BLOCK 需要同时满足全部三项条件:品类存在不利影响、原始最高分者为非多元供应商,以及低于原始底线的多元挑战者在替代公式下达到了该底线。ABSTAIN 同样会将模拟授标搁置以待审查。在此策略下,其余情况均返回 ALLOW。代码在可选的咨询因素审查之前保存关卡判定与审计记录;咨询性文本无法更改该决策或数值证据。
替代公式是一项明确的假设检验,而非独立的因果证明。0.80 底线是配置的演示诊断指标,而非采购法的法定强制要求。
跟踪一个合成采购事件从未经评估的输入到具备明确解释的搁置决策全过程。随后的对照案例将说明为何改变入围资格、通过品类诊断与准予授标是各自独立的结果。此处展示的所有供应商名称、资质认证、历史记录和授标均属于本地演示。
工作区最初显示待评分和待定入围决策的供应商输入。审查 Bridgepoint 可以在评估前检视其交付、质量、交易历史、审计历史及财务输入。这一区别至关重要:在缺少处理这些数据的公式的情况下,仅凭供应商标签或看似突出的交付百分比并不能解释最终得分。

| 合成输入项 | Apex | Bridgepoint |
|---|---|---|
| 准时交付率 | 97.2% | 98.1% |
| 质量合格率 | 96.5% | 97.2% |
| 交易笔数 | 4,200 | 180 |
| 审计次数 | 140 | 9 |
| 营业收入 | USD 820 million | USD 60 million |
模拟评分器将交付、质量、财务和价格各赋予 25% 的权重。交易与审计历史影响其对原始交付率与质量率的置信度;营收则影响财务评分。即使评分中排除了资质认证标签,这些设定也可能对较小规模的供应商造成不利影响。因此,采购方需要评估这些假设的正当性,而不是仅因略去标签就推定其具备中立性。
评估后,Apex 以 91.9 分位列原始最高分。Bridgepoint 得 70.9 分,Delta 得 70.5 分,均低于配置的 80 分入围底线。Bridgepoint 拥有更高的交付率,但单凭这一项指标并不能确立其在财务健康、价格或所有其他合规标准上的优势。

BLOCK 要求满足所有三项配置条件:品类不利影响判定、原始最高分者属于非多元供应商,以及低于原始底线但依靠替代公式达到该底线的多元挑战者。该紧固件事件符合此组合条件。决策在咨询因素审查开始前即已保存,从而保留了数值依据和搁置决定的权威性。
品类诊断汇总了供应商-采购事件记录行(包含重复参与的供应商)。在被纳入考量的记录中,少数族裔所有企业记录行入选 7 次(共 26 次),而非多元基线入选 25 次(共 37 次)。入选率比值约为 0.40,低于配置的 0.80 诊断底线。品类历史元数据 312 是独立的样本保护机制,并非该比较的分母。

| 已变更的假设 | 代理对分差的贡献 |
|---|---|
| 基于交易历史的交付置信度 | 3.01 points |
| 基于审计历史的质量置信度 | 2.50 points |
| 基于营收的财务评分 | 8.47 points |
| 价格评分,未变更 | 0.00 points |
类似 Oaxaca-Blinder 的分解对比了明确的公式。替代方案采用原始交付率、原始质量率和实际财务健康状况,保持价格与权重不变。原始分差中约有三分之二归因于在该对比中所变更的假设;剩余分差仍偏向 Apex。此残差取决于所选的替代方案,而非歧视的独立因果证明。
| 供应商 | 原始评分 | 替代评分 | 预览结果 |
|---|---|---|---|
| Apex Fastener Industries | 91.9 | 88.0 | 保持最高分 |
| Bridgepoint Components | 70.9 | 81.0 | 获得入围资格 |
| Delta Fasteners | 70.5 | 82.9 | 获得入围资格 |

该预览为采购审查人员提供了一个聚焦的问题:在机构能够辩护的评分假设下,这些供应商是否还会被排除?它并没有将 Bridgepoint 选为胜出方、执行授标、对已记录的品类评估重新评分,亦未替代原始评分器。人工审查人员仍需考量采购背景,并决定应如何处置这些已识别出的假设。
在包装材料示例中,原始推荐为 91.7 分的 Beacon,品类诊断为 PASS,配置的关卡返回 ALLOW。然而,作为合成 HUBZone 供应商的 Ironclad 在替代公式下从 72.4 分上升到 81.4 分。因此,策略放行可能与对代理敏感的入围排除并存。

重叠的多元聚合记录行在考量的 12 行中入选 8 次,而非多元基线在考量的 38 行中入选 18 次。其比率约为 1.41。少数族裔所有、HUBZone 和 8(a) 各群体各自仅有四行考量记录,保持未评分状态。因此,品类 PASS 并不代表每个类别均已受评,而 ALLOW 也不代表不存在代理或差距。
「设施与 MRO」采购事件声明的品类历史记录为 140,低于配置的最小值 200。其品类评估和关卡均返回 ABSTAIN,因此模拟自主授标被搁置以待审查。评分和分解仍可计算;但这二者都无法将不可用的品类评估转化为放行许可。

其他保护机制涵盖考量行少于五行或零入选的参考基线。低于五行的个别群体不予评分,而五至九行的群体仅供参考,无法左右品类判定。200 条的最低历史记录和这些群体保护措施属于配置的边界,并不保证真实采购数据集在统计学上是充分的。
该固定套件包含十个具有预期结果的预设原始输入案例:三个 BLOCK、四个 ALLOW 和三个 ABSTAIN。观测到的结果与所有十个预期标签完全吻合。对照用例涵盖历史、审计与营收假设、成熟认证供应商、仅有价格差异、基于绩效的排除、稀疏参考数据以及零入选的参考基线。

一个边界案例在历史记录刚好为 200 时允许评估并返回 ALLOW;另一个在 199 时返回 ABSTAIN。这些对照用例有助于检查系统实现是否在关键边界上遵循了其声明的策略。它们并不确立采购领域的准确性、校准或独立验证。该基准运行无需调用模型,且不会追加寻源审计条目。
该合成项目组合包含跨六个品类的 52 个采购事件和 342 条供应商-事件记录行。这些记录行是重复的参与记录,而非 342 家独立供应商。有 15 个事件被标记为自主授标;重新计算策略会在其中产生 8 个 BLOCK、1 个 ABSTAIN 和 6 个 ALLOW。因此,在此配置下,15 个事件中有 9 个会被搁置以待审查。

在品类层级,扫描报告了 4 个 ADVERSE_IMPACT 判定、1 个 PASS 和 1 个 ABSTAIN。该扫描有助于明确审查人员接下来应当在何处检视证据。它与十案例对照套件相互独立:前者总结了一个种子组合,而后者检验预期的实现行为。二者均不提供关于实际供应商总体的证据。
在评估和咨询因素审查完成后,「Download JSON」和「Print report」将包含已保存的决策、审计条目、品类计数、分解和因素审查。可选的「Proxy Classifier」与「Adversarial Challenger」咨询意见在关卡保存后补充标签与理由阐述。数值证据始终基于代码;咨询性文本无法授权授标。针对未变更的输入,可复用已保存的完整咨询回复,当服务商不可用时则回退至确定性审查。
对于生产环境评估,接下来的问题涉及:哪些历史度量对于合同是站得住脚的、品类比较是否代表了目标供应商群体,以及谁拥有权限解除搁置。该演示使这些问题变得可供检视。其本地 JSON 审计持久化并非不可篡改的第三方托管,而具有法律名称的导出字段是已配置的模板映射,而非法律认证或独立鉴证。
评分、假设检验与策略决策回答不同的采购问题。我们将这些问题明确区分,使审查不会继承超出证据所能提供的确定性。
| 证据 | 适用场景 | 局限性 |
|---|---|---|
| 原始评分 | 理解模拟评分器的推荐理由 | 评分排除了资质认证标签;历史与营收假设依然存在 |
| 代理中立预览 | 检验在明确的替代方案下哪些供应商可获得入围资格 | 不执行授标,亦不独立证明存在歧视 |
| 品类诊断与关卡 | 执行配置的 BLOCK、ALLOW 或 ABSTAIN 策略 | ALLOW 是策略结果,而非每个类别均已通过或不存在代理的证明 |
| 已保存的证据导出 | 结合数值依据审查已记录的决策 | 本地 JSON 持久化与模板映射,并非不可篡改的托管或法律认证 |
MeritLens 使用合成供应商与模拟授标,不包含真实的采购平台连接器或实际的合同执行。其导出内容包含具有法律名称的配置模板映射,而非法律认证或独立鉴证。反事实分析不会覆盖推荐或已保存的关卡,固定合成对照亦不确立采购领域的准确性。生产数据访问、运行持久化与人工审查权限需要单独进行设计和验证。
在合成紧固件示例中,Bridgepoint 的原始交付率为 98.1%,而 Apex 为 97.2%,但面对 80 分的入围底线,其原始得分仅为 70.9 分。模拟公式根据交易和审计历史对交付与质量置信度加权,并根据营收对财务因素评分。单凭更优的交付率并不能确立在所有合规标准上的优势。
「移除规模代理」改变的是对比预览,而非记录的推荐或关卡决策。Bridgepoint 达到 81.0 分,Delta 达到 82.9 分,使二者在该替代公式下均具备入围资格。Apex 仍为最高分获得者,合成授标保持阻断以待人工审查。
BLOCK 要求品类存在不利影响判定、原始最高分者被标记为非多元供应商,并且多元挑战者仅在反事实情境下越过入围底线。不可用的品类评估产生 ABSTAIN,同样会将模拟授标搁置以待审查。在此配置策略下,其余所有情况均返回 ALLOW,这并不代表不存在代理或差距。
当声明的品类历史记录低于 200,或非多元参考基线中纳入考量的供应商-事件记录行少于五行或零入选时,演示将弃权(ABSTAIN)。低于五行的个别群体不予评分;五至九行的群体仅供参考,无法左右品类判定。这些属于配置的样本保护机制,并不保证真实采购数据集在统计学上的充分性。
本演示使用本地合成供应商数据集并模拟自主授标。它不具备实时采购平台连接器,也不执行真实合同。生产项目需要在目标环境中建立数据访问、评分语义、持久化和审查权限。
分差解释是在所选假设下对比明确的公式;它不能独立证实真实世界中的歧视行为。具有法律名称的导出字段属于配置的模板映射,而非法律认证或独立鉴证。被阻断的紧固件导出文件保留了原始的不利影响判定,而弃权(ABSTAIN)则使该评估保持未受评状态。
代码在可选的因素咨询开始前保存策略决策和审计条目。咨询审查者提供标签、解释和质疑,而经过验证的数值证据始终基于确定性计算。保存的完整建议可针对未变更的输入进行复用,不可用的提供商则回退至确定性审查;两种途径均未赋予咨询性文本更改关卡的权限。
探讨您的采购检查关卡所需的证据。
我们帮助团队评估供应商评分假设,并围绕其数据、策略和决策权限设计审查工作流程。