MeritLens · Firewall de equidad en compras
Una mejor tasa de entrega aún puede dejar a un proveedor por debajo del umbral de preselección. Mostramos cómo las suposiciones sobre el historial y los ingresos determinan ese resultado y, a continuación, preservamos la explicación junto con la decisión de revisión de una adjudicación simulada.
70.9 → 81.0
Bridgepoint alcanza la elegibilidad en la vista previa
Fixture sintético de sujetadores industriales; puntuación original → alternativa
14.0 de 21.0
Puntos de brecha atribuidos a suposiciones proxy
Comparación de fórmulas sintéticas entre Apex y Bridgepoint
BLOCK
Decisión de adjudicación simulada guardada
Revisión humana obligatoria; no se representa una revisión completada
Proveedores sintéticos y adjudicaciones simuladas. El vídeo y las evidencias explican el comportamiento configurado de la demo; esta página es explicativa.
En el caso sintético de Industrial Fasteners, Bridgepoint Components entrega a tiempo con un 98.1%, frente al 97.2% de Apex Fastener Industries. Sin embargo, Bridgepoint obtiene 70.9 puntos frente al umbral de preselección de 80 puntos, mientras que Apex lidera con 91.9.
La fórmula asigna a las tasas de entrega y calidad de un proveedor con un historial limitado de transacciones y auditorías una menor confianza estadística. También utiliza los ingresos para la puntuación financiera. Excluir las etiquetas de certificación de una puntuación no elimina estas suposiciones sobre el historial y el tamaño.
El revisor de compras necesita comprobar qué suposiciones alteran la elegibilidad, qué diferencias persisten bajo una fórmula alternativa y por qué la política de adjudicación retiene o aprueba la recomendación. Un mejor rendimiento de entrega por sí solo no resuelve el riesgo financiero del proveedor ni su derecho a una adjudicación.
El sistema de puntuación simulado asigna a los factores de entrega, calidad, financiero y precio ponderaciones iguales del 25%. Su alternativa neutral respecto a proxies utiliza tasas de entrega y calidad brutas y la salud financiera real, manteniendo el precio y las ponderaciones sin cambios. La descomposición al estilo Oaxaca-Blinder divide la brecha original entre la brecha remanente bajo esa alternativa y un residuo atribuido a las suposiciones modificadas.
El diagnóstico configurado de cuatro quintos compara la tasa de selección de cada clase registrada con la línea base no diversa, utilizando un umbral de ratio de 0.80. Agrupa filas de eventos de proveedores sintéticos dentro de la categoría, incluidos los proveedores repetidos. Los grupos pequeños no pueden determinar el veredicto; si la evidencia por categoría no está disponible, se devuelve ABSTAIN.
BLOCK requiere las tres condiciones: impacto adverso en la categoría, un líder original no diverso y un competidor diverso que esté por debajo del umbral original pero lo alcance con la fórmula alternativa. ABSTAIN también retiene la adjudicación simulada para su revisión. Los demás casos devuelven ALLOW según esta política. El código guarda la compuerta y la entrada de auditoría antes de la revisión consultiva opcional de factores; el texto consultivo no puede alterar la decisión ni la evidencia numérica.
La fórmula alternativa es una prueba de suposiciones explícita, no una prueba causal independiente. El umbral de 0.80 es un diagnóstico configurado de la demo, no un mandato de la legislación de contratación pública.
Siga un evento de compras sintético desde las entradas no evaluadas hasta una retención justificada. Los casos comparativos muestran a continuación por qué modificar la elegibilidad de preselección, superar un diagnóstico de categoría y autorizar una adjudicación constituyen resultados independientes. Todos los nombres de proveedores, certificaciones, historiales y adjudicaciones aquí mostrados pertenecen a la demostración local.
El espacio de trabajo muestra inicialmente las entradas de los proveedores con puntuaciones y decisiones de preselección pendientes. Al inspeccionar Bridgepoint, se exponen los datos de entrega, calidad, historial de transacciones, historial de auditorías y finanzas antes de la evaluación. Esta distinción es fundamental: una etiqueta de proveedor o un porcentaje de entrega aparentemente alto no pueden justificar la puntuación sin la fórmula que los procesa.

| Entrada sintética | Apex | Bridgepoint |
|---|---|---|
| Entrega a tiempo | 97.2% | 98.1% |
| Tasa de aprobación de calidad | 96.5% | 97.2% |
| Transacciones | 4,200 | 180 |
| Auditorías | 140 | 9 |
| Ingresos | USD 820 million | USD 60 million |
El evaluador simulado pondera los factores de entrega, calidad, financiero y precio al 25% cada uno. El historial de transacciones y de auditorías afecta al grado de confianza que asigna a las tasas brutas de entrega y calidad; los ingresos influyen en la puntuación financiera. Estas elecciones pueden penalizar a un proveedor más pequeño aunque las etiquetas de certificación se excluyan de la puntuación. Por tanto, el comprador necesita evaluar la justificación de dichas suposiciones en lugar de deducir neutralidad a partir de etiquetas omitidas.
Tras la evaluación, Apex es el líder original con 91.9 puntos. Bridgepoint obtiene 70.9 y Delta obtiene 70.5 puntos, ambos por debajo del umbral de preselección configurado de 80. Bridgepoint presenta una mejor tasa de entrega, pero esa métrica aislada no demuestra superioridad en salud financiera, precio ni en los demás criterios legítimos.

BLOCK requiere las tres condiciones configuradas: una conclusión de impacto adverso en la categoría, un líder original no diverso y un competidor diverso que se encuentre por debajo del umbral original pero lo alcance con la fórmula alternativa. El evento de sujetadores cumple esa combinación. La decisión se guarda antes de iniciar la revisión consultiva de factores, preservando la base numérica y la autoridad de la retención.
El diagnóstico de categoría agrupa filas de eventos de proveedores, incluidos los proveedores repetidos. Las filas de empresas pertenecientes a minorías registran 7 selecciones de 26 consideradas, en comparación con 25 de 37 para la línea base no diversa. El ratio de tasa de selección es de aproximadamente 0.40, por debajo del umbral diagnóstico configurado de 0.80. El metadato de historial de categoría de 312 es una protección de muestra independiente; no es el denominador de dicha comparación.

| Suposición modificada | Contribución proxy a la brecha |
|---|---|
| Confianza en la entrega según el historial de transacciones | 3.01 puntos |
| Confianza en la calidad según el historial de auditorías | 2.50 puntos |
| Puntuación financiera basada en ingresos | 8.47 puntos |
| Puntuación de precio, sin cambios | 0.00 puntos |
La descomposición al estilo Oaxaca-Blinder compara fórmulas explícitas. La alternativa utiliza tasas de entrega y calidad brutas y la salud financiera real, manteniendo el precio y las ponderaciones sin cambios. Alrededor de dos tercios de la brecha original se atribuyen a las suposiciones modificadas en esa comparación; la brecha remanente sigue favoreciendo a Apex. Este residuo está condicionado a la alternativa elegida, en lugar de constituir una prueba causal independiente de discriminación.
| Proveedor | Puntuación original | Puntuación alternativa | Resultado de vista previa |
|---|---|---|---|
| Apex Fastener Industries | 91.9 | 88.0 | Se mantiene como líder |
| Bridgepoint Components | 70.9 | 81.0 | Pasa a ser elegible |
| Delta Fasteners | 70.5 | 82.9 | Pasa a ser elegible |

Esa vista previa plantea a los revisores de compras una pregunta concreta: ¿habrían sido excluidos estos proveedores bajo suposiciones de puntuación que la organización pueda defender? No elige a Bridgepoint como ganador, ni ejecuta una adjudicación, ni vuelve a puntuar la evaluación de categoría registrada ni reemplaza al evaluador original. Un revisor humano aún necesitaría considerar el contexto de compras y decidir cómo deben abordarse las suposiciones identificadas.
En el ejemplo de Packaging Materials, la recomendación original es Beacon con 91.7, el diagnóstico de categoría es PASS y la compuerta configurada devuelve ALLOW. Sin embargo, Ironclad, un proveedor sintético de HUBZone, pasa de 72.4 a 81.4 bajo la fórmula alternativa. Por consiguiente, una autorización de política puede coexistir con una exclusión de preselección sensible a proxies.

El agregado diverso superpuesto registra 8 selecciones de 12 filas consideradas, frente a 18 de 38 para la línea base no diversa. Su ratio es de aproximadamente 1.41. Los grupos individuales de empresas pertenecientes a minorías, HUBZone y 8(a) tienen solo cuatro filas consideradas cada uno y permanecen sin puntuar. Por tanto, PASS en la categoría no demuestra que se haya evaluado cada clase, y ALLOW no demuestra la ausencia de proxies ni de disparidades.
El evento de Facilities and MRO cuenta con un historial de categoría declarado de 140, por debajo del mínimo configurado de 200. Tanto la evaluación de categoría como la compuerta devuelven ABSTAIN, por lo que la adjudicación autónoma simulada queda retenida para su revisión. Las puntuaciones y la descomposición aún pueden calcularse; ninguna de ellas convierte una evaluación de categoría no disponible en una autorización.

Otras protecciones cubren una línea base de referencia con menos de cinco filas consideradas o sin selecciones. Los grupos individuales por debajo de cinco no se puntúan, mientras que los grupos de cinco a nueve filas son informativos y no pueden determinar el veredicto de categoría. El historial mínimo de 200 y estas protecciones grupales son límites configurados, no una garantía de que un conjunto de datos de compras real resulte estadísticamente adecuado.
La suite fija contiene diez casos prediseñados de datos de entrada brutos con resultados previstos: tres BLOCK, cuatro ALLOW y tres ABSTAIN. Los resultados observados coinciden con las diez etiquetas previstas. Los controles abarcan suposiciones de historial, auditoría e ingresos, proveedores certificados establecidos, diferencias exclusivamente de precio, exclusión basada en el rendimiento, datos de referencia dispersos y una línea base de referencia sin selecciones.

Un caso límite permite la evaluación con un historial de exactamente 200 y devuelve ALLOW; otro con 199 devuelve ABSTAIN. Estos controles ayudan a inspeccionar si la implementación sigue su política declarada en límites trascendentales. No establecen la precisión sobre el terreno de compras, la calibración ni la validación independiente. El benchmark se ejecuta sin llamadas a modelos y no añade entradas de auditoría de compras.
La cartera sintética contiene 52 eventos en seis categorías y 342 filas de eventos de proveedores. Esas filas son registros de participación repetida, no 342 proveedores únicos. Quince eventos están marcados para adjudicaciones autónomas; el recálculo de la política arroja ocho BLOCK, un ABSTAIN y seis ALLOW entre ellos. Por tanto, nueve de los quince quedarían retenidos para su revisión bajo esta configuración.

A nivel de categoría, la exploración informa cuatro conclusiones de ADVERSE_IMPACT, un PASS y un ABSTAIN. La exploración ayuda a identificar dónde inspeccionaría las evidencias a continuación un revisor. Es independiente de la suite de control de diez casos: una resume una cartera con datos semilla, mientras que la otra comprueba el comportamiento previsto de la implementación. Ninguna de las dos proporciona evidencia sobre poblaciones reales de proveedores.
Una vez finalizadas la evaluación y la revisión consultiva de factores, Download JSON y Print report incluyen la decisión guardada, la entrada de auditoría, los recuentos de categoría, la descomposición y la revisión de factores. Las sugerencias opcionales de Proxy Classifier y Adversarial Challenger añaden etiquetas y justificaciones después de guardar la compuerta. La evidencia numérica permanece anclada en el código; el texto consultivo no puede autorizar la adjudicación. Las respuestas consultivas completas guardadas pueden reutilizarse para entradas idénticas, y los proveedores no disponibles recurren a la revisión determinista.
Para una evaluación en producción, las siguientes cuestiones se centran en qué métricas de historial resultan defendibles para el contrato, si las comparaciones de categoría representan la población de proveedores prevista y quién dispone de la autoridad para resolver una retención. La demo hace que estas cuestiones sean auditables. Su persistencia local de auditoría en JSON no constituye una custodia inmutable por terceros, y los campos de exportación con denominación jurídica son correspondencias configuradas y no certificaciones legales ni aseguramiento independiente.
Una puntuación, una prueba de suposiciones y una decisión de política responden a distintas preguntas de compras. Mantenemos separadas esas preguntas para que una revisión no asuma más certeza de la que proporciona la evidencia.
| Evidencia | Útil para | Límite |
|---|---|---|
| Puntuación original | Comprender la recomendación del evaluador simulado | Las etiquetas de certificación se excluyen de la puntuación; las suposiciones de historial e ingresos se mantienen |
| Vista previa neutral respecto a proxies | Comprobar qué proveedores resultan elegibles bajo una alternativa explícita | No ejecuta una adjudicación ni demuestra discriminación de forma independiente |
| Diagnóstico de categoría y compuerta | Aplicar la política configurada de BLOCK, ALLOW o ABSTAIN | ALLOW es un resultado de política, no una prueba de que cada clase haya aprobado o de que no subsistan proxies |
| Exportación de evidencias guardadas | Revisar la decisión registrada con su base numérica | Persistencia local en JSON y mapeos de plantillas, no custodia inmutable ni certificación legal |
MeritLens utiliza proveedores sintéticos y adjudicaciones simuladas, sin conectores en tiempo real con plataformas de compras ni ejecución de contratos reales. Sus exportaciones incluyen mapeos de plantillas configuradas con denominaciones jurídicas, no certificaciones legales ni aseguramiento independiente. El contrafactual no sobrescribe la recomendación ni la compuerta guardada, y los controles sintéticos fijos no establecen la precisión real en el terreno de las compras. El acceso a datos en producción, la persistencia operativa y la autoridad de revisión humana requieren su propio diseño y validación.
En el ejemplo sintético de sujetadores, Bridgepoint tiene una tasa de entrega bruta del 98.1% frente al 97.2% de Apex, pero su puntuación original es de 70.9 frente a un umbral de preselección de 80 puntos. La fórmula simulada pondera la confianza en la entrega y la calidad según el historial de transacciones y auditorías, y califica el factor financiero a partir de los ingresos. Un mejor desempeño en la entrega por sí solo no establece superioridad en todos los criterios legítimos.
Eliminar el proxy de tamaño modifica la vista previa comparativa, no la recomendación registrada ni la decisión de la compuerta. Bridgepoint alcanza 81.0 y Delta alcanza 82.9, lo que hace que ambos sean elegibles para la preselección bajo esa fórmula alternativa. Apex sigue siendo el líder en puntuación y la adjudicación sintética permanece bloqueada para revisión humana.
BLOCK requiere una determinación de impacto adverso en la categoría, un líder original etiquetado como no diverso y un competidor diverso que supere el umbral de preselección solo bajo el contrafactual. Una evaluación de categoría no disponible produce ABSTAIN y también retiene la adjudicación simulada para su revisión. Todos los demás casos devuelven ALLOW según esta política configurada, lo que no garantiza la ausencia de proxies ni de disparidades.
La demo se abstiene cuando el historial de categoría declarado es inferior a 200, o cuando la línea base de referencia no diversa tiene menos de cinco filas de eventos de proveedores consideradas o no tiene selecciones. Los grupos individuales por debajo de cinco no se puntúan; los grupos de cinco a nueve filas son informativos y no pueden determinar el veredicto de la categoría. Se trata de protecciones de muestra configuradas, no de una garantía de idoneidad estadística para un conjunto de datos de compras real.
Esta demo utiliza un conjunto de datos sintético local de proveedores y simula adjudicaciones autónomas. No dispone de conectores en tiempo real con plataformas de compras ni de ejecución real de contratos. Un proyecto de producción necesitaría establecer el acceso a los datos, la semántica de puntuación, la persistencia y la autoridad de revisión para el entorno de destino.
La explicación de la brecha compara fórmulas explícitas bajo suposiciones seleccionadas; no establece de forma independiente una discriminación en el mundo real. Los campos de exportación con denominación jurídica son correspondencias configuradas en plantillas, no certificaciones legales ni aseguramiento independiente. La exportación de sujetadores bloqueada conserva la determinación original de impacto adverso, y una abstención deja esa evaluación como no evaluada.
El código guarda la decisión de política y la entrada de auditoría antes de que comience el asesoramiento opcional de factores. Los revisores consultivos aportan etiquetas, explicaciones y objeciones, mientras que la evidencia numérica validada permanece anclada en los cálculos deterministas. El asesoramiento completo guardado se puede reutilizar para entradas idénticas, y los proveedores no disponibles recurren a la revisión determinista; ninguna de las vías otorga al texto consultivo autoridad para modificar la compuerta.
Explore la investigación relacionada para obtener un contexto más amplio sobre esta demostración.
Analice la evidencia que necesita su punto de control de compras.
Ayudamos a los equipos a evaluar las suposiciones de puntuación de proveedores y a diseñar un flujo de trabajo de revisión adaptado a sus datos, políticas y autoridad decisoria.