MeritLens · Firewall de equidad en compras

Explicar la exclusión de proveedores antes de una adjudicación autónoma

Una mejor tasa de entrega aún puede dejar a un proveedor por debajo del umbral de preselección. Mostramos cómo las suposiciones sobre el historial y los ingresos determinan ese resultado y, a continuación, preservamos la explicación junto con la decisión de revisión de una adjudicación simulada.

70.9 → 81.0

Bridgepoint alcanza la elegibilidad en la vista previa

Fixture sintético de sujetadores industriales; puntuación original → alternativa

14.0 de 21.0

Puntos de brecha atribuidos a suposiciones proxy

Comparación de fórmulas sintéticas entre Apex y Bridgepoint

BLOCK

Decisión de adjudicación simulada guardada

Revisión humana obligatoria; no se representa una revisión completada

Proveedores sintéticos y adjudicaciones simuladas. El vídeo y las evidencias explican el comportamiento configurado de la demo; esta página es explicativa.

La puntuación de un proveedor puede ocultar el motivo de la exclusión

En el caso sintético de Industrial Fasteners, Bridgepoint Components entrega a tiempo con un 98.1%, frente al 97.2% de Apex Fastener Industries. Sin embargo, Bridgepoint obtiene 70.9 puntos frente al umbral de preselección de 80 puntos, mientras que Apex lidera con 91.9.

La fórmula asigna a las tasas de entrega y calidad de un proveedor con un historial limitado de transacciones y auditorías una menor confianza estadística. También utiliza los ingresos para la puntuación financiera. Excluir las etiquetas de certificación de una puntuación no elimina estas suposiciones sobre el historial y el tamaño.

El revisor de compras necesita comprobar qué suposiciones alteran la elegibilidad, qué diferencias persisten bajo una fórmula alternativa y por qué la política de adjudicación retiene o aprueba la recomendación. Un mejor rendimiento de entrega por sí solo no resuelve el riesgo financiero del proveedor ni su derecho a una adjudicación.

Cómo el punto de control transforma la exclusión en evidencia auditable

Comparar las fórmulas

El sistema de puntuación simulado asigna a los factores de entrega, calidad, financiero y precio ponderaciones iguales del 25%. Su alternativa neutral respecto a proxies utiliza tasas de entrega y calidad brutas y la salud financiera real, manteniendo el precio y las ponderaciones sin cambios. La descomposición al estilo Oaxaca-Blinder divide la brecha original entre la brecha remanente bajo esa alternativa y un residuo atribuido a las suposiciones modificadas.

Verificar las selecciones por categoría

El diagnóstico configurado de cuatro quintos compara la tasa de selección de cada clase registrada con la línea base no diversa, utilizando un umbral de ratio de 0.80. Agrupa filas de eventos de proveedores sintéticos dentro de la categoría, incluidos los proveedores repetidos. Los grupos pequeños no pueden determinar el veredicto; si la evidencia por categoría no está disponible, se devuelve ABSTAIN.

Guardar la decisión antes del asesoramiento

BLOCK requiere las tres condiciones: impacto adverso en la categoría, un líder original no diverso y un competidor diverso que esté por debajo del umbral original pero lo alcance con la fórmula alternativa. ABSTAIN también retiene la adjudicación simulada para su revisión. Los demás casos devuelven ALLOW según esta política. El código guarda la compuerta y la entrada de auditoría antes de la revisión consultiva opcional de factores; el texto consultivo no puede alterar la decisión ni la evidencia numérica.

La fórmula alternativa es una prueba de suposiciones explícita, no una prueba causal independiente. El umbral de 0.80 es un diagnóstico configurado de la demo, no un mandato de la legislación de contratación pública.

El caso práctico: explicar la exclusión, preservar la autoridad de revisión

Siga un evento de compras sintético desde las entradas no evaluadas hasta una retención justificada. Los casos comparativos muestran a continuación por qué modificar la elegibilidad de preselección, superar un diagnóstico de categoría y autorizar una adjudicación constituyen resultados independientes. Todos los nombres de proveedores, certificaciones, historiales y adjudicaciones aquí mostrados pertenecen a la demostración local.

Comenzar con la evidencia tras la puntuación

El espacio de trabajo muestra inicialmente las entradas de los proveedores con puntuaciones y decisiones de preselección pendientes. Al inspeccionar Bridgepoint, se exponen los datos de entrega, calidad, historial de transacciones, historial de auditorías y finanzas antes de la evaluación. Esta distinción es fundamental: una etiqueta de proveedor o un porcentaje de entrega aparentemente alto no pueden justificar la puntuación sin la fórmula que los procesa.

Datos de entrada brutos del proveedor Bridgepoint antes de la evaluación, con puntuaciones pendientes.
Bridgepoint es un proveedor sintético perteneciente a minorías. Sus datos brutos pueden inspeccionarse antes de que exista cualquier puntuación, recomendación o decisión de la compuerta.
Mismo fixture de sujetadores: mejores tasas brutas coexisten con un historial más breve y menores ingresos.
Entrada sintéticaApexBridgepoint
Entrega a tiempo97.2%98.1%
Tasa de aprobación de calidad96.5%97.2%
Transacciones4,200180
Auditorías1409
IngresosUSD 820 millionUSD 60 million

El evaluador simulado pondera los factores de entrega, calidad, financiero y precio al 25% cada uno. El historial de transacciones y de auditorías afecta al grado de confianza que asigna a las tasas brutas de entrega y calidad; los ingresos influyen en la puntuación financiera. Estas elecciones pueden penalizar a un proveedor más pequeño aunque las etiquetas de certificación se excluyan de la puntuación. Por tanto, el comprador necesita evaluar la justificación de dichas suposiciones en lugar de deducir neutralidad a partir de etiquetas omitidas.

Consultar la lista de preselección original y la retención guardada

Tras la evaluación, Apex es el líder original con 91.9 puntos. Bridgepoint obtiene 70.9 y Delta obtiene 70.5 puntos, ambos por debajo del umbral de preselección configurado de 80. Bridgepoint presenta una mejor tasa de entrega, pero esa métrica aislada no demuestra superioridad en salud financiera, precio ni en los demás criterios legítimos.

Lista de preselección original de sujetadores con Apex en 91.9 y Bridgepoint en 70.9, y la retención de adjudicación guardada.
La recomendación original es Apex. El estado BLOCK guardado retiene esta adjudicación autónoma simulada para su revisión humana; no representa una revisión completada ni una interceptación real de contratos.

BLOCK requiere las tres condiciones configuradas: una conclusión de impacto adverso en la categoría, un líder original no diverso y un competidor diverso que se encuentre por debajo del umbral original pero lo alcance con la fórmula alternativa. El evento de sujetadores cumple esa combinación. La decisión se guarda antes de iniciar la revisión consultiva de factores, preservando la base numérica y la autoridad de la retención.

Inspeccionar los recuentos por categoría y el origen de la brecha

El diagnóstico de categoría agrupa filas de eventos de proveedores, incluidos los proveedores repetidos. Las filas de empresas pertenecientes a minorías registran 7 selecciones de 26 consideradas, en comparación con 25 de 37 para la línea base no diversa. El ratio de tasa de selección es de aproximadamente 0.40, por debajo del umbral diagnóstico configurado de 0.80. El metadato de historial de categoría de 312 es una protección de muestra independiente; no es el denominador de dicha comparación.

Recuentos de selección de la categoría de sujetadores y descomposición de factores de la brecha de puntuación entre Apex y Bridgepoint.
La evidencia vincula la conclusión de categoría con la comparación de factores. La brecha original de 21.0 puntos contiene 14.0 puntos atribuidos a suposiciones modificadas de historial e ingresos, mientras que 7.0 puntos permanecen bajo la fórmula alternativa.
Contribuciones redondeadas de factores a la brecha sintética entre Apex y Bridgepoint.
Suposición modificadaContribución proxy a la brecha
Confianza en la entrega según el historial de transacciones3.01 puntos
Confianza en la calidad según el historial de auditorías2.50 puntos
Puntuación financiera basada en ingresos8.47 puntos
Puntuación de precio, sin cambios0.00 puntos

La descomposición al estilo Oaxaca-Blinder compara fórmulas explícitas. La alternativa utiliza tasas de entrega y calidad brutas y la salud financiera real, manteniendo el precio y las ponderaciones sin cambios. Alrededor de dos tercios de la brecha original se atribuyen a las suposiciones modificadas en esa comparación; la brecha remanente sigue favoreciendo a Apex. Este residuo está condicionado a la alternativa elegida, en lugar de constituir una prueba causal independiente de discriminación.

Modificar la vista previa sin reescribir la decisión

Las puntuaciones mostradas están redondeadas; la elegibilidad para la preselección utiliza puntuaciones no redondeadas de al menos 80.
ProveedorPuntuación originalPuntuación alternativaResultado de vista previa
Apex Fastener Industries91.988.0Se mantiene como líder
Bridgepoint Components70.981.0Pasa a ser elegible
Delta Fasteners70.582.9Pasa a ser elegible
Lista de preselección alternativa de sujetadores que muestra a Bridgepoint y Delta como elegibles mientras el BLOCK guardado permanece visible.
Eliminar el proxy de tamaño modifica la comparación mostrada. Apex se mantiene como la recomendación y el BLOCK guardado se conserva mientras Bridgepoint y Delta ingresan a la preselección de la vista previa.

Esa vista previa plantea a los revisores de compras una pregunta concreta: ¿habrían sido excluidos estos proveedores bajo suposiciones de puntuación que la organización pueda defender? No elige a Bridgepoint como ganador, ni ejecuta una adjudicación, ni vuelve a puntuar la evaluación de categoría registrada ni reemplaza al evaluador original. Un revisor humano aún necesitaría considerar el contexto de compras y decidir cómo deben abordarse las suposiciones identificadas.

Por qué ALLOW no significa que todas las clases de proveedores hayan aprobado

En el ejemplo de Packaging Materials, la recomendación original es Beacon con 91.7, el diagnóstico de categoría es PASS y la compuerta configurada devuelve ALLOW. Sin embargo, Ironclad, un proveedor sintético de HUBZone, pasa de 72.4 a 81.4 bajo la fórmula alternativa. Por consiguiente, una autorización de política puede coexistir con una exclusión de preselección sensible a proxies.

Evaluación de embalajes con Beacon recomendado, ALLOW registrado e Ironclad por debajo del umbral de preselección original.
Packaging devuelve ALLOW bajo esta política. Ironclad aún supera el umbral de preselección en la comparación alternativa; el mensaje genérico de adjudicación no garantiza que ningún competidor pueda avanzar.

El agregado diverso superpuesto registra 8 selecciones de 12 filas consideradas, frente a 18 de 38 para la línea base no diversa. Su ratio es de aproximadamente 1.41. Los grupos individuales de empresas pertenecientes a minorías, HUBZone y 8(a) tienen solo cuatro filas consideradas cada uno y permanecen sin puntuar. Por tanto, PASS en la categoría no demuestra que se haya evaluado cada clase, y ALLOW no demuestra la ausencia de proxies ni de disparidades.

Por qué la falta de evidencia retiene la adjudicación

El evento de Facilities and MRO cuenta con un historial de categoría declarado de 140, por debajo del mínimo configurado de 200. Tanto la evaluación de categoría como la compuerta devuelven ABSTAIN, por lo que la adjudicación autónoma simulada queda retenida para su revisión. Las puntuaciones y la descomposición aún pueden calcularse; ninguna de ellas convierte una evaluación de categoría no disponible en una autorización.

Evaluación de Facilities and MRO retenida porque el historial de categoría se encuentra por debajo del mínimo configurado.
ABSTAIN preserva la distinción entre evidencia insuficiente y una comprobación aprobada. La evaluación exportada de impacto adverso permanece como no evaluada.

Otras protecciones cubren una línea base de referencia con menos de cinco filas consideradas o sin selecciones. Los grupos individuales por debajo de cinco no se puntúan, mientras que los grupos de cinco a nueve filas son informativos y no pueden determinar el veredicto de categoría. El historial mínimo de 200 y estas protecciones grupales son límites configurados, no una garantía de que un conjunto de datos de compras real resulte estadísticamente adecuado.

Comprobar la política frente a controles prediseñados

La suite fija contiene diez casos prediseñados de datos de entrada brutos con resultados previstos: tres BLOCK, cuatro ALLOW y tres ABSTAIN. Los resultados observados coinciden con las diez etiquetas previstas. Los controles abarcan suposiciones de historial, auditoría e ingresos, proveedores certificados establecidos, diferencias exclusivamente de precio, exclusión basada en el rendimiento, datos de referencia dispersos y una línea base de referencia sin selecciones.

Diez controles de compras prediseñados con resultados previstos y observados, con cero discrepancias.
Los diez controles prediseñados coinciden con sus etiquetas previstas: 3 BLOCK, 4 ALLOW y 3 ABSTAIN. Esto constituye evidencia de implementación sobre una suite sintética fija.

Un caso límite permite la evaluación con un historial de exactamente 200 y devuelve ALLOW; otro con 199 devuelve ABSTAIN. Estos controles ayudan a inspeccionar si la implementación sigue su política declarada en límites trascendentales. No establecen la precisión sobre el terreno de compras, la calibración ni la validación independiente. El benchmark se ejecuta sin llamadas a modelos y no añade entradas de auditoría de compras.

Diferenciar la exploración de cartera de las intervenciones ejecutadas

La cartera sintética contiene 52 eventos en seis categorías y 342 filas de eventos de proveedores. Esas filas son registros de participación repetida, no 342 proveedores únicos. Quince eventos están marcados para adjudicaciones autónomas; el recálculo de la política arroja ocho BLOCK, un ABSTAIN y seis ALLOW entre ellos. Por tanto, nueve de los quince quedarían retenidos para su revisión bajo esta configuración.

Exploración de cartera sintética de 52 eventos y seis categorías con resultados de política hipotéticos.
La exploración resume decisiones hipotéticas a lo largo de la cola sintética. Sus nueve retenciones son resultados de política computados, en lugar de nueve intervenciones reales o adjudicaciones auditadas completadas.

A nivel de categoría, la exploración informa cuatro conclusiones de ADVERSE_IMPACT, un PASS y un ABSTAIN. La exploración ayuda a identificar dónde inspeccionaría las evidencias a continuación un revisor. Es independiente de la suite de control de diez casos: una resume una cartera con datos semilla, mientras que la otra comprueba el comportamiento previsto de la implementación. Ninguna de las dos proporciona evidencia sobre poblaciones reales de proveedores.

Poner la decisión y sus evidencias a disposición del revisor

Una vez finalizadas la evaluación y la revisión consultiva de factores, Download JSON y Print report incluyen la decisión guardada, la entrada de auditoría, los recuentos de categoría, la descomposición y la revisión de factores. Las sugerencias opcionales de Proxy Classifier y Adversarial Challenger añaden etiquetas y justificaciones después de guardar la compuerta. La evidencia numérica permanece anclada en el código; el texto consultivo no puede autorizar la adjudicación. Las respuestas consultivas completas guardadas pueden reutilizarse para entradas idénticas, y los proveedores no disponibles recurren a la revisión determinista.

Para una evaluación en producción, las siguientes cuestiones se centran en qué métricas de historial resultan defendibles para el contrato, si las comparaciones de categoría representan la población de proveedores prevista y quién dispone de la autoridad para resolver una retención. La demo hace que estas cuestiones sean auditables. Su persistencia local de auditoría en JSON no constituye una custodia inmutable por terceros, y los campos de exportación con denominación jurídica son correspondencias configuradas y no certificaciones legales ni aseguramiento independiente.

Qué puede respaldar cada elemento de evidencia

Una puntuación, una prueba de suposiciones y una decisión de política responden a distintas preguntas de compras. Mantenemos separadas esas preguntas para que una revisión no asuma más certeza de la que proporciona la evidencia.

EvidenciaÚtil paraLímite
Puntuación originalComprender la recomendación del evaluador simuladoLas etiquetas de certificación se excluyen de la puntuación; las suposiciones de historial e ingresos se mantienen
Vista previa neutral respecto a proxiesComprobar qué proveedores resultan elegibles bajo una alternativa explícitaNo ejecuta una adjudicación ni demuestra discriminación de forma independiente
Diagnóstico de categoría y compuertaAplicar la política configurada de BLOCK, ALLOW o ABSTAINALLOW es un resultado de política, no una prueba de que cada clase haya aprobado o de que no subsistan proxies
Exportación de evidencias guardadasRevisar la decisión registrada con su base numéricaPersistencia local en JSON y mapeos de plantillas, no custodia inmutable ni certificación legal

Lo que esta demo NO hace

MeritLens utiliza proveedores sintéticos y adjudicaciones simuladas, sin conectores en tiempo real con plataformas de compras ni ejecución de contratos reales. Sus exportaciones incluyen mapeos de plantillas configuradas con denominaciones jurídicas, no certificaciones legales ni aseguramiento independiente. El contrafactual no sobrescribe la recomendación ni la compuerta guardada, y los controles sintéticos fijos no establecen la precisión real en el terreno de las compras. El acceso a datos en producción, la persistencia operativa y la autoridad de revisión humana requieren su propio diseño y validación.

Preguntas habituales de los equipos de compras

¿Por qué un proveedor con mejor rendimiento de entrega no entró en la lista de preselección?

En el ejemplo sintético de sujetadores, Bridgepoint tiene una tasa de entrega bruta del 98.1% frente al 97.2% de Apex, pero su puntuación original es de 70.9 frente a un umbral de preselección de 80 puntos. La fórmula simulada pondera la confianza en la entrega y la calidad según el historial de transacciones y auditorías, y califica el factor financiero a partir de los ingresos. Un mejor desempeño en la entrega por sí solo no establece superioridad en todos los criterios legítimos.

¿Eliminar el proxy de tamaño cambia quién gana el contrato?

Eliminar el proxy de tamaño modifica la vista previa comparativa, no la recomendación registrada ni la decisión de la compuerta. Bridgepoint alcanza 81.0 y Delta alcanza 82.9, lo que hace que ambos sean elegibles para la preselección bajo esa fórmula alternativa. Apex sigue siendo el líder en puntuación y la adjudicación sintética permanece bloqueada para revisión humana.

¿Qué hace exactamente que MeritLens bloquee una adjudicación?

BLOCK requiere una determinación de impacto adverso en la categoría, un líder original etiquetado como no diverso y un competidor diverso que supere el umbral de preselección solo bajo el contrafactual. Una evaluación de categoría no disponible produce ABSTAIN y también retiene la adjudicación simulada para su revisión. Todos los demás casos devuelven ALLOW según esta política configurada, lo que no garantiza la ausencia de proxies ni de disparidades.

¿Qué ocurre cuando no disponemos de suficientes datos de proveedores?

La demo se abstiene cuando el historial de categoría declarado es inferior a 200, o cuando la línea base de referencia no diversa tiene menos de cinco filas de eventos de proveedores consideradas o no tiene selecciones. Los grupos individuales por debajo de cinco no se puntúan; los grupos de cinco a nueve filas son informativos y no pueden determinar el veredicto de la categoría. Se trata de protecciones de muestra configuradas, no de una garantía de idoneidad estadística para un conjunto de datos de compras real.

¿Podemos conectar esto con nuestra plataforma de compras?

Esta demo utiliza un conjunto de datos sintético local de proveedores y simula adjudicaciones autónomas. No dispone de conectores en tiempo real con plataformas de compras ni de ejecución real de contratos. Un proyecto de producción necesitaría establecer el acceso a los datos, la semántica de puntuación, la persistencia y la autoridad de revisión para el entorno de destino.

¿El informe demuestra discriminación o certifica el cumplimiento legal?

La explicación de la brecha compara fórmulas explícitas bajo suposiciones seleccionadas; no establece de forma independiente una discriminación en el mundo real. Los campos de exportación con denominación jurídica son correspondencias configuradas en plantillas, no certificaciones legales ni aseguramiento independiente. La exportación de sujetadores bloqueada conserva la determinación original de impacto adverso, y una abstención deja esa evaluación como no evaluada.

¿Puede el asesoramiento de un modelo de lenguaje modificar la decisión de adjudicación?

El código guarda la decisión de política y la entrada de auditoría antes de que comience el asesoramiento opcional de factores. Los revisores consultivos aportan etiquetas, explicaciones y objeciones, mientras que la evidencia numérica validada permanece anclada en los cálculos deterministas. El asesoramiento completo guardado se puede reutilizar para entradas idénticas, y los proveedores no disponibles recurren a la revisión determinista; ninguna de las vías otorga al texto consultivo autoridad para modificar la compuerta.

Investigación técnica

Explore la investigación relacionada para obtener un contexto más amplio sobre esta demostración.

Incorpore las suposiciones de puntuación en la agenda de revisión

Analice la evidencia que necesita su punto de control de compras.

Ayudamos a los equipos a evaluar las suposiciones de puntuación de proveedores y a diseñar un flujo de trabajo de revisión adaptado a sus datos, políticas y autoridad decisoria.

Evaluación de la puntuación de proveedores

  • ✓ Revisar los datos de entrada y las suposiciones de puntuación
  • ✓ Definir las preguntas de comparación por categoría
  • ✓ Evaluar las limitaciones de la muestra y los datos
  • ✓ Especificar las evidencias para la revisión de compras

Diseño del punto de control

  • ✓ Mapear los límites del evaluador y de decisión
  • ✓ Definir el enrutamiento para la revisión humana
  • ✓ Planificar el acceso a datos y la persistencia
  • ✓ Establecer criterios de validación antes del despliegue