Conformità del pricing AI ed equità algoritmica

L'algoritmo non vede mai razza o reddito. Vede codice ZIP e dispositivo. Stesso prodotto, segnali di domanda coincidenti. Un prezzo superiore del 26%.

Quando arriva la Civil Investigative Demand (CID), la risposta dovrebbe essere un file. Equity è un livello di audit per la difendibilità del pricing che si posiziona sopra qualsiasi motore di pricing già utilizzato da un retailer. Rigioca il registro delle decisioni del motore stesso, valuta ogni input di pricing per la dispersione verso classi protette (protected-class leakage), inclusi i proxy composti che i controlli per singola feature non sono in grado di rilevare. Applica come gate al risultato la EEOC four-fifths rule in codice deterministico, misura quanto il vincolo di equità costi in termini di ricavi, mostra perché la correzione ovvia venga aggirata e sigilla il record in un evidence pack con hash SHA-256 e mappatura normativa, creato appositamente per quella richiesta.

+26.2%

Prezzo più alto per la coorte con ZIP a maggioranza di minoranze e dispositivi datati, a parità di SKU

Medie di coorte su 3,037 e 2,880 decisioni sintetiche inizializzate, a parità di segnali di domanda

Da 0.43 a 0.82

Rapporto EEOC four-fifths, da Fail a Pass, dopo il fairness-aware reward shaping

A un costo misurato dell'1.3% sui ricavi per questo motore e scenario sintetici

0.73

Informazione mutua congiunta di un proxy composto i cui due componenti singolarmente ottengono PASS

Referral × Dwell Time; la sola eliminazione di ZIP e device fallisce ancora il gate a 0.59

Ogni dato della demo in questa pagina è sintetico e inizializzato. ShopMart Dynamic Pricing è un contextual bandit LinUCB che abbiamo costruito come sostituto del motore che un cliente utilizzerebbe, le Aura Wireless Earbuds e i 10,000 acquirenti sono generati, e la struttura di proxy è innestata affinché l'audit abbia qualcosa di reale da rilevare. Nessun retailer reale è stato sottoposto ad audit e a nessun acquirente reale è stato applicato un prezzo eccessivo.

I regolatori hanno smesso di richiedere l'intenzionalità. L'applicazione della legge si concentra ora su ciò che il motore ha fatto, e un team di pricing che non ha mai registrato i dati corretti non può dimostrarlo.

Un General Counsel o un Head of Pricing di una piattaforma e-commerce con volumi a New York e in California esegue un motore di dynamic pricing che non acquisisce mai razza o reddito ed è comunque esposto, poiché il motore determina i prezzi in base a ZIP code, device tier e comportamento di sessione, e ciascuno di questi elementi trasmette un segnale demografico. Un contextual bandit che ottimizza i ricavi individuerà qualsiasi input in grado di prevedere la disponibilità a pagare, compresi quelli che in realtà predicono l'identità dell'acquirente. Il codice ZIP predice il reddito; il reddito predice la sensibilità al prezzo; un vecchio smartphone Android predice una minore comparazione dei prezzi. Nessuno di questi è la razza. Tutti si muovono insieme a essa. Nel momento in cui arriva la Civil Investigative Demand (CID), un team che non dispone di alcuno di questi dati registrati trascorre mesi in un'attività forense reattiva di estrazione dati.

Il caso della FTC si è basato su ciò che l'algoritmo ha fatto

L'accordo transattivo da $60M della FTC con Instacart relativo ai suoi esperimenti di pricing Eversight (FTC, December 2025) è stata un'azione basata sui risultati. La denuncia ha documentato che a diversi acquirenti venivano mostrati prezzi diversi per articoli identici, con differenze fino al 23%. Non si è trattato di un accertamento di discriminazione basata su gruppi, e non dipendeva da ciò che era stato detto all'algoritmo.

Gli obblighi di informativa e di valutazione d'impatto sono già previsti dalla legge

L'Algorithmic Pricing Disclosure Act di New York, in vigore dal November 10, 2025, richiede un'informativa evidente quando i dati personali modificano un prezzo e prevede una sanzione civile fino a $1,000 per violazione. La legge Colorado SB 24-205, in vigore dal June 30, 2026, qualifica la determinazione dei prezzi come una decisione consequenziale che richiede una valutazione d'impatto.

Gli obblighi dell'UE si applicano a partire dal August 2, 2026, con un tetto legale stabilito

Gli obblighi per i sistemi ad alto rischio dell'EU AI Act si applicano a partire dal August 2, 2026. Gli Articles 13 and 14 riguardano la trasparenza per i sistemi ad alto rischio e la documentazione antidiscriminatoria, e la non conformità per i sistemi ad alto rischio comporta sanzioni fino a un massimo legale di €15M o al 3% del fatturato globale.

Ogni statistica, ogni verdetto e l'hash risiedono nel codice deterministico. Gli agenti redigono testo e non possono accedere ad alcuno di essi.

La pipeline consiste in un singolo passaggio sul registro decisionale del motore stesso: 10,000 decisioni di pricing del motore sottoposto ad audit, un audit deterministico degli input, un gate four-fifths, una sintesi del vincolo di equità confrontata con un tetto aggirabile, la narrazione degli agenti, un evidence pack con hash SHA-256 e un benchmark etichettato. Gli agenti consigliano, il codice decide, e questa separazione è ciò che rende il pacchetto depositabile in giudizio, indipendentemente dal modello sottostante.

01 / IL MOTORE SOTTOPOSTO AD AUDIT

Un bandit per l'ottimizzazione dei ricavi che non vede mai l'attributo protetto

Il motore sottoposto ad audit è ShopMart Dynamic Pricing, un contextual bandit LinUCB a 7 bracci con seed=42, che prezza una singola SKU, le Aura Wireless Earbuds con un prezzo di listino di $79.00, per una popolazione sintetica etichettata di 10,000 acquirenti. Determina i prezzi in base a indice di reddito per ZIP, device tier, referral, dwell time, cart size, repeat rate, session count, premium membership e ora, oltre a termini incrociati referral per dwell time del tipo comunemente presente in molti motori reali. La coorte protetta è un'etichetta latente che l'audit non riceve mai. Nella demo, questo bandit rappresenta il motore sottoposto ad audit.

02 / L'AUDIT DETERMINISTICO DEGLI INPUT

Tre punteggi per ciascun input, e un quarto che esamina le coppie

Run Audit calcola, in puro numpy, la correlazione assoluta di Pearson di ogni input di pricing rispetto alla coorte protetta, la sua informazione mutua normalizzata, un'informazione mutua congiunta per le coppie di feature e una variazione controfattuale del prezzo: sovrascrive un input per la coorte protetta con il valore di riferimento della coorte avvantaggiata, mantiene costante tutto il resto, riesegue la policy del motore e misura la variazione di prezzo per la coorte protetta. Le regole del verdetto sono codice, verificate in sequenza: un input il cui campione effettivo scende sotto 400 viene restituito come Insufficient Evidence anziché ricevere un verdetto di proxy, regola che nessun input in questa esecuzione attiva; il segnale di fedeltà dual-use con qualsiasi associazione materiale è un ABSTAIN instradato alla revisione legale prima che venga eseguito il test di violazione; una correlazione assoluta di almeno 0.30 o un'informazione mutua di almeno 0.05 costituisce una VIOLATION; una correlazione da 0.20 fino a 0.30 costituisce un ABSTAIN; tutto il resto è un PASS. Per ogni altro input il controfattuale corrobora e non attiva mai un verdetto da solo; solo per il segnale dual-use una variazione controfattuale materiale concorre all'ABSTAIN.

03 / IL GATE E IL VINCOLO

Uno standard legale esterno, poi una correzione senza margini aggirabili

Il Disparate-Impact Gate applica la EEOC four-fifths rule (29 CFR 1607.4(D)) adattata alle fasce di prezzo: il tasso della coorte protetta nel ricevere la fascia di prezzo favorevole diviso per quello della coorte avvantaggiata, a fronte di una soglia di 0.80. Remediation sintetizza quindi Fairness-Aware Reward Shaping, che attrae continuamente ciascun prezzo verso un prezzo di riferimento privo di proxy proveniente da un secondo bandit addestrato escludendo i quattro input proxy, e ricerca mediante ricerca binaria il peso minimo di attrazione che superi 0.80. Viene mostrato accanto a una Hard-Cap Baseline al 115% del prezzo equo, la correzione ingenua, con la misurazione della gaming signature per entrambe.

04 / LA CREW E IL PACCHETTO

Narrazione in superficie, record sigillato alla base

Un Feature Auditor illustra ciascun input contrassegnato e un Adversarial Challenger sostiene la tesi a favore del trattamento dell'input astenuto come segnale legittimo; il ruolo del Regulatory Mapper è una tabella fissa che associa ciascuna VIOLATION a cinque regimi e l'ABSTAIN a una singola voce di revisione legale. La crew consente l'interscambio del provider, ricorre a template deterministici quando non è configurato alcun provider di modelli in modo che l'app funzioni in maniera identica, e non può calcolare alcun numero né stabilire verdetti. Evidence Pack sigilla il nome e la versione del motore, la popolazione esaminata, il gate, ogni rilievo con la relativa motivazione, la mappatura normativa, l'esito della remediation e il riepilogo della narrazione in JSON oltre a un pack HTML stampabile, con un digest SHA-256 del corpo del pacchetto come hash a prova di manomissione.

La console presenta due viste oltre a finestre di dialogo. La vista manuale contiene la scheda Pricing Outcome Comparison e un pannello delle attività che trasmette in streaming ogni fase; ogni risultato si apre come dialogo intitolato Audit Results, Remediation Results o Evidence Pack Results, mentre Remediation ed Evidence Pack rimangono disabilitati fino al completamento di Run Audit. Run Benchmark passa a una vista separata Benchmark Results. About Demo dichiara sullo schermo i limiti dello scenario: un motore sintetico con ground truth nota, i cui risultati dimostrano il metodo e non costituiscono una prova di intenzionalità convalidata sul campo. Ciascun numero riportato di seguito si colloca entro tali limiti.

Stesso prodotto, segnali di domanda coincidenti, un divario del 26%. Ecco dove l'audit lo individua, applica il gate, lo corregge e lo sigilla.

La demo esamina 10,000 decisioni di pricing sintetiche e inizializzate su una singola SKU. Quanto segue mostra ciò che l'esecuzione visualizza a schermo, nell'ordine esatto in cui compare.

La console di Equity con la scheda Pricing Outcome Comparison aperta prima dell'esecuzione di qualsiasi audit. Decision Set A, Reference, mostra le Aura Wireless Earbuds a un prezzo visualizzato di $74.06 rispetto a un listino di $79.00, con il profilo rappresentativo ZIP 10021 Upper East Side NYC, iPhone new, un carrello di 3 articoli con referral organico, un badge verde Reference Cohort e un piè di pagina con Matched Cohort · n=2,880 e No Proxy Lift. Decision Set B, Exposed, mostra gli stessi auricolari a $93.47 con il profilo ZIP 10456 South Bronx NYC, Android old, un badge rosso Proxy Risk Identified e un piè di pagina con Matched Cohort · n=3,037 e Review Required. Tra di essi, una Measured Variance di +26.2% è etichettata come Same SKU, Matched Demand Signals. I pulsanti dell'intestazione riportano About Demo, Run Benchmark, Remediation, Evidence Pack e Run Audit, e una banda di sottotitolo in basso riporta Set A is a high-income-zip, new-device cohort.
Questa scheda è visualizzata sullo schermo prima dell'avvio: due coorti corrispondenti, una singola SKU. La coorte con ZIP ad alto reddito e dispositivi nuovi visualizza $74.06; la coorte con ZIP a maggioranza di minoranze e dispositivi datati visualizza $93.47, un divario del 26.2% sugli stessi auricolari a fronte di segnali di domanda coincidenti. Si tratta di medie di coorte su 2,880 e 3,037 decisioni sintetiche, non di due acquirenti selezionati ad arte, e il codice ZIP e il dispositivo su ciascuna scheda rappresentano il profilo rappresentativo della coorte; le coorti stesse coprono diversi ZIP ed entrambe le famiglie di dispositivi. Al motore che ha prodotto questo divario non è mai stato fornito alcun parametro che un legale riconoscerebbe come protetto.
Il dialogo Audit Results mostra la tabella Input Audit: Which Features Are Demographic Proxies? con le colonne Pricing Input, |r| vs Protected, Mutual Information, Counterfactual e Verdict. Zip Income Idx riporta 0.95, 1.00, +7.8%, VIOLATION. Device Tier riporta 0.32, 0.08, +2.9%, VIOLATION. Referral × Dwell Time, con tag Interaction, riporta 0.00, 0.73, +1.7%, VIOLATION, con il cursore posizionato su di esso. Premium Member riporta 0.24, 0.04, -1.3%, ABSTAIN. Referral, Dwell Time, Cart Size, Repeat Rate, Session Count e Hour riportano tutti PASS. La legenda sottostante recita Violation: Flagged Proxy, Abstain: Routed To Legal Review, Cleared: Legitimate Demand Signal, seguita da tre note del Feature Auditor.
Zip Income Idx e Device Tier rappresentano i proxy evidenti, con una correlazione di Pearson di 0.95 e 0.32. Un audit condotto singola feature per feature non è in grado di produrre la terza riga con VIOLATION. Il solo Referral evidenzia una correlazione di 0.00 e un'informazione mutua di 0.00, il solo Dwell Time mostra 0.17 e 0.03, ed entrambi ottengono PASS. La loro informazione mutua congiunta con la classe protetta è 0.73, con un guadagno di interazione di 0.71 rispetto alla migliore feature singola. La popolazione è strutturata in modo che un arrivo organico con permanenza prolungata e un arrivo da comparatore con permanenza breve contraddistinguano entrambi la coorte protetta: nessun input separa i gruppi da solo, la coppia lo fa. Un programma di compliance che esamina gli input uno alla volta analizza l'oggetto sbagliato. Cart size, repeat rate, session count e hour risultano Cleared come segnali legittimi di domanda; l'audit non segnala indiscriminatamente tutto ciò che vede.
Il dialogo Audit Results visualizzato fino in fondo. In alto si trovano le righe PASS per Referral, Dwell Time, Cart Size, Repeat Rate, Session Count e Hour, la legenda dei verdetti, tre note del Feature Auditor e una nota dell'Adversarial Challenger su premium_member. Al di sotto, la scheda Disparate-Impact Gate: EEOC Four-Fifths Rule mostra un indicatore circolare rosso con 0.43, Four-Fifths Ratio (Threshold 0.80), Fail, e quattro riquadri: 36% Protected Cohort Receiving The Favorable Price Tier, 83% Advantaged Cohort Receiving The Favorable Price Tier, 64% Protected Cohort In The Highest Price Tier e +15.6% Mean Overcharge: Protected Versus Advantaged.
Il gate applica uno standard giuridico calcolato direttamente nel codice, e 'favorevole' indica in questo contesto la fascia di prezzo non massima. Il 36% della coorte protetta la ottiene contro l'83% della coorte avvantaggiata, e 0.36 diviso 0.83 è pari a 0.434, ampiamente al di sotto della soglia four-fifths di 0.80 stabilita in 29 CFR 1607.4(D). Il 64% della coorte protetta si colloca nella fascia di prezzo massima e il sovrapprezzo medio è del 15.6% sull'intera popolazione. Sopra l'indicatore, l'Adversarial Challenger sostiene l'argomentazione del beneficio fedeltà per Premium Member, un input che il codice ha già instradato alla revisione legale. Il codice non lo contrassegna né lo rimuove, e la regola sul verdetto ha definito l'ABSTAIN prima della stesura di tale nota. Show Audit Results riscrive il badge Set B sulla scheda Pricing Outcome Comparison nel momento esatto in cui si apre questo dialogo; chiudendolo, la scheda riporta ora Gate Failed, 0.43 < 0.80.
Il dialogo Remediation Results intitolato Fairness Constraint: From Detection To Remediation. Un riquadro rosso riporta 0.43, Four-Fifths Before, Fail, Engine As Shipped; una freccia punta a un riquadro verde che riporta 0.82, Four-Fifths After, Pass, Revenue Cost -1.3%. Più in basso, Fairness-Aware Reward Shaping, etichettato come Recommended Control, elenca Four-Fifths Ratio 0.82 Pass, Revenue Cost -1.3%, Gaming Signature 2% e Pull Weight 0.65. Accanto, Hard-Cap Baseline (115% Of Fair Price) riporta Four-Fifths Ratio 0.59 Fail, Revenue Cost -0.2%, Gaming Signature 29% Priced At The Cap e Verdict Gamed To The Boundary. Le note in piccolo precisano che un tetto basato su soglia viene ottimizzato fino al suo margine estremo, che il reward shaping attira ciascun prezzo verso un riferimento privo di proxy senza creare un confine aggirabile e che l'impatto sui ricavi è specifico di questo motore e scenario sintetici.
Un hard cap al 115% del prezzo di riferimento equo costa lo 0.2% dei ricavi e fallisce comunque il gate a 0.59, poiché il massimizzatore di ricavi tratta il tetto come un bersaglio: il 29% della coorte protetta viene riprezzato entro l'1% da esso, e il dialogo lo definisce Gamed To The Boundary. Fairness-Aware Reward Shaping attira ogni prezzo continuamente verso un prezzo di riferimento privo di proxy, non offre al motore alcun margine su cui spingere i prezzi e supera il gate a 0.82 con un pull weight di 0.65 e una gaming signature del 2%. Su questo motore sintetico ciò costa l'1.3% dei ricavi, e le note dell'app specificano che la cifra è specifica di questo motore e scenario.
Il dialogo Evidence Pack Results con intestazione CID-Ready Evidence Pack e un link Open Full Pack. Cinque riquadri riportano 10 Inputs Audited And Recorded, 0.43 Four-Fifths Ratio As Shipped, 0.82 Four-Fifths Ratio After Remediation, 4 Findings Mapped To Regulation e <2s Evidence-Pack Generation Time. Al di sotto, una riga di testo in piccolo sulla mappatura normativa e sulla natura append-only e a prova di manomissione del record, una casella per l'hash SHA-256 e una riga di percorso salvato che indica data/cid_evidence_pack.json e data/cid_evidence_pack.html. I pulsanti dell'intestazione ora recitano Remediation Complete, Pack Exported e Rerun Audit.
Questo dialogo costituisce la ricevuta. Il pacchetto registra 10 input sottoposti ad audit, il gate nello stato iniziale e post-remediation, e 4 rilievi mappati sulla normativa: le tre VIOLATION ciascuna associata ai cinque regimi nella mappatura normativa del pacchetto e l'ABSTAIN collegato a una singola voce per la revisione legale. L'hash è un digest SHA-256 del corpo del pacchetto: un sigillo a prova di manomissione che cambia a ogni esportazione poiché il pacchetto reca con sé l'ora di generazione. Il riquadro <2s è l'etichetta del dialogo per una compilazione che è effettivamente istantanea, non una misurazione di benchmark.
L'evidence pack stampabile aperto in una scheda del browser, con intestazione Pricing Defensibility: CID-Ready Evidence Pack. Una riga di intestazione indica lo schema vp-cid-pack/1.0, il motore ShopMart Dynamic Pricing (contextual MAB) linucb-7arm seed=42, 10,000 decisioni sottoposte ad audit e una narrazione memorizzata in cache di claude-opus-4-8. Sotto Disparate-Impact Gate (EEOC four-fifths) quattro riquadri indicano Four-fifths ratio 0.43 threshold 0.8, Favorable-tier rate protected 0.36 advantaged 0.83, Protected in top tier 64% e Representative gap +26% Aura Wireless Earbuds. Una tabella Findings elenca ciascun input con verdetto, |r|, MI, controfattuale e motivazione, con le righe di VIOLATION colorate in rosso, le righe PASS in verde e la riga ABSTAIN per premium_member in ambra, terminando con la riga del proxy composto referral × dwell_time. Al di sotto ha inizio una sezione Regulatory Mapping.
Open Full Pack è il formato che l'ufficio legale riceverebbe: lo stesso JSON visualizzato come documento stampabile, che elenca il motore e la build utilizzati, il numero di decisioni, i parametri del gate, il verdetto di ciascun input con la relativa motivazione e la mappatura normativa riga per riga. L'intestazione certifica che la narrazione proviene dall'output di un modello in cache; ogni numero accanto ad essa deriva dall'audit deterministico, e lo stesso seed li riproduce a ogni esecuzione. La risposta a una Civil Investigative Demand (CID) diventa questo file.
La vista Benchmark Results con il dialogo Benchmark Results aperto in primo piano, intitolato Validation Benchmark: Labeled Evaluation Set. Una nota spiega che la struttura dei proxy è innestata in questo set sintetico etichettato affinché individuazione, astensione e remediation possano essere valutate rispetto alla ground truth che l'audit non ispeziona direttamente. Quattro riquadri indicano 100% Precision: Proxies Correctly Flagged, 100% Recall: Planted Proxies Recovered, 0 Legitimate Signals Incorrectly Flagged e 1/1 Dual-Use Signals Correctly Abstained. In basso, Baseline: Fairness Through Unawareness elenca Remove ZIP And Device Inputs, Four-Fifths Ratio 0.59 Fails, Reason Compound Proxy Still Leaks; accanto, Equity Constraint riporta Four-Fifths Ratio 0.82 Pass, Revenue Cost -1.3% e Hard-Cap Baseline 0.59 Fails. Il pulsante Back To Manual Testing è posizionato in alto a destra.
Run Benchmark costituisce l'autoverifica del metodo e il suo ambito è indicato direttamente nella finestra di dialogo. Ricostruisce da zero la medesima popolazione e motore con seed=42 e valuta l'audit rispetto alle etichette innestate che non visualizza mai: 3 of 3 proxy innestati individuati, 0 segnali legittimi contrassegnati, 1 of 1 segnale dual-use astenuto. La baseline affiancata rappresenta la linea di difesa convenzionale: rimuovere ZIP e dispositivo e riaddestrare. Il rapporto passa da 0.43 a 0.59 e continua a fallire, poiché il proxy composto sopravvive all'eliminazione.

Cosa mostra la demo e cosa ne rimane escluso.

I numeri sopra riportati provengono da una popolazione sintetica inizializzata di 10,000 decisioni di pricing su una singola SKU con una struttura proxy innestata e riproducibile. Le cifre dimostrano che il metodo individua la struttura innestata con l'accuratezza di un set etichettato. Non rappresentano un tasso di accuratezza su dati di pricing reali, non sono un benchmark rispetto ai concorrenti e non costituiscono un'affermazione su alcun retailer reale.

DomandaCosa fa Equity in questa demoCosa rimane escluso dalla demo
IntegrazioneSottopone ad audit il bandit LinUCB integrato nell'app demo come motore sostitutivo ed è progettato affinché il motore di un cliente possa essere inserito a valle di un adapter.Qualsiasi codice adapter o connettore diretto a piattaforme di pricing. Non ne esiste alcuno in questa build, e nessun fornitore menzionato è cliente o partner.
Dati demograficiLegge una tabella di riferimento curata di dieci codici ZIP di New York e California e uno sbilanciamento dei dispositivi (device skew) inizializzato e codificato nell'app.Un feed censuario o di possesso dei dispositivi in tempo reale. La tabella è ridotta e curata manualmente, e la coorte protetta è un'etichetta innestata.
RisultanzeIndividua la struttura proxy innestata e registra nel pacchetto il verdetto di ciascun input con la relativa motivazione.La prova di discriminazione o intenzionalità nel mondo reale; l'infrastruttura non emette alcun verdetto di intenzionalità.

Cosa NON fa questa demo

Equity non stabilisce il prezzo per alcun cliente e non sostituisce Pricefx, PROS, Zilliant o Competera; il motore calcola i prezzi, Equity esegue l'audit e impone i vincoli. Non certifica la conformità, non garantisce il superamento dei controlli né fornisce consulenza legale; il pacchetto costituisce una prova a disposizione dell'ufficio legale del cliente. Questa build riguarda una singola SKU e il percorso di disparate impact dall'audit all'evidence pack; la collusione algoritmica, i middleware di informativa multigiurisdizionale, il monitoraggio in streaming e l'interfaccia di checkout ne sono esclusi. I profili di South Bronx e Upper East Side sulla scheda Pricing Outcome Comparison sono etichette rappresentative per coorti multi-ZIP e multidispositivo, non affermazioni su quartieri reali.

Cosa chiedono i responsabili legali e del pricing prima di implementare un livello di audit sul motore.

Il nostro modello di pricing non utilizza mai razza o reddito. Come può essere discriminatorio?

Perché il motore non ha bisogno di vedere la razza o il reddito per determinare il prezzo in base ad essi. Nella demo il motore sottoposto ad audit fissa i prezzi in base all'indice di reddito per ZIP, alla fascia del dispositivo e al comportamento di sessione, e tali input veicolano la classe protetta: l'indice di reddito per ZIP si correla ad essa a 0.95 e la fascia del dispositivo a 0.32. Il risultato sulla popolazione sintetica inizializzata è un prezzo superiore del 26.2% per la coorte con ZIP a maggioranza di minoranze e dispositivi datati sugli stessi auricolari a parità di segnali di domanda, e un rapporto four-fifths di 0.43 a fronte della soglia di 0.80. L'azione della FTC contro Instacart è stata un caso incentrato sui risultati in cui diversi acquirenti vedevano prezzi differenti per articoli identici, non un accertamento su cosa fosse stato programmato nell'algoritmo.

Abbiamo già rimosso il codice ZIP dal modello. Non è sufficiente?

Su questo motore, no. La baseline Fairness Through Unawareness nel benchmark esegue un nuovo addestramento senza gli input ZIP e dispositivo, e il rapporto four-fifths sale solo da 0.43 a 0.59, restando un fallimento. La modalità di arrivo dell'acquirente e il tempo di permanenza superano singolarmente il controllo, eppure codificano congiuntamente la coorte con un'informazione mutua di 0.73. La correlazione per singola feature è cieca rispetto a questa coppia; una verifica dell'informazione mutua congiunta non lo è, ed è per questo che l'audit valuta le interazioni oltre ai singoli input.

Non possiamo semplicemente fissare un tetto ai prezzi a una certa percentuale rispetto alla baseline?

È possibile, e la demo dimostra come si comporta un ottimizzatore dei ricavi in tale situazione. La Hard-Cap Baseline vieta qualsiasi prezzo superiore al 115% del prezzo equo di riferimento. Il motore rinuncia allo 0.2% dei ricavi per rispettarne la lettera e colloca il 29% della coorte protetta entro l'1% dal tetto massimo, di conseguenza il rapporto four-fifths raggiunge solo 0.59 e il gate fallisce comunque. Un tetto costituisce un bersaglio. Il Fairness-Aware Reward Shaping non ha alcun confine verso cui puntare, e supera il controllo a 0.82 con un costo dell'1.3% sui ricavi su questo motore sintetico.

Sostituisce Pricefx o PROS? Non intendiamo sostituire il nostro motore di pricing.

No. Equity non fissa mai un prezzo. Esegue l'audit delle decisioni del motore e propone un vincolo; il vostro motore, sia esso Pricefx, PROS, Zilliant, Competera o un bandit personalizzato, continua a stabilire i prezzi. Il punto di innesto per il motore di un cliente è un'interfaccia di scambio documentata; nella demo non è presente alcun codice di adattamento né integrazione live, quindi il bandit LinUCB che abbiamo creato funge da motore e viene controllato direttamente.

C'è un LLM in questo sistema. Come regge in fase di discovery legale?

Nulla di ciò che un avvocato dovrebbe difendere è l'output di un modello: le statistiche, il confronto con le soglie, ciascun verdetto, il vincolo e l'hash del pacchetto provengono tutti da codice numpy deterministico al di fuori del livello degli agenti. Il Feature Auditor e l'Adversarial Challenger scrivono testo in prosa; non calcolano mai un numero e non possono stabilire o modificare un verdetto, e la mappatura normativa è una tabella predefinita anziché l'output di un modello. In assenza di un provider di modelli, la crew ricorre a template deterministici e l'applicazione produce gli stessi verdetti. La narrazione nel walkthrough registrato è l'output validato e memorizzato in cache di un modello, e l'intestazione del pacchetto lo dichiara esplicitamente.

Cosa consegniamo effettivamente ai nostri legali quando arriva la CID?

Un evidence pack pronto per la CID in formato JSON e HTML stampabile. Registra il nome e la versione del motore, le 10,000 decisioni esaminate, il gate four-fifths prima e dopo la remediation, il verdetto di ciascun input con la relativa motivazione, la mappatura di ciascun input contrassegnato rispetto alla EEOC four-fifths rule, all'Algorithmic Pricing Disclosure Act di NY, al Colorado AI Act SB 24-205, agli EU AI Act Articles 13 and 14 e all'FTC Act Section 5, l'esito della remediation e un digest SHA-256 del corpo del pacchetto. Noi forniamo le prove; il vostro team legale prende la decisione.

Mostrate il 100% di precisione e recall. È un dato reale di accuratezza?

È un'autoverifica su set etichettato e va interpretata come tale. Il benchmark rigenera la popolazione sintetica di 10,000 decisioni inizializzata della demo e pone una sola domanda: l'audit ha individuato i tre proxy innestati e nient'altro? Lo ha fatto. Tutti e tre sono stati contrassegnati, nessuno dei quattro segnali legittimi di domanda è stato segnalato e l'unico segnale dual-use è stato posto in ABSTAIN anziché essere contrassegnato o cleared. Ciò dimostra che il metodo recupera la struttura innestata. I log di pricing reali sono soggetti a fattori di confondimento e non è eticamente ammissibile condurre A/B test applicando prezzi diversi a gruppi demografici differenti; pertanto, in un incarico reale, la medesima infrastruttura produce prove per la valutazione legale, mai un verdetto automatizzato.

Ricerca tecnica

La ricerca alla base di questa demo — l'architettura, la progettazione della verifica e il blueprint enterprise.

Social

Pubblicato anche su

Iniziate dagli input che il vostro motore di pricing utilizza già e scoprite quali di essi veicolano la classe protetta.

Siamo un team di ingegneria dell'AI, non un fornitore di software di pricing né un certificatore di compliance. Partiamo dal registro decisionale del vostro motore e arriviamo a un pacchetto che i vostri legali possono depositare; la valutazione sul significato delle evidenze spetta a loro.

Una prima conversazione utile è concreta: quale motore fissa i prezzi del vostro catalogo, quali input riceve, se include termini incrociati o alberi decisionali che potrebbero prezzare in base a un proxy composto e quali tra New York, California, Colorado o l'UE sono interessati dai vostri volumi. Possiamo esaminare l'audit, la sintesi dei vincoli e il formato dell'evidence pack al fianco dei vostri team di pricing, legali e dei dati.

Valutazione dell'esposizione ai proxy di pricing

  • ✓ Input in base ai quali il motore calcola i prezzi e quali veicolano segnali demografici
  • ✓ Proxy composti che i controlli per singola feature non rilevano
  • ✓ Una lettura four-fifths del vostro registro decisionale, come prova documentale per l'ufficio legale
  • ✓ Regimi normativi che i vostri volumi intersecano effettivamente

Costruite il livello di audit e prova

  • ✓ Audit deterministico degli input con riesecuzione controfattuale
  • ✓ Gate di disparate impact in codice chiaro e trasparente
  • ✓ Vincolo di equità con un costo misurato sui ricavi
  • ✓ Evidence pack con hash SHA-256 e mappatura normativa