Il livello di verifica intorno alla tua AI legale

Un precedente inventato viene intercettato con certezza prima che la memoria venga depositata.

L'AI redige memorie che citano precedenti inesistenti, o che esistono ma dicono il contrario di ciò per cui vengono citati. CiteGuard è il livello intorno alla tua AI: ancora ogni citazione alla giurisprudenza reale su CourtListener, intercetta le fabbricazioni in modo deterministico, instrada a un umano qualsiasi cosa non possa verificare e firma un certificato di audit. Ti dice cosa è sicuro depositare e esattamente cosa richiede un umano.

0

Le citazioni inventate possono superare il cancello

Invariante di fiducia deterministico, verificato con unit test

20

Precedenti reali nel corpus di verità di riferimento

In cache da CourtListener, il database pubblico di giurisprudenza statunitense

8/8

I test del verificatore centrale sono superati

Offline e riproducibile (python tests/test_core.py)

Questa è una demo eseguibile. Le memorie di esempio, le parti e l'intestazione della pratica sono estratti sintetici, e il connettore di document management è un mock. Il corpus, i controlli live su CourtListener, il cancello deterministico e i test sono reali.

Una memoria che sembra autorevole può citare precedenti che non esistono

I tribunali stanno già irrogando sanzioni, e gli strumenti di redazione non controllano il proprio lavoro.

Il modo di fallimento non è la grammatica sbagliata. La grammatica è perfetta, ed è proprio questo che lo rende pericoloso. L'AI redige una memoria che sembra scritta da un socio e cita un precedente mai deciso, o un precedente reale che dice il contrario della tesi per cui viene invocato. Anche gli strumenti giuridici specializzati lo fanno: Westlaw Precision ha allucinato il 33% delle volte e Lexis+ il 17% in uno studio controllato (Stanford RegLab, Journal of Empirical Legal Studies, 2025).

Le conseguenze sono già arrivate. Entro l'inizio del 2026 risultavano 1,222 cause documentate che coinvolgevano citazioni allucinate dall'AI, e i tribunali hanno iniziato a sanzionare: il Sesto Circuito ha irrogato una sanzione di $30,000 a marzo 2026. Sono seguite le regole di governance. L'ABA Formal Opinion 512 e più di 300 ordinanze giudiziarie permanenti ora impongono all'avvocato di verificare l'output dell'AI prima del deposito, eppure meno del 20% degli studi ha una qualsiasi policy sull'uso dell'AI.

Non è nello strumento di redazione che si risolve il problema. Un modello più potente continua a redigere, e a un tribunale non importa quanto fosse alta la confidenza del modello. Gli importa se la citazione esiste e dice ciò che hai affermato. Per questo la risposta duratura non è un redattore più intelligente, ma un livello separato che controlla il lavoro rispetto a un'autorità indipendente, intercetta la fabbricazione con certezza ed è onesto su ciò che non può verificare.

Come funziona CiteGuard

Le parti di livello garanzia sono codice deterministico. Il giudizio di merito è un LLM che si astiene. È il cancello, non il modello, a decidere.

Incolla qualsiasi memoria redatta dall'AI e la pipeline gira dal vivo: estrae ogni citazione e la sua tesi, la ancora alla giurisprudenza reale, esegue un controllo di esistenza deterministico e un controllo di supporto LLM, applica un cancello di policy deterministico ed esporta un certificato di audit firmato. La dashboard mostra ogni stadio che si accende in una console di sistema che trasmette in streaming ogni richiesta reale a CourtListener con URL, stato e latenza, così nulla è una scatola nera.

Due motori, deliberatamente separati

Python deterministico (livello garanzia)

Il controllo di esistenza e di fabbricazione e il cancello di policy sono Python puro contro la giurisprudenza reale. Una citazione inventata è dimostrata assente da una ricerca live su CourtListener a zero risultati, non indovinata, perché un acquirente ha bisogno di un'intercettazione della fabbricazione dimostrabile e di un cancello auditabile, non della parola di un LLM.

Un unico passo LLM che si astiene

Il controllo di supporto legge l'opinione reale e chiede se sostiene la tesi P. È intercambiabile rispetto al provider e si astiene, instradando alla revisione umana, ogni volta che è incerto o non ancorato. Consiglia; non ha mai l'ultima parola.

Uno di cinque verdetti onesti per citazione

Ogni citazione si risolve in esattamente un verdetto. I verdetti che instradano a un umano sono onesti sul perché, e quello che significa che CourtListener era irraggiungibile non viene mai collassato in una fabbricazione.

Verdetto Cosa significa Deciso da
VERIFIED_SUPPORTED Precedente reale, e l'opinione sostiene la tesi Controllo di esistenza più controllo di supporto
VERIFIED_UNSUPPORTED (necessita revisione) Precedente reale, ma l'opinione non la sostiene in modo chiaro Instradato a un umano con il contesto
FABRICATED Nessun precedente di questo tipo nella giurisprudenza reale Deterministico, ricerca live a zero risultati
OUTSIDE_COVERAGE Un precedente genuino non presente nel sottoinsieme in cache, contrassegnato onestamente Deterministico, mai un verificato falso
UNVERIFIED CourtListener irraggiungibile, quindi l'assenza non è provata Deterministico, mai collassato in fabbricato

Il cancello di policy

Il cancello è deterministico. Restituisce FILING_READY solo se ci sono zero citazioni inventate e zero citazioni irrisolte, e NOT_FILING_READY altrimenti. Significa che una sola citazione non revisionata blocca l'intero deposito, per disegno, anche quando nulla è inventato. Un clic esporta poi un certificato di audit JSON firmato che registra, per ciascuna citazione, il verdetto, l'estratto di evidenza, l'URL reale di CourtListener, il modello e la versione (o deterministic, o abstained), la versione del verificatore, un timestamp UTC e il risultato del cancello.

Una memoria, ogni percorso, eseguito da un capo all'altro

La demo include quattro memorie di esempio. Ne percorriamo due: la memoria Mixed Motion, che porta insieme una citazione reale, una inventata e una fuori corpus, e la memoria Clean Motion, in cui ogni citazione è reale. Ogni immagine sotto è uno screenshot dell'app in esecuzione. L'intestazione della pratica è illustrativa, non una causa reale.

La pipeline gira dal vivo contro la giurisprudenza reale

A sinistra c'è un'istanza di soppressione redatta dall'AI. A destra, la console di sistema si accende stadio per stadio e trasmette in streaming ogni richiesta reale a CourtListener con URL, stato e latenza, insieme al ragionamento del controllo di supporto. Questa è la prima citazione, Miranda v. Arizona, 384 U.S. 436, che si risolve rispetto al corpus di verità di riferimento mentre il controllo di supporto legge il testo dell'opinione.

La dashboard di CiteGuard: una memoria redatta dall'AI a sinistra e una console di sistema a destra che mostra gli stadi estrazione, ancoraggio, controllo di supporto, cancello e certificato con una traccia live delle richieste a CourtListener.
La pipeline live: estrazione, ancoraggio alla giurisprudenza reale, controllo di supporto, cancello, certificato, con la traccia CourtListener in streaming sotto.

Un precedente inventato, intercettato con certezza

La memoria cita Halstead v. Ferngate Holdings, 823 U.S. 1199. Il controllo di esistenza invia un GET live a CourtListener e ottiene 200 con 0 risultati, perché U.S. Reports non ha il volume 823. Il verdetto è FABRICATED, dimostrato assente anziché indovinato. Nella stessa esecuzione Brown v. Board of Education, 347 U.S. 483 è un precedente reale che non è nel sottoinsieme in cache, quindi è onestamente contrassegnato OUTSIDE_COVERAGE invece di un verificato falso. Il cancello legge NOT_FILING_READY: 1 inventata, 2 irrisolte, 1 auto-sbloccata.

Il tabellone di verifica di CiteGuard per una memoria che mostra 1 Verificata, 1 Inventata e 2 Da revisionare, con Halstead v. Ferngate 823 U.S. 1199 contrassegnata Inventata e Brown v. Board of Education contrassegnata Fuori copertura, e il cancello che legge Non depositare.
Una memoria, ogni esito: una citazione reale Verificata, Halstead 823 U.S. 1199 Inventata su una ricerca a zero risultati, Brown v. Board Fuori copertura, e il resto instradato a Da revisionare.

Un precedente reale sbloccato in verde, sulla holding stessa dell'opinione

Questa è la memoria Clean Motion, in cui ogni citazione è un precedente reale e pertinente. Quando il testo dell'opinione stabilisce la tesi, il controllo di supporto la conferma. Miranda v. Arizona, 384 U.S. 436 si sblocca come Verificata perché la maggioranza stessa afferma che un indagato deve essere avvisato del diritto al difensore e di rimanere in silenzio, con un link al precedente reale su CourtListener. Quali citazioni pertinenti si sbloccano in verde e quali vengono instradate alla revisione può variare da esecuzione a esecuzione, perché il controllo di supporto è l'unico passo non deterministico, ma una citazione pertinente come Miranda si sblocca in modo affidabile.

La traccia live del controllo di supporto che recupera l'opinione reale di Miranda v. Arizona da CourtListener e ne cita la holding sugli avvertimenti in caso di interrogatorio in stato di custodia, contrassegnando 384 U.S. 436 come Verificata, mentre Terry v. Ohio viene ancorata subito dopo.
Il controllo di supporto legge l'opinione reale e cita la holding della maggioranza, così Miranda 384 U.S. 436 si sblocca come Verificata, ancorata al testo reale con un link alla fonte.

Instrada a un umano anziché bluffare un verdetto

Nella revisione della Mixed Motion, il tabellone legge 1 Verificata, 1 Inventata e 2 Da revisionare. Bell Atlantic Corp. v. Twombly, 550 U.S. 544 è un precedente reale, ma l'estratto non stabilisce in modo netto la tesi per cui viene invocato, quindi il controllo di supporto lo contrassegna Da revisionare con il proprio ragionamento anziché valutarlo con sicurezza. Quell'astensione conservativa è il disegno: un verdetto rosso Unsupported dato con sicurezza è raro di proposito, perché la mossa onesta su un'opinione ambigua è consegnarla a un umano.

Una memoria di precedente mal applicato in cui Erie Railroad v. Tompkins e Celotex Corp. v. Catrett sono precedenti reali citati per la tesi sbagliata; la traccia mostra il controllo di supporto che legge ciascuna opinione reale, constata che il punto non è stabilito e li instrada a Da revisionare.
Precedenti reali citati per la tesi sbagliata: il controllo di supporto legge l'opinione, vede che il punto non è stabilito e li instrada a Da revisionare anziché bluffare. Una corrispondenza per parole chiave lo perderebbe.

Anche una memoria pulita è trattenuta finché ogni citazione non è risolta

Questo è il certificato per quella stessa memoria Clean Motion. Miranda si è sbloccata come Verificata, ma Terry v. Ohio e Strickland v. Washington sono state instradate alla revisione, quindi il cancello resta su Non pronta per il deposito e il sigillo legge Trattenere per revisione, anche se non una sola citazione è inventata. Il certificato elenca ciascuna citazione con il suo verdetto e il risultato del controllo di supporto e certifica che ognuna è stata controllata per l'esistenza rispetto a CourtListener, che le citazioni inventate sono identificate con certezza e che le citazioni che richiedono un giudizio contestuale sono instradate a un umano. Si esporta come record JSON firmato da allegare al deposito. Una memoria dall'aspetto pulito non è la stessa cosa di una pronta per il deposito.

Il Certificato di verifica delle citazioni per la pratica Hartwell Capital Partners, contrassegnato Non pronta per il deposito, che elenca tre citazioni con verdetti Verificata e Da revisionare e un sigillo Trattenere per revisione.
Il certificato firmato, contrassegnato Non pronta per il deposito con un sigillo Trattenere per revisione, perché le citazioni richiedono ancora il giudizio umano.

Ancorato a un'autorità indipendente

Il corpus è di 20 decisioni reali in cache da CourtListener, il database pubblico di giurisprudenza statunitense, tra cui Miranda, Twombly, Iqbal, Terry, Strickland, International Shoe, Erie, Baker v. Carr, Chevron e Daubert. I controlli di esistenza e di fabbricazione interrogano anche CourtListener dal vivo al momento della richiesta, ed è per questo che l'intercettazione della fabbricazione è autorevole anziché limitata al sottoinsieme. Il corpus di 20 casi è un sottoinsieme in cache, quindi la valutazione del supporto è dimostrata a N piccolo su precedenti reali, e quel perimetro è enunciato chiaramente anziché essere spacciato per accuratezza universale.

Il pannello Corpus di verità di riferimento che elenca 20 precedenti reali curati da CourtListener, tra cui Strickland v. Washington, Ashcroft v. Iqbal, Terry v. Ohio, Whitman v. American Trucking e Chevron, ciascuno con la propria citazione e un'opinione in cache.
Il corpus di verità di riferimento di 20 casi, in cache da CourtListener, con ricerche live al momento della richiesta per esistenza e fabbricazione.

Output AI non verificato rispetto a CiteGuard

CiteGuard non è un altro redattore. È il livello che decide cosa è sicuro depositare.

Dimensione Memoria AI non verificata Livello di verifica CiteGuard
Rilevazione di precedenti inventati Sembra autorevole, non intercettata Deterministico, ricerca live a zero risultati
Citazione reale ma mal applicata Passa intatta Instradata alla revisione umana con il contesto
Controllo di supporto incerto Il modello afferma comunque un verdetto Si astiene, lo consegna a un umano
Provenienza Nessuna Un link reale a CourtListener per ciascuna citazione
Decisione di deposito La confidenza dello strumento di redazione Un cancello deterministico, zero inventate e zero irrisolte
Traccia di audit per ABA Op. 512 Nessuna Certificato JSON firmato per ciascuna memoria

Cosa questa demo non fa

  • ✓ Non fa ricerca giuridica né redazione, e non compete con Harvey, Westlaw o Lexis. È un livello di verifica che sta intorno a qualunque modello abbia prodotto la memoria.
  • ✓ Non pretende un giudizio AI perfetto sul supporto. Il controllo di supporto è assistito da LLM con astensione, è non deterministico e instrada i casi incerti a un umano per disegno. Non contrassegna automaticamente in rosso Unsupported ogni citazione mal applicata; un verdetto rosso dato con sicurezza è raro di proposito.
  • ✓ Non tratta una memoria dall'aspetto pulito come pronta per il deposito. Solo fabbricazione ed esistenza sono garanzie deterministiche. Gli 8 test su 8 e il corpus di 20 casi sono il perimetro della demo costruita, non una pretesa di accuratezza a mondo aperto.
  • ✓ Non presenta le memorie di esempio, i precedenti o l'intestazione della pratica come clienti o pratiche reali. Sono etichettati come estratti sintetici. Le citazioni inventate sono genuinamente assenti dalla giurisprudenza reale.
  • ✓ Non usa un connettore di document management live. Il connettore iManage o NetDocuments è un mock, l'ancoraggio predefinito usa l'estratto pubblico dell'opinione di maggioranza (il testo integrale dell'opinione richiede un token gratuito CourtListener), e un certificato PDF, i controlli di negative treatment e GraphRAG sono differiti.
  • ✓ Non porta clienti, casi di studio, testimonianze o cifre di ROI. Non ne esistono ancora. Questa è una demo che prova il meccanismo, non una messa in produzione.

Domande che gli avvocati pongono davvero

Questo sostituisce Harvey, Westlaw o Lexis?

No. CiteGuard non redige né fa ricerca giuridica, quindi non compete con Harvey, Westlaw Precision o Lexis Protege. È il livello di verifica che sta intorno a qualunque cosa uno di essi abbia prodotto. Prende la memoria redatta dall'AI, dice all'avvocato cosa è sicuro depositare e esattamente cosa richiede un umano, e gira in modalità ombra o consultiva accanto allo strumento che già usi.

Come fa a sapere che una citazione è inventata e non semplicemente mancante?

Il controllo di esistenza interroga CourtListener, il database pubblico di giurisprudenza statunitense, per la citazione esatta. Una citazione inventata come Halstead v. Ferngate Holdings, 823 U.S. 1199 restituisce zero risultati (U.S. Reports non ha il volume 823), quindi è contrassegnata FABRICATED con certezza, non indovinata. Se CourtListener è irraggiungibile, la citazione è contrassegnata UNVERIFIED anziché inventata, perché l'assenza di prova non è prova di assenza. Quella distinzione è un invariante deterministico, verificato con unit test.

Posso fidarmi dell'AI nel giudicare se un precedente sostiene davvero il mio argomento?

Non ciecamente, ed è per questo che il controllo di supporto si astiene. È un unico passo LLM che legge l'opinione reale e conferma una citazione in verde solo quando il testo dell'opinione stabilisce la holding, come fa per Miranda v. Arizona. Quando l'opinione non sostiene in modo netto la tesi enunciata, instrada la citazione alla revisione umana anziché bluffare un verdetto. Il modello consiglia; il cancello deterministico e l'avvocato decidono.

Un modello AI migliore renderà semplicemente questo inutile?

No, perché pronto per il deposito è una proprietà di governance, non una proprietà del modello. A un tribunale non importa quanto fosse alta la confidenza del modello; gli importa se la citazione esiste e dice ciò che hai affermato. Quindi il bisogno duraturo è un livello indipendente che ancora ogni pretesa alla giurisprudenza reale, intercetta la fabbricazione con certezza ed è onesto su ciò che non può verificare. Quel requisito vale a qualsiasi qualità del modello.

Cosa prova realmente il certificato di audit per l'ABA Opinion 512 e le ordinanze permanenti?

Un clic esporta un certificato JSON firmato che registra, per ciascuna citazione, il verdetto, l'estratto di evidenza, l'URL reale di CourtListener, il modello e la versione (o deterministic o abstained), la versione del verificatore, un timestamp UTC e il risultato del cancello. È l'artefatto che mostra che un avvocato ha verificato l'output dell'AI prima del deposito, che è ciò che ABA Formal Opinion 512 e oltre 300 ordinanze giudiziarie permanenti ora richiedono. Nella demo il certificato è JSON; un export PDF è differito.

È un prodotto in produzione o una demo, e cosa c'è di reale?

È una demo eseguibile che prova il meccanismo, non una pipeline in produzione. Le quattro memorie di esempio, le parti e l'intestazione della pratica sono etichettate come estratti sintetici, e il connettore di document management è un mock. Cosa è reale: il corpus di 20 casi è in cache da CourtListener, i controlli di esistenza e di fabbricazione interrogano CourtListener dal vivo al momento della richiesta, il cancello deterministico e gli 8 unit test su 8 girano esattamente come mostrato, e le citazioni inventate sono genuinamente assenti dalla giurisprudenza reale.

Ricerca tecnica

La ricerca dietro questa demo — l'architettura, il design della verifica e il blueprint per l'impresa.

Mettere lavoro redatto dall'AI davanti a un tribunale?

Il livello di verifica è la parte difficile. Lo costruiamo noi.

Se il tuo studio sta cercando di capire come far usare l'AI agli avvocati senza rischiare una citazione inventata in un deposito, ci farebbe davvero piacere sentire come state ragionando. Il problema è di tutto il settore e lo saranno anche le risposte.

Valutazione della verifica

  • ✓ Mappa dove il tuo flusso di lavoro AI può depositare una citazione non verificata
  • ✓ Definisci le regole di esistenza, ancoraggio e supporto per la tua giurisprudenza
  • ✓ Progetta l'instradamento alla revisione umana e le soglie di astensione
  • ✓ Specifica il certificato di audit di cui hanno bisogno i tuoi obblighi ABA Op. 512

Costruire il livello

  • ✓ Un verificatore deterministico sulle tue fonti di giurisprudenza reale
  • ✓ Un controllo di supporto che si astiene anziché bluffare
  • ✓ Un cancello di policy e un certificato di audit firmato per ciascun deposito
  • ✓ Intercambiabile rispetto al modello, in esecuzione in modalità ombra intorno alla tua AI legale
Social

Pubblicato anche su