Il livello di verifica intorno alla tua AI legale
L'AI redige memorie che citano precedenti inesistenti, o che esistono ma dicono il contrario di ciò per cui vengono citati. CiteGuard è il livello intorno alla tua AI: ancora ogni citazione alla giurisprudenza reale su CourtListener, intercetta le fabbricazioni in modo deterministico, instrada a un umano qualsiasi cosa non possa verificare e firma un certificato di audit. Ti dice cosa è sicuro depositare e esattamente cosa richiede un umano.
0
Le citazioni inventate possono superare il cancello
Invariante di fiducia deterministico, verificato con unit test
20
Precedenti reali nel corpus di verità di riferimento
In cache da CourtListener, il database pubblico di giurisprudenza statunitense
8/8
I test del verificatore centrale sono superati
Offline e riproducibile (python tests/test_core.py)
Questa è una demo eseguibile. Le memorie di esempio, le parti e l'intestazione della pratica sono estratti sintetici, e il connettore di document management è un mock. Il corpus, i controlli live su CourtListener, il cancello deterministico e i test sono reali.
I tribunali stanno già irrogando sanzioni, e gli strumenti di redazione non controllano il proprio lavoro.
Il modo di fallimento non è la grammatica sbagliata. La grammatica è perfetta, ed è proprio questo che lo rende pericoloso. L'AI redige una memoria che sembra scritta da un socio e cita un precedente mai deciso, o un precedente reale che dice il contrario della tesi per cui viene invocato. Anche gli strumenti giuridici specializzati lo fanno: Westlaw Precision ha allucinato il 33% delle volte e Lexis+ il 17% in uno studio controllato (Stanford RegLab, Journal of Empirical Legal Studies, 2025).
Le conseguenze sono già arrivate. Entro l'inizio del 2026 risultavano 1,222 cause documentate che coinvolgevano citazioni allucinate dall'AI, e i tribunali hanno iniziato a sanzionare: il Sesto Circuito ha irrogato una sanzione di $30,000 a marzo 2026. Sono seguite le regole di governance. L'ABA Formal Opinion 512 e più di 300 ordinanze giudiziarie permanenti ora impongono all'avvocato di verificare l'output dell'AI prima del deposito, eppure meno del 20% degli studi ha una qualsiasi policy sull'uso dell'AI.
Non è nello strumento di redazione che si risolve il problema. Un modello più potente continua a redigere, e a un tribunale non importa quanto fosse alta la confidenza del modello. Gli importa se la citazione esiste e dice ciò che hai affermato. Per questo la risposta duratura non è un redattore più intelligente, ma un livello separato che controlla il lavoro rispetto a un'autorità indipendente, intercetta la fabbricazione con certezza ed è onesto su ciò che non può verificare.
Le parti di livello garanzia sono codice deterministico. Il giudizio di merito è un LLM che si astiene. È il cancello, non il modello, a decidere.
Incolla qualsiasi memoria redatta dall'AI e la pipeline gira dal vivo: estrae ogni citazione e la sua tesi, la ancora alla giurisprudenza reale, esegue un controllo di esistenza deterministico e un controllo di supporto LLM, applica un cancello di policy deterministico ed esporta un certificato di audit firmato. La dashboard mostra ogni stadio che si accende in una console di sistema che trasmette in streaming ogni richiesta reale a CourtListener con URL, stato e latenza, così nulla è una scatola nera.
Il controllo di esistenza e di fabbricazione e il cancello di policy sono Python puro contro la giurisprudenza reale. Una citazione inventata è dimostrata assente da una ricerca live su CourtListener a zero risultati, non indovinata, perché un acquirente ha bisogno di un'intercettazione della fabbricazione dimostrabile e di un cancello auditabile, non della parola di un LLM.
Il controllo di supporto legge l'opinione reale e chiede se sostiene la tesi P. È intercambiabile rispetto al provider e si astiene, instradando alla revisione umana, ogni volta che è incerto o non ancorato. Consiglia; non ha mai l'ultima parola.
Ogni citazione si risolve in esattamente un verdetto. I verdetti che instradano a un umano sono onesti sul perché, e quello che significa che CourtListener era irraggiungibile non viene mai collassato in una fabbricazione.
| Verdetto | Cosa significa | Deciso da |
|---|---|---|
| VERIFIED_SUPPORTED | Precedente reale, e l'opinione sostiene la tesi | Controllo di esistenza più controllo di supporto |
| VERIFIED_UNSUPPORTED (necessita revisione) | Precedente reale, ma l'opinione non la sostiene in modo chiaro | Instradato a un umano con il contesto |
| FABRICATED | Nessun precedente di questo tipo nella giurisprudenza reale | Deterministico, ricerca live a zero risultati |
| OUTSIDE_COVERAGE | Un precedente genuino non presente nel sottoinsieme in cache, contrassegnato onestamente | Deterministico, mai un verificato falso |
| UNVERIFIED | CourtListener irraggiungibile, quindi l'assenza non è provata | Deterministico, mai collassato in fabbricato |
Il cancello è deterministico. Restituisce FILING_READY solo se ci sono zero citazioni inventate e zero citazioni irrisolte, e NOT_FILING_READY altrimenti. Significa che una sola citazione non revisionata blocca l'intero deposito, per disegno, anche quando nulla è inventato. Un clic esporta poi un certificato di audit JSON firmato che registra, per ciascuna citazione, il verdetto, l'estratto di evidenza, l'URL reale di CourtListener, il modello e la versione (o deterministic, o abstained), la versione del verificatore, un timestamp UTC e il risultato del cancello.
La demo include quattro memorie di esempio. Ne percorriamo due: la memoria Mixed Motion, che porta insieme una citazione reale, una inventata e una fuori corpus, e la memoria Clean Motion, in cui ogni citazione è reale. Ogni immagine sotto è uno screenshot dell'app in esecuzione. L'intestazione della pratica è illustrativa, non una causa reale.
A sinistra c'è un'istanza di soppressione redatta dall'AI. A destra, la console di sistema si accende stadio per stadio e trasmette in streaming ogni richiesta reale a CourtListener con URL, stato e latenza, insieme al ragionamento del controllo di supporto. Questa è la prima citazione, Miranda v. Arizona, 384 U.S. 436, che si risolve rispetto al corpus di verità di riferimento mentre il controllo di supporto legge il testo dell'opinione.
La memoria cita Halstead v. Ferngate Holdings, 823 U.S. 1199. Il controllo di esistenza invia un GET live a CourtListener e ottiene 200 con 0 risultati, perché U.S. Reports non ha il volume 823. Il verdetto è FABRICATED, dimostrato assente anziché indovinato. Nella stessa esecuzione Brown v. Board of Education, 347 U.S. 483 è un precedente reale che non è nel sottoinsieme in cache, quindi è onestamente contrassegnato OUTSIDE_COVERAGE invece di un verificato falso. Il cancello legge NOT_FILING_READY: 1 inventata, 2 irrisolte, 1 auto-sbloccata.
Questa è la memoria Clean Motion, in cui ogni citazione è un precedente reale e pertinente. Quando il testo dell'opinione stabilisce la tesi, il controllo di supporto la conferma. Miranda v. Arizona, 384 U.S. 436 si sblocca come Verificata perché la maggioranza stessa afferma che un indagato deve essere avvisato del diritto al difensore e di rimanere in silenzio, con un link al precedente reale su CourtListener. Quali citazioni pertinenti si sbloccano in verde e quali vengono instradate alla revisione può variare da esecuzione a esecuzione, perché il controllo di supporto è l'unico passo non deterministico, ma una citazione pertinente come Miranda si sblocca in modo affidabile.
Nella revisione della Mixed Motion, il tabellone legge 1 Verificata, 1 Inventata e 2 Da revisionare. Bell Atlantic Corp. v. Twombly, 550 U.S. 544 è un precedente reale, ma l'estratto non stabilisce in modo netto la tesi per cui viene invocato, quindi il controllo di supporto lo contrassegna Da revisionare con il proprio ragionamento anziché valutarlo con sicurezza. Quell'astensione conservativa è il disegno: un verdetto rosso Unsupported dato con sicurezza è raro di proposito, perché la mossa onesta su un'opinione ambigua è consegnarla a un umano.
Questo è il certificato per quella stessa memoria Clean Motion. Miranda si è sbloccata come Verificata, ma Terry v. Ohio e Strickland v. Washington sono state instradate alla revisione, quindi il cancello resta su Non pronta per il deposito e il sigillo legge Trattenere per revisione, anche se non una sola citazione è inventata. Il certificato elenca ciascuna citazione con il suo verdetto e il risultato del controllo di supporto e certifica che ognuna è stata controllata per l'esistenza rispetto a CourtListener, che le citazioni inventate sono identificate con certezza e che le citazioni che richiedono un giudizio contestuale sono instradate a un umano. Si esporta come record JSON firmato da allegare al deposito. Una memoria dall'aspetto pulito non è la stessa cosa di una pronta per il deposito.
Il corpus è di 20 decisioni reali in cache da CourtListener, il database pubblico di giurisprudenza statunitense, tra cui Miranda, Twombly, Iqbal, Terry, Strickland, International Shoe, Erie, Baker v. Carr, Chevron e Daubert. I controlli di esistenza e di fabbricazione interrogano anche CourtListener dal vivo al momento della richiesta, ed è per questo che l'intercettazione della fabbricazione è autorevole anziché limitata al sottoinsieme. Il corpus di 20 casi è un sottoinsieme in cache, quindi la valutazione del supporto è dimostrata a N piccolo su precedenti reali, e quel perimetro è enunciato chiaramente anziché essere spacciato per accuratezza universale.
CiteGuard non è un altro redattore. È il livello che decide cosa è sicuro depositare.
| Dimensione | Memoria AI non verificata | Livello di verifica CiteGuard |
|---|---|---|
| Rilevazione di precedenti inventati | Sembra autorevole, non intercettata | Deterministico, ricerca live a zero risultati |
| Citazione reale ma mal applicata | Passa intatta | Instradata alla revisione umana con il contesto |
| Controllo di supporto incerto | Il modello afferma comunque un verdetto | Si astiene, lo consegna a un umano |
| Provenienza | Nessuna | Un link reale a CourtListener per ciascuna citazione |
| Decisione di deposito | La confidenza dello strumento di redazione | Un cancello deterministico, zero inventate e zero irrisolte |
| Traccia di audit per ABA Op. 512 | Nessuna | Certificato JSON firmato per ciascuna memoria |
No. CiteGuard non redige né fa ricerca giuridica, quindi non compete con Harvey, Westlaw Precision o Lexis Protege. È il livello di verifica che sta intorno a qualunque cosa uno di essi abbia prodotto. Prende la memoria redatta dall'AI, dice all'avvocato cosa è sicuro depositare e esattamente cosa richiede un umano, e gira in modalità ombra o consultiva accanto allo strumento che già usi.
Il controllo di esistenza interroga CourtListener, il database pubblico di giurisprudenza statunitense, per la citazione esatta. Una citazione inventata come Halstead v. Ferngate Holdings, 823 U.S. 1199 restituisce zero risultati (U.S. Reports non ha il volume 823), quindi è contrassegnata FABRICATED con certezza, non indovinata. Se CourtListener è irraggiungibile, la citazione è contrassegnata UNVERIFIED anziché inventata, perché l'assenza di prova non è prova di assenza. Quella distinzione è un invariante deterministico, verificato con unit test.
Non ciecamente, ed è per questo che il controllo di supporto si astiene. È un unico passo LLM che legge l'opinione reale e conferma una citazione in verde solo quando il testo dell'opinione stabilisce la holding, come fa per Miranda v. Arizona. Quando l'opinione non sostiene in modo netto la tesi enunciata, instrada la citazione alla revisione umana anziché bluffare un verdetto. Il modello consiglia; il cancello deterministico e l'avvocato decidono.
No, perché pronto per il deposito è una proprietà di governance, non una proprietà del modello. A un tribunale non importa quanto fosse alta la confidenza del modello; gli importa se la citazione esiste e dice ciò che hai affermato. Quindi il bisogno duraturo è un livello indipendente che ancora ogni pretesa alla giurisprudenza reale, intercetta la fabbricazione con certezza ed è onesto su ciò che non può verificare. Quel requisito vale a qualsiasi qualità del modello.
Un clic esporta un certificato JSON firmato che registra, per ciascuna citazione, il verdetto, l'estratto di evidenza, l'URL reale di CourtListener, il modello e la versione (o deterministic o abstained), la versione del verificatore, un timestamp UTC e il risultato del cancello. È l'artefatto che mostra che un avvocato ha verificato l'output dell'AI prima del deposito, che è ciò che ABA Formal Opinion 512 e oltre 300 ordinanze giudiziarie permanenti ora richiedono. Nella demo il certificato è JSON; un export PDF è differito.
È una demo eseguibile che prova il meccanismo, non una pipeline in produzione. Le quattro memorie di esempio, le parti e l'intestazione della pratica sono etichettate come estratti sintetici, e il connettore di document management è un mock. Cosa è reale: il corpus di 20 casi è in cache da CourtListener, i controlli di esistenza e di fabbricazione interrogano CourtListener dal vivo al momento della richiesta, il cancello deterministico e gli 8 unit test su 8 girano esattamente come mostrato, e le citazioni inventate sono genuinamente assenti dalla giurisprudenza reale.
La ricerca dietro questa demo — l'architettura, il design della verifica e il blueprint per l'impresa.
Soluzione completa
Esplora la soluzione Verifica e governance delle citazioni nell'AI legale →Il livello di verifica è la parte difficile. Lo costruiamo noi.
Se il tuo studio sta cercando di capire come far usare l'AI agli avvocati senza rischiare una citazione inventata in un deposito, ci farebbe davvero piacere sentire come state ragionando. Il problema è di tutto il settore e lo saranno anche le risposte.