La capa de verificación alrededor de su IA jurídica

Un caso fabricado se detecta con certeza antes de que su escrito se presente.

La IA redacta escritos que citan casos que no existen, o que existen pero dicen lo contrario de aquello para lo que se citan. CiteGuard es la capa alrededor de su IA: ancla cada cita en jurisprudencia real de CourtListener, detecta fabricaciones de forma determinista, deriva a un humano todo lo que no puede verificar y firma un certificado de auditoría. Le indica qué es seguro presentar y exactamente qué necesita a un humano.

0

Las citas fabricadas pueden pasar la compuerta

Invariante de confianza determinista, cubierto por pruebas unitarias

20

Casos reales en el corpus de verdad fundamental

En caché desde CourtListener, la base de datos pública de jurisprudencia de EE. UU.

8/8

Las pruebas del verificador central pasan

Fuera de línea y reproducible (python tests/test_core.py)

Esta es una demostración ejecutable. Los escritos de muestra, las partes y el encabezado del asunto son extractos sintéticos, y el conector de gestión documental es un simulacro. El corpus, las comprobaciones en vivo de CourtListener, la compuerta determinista y las pruebas son reales.

Un escrito que parece autoritativo puede citar casos que no existen

Los tribunales ya lo están sancionando, y las herramientas de redacción no comprueban su propio trabajo.

El modo de fallo no es la mala gramática. La gramática es perfecta, y eso es lo que lo hace peligroso. La IA redacta un escrito que se lee como si lo hubiera escrito un socio y cita un caso que nunca se falló, o un caso real que dice lo contrario de la proposición para la que se ofrece. Incluso las herramientas jurídicas especializadas lo hacen: Westlaw Precision alucinó el 33 % y Lexis+ el 17 % de las veces en un estudio controlado (Stanford RegLab, Journal of Empirical Legal Studies, 2025).

Las consecuencias ya han llegado. A principios de 2026 había 1,222 casos judiciales documentados que involucraban citas alucinadas por IA, y los tribunales han empezado a sancionar: el Sexto Circuito impuso una sanción de $30,000 en marzo de 2026. Siguieron las normas de gobernanza. El Dictamen formal 512 de la ABA y más de 300 órdenes permanentes judiciales ahora exigen que un abogado verifique la salida de IA antes de presentar, y sin embargo menos del 20 % de los bufetes tienen alguna política de uso de IA en absoluto.

El redactor es el lugar equivocado para corregir esto. Un modelo más potente sigue redactando, y un tribunal no se preocupa de cuánta confianza tenía el modelo. Le importa si la cita existe y dice lo que usted afirmó. Por eso la respuesta duradera no es un redactor más inteligente, sino una capa aparte que comprueba el trabajo frente a una autoridad independiente, detecta la fabricación con certeza y es honesta sobre lo que no puede verificar.

Cómo funciona CiteGuard

Las partes de grado de garantía son código determinista. El juicio de valor es un LLM que se abstiene. La compuerta, no el modelo, decide.

Pegue cualquier escrito redactado por IA y el pipeline se ejecuta en vivo: extrae cada cita y su proposición, la ancla en jurisprudencia real, ejecuta una comprobación de existencia determinista y una comprobación de respaldo con LLM, aplica una compuerta de política determinista y exporta un certificado de auditoría firmado. El panel muestra cómo se ilumina cada etapa en una consola de sistema que transmite cada solicitud real a CourtListener con su URL, estado y latencia, de modo que nada es una caja negra.

Dos motores, deliberadamente separados

Python determinista (grado de garantía)

La comprobación de existencia y fabricación y la compuerta de política son Python puro frente a jurisprudencia real. Una cita fabricada se demuestra ausente mediante una consulta en vivo a CourtListener con cero resultados, no se adivina, porque un comprador necesita detección de fabricación demostrable y una compuerta auditable, no la palabra de un LLM.

Un solo paso de LLM que se abstiene

La comprobación de respaldo lee la opinión real y pregunta si respalda la proposición P. Es intercambiable entre proveedores y se abstiene, derivando a revisión humana, siempre que no esté segura o no esté anclada. Aconseja; nunca tiene la última palabra.

Uno de cinco veredictos honestos por cita

Cada cita se resuelve en exactamente un veredicto. Los veredictos que derivan a un humano son honestos sobre el porqué, y el que significa que CourtListener era inalcanzable nunca se colapsa en una fabricación.

Veredicto Qué significa Decidido por
VERIFIED_SUPPORTED Caso real, y la opinión respalda la proposición Comprobación de existencia más comprobación de respaldo
VERIFIED_UNSUPPORTED (necesita revisión) Caso real, pero la opinión no lo respalda con claridad Derivado a un humano con el contexto
FABRICATED No existe tal caso en la jurisprudencia real Determinista, consulta en vivo con cero resultados
OUTSIDE_COVERAGE Un caso genuino que no está en el subconjunto en caché, marcado con honestidad Determinista, nunca un verificado falso
UNVERIFIED CourtListener inalcanzable, de modo que la ausencia no está demostrada Determinista, nunca colapsado a fabricado

La compuerta de política

La compuerta es determinista. Devuelve FILING_READY solo si hay cero citas fabricadas y cero citas sin resolver, y NOT_FILING_READY en caso contrario. Eso significa que una sola cita sin revisar retiene toda la presentación, por diseño, incluso cuando nada está fabricado. Un clic exporta entonces un certificado de auditoría JSON firmado que registra, por cita, el veredicto, el fragmento de evidencia, la URL real de CourtListener, el modelo y la versión (o determinista, o abstención), la versión del verificador, una marca de tiempo UTC y el resultado de la compuerta.

Un escrito, todos los caminos, trabajado de extremo a extremo

La demostración incluye cuatro escritos de muestra. Recorremos dos: el escrito Mixed Motion, que lleva a la vez una cita real, una cita fabricada y una cita fuera del corpus, y el escrito Clean Motion, en el que cada cita es real. Cada imagen de abajo es una captura de la aplicación en ejecución. El encabezado del asunto es ilustrativo, no un caso real.

El pipeline se ejecuta en vivo frente a jurisprudencia real

A la izquierda hay una moción de exclusión redactada por IA. A la derecha, la consola de sistema se ilumina etapa por etapa y transmite cada solicitud real a CourtListener con su URL, estado y latencia, junto con el razonamiento de la comprobación de respaldo. Esta es la primera cita, Miranda v. Arizona, 384 U.S. 436, que se resuelve contra el corpus de verdad fundamental mientras la comprobación de respaldo lee el texto de la opinión.

El panel de CiteGuard: un escrito redactado por IA a la izquierda y una consola de sistema a la derecha que muestra las etapas de extracción, anclaje, comprobación de respaldo, compuerta y certificado, con un rastreo en vivo de las solicitudes a CourtListener.
El pipeline en vivo: extraer, anclar en jurisprudencia real, comprobación de respaldo, compuerta, certificado, con el rastreo de CourtListener transmitiéndose debajo.

Un caso fabricado, detectado con certeza

El escrito cita Halstead v. Ferngate Holdings, 823 U.S. 1199. La comprobación de existencia envía un GET en vivo a CourtListener y obtiene 200 con 0 resultados, porque U.S. Reports no tiene el volumen 823. El veredicto es FABRICATED, ausencia demostrada en lugar de adivinada. En la misma ejecución, Brown v. Board of Education, 347 U.S. 483 es un caso real que no está en el subconjunto en caché, así que se marca con honestidad OUTSIDE_COVERAGE en lugar de un verificado falso. La compuerta lee NOT_FILING_READY: 1 fabricada, 2 sin resolver, 1 despejada automáticamente.

El marcador de verificación de CiteGuard para un escrito que muestra 1 Verificado, 1 Fabricado y 2 Requieren revisión, con Halstead v. Ferngate 823 U.S. 1199 marcado Fabricado y Brown v. Board of Education marcado Fuera de cobertura, y la compuerta leyendo No presentar.
Un escrito, todos los resultados: una cita real Verificada, Halstead 823 U.S. 1199 Fabricada en una consulta con cero resultados, Brown v. Board Fuera de cobertura, y el resto derivado a Requiere revisión.

Un caso real despejado en verde, sobre el propio fallo de la opinión

Este es el escrito Clean Motion, en el que cada cita es un caso real y pertinente. Cuando el texto de la opinión establece la proposición, la comprobación de respaldo lo confirma. Miranda v. Arizona, 384 U.S. 436 queda Verificado porque la propia mayoría sostiene que a un sospechoso se le debe informar del derecho a un abogado y a guardar silencio, con un enlace al caso real en CourtListener. Qué citas pertinentes concretas quedan en verde frente a las que se derivan a revisión puede variar de una ejecución a otra, porque la comprobación de respaldo es el único paso no determinista, pero una cita pertinente como Miranda queda en verde de forma fiable.

El rastreo en vivo de la comprobación de respaldo que extrae la opinión real de Miranda v. Arizona de CourtListener y cita su propio fallo sobre las advertencias en interrogatorios en custodia, marcando 384 U.S. 436 Verificado, mientras Terry v. Ohio se ancla a continuación.
La comprobación de respaldo lee la opinión real y cita el propio fallo de la mayoría, de modo que Miranda 384 U.S. 436 queda Verificado, anclado en texto real con un enlace a la fuente.

Deriva a un humano en lugar de farolear un veredicto

En la revisión del Mixed Motion, el marcador lee 1 Verificado, 1 Fabricado y 2 Requieren revisión. Bell Atlantic Corp. v. Twombly, 550 U.S. 544 es un caso real, pero el extracto no establece de forma inequívoca la proposición para la que se ofrece, así que la comprobación de respaldo lo marca Requiere revisión con su razonamiento en lugar de calificarlo con confianza. Esa abstención conservadora es el diseño: un veredicto rojo Unsupported emitido con confianza es raro a propósito, porque la decisión honesta ante una opinión ambigua es entregársela a un humano.

Un escrito de precedente mal aplicado en el que Erie Railroad v. Tompkins y Celotex Corp. v. Catrett son casos reales citados para la proposición equivocada; el rastreo muestra a la comprobación de respaldo leyendo cada opinión real, comprobando que el punto no está establecido y derivándolos a Requiere revisión.
Casos reales citados para la proposición equivocada: la comprobación de respaldo lee la opinión, ve que el punto no está establecido y los deriva a Requiere revisión en lugar de farolear. Una coincidencia por palabras clave no detectaría esto.

Incluso un escrito limpio se retiene hasta que cada cita se resuelve

Este es el certificado de ese mismo escrito Clean Motion. Miranda quedó Verificado, pero Terry v. Ohio y Strickland v. Washington se derivaron a revisión, así que la compuerta se mantiene en No listo para presentar y el sello lee Retener para revisión, aunque no hay ni una sola cita fabricada. El certificado lista cada cita con su veredicto y el resultado de la comprobación de respaldo y certifica que cada una se comprobó por existencia frente a CourtListener, que las citas fabricadas se identifican con certeza y que las citas que requieren juicio contextual se derivan a un humano. Se exporta como un registro JSON firmado que usted adjunta a la presentación. Un escrito de aspecto limpio no es lo mismo que uno listo para presentar.

El Certificado de verificación de citas para el asunto Hartwell Capital Partners, marcado No listo para presentar, que lista tres citas con veredictos Verificado y Requiere revisión y un sello de Retener para revisión.
El certificado firmado, marcado No listo para presentar con un sello de Retener para revisión, porque las citas aún requieren juicio humano.

Anclado en una autoridad independiente

El corpus son 20 decisiones reales en caché desde CourtListener, la base de datos pública de jurisprudencia de EE. UU., incluidas Miranda, Twombly, Iqbal, Terry, Strickland, International Shoe, Erie, Baker v. Carr, Chevron y Daubert. Las comprobaciones de existencia y fabricación también consultan CourtListener en vivo en el momento de la solicitud, por eso la detección de fabricación es autoritativa y no se limita al subconjunto. El corpus de 20 casos es un subconjunto en caché, así que la adjudicación de respaldo se demuestra a N pequeño sobre casos reales, y ese alcance se declara con claridad en lugar de disfrazarse de precisión universal.

El panel Corpus de verdad fundamental que lista 20 casos reales curados desde CourtListener, incluidos Strickland v. Washington, Ashcroft v. Iqbal, Terry v. Ohio, Whitman v. American Trucking y Chevron, cada uno con su cita y una opinión en caché.
El corpus de verdad fundamental de 20 casos, en caché desde CourtListener, con consultas en vivo en el momento de la solicitud para existencia y fabricación.

Salida de IA no verificada frente a CiteGuard

CiteGuard no es otro redactor. Es la capa que decide qué es seguro presentar.

Dimensión Escrito de IA no verificado Capa de verificación CiteGuard
Detección de casos fabricados Se lee como autoritativo, sin detectar Determinista, consulta en vivo con cero resultados
Cita real pero mal aplicada Se envía intacta Derivada a revisión humana con contexto
Comprobación de respaldo incierta El modelo afirma un veredicto de todos modos Se abstiene, lo entrega a un humano
Procedencia Ninguna Un enlace real de CourtListener por cita
Decisión de presentación La confianza del redactor Una compuerta determinista, cero fabricadas y cero sin resolver
Rastro de auditoría para el Dictamen 512 de la ABA Ninguna Certificado JSON firmado por cada escrito

Lo que esta demostración no hace

  • ✓ No hace investigación jurídica ni redacción, y no compite con Harvey, Westlaw o Lexis. Es una capa de verificación que se sitúa alrededor de cualquier modelo que haya producido el escrito.
  • ✓ No reclama un juicio de IA perfecto sobre el respaldo. La comprobación de respaldo está asistida por LLM con abstención, es no determinista y deriva los casos inciertos a un humano por diseño. No marca automáticamente en rojo Unsupported cada cita mal aplicada; un veredicto rojo emitido con confianza es raro a propósito.
  • ✓ No trata un escrito de aspecto limpio como listo para presentar. Solo la fabricación y la existencia son garantías deterministas. Las 8 de 8 pruebas y el corpus de 20 casos son el alcance de la demostración construida, no una afirmación de precisión de mundo abierto.
  • ✓ No presenta los escritos de muestra, los casos ni el encabezado del asunto como clientes o asuntos reales. Están etiquetados como extractos sintéticos. Las citas fabricadas están genuinamente ausentes de la jurisprudencia real.
  • ✓ No usa un conector de gestión documental en vivo. El conector de iManage o NetDocuments es un simulacro, el anclaje por defecto usa el fragmento público de la opinión mayoritaria (el texto completo de la opinión necesita un token gratuito de CourtListener), y un certificado PDF, las comprobaciones de tratamiento negativo y GraphRAG quedan aplazados.
  • ✓ No aporta clientes, casos de estudio, testimonios ni cifras de ROI. Aún no existen. Esta es una demostración que prueba el mecanismo, no un despliegue.

Preguntas que los abogados realmente hacen

¿Esto sustituye a Harvey, Westlaw o Lexis?

No. CiteGuard no redacta ni hace investigación jurídica, así que no compite con Harvey, Westlaw Precision o Lexis Protege. Es la capa de verificación que se sitúa alrededor de lo que cualquiera de ellos haya producido. Toma el escrito redactado por IA, indica al abogado qué es seguro presentar y exactamente qué necesita a un humano, y se ejecuta en modo sombra o asesor junto a la herramienta que ya usa.

¿Cómo sabe que una cita está fabricada y no simplemente ausente?

La comprobación de existencia consulta CourtListener, la base de datos pública de jurisprudencia de EE. UU., para la cita exacta. Una cita fabricada como Halstead v. Ferngate Holdings, 823 U.S. 1199 devuelve cero resultados (U.S. Reports no tiene el volumen 823), así que se marca FABRICATED con certeza, no se adivina. Si CourtListener es inalcanzable, la cita se marca UNVERIFIED en lugar de fabricada, porque la ausencia de prueba no es prueba de ausencia. Esa distinción es un invariante determinista, cubierto por pruebas unitarias.

¿Puedo confiar en que la IA juzgue si un caso realmente respalda mi argumento?

No a ciegas, y por eso la comprobación de respaldo se abstiene. Es un solo paso de LLM que lee la opinión real y confirma una cita en verde solo cuando el texto de la opinión establece el fallo, como ocurre con Miranda v. Arizona. Cuando la opinión no respalda de forma inequívoca la proposición enunciada, deriva la cita a revisión humana en lugar de farolear un veredicto. El modelo aconseja; la compuerta determinista y el abogado deciden.

¿Un modelo de IA mejor hará que esto sea innecesario?

No, porque listo para presentar es una propiedad de gobernanza, no una propiedad del modelo. Un tribunal no se preocupa de cuánta confianza tenía el modelo; le importa si la cita existe y dice lo que usted afirmó. Así que la necesidad duradera es una capa independiente que ancla cada afirmación en jurisprudencia real, detecta la fabricación con certeza y es honesta sobre lo que no puede verificar. Ese requisito se sostiene con cualquier calidad de modelo.

¿Qué demuestra realmente el certificado de auditoría para el Dictamen 512 de la ABA y las órdenes permanentes?

Un clic exporta un certificado JSON firmado que registra, por cita, el veredicto, el fragmento de evidencia, la URL real de CourtListener, el modelo y la versión (o determinista o abstención), la versión del verificador, una marca de tiempo UTC y el resultado de la compuerta. Es el artefacto que muestra que un abogado verificó la salida de IA antes de presentar, que es lo que ahora exigen el Dictamen formal 512 de la ABA y más de 300 órdenes permanentes judiciales. En la demostración el certificado es JSON; una exportación a PDF queda aplazada.

¿Es esto un producto en vivo o una demostración, y qué hay de real en ella?

Es una demostración ejecutable que prueba el mecanismo, no un pipeline desplegado. Los cuatro escritos de muestra, las partes y el encabezado del asunto están etiquetados como extractos sintéticos, y el conector de gestión documental es un simulacro. Lo que es real: el corpus de 20 casos está en caché desde CourtListener, las comprobaciones de existencia y fabricación consultan CourtListener en vivo en el momento de la solicitud, la compuerta determinista y las 8 de 8 pruebas unitarias se ejecutan exactamente como se muestra, y las citas fabricadas están genuinamente ausentes de la jurisprudencia real.

Investigación técnica

La investigación detrás de esta demostración: la arquitectura, el diseño de verificación y el modelo de referencia empresarial.

¿Va a poner trabajo redactado por IA ante un tribunal?

La capa de verificación es la parte difícil. Nosotros la construimos.

Si su bufete está resolviendo cómo dejar que los abogados usen IA sin arriesgar una cita fabricada en una presentación, nos gustaría de verdad escuchar cómo lo están pensando. El problema es de todo el sector y las respuestas también lo serán.

Evaluación de verificación

  • ✓ Mapear dónde su flujo de IA puede presentar una cita no verificada
  • ✓ Definir las reglas de existencia, anclaje y respaldo para su jurisprudencia
  • ✓ Diseñar el enrutamiento a revisión humana y los umbrales de abstención
  • ✓ Especificar el certificado de auditoría que necesitan sus obligaciones del Dictamen 512 de la ABA

Construir la capa

  • ✓ Un verificador determinista sobre sus fuentes reales de jurisprudencia
  • ✓ Una comprobación de respaldo que se abstiene en lugar de farolear
  • ✓ Una compuerta de política y un certificado de auditoría firmado por cada presentación
  • ✓ Intercambiable entre modelos, ejecutándose en modo sombra alrededor de su IA jurídica
Redes sociales

También publicado en