Los jueces colombianos dejan de lado el porcentaje de los detectores de inteligencia artificial y deciden con lo que pueden comprobar en el expediente
En nueve procesos colombianos con providencias dictadas entre el 30 de enero y el 3 de agosto de 2026 apareció un porcentaje o una probabilidad de texto atribuido a la inteligencia artificial. En ocho lo llevó una parte y en uno lo calculó la propia Corte Suprema de Justicia. En seis apuntaba contra una decisión judicial, en dos contra los escritos de quien litigaba y en uno contra los actos que resolvieron los recursos de un concurso de la carrera judicial. Las cifras iban del 80 al 100 por ciento, y los detectores a los que se atribuyen son siete: Copyleaks, Justdone, Originality.ai, Scribbr, Sidekicker, Turnitin y Winston AI. En octubre de 2025, además, la sentencia de un tribunal llevó en una nota al pie la leyenda de uno de ellos.
La Sala de Casación Penal de la Corte Suprema es, en estas providencias, la única que sometió a detectores el escrito de una parte. Concluyó en febrero, con base en el porcentaje, que una demanda de casación se había producido con inteligencia artificial, y la inadmitió por su falta de técnica. Las providencias posteriores decidieron con otros elementos. En ninguna de las seis decisiones judiciales atacadas fue el porcentaje la razón de lo decidido, y las que razonaron sobre estos programas, junto con tres que lo hicieron sin que nadie les llevara uno, muestran una tendencia: el porcentaje de un detector, por sí solo, no establece quién redactó un texto ni cómo se usó la herramienta, y los despachos deciden con lo que el expediente permite comprobar. Esa tendencia protege el uso legítimo de la herramienta, que dos salas de la Corte Suprema reconocieron en la ayuda de ortografía, redacción y estilo, y centra la discusión en si alguien revisó lo que la herramienta produjo.
Los jueces respondieron con otras razones a los seis ataques con un porcentaje contra decisiones judiciales
El primero de esos casos llegó al Tribunal Administrativo de Bolívar. Una entidad pública que era parte en una acción de cumplimiento pidió anular la sentencia de primera instancia porque, según cuatro detectores, su motivación tenía índices de generación por inteligencia artificial superiores al 90 por ciento. El 3 de febrero de 2026 el Tribunal revocó esa sentencia por otra razón, la improcedencia del medio de control, y se abstuvo de estudiar la nulidad por innecesaria.
En marzo, dos despachos se pronunciaron sobre el argumento del porcentaje. Al conceder una apelación que tachaba una sentencia de no serlo por haberse elaborado en un 89 por ciento con inteligencia artificial (el auto no dice de dónde salió la cifra), el despacho ponente de la Sección Primera, Subsección A, del Tribunal Administrativo de Cundinamarca precisó que, "independientemente de si en la elaboración de la sentencia apelada se empleó o no IA", su utilización dentro del marco vigente "es legalmente válida y no vulnera derecho alguno". Recordó también que los magistrados de la Sala, "previa lectura, desde el día anterior a la convocatoria, y análisis aprobaron el texto en su integridad". Ordenó remitir el expediente al Consejo de Estado para que conozca del recurso.
Tres días después, el Juzgado Tercero de Pequeñas Causas y Competencia Múltiple de Cartagena declaró improcedente un recurso que le atribuía a la herramienta el 82 por ciento de un auto, según Justdone. Para el juzgado, el resultado de ese programa "carece de relevancia jurídica y procesal", porque no acredita con certeza el uso de la herramienta, y el recurso tampoco decía cuál habría sido el mal uso ni qué derecho resultó afectado. Distinguió la inteligencia artificial generativa, para la que el Acuerdo PCSJA24-12243 fija reglas, de las herramientas integradas en el paquete de oficina que la Rama Judicial entrega a sus despachos, que calificó como "No de IA generativa" y que ayudan a redactar y organizar un texto, y advirtió que "no es lo mismo usar una herramienta de IA para colocar mejor una coma o un punto" que redactar un texto desde cero sin verificación humana. Le pidió además a Copilot, la herramienta que provee el Consejo Superior de la Judicatura, que revisara si el auto atacado se había generado con inteligencia artificial, reprodujo su respuesta en capturas de pantalla y con ella dio por demostrado que no había certeza del uso de la herramienta generativa en el auto. Esa respuesta es, a su vez, la lectura de otro programa sobre el mismo texto, y la improcedencia se declaró "por carecer de la debida carga argumentativa para entrar a debatir el contenido del auto recurrido".
En mayo, la Sala Civil Familia del Tribunal Superior de Antioquia negó en primera instancia dos tutelas contra sentencias de segunda instancia de un juzgado promiscuo del circuito de Antioquia, cuyas demandas sostenían que un programa detector les atribuía a esos fallos el 80 y el 100 por ciento de inteligencia artificial (sentencias de tutela 086 y 087 del 13 de mayo de 2026, rads. 2026-00184 y 2026-00185). Las sentencias de tutela no mencionan el porcentaje. Encontraron razonable cada fallo atacado, porque "obedece a una labor intelectiva realizada dentro del ámbito de su competencia y se atisba razonable".
Al resolver en agosto la súplica de una parte que sostenía que un auto de la magistrada sustanciadora no existía porque dos detectores le daban 89 y 85 por ciento, la Sala de Casación Civil de la Corte Suprema respondió ese punto, en el AC5001-2026, con el artículo 279 del Código General del Proceso: el auto expresó sus motivos, llevó el nombre de la corporación, el lugar y la fecha, y "culminó con la firma de la magistrada ponente". Confirmó el auto, que había rechazado una demanda de revisión por no ajustarse a las causales invocadas.
La Sala Penal de la Corte Suprema usó dos detectores en febrero, y en marzo anotó que buscan rasgos propios de la escritura judicial
El 11 de febrero de 2026, en el AP760-2026, ante la "fundada sospecha" de que una demanda de casación no la había confeccionado el abogado, "la Corte sometió el texto a la herramienta Winston AI", que le dio "únicamente un 7% de contenido humano", lo que a juicio de la Sala "permite concluir que fue producido mediante inteligencia artificial", y a Copyleaks, que le dio un 100 por ciento de probabilidad de generación artificial. En sus notas al pie les atribuyó a los dos programas niveles de precisión del 99,98 y del 99 por ciento. La demanda se inadmitió por su falta de técnica: sus enunciados, dijo la Sala, "estaban desprovistos de todo rigor casacional".
Cinco semanas después, en el AP1902-2026, la misma Sala resolvió sobre una demanda cuyo autor había escrito que la hizo "con apoyo en (sic) la herramienta de la inteligencia artificial". La Sala tuvo esa declaración y la ratificó con rasgos del propio escrito: críticas replicadas sin desarrollo, ninguna referencia al nombre del procesado, de la víctima o de los testigos y cargos por modalidades de falso juicio ajenas a la clasificación tradicional, como un "falso juicio de certeza". Mencionó la verificación tecnológica del AP760 como otra vía para establecer el uso e insistió, "al margen de la fiabilidad y falibilidad de estos mecanismos de verificación de IA o potenciales críticas por su carácter aún intuitivo", en el deber de comprobar lo que se lleva al proceso. Anotó que entre lo que esos mecanismos revisan está "la reproducción literal de providencias anteriores, el uso de ciertas palabras, inclusive la utilización de una óptima redacción", y en una nota al pie advirtió que esos son "Rasgos característicos de antaño en la jurisprudencia y las decisiones de los jueces, en especial tratándose de respuestas judiciales estandarizadas". La advertencia explica por qué un detector puede señalar como generada la escritura estandarizada de los despachos.
Dos salas de la Corte Suprema explicaron el porcentaje con la ayuda de ortografía y redacción, que está permitida
El caso llegó a la Corte Suprema como tutela. Los accionantes, entre ellos el condenado, sostenían que la estudiante de consultorio jurídico que lo defendió había hecho los alegatos de conclusión y la apelación con inteligencia artificial, porque unas aplicaciones de detección mostraron "un porcentaje considerable". La Sala de Decisión de Tutelas n.º 2 de la Sala de Casación Penal encontró improcedente la tutela por no haberse agotado la casación, y al examinar si había un perjuicio irremediable revisó la grabación del juicio y el escrito de apelación. Concluyó el 24 de febrero de 2026 que "Los resultados de detección de IA muy probablemente se dan con ocasión de la ayuda mecánica de corrección de ortografía, redacción, estilo o consulta de normas, lo cual no desborda el uso permitido de la tecnología en el ámbito judicial". Lo prohibido, precisó con los artículos 3.6 y 8.3 del Acuerdo PCSJA24-12243, "es que la IA supla la valoración probatoria o la toma de decisiones judiciales", y extendió esa regla a los argumentos de las partes.
La Sala de Casación Civil confirmó ese fallo el 17 de junio de 2026, en la STC10581-2026, porque el condenado no había agotado la casación y porque la censura era infundada. Según su resumen de la demanda, las aplicaciones habían arrojado "coincidencias superiores al 85%". Encontró en la apelación "un escrito breve y ordenado", sin un despliegue argumentativo anormal, y dijo que los porcentajes "encuentran explicación plausible en el apoyo instrumental para labores de corrección ortográfica, redacción o estilo, empleo que no se halla proscrito".
La misma Sala de Tutelas n.º 2 había examinado el otro lado de la línea menos de tres meses antes. En la STP21973-2025, del 2 de diciembre de 2025, revisó el borrador de una sentencia condenatoria que la defensa había hallado en el expediente digital y encontró en él un análisis del testimonio de la víctima que empezaba "Gracias por compartir el testimonio". Sustentó la inferencia de que se había hecho con la herramienta "en el lenguaje, la estructura y el contenido del texto", y advirtió que ese análisis desbordaba los usos permitidos, porque la herramienta hacía la valoración de la prueba. Concedió el amparo por la imparcialidad del juez y exhortó al juzgado a que, si acude a la herramienta, lo haga con estricta sujeción al Acuerdo. Los dos casos se separaron por lo que decía el texto.
Un despacho del Consejo de Estado se abstuvo de usar detectores y explicó por qué no son fiables en un proceso judicial
El 26 de mayo de 2026, un despacho de la Sección Tercera del Consejo de Estado rechazó un recurso extraordinario de unificación que se apoyaba en cuatro sentencias que no existen tal como se citaron. Después explicó que pudo pasar el escrito por un detector y decidió no hacerlo, porque esos programas, "hasta el momento, no ofrecen niveles adecuados de fiabilidad, precisión y estabilidad para su utilización en actuaciones judiciales". Sus razones son de cuatro órdenes. Se eluden con facilidad, porque reescribir el texto varias veces reduce las tasas de detección "hasta niveles cercanos al azar" y cambios mínimos bastan para que lo generado pase por humano. Tienden a penalizar ciertos rasgos de estilo y la simplicidad del lenguaje, lo que "afecta de manera desproporcionada a quienes no tienen el inglés como lengua materna o presentan alguna discapacidad", porque muchos miden la perplejidad, el grado de predictibilidad de cada palabra. La distinción se vuelve más difícil, y en algunos casos inviable, a medida que los modelos escriben más parecido a las personas. Y son inestables y opacos, porque "una misma herramienta puede arrojar resultados distintos respecto de un mismo texto en momentos diferentes" y la mayoría ofrece "únicamente una probabilidad sin suministrar evidencia o justificación verificable que permita controvertir el resultado".
La advertencia coincide con lo que las instituciones invitadas a rendir concepto le dijeron a la Corte Constitucional en el proceso de la T-008 de 2026. Allí, aspirantes de un concurso de la carrera judicial llevaban el rastro de una instrucción que había quedado en la respuesta a una de las preguntas y, a partir de él, porcentajes de entre 86 y 93 por ciento contra los actos que resolvieron sus recursos. Esas instituciones advirtieron, en palabras que la sentencia transcribe, que "Los detectores operan sobre el texto observable y no sobre el proceso de producción" y que "La determinación responsable requiere evidencias de proceso: historial de versiones, borradores intermedios, prompts, metadatos de edición, registros de control de versiones o cuadernos de trabajo". La Corte declaró improcedentes las tutelas y dejó ese debate al juez administrativo.
Las decisiones sobre un uso sin control se apoyaron en lo que se puede comprobar: citas que no existen y escritos que no corresponden al caso
La Sala Penal del Tribunal Superior de Bogotá anuló el 3 de junio de 2026 la actuación desde el traslado de una sentencia condenatoria, para que el procesado tuviera una apelación real, porque la que presentó su defensa hablaba de otro delito y de otra fecha y no se refería a ninguna de las pruebas. Prescindió de los detectores e infirió el uso de la herramienta a partir de rasgos del escrito que, dijo, "no constituyen, por sí solos, una prueba concluyente del uso de inteligencia artificial generativa", pero valen como indicios cuando concurren con inconsistencias sustanciales. La nulidad descansó en esas inconsistencias, porque el escrito "no guardó correspondencia con la sentencia recurrida, los hechos juzgados, los delitos objeto de condena ni las pruebas practicadas en juicio". Y dejó escrita la frase que ordena lo demás: "La afectación advertida no deriva del eventual uso de inteligencia artificial en sí mismo, pues, como se indicó, tal herramienta no está prohibida y puede ser útil en la actividad jurídica". Lo relevante, siguió, "es la ausencia de control, verificación y adecuación profesional del escrito presentado".
La nulidad que la Sala Penal del mismo Tribunal decretó en diciembre de 2025 contra una sentencia condenatoria descansó en fuentes que no existen y en la conclusión de que el análisis de la prueba se había delegado en la herramienta. Es la decisión que invocó la entidad que pidió la nulidad ante el Tribunal Administrativo de Bolívar. Y el recurso que rechazó el despacho del Consejo de Estado cayó por las sentencias que no existen, sin necesidad de establecer quién o qué las escribió. Las huellas literales se comprueban leyendo: el "Gracias por compartir el testimonio" del borrador y la instrucción que quedó en los actos del concurso. Los rasgos de estilo, como el vocabulario limitado o el ritmo uniforme, son indicios que el propio Tribunal de Bogotá declaró insuficientes por sí solos.
Sin porcentaje, la sola sospecha tampoco alcanza. La Sección Cuarta del Consejo de Estado resolvió en abril de 2026 que "la sola afirmación" de una tutelante sobre el uso de la herramienta en la respuesta a su petición no permitía concluir la vulneración de derecho alguno, y la Sala Penal del Tribunal Superior de Valledupar concluyó en marzo que, con el material del expediente, "no es posible determinar de manera objetiva" si un fallo de tutela se redactó con ella.
La nota de transparencia responde por escrito lo que el detector intenta adivinar
El despacho de la Sección Tercera del Consejo de Estado que se negó a usar detectores declaró en el mismo auto el uso de una herramienta generativa, y dijo cómo. Una nota al pie cuenta que un cuadro "fue elaborado por Claude, herramienta de inteligencia artificial generativa basada en modelos de lenguaje", que antes el despacho consultó directamente las providencias y extrajo la información, que los datos enviados eran públicos, cuál fue la instrucción y que, al obtener la imagen, "se corroboró que los datos allí plasmados coincidieran con la información que fue extraída tras el análisis de las providencias". Con una nota así, la pregunta que el detector intenta responder queda contestada en el propio texto.
La leyenda de un detector llegó también a una sentencia. La primera nota al pie de la sentencia 174 del 27 de octubre de 2025 del Tribunal Administrativo de Caldas trae, después de la advertencia sobre los resaltados, la leyenda "No AI Content Found", el nombre del detector Copyleaks y el enlace a su página, sin decir qué texto se analizó. Una leyenda así vale con los límites que el despacho del Consejo de Estado describió para los detectores en general, entre ellos que se eluden con facilidad. La nota de transparencia, en cambio, dice qué hizo la herramienta.
La nota también da a las partes un hecho cierto para discutir. La demanda de una de las tutelas de Antioquia sostuvo que el uso de la herramienta quedaba "evidenciado en el primer folio de la decisión". En ese folio, una nota al pie puesta en el título de los antecedentes identificaba ese aparte como "desarrollado con asistencia de Copilot de Microsoft", y el Tribunal resolvió sobre la razonabilidad del fallo sin ocuparse del punto.
Para los despachos judiciales, el Acuerdo PCSJA24-12243 manda declarar el uso de la inteligencia artificial generativa. Su artículo 10 dispone que los servidores judiciales "deberán informar expresamente sobre el uso de sistemas de IA generativa para el apoyo de labores, tareas o actividades institucionales", y en la ayuda de redacción el alcance de ese deber se discute. Una aclaración de voto en la Sección Cuarta del Consejo de Estado sostuvo que la nota no se exige cuando Copilot se usa para una revisión ortográfica, gramatical y léxica, porque ese uso es el de las "herramientas colaborativas para la correcta edición del texto", distinto del de la inteligencia artificial generativa. La Comisión Nacional de Disciplina Judicial advirtió en agosto que la nota de una sentencia que declaraba ChatGPT para redacción y ortografía no atendía todos los requisitos del artículo 10, e instó a la comisión seccional y al magistrado que la dictaron a que, cuando usen estas herramientas, "se atengan expresamente a lo regulado en el mencionado acuerdo". Las instituciones que intervinieron en la T-008 señalaron, en la síntesis de la Corte, que "el medio más adecuado consiste en articular la buena fe del servidor para reportar el uso de IAgen con las políticas de las entidades en donde se establezca la obligación de declarar el uso de herramientas generativas".
De estas providencias sale una guía práctica. Quien quiera discutir un texto hecho con la herramienta tiene a la mano argumentos que se pueden comprobar: una cita que no existe, una prueba que no se valoró, un escrito que no corresponde al caso, la instrucción o la respuesta de la herramienta que quedaron en el texto. Quien la usa en un despacho judicial encuentra en el literal q del numeral 4.2 del Acuerdo PCSJA24-12243 la tarea de "Asistir en la corrección, mejora de la redacción y síntesis de textos de providencias o decisiones", entre los "Usos que requieren revisión detallada de los productos y resultados obtenidos", y en el numeral 3 de su artículo 8 el deber de "Prescindir de herramientas de IA para la valoración de medios probatorios, escrutinio de hechos, realización de juicios de valor, ni la solución de problemas jurídicos". Y quien litiga encuentra en la Corte Suprema el mismo criterio: la Sala Civil llamó a la ayuda de ortografía, redacción y estilo un "empleo que no se halla proscrito", y lo exigible es verificar lo que se presenta. El artículo La inteligencia artificial ya está en documentos de más de 190 despachos judiciales colombianos, y declararlo protege al juez desarrolla por qué la nota es la mejor protección del despacho.
Cobertura. Comprende las providencias del observatorio COLOMB-IA y de la biblioteca de la revista, y los documentos de tribunales y juzgados bajados del portal de Publicaciones Procesales de la Rama Judicial, con corte al 27 de septiembre de 2026. En el texto de esos documentos se buscaron los nombres de los detectores y las expresiones con que se los menciona, y en el buscador del portal se buscaron además esos nombres y esas expresiones, lo que trajo una providencia que la revista no tenía, la sentencia del Tribunal Administrativo de Caldas, que entró al observatorio. Las dos sentencias de tutela del Tribunal Superior de Antioquia no tienen ficha en el observatorio porque no se pronuncian sobre la herramienta, y se consultan por su radicado en ese portal. La de Caldas sí la tiene, porque deja en su propio texto la leyenda de un detector. Aparecieron además escritos de parte que llevan detectores contra la contraparte, con un 99 por ciento de Justdone en una acción popular y un reporte de ZeroGPT aportado como prueba en un proceso de responsabilidad civil, que no se cuentan porque el informe cuenta providencias. El portal busca por palabras y no por materia, de modo que puede haber providencias sobre detectores que no usan ninguno de esos nombres.