Modelos de lenguaje de gran tamaño en el control de la contratación pública: qué detectan y qué se sabe sobre los resultados. La experiencia de Brasil, Corea, Chile, Colombia y la Unión Europea
Descargar el informe
Resumen
Los organismos públicos de Brasil, la República de Corea, Chile, Colombia y la Unión Europea han empezado a aplicar modelos de lenguaje de gran tamaño al control de la contratación pública. El estudio examina qué herramientas basadas en modelos de lenguaje aplican esos organismos, qué verifican, qué mecanismos de distorsión del procedimiento competitivo son capaces de detectar y qué se ha publicado sobre los resultados de su funcionamiento.
Datos y método. El estudio se apoya en los documentos de los organismos que aplican las herramientas: resoluciones y artículos técnicos del Tribunal de Cuentas de la Unión de Brasil y de los tribunales de cuentas de los estados, comunicados de prensa y documentación de concurso del Servicio de Contratación Pública de Corea, publicaciones de ChileCompra y el registro de adjudicación en Mercado Público, la directiva de la Autoridad Nacional Anticorrupción de Italia y los informes de la Comisión Europea y de la Oficina Europea de Lucha contra el Fraude. Para cada herramienta se completó una ficha de seis campos; las funciones de las herramientas se cotejaron con los 30 mecanismos de la tipología del CILC según tres valores (detecta directamente, detecta indirectamente, no detecta); los resultados se calcularon a partir de las cifras publicadas, con indicación del denominador.
Resultados principales. A octubre de 2026, en ninguna de las cinco jurisdicciones los modelos de lenguaje se han convertido en la herramienta principal de control. El inventario cuenta seis sistemas en los que la aplicación de un modelo de lenguaje está confirmada por documentos del propio organismo y dos proyectos anunciados cuya tecnología o función de contratación no está confirmada; de los seis sistemas confirmados, dos se encuentran en operación, y solo respecto de uno el organismo ha publicado una resolución con resultados. Se trata de Alice 360 del Tribunal de Cuentas de la Unión de Brasil, donde el modelo resuelve una tarea preparatoria, el reconocimiento del objeto de la contratación a partir de descripciones imprecisas, tras lo cual los precios se comparan con métodos estadísticos. Las dos herramientas en operación cubren cinco de los 30 mecanismos de la tipología; si se cuentan los sistemas en construcción de Corea, Chile y el distrito de Seocho, la cobertura potencial alcanza 10 mecanismos en cinco de las diez etapas del ciclo de contratación. Ninguna herramienta en operación verifica la presentación de ofertas, su evaluación, la impugnación, la ejecución ni el pago, y el grupo de mecanismos «neutralización del control» queda fuera de su campo de visión. El límite de visibilidad del modelo de lenguaje coincide con el límite de visibilidad del participante externo en la tipología.
Conclusiones. Ningún organismo publica la proporción de alertas fundadas por función del modelo de lenguaje; las únicas proporciones publicadas corresponden a herramientas sin modelo de lenguaje y van del 3,4 al 23,5 %. Los indicios que buscan las herramientas arrojan cuatro candidatos a nuevos mecanismos de la tipología. Para monitorear la calidad del modelo de lenguaje y de su aplicación, el organismo debe recopilar al menos cuatro magnitudes por cada función: alertas emitidas, alertas verificadas por una persona, alertas confirmadas y alertas que dieron lugar a medidas. Sin esos datos, la eficacia del modelo de lenguaje es indistinguible de la eficacia de las reglas a las que se ha añadido.
El registro contiene el informe en inglés, español y ruso.
Cita recomendada
Limarau, D., Krukovskiy, I. (2026). Modelos de lenguaje de gran tamaño en el control de la contratación pública: qué detectan y qué se sabe sobre los resultados. Report. Consejo Internacional para la Lucha contra la Corrupción. DOI 10.5281/zenodo.23241236. https://cilclegal.org/
El texto original de la obra está en inglés.
Todas las publicaciones