Les grands modèles de langage dans le contrôle de la commande publique : ce qu'ils détectent et ce que l'on sait de leurs résultats. L'expérience du Brésil, de la Corée, du Chili, de la Colombie et de l'Union européenne
Télécharger le rapport
Résumé
Les autorités publiques du Brésil, de la République de Corée, du Chili, de la Colombie et de l'Union européenne ont commencé à appliquer les grands modèles de langage au contrôle de la commande publique. L'étude examine quels outils fondés sur des modèles de langage ces autorités appliquent, ce que ces outils vérifient, quels mécanismes de distorsion d'une procédure concurrentielle ils sont capables de détecter et ce qui a été publié sur les résultats de leur fonctionnement.
Données et méthode. L'étude repose sur les documents des autorités qui appliquent les outils : décisions et articles techniques du Tribunal fédéral des comptes du Brésil et des cours des comptes des États, communiqués de presse et documents d'appel d'offres du Service des marchés publics de Corée, publications de ChileCompra et registre d'attribution dans Mercado Público, directive de l'Autorité nationale anticorruption italienne et rapports de la Commission européenne et de l'Office européen de lutte antifraude. Pour chaque outil, une fiche de six champs a été remplie ; les fonctions des outils ont été mises en regard des 30 mécanismes de la typologie du CILC selon trois valeurs (détecte directement, détecte indirectement, ne détecte pas) ; les résultats ont été calculés à partir des chiffres publiés, avec indication du dénominateur.
Principaux résultats. En octobre 2026, les modèles de langage ne sont devenus l'outil principal de contrôle dans aucune des cinq juridictions. L'inventaire compte six systèmes dans lesquels l'utilisation d'un modèle de langage est confirmée par les documents de l'autorité elle-même et deux projets annoncés dont la technologie ou la fonction de passation n'est pas confirmée ; sur les six systèmes confirmés, deux sont en service, et pour un seul l'autorité a publié une décision assortie de résultats. Il s'agit d'Alice 360 du Tribunal fédéral des comptes du Brésil, où le modèle accomplit une tâche préparatoire, la reconnaissance de l'objet du marché à partir de descriptions imprécises, après quoi les prix sont comparés par des méthodes statistiques. Les deux outils en service couvrent cinq des 30 mécanismes de la typologie ; en comptant les systèmes en construction en Corée, au Chili et dans l'arrondissement de Seocho, la couverture potentielle atteint 10 mécanismes à cinq des dix étapes du cycle de passation. Aucun outil en service ne vérifie le dépôt des offres, leur évaluation, le recours, l'exécution ni le paiement, et le groupe de mécanismes « neutralisation du contrôle » reste hors de leur champ de vision. La limite de visibilité du modèle de langage coïncide avec la limite de visibilité du participant externe dans la typologie.
Conclusions. Aucune autorité ne publie la part des alertes fondées par fonction du modèle de langage ; les seules parts publiées concernent des outils sans modèle de langage et vont de 3,4 à 23,5 %. Les signaux que recherchent les outils fournissent quatre candidats à de nouveaux mécanismes de la typologie. Pour suivre la qualité d'un modèle de langage et de son application, une autorité doit recueillir au moins quatre grandeurs pour chaque fonction : alertes émises, alertes examinées par une personne, alertes confirmées et alertes ayant donné lieu à des mesures. Sans ces données, l'efficacité du modèle de langage ne se distingue pas de celle des règles auxquelles il a été ajouté.
La notice contient le rapport en anglais, en espagnol et en russe.
Citation recommandée
Limarau, D., Krukovskiy, I. (2026). Large language models in the oversight of public procurement: what they detect and what is known about the results. Report. Consejo Internacional para la Lucha contra la Corrupción. DOI 10.5281/zenodo.23241236. https://cilclegal.org/
Le texte original de l'œuvre est en anglais.
Toutes les publications