La gouvernance qui survit au contact d’un système réel
La plupart des politiques internes sur l’IA partagent le même défaut : elles ont été écrites avant que quiconque ait déployé quoi que ce soit, à partir de risques imaginés plutôt qu’observés. Elles interdisent des usages que personne n’envisageait, laissent hors de leur champ ceux qui tournent déjà, et se règlent par des validations humaines systématiques qui rendent tout système trop lent pour être utilisé. Une gouvernance qui tient fait l’inverse. Elle part de l’inventaire de ce qui existe réellement, y compris les usages informels que des équipes ont mis en place sans prévenir. Elle classe ces usages par le coût d’une erreur et par le délai avant qu’on s’en aperçoive, ces deux questions étant les seules qui décident du niveau de surveillance nécessaire. Et elle désigne une personne, avec un nom, un pouvoir d’arbitrage et un accès aux équipes techniques. Tout le reste est de la documentation, utile le jour d’un audit et sans effet sur ce qui se passe le reste du temps.
Commencer par l’inventaire, pas par la politique
Dans à peu près toute organisation d’une certaine taille, des systèmes fondés sur des modèles tournent déjà, mis en place par des équipes qui n’ont demandé l’avis de personne parce qu’aucun processus ne les y obligeait. Ce n’est pas une faute, c’est la conséquence normale d’un outil accessible par abonnement.
L’inventaire consiste à retrouver ces usages, sans esprit de sanction, parce qu’une recherche perçue comme une enquête ne remonte rien. Ce qu’on cherche est simple : quelles données entrent, quelle décision sort, qui s’en sert, et ce qui se passerait si la sortie était fausse.
Ce travail change souvent la politique qu’on s’apprêtait à écrire. Une organisation qui découvre que son usage le plus répandu est la reformulation de courriers ne rédigera pas les mêmes règles qu’une organisation dont un système classe des dossiers de crédit.
Classer par le coût de l’erreur, pas par la technologie
Les classements par technologie vieillissent en un an et n’aident personne à décider. Un classement utile repose sur deux questions dont les réponses sont stables.
Combien coûte une sortie fausse, en euros, en risque juridique ou en confiance perdue. Et surtout, par quel moyen s’en apercevrait-on. Une erreur détectée dans l’heure par la personne qui reçoit le résultat appelle une surveillance légère. Une erreur qui n’apparaît qu’au contrôle annuel appelle l’inverse, quelle que soit sa probabilité.
Cette grille à deux entrées suffit à répartir les usages en trois niveaux, et trois niveaux suffisent. Les classifications à sept catégories existent et personne ne s’en sert, parce qu’au moment de décider, un responsable veut savoir s’il faut une relecture, un journal, ou les deux.
Les règles qui tiennent
Une trace de ce qui a été décidé. Quelle version du modèle, quelles consignes, quel jeu d’évaluation, quel résultat obtenu, et qui a validé. C’est peu coûteux pendant le projet et impossible à reconstituer après.
Un jeu d’évaluation maintenu. Sans lui, une organisation apprend les régressions par les plaintes de ses utilisateurs, plusieurs semaines après un changement de version chez un fournisseur. C’est l’exigence de gouvernance la plus concrète et la plus souvent oubliée, parce qu’elle ressemble à de la technique et relève en réalité du contrôle.
Une frontière écrite sur les données. Ce qui peut sortir de l’organisation et vers quel fournisseur, formulé en catégories de données plutôt qu’en noms d’outils. Les outils changent tous les six mois, les catégories de données non.
Un chemin d’escalade nommé. À qui s’adresse une personne qui trouve une sortie aberrante, et sous quel délai obtient-elle une réponse. Sans cela, les utilisateurs cessent simplement d’utiliser le système, et personne n’apprend jamais pourquoi.
Les règles qui ne tiennent pas
La validation humaine systématique, appliquée à tout. Elle est rassurante à écrire et elle produit deux effets connus : soit elle rend le système plus lent que le travail manuel et il est abandonné, soit les relectures deviennent formelles au bout de trois semaines et la garantie n’existe plus que sur le papier.
L’interdiction générale d’une catégorie d’outils. Elle déplace l’usage hors du champ de l’organisation plutôt qu’elle ne le supprime, ce qui aggrave exactement le risque qu’elle prétend traiter.
Et l’exigence d’explicabilité formulée sans destinataire. Expliquer une sortie à un utilisateur, à un client ou à un régulateur ne demande pas la même chose, et une règle qui ne précise pas lequel des trois est visé ne sera satisfaite par aucune implémentation.
Un problème, trente minutes
Décrivez une tâche qui prend trop de temps aujourd’hui, exceptions comprises. Nous vous dirons si elle vaut la peine d’être construite, et nous le dirons franchement quand ce n’est pas le cas.
A first conversation is thirty minutes and is not a sales call. If the answer is that you do not need us, that is a useful outcome and we will say so.