En bref
Une simulation académique suggère qu’un risque de biais peut apparaître après l’évaluation initiale d’un LLM: plusieurs modèles y ont développé des stéréotypes à partir de feedbacks malgré des consignes d’équité. Le résultat ne prouve pas que le phénomène existe dans les produits RH réels, mais il invite à surveiller les systèmes qui évoluent avec leur usage.
Ce qui change
L’objet de l’audit s’élargit. Au lieu de rechercher seulement les biais présents avant déploiement, les entreprises doivent se demander si les feedbacks et mécanismes d’adaptation peuvent faire évoluer le comportement du système. Une évaluation ponctuelle peut être insuffisante lorsqu’un produit change avec l’usage.
Pourquoi ça compte
Les éditeurs et entreprises utilisatrices doivent pouvoir expliquer et contrôler le rôle des feedbacks dans les outils de recrutement. Cela renforce l’intérêt des évaluations continues, de la traçabilité et de la supervision avant d’étendre un LLM au tri, à l’évaluation ou à l’aide à la décision sur les candidats.
Qui est concerné
Les éditeurs de logiciels RH et de recrutement, les directions RH, les responsables IA, les équipes conformité et les entreprises qui utilisent ou évaluent des LLM pour le tri, l’évaluation ou l’aide à la décision sur des candidats.
Action à faire
- 1Identifier les outils de recrutement concernés et vérifier s’ils comportent des boucles de feedback ou des mécanismes d’adaptation.
- 2Demander aux fournisseurs comment les biais sont mesurés dans le temps et comment les feedbacks influencent le système.
- 3Tester régulièrement les écarts de traitement sur des scénarios contrôlés.
- 4Vérifier la traçabilité et la supervision disponibles avant d’élargir les usages décisionnels.
Risques et limites
Le signal provient d’une simulation utilisant des groupes fictifs et ne démontre pas que les mêmes dynamiques se produisent dans des recrutements réels. Le risque dépend du modèle, de l’architecture du produit et de l’utilisation effective des feedbacks; il ne faut donc pas généraliser le résultat à tous les LLM ou à tous les logiciels RH.
Verdict Radar
WATCH — Le risque est assez crédible pour intégrer l’évolution dans le temps aux audits des systèmes adaptatifs, mais les éléments disponibles ne permettent pas de conclure que ce phénomène se manifeste dans l’ensemble des outils de recrutement réels.
Sources
Sources
Signal d’origine utilisé pour l’analyse Radar.
Recevoir la newsletter Radar
Un email par semaine. Les signaux triés, notés, prêts à décider.



