Ce premier outil gratuit du genre offre aux rédactions, aux services RH, aux compagnies d'assurance et aux équipes d'IA, entre autres, un moyen pratique d'éliminer en quelques secondes les biais linguistiques des contenus écrits et des données d'entraînement des IA.
L'institut Vector a lancé aujourd'hui UnBias-Plus , un outil d'IA gratuit et open source conçu par les chercheurs de Vector spécialisés dans la sécurité de l'IA, qui permet de détecter, d'expliquer et de réécrire en quelques secondes le langage biaisé dans les contenus écrits et les ensembles de données d'entraînement de l'IA.
Cette publication survient à un moment décisif. La Stratégie nationale canadienne en matière d’IA, « L’IA pour tous », désigne explicitement la lutte contre les biais algorithmiques comme un pilier du développement responsable de l’IA, reconnaissant que les biais non contrôlés dans les systèmes d’IA nuisent à l’équité, à la sécurité et à la confiance du public. L’ampleur du défi est stupéfiante : les taux de biais dans les données d’entraînement de l’IA ont été mesurés entre 3,4 % et 38,5 % , et même les grands modèles de langage (GML) optimisés pour la sécurité présentent des biais raciaux et sexistes implicites – une réalité troublante étant donné que les GML risquent de perpétuer et d’amplifier les biais humains inhérents aux textes dont ils s’inspirent.
UnBias-Plus est le premier outil gratuit de ce genre accessible aux organisations comme au grand public. Il analyse les textes à la recherche de biais linguistiques liés à la race, au genre, à l'âge et à l'orientation politique, explique précisément pourquoi certains termes ont été signalés, propose des alternatives neutres et fournit une version entièrement réécrite du texte original. Plutôt que de simplement produire une copie corrigée, UnBias-Plus explique aux utilisateurs pourquoi le langage peut être biaisé, contribuant ainsi à une meilleure compréhension de la manière dont les biais se manifestent dans la communication quotidienne. La plateforme est disponible en deux formats :
- Une version Web destinée au grand public, prenant en charge du contenu jusqu'à 750 mots – pratique pour l'écriture quotidienne et pour les organisations évaluant l'outil avant son adoption à plus grande échelle ;
- Un programme d'installation pour développeurs permettant l'intégration dans les applications, systèmes et flux de travail de l'entreprise.
Ce qui nous a poussés à créer cet outil est simple : les personnes les plus touchées par les biais de langage sont souvent les dernières à en prendre conscience. Un patient ne perçoit pas les présupposés cachés dans son dossier médical. Un candidat à un emploi ignore pourquoi une porte se ferme sans cesse. Nous voulions rendre visible l’invisible : un outil gratuit qui met en évidence les biais, les explique et aide à les corriger. Or, les préjugés ne se limitent pas aux documents rédigés aujourd’hui. Ils sont présents dans les données utilisées pour entraîner les modèles d'IA et, lorsqu'ils ne sont pas détectés, ils sont appris, reproduits et déployés à grande échelle dans des organisations entières. UnBias-Plus permet aux développeurs et aux scientifiques des données de repérer et d’éliminer ces biais avant qu’ils ne soient intégrés au modèle.
UnBias-Plus est conçu pour aider les professionnels et les secteurs où les biais linguistiques ont les conséquences les plus graves dans le monde réel :
Éditorial et médias – Les rédacteurs peuvent intégrer UnBias-Plus directement dans leurs flux de travail pour identifier et corriger les biais avant publication, favorisant ainsi des reportages plus précis et inclusifs.
Équipes des ressources humaines, de l'EDI et du lieu de travail – Cet outil peut être utilisé pour aider à examiner les descriptions de poste, les évaluations de rendement, les dossiers de promotion et les communications internes afin de repérer les formulations sexistes, racialisées ou autres qui peuvent involontairement créer des obstacles pour les employés et les candidats.
Communication dans le domaine de la santé – UnBias-Plus aide à examiner les notes cliniques, les évaluations de soins et les communications avec les patients afin de repérer les formulations stigmatisantes ou discriminatoires susceptibles d’influencer les décisions de soins, la couverture d’assurance et les résultats. Par exemple, si un soignant écrit « patient non observant a refusé son traitement », cette formulation sera utilisée pour tous les rendez-vous ultérieurs du patient. UnBias-Plus peut signaler ce type de formulation et suggérer une alternative telle que « le patient a refusé son traitement » afin que le dossier reste factuel et non subjectif.
Assurance – Les équipes peuvent aider à examiner les lettres relatives aux prestations, les avis d’admissibilité et les communications sur la couverture afin de s’assurer que le langage reflète la politique et les faits, et non des suppositions inconscientes sur qui mérite des soins.
Pour les développeurs d'IA et les scientifiques des données , UnBias-Plus facilite le filtrage des annotations, des invites et du texte source afin d'utiliser des données aseptisées pour l'entraînement ou l'optimisation des modèles d'IA. L'outil identifie les biais dès la couche de données, avant même que ces biais ne soient appris, reproduits et déployés dans les systèmes. Les équipes d'IA peuvent également analyser les résultats des modèles avec cet outil pour détecter tout langage biaisé avant leur diffusion aux utilisateurs ou leur intégration dans les flux de travail en aval.
« Le leadership canadien en IA repose sur la mise en place de systèmes qui créent des résultats plus équitables, ce qui implique de garantir l’accès à la recherche sous-jacente à ces systèmes pour tous. Le fait qu’UnBias-Plus soit gratuit, transparent et libre de droits est une expression délibérée de la mission de Vector en tant qu’institut indépendant à but non lucratif : la recherche sur le fonctionnement des biais dans l’IA et le langage a des répercussions sur l’ensemble de la société, et les outils qui en découlent devraient en faire autant. En ouvrant ces travaux aux développeurs, aux organisations et au public, nous veillons à ce que la capacité de créer une IA plus juste soit accessible à tous. »
Explorez UnBias-Plus :
UnBias-Plus est le premier produit de Vector Institute au sein d'une suite plus complète d'outils d'IA sécurisée. Les mises à jour étendront ses fonctionnalités, notamment la détection des biais audio et vidéo ainsi que la détection de la désinformation, prévues pour une version ultérieure. Pour accéder aux autres produits disponibles, veuillez consulter notre page Logiciels libres .
UnBias-Plus ne prend actuellement en charge que les textes en anglais. Cet outil ne vérifie pas l'exactitude des faits, ne détecte pas la désinformation et n'identifie pas le contenu généré par l'IA.