Quel problème vous préoccupe le plus ? Le clustering de documents peut répondre à cette question à partir des données textuelles complètes de votre base de problèmes.
Pour quel sujet les capacités devraient-elles être mobilisées dans le prochain grand projet d’amélioration ? Cette question est généralement tranchée de manière intuitive ou à partir de catégories d’erreurs maintenues manuellement. La gestion de ces catégories d’erreurs est non seulement fastidieuse, mais aussi très sujette aux erreurs et peu précise.
Grâce au clustering de documents, les sujets les plus fréquents peuvent être identifiés directement à partir des fréquences de mots et des collocations issues des données en texte intégral. Cette méthode est ainsi moins coûteuse en temps et plus précise que les catégories d’erreurs.
Nous montrerons comment le clustering de documents peut être utilisé pour identifier les principaux sujets.