Scénario n° : 007
Auteur : Département informatique, Chambre des députés d'Italie
Date : 22 mai 2024
Objectif :
Classer automatiquement des documents législatifs italiens issus du Journal officiel italien suivant le thésaurus EuroVoc.
Acteurs :
- Services opérationnels
- Système de classification
Conditions préalables :
- Existence d'une base de données de documents législatifs servant de données d'apprentissage
- Connaissance du thésaurus EuroVoc
- Modèle IA de classification entraîné à attribuer des libellés aux documents
Scénario :
- Un nouveau document législatif est proposé et introduit dans la base de données.
- Le modèle de classification propose les libellés EuroVoc les plus appropriés.
- L'utilisateur peut accepter ou modifier la liste des libellés associés à la loi.
- Les libellés associés à la loi sont stockés sous forme de métadonnées.
Résultats attendus :
- L'attribution de libellés EuroVoc aux documents est plus efficace.
Problèmes potentiels :
- Données asymétriques
- Modèle non interprétable (p. ex. réseaux neuronaux)
- Apprentissage long (et peu évolutif en termes de volume de données d’entraînement)
- Certains types de modèles pourraient ne pas résister à des valeurs aberrantes
- Empêcher le surapprentissage
Données requises :
- Base de données de documents législatifs
Intégration à d'autres systèmes :
- Base de données de documents législatifs
Indicateurs de réussite :
- Réduction du temps nécessaire pour classer les documents législatifs
- Pourcentage de documents législatifs classés sans aucune modification humaine des libellés
- Temps de réponse moyen nécessaire pour établir la classification