Scénario n° : 003
Auteur : Département informatique, Chambre des députés d'Italie
Date : 22 mai 2024
Objectif :
Générer, en temps réel, les sous-titres des allocutions tenues lors des séances de l'assemblée. Les sous-titres sont intégrés aux signaux vidéo publiés par la Web TV.
Acteurs :
- Système de sous-titrage RVA
- Utilisateurs de la Web TV
Conditions préalables :
- Existence d'un signal audio d'allocutions tenues en assemblée
- Existence d'un signal vidéo de l'assemblée
- Existence d'un modèle de sous-titrage pré-entraîné
Scénario :
- Le signal audio des allocutions tenues en assemblée pénètre dans le système de sous-titrage RVA en temps réel.
- Le système de sous-titrage RVA transcrit les sous-titres en temps réel sans intervention humaine.
- Les sous-titres sont intégrés au signal vidéo de l'assemblée.
- Le signal vidéo apparaît sur la Web TV. Les utilisateurs peuvent activer/désactiver les sous-titres.
Résultats attendus :
- Les sous-titres des allocutions tenues en assemblée sont transcrits en temps réel et sans intervention humaine et sont diffusés sur la Web TV.
- Problèmes potentiels :
- Le modèle de RVA n'est pas correctement entraîné.
- Le fonctionnement du modèle de RVA ne sera pas optimal avec les dialectes et des termes spécifiques n'ayant pas été utilisés pendant la phase d'entraînement (p. ex. le terme "COVID-19" a été beaucoup utilisé pendant la pandémie, mais il était inconnu auparavant).
Données requises :
- Le modèle de RVA devrait être entraîné avec un volume important de données provenant de comptes rendus de séances. En général, il devrait être entraîné avec un volume important de données provenant d'allocutions et de mots dans la langue souhaitée.
Intégration à d'autres systèmes :
- Système qui produit le signal audio de l'assemblée
- Système qui produit le signal vidéo de l'assemblée
- Web TV
Indicateurs de réussite :
- Temps nécessaire pour générer les sous-titres
- Délai entre le signal audio/vidéo de l'assemblée et l'apparition des sous-titres correspondants