Key points are not available for this paper at this time.
La traduction simultanée de la parole (SimulST) est une tâche exigeante qui implique de générer des traductions en temps réel tout en traitant en continu l'entrée vocale. Cet article offre un aperçu complet des développements récents dans la recherche sur la SimulST, en se concentrant sur quatre grands défis. Tout d'abord, les complexités associées au traitement de flux de parole longs et continus posent des obstacles significatifs. Deuxièmement, satisfaire aux exigences en temps réel présente des difficultés inhérentes en raison de la nécessité d'une sortie de traduction immédiate. Troisièmement, trouver un équilibre entre la qualité de la traduction et les contraintes de latence demeure un défi crucial. Enfin, la rareté des données annotées ajoute une couche supplémentaire de complexité à la tâche. À travers notre exploration de ces défis et des solutions proposées, nous visons à fournir des aperçus précieux sur le paysage actuel de la recherche en SimulST et à suggérer des directions prometteuses pour les explorations futures.
Liu et al. (Sat,) ont étudié cette question.