Key points are not available for this paper at this time.
La parole est une approche courante et efficace pour la communication entre les humains et les appareils mobiles modernes tels que les smartphones ou les hubs domestiques. Les avancées remarquables en informatique et en réseau ont démocratisé les systèmes de reconnaissance automatique de la parole (ASR), qui peuvent interpréter les signaux de parole reçus sur des appareils mobiles et nous permettent de contrôler et d'interagir à distance avec ces appareils. Malgré un développement prometteur, les exemples adversaires audio, un nouveau type d'attaque sur les systèmes ASR avancés, s'avèrent extrêmement efficaces pour imiter la parole humaine tout en trompant les appareils mobiles afin de produire des commandes incorrectes. Dans cet article, nous proposons une enquête systématique sur les exemples adversaires audio dans la littérature. Nous présentons d'abord un aperçu de l'architecture des systèmes ASR et esquissons la philosophie de l'attaque de base. Suivi d'une brève introduction des solutions à la pointe de la technologie contre les exemples adversaires audio, une comparaison complète est présentée. Enfin, après avoir discuté des contre-mesures existantes pour défendre l'ASR, nous mettons en lumière plusieurs directions et défis de recherche futurs prometteurs pour construire des exemples adversaires audio plus robustes et pratiques.
Hu et al. (2019) ont étudié cette question.
Synapse has enriched 4 closely related papers on similar clinical questions. Consider them for comparative context: