Contrôle Prédictif Renforcé via l'Optimisation de Politique Quasi-Newton dans une Région de Confiance | Synapse