Controle de Sistemas Não-Afinados Não-Lineares de Tempo Discreto Usando Redes Neurais Linearmente Parametrizadas Baseadas em Aprendizado por Reforço | Synapse