Key points are not available for this paper at this time.
随机逻辑网络(SLN)是具有布尔(或多值)逻辑状态变量的离散时间随机动力系统。本文研究了 SLN 的折扣无限时域最优控制问题。通过借助等效的马尔可夫决策过程描述,该无限时域优化问题以代数形式呈现。随后利用增维技术,为值迭代方法推导了一种能够找到最优平稳策略的改进有限收敛准则。为证明该方法的理论价值,将其应用于人机博弈以及 p53-Mdm2 基因网络的优化问题中。
Wu et al. (Thu,) 研究了这一问题。