Key points are not available for this paper at this time.
部分観測マルコフ決定プロセス(POMDP)は、関心のあるパラメーターに関する情報が不完全な連続的な意思決定問題であり、可能な行動にはサンプリング、調査、またはその他の方法で追加情報を収集することが含まれます。このような問題は理論的には動的プログラムとして解決できますが、関連する状態空間は無限であり、アルゴリズムによる解決を妨げます。本論文では、状態空間を有限の点のグリッドで近似し、そのグリッドを使用して上限および下限の価値関数の限界を構築し、近似的な非定常および定常方針を生成し、これらの方針を意思決定問題に使用する際の最適に対する価値損失を限定する方法を説明します。数値例が方法論を示します。
ウィリアム・S・ラブジョイ(金曜日)がこの質問を研究しました。
Synapse has enriched 5 closely related papers on similar clinical questions. Consider them for comparative context: