کد مقاله کد نشریه سال انتشار مقاله انگلیسی نسخه تمام متن
1142020 1378600 2016 5 صفحه PDF دانلود رایگان
عنوان انگلیسی مقاله ISI
The value functions of Markov decision processes
ترجمه فارسی عنوان
توابع ارزش در فرایند تصمیم گیری مارکف
کلمات کلیدی
مشکلات تصمیم گیری مارکوف، تابع ارزش، کاراکتریزه کردن
موضوعات مرتبط
مهندسی و علوم پایه ریاضیات ریاضیات گسسته و ترکیبات
چکیده انگلیسی

It is known that the value function of a Markov decision process, as a function of the discount factor λλ, is the maximum of finitely many rational functions in λλ. Moreover, each root of the denominators of the rational functions either lies outside the unit ball in the complex plane, or is a unit root with multiplicity 1. We prove the converse of this result, namely, every function that is the maximum of finitely many rational functions in λλ, satisfying the property that each root of the denominators of the rational functions either lies outside the unit ball in the complex plane, or is a unit root with multiplicity 1, is the value function of some Markov decision process. We thereby provide a characterization of the set of value functions of Markov decision processes.

ناشر
Database: Elsevier - ScienceDirect (ساینس دایرکت)
Journal: Operations Research Letters - Volume 44, Issue 5, September 2016, Pages 587–591
نویسندگان
, , ,