کد مقاله کد نشریه سال انتشار مقاله انگلیسی نسخه تمام متن
695527 1460661 2015 7 صفحه PDF دانلود رایگان
عنوان انگلیسی مقاله ISI
Parameterized Markov decision process and its application to service rate control
ترجمه فارسی عنوان
فرایند تصمیم گیری پارامتریک مارکوف و کاربرد آن در کنترل نرخ خدمات
کلمات کلیدی
روند تصمیم گیری مارکوف، سیستم های رویداد گسسته، سیاست پارامتری تکرار سیاست، کنترل نرخ خدمات
موضوعات مرتبط
مهندسی و علوم پایه سایر رشته های مهندسی کنترل و سیستم های مهندسی
چکیده انگلیسی

In this paper, we discuss the optimization of Markov decision processes (MDPs) with parameterized policy, where the state space is partitioned and a parameter is assigned to each partition. The goal is to find the optimal parameters which maximize the long-run average performance. The traditional policy iteration is usually inapplicable to parameterized policy because the parameter tuning at different states are correlated. With some appropriate assumptions and special conditions, we develop a modified policy iteration type algorithm to find the optimal parameters. Compared with the traditional gradient-based approaches for MDP with parameterized policy, this policy iteration type approach is much more efficient. Finally, as an example, we apply this approach to a service rate control problem in closed Jackson networks. As compared with the gradient-based approach which is trapped into local optimum, our approach is demonstrated to efficiently find the optimal service rates in global scope.

ناشر
Database: Elsevier - ScienceDirect (ساینس دایرکت)
Journal: Automatica - Volume 54, April 2015, Pages 29–35
نویسندگان
, ,