Понятие об игровых моделях
Лекция 4 Тема: «ЭЛЕМЕНТЫ ТЕОРИИ ИГР»
Понятие об игровых моделях На практике часто приходится сталкиваться с задачами, в которых необходимо принимать решения в условиях неопределенности, т.е. возникают ситуации, в которых две (или более) стороны преследуют различные цели, а результаты любого действия каждой из сторон зависят от мероприятий партнера. Такие ситуации, возникающие при игре в шахматы, шашки, домино и т.д., относятся к конфликтным: результат каждого хода игрока зависит от ответного хода противника, цель игры — выигрыш одного из партнеров. В экономике конфликтные ситуации встречаются очень часто и имеют многообразный характер. К ним относятся, например, взаимоотношения между поставщиком и потребителем, покупателем и продавцом, банком и клиентом. Во всех этих примерах конфликтная ситуация порождается различием интересов партнеров и стремлением каждого из них принимать оптимальные решения, которые реализуют поставленные цели в наибольшей степени. При этом каждому приходится считаться не только со своими целями, но и с целями партнера, и учитывать неизвестные заранее решения, которые эти партнеры будут принимать. Для грамотного решения задач с конфликтными ситуациями необходимы научно обоснованные методы. Такие методы разработаны математической теорией конфликтных ситуаций, которая носит название теория игр. Ознакомимся с основными понятиями теории игр. Математическая модель конфликтной ситуации называется игрой, стороны, участвующие в конфликте, — игрокам и, а исход конфликта — выигрышем. Для каждой формализованной игры вводятся правил а, т.е. система условий, определяющая:
1) варианты действий игроков; 2) объем информации каждого игрока о поведении партнеров; 3) выигрыш, к которому приводит каждая совокупность действий. Как правило, выигрыш (или проигрыш) может быть задан количественно; например, можно оценить проигрыш нулем, выигрыш — единицей, а ничью — 1/2. Игра называется парной, если в ней участвуют два игрока, и множественной, если число игроков больше двух. Мы будем рассматривать только парные игры. В них участвуют два игрока А и В, интересы которых противоположны, а под игрой будем понимать ряд действий со стороны А и В. Игра называется игрой с нулевой суммой, или антагонистическо й, если выигрыш одного из игроков равен проигрышу другого, т.е. для полного задания игры достаточно указать величину одного из них. Если обозначить а — выигрыш одного из игроков, b — выигрыш другого, то для игры с нулевой суммой b = - а, поэтому достаточно рассматривать, например а. Выбор и осуществление одного из предусмотренных правилами действий называется ходом игрока. Ходы могут быть личными и случайными. Личный ход — это сознательный выбор игроком одного из возможных действий (например, ход в шахматной игре). Случайный ход — это случайно выбранное действие (например, выбор карты из перетасованной колоды). В дальнейшем мы будем рассматривать только личные ходы игроков. Стратегией игрока называется совокупность правил, определяющих выбор его действия при каждом личном ходе в зависимости от сложившейся ситуации. Обычно в процессе игры при каждом личном ходе игрок делает выбор в зависимости от конкретной ситуации. Однако, в принципе, возможно, что все решения приняты игроком заранее (в ответ на любую сложившуюся ситуацию). Это означает, что игрок выбрал определенную стратегию, которая может быть задана в виде списка правил или программы. (Так можно осуществить игру с помощью ЭВМ). Игра называется конечно й, если у каждого игрока имеется конечное число стратегий, и бесконечной — в противном случае.
Для того чтобы решить игру, или найти решение игры, следует для каждого игрока выбрать стратегию, которая удовлетворяет условию оптимальност и, т.е. один из игроков должен получать максимальный выигрыш, когда второй придерживается своей стратегии. В то же время второй игрок должен иметь минимальный проигрыш, если первый придерживается своей стратегии. Такие стратеги и называются оптимальным. Оптимальные стратегии должны также удовлетворять условию устойчивости, т.е. любому из игроков должно быть невыгодно отказаться от своей стратегии в этой игре. Если игра повторяется достаточно много раз, то игроков может интересовать не выигрыш и проигрыш в каждой конкретной партии, а средний выигрыш (проигрыш) во всех партиях. Целью теории игр является определение оптимальной стратегии для каждого игрока. При выборе оптимальной стратегии естественно предполагать, что оба игрока ведут себя разумно с точки зрения своих интересов. Важнейшее ограничение теории игр — единственность выигрыша как показателя эффективности, в то время как в большинстве реальных экономических задач имеется более одного показателя эффективности. Кроме того, в экономике, как правило, возникают задачи, в которых интересы партнеров не обязательно антагонистические. Развитие аппарата теории игр для решения задач со многими участниками, имеющими непротиворечивые интересы, выходит за рамки лекции.
Платежная матрица. Нижняя и верхняя цена игры Рассмотрим парную конечную игру. Пусть игрок А располагает т личными стратегиями, которые обозначим
Строки этой таблицы соответствуют стратегиям игрока А, а столбцы — стратегиям игрока В. Пример. Составить платежную матрицу для следующей игры. Игра "поиск". Игрок А может прятаться в одном из двух убежищ (I и II); игрок В ищет игрока А, и если найдет, то получает штраф 1 ден. ед. от А, в противном случае платит игроку А 1 ден. ед. Необходимо построить платежную матрицу игры. Решение. Для составления платежной матрицы следует проанализировать поведение каждого из игроков. Игрок А может спрятаться в убежище I — обозначим эту стратегию через Игрок В может искать первого игрока в убежище I — стратегия
Рассмотрим игру т Обозначим через
Среди всех чисел
Стратегия, соответствующая максимину, называется максиминной стратегией. Игрок В заинтересован в том, чтобы уменьшить выигрыш игрока А; выбирая стратегию
Среди всех чисел
Стратегия, соответствующая минимаксу, называется минимаксной стратегией. Принцип, диктующий игрокам выбор наиболее "осторожных" минимаксной и максиминной стратегий, называется принципом минимакса. Этот принцип следует из разумного предположения, что каждый игрок стремится достичь цели, противоположной цели противника. Пример. Определить нижнюю и верхнюю цены игры и соответствующие стратегии в игре «Поиск». Рассмотрим платежную матрицу: При выборе стратегии Гарантируя себе максимальный выигрыш при любой стратегии игрока В, т.е. нижнюю цену игры Выбирая стратегию Аналогично максимальный проигрыш игрока В (выигрыш А ) при выборе им стратегии Таким образом, при любой стратегии игрока А гарантированный минимальный проигрыш игрока В равен Любая стратегия игрока В является минимаксной. Дополнив таблицу строкой
На пересечении дополнительных строки и столбца будем записывать верхнюю и нижнюю цены игр. Если верхняя и нижняя цены игры совпадают, то общее значение верхней и нижней цены игры Пара чистых стратегий
Пример. Определить нижнюю и верхнюю цену игры, заданной платежной матрицей. Найти седловую точку игры.
Решение. Составим таблицу, в которой кроме матрицы Р, введем столбец
Столбец
Воспользуйтесь поиском по сайту: ![]() ©2015 - 2025 megalektsii.ru Все авторские права принадлежат авторам лекционных материалов. Обратная связь с нами...
|