Главная Лечение рака

Равновесие нэша в смешанных стратегиях. Теория игр

И Оскар Моргенштерн стали основателями нового интересного направления математики, которое получило название "теория игр". В 1950-е годы этим направлением заинтересовался молодой математик Джон Нэш. Теория равновесия стала темой его диссертации, которую он написал, будучи в возрасте 21 год. Так родилась новая стратегия игр под названием «Равновесие по Нэшу», заслужившая Нобелевскую премию спустя много лет - в 1994 году.

Долгий разрыв между написанием диссертации и всеобщим признанием стал испытанием для математика. Гениальность без признания вылилась в серьезные ментальные нарушения, но и эту задачу Джон Нэш смог решить благодаря прекрасному логическуму разуму. Его теория "равновесие по Нэшу" удостоилась премии Нобеля, а его жизнь экранизации в фильме «Beautiful mind» («Игры разума»).

Кратко о теории игр

Поскольку теория равновесия Нэша объясняет поведение людей в условиях взаимодействия, поэтому стоит рассмотреть основные понятия теории игр.

Теория игр изучает поведение участников (агентов) в условиях взаимодействия друг с другом по типу игры, когда исход зависит от решения и поведения нескольких людей. Участник принимает решения, руководствуясь своими прогнозами относительно поведения остальных, что и называется игровой стратегией.

Существует также доминирующая стратегия, при которой участник получает оптимальный результат при любом поведении других участников. Это наилучшая безпроигрышная стратегия игрока.

Дилемма заключенного и научный прорыв

Дилемма заключенного - это случай с игрой, когда участники вынуждены принимать рациональные решения, достигая общей цели в условии конфликта альтернатив. Вопрос заключается в том, какой из этих вариантов он выберет, осознавая личный и общий интерес, а также невозможность получить и то, и другое. Игроки словно заключены в жесткие игровые условия, что порой заставляет их мыслить очень продуктивно.

Эту дилемму исследовал американский математик Равновесие, которое он вывел, стало революционным в своем роде. Особенно ярко эта новая мысль повлияла на мнение экономистов о том, как делают выбор игроки рынка, учитывая интересы других, при плотном взаимодействии и пересечении интересов.

Лучше всего изучать теорию игр на конкретных примерах, поскольку сама эта математическая дисциплина не является сухо-теоретической.

Пример дилеммы заключенного

Пример, два человека совершили грабеж, попали в руки полиции и проходят допрос в отдельных камерах. При этом служители полиции предлагают каждому участнику выгодные условия, при которых он выйдет на свободу в случае дачи показаний против своего напарника. У каждого из преступников существует следующий набор стратегий, которые он будет рассматривать:

Оба одновременно дают показания и получают по 2,5 года в тюрьме.
Оба одновременно молчат и получают по 1 году, поскольку в таком случае доказательная база их вины будет мала.
Один дает показания и получает свободу, а другой молчит и получает 5 лет тюрьмы.

Очевидно, что исход дела зависит от решения обоих участников, но сговориться они не могут, поскольку сидят в разных камерах. Также ярко виден конфликт их личных интересов в борьбе за общий интерес. У каждого из заключенных есть два варианта действий и 4 варианта исходов.

Цепь логических умозаключений

Итак, преступник А рассматривает следующие варианты:

Я молчу и молчит мой напарник — мы оба получим по 1 году тюрьмы.
Я сдаю напарника и он сдает меня — мы оба получим по 2,5 года тюрьмы.
Я молчу, а напарник меня сдает — я получу 5 лет тюрьмы, а он свободу.
Я сдаю напарника, а он молчит - я получаю свободу, а он 5 лет тюрьмы.

Приведем матрицу возможных решений и исходов для наглядности.

Таблица вероятных исходов дилеммы заключенного.

Вопрос состоит в том, что выберет каждый участник?

«Молчать, нельзя говорить» или «молчать нельзя, говорить»

Чтобы понять выбор участника, нужно пройти по цепочке его размышлений. Следуя рассуждениям преступника А: если я промолчу и промолчит мой напарник, мы получим минимум срока (1 год), но я не могу узнать, как он себя поведет. Если он даст показания против меня, то мне также лучше дать показания, иначе я могу сесть на 5 лет. Лучше мне сесть на 2,5 года, чем на 5 лет. Если он промолчит, то мне тем более нужно дать показания, поскольку так я получу свободу. Точно так же рассуждает и участник B.

Нетрудно понять, что доминирующая стратегия для каждого из преступников - это дача показаний. Оптимальная точка этой игры наступает тогда, когда оба преступника дают показания и получают свой «приз» — 2,5 года тюрьмы. Теория игр Нэша называет это равновесием.

Неоптимальное оптимальное решение по Нэшу

Революционность нэшевского взгляда в том, не является оптимальным, если рассмотреть отдельного участника и его личный интерес. Ведь наилучший вариант - это промолчать и выйти на свободу.

Равновесие по Нэшу - это точка соприкосновения интересов, где каждый участник выбирает такой вариант, который для него оптимальный только при условии, что другие участники выбирают определенную стратегию.

Рассматривая вариант, когда оба преступника молчат и получают всего по 1 году, можно назвать него Парето-оптимальным вариантом. Однако он возможен, только если преступники смогли бы сговориться заранее. Но даже это не гарантировало бы этого исхода, поскольку соблазн отступить от уговора и избежать наказания велик. Отсутствие полного доверия друг к другу и опасность получить 5 лет вынуждает выбрать вариант с признанием. Размышлять о том, что участники будут придерживаться варианта с молчанием, действуя согласованно, просто нерационально. Такой вывод можно сделать, если изучать равновесие Нэша. Примеры только доказывают правоту.

Эгоистично или рационально

Теория равновесия Нэша дала потрясающие выводы, опровергнувшие существующие до этого принципы. Например, Адам Смит рассматривал поведение каждого из участников как абсолютно эгоистичное, что и приводило систему в равновесие. Эта теория носила название «невидимая рука рынка».

Джон Нэш увидел, что если все участники будут действовать, преследуя только свои интересы, то это никогда не приведет к оптимальному групповому результату. Учитывая, что рациональное мышление присуще каждому участнику, более вероятен выбор, который предлагает стратегия равновесия Нэша.

Чисто мужской эксперимент

Ярким примером может служить игра «парадокс блондинки», которая хотя и кажется неуместной, но является яркой иллюстрацией, показывающей, как работает теория игр Нэша.

В этой игре нужно представить, что компания свободных парней пришла в бар. Рядом оказывается компания девушек, одна из которых предпочтительнее других, скажем блондинка. Как парням повести себя, чтобы получить наилучшую подругу для себя?

Итак, рассуждения парней: если все начнут знакомиться с блондинкой, то, скорее всего, она никому не достанется, тогда и ее подруги не захотят знакомства. Никто не хочет быть вторым запасным вариантом. Но если парни выберут избегать блондинку, то вероятность каждому из парней найти среди девушек хорошую подругу высока.

Ситуация равновесия по Нэшу неоптимальна для парней, поскольку, преследуя лишь свои эгоистические интересы, каждый выбрал бы именно блондинку. Видно, что преследование только эгоистичных интересов будет равнозначно краху групповых интересов. Равновесие по Нэшу будет значить то, что каждый парень действует в своих личных интересах, которые соприкасаются с интересами всей группы. Это неоптимальный вариант для каждого лично, но оптимальный для каждого, исходя из общей стратегии успеха.

Вся наша жизнь игра

Принятие решений в реальных условиях очень напоминает игру, когда вы ожидаете определенного рационального поведения и от других участников. В бизнесе, в работе, в коллективе, в компании и даже в отношениях с противоположным полом. От больших сделок и до обычных жизненных ситуаций все подчиняется тому или иному закону.

Конечно, рассмотренные игровые ситуации с преступниками и баром - это всего лишь отличные иллюстрации, демонстрирующие равновесие Нэша. Примеры таких дилемм очень часто возникают на реальном рынке, а особенно это работает в случаях с двумя монополистами, контролирующими рынок.

Смешанные стратегии

Часто мы вовлекаемы не в одну, а сразу в несколько игр. Выбирая один из вариантов одной игре, руководствуясь рациональной стратегией, но попадаете в другую игру. После нескольких рациональных решений вы можете обнаружить, что ваш результат вас не устраивает. Что же предпринимать?

Рассмотрим два вида стратегии:

Чистая стратегия - это поведение участника, которое исходит из размышления над возможным поведением других участников.
Смешанная стратегия или случайная стратегия - это чередование чистых стратегий случайным образом или выбор чистой стратегии с определенной вероятностью. Такую стратегию еще называют рэндомизированной.

Рассматривая такое поведение, мы получаем новый взгляд на равновесие по Нешу. Если ранее говорилось о том, что игрок выбирает стратегию один раз, то можно представить и другое поведение. Можно допустить тот вариант, что игроки выбирают стратегию случайно с определенной вероятностью. Игры, в которых нельзя найти равновесия Нэша в чистых стратегиях, всегда имеют их в смешанных.

Равновесие Нэша в смешанных стратегиях называется смешанным равновесием. Это такое равновесие, где каждый участник выбирает оптимальную частоту выбора своих стратегий при условии, что другие участники выбирают свои стратегии с заданной частотой.

Пенальти и смешанная стратегия

Пример смешанной стратегии можно привести в игре в футбол. Лучшая иллюстрация смешанной стратегии - это, пожалуй, серия пенальти. Так, у нас есть вратарь, который может прыгнуть только в один угол, и игрок, который будет бить пенальти.

Итак, если в первый раз игрок выберет стратегию сделать удар в левый угол, а вратарь также упадет в этот угол и словит мяч, то как могут развиваться события во второй раз? Если игрок будет бить в противоположный угол, это, скорее всего, слишком очевидно, но и удар в тот же угол не менее очевиден. Поэтому и вратарю, и бьющему ничего не остается, как положиться на случайный выбор.

Так, чередуя случайный выбор с определенной чистой стратегией, игрок и вратарь пытаються получить максимальный результат.

Отправить свою хорошую работу в базу знаний просто. Используйте форму, расположенную ниже

Студенты, аспиранты, молодые ученые, использующие базу знаний в своей учебе и работе, будут вам очень благодарны.

Размещено на http://www.allbest.ru/

Равновесие Нэша

Введение

1. Джон Форбс Нэш

1.1 Научные достижения Джона Нэша

2. Равновесие Нэша

2.1 Проблема существования равновесий Нэша

2.2 Проблема единственности равновесия Нэша

2.3 Проблема эффективности равновесия Нэша

2.4 Оптимальные по Парето ситуации

3. Проблемы практического применения

Заключение

Список литературы

Введение

Ученые вот уже почти шестьдесят лет используют теорию игр для расширения анализа стратегических решений, принимаемых фирмы, в частности для того, чтобы ответить на вопрос: почему на некоторых рынках фирмы и стремятся сговориться, тогда, как на других агрессивно конкурируют; использующих фирмы, чтобы не допустить вторжения потенциальных конкурентов; как должны приниматься решения о цене, когда меняются условия п опроса или расходов или, когда новые конкуренты вторгаются на рынок.

Первыми провели исследование в области теории игр Дж-Ф Нейман и О Моргенштерн и описали результаты в книге "Теория игр и экономическое поведение" (1944) Они распространили математические категории этой теории й на экономическую жизнь общества, введя понятие оптимальных стратегий, максимизации ожидаемой полезности, доминирования в игре.

Ученые стремились сформулировать основополагающие критерии рационального поведения участника на рынке с целью достижения благоприятных результатов. Они различали две основные категории игр. Первая - игра с нулевой суммой, предусматривающий такой выигрыш, состоящий исключительно из проигрыша других игроков. В связи с этим пользу одних непременно должна образовываться за счет потерь других игроков, так что общее, а сумма пользы и потерь всегда равна нулю. Вторая категория - игра с положительной суммой, когда индивидуальные игроки соревнуются за выигрыш, состоящий из их же ставок. В обоих случаях игра неизбежно сопряжена с риском, поскольку каждый из ее участников, как считали исследователи, стремится максимально повысить функцию, переменные которой им не контролируются. Если все игроки одинаково умелые, то решающим фактором становится случайность. Но так бывает редко. Почти всегда важную роль в игре играет хитрость, с помощью которой делаются попытки раскрыть замыслы противников и завуалировать свои й намерениях, а затем занять выгодные позиции, которые заставили бы этих противников действовать в ущерб самим себе.

В начале 50-х Джон Нэш разрабатывает методы анализа, в которых все участники или выигрывают, или терпят поражение. Эти ситуации получили названия «равновесие по Нэшу».

1. Джон Форбс Нэш

Очень сильная личность и Нобелевский лауреат Джон Нэш является ученым, который много и плодотворно работал в сфере дифференциальной геометрии и теории игр. Однако не все знают, что математик многие годы своей жизни посвятил трагической борьбе с собственным безумием, граничащим с гениальностью.

«Хорошие научные идеи не приходили бы мне в голову, если бы я думал как нормальные люди.» Д. Нэш

Трудовую деятельность Джон Нэш начал в корпорации "РЭНД" (Санта-Моника, Калифорния), где работал летом 1950 года, а также в 1952 и 1954 годах.

В 1950 - 1951 годах молодой человек преподавал на курсах исчисления (Принстон). В этот период времени он доказал теорему Нэша (о регулярных вложениях). Она является одной из главных в дифференциальной геометрии.

В 1951 - 1952 гг. Джон работает научным ассистентом в Кембридже (Массачусетский технологический институт).

Великому ученому было трудно уживаться в рабочих коллективах. Еще со времен студенчества он прослыл чудаковатым, обособленным, заносчивым, эмоционально холодным человеком (что уже тогда указывало на шизоидную организацию характера). Коллеги и сокурсники, мягко говоря, недолюбливали Джона Нэша за эгоистичность и замкнутость.

1.1 Научные достижения Джона Нэша

Прикладная математика имеет один из разделов - теория игр, который изучает оптимальные стратегии в играх. Эта теория широко применяется в общественных науках, экономике, изучении политико-социальных взаимодействий.

Самое большое открытие Нэша - это выведенная формула равновесия. Она описывает игровую стратегию, в которой выигрыш увеличить не может ни один участник, если изменит свое решение в одностороннем порядке. Например, рабочий митинг (требующий повышения социальных льгот) может завершиться соглашением сторон или же путчем. Для взаимной выгодности две стороны должны использовать идеальную стратегию. Ученый сделал математическое обоснование сочетаний коллективной и личной выгоды, понятий конкуренции. Также он развил "теорию торгов", которая была положена в основу современных стратегий разных сделок (аукционов и т. п.).

Научные изыскания Джона Нэша после исследований в области теории игр не остановились. Ученые считают, что труды, которые математик написал после его первого открытия, даже люди науки не могут понять, очень уж они сложны и для их восприятия.

нэш математик единственность равновесие

2. Равновесие Нэша

Основной математической моделью конфликтной ситуации является игра в нормальной форме. Эта модель задается совокупностью

где множество участников или игроков;

множество допустимых стратегий игрока;

ситуация игры, возникающая в результате выбора всеми игроками своих стратегий;

выигрыш игрока в ситуации.

Важнейшим принципом принятия решений в конфликтных ситуациях является понятие равновесия Нэша.

Равновесием Нэша в игре называется набор стратегий такой, что для каждого игрока его стратегия, входящая в набор, удовлетворяет условию:

Выражение "" читается " при условии ". Оно обозначает набор стратегий, в котором все компоненты, кроме стратегии игрока, совпадают с, а стратегия есть. Данное условие показывает, что стратегия, входящая в набор, является оптимальной для игрока при фиксированных стратегиях всех остальных игроков. Таким образом, можно сказать, что равновесие Нэша это такой набор стратегий, от которого ни одному из игроков не выгодно отклоняться индивидуально.

Обсудим, как можно использовать понятие равновесия Нэша с точки зрения принятия решений. В теории игр, как и во многих других теориях, можно выделить два подхода: нормативный и позитивный. Нормативный подход состоит в том, что теория дает рекомендации, как следует действовать в той или иной конфликтной ситуации. А при позитивном подходе теория пытается описать, как на самом деле происходит взаимодействие между игроками. Изначально теория игр развивалась как нормативная. И сейчас мы обсудим понятие равновесия Нэша именно с такой точки зрения. В этом случае правило принятия решения можно сформулировать следующим образом: в конфликтной ситуации, описываемой игрой в нормальной форме, каждому участнику следует использовать стратегию, которая входит в равновесие Нэша.

Возникают следующие вопросы: всегда ли существует равновесие Нэша и является ли оно единственным? Далее приводятся несколько примеров, которые показывают, что на оба эти вопроса ответ, вообще говоря, отрицательный.

2 .1 Проблема существования равновесий Нэша

Рассмотрим игру двух лиц (), у каждого из которых имеется конечное число стратегий: , . Такие игры двух лиц с конечным числом стратегий у каждого игрока называют биматричными, т.к. для задания функций выигрыша в этом случае удобна биматричная форма записи:

Стратегиям первого игрока соответствуют строки, а стратегиям второго игрока столбцы. Элемент матрицы равен выигрышу игрока, если первый игрок использует свою -тую стратегию, а второй игрок применяет свою -тую стратегию.

Пример игры, в которой не существует равновесий Нэша

Рассмотрим следующую биматричную игру:

Игре с такими матрицами выигрышей можно дать следующую интерпретацию: происходит игра "в монетку": второй игрок загадывает "орел" или "решку", а первый игрок отгадывает. Если он угадывает правильно, то получает от второго игрока "1", иначе отдает "1" второму игроку.

Легко видеть, что в рассматриваемой игре нет равновесий Нэша. Это можно доказать непосредственной проверкой: какую бы ситуацию мы ни взяли, одному из игроков выгодно отклониться, т.к. их интересы противоположны (если выигрывает один, то проигрывает другой) и при любой фиксированной стратегии одного из игроков у другого всегда найдется стратегия, при которой он выигрывает.

2 .2 Проблема единственности равновесия Нэша

Перейдем к ответу на второй вопрос: если существует равновесие Нэша, то является ли оно единственным?

Рассмотрим биматричную игру, называемую "семейный спор". Игроки молодая супружеская пара. Они решают проблему, куда пойти вечером: на футбол или на балет. Муж предпочитает футбол, а жена балет. Но в любом случае им хочется провести вечер вместе, т.к. если они пойдут в разные места, то все удовольствие будет испорчено.

матрица выигрышей жены,

матрица выигрышей мужа.

Легко убедиться, что в этой игре существует два равновесия Нэша: когда оба игрока используют первую стратегию (т.е. супруги идут на балет), либо когда оба игрока используют вторую стратегию (т.е. супруги идут на футбол).

Согласно принципу принятия решений, основанному на понятии равновесия Нэша, игрок должен использовать стратегию, входящую в какое-либо равновесие Нэша. Допустим, каждый игрок выберет то равновесие Нэша, которое ему больше нравится. В данной игре это может привести к самому худшему результату, т.к. жена выберет балет, муж выберет футбол, и в результате они попадут в ситуацию, когда выигрыш у обоих нулевой, т.е. меньше, чем выигрыш каждого игрока в любой из точек равновесия Нэша.

Пример показывает, что необходим какой-то механизм координации при выборе стратегии, если существует несколько равновесий Нэша. Поэтому игры, подобные данному примеру, называют также "играми на координацию".

2 .3 Проблема эффективности равновесия Нэша

Рассмотрим биматричную игру, называющуюся "Дилемма заключенного". (Эта игра достаточно знаменита. Ей посвящено несколько тысяч работ, дающих различные интерпретации этой игры.) Игроками являются два находящихся под следствием человека. У каждого из них есть две стратегии: сознаться в совершенном преступлении или не сознаваться. Следователь предлагает каждому заключенному такие условия: если он сознается, а другой подозреваемый нет, то тогда первого, учитывая его помощь следствию, осудят по минимальному обвинению (на 1 год), а второму дадут максимальный срок (10 лет). Если сознаются оба, то их обоих осудят и дадут срок, соответствующий их преступлению (по 5 лет лишения свободы каждому). Наконец, если оба подследственных не сознаются, то их смогут осудить за недостаточностью улик только по части обвинения (например, за незаконное хранение оружия вместо более тяжкого преступления, которое они на самом деле совершили). В этом случае оба получат по 2 года.

Получаем следующие матрицы выигрышей ("С" сознаться, "Н" не сознаваться):

для первого игрока

для второго игрока

В этой игре существует единственная точка равновесия Нэша обоим сознаться. Но есть ситуация, которая выгоднее обоим игрокам это обоим не сознаваться. Следовательно, точки равновесия Нэша могут быть неэффективны в том смысле, что за счет отклонения обоих игроков от точки равновесия Нэша можно улучшить выигрыши каждого из них.

Описанная в примере игра имеет следующую структуру:

2.4 Оптимальные по Парето ситуации

Чтобы сформулировать обнаруженное свойство неэффективности равновесий Нэша более формально, введем понятие Парето-оптимальной ситуации.

Пусть задана игра в нормальной форме. Набор стратегий называется Парето-оптимальным, если для любого

Фактически оптимальность некоторой ситуации по Парето означает, что за счет изменения стратегий нельзя увеличить выигрыши хотя бы части игроков так, чтобы при этом не уменьшить выигрыши для остальных.

Рассмотренный пример "дилемма заключенного" показывает, что для некоторых игр не существует точек равновесий Нэша, являющихся Парето-оптимальными. В этом случае любая точка равновесия Нэша может быть улучшена за счет совместного выбора стратегий.

3 . Проблемы практического применения

Мы отметили три недостатка понятия равновесия по Нэшу:

равновесий Нэша в игре может не существовать;

равновесие Нэша может быть не единственно;

равновесие Нэша может быть неэффективно.

Но, несмотря на эти недостатки, указанное понятие играет центральную роль в теории принятия решений в конфликтных ситуациях. В 1999 году Джон Нэш, предложивший данное понятие равновесия и известный в основном именно благодаря этому, получил Нобелевскую премию по экономике.

Безусловно, следует указать и на наличие определенных границ применения аналитического инструментария теории игр. В следующих случаях он может быть использован лишь при условии получения дополнительной информации.

Во-первых, это тот случай, когда у игроков сложились разные представления об игре, в которой они участвуют, или, когда они недостаточно информированы о возможностях друг друга. Например, может иметь место неясная информация о платежах конкурента (структуре издержек). Если неполнотой характеризуется не слишком сложная информация, то можно применять опыт подобных случаев с учетом определенных различий.

Во-вторых, теорию игр трудно применять при множестве ситуаций равновесия. Эта проблема может возникнуть даже в ходе простых игр с одновременным выбором стратегических решений.

В-третьих, если ситуация принятия стратегических решений очень сложна, то игроки часто не могут выбрать лучшие для себя варианты. Например, на рынок в разные сроки могут вступить несколько предприятий или реакция уже действующих там предприятий может оказаться более сложной, нежели быть агрессивной или дружественной.

Экспериментально доказано, что при расширении игры до десяти и более этапов игроки уже не в состоянии пользоваться соответствующими алгоритмами и продолжать игру с равновесными стратегиями.

К сожалению, ситуации реального мира зачастую очень сложны и настолько быстро изменяются, что невозможно точно спрогнозировать, как отреагируют конкуренты на изменение тактики. Тем не менее, теория игр полезна, когда требуется определить наиболее важные и требующие учета факторы в ситуации принятия решений в условиях конкурентной борьбы. Эта информация важна, поскольку позволяет учесть дополнительные переменные или факторы, имеющие возможность повлиять на ситуацию, и тем самым повысить эффективность решения.

Заключение

В заключение следует особо подчеркнуть, что теория игр является очень сложной областью знания. При обращении к ней надо соблюдать известную осторожность и четко знать границы применения. Слишком простые толкования таят в себе скрытую опасность. Анализ и консультации на основе теории игр из-за их сложности рекомендуются лишь для особо важных проблемных областей. Опыт показывает, что использование соответствующего инструментария предпочтительно при принятии однократных, принципиально важных плановых стратегических решений, в том числе при подготовке крупных кооперационных договоров.

Где же сегодня применяются открытия Нэша?

Пережив бум в семидесятых-восьмидесятых, теория игр заняла прочные позиции в некоторых отраслях социального знания. Эксперименты, в которых команда Нэша в свое время фиксировала особенности поведения игроков, в начале пятидесятых были расценены как провал. Сегодня они легли в основание «экспериментальной экономики». «Равновесие Нэша» активно используется в анализе олигополий: поведении небольшого количества конкурентов в отдельном секторе рынка.

Кроме того, на Западе теория игр активно используется при выдаче лицензий на вещание или связь: выдающий орган математически высчитывает наиболее оптимальный вариант распределения частот.

Список литературы

1. Васин А. А., Морозов В. В. Теория игр и модели математической экономики. -- М.: МГУ, 2005, 272 с.

2. Воробьёв Н. Н. Теория игр для экономистов-кибернетиков. -- М.: Наука, 1985

3. http://dic.academic.ru/dic.nsf/econ_dict/22119

4. http://economicportal.ru/ponyatiya-all/nash_equilibrium.html

Размещено на Allbest.ru

...

Подобные документы

Проблемы неравномерного распределения доходов среди населения. Закон распределения Парето: зависимость между размером доходов и количеством людей. Распределение Парето в теории катастроф. Методы обработки данных с распределением с тяжелыми хвостами.

курсовая работа , добавлен 06.01.2012

Особенности формирования математической модели принятия решений, постановка задачи выбора. Понятие оптимальности по Парето и его роль в математической экономике. Составление алгоритма поиска парето-оптимальных решений, реализация программного средства.

контрольная работа , добавлен 11.06.2011

Разработка математической модели оптимальной расстановки игроков футбольной команды на поле с учетом распределения игровых обязанностей между футболистами и индивидуальных особенностей каждого для достижения максимальной эффективности игры всей команды.

курсовая работа , добавлен 04.08.2011

Сравнительная характеристика эффективности и простоты применения зажиточных за Кондорсе правил голосования Копленда и Симпсона, законов Бордо и оптимальности по Парето с целью разработки автоматизированной программы для нахождения победителя выборов.

курсовая работа , добавлен 20.08.2010

Условия равновесия в экономической модели. Методы регулирования совокупного спроса. Исследование возможностей получения эффективных равновесий в макроэкономике. Использование монетарной и фискальной политик в процессе регулирования рыночных отношений.

дипломная работа , добавлен 18.11.2017

Экономическое равновесие, условия и методы его достижения, ценовые и неценовые причины нарушения. Общая модель рынка по Вальрасу, ее применение в обосновании экономического равновесия, отличия от модели Эрроу-Дебре. Устойчивость конкурентного равновесия.

курсовая работа , добавлен 19.06.2009

Цель сервисной деятельности, формы обслуживания потребителей. Анализ эффективности работы организации в сфере обслуживания. Понятие системы массового обслуживания, ее основные элементы. Разработка математической модели. Анализ полученных результатов.

контрольная работа , добавлен 30.03.2016

Типы многокритериальных задач. Принцип оптимальности Парето и принцип равновесия по Нэшу при выборе решения. Понятие функции предпочтения (полезности) и обзор методов решения задачи векторной оптимизации с использованием средств программы Excel.

реферат , добавлен 14.02.2011

Классическая теория оптимизации. Функция скаляризации Чебышева. Критерий Парето-оптимальность. Марковские процессы принятия решений. Метод изменения ограничений. Алгоритм нахождения кратчайшего пути. Процесс построения минимального остовного дерева сети.

контрольная работа , добавлен 18.01.2015

Рассмотрение теоретических и практических аспектов задачи принятия решения. Ознакомление со способами решения с помощью построения обобщенного критерия и отношения доминирования по Парето; примеры их применения. Использование критерия ожидаемого выигрыша.

Проявляет себя в реальности, дабы показать, что это понятие является не просто абстрактным термином, а обобщением реально существующей закономерности. Однако, несмотря на наглядность примера, на основании только его одного может показаться, что мы наткнулись на какой-то вырожденный случай. Поэтому имеет смысл рассмотреть и более общее описание данного правила.

Многие читатели, возможно, знакомы с равновесием Нэша по одному весьма распространённому его частному случаю - так называемой «дилемме заключённого». Его суть примерно в следующем.

В тюрьме находятся два заключённых, которых взяли с поличным по отдельности, но ещё подозревают в более тяжких преступлениях. Если участие докажут, то срок заключённых возрастёт до десяти лет. Сейчас же они отсиживают по году каждый. Следствие предлагает каждому из них пойти на сделку и дать показания против второго. В этом случае первому срок скостят до полугода, а второй сядет на десять. Однако заключённые понимают, что если они оговорят друг друга, то вряд ли их обоих пощадят - скорее добавят каждому ещё лет по пять.

Расклад можно отобразить при помощи следующей таблицы.

Легко видеть, что «зелёные» варианты (1, 2) и (2, 1) являются симметричными, в двух же других положение заключённых будет идентичным. Поэтому можно рассмотреть логику ситуации с точки зрения только одного из заключённых - для второго она будет такой же.

Заключённый, разумеется, хочет наименьшего срока для себя. Но если он будет хранить молчание, то, возможно, его коллега даст против него показания, чем повысит ему срок до десяти лет. Если бы не обещанное снижение срока, то можно было бы тешить себя мыслью «а зачем мне это?», но соблазн снизить срок слишком вели́к. Кроме того, второй заключённый, как понимает первый, будет подозревать его, первого, в том, что он даст показания против второго и повысит тем самым ему срок.

«Обидно будет оказаться крайним и загреметь на десять лет», - думает первый. Но «и второй наверняка думает так же, и так же подозревает меня, - понимает он, - а потому шансов, что коллега меня не заложит, очень мало. Выходит, надо давать показания: если второй каким-то чудом промолчит, то будет полгода, проговорится - пять. Ну хоть не десять, которые я неизбежно получу из-за разоткровенничавшегося со следствием моего подельника!».

«Оранжевый» вариант (1, 1) является удобоваримым для обоих и в каком-то смысле это оптимум в данной ситуации. Однако у каждого есть ещё лучший вариант - соответствующий «зелёный» (1, 2) или (2, 1). В результате чего на деле будет реализован «красный» вариант (2, 2).

Можно сказать, что для каждого из заключённых он не так плох: всего пять лет против десяти в «зелёном» варианте в пользу подельника. Однако представим, что в «красном» варианте обоим дадут по десять. Логика в данном случае чуть-чуть поменяется: «если я его сдам, то хотя бы есть шанс отвертеться от десяти лет, а если промолчу - шансов нет, он меня наверняка заложит по тем же соображениям». Однако тут система подталкивает заключённых выбрать наихудший вариант из возможных. Действуя, что характерно, строго ради своей выгоды.

Рассмотрим теперь ещё одну ситуацию. Есть две фирмы - А и Б. Каждая из них может воспользоваться стратегией - Икс или Игрек. Однако на результаты оказывает влияние не только стратегия, выбранная самой фирмой, но и стратегия второй фирмы тоже. Выигрыш или проигрыш каждой из фирм мы представим в виде следующей таблицы.

Я специально для повышения накала страстей подобрал числа так, чтобы убыточное для обеих фирм состояние лишь незначительно отличалось бы от «соседних» с ним: тем удивительнее, что будет реализовано именно оно. Фирмы, действуя строго в своих интересах, с большой вероятностью захотят получить тысячу рублей вместо ста и тем самым не получат ничего, а наоборот, даже утратят. Переход же одной из фирм на стратегию Икс ещё сильнее ухудшит её положение - другая фирма будет обогащаться, а вторая терять ещё больше, хотя и незначительно больше.

Запишем вышеприведённые матрицы в более общем виде, абстрагировавшись от «фирм», «заключённых», «сроков» и «рублей». Положим, что у нас просто есть два игрока А и Б, играющие в некоторую игру, где на каждом ходе можно совершить один из двух ходов - Икс или Игрек. Выигрышем являются просто некие «баллы», наибольшее число которых каждый игрок и стремится набрать.

	А делает ход Икс	А делает ход Игрек
Б делает ход Икс	А: a 0 Б: b 0	А: a 1 > a 0 Б: b 1 < b 3
Б делает ход Игрек	А: a 2 < a 3 Б: b 2 > b 0	А: b 3 Б: a 3

Правила игры, представленные данной матрицей, будут «подталкивать» игроков к реализации «красного» варианта (2, 2), даже если выигрыши игроков в этом случае существенно меньше, чем во всех остальных вариантах. Правда, в зависимости от соотношения выигрышей (которые могут быть в том числе отрицательными - то есть проигрышами), обозначенных буквами «a» и «b» с индексами, частота реализации каждого из вариантов будет разной.

В частности, на выбор может влиять среднее арифметическое выигрышей при выборе каждой из стратегий, а также предположительная вероятность, с которой игрок сделает тот или иной ход (которая, кстати, может быть аппроксимирована частотой ходов, сделанных в предыдущих раундах). Так, в простейшем случае игрок А для оценки хода Икс складывает a 0 и a 2 и делит результат на два, полагая выбор хода со стороны Б равновероятным. То же самое он проделывает для хода Игрек - складывает a 1 с a 3 , после чего делит результат на два - и сравнивает результаты. В более сложном случае игрок считает сумму a 0 *p x + a 2 *p y , где p x и p y - вероятности ходов Икс и Игрек, сделанных игроком Б. Результат сравнивается с a 1 *p x + a 3 *p y .

Можно было бы, конечно, снова поделить результат на два, но поскольку деление на два имеет место быть для обоих вариантов хода, для сравнения величин эта операция необязательна, как, впрочем, и в случае «равновероятных ходов».

Также игрок может ориентироваться на сами величины. Например, если один из ходов означает вероятный проигрыш - особенно крупный, такой, какой игрок не может себе позволить, - игрок, не исключено, будет выбирать другой ход, даже если предположительный выигрыш при другом ходе в среднем ниже, но зато в обоих случаях положительный.

Наконец, надо помнить, что люди часто, скажем так, «помнят о другом игроке». Если второй игрок - конкурент или даже враг, то, возможно, будет иметь место тенденция выбирать такой ход, который навредит другому игроку, даже если первый игрок из-за этого выиграет мало, и даже, не исключено, проиграет. Если второй игрок - друг, то чаще будет выбираться ход, позволяющий чуть-чуть выиграть и ему тоже - в том случае, если «игра» - это не заранее заявленное соревнование, а какой-то процесс из реальной жизни. Возможности мести и поблажек, разумеется, зависят от соотношений в матрице - при некоторых из них скорее забудут, что соперник - твой друг, чем начнут ему слегка подыгрывать.

Иными словами, рассматриваемый нами принцип отображает именно что тенденцию, а не детерминированность. Чем сильнее соотношения значений выигрышей и проигрышей подобны фигурировавшим в «дилемме заключённого», тем чаще и быстрее система будет подводить игроков к «наихудшему» варианту и тем «более наихудшим» будет этот вариант.

Есть как бы «невидимая рука рынка», которая как бы невидимо подталкивает игроков… ну, вы знаете. Точнее, нет, может быть, и не знаете. В классическом варианте «рука рынка» как бы подталкивает куда всем надо, а тут она толкает совсем не туда. Не во всеобщее благо, а в перманентный кризис, которого при иных раскладах можно было бы избежать, что нам иллюстрирует и «дилемма заключённого», и гипотетический пример с конкуренцией фирм, и реальный пример с неизбежным завышением сроков разработки софта, о котором речь шла в предыдущей статье.

Рынок толкает игроков к равновесию Нэша, которое сколь угодно далеко может отстоять от их общего и личного блага.

В данном случае мы рассматривали только двух игроков и игру с двумя ходами, однако возможно и более широкое обобщение, которое как раз и является формулировкой равновесия Нэша:

Если в некоторой игре с произвольными количеством игроков и матрицей выигрышей существует такое состояние, что при выборе не соответствующего ему хода любым из игроков в отдельности его личный выигрыш уменьшится, то это состояние окажется «равновесным» для данной игры.

Кроме того, в ряде случаев ходы игроков будут иметь тенденцию стремиться к этому состоянию, даже если в этой игре есть другие состояния, в рамках которых выигрыш игроков в целом и/или по отдельности выше.

Приводить примеры такого общего случая способом, подобным ранее использованному, ощутимо тяжелее, поскольку добавление каждого игрока будет добавлять ещё одно измерение к матрице выигрышей. Однако об этом - позже.

На протяжении всей жизни человек вынужден принимать определённые решения по самым разнообразным вопросам, начиная от бытовых споров - кто будет убирать комнаты в доме или как благоустроить свой город, и заканчивая международными переговорами, многомиллионными аукционами и даже военными действиями. И во всех этих ситуациях человек стремится максимизировать свой собственный выигрыш. Но при этом ему всегда приходится выбирать: сотрудничать с другими людьми или думать только о своей выгоде, не заботясь о выгоде других. Классическим примером, который показывает, что в погоне за личной выгодой не всегда можно достичь лучшего результата, выступает «Дилемма заключённого».

Двое заключённых А и Б подозреваются в совершении преступления, за которое им грозит до 10 лет лишения свободы. Но прямых улик пока нет. Поэтому следствие предлагает каждому из заключённых пойти на сделку - признаться в содеянном и свалить инициативу преступления на другого. Если один признается, а другой заключённый будет хранить молчание, то первому уменьшат срок заключения до трёх лет за содействие следствию, а второго посадят на 10 лет.

Если оба пойдут на сделку со следствием и сознаются в содеянном, то каждый получит по 5 лет. Однако, если оба будут молчать, то за отсутствием улик, их выпустят на свободу. Заключённые находятся в разных камерах, чтобы они не могли сговориться друг с другом и согласовать своё поведение на допросе. Ни один из них не знает точно, что сделает другой. Какое решение примет каждый из них? Что произойдёт?

У каждого заключённого есть выбор: молчать или признаться. Это и есть дилемма заключённого: должен ли он оговорить другого или должен попытать удачу и не признаваться, сильно при этом рискуя? В зависимости от выбора заключённых в этой ситуации возможны четыре исхода.

Рассмотрим их:

1. Если оба заключённых дают признательные показания, каждый из них получает по пять лет тюрьмы;

2. Если заключённый А будет хранить молчание, а заключённый Б даст показания против него, то первый сядет на 10 лет, а второй - на три года;

3. И наоборот, если заключённый А признается, а заключённый Б будет хранить молчание, то первый сядет на три года, а второй - на 10 лет;

4. А если оба будут молчать, то за отсутствием улик из выпустят на свободу.

Какой из этих исходов наиболее реален? Чтобы ответить на этот вопрос, нужно знать, как рассуждает каждый из них. Вот как рассуждает заключённый А:

« Допустим, что заключённый Б признается. Если я тоже признаюсь, то получу 5 лет. Если же буду молчать - получу 10 лет. Значит, если заключённый Б признается, мне тоже лучше признаться в содеянном.

Если же заключённый Б будет хранить молчание, как следует поступить мне? Если признаюсь - получу 3 года. А если тоже буду молчать, то выйду на свободу. Это, конечно, идеальный вариант, но я не уверен, что заключённый Б будет молчать, я ему не доверяю. Поэтому мне лучше дать показания.

Значит, что бы ни делал заключённый Б, мне лучше признаться».

Ход рассуждений заключённого Б аналогичный, и он также приходит к выводу, что для него выгоднее признаться, независимо от того, что будет делать заключённый А.

Что же получается? Каждый из заключённых выбрал стратегию, которая, хотя и не приводит к самому лучшему результату (выходу на свободу), но является наилучшей для каждого из них при любом поведении соперника. Так как цель каждого заключённого - минимизировать свой срок заключения, не заботясь о другом заключённом, то признаться и оговорить другого - наиболее выгодная стратегия для каждого из них. Проще говоря, не важно, что сделает другой, каждый выиграет больше, если предаст. Поэтому заключённые выберут стратегию «Признаться» и получат по 5 лет тюрьмы.

Итак, на этом примере мы увидели, что решение, принимаемое одним игроком, влияет на решение другого (и наоборот) и в итоге влияет на конечный исход игры.

Другими примерами игр, в которых участвуют люди с несовпадающими (противоположными) целями, когда результат зависит от решений всех участников, могут послужить игра в покер, шахматы, пенальти в футболе и многие другие игры.

Но, наряду с традиционными играми, между людьми существуют и такие серьёзные отношения как рыночная конкуренция, гонка вооружений, загрязнение окружающей среды, выборы, торговля и др. Например, компании, конкурирующие на рынке, при принятии решений должны оглядываться на действия конкурентов. Или другой показательный пример - гонка вооружений между Советским Союзом и США в 1950-1990-х годах. В течение почти полувека две великие страны тратили много денег на вооружение, не отставая друг от друга. Если бы между ними было доверие, они бы не тратили столько средств на вооружение, а потратили бы их с бо льшей пользой (на образование, здравоохранение, пенсии и т. п.) и обе стороны выиграли бы от этого. Но вместо этого каждая страна, не доверяя другой, продолжала производить оружие и никто от этого не выигрывал.

Все эти серьёзные отношения тоже называют играми, поскольку в них, как и в обычных играх, результат зависит от решений (стратегий) всех участников. А наука, которая изучает эти серьёзные отношения, называется теорией игр. Поэтому слово «игра» в данном случае не должно вводить вас в смятение. Это понятие в теории игр трактуется шире, чем в повседневной жизни.

Равновесие Нэша

Итак, в «Дилемме заключённого» ситуация складывается таким образом, что, поступая по отдельности рационально и разумно, в итоге заключённые получают по пять лет тюрьмы. Однако, как мы уже отметили, это не самый оптимальный исход. Есть вариант и получше: выйти на свободу, если оба будут молчать.

Наверняка каждый из заключённых, когда принимал решение, рассуждал так: «Если мы оба будем молчать, то выйдем на свободу. Конечно, это лучше, чем сесть на пять лет. Но где гарантия, что второй тоже будет молчать? Ведь если я буду молчать, а другой даст показания, то я сяду на целых 10 лет! Нет, уж лучше я признаюсь в содеянном».

Очевидно, что взаимное недоверие друг к другу не позволяет реализоваться ситуации, когда каждый выйдет на свободу. К тому же заключённые сидят в разных камерах и каждый принимает решение, не зная о решении другого и у каждого есть соблазн дать показания против другого и получить 3 года вместо 5 или 10 лет. Получается, что самый лучший исход - выйти на свободу - является ненадёжным и нестабильным. Именно поэтому заключённые выбрали такие стратегии, которые привели пусть не к самому лучшему исходу, но зато надёжному и исключающему риск обмана и предательства. Такой исход называется равновесием Нэша.

Равновесие Нэша (Nash equilibrium ) - это такая комбинация стратегий игроков и их выигрышей, при которой ни один из игроков не может увеличить свой выигрыш, изменив свою стратегию, если при этом другие участники своих стратегий не меняют. Примечание: равновесие Нэша существует в играх, в которых игроки действуют независимо друг от друга и не могут объединяться и координировать свои действия.

Простыми словами, равновесие Нэша - это такая ситуация, когда стратегия каждого игрока является наилучшей реакцией на стратегии других игроков и ни одному игроку невыгодно в отдельности менять свою стратегию.

Равновесие Нэша - это не самый лучший исход из всех возможных, но в ситуации, когда каждый играет сам за себя, это оптимальный исход для каждого игрока, потому что сводятся к нулю риски и потери каждого игрока, которые могли бы быть, если другой игрок решит его обмануть или предать.

Равновесие Нэша - это устойчивое равновесие, потому что игрокам выгодно его сохранять, так как любое изменение ухудшит их положение. Но если в отношениях между игроками появляется сотрудничество, равновесие Нэша перестаёт быть равновесным, потому что появляется возможность достичь более лучшего результата. Например, если бы в «Дилемме заключённого» у игроков была возможность договориться о сотрудничестве, а именно - вдвоём хранить молчание, либо, если бы у них не было сомнений в том, что другой не предаст и тоже будет молчать, то ситуация могла бы закончиться для обоих с более лучшим исходом - выходом на свободу.

Вывод: Равновесие Нэша показывает, что каждый игрок может выиграть больше, если между игроками будут существовать сотрудничество, доверие и честность, и каждый игрок, делая лучше для других, сделает лучше для себя.

Иллюстрация с сайта postnauka.com

Статьи по теме