НАЗАДИССЛЕДОВАНИЯ
AV.N.E.519.001Исследование · Интерактивная научная заметка

Камень · Ножницы · Бумага

Можно ли получить преимущество в совершенно честной игре?

В одном раунде почти нет материала для предсказания. Камень побеждает Ножницы. Ножницы побеждают Бумагу. Бумага побеждает Камень. Ни один знак не сильнее остальных. Но в серии раундов в игру вступает память. Человек помнит, чем только что выиграл и чем проиграл. Иногда повторяет удачный ход, иногда меняет неудачный. Поэтому против совершенно непредсказуемого соперника игра остаётся честной. Против человека - не всегда.

Правило, которое стоит попробовать

Для начала - простое правило. Расположите три знака в цикле. После победы - один шаг вправо. После поражения - один шаг влево.

Бумага
Ножницы
Камень
затем снова Бумага
Вы победили → вправоВы проиграли → влево
Вы только что сыграли Бумагой

Что произошло с этим ходом?

Попробуйте несколько раундов. А затем разберёмся, почему такое простое правило вообще может работать против человека.

Почему это может работать

Правило способно помочь, только если следующий выбор соперника зависит от того, что только что произошло. Логику показывают два конкретных примера.

01
Что произошло
Вы сыграли Ножницы. Соперник сыграл Камень. Вы проиграли, поэтому соперник только что выиграл.
Прогноз хода соперника
Снова Камень
Ваш ответный ход
Бумага - один шаг влево от Ножниц

Победители в эксперименте чаще повторяли удачный знак. Если соперник снова выберет Камень, вам нужна Бумага. В практическом цикле Ножницы → Бумага - это шаг влево. Поэтому именно ветвь «вы проиграли - влево» яснее всего связана с наблюдаемой тенденцией повторять знак после победы.

02
Что произошло
Вы сыграли Бумагу. Соперник сыграл Камень. Вы выиграли, поэтому соперник только что проиграл.
Прогноз хода соперника
Камень → Бумага
Ваш ответный ход
Ножницы - один шаг вправо от Бумаги

Правило предполагает, что проигравший соперник сменит Камень на Бумагу. Ножницы побьют предсказанную Бумагу, поэтому Бумага → Ножницы - это шаг вправо. Именно эта часть правила менее надёжна. После поражения люди действительно часто меняют поведение, но направление смены зависит от человека и условий.

54 000 партий

Чтобы увидеть такие зависимости, одного вечера за столом недостаточно.

В период с 2010 по 2014 год Zhijian Wang, Bin Xu и Hai-Jun Zhou провели в Чжэцзянском университете эксперимент с 360 участниками. Их разделили на 60 групп по шесть человек. Каждая группа сыграла 300 раундов; в каждом раунде компьютер случайным образом составлял три пары.

60групп
300раундов
3партий в раунде
54 000проведённых партий
Расчёт полного числа проведённых партий

Всего было проведено 54 000 парных партий. Одну группу из шести человек исключили из основного анализа из-за нетипичного поведения. В отобранных данных остались 354 участника, 59 групп и 53 100 партий.

Равные доли - ещё не случайность

По итоговым долям игрок может выглядеть совершенно непредсказуемым. Но порядок ходов способен рассказать гораздо больше.

Можно выбирать каждый знак ровно в трети случаев и при этом делать следующий ход очевидным. Баланс описывает итоговые доли. Независимость показывает, помогают ли предыдущие события предсказать продолжение.

Камень · 1/3Бумага · 1/3Ножницы · 1/3
Один и тот же итоговый баланс
Камень
Бумага
Ножницы
Камень
Бумага
Ножницы
Камень
Бумага
Ножницы
Повтор
Равные доли; полностью заданная последовательность

Последовательность может быть идеально сбалансированной и идеально предсказуемой.

Что меняется, когда победа становится важнее

Эксперимент проводили в нескольких условиях. Правила не менялись. Исследователи меняли только ценность победы относительно ничьей.

В одних группах победа была лишь немного ценнее ничьей. В других она становилась заметно важнее. Вместе со структурой вознаграждения менялось и поведение. Когда разница между победой и ничьей была небольшой, участники чаще повторяли предыдущий знак. Когда победа становилась заметно ценнее, после поражения игроки чаще переходили в направлении Камень → Ножницы → Бумага → Камень. Авторы называли такой направленный переход clockwise shift, или смещением по часовой стрелке. Даже в этой простой игре люди реагировали по-разному в разных условиях.

Эти две схемы показывают только направление перехода между знаками. Они не означают, что оба направления одинаково наблюдались в эксперименте. Против часовой стрелки: камень, бумага, ножницы, камень. По часовой стрелке: камень, ножницы, бумага, камень.

В оригинальной работе относительная ценность победы обозначалась параметром a. Направленная реакция после поражения особенно проявлялась в условиях a ≥ 2. Эта запись нужна для научной точности; понимать её для использования практического правила не требуется.

Правило и эксперимент - не одно и то же

Здесь важно разделить удобное правило и результаты эксперимента.

Практическое начальное правило

Правило «победил - вправо, проиграл - влево» на цикле Бумага → Ножницы → Камень легко запомнить и можно сразу проверить в обычной игре.

Что обнаружили в исследовании

Данные показали, что следующий выбор зависел от предыдущего результата: победители нередко сохраняли знак, а реакции после поражения менялись вместе с условиями. Исследование не показало, что все люди точно следуют практическому правилу; направление после поражения особенно зависит от человека и условий.

Используйте правило не как закон, а как первую модель соперника. Если человек её подтверждает - пользуйтесь. Если нет - меняйте модель.

От закономерности к преимуществу

В обычной игре не нужно вычислять десятки вероятностей. Начните с цикла Бумага → Ножницы → Камень → Бумага: если вы победили - вправо, если проиграли - влево. Затем наблюдайте за соперником.

01

Наблюдать

Наблюдайте, что соперник делает после победы и поражения. Повторяет выигравший знак или меняет проигравший?

02

Предсказать

Назовите знак, который теперь кажется вероятнее. Полезная закономерность должна давать конкретный прогноз на следующий раунд.

03

Ответить

Выберите знак, который побеждает ваш прогноз. Если несколько прогнозов не сработали, обновите модель и меньше полагайтесь на это правило.

НаблюдатьПредсказатьОтветитьОбновить

Преимущество создаёт закономерность, которую повторяет соперник. Оно исчезает, когда закономерность меняется.

Когда правило перестаёт работать

Стратегия работает не против игры. Она работает против предсказуемости конкретного человека.

  1. Один соперник повторяет победивший знак, одинаково реагирует на поражение и долго не замечает закономерности.
  2. Другой использует иное правило, а короткая серия лишь случайно выглядит как привычка.
  3. Третий замечает, что его читают, и намеренно меняет стратегию.
  4. Четвёртый старается выбирать независимо и почти случайно, не оставляя полезной закономерности.

Меньше полагайтесь на правило, когда свидетельства ослабевают. Адаптация - часть стратегии, а не её неудача.

Машина изучает вас

Теперь поменяем роли. Машина не знает заранее, какой знак вы выберете. Она наблюдает только за тем, что уже произошло: что вы делаете после победы, как реагируете на поражение, повторяете ли знак и двигаетесь ли по одному циклу. Первые раунды дают ей мало информации. Если появляется устойчивая закономерность, она постепенно начинает использовать её. Цель здесь не просто выиграть, а сделать так, чтобы предыдущий раунд перестал помогать машине предсказывать следующий выбор.

Её ход фиксируется до того, как система получает ваш текущий выбор.

Сессия остаётся в этой вкладке браузера. История ходов не передаётся и не сохраняется.

Так это работает?

Да - против некоторых людей.

Особенно понятна логика после вашего поражения: соперник только что выиграл, а победители нередко повторяют удачный знак. Шаг влево выбирает ответ на такое повторение.

После вашей победы правило делает более смелое предположение о реакции проигравшего. Люди действительно часто меняют ход после поражения, но точное направление этой смены менее универсально.

Используйте правило как первую модель соперника, а не как закон. Продолжайте использовать эту закономерность, пока поведение соперника её подтверждает. Если нет - остановитесь раньше, чем предсказуемыми станете вы сами.

Вывод

В игре «Камень, ножницы, бумага» нет скрытого сильнейшего хода. Преимущество появляется в другом месте: в реакции человека на то, что только что произошло.

В эксперименте провели 54 000 партий. После исключения одной нетипичной группы основной анализ охватывал 59 групп, 354 участников и 53 100 партий. Именно в этих данных исследователи обнаружили зависимость следующего решения от предыдущего результата; реакции также менялись вместе с условиями. В качестве начальной модели шаг влево после вашего поражения отвечает на возможный повтор победителя, а шаг вправо после вашей победы остаётся более осторожной ставкой на то, как проигравший сменит ход. Сохраняйте модель только пока поведение соперника её подтверждает.

Не ищите последовательность, которая побеждает всех. Ищите закономерность человека, который играет перед вами.

Пределы свидетельств

Надёжный вывод скромнее, чем обещает популярное правило «после победы вправо, после поражения влево».

  1. Популярное правило «после победы вправо, после поражения влево» не было напрямую доказано Wang et al. как универсальный алгоритм победы.
  2. Тенденции на уровне популяции не определяют поведение отдельного человека.
  3. Лабораторные условия вознаграждения не тождественны обычной дружеской игре.
  4. Точное направление смены после поражения различается между исследованиями и условиями.
  5. Игрок может заметить, что его пытаются предсказать, и изменить поведение.
  6. Пятьдесят браузерных раундов не позволяют надёжно оценить все поведенческие стратегии.
  7. Равные частоты действий не гарантируют независимость.
  8. Детерминированный «научный победный цикл» становится уязвимым, как только соперник его распознаёт.

Свидетельства не устанавливают универсальную последовательность, побеждающую любого человека, обязательное правило после каждого результата или устойчивую психологическую черту, которую можно вывести из одной короткой сессии.

Источники

Первичные свидетельства отделены от дополнительного контекста. Нумерованные ссылки в тексте ведут к этой библиографии.

Первичные исследования

  1. Wang, Z., Xu, B. & Zhou, H.-J.

    Social cycling and conditional responses in the Rock-Paper-Scissors game.

    Scientific Reports 4, 5830 · 2014

    DOI: 10.1038/srep05830
  2. Dyson, B. J., Wilbiks, J. M. P., Sandhu, R., Papanicolaou, G. & Lintag, J.

    Negative outcomes evoke cyclic irrational decisions in Rock, Paper, Scissors.

    Scientific Reports 6, 20479 · 2016

    DOI: 10.1038/srep20479
  3. Sundvall, J. & Dyson, B. J.

    Breaking the bonds of reinforcement: Effects of trial outcome, rule consistency and rule complexity against exploitable and unexploitable opponents.

    PLOS ONE 17(2), e0262249 · 2022

    DOI: 10.1371/journal.pone.0262249
  4. Arai, K., Jacob, S., Widge, A. S. & Yousefi, A.

    Deviation from Nash mixed equilibrium in repeated rock–scissors–paper reflect individual traits.

    Scientific Reports 15, 14955 · 2025

    DOI: 10.1038/s41598-025-95444-6

Дополнительное исследование

  1. Brockbank, E. & Vul, E.

    Repeated rock, paper, scissors play reveals limits in adaptive sequential behavior.

    Cognitive Psychology 151, 101654 · 2024

    DOI: 10.1016/j.cogpsych.2024.101654