Введение
Тип ассоциативного процесса обучения для модификации поведения
Оперантное обусловливание, также называемое инструментальным обусловливанием, – это процесс обучения, в котором произвольное поведение изменяется посредством ассоциации с добавлением (или удалением) подкрепления или аверсивных стимулов. Частота или продолжительность поведения может возрастать за счет подкрепления или снижаться за счет наказания или угасания. Оперантное обусловливание берет начало в работах Эдварда Торндайка, закон эффекта которого постулировал, что поведение возникает в зависимости от того, являются ли его последствия удовлетворительными или неприятными. В XX веке оперантное обусловливание изучалось бихевиористами, которые полагали, что значительная часть, если не вся, психики и поведения может быть объяснена как результат обусловливания окружающей средой. Подкрепление – это стимулы окружающей среды, которые увеличивают вероятность проявления поведения, в то время как наказание – это стимулы, которые уменьшают эту вероятность. Оба типа стимулов могут быть дополнительно классифицированы на положительные и отрицательные, которые соответственно связаны с добавлением или удалением стимулов окружающей среды. Оперантное обусловливание отличается от классического обусловливания, при котором стимулы связываются с биологически значимыми событиями для выработки непроизвольных и рефлекторных реакций. В отличие от этого, оперантное обусловливание является произвольным и зависит от последствий поведения. Изучение поведения животных в XX веке было в значительной степени сосредоточено на анализе этих двух типов обучения, и они по-прежнему лежат в основе анализа поведения. Они также применяются в изучении социальной психологии, помогая прояснить определенные явления, такие как эффект ложного консенсуса.
Закон эффекта Торндайка
Оперантное обусловливание, иногда называемое инструментальным обучением, впервые было всесторонне изучено Эдвардом Л. Торндайком (1874–1949), который наблюдал за поведением кошек, пытающихся выбраться из самодельных ящиков-головоломок. Кошка могла выбраться из ящика, совершив простое действие, например, потянув за веревку или толкнув палку, но когда кошки оказывались в ящике впервые, им требовалось много времени, чтобы выбраться. С повторением попыток неэффективные действия совершались реже, а успешные – чаще, поэтому кошки выбирались все быстрее и быстрее. Люди, по-видимому, усваивают многие простые модели поведения посредством процесса, изученного Торндайком, который теперь называется оперантным обусловливанием. Иными словами, действия закрепляются, если приводят к положительному результату, и отбрасываются, если не приводят к нему или вызывают нежелательные последствия. Обычно это происходит без какого-либо осознанного планирования со стороны "учителя", но оперантное обусловливание использовалось родителями для воспитания детей на протяжении тысячелетий.
Б. Ф. Скиннер
Б. Ф. Скиннер (1904–1990) считается отцом оперантного обусловливания, и его работы часто цитируются в связи с этой темой. Его книга 1938 года «Поведение организмов: экспериментальный анализ» положила начало его пожизненному изучению оперантного обусловливания и его применению к поведению человека и животных. Следуя идеям Эрнста Маха, Скиннер отверг обращение Торндайка к ненаблюдаемым психическим состояниям, таким как удовлетворение, и построил свой анализ на наблюдаемом поведении и его столь же наблюдаемых последствиях. Скиннер полагал, что классическое обусловливание было слишком упрощенным для описания чего-либо столь сложного, как человеческое поведение. По его мнению, оперантное обусловливание лучше описывало человеческое поведение, поскольку рассматривало причины и следствия целенаправленных действий. Для реализации своего эмпирического подхода Скиннер изобрел камеру оперантного обусловливания, или «коробку Скиннера», в которой такие испытуемые, как голуби и крысы, изолировались и подвергались тщательно контролируемым стимулам. В отличие от ящика с загадками Торндайка, эта конструкция позволяла испытуемому совершать один или два простых, повторяющихся ответа, а скорость этих ответов стала основной поведенческой мерой Скиннера. Другое изобретение, кумулятивный регистратор, создавало графическую запись, по которой можно было оценить эти показатели ответа. Эти записи были основными данными, которые Скиннер и его коллеги использовали для изучения влияния различных графиков подкрепления на скорость ответа. График подкрепления можно определить как «любую процедуру, которая предоставляет подкрепление организму в соответствии с четко определенным правилом». Эффекты графиков, в свою очередь, стали основными результатами, на основе которых Скиннер разработал свою теорию оперантного обусловливания. Он также опирался на множество менее формальных наблюдений за поведением человека и животных. Многие работы Скиннера посвящены применению оперантного обусловливания к человеческому поведению. В 1948 году он опубликовал «Уолден Два» — художественный рассказ о мирной, счастливой и продуктивной общине, организованной на основе его принципов обусловливания. В 1957 году Скиннер опубликовал «Словесное поведение», в котором распространил принципы оперантного обусловливания на язык — форму человеческого поведения, которая ранее анализировалась лингвистами и другими совершенно иным образом. Скиннер определил новые функциональные отношения, такие как «манды» и «такты», чтобы отразить некоторые существенные аспекты языка, но он не ввел никаких новых принципов, рассматривая вербальное поведение как любое другое поведение, контролируемое его последствиями, которые включали реакции аудитории говорящего.
Истоки поведения операнта: изменчивость операнта
Оперирующее поведение, как говорят, "излучается", то есть изначально оно не вызывается каким-либо конкретным стимулом. Таким образом, возникает вопрос, почему оно происходит вообще. Ответ на этот вопрос аналогичен ответу Дарвина на вопрос о происхождении "новой" структуры тела, а именно – вариативность и отбор. Подобно этому, поведение индивида варьируется от момента к моменту по таким параметрам, как конкретные движения, величина прикладываемой силы или время реакции. Вариации, приводящие к подкреплению, укрепляются, и при последовательном подкреплении поведение стремится к стабильности. Однако вариабельность поведения сама по себе может изменяться посредством манипулирования определенными факторами.
Изменение поведения оператора: усиление и наказание
Подкрепление и наказание — основные инструменты, посредством которых изменяется оперантное поведение. Эти термины определяются их влиянием на поведение. Они могут быть положительными или отрицательными. Положительное и отрицательное подкрепление увеличивают вероятность поведения, за которым они следуют, в то время как положительное и отрицательное наказание уменьшают вероятность поведения, за которым они следуют. Другая процедура называется «угасание». Угасание происходит, когда ранее подкреплённое поведение больше не подкрепляется ни положительным, ни отрицательным подкреплением. В процессе угасания вероятность проявления поведения снижается. Периодическое подкрепление может привести к ещё большей задержке перед угасанием поведения из-за того, что для получения подкрепления требуется повторение опыта, в отличие от ситуации, когда подкрепление предоставлялось при каждой возможности до начала угасания. Существует в общей сложности пять типов последствий. Положительное подкрепление происходит, когда поведение (реакция) является вознаграждающим или за ним следует другой стимул, который является вознаграждающим, что увеличивает частоту этого поведения. Например, если крыса в клетке Скиннера получает пищу при нажатии на рычаг, частота её нажатий увеличится. Эта процедура обычно называется просто подкреплением. Отрицательное подкрепление (также известное как избегание) происходит, когда за поведением (реакцией) следует устранение неблагоприятного стимула, тем самым увеличивая частоту исходного поведения. В эксперименте с клеткой Скиннера неблагоприятным стимулом может быть громкий непрерывный шум; отрицательное подкрепление произойдёт, когда крыса нажмёт на рычаг, чтобы выключить шум. Положительное наказание (также называемое «наказанием посредством добавления стимула») происходит, когда за поведением (реакцией) следует неблагоприятный стимул. Пример: боль от шлепка, которая часто приводит к снижению этого поведения. Положительное наказание — запутанный термин, поэтому процедура обычно называется просто «наказанием». Отрицательное наказание (штраф) (также называемое «наказанием посредством удаления стимула») происходит, когда за поведением (реакцией) следует удаление стимула. Пример: отнятие игрушки у ребёнка после нежелательного поведения, что приведёт к снижению нежелательного поведения. Угасание происходит, когда поведение (реакция), которое ранее было подкреплено, больше не является эффективным. Пример: крысе сначала дают пищу много раз за нажатие на рычаг, пока экспериментатор перестаёт давать пищу в качестве награды. Крыса обычно нажимает на рычаг реже, а затем прекращает это делать. Нажатие на рычаг в этом случае считается «угаснувшим». Объекты, совершающие действие (например, крыса), не описываются как подкреплённые, наказанные или угасшие; подкрепляются, наказываются или угасают именно действия. Подкрепление, наказание и угасание — это не термины, использование которых ограничено лабораторными условиями. Естественные последствия также могут подкреплять, наказывать или гасить поведение и не всегда планируются или применяются намеренно.
Графики усиления
Графики подкрепления – это правила, определяющие условия предоставления подкрепления. Эти правила указывают либо время, когда подкрепление становится доступным, либо количество необходимых реакций, либо и то, и другое. Существует множество различных правил, но наиболее базовыми и часто используемыми являются следующие: Немедленность: немедленное подкрепление эффективнее отсроченного. Если дать собаке лакомство за выполнение команды "сидеть" в течение пяти секунд, она обучится быстрее, чем если лакомство будет дано через тридцать секунд. Зависимость от реакции: для максимальной эффективности подкрепление должно последовательно следовать за реакцией и не происходить в другое время. Обучение может замедлиться, если подкрепление является прерывистым, то есть следует только за некоторыми проявлениями данной реакции. Реакции, подкрепляемые прерывисто, обычно труднее погасить, чем реакции, которые всегда подкреплялись. Поскольку не существует объективных критериев для определения усиления поведения, использование термина "неконтингентное подкрепление" вызывает споры.
Immediacy: An immediate consequence is more effective than a delayed one. If one gives a dog a treat for sitting within five seconds, the dog will learn faster than if the treat is given after thirty seconds. Contingency: To be most effective, reinforcement should occur consistently after responses and not at other times. Learning may be slower if reinforcement is intermittent, that is, following only some instances of the same response. Responses reinforced intermittently are usually slower to extinguish than are responses that have always been reinforced. As no measured behavior is identified as being strengthened, there is controversy surrounding the use of the term noncontingent "reinforcement".
Контроль поведения операнта
Хотя изначально оперантное поведение проявляется без явной связи с конкретным стимулом, в процессе оперантного обусловливания операнты начинают контролироваться стимулами, присутствующими в момент подкрепления поведения. Эти стимулы называются "дискриминативными стимулами". В результате формируется так называемая "трехчленная зависимость". То есть, дискриминативные стимулы сигнализируют о возможности получения вознаграждения или наказания за определенные реакции. Например, крысу можно обучить нажимать на рычаг только при включении света; собака спешит на кухню, услышав шуршание своего пакета с кормом; ребенок тянется к конфетам, когда видит их на столе.
Дискриминация, обобщение и контекст
Большинство поведения находится под контролем стимулов. Можно выделить несколько аспектов этого: Дискриминация обычно возникает, когда подкрепление ответа происходит только в присутствии определенного стимула. Например, голубя могут кормить за клевание красного света, но не зеленого; в результате он начинает клевать красный и прекращает клевать зеленый. Изучено множество сложных комбинаций стимулов и других условий; например, организм может получать подкрепление по интервальному графику в присутствии одного стимула и по пропорциональному графику в присутствии другого. Обобщение – это тенденция реагировать на стимулы, сходные с ранее обученным дискриминационным стимулом. Например, если голубь был обучен клевать "красный", он может также клевать "розовый", хотя обычно и менее интенсивно. Контекст относится к стимулам, которые постоянно присутствуют в ситуации, таким как стены, столы, стулья и т.д. в комнате или внутренняя среда камеры для оперантного обусловливания. Контекстные стимулы могут контролировать поведение, как и дискриминационные стимулы, хотя обычно более слабо. Поведение, усвоенное в одном контексте, может отсутствовать или изменяться в другом. Это может создавать трудности для поведенческой терапии, поскольку поведение, усвоенное в терапевтической среде, может не проявляться в других ситуациях.
Discrimination typically occurs when a response is reinforced only in the presence of a specific stimulus. For example, a pigeon might be fed for pecking at a red light and not at a green light; in consequence, it pecks at red and stops pecking at green. Many complex combinations of stimuli and other conditions have been studied; for example an organism might be reinforced on an interval schedule in the presence of one stimulus and on a ratio schedule in the presence of another. Generalization is the tendency to respond to stimuli that are similar to a previously trained discriminative stimulus. For example, having been trained to peck at "red" a pigeon might also peck at "pink", though usually less strongly. Context refers to stimuli that are continuously present in a situation, like the walls, tables, chairs, etc. in a room, or the interior of an operant conditioning chamber. Context stimuli may come to control behavior as do discriminative stimuli, though usually more weakly. Behaviors learned in one context may be absent, or altered, in another. This may cause difficulties for behavioral therapy, because behaviors learned in the therapeutic setting may fail to occur in other situations.
Поведенческие последовательности: условная подкрепление и цепление
Большинство поведения нельзя легко описать в терминах отдельных реакций, подкрепляемых поочередно. Область оперантного анализа расширяется благодаря концепции поведенческих цепочек – последовательностей реакций, связанных между собой трехкомпонентными зависимостями, описанными выше. Цепочки строятся на том факте, который был экспериментально продемонстрирован: дискриминационный стимул не только задает условия для последующего поведения, но и может подкреплять предшествующее ему поведение. Иными словами, дискриминационный стимул также является "условным подкреплением". Например, свет, сигнализирующий о возможности нажатия рычага, может использоваться для подкрепления "поворота" в присутствии шума. Это приводит к последовательности: "шум – поворот – свет – нажатие рычага – пища". Гораздо более длинные цепочки можно построить, добавляя больше стимулов и реакций.
Бегство и избегание
В обучении избеганию, поведение прекращает (аверсивный) стимул. Например, закрывание глаз от солнечного света прекращает (аверсивное) воздействие яркого света на глаза. (Это пример отрицательного подкрепления, определенного выше.) Поведение, которое поддерживается предотвращением стимула, называется "избеганием", как, например, надевание солнцезащитных очков перед выходом на улицу. Поведение избегания порождает так называемый "парадокс избегания", поскольку возникает вопрос, как отсутствие стимула может служить подкреплением? Этот вопрос рассматривается в нескольких теориях избегания (см. ниже). Обычно используются два типа экспериментальных установок: избегание с дискриминацией и свободное оперативное избегание.
Дискриминационное обучение избеганию
Эксперимент с дискриминационным избеганием включает в себя серию испытаний, в которых за нейтральным стимулом, таким как свет, следует нежелательный стимул, например, удар током. После появления нейтрального стимула оперативное действие, такое как нажатие на рычаг, предотвращает или прекращает действие нежелательного стимула. В начале эксперимента испытуемый не выполняет действие до наступления нежелательного стимула, поэтому эти первые испытания называются "испытаниями уклонения". По мере обучения испытуемый начинает реагировать во время действия нейтрального стимула, тем самым предотвращая появление нежелательного стимула. Такие испытания называются "испытаниями избегания". Считается, что в этом эксперименте задействовано классическое обусловливание, поскольку нейтральный СС (условный стимул) сочетается с нежелательным УС (неусловный стимул); эта идея является основой двухфакторной теории обучения избеганию, описанной ниже.
Свободно действующее обучение избеганию
При свободном оперантном избегании испытуемый периодически получает аверсивный стимул (часто электрический шок), если не совершает оперантный ответ; этот ответ задерживает начало шока. В этой ситуации, в отличие от дискриминированного избегания, нет предварительного сигнала о наступлении шока. Два ключевых временных интервала определяют скорость обучения избеганию. Первый – это интервал S S (шок-шок). Это время между последовательными шоками при отсутствии ответа. Второй интервал – интервал R S (ответ-шок). Он определяет, насколько оперантный ответ задерживает начало следующего шока. Каждый раз, когда испытуемый совершает оперантный ответ, интервал R S без шока начинается заново.
Теория избегания двух процессов
Эта теория была первоначально предложена для объяснения обучения дискриминированному избеганию, при котором организм учится избегать аверсивного стимула, уходя от сигнала, предвещающего этот стимул. В этом процессе задействованы два механизма: классическое обусловливание сигнала, за которым следует оперантное обусловливание реакции ухода:
а) Классическое обусловливание страха. Изначально организм испытывает сочетание условного стимула (СС) с аверсивным безусловным стимулом (US). Теория предполагает, что это сочетание формирует ассоциацию между СС и US посредством классического обусловливания, и из-за аверсивной природы US, СС начинает вызывать обусловленную эмоциональную реакцию (CER) – "страх". б) Подкрепление оперативного ответа за счет снижения страха. В результате первого механизма, СС теперь сигнализирует о страхе; эта неприятная эмоциональная реакция служит мотивацией для оперативных реакций, а реакции, прекращающие действие СС, подкрепляются устранением страха. Теория не утверждает, что организм "избегает" US в смысле предвидения его, а скорее, что организм "уходит" от неприятного внутреннего состояния, вызванного СС. Ряд экспериментальных данных представляются противоречащими двухфакторной теории. Например, поведение избегания часто очень медленно угасает, даже когда первоначальное сочетание СС и US больше не повторяется, поэтому можно было бы ожидать угасания реакции страха (см. Классическое обусловливание). Более того, животные, обученные избеганию, часто демонстрируют мало признаков страха, что позволяет предположить, что уход от страха не является необходимым условием для поддержания поведения избегания.
Теория операнта или "один-фактор"
Некоторые теоретики предполагают, что поведение избегания может быть просто частным случаем оперантного поведения, поддерживаемого его последствиями. В рамках этого подхода понятие "последствий" расширяется, включая чувствительность к определенной последовательности событий. Таким образом, при избегании последствием реакции является снижение интенсивности аверсивного воздействия. Фактически, экспериментальные данные показывают, что "избежание удара током" воспринимается как стимул и может выступать в качестве подкрепления. Когнитивные теории избегания развивают эту идею дальше. Например, крыса начинает "ожидать" удар током, если не нажимает на рычаг, и "не ожидать удара током", если нажимает, а поведение избегания усиливается, когда эти ожидания подтверждаются.
Нейробиологические корреляты
Первые научные исследования, выявившие нейроны, реагирующие таким образом, что это указывает на кодирование условных стимулов, были проведены Малоном де Лонгом и Р.Т. Ричардсоном. Также имеются данные о том, что дофамин активируется в сопоставимые моменты времени. Существует значительное количество свидетельств того, что дофамин участвует как в подкреплении, так и в аверсивном обучении. Дофаминовые пути проецируются значительно плотнее в области фронтальной коры. Холинергические проекции, напротив, плотны даже в задних отделах коры, таких как первичная зрительная кора. Исследование пациентов с болезнью Паркинсона, состоянием, обусловленным недостаточной активностью дофамина, дополнительно иллюстрирует роль дофамина в положительном подкреплении. Оно показало, что в период, когда пациенты не принимали лекарства, они легче обучались при аверсивных последствиях, чем при положительном подкреплении. Пациенты, принимавшие лекарства, демонстрировали обратную картину: положительное подкрепление оказывалось более эффективной формой обучения при высокой дофаминовой активности. Предполагается, что нейрохимический процесс с участием дофамина лежит в основе подкрепления. Когда организм испытывает подкрепляющий стимул, в мозге активируются дофаминовые пути. Эта сеть путей "высвобождает короткий импульс дофамина на множество дендритов, тем самым транслируя глобальный сигнал подкрепления постсинаптическим нейронам". Это позволяет недавно активированным синапсам повысить свою чувствительность к эфферентным (проводящим наружу) сигналам, тем самым увеличивая вероятность повторения недавних реакций, предшествовавших подкреплению. Статистически, эти реакции с наибольшей вероятностью были тем поведением, которое привело к успешному подкреплению. Однако, когда подкрепление применяется не сразу или не последовательно (нерегулярно), способность дофамина воздействовать на соответствующие синапсы снижается.
Вопросы о законе эффекта
Ряд наблюдений, по-видимому, показывает, что оперантное поведение может формироваться без подкрепления в смысле, определенном выше. Наиболее часто упоминаемым является феномен автоформирования (иногда называемый "отслеживанием сигнала"), при котором стимул неоднократно предшествует подкреплению, и в результате животное начинает реагировать на этот стимул. Например, загорается клавиша ответа, а затем предоставляется пища. После нескольких повторений голубь начинает клевать клавишу, даже если пища появляется независимо от того, клюет птица или нет. Аналогично, крысы начинают манипулировать небольшими предметами, такими как рычаг, когда пища появляется поблизости. Примечательно, что голуби и крысы продолжают демонстрировать такое поведение, даже когда клевание клавиши или нажатие рычага приводит к уменьшению количества пищи (обучение по упущению). Другим очевидным примером оперантного поведения, возникающего без подкрепления, является контрзагрузка. Эти и другие наблюдения, по-видимому, противоречат закону эффекта и побудили некоторых исследователей предложить новые концептуализации оперантного подкрепления (например, автоформирование рассматривается как пример классического обусловливания; процедура автоформирования, фактически, стала одним из наиболее распространенных способов измерения классического обусловливания). Согласно этой точке зрения, на многие виды поведения могут влиять как классические зависимости (стимул-реакция), так и оперантные зависимости (реакция-подкрепление), и задача экспериментатора состоит в том, чтобы выяснить, как эти зависимости взаимодействуют.
Приложения
Усиление и наказание широко распространены во взаимодействиях между людьми, и предложено и реализовано множество практических применений принципов оперантного обусловливания. Ниже приведены некоторые примеры.
Зависимость и зависимость
Положительное и отрицательное подкрепление играют центральную роль в развитии и поддержании зависимости и наркотической зависимости. Наркотическое вещество обладает внутренней награждающей ценностью, то есть функционирует как первичный положительный подкрепляющий фактор употребления. Система вознаграждения мозга придает ему стимульную значимость (то есть оно становится "желанным" или "стремимым"), поэтому по мере развития зависимости лишение наркотика вызывает влечение. Кроме того, стимулы, связанные с употреблением наркотика – например, вид шприца или место употребления – становятся ассоциированными с интенсивным подкреплением, вызванным наркотиком.
Прикладной анализ поведения
Прикладной анализ поведения – это дисциплина, инициированная Б. Ф. Скиннером, которая применяет принципы обуславливания к изменению социально значимого поведения человека. В ней используются базовые понятия теории обуславливания, включая условный стимул (SC), дискриминирующий стимул (Sd), реакцию (R) и подкрепляющий стимул (Srein или Sr для подкреплений, иногда Save для аверсивных стимулов). Проводятся исследования принципов, влияющих на преступное поведение, профилактику ВИЧ, сохранение природных ресурсов, образование, геронтологию, здоровье и физическую активность, промышленную безопасность, усвоение языка, загрязнение окружающей среды мусором, медицинские процедуры, воспитание, психотерапию, использование ремней безопасности, тяжелые психические расстройства, спорт, злоупотребление психоактивными веществами, фобии, нарушения пищевого поведения у детей, а также управление зоопарками и уход за животными. Некоторые из этих областей применения описаны ниже.
Обучение родителям по управлению поведением детей
Обеспечение положительного подкрепления желательного поведения ребенка – ключевой аспект тренингов для родителей по управлению поведением. Как правило, родители учатся поощрять желательное поведение с помощью социальных вознаграждений (например, похвалы, улыбок и объятий), а также материальных вознаграждений (например, наклеек или баллов, которые можно обменять на более крупную награду в рамках системы поощрений, разработанной совместно с ребенком). Кроме того, родители учатся сосредотачиваться на простых моделях поведения в начале работы и поощрять каждый небольшой шаг, который ребенок делает на пути к достижению более значимой цели (этот подход называется "последовательными приближениями").
Экономика
Как психологи, так и экономисты стали проявлять интерес к применению концепций и результатов оперантного обуславливания к поведению людей на рынке. Примером может служить анализ потребительского спроса, измеряемый количеством приобретенного товара. В экономике степень влияния цены на потребление называется "ценовой эластичностью спроса". Некоторые товары обладают большей эластичностью, чем другие; например, изменение цены на определенные продукты питания может существенно повлиять на объем покупок, в то время как на спрос на бензин и другие товары повседневного потребления изменения цен оказывают меньшее воздействие. С точки зрения оперантного анализа, подобные эффекты можно интерпретировать, учитывая мотивацию потребителей и относительную ценность товаров как подкреплений.
is the analysis of consumer demand, as indexed by the amount of a commodity that is purchased. In economics, the degree to which price influences consumption is called "the price elasticity of demand." Certain commodities are more elastic than others; for example, a change in price of certain foods may have a large effect on the amount bought, while gasoline and other everyday consumables may be less affected by price changes. In terms of operant analysis, such effects may be interpreted in terms of motivations of consumers and the relative value of the commodities as reinforcers.
Азартные игры планирование переменных коэффициентов
Как было сказано ранее в этой статье, схема с переменным отношением подкрепления обеспечивает вознаграждение после совершения непредсказуемого числа действий. Эта схема обычно вызывает быстрый и устойчивый ответ. Игровые автоматы выплачивают выигрыши по схеме с переменным отношением, и именно поэтому они вызывают у игроков настойчивое поведение, заключающееся в дергании за рычаг. Переменное отношение выплат в игровых автоматах и других формах азартных игр часто называют одним из факторов, лежащих в основе игровой зависимости.
Военная психология
Люди обладают врожденным сопротивлением убийству и не склонны действовать прямо и агрессивно по отношению к представителям своего вида, даже ради спасения жизни. Это сопротивление убийству на протяжении всей истории военных действий делало пехоту удивительно неэффективной. Это явление оставалось неизученным до тех пор, пока С. Л. А. Маршалл (бригадный генерал и военный историк) не провёл серию интервью с пехотинцами Второй мировой войны сразу после участия в боевых действиях. Знаменитая и вызывающая споры книга Маршалла «Люди против огня» показала, что лишь 15% солдат стреляли из винтовки с намерением убить противника в бою. После принятия армией США результатов исследований Маршалла в 1946 году, Управление исследований человеческих ресурсов армии США начало внедрять новые протоколы обучения, основанные на принципах оперантного обусловливания. Последующее применение этих методов позволило увеличить процент солдат, способных убивать, до примерно 50% в Корее и более 90% во Вьетнаме. Среди других усовершенствований методов военной подготовки – стрельбы на время, более реалистичные тренировки, многократные повторения, похвала от командиров, награды за меткость и групповое признание. К негативному подкреплению относится взаимный контроль сослуживцев или необходимость повторного прохождения курсов. Современная военная подготовка формирует реакцию среднего мозга на боевое давление посредством тщательного моделирования реальных боевых ситуаций, используя преимущественно классическое обусловливание Павлова и оперантное обусловливание Скиннера (обе формы бихевиоризма). Сотни исследований продемонстрировали эффективность похвалы в стимулировании позитивного поведения, в частности, в исследованиях, посвящённых использованию похвалы учителями и родителями для улучшения поведения и успеваемости детей. Также было показано, что похвала может усиливать позитивное поведение у окружающих, не являющихся непосредственными получателями похвалы (например, у одноклассников), посредством викариатного подкрепления. Эффективность похвалы в изменении поведения может варьироваться в зависимости от её формы, содержания и способа подачи. Чтобы похвала оказала положительное влияние на поведение, она должна быть непосредственно связана с этим поведением (то есть, произноситься только после его совершения), чётко указывать на конкретные аспекты поведения, которое необходимо закрепить, и быть выражена искренне и убедительно. Признавая эффективность похвалы как стратегии позитивного подкрепления, многочисленные поведенческие и когнитивно-поведенческие вмешательства включили её использование в свои протоколы. Стратегическое использование похвалы признано научно обоснованной практикой в управлении классом, хотя в исследованиях вмешательств похвала часто объединяется в более широкую категорию позитивного подкрепления, включающую такие стратегии, как целенаправленное внимание и поведенческие вознаграждения. Было проведено несколько исследований, посвящённых влиянию когнитивно-поведенческой терапии и оперантной поведенческой терапии на различные заболевания. Когда пациенты осваивали когнитивные и поведенческие техники, изменяющие их поведение, установки и эмоции, интенсивность боли уменьшалась. Результаты этих исследований показали влияние когнитивных процессов на восприятие боли и объяснили общую эффективность когнитивно-поведенческой терапии (КПТ) и оперантной поведенческой терапии (ОПТ).
Видеоигры
Большинство видеоигр созданы вокруг цикла вознаграждения, добавляя форму положительного подкрепления через график переменного соотношения, чтобы удержать игрока. Это может привести к развитию патологической зависимости от видеоигр. В рамках тенденции монетизации видеоигр, начавшейся в 2010-х годах, некоторые игры стали предлагать лутбоксы в качестве наград или предметов, приобретаемых за реальные деньги. Лутбоксы содержат случайный набор внутриигровых предметов. Эта практика связана с теми же механизмами, которые используются в игровых автоматах и других азартных устройствах, поскольку также основана на графике переменного соотношения. Несмотря на распространенное мнение о том, что лутбоксы являются формой азартных игр, официально таковыми они признаны лишь в нескольких странах. Однако возможность использования этих предметов в качестве виртуальной валюты для онлайн-азартных игр или обмена на реальные деньги привела к формированию рынка торговли скинами, который в настоящее время подвергается юридической оценке.
Оперативная кондиционирование и защитная медицина
Одной из многих причин, приводимых для объяснения резко возросших затрат на здравоохранение, является практика защитной медицины. Прабху анализирует статью Коула и обсуждает, как поведение двух групп нейрохирургов является классическим примером оперантного обусловливания. Одна группа практикует в штате с ограничениями на медицинские иски, а другая – в штате без таких ограничений. Нейрохирургов анонимно опросили об их практике. Врачи изменили свою практику в ответ на негативную обратную связь (опасение судебных исков) в группе, работающей в штате без ограничений на иски.