Сообщество - Доказательная психология!

Доказательная психология!

32 поста 13 подписчиков

Популярные теги в сообществе:

167

Продолжение поста «Гормоны оправдывают женские истерики?»3

Для ЛЛ: бегите.

Небольшая преамбула

Всё написанное ниже существует в рамках ответа, поэтому к нему отсылается и из него исходит. Напоминаю, что гражданин Психожесть в одной из своих публикаций разъяснил, что на повседневной жизни женщины (в т.ч. на её поведении и эмоциональности) отражается то, как в женском организме работают гормоны.

Далее Биохимичка — в качестве квази-ответа — выкатывает собственный пост, где предлагает поспорить с тезисом о том, что "у женщин гормоны скачут, потому перепады настроения и эмоциональные качели - это нормально".

С тезисом в такой формулировке и я бы поспорил, но в процессе аргументации гражданка протаскивает следующий тезис: "Если поведение женщины резко меняется в определённые фазы цикла, то наиболее вероятное объяснение — сознательная манипуляция, а не влияние гормональных изменений."

Для такого утверждения нужны серьёзные данные, показывающие, что в большинстве подобных случаев женщины сознательно симулируют потерю контроля или используют гормоны как предлог. В приведённом тексте таких данных нет.


Начнём с методологии мышления. Для этого нам понадобятся три важнейший для психологического мышления вещи: логика, тип влияния гормонов на поведение и биопсихосоциальная модель.

Логика

Попробуем разбить класс "женщины" (это не призыв к насилию) по двум основаниям: "есть легитимный физиологический драйвер" и "манипулирует". В итоге мы получим четыре класса, но сперва объясню смысл первого основания.

Сюда я отношу болезненные месячные или гормональную модуляцию настроения. Был соблазн построить повествование без второго, но оно нам необходимо. Ведь в этом был весь смысл: выяснить, зависит ли поведение женщины от цикла и гормонов, в фазы этого цикла "бушующие".

Истерику мы заменим на плохое или негативное поведение, ибо сомневаюсь, что окружающие негодуют только от истерик. Скорее всего, доёб идёт даже до ситуаций, когда женщина просто раздражена. И в таких ситуациях женщина может объяснять своё раздражение гормонами и ПМС.

Тогда у нас получается следующие 4 класса женщин:

  1. Манипулирующие женщины с легитимным основанием для плохо поведения.

  2. Манипулирующие женщины без легитимного основания.

  3. Не-манипулирующие с основанием.

  4. Не-манипулирующие без основания.

Как видим, четвёртый класс — идеальная женщина. У него нет болезненных месячных и сильного влияния гормонов на настроение. Она не манипулирует.

Морально самый худший класс — манипулирующие без основания. Именно сюда обычно целятся суждения вроде "ыааа монепуляторшы".

Однако люди не умеют делить логически даже на квадраты, поэтому регулярно зацепляют классы 1 и 3. То есть отказывают "не-манипулирующим женщинам с основанием" и "манипулирующим с основанием" в том, чтобы признать болезненность их положения. Признать, что ПМС действительно влияет на их поведение.

Хорошо. ПМС и гормоны влияют. Но как?

Типы влияния гормонов на поведения

Гормоны влияют на психику и поведение не одним способом, а минимум четырьмя.

Иллюстрация из книги Жукова Д. А. "Биология поведения: гуморальные механизмы"

Иллюстрация из книги Жукова Д. А. "Биология поведения: гуморальные механизмы"

Самым простым типом влияния является прямое влияние или индукция. Гормон запускает поведение сам, запускает дозозависимо и без участия ситуации. Чем выше концентрация — тем сильнее выражено поведение, независимо от контекста. Так работает инсулин в отношении голода: малые дозы вызывают чувство голода и пищевое поведение практически как рефлекс. Так же действуют альдостерон и другие минералокортикоиды на жажду, кортиколиберин — на тревогу, эндорфины — на эйфорию.

На сегодняшний день у человека надёжно подтверждено очень и очень мало таких форм: пищевое и питьевое поведение и два аффективных состояния (тревога и эйфория).

Второй тип — обеспечение — он же пороговый. Без гормона функция или психическая репрезентация отсутствует, но при достижении определённого уровня — появляется. Дальнейший рост концентрации сверх этого порога уже ничего не меняет, а все колебания находятся внутри рабочего диапазона и не коррелируют с колебаниями поведения.

Третье: организующее влияние в период внутриутробного созревания и раннего детства. Например, дефицит гормонов щитовидной железы на этапе развития приводи к кретинизму, а введение гормона взрослому это уже не исправят. По этой же логике не работает и попытка переключить мужское поведение на женское введением женских половых гормонов мужчине. Дело в том, что организующий эффект действуют один раз в узком временно окне, а не постоянно в течение жизни.

Наконец, последний, но самый важный тип влияния, который является и самым распространённым и касается темы статьи — модуляция. Модулирующее влияние гормона на поведение связано с тем, что гормон усиливает или ослабляет уже существующее поведение, но не создаёт его из ничего и не переключает через любые условия.

Вводить человеку окситоцин и рассчитывать, что он подобреет к тому, кого ненавидит, — глупость. На самом деле, учитывая некоторые современные данные о работе окситоцина, эффект может быть противоположный.

Половые гормоны и их связь с настроением в течение цикла по этому критерию — не индукция и не обеспечение, а модуляция: есть облегчение или затруднение уже существующей эмоциональной реакции на реальный повод. И эта разница принципиальна, ибо индукция вполне может снять вопрос "с чем связана эмоция?" — гормон и есть причина.

Модуляция вопрос не снимает, ибо эмоция всё равно на что-то реагирует, просто реагирует легче или тяжелее, чем без эмоционального сдвига.

Биопсихосоциальная модель

Биопсихосоциальная модель нужна здесь по той же причине, что и типология влияния гормонов, ибо она не даёт свалить всё в одну тривиальную кучу под названием "во всём виноваты гормоны" или, с равным успехом, "во всём виновата манипуляция". Она разносит одно и то же явление — эмоциональную нестабильность в определённой фазе цикла — по разным временным ролям, и в каждой роли гормоны — только один из игроков.

Модель психических расстройств из книги "Когнитивно-бихевиоральная терапия психических расстройств" Прашко, Можны, Шлепецки.

Модель психических расстройств из книги "Когнитивно-бихевиоральная терапия психических расстройств" Прашко, Можны, Шлепецки.

Предиспонирующие факторы — то, что делает конкретную женщину более уязвимой к выраженным перепадам настроения в принципе, ещё до всякого цикла, к ним относятся: индвидуальные различия в базовой чувствительности эмоциональной регуляции, складе характера, семейной истории аффективных расстройств и т.д. То есть здесь идёт речь о том, что диапазон реакций на одни и те же гормональные колебания или болезненность у разных людей разные ещё до того, как цикл начался.

Преципитирующий фактор в данном случае конкретен и очевиден — гормональный сдвиг лютеиновой фазы. Именно он запускает эпизод, но запускает у тех, у кого уже есть предрасположенность, а не создаёт её из ничего. Можете воспринимать его как спусковой крючок, который, строго говоря, причиной самой по себе не является. Сюда же относится боль. Боль прямо сейчас портит настроение прямо сейчас. У боли роль двойная.

Поддерживающие факторы — то, что удерживает и усиливает состояние уже после того, как оно началось, и здесь как раз есть место боли и ощущениям, о которых поговорим далее. Сюда мы относим недосыпы, спазмы, отмену привычной физической активности, избегание социальных ситуаций и прочее-прочее-прочее. Всё это уже не гормональные эффекты сами по себе, а поведенческие паттерны, которые продлевают и утяжеляют состояние, для которых гормональный сдвиг стал спусковым крючком.

Также есть модифицирующие факторы, которые расстройство не вызывают, но при уже развернувшемся эпизоде усиляют его. Сюда мы относим хронический недосып независимо от цикла, фоновый стресс на работе, физическое истощение. Всё это складывается с гормональными преципитирующими факторами.

И отдельно (вне предложенной схемы) выделяют протективные факторы. То есть факторы, которые защищают от негативных последствий или снижают тяжесть эпизодов. Это устойчивый режим сна, регулярная физическая активность, навыки эмоциональной регуляции (о чём тоже поговорим) и АХУЕТЬ поддержка со стороны близких. Это факторы, которые снижают вероятность или тяжесть эпизода.

Эти факторы не отменяют влияние гормонов, не разворачивают спазмы вспять, но укрепляют предиспонирующий фон и снижают нагрузку от поддерживающих и модифицирующих факторов.

Одна и та же женщина в один цикл переносит лютеиновую фазу почти незаметно, а в другой — тяжело, и разница чаще всего не в некоем гормональном сдвиге — гормональный сдвиг в среднем одинаков и организм к нему готовится, — а в том, сколько других факторов из этой сетки совпали в конкретном месяце. В прошлом месяце всё было хорошо, женщина — божий одуванчик. В этом месяц плохой сон, стресс на работе, отсутствие поддержки — туши свет.

Да, гормоны в большинстве случаев не диктуют. Но теперь, надеюсь, понятно, почему у меня от рассуждений Биохимички натурально горит.


Теперь немного о том, 1) как ожидания усиливают боль, 2) как эмоциональная регуляция связана с болью и 3) как конкретно менструальная боль связана с когнитивными факторами.

Самой базовой и авторитетной работой по первому вопросу является работа Atlas & Wager (2012) — это обзор по нейронауке боли, где говорится, что ожидания способны изменять субъективную интенсивность боли и активность болевых сетей мозга. То есть боль является не только отражением ноцицептивного сигнала, но и результатом его когнитивной обработки.

Для психологов, читавших "Основы общей психологии" Рубинштейна, это не новость.

Первое издание вышло в 1940-м году

Первое издание вышло в 1940-м году

Но есть и более свежий обзор Atlas (2023), где показано, что ожидания, обучение и вербальные установки оказывают измеримое влияние на болевой опыт через механизмы плацебо и ноцебо. Если человек заранее ожидает сильной боли и негативного опыта, это само по себе становится фактором усиления боли.

Но бога ради не нужно из этого делать вывод о том, что боль выдумана. Усиленная ожиданиями боль вполне реальна. Это говорит лишь о том, что практики КПТ, КОТОРЫМ ЕЩЁ НУЖНО НАУЧИТЬСЯ, могут снизить интенсивность боли или не раскручивать спирать "боль — страдание — страдание от страдания".

Второй корпус литературы как раз об этом и повествует. Kechlin et al. (2018) показали, что неадаптивные способы эмоциональной регуляции связаны с большей выраженностью боли и худшими психологическими исходами.

Работа Emotion regulation and pain: Behavioral and neuronal correlates (2016) рассматривает общие нейронные механизмы эмоциональной регуляции и болевой модуляции, включая роль префронтальной коры, так любимой у сторонников совладания со спазмами.

Ну и для любителей классики: Bushnell, Čeko & Low (2013), Cognitive and emotional control of pain and its disruption in chronic pain. Эмоции, внимание и когнитивный контроль способны как усиливать, так и ослаблять боль.

Мне же не лень. Я ещё раз повторю: усиленная ожиданиями и страданиями боль вполне реальна.

Наконец, самое интересное: менструальная боль, ожидания и катастрофизация.

Женщины с тяжёлой дисменореей заранее ожидали более сильную боль и демонстрировали больше тревоги, стресса и негативных эмоций перед менструацией. Ожидаемая боль и негативные эмоции коррелировали с последующей интенсивностью реально переживаемой боли. Exploring the role of negative expectations and emotions in primary dysmenorrhea (2025).

У подростков именно катастрофизация боли оказалась одним из лучших предикторов выраженности менструальной боли. Payne et al. (2016), Pain Catastrophizing Predicts Menstrual Pain Ratings.

Среди различных психосоциальных факторов именно катастрофизация наиболее надёжно предсказывала тяжесть менструальной боли. Chen et al. (2021), Pain catastrophizing is associated with menstrual pain severity.

Систематический обзор и метаанализ 2023 года по циклической тазовой боли обнаружил устойчивую положительную связь между катастрофизацией и выраженностью боли. The role of catastrophizing in chronic cyclical pelvic pain: A systematic review and meta-analysis, 2023.


Так что девочки)) не манипулируйте там)) сами себя чёт накуртили))0) потерпеть не можете?)) просто измените своё мышление))0))00)


Что касается воли и волевых усилий:

Хоть концепция истощения эго (воли) и является частично опровергнутой — Inzlicht & Berkman, 2017 — однако... (цитирую конспект, ибо дохрена написал и более адаптировать для Пикабу не хочу)

Продолжительная когнитивная нагрузка действительно может приводить к ухудшению работы исполнительных функций — внимания, рабочей памяти, тормозного контроля, когнитивной гибкости, — однако это не обязательно связано с исчерпанием некоего единого ресурса воли. Возможными механизмами считаются ментальная усталость, изменение мотивации, перераспределение внимания и изменение оценки затрат и выгод дальнейшего усилия.

То есть "самоконтроль" не бинарен. Его эффективность зависит от состояния когнитивной всей хуйни. Боль, недосып, стресс, эмоциональная нагрузка и длительное усилие могут снижать качество исполнительного контроля, даже если человек формально остаётся ответственным за свои поступки.


Если вы дочитали до конца, то вам нужно памятник поставить. А мне нужно взять перерыв и посмотреть, что граждане в комментариях понапишут.

ТГМАХъДонутСайт (там можно про теорию самодетерминации почитать)

Показать полностью 3
95

Ответ на пост «Гормоны оправдывают женские истерики?»3

Дано: Злобная Биохимичка отвечает гражданину Психожесть по вопросу влияния гормонов на женское поведение в период менструации.

Психожесть вообще не удосуживается раскрывать детали и нюансы, а просто пишет, что:

Это просто не может не отражаться на повседневной жизни женщины, в том числе - на ее поведении и эмоциональности.

По большей части, это всё предметное содержание поста. Если не обращать внимание на пассаж перед концом... Энивей, он большого отношения к обсуждаемому вопросу не имеет.

В целом, у Биохимички верно написано, что:

1. Гормоны влияют на настроение, но не определяют его.


2. У людей есть способность к эмоциональной саморегуляции.


3. Гормоны в основном оказывают модулирующее влияние, а не прямое.


4. Чем выше уровень эстрадиола у НЕКОТОРЫХ ПОДРОСТКОВ, тем активнее работает ДЛПФК во время попыток сознательно снизить негативные эмоции.


5. Гормональный фон влияет на то, как быстро и интенсивно мозг реагирует на эмоциональный стимул.


6. Во время ПМС наблюдается сложность в обработке конфликтной эмоциональной информации, которая требует большего когнитивного усилия.

Вместе с этим Биохимичка уже несколько месяцев страдает от одних и тех же ошибок, по которым впору делать бинго. Например:

1. Натуралистическая ошибка и умозрительная эволюционная выгодность. Гражданка вновь и вновь объясняет сложные формы поведения современного человека россказнями о том, что эволюционно это было выгодно.

Здесь это выражается в следующем пассаже:

Мы, понимаете ли, настолько крутые высокомерные прямоходящие обезьяны, настолько развитые, что умеем в эмоциональную регуляцию. Сей приятный навык доступен всем взрослым людям (исключение - тяжёлые психические расстройства). Вдобавок, это выглядит эволюционно выгодным приобретением. Полагаю, в более простые первобытные времена у тех девчонок, которые умели контролировать эмоции, было преимущество: их реже били и чаще любили. Думаете, это метафора такая? Ну ок.

Именно. Метафора. А если выражаться максимально точно, то это — just-so story — ключевой способ аргументации в эволюционной психологии. Взять некое поведение и придумать (!) ему разумное объяснение.

Надо ли говорит, что наука так не работает?

2. Разделение на эмоции и разум. Это выражается и в куске про интеграцию эмоциональной и когнитивной обработки, где когнитивная превыше всего. Это выражается вот здесь:

Они могут влиять на "настройки" мозга, делая эмоциональный ответ более интенсивным, но финальное поведение всегда определяется высшими отделами мозга, которые контролируют импульсы.

И здесь:

Это не потеря контроля, а скорее селективная сложность в обработке конфликтной эмоциональной информации, которая требует большего когнитивного усилия. Мозг всегда остается главным диспетчером.

Всё это — демонстрация той модели, которую современная аффективная нейронаука считает даже не упрощением, а явной и конкретной ошибкой. Люиз Пессоа в книге The Cognitive-Emotional Brain вот такое противопоставление называет мультяшным. Идея, что кора отвечает за разум, а лимбика — за эмоции, которая либо подавляется, либо захватывает мозг, даже на уровне анатомии не выдерживает никакой критики.

Зоны, которые считаются эмоциональными (все знают про миндалину, она же амигдала), задействованы во внимании и принятии решений. А я напоминаю, что принятие решений — когнитивная функция — вообще-то в этой схеме должна была быть в коре.

И наоборот: зоны, которые считают когнитивными (та же ДЛПФК), участвуют в генерации самой эмоции, а не только в её подавлении. Дело всё в том, что мозг — это сеть, там связь не иерархическая, а гетерархическая. Там нет командиров и подчинённых. Все регионы совместно формируют поведение. Никто никому ничего не диктует.

Иначе бы эта система была крайне уязвима.

Ирония в том, что собственный аргумент гражданки подрывает логику изнутри. В одном месте она приводит данные о функциональной связности между эстрадиолом и ДЛПФК-сетями как довод о том, что "гормоны не диктуют, потому что мозг сложно всё это интергирует" — то есть демонстрирует современную жопку современной, сетевой, распределённой и взаимной связанности модель. А в другом месте оказывает, что разум — главный диспетчер, а эмоции — подчинённые импульсы.

То есть использует интеграционные данные, чтобы аргументировать в пользу иерархической модели, которую эти же данные разбирают.

Нет, так не получится. Либо шашечки, либо ехать.

3. Ложная дихотомия.

Что, видели, как "вот у неё гормоны реально крышу сносят, а вне ПМС - милейшая девушка"? Поздравляю (нет), вы стали жертвой женской манипуляции (почти всегда) или свидетелем психических проблем у данного человека (редко).

Вот эта хрень даже в контраргументации не нуждается. После него гражданка пишет "Это - не моё мнение. Это - наука.", которое манипулятивноооооо шо пиздец. Нет, это ваше мнение, это ваша интерпретация. Да, объектом интерпретации выступают научные данные, но интерпретация — ваше мнение.


Если будет интересно, могу отдельно вопрос о влиянии менструации на поведение разобрать, но по запросу. К сожалению, писать без запроса сейчас никакого времени нет.

Показать полностью
2

Насколько различны мужчины и женщины и как это выяснить?

Серия Отношач

Карикатурные сравнения мужчин и женщин грешат либо полным отрицанием сходств, либо полным отрицанием различий. Никто в науке всерьёз не говорит о том, что мы тождественны или полностью несовместимы. Основное поле боя: размер эффектов и то, как разницу оценивать.

Публикация навеяна постами хлебушков.


Разговор о том, различны мужчины и женщины или нет ведётся давно, основной позицией является то, что мужчины и женщины различны. В процессе исследований (а их дохуятнадцать, то есть примерно больше 90 тысяч, из которых 750+ штук — мета-анализы) находили как малые и средние эффекты, так и большие.

И исходя из того, что доминирующей позицией является "мужчины и женщины сильно различны" в 2005-м году гражданка Хайд публикует статью (её изложение мы опубликовали на сайте: "Гипотеза гендерного сходства: исследование Hyde (2005)"), где анализирует данные и предлагает гипотезу гендерного сходства. В этой статье она на материале 124 эффектов из 46 мета-анализов показывает, что 78% эффектов оказались близкими к нулю или малыми (30% и 48% соответственно).

В ответ на публикацию Хайд и её гипотезу гендерного сходства некий итальянский гражданин по фамилии Дель Джудиче опубликовал методологическую статью (разбор, которой тоже есть у нас: "Расстояние Махаланобиса против среднего d: Del Giudice et al. 2012"), в которой подверг критике то, как Хайд оценивала разницу между мужчинами и женщинами.

Джудиче привёл аналогию: расстояние между городом А и городом Б не равно среднему по широте, долготе и высоте, оно равно евклидову расстоянию, которое оказывается почти вдвое больше, чем наивное усреднение.

Джудиче предлагает сравнивать не по отдельным эффектам, а агрегировать их в многомерный показатель, реализацией которого является расстояние Махаланобиса. И оценка гендерных различий через подобный агрегированный показатель значительно отличается от среднего по отдельным эффектам: D = 2.71, что соответствует всего 10% пересечения между распределениями мужчин и женщин.

Зелл и коллеги в 2015-м году (статья на сайте) перепроверили эффекты: взяли 386 эффектов, 106 независимых мета-анализов и совокупную выборку свыше 12 миллионов человек. Средняя абсолютная разница между мужчинами и женщинами по всем 106 мета-анализам составляет d = 0.21, что по конвенции Коэна попадает в категорию малых эффектов и соответствует примерно 84% пересечению распределений.

Это почти те же цифры, что у и Хайд, но методология у Зелл намного строже, а данные получены и обработаны принципиально другим способом. То есть то, что обнаружила Хайд, видимо, действительно есть: разница в отдельных эффектах между мужчинами и женщинами мала.

Однако малость среднего не означает стабильность частного. Оказалось, что эффекты, вошедшие в мета-анализы, статистически гетерогенны. Другим словами, в одном исследовании мужчины были агрессивнее женщин, а в другом — наоборот.

Зелл и коллеги согласны с Джудиче в том, что типичное различие по отдельно взятой переменной мало что говорит о совокупном различии.

И основным своим вкладом считают подтверждение гипотезы о том, что межиндвидуальные различия сильнее и крупнее средних межполовых.

Наконец, конкретное объяснение того, почему в исследованиях мужчины и женщины слабо отличаются по отдельным эффектам, но сильно отличаются по совокупности, дали довольно именитые исследователи Элис Игли и Уильям Ревелл.

Охуеть, но об этом тоже есть статья на сайте: "Почему гендерные различия то малы, то велики: Eagly and Revelle (2022)"

Если коротко, то авторы предлагают объяснение через методологию сбора и анализа данных, которое не требует ответа на вопрос "кто прав?". Они говорят, что большая часть разрыва между их собственным выводом об агрегации и разницей между числами Хайд/Зелл и Арчера объясняется даже не логикой агрегации, а произволом в решениях о том, какие мета-анализы включать в обзор.

Также они показывают, что увеличение разницы при переходе от отдельных эффектов к многомерным — вполне закономерный паттерн. Даже те методики, которые не предназначены для поиска различий между полами, дают рост разницы при переходе от одиночных эффектов к агрегированным данным.

Даже больше: практически всегда агрегированные данные значительно больше, чем одиночные эффекты. Авторы проверили это на крупнейших одиночных эффектах: тому, какова разница в профессиях.

Есть наблюдение, которое гласит, что мужчины тяготеют к работе с вещами, а женщины — с людьми. Эта разница — одна из крупнейших в межполовых сравнениях: 0.93 и 1.01, — и даже этот эффект оказывается меньше многомерного D.


Если подытожить, то даже научные изыскатели не вполне понимают, как ответить на вопрос "какова разница между мужчинами и женщинами?". Многие исследователи склоняются к тому, что сам по себе вопрос сформулирован неправильно. А на неправильный вопрос любой ответ — неправильный.

Мы гарантированно знаем, что:

  1. По одиночным эффектам разница между мужчинами и женщинами в основном мала.

  2. По совокупным оценкам разница между мужчинами и женщинами велика.

  3. Межполовая разница практически всегда меньше, чем разница между индивидами.

В принципе, мы можем сказать, что "в Х мужчины и женщины схожи" (то есть надо брать конкретное сравнение и смотреть на него), но это не означает, что мы схожи в принципе, вообще.

Предсказательная сила некоторых отдельных эффектов велика, а агрегированные данные подобным похвастаться не могут.

К счастью, то, что мы разные не является основанием для негативного отношения друг к другу. К сожалению, нередко именно различия выступают поводом не только негативно относить к противоположному (или своему) полу, но и выражать негатив дискриминацией в профессиях и отношениях.


ТГМАХъДонут

Показать полностью
10

Разница в либидо мужчин и женщин

Серия Отношач

"Мужчинам секс нужен больше, чем женщинам" — одно из самых устойчивых бытовых убеждений о различии полов.

Оно кажется самоочевидным: подтверждается наблюдением, подтверждается статистикой потребления порнографии, подтверждается тем, как устроены ухаживание и брак почти во всех известных культурах.

Проблема в том, что почти на каждом шаге, где это убеждение опирается на данные, есть отдельный, независимо задокументированный источник искажения, и эти источники разной природы, решают разные задачи и не сводятся друг к другу.


Самой цитируемой количественной сводкой является мета-анализ Petersen & Hyde (2010). В ней авторы обнаружили крупнейшую разницу по частоте мастурбации, заметную разницу по частоте фантазий, потреблению соответствующего контента, отношению к каузальному сексу и желаемому числу партнёров.

Есть кросс-культурная проверка на выборке около 53 стран в исследовании Lippa (2009). Там практически везде воспроизводится разница в самоотчётах, разница эта слабо коррелирует с индексами гендерного равенства в стране.

Это аргумент против объяснения разницы одной лишь культурой конкретного общества, но не доказательство биологической природы. Корреляционные данные между странами такого доказать не могут в принципе.

Есть и довольно свежий мета-анализ Frankenbach et al. (2022): крупнейший на сегодня мета-анализ, включивший 211 исследований, 856 эффектов и 610 тысяч голов в качестве испытуемых, который показал необработанный эффект g~0.69.

Если вы полезете проверять самостоятельно или попросите проверить нейронку, то неминуемо наткнётесь на то, что "ну это доказано, никаких сомнений".

Какие вообще могут быть вопросы? Вот устойчивый, воспроизводимый, кросс-культурный факт среднего-крупного размера. Об чём вообще речь?

Артефакты

Оказывается, если добавить в опрос детектор лжи, то сказка рушится. Дело даже не в том, что мы видим ложь испытуемых, а в том, что люди просто начинают давать более искренние ответы.

Alexander & Fisher (2003) продемонстрировали, что если давать одну и ту же анкету о сексуальном поведении в трёх разных условиях — 1) под угрозой, что экспериментатор увидит ответы; 2) анонимно; 3) и с "детектором лжи" — то люди отвечают по-разному.

Разница между полами была наибольшей под угрозой, что экспериментатор увидит ответы, средней в условиях анонимности и практически исчезала, если людей пугали детектором лжи — причём эффект был сильнее всего именно там, где действуют двойные стандарты (солоублажение и прон — то, в чём сознаваться менее социально приемлемо женщине, чем мужчине)

То есть мы видим, что часть измеренных различий — не разница в желании, а разница в готовности признать желание.

Вторым типом артефактов является проблема определения и измерения конструкта.

В исследовании Conley & Yang (2024) (это прямая полемика с Frankenbach) указано, что большинство исследований определяют секс как penile-vaginal intercourse, что как бы смещает измерение в сторону мужского опыта и потенциально хуже отражает то, что происходит у женщин.

Нужны вам отношения с партнёром? А если партнёр вас будет бить и унижать? Такие — не нужны. И мы знаем, что негативный опыт сказывается на желании.

Мужчины тоже начинают это чувствовать, я всё чаще слышу, что "женщины стали хреновые, руки опускаются, искать отношения желания нет".

Третий тип артефактов проще проиллюстрировать на аналогии средней температуры по больнице. Если в больнице с моргом равное количество мужчин и женщин, но по какой-то причине женщин в морге больше, то средняя температура по группе женщин окажется ниже.

Это не означает, что живые и здоровые женщины холоднее живых и здоровых мужчин. Просто групповое среднее — смесь подгрупп с разной причинной историей.

В исследовании Conley & Yang описано, что если часть женской выборки несёт опыт, системно снижающий желание (например, насилие или неудовлетворяющие партнёры), а у мужчин доля такого опыта меньше или его влияние на желание слабее, то среднее по группе будет "заражено" вкладом этой подгруппы.

Но с моргом всё очевидно: жив или мёртв, а с желанием всё гораздо сложнее. У желания такой границы нет. К тому же, причинность может идти в обе стороны: низкое желание может быть причиной худшего секса, а не только его следствием.

Так, это, вроде, четвёртый тип: попытка вычесть искажения. В исследовании Frankenbach была попытка статистически скорректировать эффект на предвзятость ответов (первый пункт), которая снизила разницу (с g=0.69 до 0.54). Разница не исчезла, но заметно снизилась именно за счёт того типа артефакта, который поддаётся прямой коррекции.

Conley & Yang в ответ указали на пункты 2 и 3, которые статистическая коррекция Frankenbach не затрагивает вообще, ибо они не связаны с искажением ответа, а связаны с тем, у кого и что вообще измеряется.

В том же 2024-м году Frankenbach с соавторами ответили на комментарий, в котором частично согласились, что асимметрия качества сексуального опыта может частично объяснять разрыв, но не согласились, что это устраняет эффект полностью, и защитили устойчивость своей меры к проверенным модераторам.

Короче, даже лучшая доступная сегодня оценка эффекта — это оценка, из которой вычтен только один из трёх известных источников искажения. Величина оставшегося эффекта после потенциального учёта пунктов — открытый вопрос, ответа с высокой уверенностью нет.


Масштаб всей хуйни

Даже необработанный g=0.69 означает по определению самой метрики, что межгрупповой сдвиг средних меньше, чем внутригрупповой разброс. В грубом приближении через нормальное распределение: вероятность, что случайно взятый мужчина покажет более высокий балл, чем случайно взятая женщина — около 69% против 50% при отсутствии разницы; около 25% женщин превышают среднего мужчину; перекрытие распределений — около 73%.

При скорректированном g=0.54 цифры смещаются в сторону ещё большего перекрытия.

Тот же паттерн наблюдался аж 20 лет назад в исследовании Хайда для десятков других психологических измерений: групповые различия почти везде малы-средни относительно внутригруппового разброса.


Физиологические данные (например, в работах Мередит Чиверс) с генитальной плетизмографией показывает, что у женщин корреляция между субъективным набуханием и генитальным откликом ниже, чем у мужчин. Плюс, генитальный отклик у женщин менее специфичен по объекту стимула.

Это с высокой долей вероятности означает, что связь между телом и осознаваемым желанием у женщин устроена иначе и менее интроспективно доступна. Про модель ответного и спонтанного желания уже писал.


Пора бежать. В следующей публикации расскажу о двух источниках, откуда есть пошла кулстори про то, что женщинам нужно меньше.


Подписывайтесь на ТГ: пишите вопросы, давайте ответы. Прости_хоспаде мах

Донут

Показать полностью
6

Все ли зависимы от ПАВ? Мыши и дофамин

Серия Дофамин и все-все-все

Внатуре нейросаенс... прошу прощения...

В Nature Neuroscience вышла работа, в которой отследили дофаминовые сигналы в прилежащем ядре мышей в реальном времени, пока те делали выбор между жирной пищей и оптогенетической и кокаиновой стимуляцией дофаминовых нейронов.

Нельзя сказать, что мы совершенно точно установили, что индивидуальные различия не сводятся к внешним условиям, но, видимо, так оно и есть. Генетически однородные мыши в одинаковых условиях* демонстрируют устойчивые различия в выборе.

И эти различия предсказываются дофаминовым ответом на предваряющие сигналы. То есть субъективная оценка формируется на уровне ассоциативного обучения, а не на уровне свойств самого вознаграждения. Ибо различий в дофаминовом ответе на калорийность пищи или силы стимула не обнаружено.

Важно и то, что дофамин после вознаграждения не предсказывает поведение, а вот реакция на сигнал перед вознаграждением — предсказывает. Это различие демонстрирует, что между этапами переработки информации есть разница в том, как формируется предпочтение.

Наконец, система остаётся пластичной, но не у всех. Изменение силы награды или введение наказания пересчитывает дофаминовый ответ у большинства, но у части особей этого не происходит.

Также, мыши, выбиравшие слабую оптогенетическую стимуляцию, охотнее переходили на кокаин, чем мыши, выбиравшие натуральные награды. Несмотря на то, что зависимости могут существовать независимо (зависимости независимо, лол) индивидуальная склонность к переоценке искусственных стимулов, видимо, не ограничивается конкретным веществом и может воспроизводиться при замене награды.

Источник

Pascoli, V., Python, L., Hiver, A. et al. Conditioned accumbal dopamine transients forecast individual preference for drug versus natural rewards and compulsive behavior. Nat Neurosci (2026). https://doi.org/10.1038/s41593-026-02331-y


Задавайте вопросы здесь, в ТГ и, прости_хоспаде махе (я там чат прикрутил)

Показать полностью
9

Юбка и риски, или почему Ириске носить юбку запрещали

Очередная волна поутихла. Врываюсь.

Вопросы вины и риска находятся на разных осях и практически не пересекаются.

Есть искушение выстроить рассуждение как лестницу, где от ступеньки "надела короткую юбку" до ступеньки "сама виновата" выложен очевидный и вовсе не шизовый маршрут, но нипалучаеца.

Риск

Риск — это групповое и статистическое понятие. Вот у нас есть группа людей, обладающих признаком Х и мы видим, что с этой группой людей событие Y происходит в 10% случаев. Вот у нас группа людей без признака Х, с которыми событие Y происходит в 5% случаев.

Тогда говорят, что риск (относительный) события Y для группы Х в два раза больше, чем для группы не-Х. Или говорят, что риск (абсолютный) события Y для группы Х составляет 10%.

Как видно, относительный риск легко может создать ложное ощущение пиздеца / нормальности там, где абсолютный риск говори об обратном. Например, в октябре 1995 года британский регулятор (Committee on Safety of Medicines) разослал предупреждение о том, что оральные контрацептивы третьего поколения повышают риск венозной тромбоэмболии примерно вдвое по сравнению с более старыми препаратами.

Женщины массово и панически бросали приём — и использование препаратов третьего поколения упало с 53% до 14% за три года. Однако абсолютный риск, связанный с препаратами, составлял 0,015% и 0,025% соответственно. То есть технически рост действительно почти в два раза, но на практике (в клинике) эти цифры неотличимы.


Причинный вклад

Вопрос "повышает ли фактор Х вероятность нападения?" — это вопрос эмпирический, и на него нельзя отвечать интуитивно. Здесь всплывают сразу две вещи, без которых обсуждение превращается в обмен претензиями.

Контролируемость

Риск, связанный со страной или районом рождения, задан извне — повлиять на него нельзя, и совет здесь бессмыслен: можно говорить только о структурных мерах вроде повышения эффективности работы полиции, освещения тёмных переулков и т.д. Риск, связанный с маршрутом, временем выхода из дома, — контролируемый, и только применительно к нему разговор о неких советах вообще имеет предмет.

Реальные причины

В литературе вопрос одежды и сексуального насилия распадается на два корпуса, который затем одним мякишем мигрируют прямо в головы граждан.

Первый корпус связан с исследованиями атрибуции вины. То есть в этой литературе описаны не реальные мотивы и причины выбора насильниками жертв, а мнение сторонних наблюдателей по вопросу того, что же они считают причиной случившегося насилия.

И в таких опросах (например, Cassidy & Hurrell, 1995) действительно регулярно участники, видевшие фотографию жертвы в "провокационной" одежде, чаще считали её ответственной за произошедшее и реже признавали случившееся изнасилованием (Lennon et al., 2019). Это Пикабу, поэтому повторю ещё раз: это исследования восприятия задним числом, они ничего не говорят о фактической вероятности нападения, они показывают то, как формируется вина в голове наблюдателя.

Второй корпус связан с попытками определить, а что же реально движет нападающими. Таких исследований мало, в большей степени это опросы самих нападавших, в которых они могут врать о том, что жертва сама их спровоцировала. И многие так и говорят. Однако с их же слов получается, что нападающий — расчётливый агент, который выбирает жертву прежде всего по признаку воспринимаемой уязвимости, а не по фасону одежды.

Возможно, что байка с одеждой вообще пошла из статистики. Представительницы древних профессий и дамы, которые (кстати, могут объективно выглядеть плохо, но) считают свой внешний вид сексуальным, чаще сталкиваются с насилием, ибо чаще оказываются в местах и ситуациях, когда могут отказаться жертвой насилия. Если каждый вечер такой дамы проходит в баре, куда она ходит в вызывающих нарядах, то вероятность растёт не просто от наряда или места, а от количества ночей (Synovitz & Byrne, 1998).

Обзор литературы по охоте сексуальных преступников показывает, что нападающие ориентируются на доступность и поведенческие сигналы. Под доступностью имеется ввиду то, может ли нападающий совершить нападение: как близко он находится к жертве, в каком месте они находятся. Также преступник оценивает походку и уверенность.

То есть исследования говорят, что значение имеют возможность, уязвимость и наличие защитников (свидетелей, людей, которые могут прийти на помощь).

Прямого контролируемого исследования, которое бы отделило вклад одежды от других переменных вроде времени суток, района, алкоголя или изоляции и измеряло бы именно частоту нападения, а не постфактум-атрибуцию вины, найти лично мне не удалось.

Риск-менеджмент

Здесь речь идёт о палке с двумя концами. Есть риск попасть в аварию за рулём, но автомобиль даёт скорость, комфорт и грузоподъемность. И вопрос о том, оправдан ли риск, распадается на два.

Оправдан ли риск лично для меня — и это решает сам человек, это законное поле его индивидуального выбора. И кто отвечает, если риск реализовался — а это вообще не статистический вопрос. Тот факт, что кто-то посчитал риск приемлемым, не означает, что вина на нём. Вина распределяется по агентности: в насилии виноват насильник.

Виновность

Вина — не результат статистики. Конкретное действие совершил конкретный агент с определённым умыслом. Причинный вклад жертвы в возникновение ситуации не размывает вину преступника потому, что виновность определяется контролем над решением причинить вред, а этот контроль всегда полностью у агрессора, независимо от того, насколько высоким статистически был риск, в который вошла (вольно или невольно) жертва.


Итог

Спор не касается фактов. По большинству фактов противоборствующие стороны, в общем, могли бы согласиться. Юбка статистически может быть связана с чем-то, но вина за нападение всегда полностью за нападавшим.

Спор возникает из-за того, что совершаются нелегитимные переносы между риском и ответственностью. Один лагерь использует статистику как аргумент в пользу того, что на жертве есть часть вины (которая может быть связана не с нападением, а (!) "виктимным поведением"). Другой лагерь отрицает статистику и риски, лишь бы не дать оппонентам повода повиктимблеймичать.


Любите друг друга. Но по согласию!

Не забывайте подписываться на телегу и, прости_господи, мах.

Показать полностью
8

Гипергамия: раньше и сейчас

Серия Раньше и сейчас

UPD:

Пост перенесён из серии "Отношач" в серию "Раньше и сейчас"

В конце XIX века финский антрополог Эдвард Вестермарк ввёл термин "гипергамия" для описания институционального правила в кастовых и сословных обществах, где женщина выходит замуж за мужчину более высокого социального ранга. Так были устроены система родства и наследования.

В индийской кастовой системе это буквально писаное, обычное право.

В 80-х и нулевых эволюционная психология переняла слово и переопределила его как черту индивидуальной психологии женщины. Основным источником, на который все ссылаются, является "кросс-культурное" исследование Дэвида Басса (Buss, 1989).

"Кросс-культурное" я беру в кавычки, ибо исследование, в котором основная масса опрошенных — это белые, западные, городские, образованные и с высоким доходом люди, а деление на культурные группы осуществлено только в некоторых странах (например, ЮАР) и без последовательно применённого критерия культурной единицы по всему массиву и без унифицированного метода набора участников... Ну это моветон. Нельзя в выборку из десяти тысяч человек взять двух с половиной индусов и назвать исследование кросс-культурным.

Энивей. В исследовании женщины в среднем (!) оценивали финансовые перспективы и амбициозность / трудолюбие партнёра как более важные качества, чем мужчины. Конечно же автор пытались подтвердить гипотезу родительского вклада: женщина несёт более высокие репродуктивные издержки, поэтому эволюционно склонны оценивать способность партнёра обеспечивать ресурсами.

Дэвид Басс с коллегами замерили заявленные предпочтения, а не фактически сделанный выбор, но трактовали результаты как подтверждение гипергамии.

Разрыв между заявленным предпочтением и реальным поведением при выборе — систематическая проблема во всей этой литературе, и Басс её не решает, потому что не пытался: это не поведенческое исследование. Кроме того, различие по полу — умеренное смещение среднего значения по шкале важности, не абсолютный порог или бинарное разделение. Из такого исследования никак не следует прогноз о том, что требования будут расти со временем или реагировать на появление новой технологии знакомств — оно вообще ничего не говорит про динамику, это срез 1989 года.

Однако у нас есть конкурирующее объяснение, не эволюционное. И даже есть данные, которые показываю снижение гипергамии по фактическому выбору: это касается разницы в уровне образования и разницы в доходах (Easteve et al, 2016). И это объяснение не требует от нас предполагать, что изменившийся фактический выбор связан с изменениями в предпочтениях. Потому что гипергамия в таких моделях является следствием структуры брачного рынка и снижается при перестройке этого брачного рынка.

Более того, доля пар, где жена образованнее мужа (гипогамия — обратный паттерн), устойчиво растёт почти повсеместно.


Однако выше мы говорили об академическом понимании гипергамии. В интернетах и сообществах термин используется несколько иначе. Он не только вышел за пределы своего родоначальника, но ещё и добавил идеологическую нагрузку, которой не было Ни у Вестермарка, ни у Басса.

К сожалению, в бытовом употреблении термин перестаёт быть операционализируемой переменной и превращается в объяснение-заглушку, которое приклеивается постфактум к любому отказу женщины. Типичная ситуация для бытового термина: неизмеримая величина, вводимая для объяснения уже известного исхода, а не для предсказания нового.

В лучшем случае этот термин будет опираться на исследования соотношения лайков в дейтинг-приложениях. Но об этом в следующей серии.


Оказалось, что на мобиле серии постов не отображаются. Напоминаю, что это — пост из серии "Отношач". Немного навигации:

  1. Нам нравятся красивые люди — пост о том, что не только мужчины ценят в партнёре красоту и не только для мужчин она важна.

  2. Реальное и идеальное в отношениях — удовлетворённость в отношениях лучше предсказывает соответствие партнёра нормативно желательным чертам, чем ваши заявленные предпочтения.

  3. Спонтанное и ответное шрексуальное желание — немного о том, что сексуальное желание бывает спонтанным, а бывает ответным.

  4. Браки, разводы и причуды статистики про 80% — похоронил и уничтожил, низверг, закопал и потоптался на могиле россказней про 80% распадающихся браков.

  5. Непереносимость отношача — продолжение истории о том, что непереносимость неопределённости является важным источником тревоги.

  6. Права в отношениях. Или же правила — в большей степени ответ, но здесь я популярно объясняю, почему права и обязанности в отношениях чаще все оказывают обыкновенным давлением, от которого любому человеку хочется сбежать, даже если предложение партнёра конструктивно.

Не забывайте подписываться на телегу и, прости_господи, мах.

Показать полностью
6

Научность психологии. Кризис воспроизводимости, или "А был ли мальчик?"

Публикую перевод отрывка из отчёта NASEM "Reproducibility and Replicability in Science" (2019) о положении психологической науки в вопросе воспроизводимости. Это показательный документ, наиболее важной частью которого (в контексте публикации на Пикабу и обитающих здесь граждан) считаю пункт о неоспоримой пользе психологического знания.

Пока люди, занимающиеся психологической наукой, за скромные копейки делают мир вокруг себя лучше, полоумные неучи продолжают с пеной у рта отстаивать тезисы о ненаучном статусе психологии, называть психологию индустрией обмана и оценивать необходимость добычи психологического знания по результатам жизнедеятельности шарлатанов (и шарлатанок).

Итак, страница 150. Психология.


Идея о существовании «кризиса повторяемости» в психологии получила широкое освещение как в профессиональной, так и в популярной прессе, включая The New York Times, The Atlantic, National Review и Slate. Однако в самом научном сообществе по этому вопросу нет единого мнения. Одни исследователи полагают, что в дисциплине широко распространены нестрогие методы, ставящие под угрозу валидность результатов, – в частности, низкая статистическая мощность, отсутствие чёткого разграничения между априорной и апостериорной проверкой гипотез, а также практика p-хакинга (см., например: Pashler & Wagenmakers, 2012; Simmons et al., 2011). Другие учёные не согласны с такой характеристикой и указывают на издержки, которые, по их мнению, влечёт за собой изображение психологии как науки, находящейся в кризисе, – например, возможный сковывающий эффект подобных заявлений на молодых исследователей, чрезмерный акцент на ошибках первого рода (ложноположительные результаты) в ущерб ошибкам второго рода (ложноотрицательные результаты) и, как следствие, риск не заметить важные новые феномены (Fanelli, 2018; Fiedler et al., 2012). Есть и те, кто напоминает, что психология давно уделяет внимание совершенствованию своей методологии, и нынешнее обсуждение воспроизводимости является частью нормального развития науки. Хороший пример – анализ влияния экспериментатора в 1960‑х годах, который, в частности, стимулировал внедрение двойного слепого метода в экспериментах (Rosenthal, 1979). С этой точки зрения, нынешние опасения следует рассматривать в контексте длительной истории методологических улучшений, по мере того как психологи углубляют понимание и применение статистических и иных методов, а также совершенствуют практику отчётности.

Одним из оснований считать психологию фундаментально состоятельной наукой является тот факт, что она производит большое количество полезного и надёжного знания. Исследователи получают множество повторяемых результатов о причинах человеческих мыслей, эмоций и поведения (Shiffrin et al., 2018). Приведём лишь несколько примеров. Исследования человеческой памяти документально подтвердили ненадёжность свидетельских показаний, что привело к освобождению многих несправедливо осуждённых (Loftus, 2017). Исследования «сверхоправдания» показывают, что поощрение детей за желательные виды деятельности может подорвать их внутреннюю мотивацию к этим занятиям (Lepper и Henderlong, 2000). Исследования того, как формулируются варианты выбора, показали, что больше людей участвуют в социальных программах (например, пенсионных накоплениях или донорстве органов), если их автоматически включают в программу и предоставляют возможность отказаться (opt‑out), по сравнению с ситуацией, когда нужно принять решение о вступлении (opt‑in) (Jachimowicz et al., 2018). Всё чаще исследователи и правительства используют подобные психологические знания для решения социальных задач и проблем, в том числе для повышения эффективности образования, сокращения государственных расходов на неэффективные программы, улучшения здоровья населения и снижения стереотипов и предубеждений (Walton & Wilson, 2018; Wood & Neal, 2016).

Возможно, что наряду с этим прогрессом в психологии наблюдается более низкий уровень повторяемости, чем хотелось бы. Как отмечается на протяжении всего настоящего доклада, ни одна область науки не даёт абсолютно повторяемых результатов, однако было бы полезно оценить текущий уровень повторяемости опубликованных психологических работ и задаться вопросом, соответствует ли он тому уровню, который сама дисциплина считает необходимым. Действительно, психология оказалась на переднем крае эмпирических попыток ответить на этот вопрос с помощью крупномасштабных проектов по повторению, в рамках которых исследователи из разных лабораторий пытались воспроизвести набор исследований (см. Таблицу 5‑1 в Главе 5).

Показано сравнение двух результатов для определения воспроизводимости

Показано сравнение двух результатов для определения воспроизводимости

Сами по себе проекты по повторению, однако, оказались спорными, порождая широкие разногласия относительно используемых критериев оценки повторяемости и интерпретации полученных результатов. Одни усматривают в результатах этих проектов повод для тревоги. Например, в своём выступлении перед комитетом Брайан Носек отметил: «Доказательства в пользу воспроизводимости [повторяемости] не достигают того уровня, который можно было бы ожидать или желать» (Nosek, 2018). Исследователи, разделяющие эту точку зрения, приводят ряд аргументов[5].

Во‑первых, многие попытки повторения имели сопоставимый или даже более высокий уровень строгости (например, по объёму выборки, прозрачности, пререгистрации), чем оригинальные исследования, и тем не менее многие из них не смогли воспроизвести исходные результаты (Cheung et al., 2016; Ebersole et al., 2016a; Eerland et al., 2016; Hagger et al., 2016; Klein et al., 2018; O’Donnell и et al., 2018; Wagenmakers et al., 2016). Учитывая высокую степень внимания к работам по повторению (Zwaan et al., 2018), маловероятно, что большинство неудачных повторений объясняются небрежностью в проведении исследований.

Во‑вторых, некоторые попытки повторения были целенаправленно сосредоточены на результатах, которые привлекли к себе большое внимание, вошли в учебники и являются в том или ином смысле «громкими» – то есть на результатах, которые, казалось бы, должны обладать высокой устойчивостью. Часть таких повторений увенчалась успехом, но многие – нет (например, Hagger et al., 2016; O’Donnell et al., 2018; Wagenmakers et al., 2016).

В‑третьих, ряд попыток повторения носили совместный характер, при этом исследователи, тесно связанные с оригинальным результатом (например, авторы исходных работ или специалисты с большим опытом в данной области), принимали активное участие в проверке дизайна и процедуры повторного исследования (Cheung et al., 2016; Eerland et al., 2016; Hagger et al., 2016; O’Donnell и et al., 2018; Wagenmakers et al., 2016). Однако это не привело к стабильно положительным результатам повторений.

В‑четвёртых, когда для неудач при повторении предлагаются возможные объясняющие факторы, они часто носят умозрительный характер и ещё не проверены эмпирически. Например, неудачи при повторении связывают с контекстной чувствительностью и с тем, что некоторые феномены просто труднее воспроизвести в другое время и в другом месте (Van Bavel et., 2016). Однако без перспективных эмпирических проверок этого или других предлагаемых объяснений остаётся реальной возможностью то, что исходный результат в принципе не является повторяемым.

В‑пятых, даже если предположить, что существенная доля (скажем, одна треть) неудачных повторений является ложноотрицательными результатами, это всё равно приводит к выводу, что уровень повторяемости в психологии не достигает идеала. Таким образом, чтобы утверждать, что показатели повторяемости приемлемы (например, близки к 80 %), необходимо быть уверенным, что большинство неудачных повторений имеют существенные недостатки.

Однако другие исследователи придерживаются совершенно иного взгляда на результаты уже проведённых проектов по повторению и предлагают свои аргументы и доказательства. Во‑первых, в некоторых проектах были получены относительно высокие показатели повторяемости: например, Klein et al. (2014) успешно повторили 10 из 13 результатов. Во‑вторых, некоторые громкие проекты (например, Open Science Collaboration, 2015) могли занизить реальный уровень повторяемости из‑за того, что в них не были исправлены ошибки, а также были внесены изменения в процедуру повторения, которых не было в оригинальных исследованиях (см., например: Bench et al., 2017; Etz & Vandekerckhove, 2016; Gilbert et al., 2015; Van Bavel et al., 2016). Более того, выявлен ряд случаев, когда исследования не воспроизводились именно из‑за методологических изменений в повторных экспериментах, а не из‑за проблем с исходными работами; когда эти изменения устраняли, повторение проходило успешно (например, Alogna et al., 2014; Luttrell et al., 2017; Noah et al., 2018). Наконец, остаётся неизвестной обобщаемость результатов самих проектов по повторению, поскольку ни один из них не отбирал исследования для повторения случайным образом, и во многих случаях выбор был достаточно избирательным.

Нерешённым вопросом при любом анализе повторяемости остаётся то, какие именно критерии следует использовать для определения успеха или неудачи. Мета-анализ совокупности результатов может быть более перспективным инструментом для оценки повторяемости, поскольку он позволяет оценить модераторы эффектов, а также однородность результатов. Однако при небольшом числе исследований мета-анализ может не обладать достаточной статистической мощностью.

Несмотря на противоположные взгляды на интерпретацию крупномасштабных проектов по повторению, начинает формироваться консенсус в том, что называть психологию наукой, находящейся в состоянии «кризиса», не является ни полезным, ни обоснованным. Носек выразил это так в своих комментариях для комитета: «Насколько широко распространена проблема воспроизводимости результатов в науке и технике в целом? Простой ответ: мы не знаем. У нас недостаточно информации, чтобы с какой-либо уверенностью дать оценку для какой-то отдельной области или даже для науки в целом». Он добавил: «Мне не нравится термин “кризис”, потому что он подразумевает множество вещей, в которых мы не уверены».

Более того, даже если бы существовала окончательная оценка повторяемости в психологии, никто не знает, каков ожидаемый уровень неповторяемости в здоровой науке. Эмпирические результаты в психологии, как и в науке в целом, по своей природе вероятностны, а это означает, что некоторое количество неудачных повторений неизбежно. Как мы подчёркиваем на протяжении всего доклада, новаторские исследования с большой вероятностью будут давать неоднозначные результаты, поскольку они раздвигают границы знания. Амбициозные исследовательские программы, например, связывающие мозг и поведение, генетические и средовые влияния, вычислительные модели с эмпирическими данными или гормональные колебания с эмоциями, неизбежно приводят к некоторым тупикам и неудачам. Одним словом, некоторые неудачи при повторении могут отражать нормальный прогресс в науке, а также могут указывать на недостаток теоретического понимания или методологические ограничения.

Каков бы ни был масштаб проблемы, научные методы и приёмы анализа данных всегда можно улучшить, и нынешняя дискуссия продолжает давнюю традицию методологических новаций в психологии. Новые практики, такие как проверка эффективности экспериментальных манипуляций, уже стали принятыми в этой области. Заявки на гранты теперь в обязательном порядке включают анализ статистической мощности. В лонгитюдных исследованиях уже не просто констатируют отсев участников, а систематически оценивают его влияние (например, с помощью анализа по принципу «назначенного лечения» – intention‑to‑treat). В то же время не все исследователи внедрили у себя передовые практики, иногда отставая от современного уровня знаний (Sedlmeier & Gigerenzer, 1989). Лишь в последнее время учёные начинают систематически использовать расчёты мощности в исследовательских отчётах и предоставлять открытый доступ к данным и материалам. В последнее десятилетие давление на исследователей с целью улучшения практик и повышения прозрачности усилилось благодаря новым разработкам в области информационных технологий, которые расширяют доступ общественности к информации и возможности для критической оценки науки (Lupia, 2017 ? не уверен в ссылке).


К сожалению, пару исследований не смог добавить, они не на поверхности лежат. Некоторые ссылки оформлены не через doi, а ведут напрямую на сайт журнала, это связано с тем, что псайнет апа я в рот ебал с их ограничениями. При необходимости (по первому запросу) составлю библиографию. Хотя сильно сомневаюсь, что кому-то это надо.

Не забывайте переходить в телегу или, прости хоспаде, мах. Сам уже устал ВПН туда-сюда подрубать, поэтому буду дублировать всякое туда.

Показать полностью 1
Отличная работа, все прочитано!

Темы

Политика

Теги

Популярные авторы

Сообщества

18+

Теги

Популярные авторы

Сообщества

Игры

Теги

Популярные авторы

Сообщества

Юмор

Теги

Популярные авторы

Сообщества

Отношения

Теги

Популярные авторы

Сообщества

Здоровье

Теги

Популярные авторы

Сообщества

Путешествия

Теги

Популярные авторы

Сообщества

Спорт

Теги

Популярные авторы

Сообщества

Хобби

Теги

Популярные авторы

Сообщества

Сервис

Теги

Популярные авторы

Сообщества

Природа

Теги

Популярные авторы

Сообщества

Бизнес

Теги

Популярные авторы

Сообщества

Транспорт

Теги

Популярные авторы

Сообщества

Общение

Теги

Популярные авторы

Сообщества

Юриспруденция

Теги

Популярные авторы

Сообщества

Наука

Теги

Популярные авторы

Сообщества

IT

Теги

Популярные авторы

Сообщества

Животные

Теги

Популярные авторы

Сообщества

Кино и сериалы

Теги

Популярные авторы

Сообщества

Экономика

Теги

Популярные авторы

Сообщества

Кулинария

Теги

Популярные авторы

Сообщества

История

Теги

Популярные авторы

Сообщества

Недвижимость и ремонт

Теги

Популярные авторы

Сообщества