Кратко
Эффект Струпа — это замедление и ошибки, которые возникают, когда нужно назвать цвет краски, а само слово называет другой цвет. Чтение у взрослого происходит почти автоматически, поэтому оно вмешивается в называние цвета, а не наоборот.

Слово «синий», напечатанное красной краской. Человек, которого попросили назвать цвет, на мгновение сбивается — и это самая известная демонстрация в когнитивной психологии. У неё есть имя: эффект Струпа. Её показывают на первых занятиях по психологии внимания, ею объясняют силу автоматизмов, её используют нейропсихологи. И вокруг неё же накопилось больше путаницы, чем вокруг любой другой лабораторной пробы: её называют то тестом на внимание, то тестом на интеллект, то упражнением для развития мозга. Разберёмся, что на самом деле измерил Струп в 1935 году и какие выводы из этого следуют, а какие нет.
Что такое эффект Струпа простыми словами
Эффект Струпа — это замедление и ошибки, которые возникают, когда нужно назвать цвет краски, а само слово называет другой цвет. Надпись «зелёный» красными буквами, правильный ответ «красный» — и он даётся заметно тяжелее, чем если бы вместо слова стоял обычный цветной квадрат.
Дело в столкновении двух действий, к которым мозг готов очень по-разному. Чтение у грамотного взрослого происходит почти само: чтобы удержаться и не прочитать знакомое слово, требуется усилие. У называния цвета такой автоматичности нет — это действие каждый раз выполняется намеренно. Когда два действия указывают на разные ответы, более медленному приходится подавлять более быстрое, и на это уходит время.
Поэтому пробу и используют как модель конфликта между автоматическим и произвольным. Её удобство в том, что конфликт виден на секундомере: не нужны ни опросники, ни самоотчёт — достаточно сравнить время на двух карточках.
Эксперимент 1935 года и его главная неожиданность
Работу, с которой всё началось, опубликовал Джон Ридли Струп в 1935 году в журнале Journal of Experimental Psychology под названием «Studies of interference in serial verbal reactions»; это был текст его диссертации. Самого выражения «эффект Струпа» там нет — автор писал об интерференции, то есть о взаимном вмешательстве двух навыков.
Материалом были не экраны с миллисекундами, а печатные карточки по 100 элементов, и секундомером измеряли время на всю карточку целиком. Цветов было пять: красный, синий, зелёный, коричневый и фиолетовый. От жёлтого пришлось отказаться — его не получалось напечатать так, чтобы он не отличался по яркости от остальных.
Первый эксперимент, в нём участвовали 70 студентов, проверял, мешает ли цвет краски читать слово. Второй, со 100 участниками, проверял обратное: мешает ли слово называть цвет. И здесь выяснилось главное: конфликт оказался резко несимметричным. Чтение ста слов, напечатанных «неправильным» цветом, занимало всего на 2,3 секунды больше, чем чтение тех же слов чёрным шрифтом, и Струп прямо отметил, что эта разница ненадёжна. А вот называние ста цветов на такой же карточке удлинилось на 47,0 секунды — на 74,3 % дольше, чем называние цветных квадратов: среднее время выросло с 63,3 до 110,3 секунды.
Получается, слово мешает цвету очень сильно, а цвет слову — практически нет. Эту асимметрию обычно теряют в пересказах, хотя именно она и есть настоящий результат 1935 года.
Почему чтение выигрывает у называния цвета
Объяснение, которое предложил сам Струп, звучит буднично — и до сих пор остаётся основой. Разница не в цветах и не в словах как таковых, а в количестве тренировки: со словом связан один-единственный привычный ответ, прочитать его, тогда как с цветом за жизнь связалось множество разных реакций — им любуются, его называют, к нему тянутся или, наоборот, его избегают.
Более поздние модели эту идею уточнили. Самой влиятельной стала модель параллельной распределённой обработки Коэна, Данбара и Макклелланда 1990 года, на которую опирается и обзор Уильямса, Мэтьюса и Маклауда. В ней нет жёсткого деления на «автоматическое» и «произвольное»: есть пути обработки разной силы, и более сильный выигрывает конкуренцию, если задание специально не усиливает слабый.
Практическое следствие важнее, чем кажется. Проба показывает не «качество» избирательного внимания вообще, а то, насколько именно в эту минуту удаётся удержать более слабое действие против более сильного.

Надёжный эффект и ненадёжная мерка
Здесь начинается самое интересное — и как раз это место чаще всего пересказывают неверно.
Как групповой эффект Струп почти неуязвим. В проекте Many Labs 3, где одну и ту же процедуру повторяли в разных лабораториях, эффект Струпа воспроизвёлся в 100 % попыток — на фоне гораздо более скромных показателей у большинства других психологических эффектов. Возьмите достаточное число людей — и разница между конфликтной и обычной карточкой появится почти наверняка.
А вот как мерка для отдельного человека та же проба работает плохо. Хедж, Пауэлл и Самнер в 2018 году проверили тест-ретестовую надёжность семи классических когнитивных заданий. Надёжности колебались от 0 до 0,82, и ни один поведенческий показатель в двух основных исследованиях не дотянул до 0,8 — уровня, который считают клинически необходимым. Для разницы во времени реакции на пробе Струпа внутриклассовый коэффициент составил 0,60 и 0,66.
Причина парадоксальна. Задание становится «классическим» именно тогда, когда все люди реагируют на него примерно одинаково: малый разброс между испытуемыми делает эффект устойчивым и легко воспроизводимым. Но этот же малый разброс лишает задание способности надёжно ранжировать людей. То, что делает пробу прекрасным экспериментом, делает её плохим тестом.
Почему это не тест на внимание и не тест на интеллект
В поиске запрос «тест Струпа» почти всегда соседствует со словами «на внимание» и «на IQ». Оба ярлыка ошибочны, и стоит разобрать почему.
Проба не измеряет мышление в целом: в ней нет ни задачи на понимание, ни на умозаключение, ни на память. Всё, что в ней происходит, — это соревнование двух ответов на один стимул, и длится оно доли секунды.
Не имеет она отношения и к критическому мышлению — умению проверять собственные суждения, взвешивать доводы и замечать подмену. Это навык, который вырабатывают годами, и измерять его скоростью называния цвета не пытался даже сам Струп.
Более того, под вопросом и само широкое утверждение, будто задание чисто измеряет «управляющие функции». Самбол и коллеги в 2023 году перепроверяли классическую трёхфакторную модель этих функций: факторный анализ показал, что проба Струпа выделилась в самостоятельный фактор, то есть немалая часть того, что она улавливает, специфична для самого задания, а не для широкой способности к торможению.
Отдельно о диагностике: ни одна проба — ни Струп, ни любая другая — сама по себе диагноза не ставит. В нейропсихологии её применяют в составе батареи методик, вместе с анамнезом и клинической беседой, и даже там вывод делает специалист, а не показатель.
Эмоциональный Струп: когда слово задевает лично
Позже у пробы появилась вторая, «эмоциональная» версия. Задание прежнее — назвать цвет краски, — но слова подбирают по значению: часть из них касается того, что человека тревожит, остальные нейтральны. Обзор Уильямса, Мэтьюса и Маклауда 1996 года обобщил десятки таких работ: пациенты нередко медленнее называют цвет слова, связанного именно с их состоянием.
Пример вне клиники: Суарес-Пельисиони с коллегами в 2015 году сравнили 20 человек с высокой математической тревогой и 20 с низкой, которые не различались ни по общей тревожности, ни по подавленности. Первые медленнее называли цвет слов, связанных с математикой, — тема сама перехватывала внимание.
Переоценивать это явление не стоит. Мета-анализ Жуаяль и коллег 2019 года, охвативший исследования при ПТСР, депрессии и тревожных расстройствах, показал картину сложнее ожидаемой: при ПТСР интерференция на слова, связанные с травмой, была сильной (g = 0,65), на в целом позитивные слова — умеренной (g = 0,38), а на в целом негативные — вообще незначимой. Возраст и пол участников на результат не влияли. Это закономерность на уровне групп, а не инструмент, которым кого-то «проверяют».
Да и природа эмоционального Струпа оказалась иной, чем думали вначале. Мета-анализ 70 исследований (Фаф и Кан, 2007) показал: самые сильные эффекты возникают, когда тревожные слова подают блоком, а в условиях, где слово почти не осознаётся, эффекта нет вовсе. Вывод авторов — дело скорее в медленном отцеплении внимания от значимого слова, чем в быстром автоматическом сканировании угрозы.
Полезно развести и два соседних понятия. Смещение внимания — это о том, за что оно цепляется, тогда как когнитивные искажения — о том, как человек толкует уже замеченное.
Если же тревожные темы действительно перехватывают внимание настолько, что это мешает жить, разбираться с этим лучше не с секундомером, а в когнитивно-поведенческой терапии, где с вниманием и толкованием событий работают вместе.
Помогают ли упражнения на пробу Струпа
Этот вопрос Струп задал себе сам — и ответил на него третьим экспериментом. Тридцать два студента Аризонского университета восемь дней подряд выполняли конфликтную карточку, по 200 реакций в день.
Результат такой: тренировка уменьшила интерференцию на 33,9 %, но не устранила её. Меньше четверти выигрыша объяснялось тем, что люди просто быстрее называли цвета, — остальное было навыком именно этого задания. И самое любопытное: после восьми дней практики просела обратная сторона — читать слова, напечатанные чужим цветом, участники стали медленнее, чем до тренировок.
Это важная деталь для всех, кто ищет «упражнения Струпа для развития мозга». Данные 1935 года говорят только о самом задании: человек становится лучше в конкретной карточке, отчасти расплачивается за это устойчивостью автоматического чтения — и никакого вывода о внимании за пределами лаборатории отсюда не следует. Проба ценна как демонстрация, а не как тренажёр.
Мифы и факты об эффекте Струпа
Что обычно пишут о пробе Струпа — и что показали первичные данные:
| На самом деле | Распространённый миф |
|---|---|
| Слово сильно мешает называть цвет, а цвет чтению — почти нет | Конфликт в пробе Струпа симметричен |
| Групповой эффект надёжен, а индивидуальный показатель — нет | По тесту Струпа можно измерить торможение у конкретного человека |
| Проба улавливает конфликт двух ответов, а не общую способность | Тест Струпа — это тест на интеллект или на внимание |
| Мета-анализы существуют только для эмоциональной версии пробы | Классический эффект Струпа подтверждён мета-анализами |
| Практика улучшает именно эту карточку и портит обратную | Упражнения Струпа развивают внимание в целом |
| Эмоциональная версия показывает закономерности на уровне групп | Эмоциональный Струп выявляет тревогу или травму у человека |
Самая честная формулировка, пожалуй, такая: эффект Струпа — одновременно одно из самых надёжных явлений в психологии и один из самых ненадёжных индивидуальных показателей. Именно это сочетание делает его прекрасным учебным примером того, чем вывод о группе отличается от вывода о человеке.
Источники
- Stroop J. R. Studies of interference in serial verbal reactions. Journal of Experimental Psychology, 1935; 18(6): 643–662. DOI: 10.1037/h0054651 · Полный текст
- Hedge C., Powell G., Sumner P. The reliability paradox: why robust cognitive tasks do not produce reliable individual differences. Behavior Research Methods, 2018; 50(3): 1166–1186. DOI: 10.3758/s13428-017-0935-1 · PMID: 28726177 · Полный текст
- Joyal M., Wensing T., Levasseur-Moreau J. и др. Characterizing emotional Stroop interference in posttraumatic stress disorder, major depression and anxiety disorders: a systematic review and meta-analysis. PLOS ONE, 2019; 14(4): e0214998. DOI: 10.1371/journal.pone.0214998 · PMID: 30964902 · Полный текст
- Suárez-Pellicioni M., Núñez-Peña M. I., Colomé À. Attentional bias in high math-anxious individuals: evidence from an emotional Stroop task. Frontiers in Psychology, 2015; 6: 1577. DOI: 10.3389/fpsyg.2015.01577 · PMID: 26539137 · Полный текст
- MacLeod C. M. Half a century of research on the Stroop effect: an integrative review. Psychological Bulletin, 1991; 109(2): 163–203. DOI: 10.1037/0033-2909.109.2.163 · PMID: 2034749 (каноническое обобщение литературы; это интегративный обзор, а не мета-анализ)
- Williams J. M. G., Mathews A., MacLeod C. The emotional Stroop task and psychopathology. Psychological Bulletin, 1996; 120(1): 3–24. DOI: 10.1037/0033-2909.120.1.3 · PMID: 8711015
- Phaf R. H., Kan K.-J. The automaticity of emotional Stroop: a meta-analysis. Journal of Behavior Therapy and Experimental Psychiatry, 2007; 38(2): 184–199. DOI: 10.1016/j.jbtep.2006.10.008 · PMID: 17112461
- Sambol S., Suleyman E., Scarfo J., Ball M. A true reflection of executive functioning or a representation of task-specific variance? Re-evaluating the unity/diversity framework. Acta Psychologica, 2023; 236: 103934. DOI: 10.1016/j.actpsy.2023.103934 · PMID: 37156119
Часто задаваемые вопросы
Кто такой Струп и почему эффект назван его именем?
Джон Ридли Струп — американский психолог, опубликовавший в 1935 году диссертационное исследование «Studies of interference in serial verbal reactions» в журнале Journal of Experimental Psychology. Сам он писал об интерференции, а не об «эффекте Струпа»: это название закрепилось позже, когда проба стала стандартным лабораторным заданием у следующих поколений исследователей.
Как выглядит классическая проба Струпа?
В оригинале это были печатные карточки по сто элементов, а не компьютерный экран. На одной карточке названия цветов напечатаны чёрным, на другой те же слова напечатаны чужим цветом, на третьей просто цветные квадраты. Участник либо читает слова, либо называет цвет краски, а исследователь засекает время на всю карточку.
Мешает ли цвет чтению так же, как слово мешает называнию цвета?
Нет, и это главная неожиданность оригинального исследования. Конфликтный цвет краски удлинил чтение ста слов всего на 2,3 секунды, причём Струп отметил, что такая разница ненадёжна. А конфликтное слово удлинило называние ста цветов на 47 секунд. Эффект резко несимметричен: более сильный навык вмешивается в более слабый.
Можно ли по тесту Струпа оценить торможение у конкретного человека?
Корректно — нет. Проверка тест-ретестовой надёжности показала, что для разницы во времени реакции на пробе Струпа внутриклассовый коэффициент составляет примерно 0,60 и 0,66, тогда как клинически необходимым уровнем считают 0,8. Индивидуальный балл слишком нестабилен во времени, чтобы делать выводы об отдельном человеке.
Почему эффект Струпа так хорошо воспроизводится в исследованиях?
Потому что различий между людьми в нём мало: почти все грамотные взрослые замедляются на конфликтной карточке. В проекте Many Labs 3, где одну процедуру повторяли в разных лабораториях, эффект воспроизвёлся во всех попытках. Та же однородность, которая делает его устойчивым, лишает пробу способности сравнивать людей между собой.
Чем эмоциональный Струп отличается от классического?
В классической версии конфликтуют слово и цвет краски. В эмоциональной слова не называют цветов: часть из них касается того, что человека тревожит, остальные нейтральны, а называть нужно цвет. Исследователей интересует, замедляет ли человека само значение слова, а не столкновение двух ответов на один стимул.
Может ли эмоциональный Струп выявить тревогу или ПТСР?
Нет, это исследовательская процедура, а не диагностическая. Мета-анализ исследований при ПТСР, депрессии и тревожных расстройствах показал умеренные размеры эффекта и разную картину у разных диагнозов: при ПТСР замедление на слова о травме было выраженным, а на в целом негативные слова — незначимым. Диагноз ставят по клинической оценке.
Развивают ли внимание упражнения на эффект Струпа?
Прямых оснований так считать нет. В третьем эксперименте Струпа восемь дней ежедневной практики уменьшили интерференцию примерно на треть, но не устранили её, причём меньшая часть выигрыша объяснялась более быстрым называнием цветов. Вдобавок после тренировок участники стали медленнее читать слова, напечатанные чужим цветом.
73 отзыва — средняя оценка центра New Leaf