Открыть сервис

Small World of Words

Small World of Words — это международный научно-исследовательский проект, направленный на изучение организации ментального лексикона человека, то есть того, как слова и понятия связаны между собой в сознании носителей разных языков. Проект основан на методе свободных ассоциаций и представляет собой крупнейшую в мире базу данных ассоциативных связей, собранную на десятках языков, включая русский, английский, немецкий, японский, китайский и другие.

История и цели проекта

Проект был запущен в 2012 году группой исследователей из Университета Бохума (Германия) и Лёвенского католического университета (Бельгия) под руководством лингвиста Саймона Де Дейна. Основной целью стало создание масштабной, открытой и постоянно пополняемой базы ассоциативных норм, которая позволила бы изучать универсальные и культурно-специфические механизмы работы памяти, мышления и языка.

В отличие от многих предыдущих ассоциативных словарей, которые были ограничены по объёму (часто 100–200 слов-стимулов) и по числу участников, «Small World of Words» ставил задачу собрать данные по тысячам слов-стимулов от десятков тысяч респондентов на разных языках. Проект использует краудсорсинговый подход: любой желающий может принять участие в эксперименте на сайте проекта, что обеспечивает высокую репрезентативность выборки.

Методология

Сбор данных

Участникам проекта предлагается последовательность слов-стимулов (например, «собака», «счастье», «бежать»). На каждое слово-стимул респондент должен ввести первое слово, которое приходит ему в голову (ассоциацию). Время ответа не ограничено, но фиксируется. Каждый участник обычно проходит от 10 до 20 слов-стимулов. Для каждого языка в проекте используется отдельный набор стимулов, отобранный на основе частотности и психолингвистических критериев.

Обработка результатов

Все ответы проходят фильтрацию: удаляются нецензурные, нечитаемые или явно случайные ответы. Для каждого слова-стимула строится ассоциативное поле — список всех ассоциаций, отсортированный по частоте упоминания. Частота ассоциации отражает силу связи между стимулом и реакцией в сознании носителей языка.

Масштаб

По состоянию на 2025 год в проекте приняли участие более 200 000 человек, собравших более 100 миллионов ассоциативных пар. База данных охватывает более 30 языков, включая:

  • русский (более 10 000 участников, около 5 миллионов ассоциаций);
  • английский (наиболее полный, более 50 000 участников);
  • немецкий, французский, испанский, японский, китайский, арабский, хинди и другие.

Ключевые результаты и открытия

Универсальные ассоциативные сети

Исследования в рамках проекта показали, что, несмотря на культурные различия, существуют универсальные ассоциативные связи. Например, на слово «собака» на большинстве языков самой частой ассоциацией является «кошка». На слово «хлеб» — «масло» или «молоко». Это указывает на общие когнитивные механизмы категоризации и опыта.

Культурная специфика

В то же время проект выявил значительные различия. Например, для слова «счастье» в русском языке одной из самых частых ассоциаций является «семья» и «любовь», в то время как в японском — «улыбка» и «мир». Для слова «работа» в немецком языке частой ассоциацией является «стресс», а в русском — «деньги» и «дом». Эти данные позволяют изучать культурные ценности и стереотипы.

Структура ментального лексикона

Анализ ассоциативных сетей показал, что слова в сознании человека организованы не в виде простого списка, а в виде сложной сети, где узлы (слова) соединены множеством связей разной силы. Эта сеть имеет свойства «малого мира» (отсюда и название проекта): от любого слова до любого другого можно добраться через небольшое число шагов (обычно 2–3 ассоциации). Это объясняет, почему люди могут быстро подбирать синонимы, антонимы или вспоминать связанные понятия.

Применение

Психолингвистика и когнитивная наука

База данных «Small World of Words» используется для проверки теоретических моделей памяти, внимания и семантической обработки. Она позволяет строить компьютерные модели ассоциативного мышления.

Лексикография и изучение языков

Данные проекта помогают составлять толковые и ассоциативные словари, а также разрабатывать учебные материалы для изучения иностранных языков, основанные на реальных ассоциативных связях.

Искусственный интеллект и NLP

Ассоциативные сети используются для улучшения алгоритмов обработки естественного языка (NLP), в частности, для семантического анализа текстов, машинного перевода и генерации текста. Модели, обученные на ассоциативных данных, лучше понимают контекст и смысловые связи.

Маркетинг и реклама

Ассоциативные поля помогают изучать восприятие брендов, продуктов и рекламных сообщений. Например, зная, с чем ассоциируется слово «кофе» у носителей разных языков, можно точнее настроить рекламную кампанию.

Критика и ограничения

Проект подвергается критике по нескольким направлениям. Во-первых, метод свободных ассоциаций фиксирует только первую, самую поверхностную ассоциацию, тогда как в реальном мышлении слово может активировать множество связей одновременно. Во-вторых, выборка участников не является полностью репрезентативной: в основном это молодые люди с высшим образованием, имеющие доступ к интернету. В-третьих, результаты могут зависеть от контекста эксперимента (например, последовательность стимулов может влиять на ответы).

Тем не менее, «Small World of Words» остаётся крупнейшим и наиболее открытым проектом в области ассоциативных исследований, данные которого доступны для свободного скачивания и анализа.

Интересные факты

  • Самое ассоциативное слово в русском языке по данным проекта — «человек»: оно вызывает наибольшее количество разнообразных ассоциаций.
  • В английском языке самое частое слово-ассоциация — «love» (любовь), которое появляется в ответах на множество разных стимулов.
  • Проект продолжает пополняться: каждый год добавляются новые языки и обновляются данные по уже существующим.
  • Участники проекта могут увидеть, как их собственные ассоциации соотносятся с ассоциациями других людей, что делает эксперимент интерактивным и познавательным.

Источники

  • De Deyne, S., & Storms, G. (2015). Word associations: Norms for 1,424 Dutch words in a continuous task. Behavior Research Methods.
  • De Deyne, S., et al. (2019). The “Small World of Words” project: A large-scale, cross-linguistic database of word associations. Proceedings of the 41st Annual Conference of the Cognitive Science Society.
  • Официальный сайт проекта: smallworldofwords.com
  • Nelson, D. L., McEvoy, C. L., & Schreiber, T. A. (2004). The University of South Florida free association, rhyme, and word fragment norms. Behavior Research Methods, Instruments, & Computers.

BFOmetr — база данных и аналитика по компаниям России.

На главную BFOmetr →