Открыть сервис

Коллокация

Коллокация — это лингвистическое понятие, обозначающее устойчивое сочетание слов, в котором лексическая единица (слово) регулярно и предсказуемо соединяется с другой лексической единицей, образуя семантически и грамматически связанную конструкцию. В отличие от свободных словосочетаний, коллокации характеризуются ограниченной сочетаемостью: замена одного из компонентов на синоним или близкое по смыслу слово часто приводит к неестественности или грамматической ошибке (например, «крепкий чай» — норма, но «сильный чай» — ненормативно). Коллокации занимают промежуточное положение между свободными словосочетаниями и фразеологизмами, так как их значение обычно выводимо из значений компонентов, но сочетаемость фиксирована языковой традицией.

История изучения

Термин «коллокация» (от лат. collocatio — «размещение», «расположение») ввёл в научный оборот британский лингвист Джон Руперт Фёрт в 1950-х годах. Фёрт, один из основателей британского контекстуализма, рассматривал значение слова как производное от его окружения — «слово познаётся по компании, которую оно держит». Он различал коллокацию как конкретное сочетание слов (например, «тёмная ночь») и коллигацию — грамматическую связь между частями речи.

В 1960–1970-х годах идеи Фёрта развивали его ученики, в том числе Майкл Халлидей, который включил коллокацию в свою теорию функциональной грамматики. В этот же период начались корпусные исследования: с появлением электронных текстовых массивов (корпусов) стало возможным статистически измерять частоту совместной встречаемости слов. В 1990-х годах, с развитием компьютерной лингвистики, коллокации стали ключевым объектом изучения в лексикографии, автоматической обработке текста и машинном переводе.

В российской лингвистике термин «коллокация» долгое время не был общеупотребительным; вместо него использовались понятия «устойчивое словосочетание», «лексически связанное сочетание» или «фразеологическое сочетание» (по классификации Виктора Виноградова). Однако с 2000-х годов, благодаря интеграции с западной корпусной лингвистикой, термин «коллокация» прочно вошёл в научный обиход, особенно в работах по лексикографии, семантике и преподаванию русского языка как иностранного.

Классификация коллокаций

Коллокации классифицируют по нескольким основаниям: степени устойчивости, семантической прозрачности, грамматической структуре и типу лексического взаимодействия.

По степени устойчивости

  • Свободные коллокации — сочетания, в которых компоненты сохраняют своё прямое значение, но их совместное употребление предпочтительнее других вариантов (например, «принимать душ», «заваривать чай»). Замена синонимом возможна, но звучит менее естественно («принимать ванну» — норма, «принимать дождь» — нет).
  • Фиксированные коллокации — сочетания, в которых один из компонентов имеет ограниченную сочетаемость (например, «закадычный друг» — прилагательное «закадычный» употребляется только с существительным «друг»). Такие коллокации близки к фразеологизмам, но их значение остаётся прозрачным.
  • Идиоматические коллокации — сочетания, значение которых не выводится из значений компонентов (например, «бить баклуши» — «бездельничать»). В строгом смысле это уже фразеологизмы, но в корпусной лингвистике их часто включают в коллокации как крайний случай устойчивости.

По семантической прозрачности

  • Прозрачные — значение коллокации складывается из значений компонентов: «горячий кофе», «быстро бежать».
  • Непрозрачные — значение не является суммой значений: «собаку съесть» (стать экспертом), «белая ворона» (отличающийся человек).

По грамматической структуре

  • Именные (существительное + прилагательное): «золотые руки», «кислый запах».
  • Глагольные (глагол + существительное): «одержать победу», «нанести урон».
  • Адвербиальные (глагол + наречие): «сильно удивиться», «глубоко вздохнуть».
  • Предложные (существительное/глагол + предлог + существительное): «в ходе переговоров», «выйти из себя».

По типу лексического взаимодействия

  • Лексические коллокации — основаны на семантической близости слов (например, «сильный дождь» — не «мощный дождь», хотя «сильный» и «мощный» — синонимы).
  • Грамматические коллокации — основаны на синтаксической структуре (например, «зависеть от кого-то», «верить в кого-то»).

Методы выявления коллокаций

В современной лингвистике коллокации выявляются преимущественно корпусными методами. Для этого используются статистические меры, оценивающие силу связи между словами в текстовом корпусе:

  • Частота совместной встречаемости — абсолютное число случаев, когда два слова появляются в определённом окне (например, в пределах 5 слов друг от друга).
  • Взаимная информация (MI-score) — отношение наблюдаемой частоты совместной встречаемости к ожидаемой, если бы слова были независимы. Высокий MI-score (обычно >3) указывает на сильную коллокацию.
  • T-критерийстатистический тест, оценивающий, насколько совместная встречаемость значимо превышает случайную.
  • Логарифмическое правдоподобие — метод, используемый для сравнения двух корпусов (например, для выявления коллокаций, характерных для определённого жанра).

Примеры корпусов, используемых для анализа коллокаций: Национальный корпус русского языка (НКРЯ), Британский национальный корпус (BNC), Корпус современного американского английского (COCA).

Применение коллокаций

Лексикография

Коллокации являются основой для составления толковых, двуязычных и учебных словарей. В современных словарях, например, в «Большом толковом словаре русского языка» под редакцией С. А. Кузнецова или в «Oxford Collocations Dictionary», коллокации приводятся в виде примеров или специальных блоков, помогающих пользователю правильно употреблять слова.

Преподавание иностранных языков

Знание коллокаций — ключевой компонент языковой компетенции. Изучающие язык часто допускают ошибки, выбирая неверное сочетание (например, *«делать ошибку» вместо «совершать ошибку»). Методика преподавания русского языка как иностранного активно использует коллокации для формирования естественной речи. В учебных пособиях, таких как «Русский язык в упражнениях» С. А. Хаврониной и А. И. Широковой, коллокации выделяются в отдельные блоки.

Компьютерная лингвистика и обработка естественного языка

В автоматической обработке текста коллокации используются для:

  • Машинного перевода — для выбора корректного перевода многозначных слов (например, «сильный» переводится как «strong» в контексте «сильный ветер», но как «heavy» в контексте «сильный дождь»).
  • Извлечения терминологии — для выявления терминов из научных текстов (например, «искусственный интеллект», «машинное обучение»).
  • Сентимент-анализа — для определения тональности фраз (например, «высокое качество» — положительная коллокация).
  • Генерации текста — для создания естественных словосочетаний в нейросетевых моделях.

Когнитивная лингвистика

Коллокации изучаются как отражение ментальных лексиконов и когнитивных схем. Например, коллокации с глаголом «взять» («взять ответственность», «взять курс») показывают, как в языке концептуализируется действие приобретения или контроля.

Примеры коллокаций в русском языке

  • Прилагательное + существительное: «звонкий голос», «глубокий сон», «крепкий орешек».
  • Глагол + существительное: «одержать победу», «нанести удар», «принять решение».
  • Глагол + наречие: «сильно удивиться», «глубоко вздохнуть», «крепко спать».
  • Существительное + существительное (родительный падеж): «ход событий», «сила воли», «поле деятельности».
  • Глагол + предлог + существительное: «выйти из себя», «взять на себя», «прийти в голову».

Критика и ограничения

Понятие коллокации подвергается критике за размытость границ. Не существует единого критерия, позволяющего однозначно отличить коллокацию от свободного словосочетания или фразеологизма. Разные исследователи используют разные статистические пороги, что приводит к вариативности результатов. Кроме того, коллокации зависят от жанра, регистра и диалекта: то, что является коллокацией в научном тексте, может быть свободным сочетанием в разговорной речи.

Ещё одно ограничение — коллокации не всегда отражают реальное языковое употребление, особенно в малых корпусах. Например, редкие, но значимые сочетания могут быть пропущены из-за низкой частоты.

См. также

Источники

  1. Фёрт, Дж. Р. (1957). Papers in Linguistics 1934–1951. Oxford University Press.
  2. Халлидей, М. А. К. (1966). «Lexis as a Linguistic Level». Journal of Linguistics, 2(1), 57–67.
  3. Виноградов, В. В. (1947). Русский язык: Грамматическое учение о слове. Учпедгиз.
  4. Sinclair, J. (1991). Corpus, Concordance, Collocation. Oxford University Press.
  5. Manning, C. D., & Schütze, H. (1999). Foundations of Statistical Natural Language Processing. MIT Press.
  6. Национальный корпус русского языка (НКРЯ). — ruscorpora.ru.

BFOmetr — база данных и аналитика по компаниям России.

На главную BFOmetr →