Б.М. Лейкиной. Валентностному анализу будет в дальнейшем посвящен специальный параграф, а здесь достаточно указать, что термин «валентность» тоже означает сочетательную способность лингвистического элемента.
Дистрибутивно-статистический анализ в том виде, как его разработал и применяет А.Я. Шайкевич, «есть сумма формальных алгоритмических процедур, направленных на описание языка и опирающихся только на распределение (дистрибуцию) заданных элементов в тексте. Под заданными элементами могут пониматься буквы (и другие графические символы), цепочки букв между пробелами (слова), цепочки слов между более крупными пробелами (высказывания), короче —любые объекты в тексте, непосредственно доступные нашему восприятию. Сам анализ при этом носит не жестко-детерминистский, а статистический характер, постоянно использует количественную информацию о встречаемости элементов в тексте» (Шайкевич, 1976:355).
Важно подчеркнуть, что в своем анализе А.Я. Шайкевич убедительно показывает следующее: скрытое или явное предположение о том, что текст или какие-то явления в тексте можно представить как случайный процесс, для лингвостатистики неплодотворно. Шайкевич доказывает, что основные перспективы лингвостатистики, если она хочет исследовать особенности структуры текста или структуры языка, связаны с поисками расхождений между теоретическими данными (чаще всего они сравниваются с нормальным распределением, или распределением Пуассона) и эмпирическими данными.
Объяснять здесь сущность этих понятий мы не сможем за недостатком места. Это слишком отвлекло бы нас от основного изложения. Но тому, кто будет пользоваться методикой дистрибутивностатистического анализа, необходимо проработать не только работы самого Шайкевича, но и какой-либо из современных учебников по статистике.
Здесь мы ограничимся конкретным примером, иллюстрирующим предложенную методику. Шайкевич исследовал распределение относительной частоты неопределенного артикля в речи персонажей У. Шекспира и показал неоднородность этого распределения для двух, выделившихся именно благодаря этому анализу, групп персонажей. У слуг, горожан и носителей комического начала (шутов, остряков, глупцов) отмечено повышение частоты неопределенного артикля. И напротив, у героев «серьезных» и высоко стоящих на социальной лестнице частота неопределенного артикля понижается.
42
Таким образом, метод может быть использован в стилистике, но, разумеется, пригоден и для других целей. В информатике, например, его применяют для выделения ключевых слов.
§ 6. Валентностный анализ
Валентностный анализ имеет много общего с только что описанным дистрибутивно-статистическим, хотя он разрабатывался независимо от дистрибутивного, вне всякой связи со структурализмом и более лингвистичен.
Термин «валентность» заимствован в лингвистику из химии. Там валентностью называется способность атома химического элемента образовывать химические связи с другими атомами. Само слово «валентность» происходит от латинского valentia сила. Термин применяется и в других науках, например в биологии. Там валентность, или «экологическая пластичность», есть степень приспособляемости животного к условиям среды. Весьма вероятно, что изучение развития этого понятия в других науках могло бы быть эвристически полезным и для языковедов, но мы на этом останавливаться не будем.
В лингвистику термин был введен в 1948 году С. Д. Кацнельсоном, который определил валентность как «свойство слова определенным образом реализоваться в предложении и вступать в определенные комбинации с другими словами». Его же более позднее определение более лаконично: «Валентность — это свойство определенных разрядов слов присоединять к себе другие слова». Для семасиологии также очень важно замечание этого ученого, ставшего еще при жизни классиком советского языкознания, о том, что валентность есть свойство значения, в котором как бы содержатся пустые места, нуждающиеся в восполнении. Валентность, таким образом, есть «имплицитно содержащееся в нем (в слове) указание на необходимость восполнения его другими словами определенных типов в предложении» (Кацнельсон, 1987).
Общая концепция валентности иллюстрируется в цитируемой выше статье (опубликованной посмертно) на примерах из области синтаксиса. Валентность предиката, например, характеризуется числом открываемых им мест. Событийные непереходные предикаты (падать, тонуть) одновалентны. В них события не выходят за пределы субъекта. Предикаты относительные выражают события, происходящие между двумя или больше участниками (Подводная лодка потопила транспорт. ) В таких случаях валентность определяется числом ролей, их обычно не больше трех-че-
43
тырех. Тогда, соответственно, говорят о трехили четырехместной валентности.
Не следует смешивать, как подчеркивает С.Д. Кацнельсон, «место» при глаголе и обстоятельственную характеристику действия. Поясним его положение примером. После глагола отправил обстоятельство времени возможно, но необязательно (Он отправил письмо; Он отправил письмо 24-го марта). Однако существует ряд глаголов «времяпрепровождения», которые обязательно требу-
ют временного дополнения (Он прождал ответа целый месяц}.
Приводятся такие примеры одноместных, двухместных и трехместных глаголов. Одноместные: смеяться, плакать, прыгать, лежать; двухместные: убивать, находить, ловить, догонять;
трехместные: дать, дарить.
По признакам сходства валентностных характеристик могут выделяться лексико-грамматические разряды, идеографические или еще более мелкие группы.
Под лексической валентностью понимается способность данного слова сочетаться с другими словами, которые образуют его валентностный набор. При этом, разумеется, целесообразно рассматривать не слова в целом, а их лексико-семантические варианты. Многозначные слова должны входить в несколько валентностных наборов. Валентностные наборы представляют собой множества, задаваемые перечислением. На некоторых этапах они удобно поддаются обработке методами символической логики.
Валентностный анализ проходит следующие стадии:
После того как установлена общая задача исследования, устанавливается список слов, валентность которых намечено изучить, определяется тип текстов, из которых будет взята выборка, и устанавливается общий объем выборки.
Общей методики свертывания примеров пока не существует, каждый решает эту задачу в соответствии со своим материалом. Так, например, в некоторых работах могут быть отброшены все элементы, которые не имеют синтаксической связи с ядром, устранение которых не нарушает отмеченности и которые избыточны как контекстуальные индикаторы. Здесь нельзя не обратить внимания на связь этой методики с методом контекстуального анализа, о котором речь пойдет в следующем параграфе; связана эта методика и с теорией вероятностей и со статистикой.
Большой вклад в разработку этой методики внесли МД. Степанова, Б.М. Лейкина, а за рубежом — Г. Хельбиг.
Термин «валентность» для Б.М. Лейкиной означает сочетательную способность лингвистического элемента, его способность
44
встречаться вместе с другими элементами того же класса. Эта способность предопределяется смысловыми, грамматическими, экспрессивными и стилистическими факторами (Лейкина, 1961}. Впрочем, возможны и особые случаи. Так, О.Н. Селиверстова выделяет еще и произвольные особенности в сочетаемости, которые она называет конфигуративными (термин этот не привился) и иллюстрирует таким примером: можно сказать Он прекратил чтение и Он перестал читать, но нельзя сказать Он перестал чтение.
Сфера применения валентностного анализа очень разнообразна. Так, В.И. Шаховский использует эту методику для показа взаимодействия денотативных и эмотивных компонентов в значении слова. Под эмотивной валентностью этот автор понимает способность лингвистической единицы вступать в эмотивные связи с другими единицами на основе содержащихся в них явных или скрытых (импликационных) эмосем и таким образом осуществлять свою эмотивную функцию (Шаховский, 1984}.
Специально занимаясь валентностным анализом, МД. Степанова внесла очень важный вклад в его теорию и методику (Степанова, 1973}.
МД. Степанова считает валентностный анализ частным случаем дистрибутивного. Но они так близки, что с таким же успехом можно было бы считать дистрибутивный анализ частным случаем валентностного. Вероятно, точнее было бы сказать, что методика валентностного анализа хорошо комбинируется и коррелирует со многими другими, и в том числе, и с дистрибутивным, и с компонентным, и со статистической обработкой материала и очень хорошо поддается формализации. Заслуга МД. Степановой в том, что она не только перенесла валентностный анализ в область словообразования, но и четко связала его с вероятностным подходом.
Вероятность принято определять как числовую характеристику степени возможности наступления случайного события при определенной комбинации условий. Лингвистическую вероятность МД. Степанова понимает как меру возможностей при превращении последней в действительность, т.е. в факт языка. Лингвистическая вероятность проявляется на разных уровнях языка по-разно- му.
МД. Степанова предлагает различать внутреннюю (словообразовательную) и внешнюю валентность слова.
Внутренней валентностью она называет общую закономерность сцепления в слове его непосредственно составляющих. Она складывается из закономерностей комбинаторики фонетических, мор45
фологических и семантических компонентов. Изучение этих зако' номерностей позволяет прогнозировать дальнейшие судьбы словообразования, а определение словообразовательных потенций может составить существенную часть изучения общей проблематики лингвистической вероятности.
§ 7. Контекстологический анализ
Как и другие исследовательские процедуры, методика контекстуального анализа неразрывно связана с соответствующей языковой теорией в данном случае с теорией контекстной семантики (термин Г.В. Колшанского).
Родоначальником теории контекста можно считать основателя Лондонской лингвистической школы Дж. Ферса (см. с. 18), который, продолжая идеи антрополога Бронислава Малиновского, считал, что высказывание получает смысл в ситуативном и социальном контексте и является функцией такого контекста. При этом подходе учитывается влияние на языковую семантику коммуникативной ситуации, ролевой структуры общения, социальных факторов и условий функционирования языка, всего многообразия познаваемого человеком мира, образующего информационную основукоммуникации.
Таким образом, рассмотрение контекста как внеязыковой среды, в которой функционируют языковые единицы всех рангов: слова, предложения, тексты, возникло раньше чем концепция лингвистического и стилистического контекстов, составляющих основу современной методики, называемой контекстуальным анализом.
Подход Ферса несомненно перспективен, особенно в свете современной теории коммуникации и прагмалингвистики. К сожалению, при наличии целого ряда теоретических работ, рассматривающих проблемы контекста с этой точки зрения, ни соответствующего исследовательского метода, ни необходимых методик общего характера пока не создано.
Это - дело близкого будущего.
В нашей стране теория и методика контекстологического анализа связана прежде всего с именем Н.Н. Амосовой. Теория контекстологического анализа была создана ею в процессе исследований английской фразеологии, причем основное ее внимание первоначально было сосредоточено на разграничении постоянного и переменного контекста при описании и характеристике фразеологических единиц. То есть теория возникла при решении конкретной задачи, но оказалась вскоре применимой в значительно более ши-
46
роком диапазоне и плодотворно разрабатывалась уже после смерти ученого многочисленными учениками и коллегами. Метод не потерял своего значения и непрерывно развивался в последние десятилетия (Амосова, 1963).
Н.Н. Амосова определяла контекст как соединение указательного минимума с семантически реализуемым словом. В основе такого понимания имплицитно заложена модель полисемии и омонимии
вязыке, основанная на следующих допущениях:
1.Языковой знак асимметричен, полисемия и омонимия являются языковыми универсалиями, но все множество значений каждого языкового знака можно разделить на отдельные дискретные
элементы — лексико-семантические варианты, которые могут идентифицироваться по лексической, грамматической или комбинированной сочетаемости.
2.В речи слово актуализируется только в одном из возможных для него вариантов.
3.Отправитель и получатель сообщения одинаково знакомы с условиями реализации слов в данном языке, и поэтому слушатель или читатель, зная контекстуальные индикаторы, в состоянии понять, в каком из возможных для него значений встретилось слово и соответственно понять смысл текста.
4.Система языка остается неизменной.
Нетрудно убедиться в том, что эта модель достаточно огрублена и реальные условия коммуникации сложнее, о чем будет сказано позже.
В работах Н.Н. Амосовой контекст ограничивается рамками предложения. Различают лексический, синтаксический, морфоло- го-синтаксический, конструктивный и смешанный контексты, что зависит от того, на каком уровне отмечается индикация. Если лексический контекстуальный индикатор, обеспечивающий указательный минимум, находится в непосредственной синтаксической связи с реализуемым словом, такой лексический контекст называется лексическим контекстом первой степени. Если же связь их опосредована, то говорят о лексическом контексте второй степени. Важным достоинством подхода Амосовой является то, что она рассматривает контекст как единство реализуемого слова и индикатора, т.е. учитывает их взаимодействие. Многие другие исследователи считают контекстом только окружение слова. Внеязыковые условия, влияющие на реализацию значения, в теории Амосовой называются ситуацией. Различают внетекстовую жизненную ситуацию, в которую входят общие жизненные условия, такие, как прямой показ и
47
некоторые другие факторы, и текстовую ситуацию — общую тему текста или текстовое описание ситуации.
Теория ситуации получила за последнее время сильное развитие и привлекает внимание многих ученых. В этих работах можно, пожалуй, усматривать развитие концепций, начало которым было
положеноДж.Ферсом.
Лингвистический контекстологический анализ, по Амосовой, часто сочетается с компонентным анализом по словарным дефинициям и имеет немало общего с рассмотренными выше валентностным и дистрибутивным анализами, но возник раньше и независимо от них. Он менее формализован, но более требователен к описанию деталей фактического текстового материала.
Для иллюстрации этой методики приведем анализ, выполненный уже в 80-х годах. Анализируется слово pain и его лексико-се- мантическое поле. Контекстуальный анализ начинается со сбора фактического материала. Большой массив обследованного текста (15 000 - 30 000 страниц) — обязательное требование. В диссертационном исследовании М.И. Румянцевой путем сплошной выборки из словарей было отобрано 60 единиц. Критерием для отбора служило наличие инвариантного элемента в дефинициях. Наличие общего семантического компонента позволило признать эти 60 единиц лексико-семантическим полем pain. Затем по текстовому материалу соответствующего объема были определены типичные лексические и синтаксические контексты. Так, например, удалось показать, что значение физическая боль реализуется в лексическом контексте первой степени в структуре N + Prep + N1, где лексическим индикатором NI является слово, означающее какую-ни-
будь часть тела.
Развитие первоначальной концепции Н.Н. Амосовой последующими исследователями внесло ряд корректив в технику такого анализа, причем он сочетался с другими существующими методиками. Главная трудность, неизбежная при этой методике, заключается в зыбкости дискретизации значений, в чем легко убедиться, обратив внимание на то, как по-разному решается вопрос о числе и составе лексико-семантических вариантов одного и того же слова в разных словарях. Кроме того, в реальных текстах, особенно художественных, слова нередко передают не одно значение. Это особенно заметно для разного рода метафорических или метонимических переносных значений, где экспрессивность и образность зависит именно от сохранения как бы на заднем плане первоначального прямого значения. Не всегда оправдывается и третье из перечисленных допущений (см. с. 47) — коды отправителя и получателя со48
общения полностью совпасть не могут. И, наконец, что особенно важно, языковая система находится в состоянии постоянного развития и код под действием сообщения все время меняется, чтобы удовлетворить условиям коммуникации.
Это изменение происходит как семантическое осложнение. Для литературного текста начало исследованию этого явления было положено Б.А. Лариным, а позднее вылилось в теорию стилистического контекста в работах И.А. Банниковой, Р.А. Киселевой, С.И. Болдыревой, Г.В. Андреевой и других.
Теория стилистического контекста учитывает то обстоятельство, что при чтении читатель основывает свое понимание на всех возможных сопоставлениях и противопоставлениях элементов в структуре целого. Стилистический контекст основан не на минимальных контекстуальных указаниях, идентифицирующих уже знакомые значения, а, напротив, на возможном максимуме индикации, позволяющем заметить появление в слове новых оттенков значения, коннотаций и новых связей с обозначаемой действительностью или вымыслом. Стилистический контекст, соответственно, не ограничивается рамками непосредственного окружения элемента, а учитывает дистантные связи в тексте в целом и возможные ассоциации в тезаурусе читателя. Языковой контекст при этом должен учитываться на первой ступени анализа.
Исследования живой речи показали плодотворность и необходимость применения контекстологического анализа за рамками предложения с учетом фоновых знаний коммуникантов, речевой ситуации и ролевой структуры общения.
§ 8. Компонентный анализ
Рассмотренные выше типы анализа - дистрибутивный, контекстологический и валентностный-основывались на синтагматических связях изучаемых единиц лексики. Компонентный анализ, которому посвящен настоящий параграф, опирается на парадигматические связи в системе.
Компонентный анализ был разработан и используется в основном как метод раскрытия семантики слов, но применялся и в других областях лингвистики, например в фонологии, где фонема представлялась как связка или пучок различительных (дифференциальных) признаков на основе ряда их бинарных противопоставлений. Метод, как показали Е.В. Гулыга и Е.И. Шендельс, оказался плодотворным и в морфологии и в синтаксисе.
49
Но особенное развитие этот тип анализа получил применительно к семантике слов, на чем и будет сосредоточено внимание в
этом параграфе.
В компонентном анализе значение слова разлагается на его составляющие.Ихназываютсемантическимикомпонентами,семан- 'тическимимножителями,дифференциальнымисемантическими признаками, семантическими параметрами, ноэмами и т.д. В дальнейшем изложении будет принят термин «сема». Этот термин наиболее приемлем в качестве центрального термина компонентного анализа, поскольку он отвечает требованиям краткости, прозрачной мотивированности, указывающей на его принадлежность к семантике как плану содержания, обладает хорошим словообразовательным потенциалом (ср. «семный состав», «классема», «гиперсе-
ма» и т.д.).
Семой мы будем называть элементарную составляющую значения слова или другой языковой единицы, отражающую рарличаемыеязыкомпризнакиобозначаемого.
Сему часто называют мельчайшей единицей смысла, неразложимой на более мелкие части. Такое определение необосновано и неудачно, поскольку для многих общеизвестных и общепринятых сем возможна дальнейшая сегментация, так, например, в семе [пол] можно еще выделить сему [живое существо]. Вряд ли можно назвать мельчайшими единицами смысла семы [невзрослость], [женский пол] и [человеческое существо], образующие смысл слова девочка. Предел членения того или иного значения на семы задается поставленными висследовании задачами.
После этих общих замечаний и прежде чем переходить к описанию современного состояния методики компонентного анализа, необходимо коротко описать историю этого подхода.
Первыми исследователями, предложившими и разработавшимикомпонентныйанализлексики,былиамериканскиеантропологи У. Лаунсбери и Ф. Гудинаф, которые при помощи информантов изучали языки американских индейцев и, в частности, термины
родства у разных племен.
Сравнивая по минимальным парам термины родства, они для определения смысла слов отец, мать, сын, дочь, дядя, тетка выделили следующие признаки: [старшее :: младшее поколение], [женский :: мужской пол], [прямое :: непрямое родство]. Тогда слово отец означает лицо старшего поколения, мужского пола и пря-
мого родства.
Подобные четко структурированные семантические поля позволяют выделить семы реляционно, т.е. путем сопоставления ми-
50
нимальных пар. Однако, поскольку таких строго упорядоченных систем в лексике очень немного, необходимо было найти более универсальный способ компонентного анализа. Такой способ и был найден в виде опоры на словарные дефиниции.
Обращение к словарям как к источникам материала при лингвистических исследованиях прочно вошло в науку со второй половины XX века. Но начало ему было положено значительно раньше. И.А. Бодуэн де Куртенэ еще в 1903 году при подготовке съезда славянских филологов и историков предложил среди прочих тем для обсуждения на съезде тему «Об утилизации словарного материала для общелингвистических, психологических и культурно-истори- ческих выводов». О том, как реализованы эти идеи в настоящее время, будет подробнее сказано дальше, а применительно к обзору истории методики отметим, что, помимо толковых словарей, использовались и идеографические.
Идеографическим называется, как известно, словарь, в котором слова расположены не в алфавитном порядке, а, исходя из их значения, по тематическим рядам. В таком словаре в явном виде фиксируются семантические отношения между словами и дается клас-
сификация лексики применительно к отраженной в ней системе понятий.
Наиболее известным идеографическим словарем является тезаурус Роже, впервые изданный в 1852 году, а в дальнейшем неоднократно переиздававшийся и совершенствовавшийся. Разработанная в нем система понятий, хотя она неоднократно подвергалась критике и переделывалась, дает возможность классифицировать лексику применительно к обозначаемым понятиям. При этом осуществляется основное требование, предъявляемое к любому описанию — число описывающих элементов значительно меньше числа описываемых. Названия тех классов и групп, в которые слово входит, могут тогда рассматриваться как его семы.
Этим свойством и воспользовалась группа кембриджских ученых под руководством М. Мастерман. Компонентный анализ, разработанный этой группой, состоит в приписывании каждому слову индексов в соответствии с теми группами, классами и темами, в которые оно входит в словаре Роже. Исследование было ориентировано на нужды машинного перевода.
В том же Кембридже другая исследовательница К. Спарк Джоунз использовала компонентный анализ с помощью идеогра-
фического, словаря для разработки теории синонимии. Обе группы исследовали также полисемию.
51