компонентов окружающей языковой или внеязыковой среды предположено учесть, и обосновать принятые решения.
СПИСОК РЕКОМЕНДУЕМОЙ ЛИТЕРАТУРЫ
Адмони В.Г. Синтаксис современного немецкого языка.-Л., 1973.
Арнольд И.В., Буга Н.Н. Адаптивные системы и некоторые вопросы лексикологии // Системное описание лексики германских языков. -1981. - Вып. 4. - С. 3 -10.
Бондарко А.В. Опыт лингвистической интерпретации соотношения системы и среды // Вопр. языкознания.—1985.—№ 1. —С. 13—23.
Буга Н.Н. Основы теории связи и передачи данных. —Л., 1968. — 4.1.
Заде Л. Понятие лингвистической переменной и его применение к принятию
приближенных решений. - М., 1976.
Иванова И.П. О полевой структуре частей речи в английском языке // Теория языка, методы его исследования и преподавания. — Л., 1981. — С. 125 —129.
Иванова И.П. и др. Теоретическая грамматика современного английского язы-
ка: Учебник. - М., 1981.
Караулов Ю.Н. Лингвистическое конструирование и тезаурус литературного
языка.-М., 1981.
Мельников Г.П. Системология и языковые аспекты кибернетики. -М., 1978. Морковкин В.В. Идеографические словари. — М., 1970.
Скрелина Л.М. Грамматическая синонимия. — Л., 1987. Соссюр Ф. де. Труды по языкознанию. — М., 1977. Щур Г.С. Теория поля в лингвистике. — М., 1974.
Firth J. Papers in linguistics, 1934-1951. - L.: Oxf. univ. press, 1958.
Guillaume G. Foundations for a science of language.—Amsterdam-Philadelphia:
John Benjamins, 1984. -Р. 58-60.
Halliday M.A.K. A short introduction to functional grammar. - L., 1984. Leech G.N. Towards a semantic description of English. - L.: Longman, 1971.
Quirk R., Greenbaum S., Leech G., Svartvik J. A grammar of contemporary English.-L.: Longman, 1976.
Глава III. МЕТОДЫ И ПРОЦЕДУРЫ ЛИНГВИСТИЧЕСКОГО АНАЛИЗА
§1. Выбор методики
Впервой главе было показано различие между методологией, методом и методиками (процедурами) лингвистического анализа. Методология науки о языке базируется на философии и научной парадигме. Эта методология находит свое выражение в растущем внимании к функционированию языка в практике общения людей. Современный функциональный подход к языку как к постоянно саморазвивающейся системе можно рассматривать как господствующую в науке парадигму. Другими широко известными подходами, имеющими многолетнюю историю, являются сравнительноисторический метод и исторический метод, исследующий развитие фонетики, морфологии, синтаксиса и других аспектов конкретных языков, сопоставительный метод, описывающий сходства и различия двух или больше языков, а ныне метод автоматического анали-
за текстов с помощью компьютеров. — В литературе существует немало работ по методам исследова-
ния, но в большинстве случаев они описывают какой-нибудь один метод и не дают общей картины. Восполнить этот недостаток и предстоит данной главе, содержащей обзор наиболее распространенных методов и возникших в их рамках процедур, так, чтобы читатель сам мог выбрать наиболее для себя подходящие.
Выбор методики, соответствующей объекту и задачам исследования, имеет для успеха работы первостепенное значение. Для начинающего исследователя этот выбор затруднен тем, что он плохо знаком с существующими возможностями и сравнительной эффективностью процедур. Поскольку такого обзора нигде в литературе нет, начинающий тратит много времени, отыскивая, более или менее вслепую, подходящую методику, а выбор его не всегда оказывается оптимальным.
Генетически каждая методика анализа связана с каким-либо конкретным методом и конкретной лингвистической теорией. Практика, однако, показывает, что оптимальные результаты дает хорошо продуманное сочетание нескольких типов процедур таким образом, что каждая из них будет не только дополнять, но и конкретизировать остальные. Известно, например, что дистрибутивный анализ, о котором пойдет речь в одном из параграфов настоящей главы, диагностирует далеко не все различия в семантике слова и его приходится дополнять трансформационным анализом. Соче-
33
тание дистрибутивного и трансформационного анализа изначально заложено в анализе, который называют операционным.
Ввиду тесной связи процедур анализа с теми методами, в рамках которых они возникли, материал в дальнейшем группируется по методам, а внутри каждого метода рассматриваются наиболее характерные для него методики. Таким образом будут описаны ги- потетико-дедуктивный метод, метод оппозиций, дистрибутивностатистический анализ, валентностный анализ, компонентный анализ, контекстологический анализ, методы автоматического ана-
лиза текста.
Этому списку недостает полноты, а пополнять его можно до бесконечности, поскольку в настоящее время для большинства работ характерна комплексная методика, а новое сочетание уже известных элементов может дать качественно новый результат. Будем исходить из невозможности объять необъятное и ограничимся главными типами.
§ 2. Гипотетико-дедуктивный метод
Гипотетико-дедуктивный метод анализа следует рассмотреть первым, поскольку он нередко является в исследовании основным, включающим другие, более частные методики.
Еще в 1931 году Л.В. Щерба в статье «О трояком аспекте языковых явлений и об эксперименте в языкознании» писал, что лингвистическое исследование должно состоять из сбора фактического языкового материала, построения гипотезы и проверки ее истинности на новых фактах (Щерба, 1974).
Напомним, что под гипотезой понимается прием познавательной деятельности человека. Гипотеза — особая форма развивающегося знания, предположение, которое объясняет наблюдаемые явления и которое, для того чтобы стать научной теорией, нуждается в проверке и доказательстве.
История науки показала, что невнимание к этому естественному ходу познания, т.е. невнимание, в частности, к фактическому материалу, оказывается причиной краха многих теорий.
Подробнее с гипотетико-дедуктивным методом можно ознакомиться по очень обстоятельной статье О.Н. Селиверстовой, которая тоже показывает большую роль Л.В. Щербы в возникновении этого типа анализа. Но она же отмечает, что название «гипотетикодедуктивный» было позже заимствовано для этого метода из философии (Селиверстова, 1976).
В основном метод состоит из следующих этапов:
34
Установив критерии подлежащего исследованию объекта, исследователь собирает фактический материал. Источником материала может служить художественная или специальная литература, словари или опрос информантов.
Собранный языковой материал обобщается индуктивным путем. Индуктивным называется умозаключение, в котором мысль развивается от знания единичного и частного к знанию общего. Так создается теория в виде гипотезы. Теорией будем называть некоторую систему идей, дающую научное объяснение явлению или классу явлений. Далее гипотеза уточняется многими путями, например, сопоставлением с уже известными концепциями и выявлением противоречащего им материала.
Затем наступает этап дедукции. Так называют выведение новой мысли из признанных истинными данных чисто логическим путем. Путем дедукции получают также следствия из предложенной теории.
Заключительным этапом является проверка новой теории путем сопоставления ее с дополнительно полученными фактами. Если при этом обнаруживается отрицательный, т.е. противоречащий сделанным выводам материал, который не укладывается в рамки предложенной теории, это, при условии, что гипотеза в целом подтверждается достаточно большим числом случаев, означает необходимость введения уточнений и описания пограничных случаев. Последнее обстоятельство заслуживает серьезного внимания в связи с концепцией полевой структуры языковых явлений (см. с. 26).
В большинстве работ гипотетико-дедуктивный метод применяют в сочетании с каким-либо другим из описанных ниже методов, что обеспечивает большую надежность результатов.
Все виды лингвистического исследования включают не только наблюдение и объяснение, но и классификацию полученных фактов. В целом ряде случаев классификация исследуемых объектов, т.е. распределение их по классам по наиболее существенным признакам, составляет важную часть их изучения. Предварительная классификация может иметь место уже на начальных этапах при организации исходных данных. Нередко классификация включается в задачи работы и дается в конце ее. Большое значение классификаций в лингвистической науке обусловлено тем, что в языке приходится иметь дело с очень мощными множествами единиц.
В качестве синонима для термина «классификация» часто употребляют термин «таксономия». Но это не совсем одно и то же, так как таксономия есть теория классификации, или наука о классификациях. Но ошибка здесь невелика, поскольку в языкознание
35
входят многие науки, названия которых метонимически совпадают с названиями изучаемых ими предметов (грамматика, морфоло-
гия, семантика и т.д.).
Большинство лингвистических классификаций строится по единому принципу деления в соответствии с двузначной логикой Аристотеля. Для того же множества можно получить и другую классификацию, если ввести другой признак деления. Несколько классификаций одного и того же множества по разным основаниям образуют комплекс классификаций. Так, например, все множество английских глаголов можно по морфологическому признаку разделить на корневые, префиксальные и сложные; по синтаксическому признаку - на переходные и непереходные; по семантическим характеристикам — выделить глаголы психического состояния и подразделить их на интеллектуальные, эмоциональные, сенсорные и
т.д.
После точного установления полного набора диагностирующих признаков каждый член группы характеризуется по каждому из
них.
Группы формируются на основе жестких последовательных де-
лений.
Для отнесения к группе элемент должен обладать полным набором признаков. В противном случае он выделяется для особого описания и объяснения.
При полевой структуре полным набором признаков обладает
только ядро группы.
При классификации по принципам многозначных логик исследователя интересует комбинаторика признаков, отдельные признаки могут оцениваться знаком минус. Удобным средством для такого анализа оказалась Булева алгебра и решетки Вейтча (см.
с. 107).
Описание количественной таксономии дано в работах А.Я. Шайкевича. На них мы подробнее остановимся ниже (см. с. 42), а здесь заметим только, что в его методике составляются таблицы, или матрицы, где строки соответствуют объектам, а колонки - признакам. На пересечении строк и колонок отмечается наличие или отсутствие признака. Результаты обрабатываются с помощью математической статистики или простыми арифметическими подсчетами.
§ 3. Метод оппозиций
Подобно многим другим методам, метод оппозиций трудно разграничить с породившей его теорией. Поэтому содержанием
36
этого параграфа будет прежде всего именно теория оппозиций, а ее применение в исследовательской практике лингвистов будет изложено сравнительно кратко.
Учением об оппозициях наука обязана выдающемуся русскому филологу Н.С. Трубецкому, бывшему одним из создателей Пражской лингвистической школы. Теория оппозиций изложена Н.С. Трубецким в его ставшей классической работе применительно к фонологии. Но при дальнейшем использовании многими учеными разных стран она оказалась весьма плодотворной на всех уровнях языка (Трубецкой, 1987).
Разработанное Н.С. Трубецким учение об оппозициях имеет в своей основе известный тезис Ф. де Соссюра: «Весь лингвистический механизм вращается вокруг тождеств и различий, причем эти последние только обратная сторона первых». Однако ни сам Сос-
сюр и никто другой до Трубецкого целостной теории оппозиций не давал.
Перечислим коротко те положения теории, которые лежат в основе метода. Прежде всего надо подчеркнуть, что не всякое различие является оппозицией. Оппозиция возможна лишь тогда, когда между ее членами имеются не только различия, но и общие признаки. Эти последние называются основанием для сравнения, а различительный признак принято называть дифференциальным признаком. Оппозицию можно определить как семантически релевантное различие по одному признаку при сходстве остальных.
Основание оппозиции может рассматриваться как некоторый абстрактный инвариант. Реальные элементы оказываются тогда вариантами, осложненными некоторыми добавочными признаками. При сравнении учитываются и рассматриваются не все признаки, а
только те, которые признаны существенными для предложенной модели.
Н.С. Трубецкой различает оппозиции по отношению к системе и оппозиции между членами оппозиции. Один из более поздних исследователей, успешно соединивший теорию оппозиции с теорией графов, С. Маркус убедительно показал, что оппозиции по от-
ношению к системе целесообразнее рассматривать как отношения между оппозициями.
Оппозиции между членами оппозиции подразделяются на привативные, или бинарные, градуальные, или ступенчатые, и эк-
виполентные, или равнозначные. Привативными называются оппозиции, один член которых характеризуется наличием, а дру-
гой - отсутствием дифференциального признака. Привативные оппозиции соответствуют двоичной логике исключенного третьего 37
(да — нет), и поэтому их называют также бинарными, а классификацию по ним —дихотомической. Бинарный принцип неоднократно подвергался критике за огрубление действительности. Но огрубление неизбежно при всяком моделировании и в любой абстракции. Кроме того, стоит учесть, что все другие типы оппозиций могут, как правило, быть сведены к бинарным. Так, например, эквиполентная оппозиция, противопоставляющая исходное, метафорическое и метонимическое значения слова, может рассматриваться как привативное противопоставление исходного и неисходных, т.е. производных значений с дальнейшим подразделением внутри этих последних.
Эквиполентными называются оппозиции, которые не являются ни отрицанием, ни утверждением какого-либо признака, а характеризуются его качественным различием. Ср. kid ребенок и kid лай- ка. Оба члена оппозиции являются переносными вариантами kid козленок, но перенос в них разного типа: в первом случае - метафорический, а во втором — метонимический.
Градуальными называются оппозиции, члены которых отличаются разной степенью, или градацией, одного и того же признака. Например, глаголы: affect :: torment :: torture отличаются степенью интенсивностипричиненногострадания.
Примеров эквиполентных оппозиций можно привести очень много. Такой лексической эквиполентной оппозицией является, например, любой ряд стилистических синонимов:
lass. В этом случае основанием оппозиции является денотативное значение молодое существо женского пола, а стилистическая отнесенность— дифференциальным признаком. Для обозначения оппозиции принято употреблять знаки :: и
.То есть приведенную выше оппозицию можно записать и так:
Уже упомянутый выше С. Маркус, разрабатывая теоретикомножественную теорию оппозиций, добавил к перечисленным типам еще нулевые и дизъюнктивные оппозиции. Нулевые соответствуют тождеству, а дизъюнктивные — отсутствию сходства, но эти два типа могут иметь только вспомогательное значение.
Сам Н.С. Трубецкой оппозициям между членами оппозиции противопоставлял оппозиции по отношению к системе, различая при этом оппозиции пропорциональные, изолированные и многомерные.
Пропорциональной называется оппозиция, отношение между членами которой тождественно отношению между членами какойто другой оппозиции, так что они образуют корреляцию оппози-
ций, что позволяет выявить какую-либо языковую закономерность. Оппозицию в этом случае представляют как дробь:
что позволяет выделить во всем множестве английских прилагательных подмножество прилагательных с префиксом un-, означающим отсутствие признака, указанного основой. Или другой пример:
Здесь корреляция состоит из слов, которые попарно отличаются тем, что первые члены пар означают лиц мужского пола, а вторые — женского, причем различие в значении морфологически выражено суффиксом -ess.
Если в системе нет другой пары, члены которой находились бы в таких же отношениях, рассматриваемая оппозиция считается изолированной. Например: wit:: witness, где именная основа первого члена, сочетаясь с суффиксом, дает имя лица, в то время как обычно суффикс -ness присоединяется к адъективным основам и образует абстрактные существительные: ready:: readiness.
Многомерными Н.С. Трубецкой, называл оппозиции, основание которых не ограничивается членами данной пары, но распространяется и на другие элементы в системе.
И сам Трубецкой, и позднейшие исследователи наметили пути использования данного метода для выделения классов языковых единиц и их множеств, над которыми возможны различные операции. Обращение к теории оппозиций особенно перспективно для раскрытия системности в языке и при составлении всякого рода классификаций (Арнольд, 1986).
Метод оппозиций хорошо сочетается почти со всеми другими методами лингвистического анализа, описанными в последующих параграфах этой главы: например с дистрибутивным, не реже чем с компонентным или контекстологическим.
§ 4. Дистрибутивный анализ
Дистрибутивный анализ генетически связан со структурализмом и занимал большое место в американской лингвистике 30-х, 40-х и 50-х годов. И хотя общие теории структурализма современ-
38 |
39 |
|
ной лингвистикой оставлены, техника, им созданная, оказывается полезной и в настоящее время в рамках других направлений.
В этой главе мы стараемся показать, что внутри каждого метода возможны еще отдельные частные методики — процедуры сбора материала и его обработки для получения научного результата. Эти частные методики, возникшие сначала в рамках одного конкретного метода, потом могут использоваться вместе с процедурами, первоначально возникшими в других направлениях. Это справедливо и для дистрибутивных методик.
Под дистрибуцией понимают сумму всех окружений, в которых встречается тот или иной языковой элемент (фонема, морфема, слово и т.д.), т.е. сумму всех возможных позиций элемента относительно других элементов того же уровня, его сочетаемость.
Для упорядочения описания в дистрибутивном анализе широко используются условные буквенные обозначения классов слов, из которых образуются так называемые дистрибутивные формулы. При таком кодировании слова заменяются символами, указывающими класс, к которому принадлежит слово. Так, N означает существительные и слова, которые могут стоять в позиции существительных. Для уточнения, т.е. указания лексико-грамматических разрядов существительных, можно пользоваться подстрочными
индексами: Npers-имя лица, Nmass - вещественное существительное, Nabstr - абстрактное существительное, Vtr - переходный глагол, Vintr — непереходный глагол, А - прилагательное, D - наречие и его эквиваленты. Не кодируются, а даются в обычной транскрипции исследуемые слова и некоторые служебные.
Кодируя все слова, кроме изучаемого, получают его дистрибутивную формулу.
Дистрибутивные формулы очень удобны для классификации собираемых примеров, позволяя показать условия вариативности значения того или иного слова:
make + N |
make a coat/ a decision |
make + (the) + N + V |
make the machine go |
make + A |
make sure |
make + A + N + for + N |
make a good wife for him |
Дистрибутивное моделирование широко применяется в лексикографии для показа функционирования слова и его сочетаемости. Первыми, кто применил такое моделирование, были представители прикладной лингвистики: известный методист Г. Пальмер, использовавший моделирование в своих подстановочных таблицах для обучения английскому языку японцев, а затем в 40-х годах не 40
менее известный лексикограф А.С. Хорнби в учебном словаре. Оба они применяли, однако, не формулы буквенного типа, а модели, выраженные словами. В лексикографии этот метод, или точнее прием, очень себя оправдал. Модели с формулами приводятся, например, во введении к «Англо-русскому словарю глагольных сочетаний» под редакцией Э.М. Медниковой и использованы в словарных статьях этого словаря. Применяются они и в справочнике наиболее употребительных английских словосочетаний, составителями которого являются В.И. Перебейнос, С.С. Хидекель и другие ав-
торы.
Моделью в этом последнем справочнике называется «конструкция, отражающая грамматическую сочетаемость слов и выступающая как общее правило соединения классов слов и построения словосочетаний». Модели записываются символами грамматических классов и подклассов слов и располагаются в статье в соответствии с заданным порядком моделей каждой части речи. Употребление каждого слова определяется набором моделей. Так, для глагола make дается 6 различных моделей. Среди них, например, мо-
дель VNV - Let's make it go.
Таким образом, хотя породившая дистрибутивную методику теория отошла в область истории, развитые в ней процедуры и сейчас успешно применяются в практике лексикографии.
§ 5. Дистрибутивно-статистический анализ
Только что описанная нами в предыдущем параграфе методика хорошо коррелирует с применением статистики, а следовательно, и с другими отраслями прикладной лингвистики, а не только с лек-
сикографией.
Лингвистическая статистика - отрасль языкознания, занимающаяся изучением методов раскрытия закономерностей, свойственных большим совокупностям однородных объектов на основании их выборочного обследования. Свои важнейшие понятия лингвистическая статистика заимствует у математической статистики. Существенно обратить внимание на то, что просто количественный подсчет того или иного явления в нескольких или даже в большом числе текстов статистическим не является. Корректное примене-
ние статистики требует серьезного с ней ознакомления.
Основным методом применения статистики в сочетании с дистрибутивным анализом следует признать дистрибутивно-статисти- ческий анализ, как он представлен в трудах А.Я. Шайкевича и Ю.Д. Апресяна. Их методика имеет много общего с валентностным анализом, как он разработан Г. Хельбигом, а в Ленинграде —
41