При добавлении в анализ каждого критерия из РАТ и шкалы аспектов связности дискурса (см. Приложение В) количество значимых корреляций на уровне = 0.05 увеличивается до 67, и после применения поправки Бонферрони устанавливается уровень значимости, равный p' = .00074627. Перечисленные выше коррелирующие между собой методы анализа остаются значимыми и на этом уровне. Что касается подробных критериев, использованных в обоих тестах, помимо естественных корреляций внутренних критериев каждого метода между собой и с их средним, также была установлена значимая корреляция для параметров информативности в обоих тестах. Однако разница между ними всё же есть: если информативность как один из четырёх аспектов коррелирует с локальной связностью, а также со средним результатом теста РАТ, то информативность в шкалах РАТ демонстрирует связь с каждым из четырёх аспектов дискурса, а также со шкалой качества содержания; с качеством содержания оказывается также связанным критерий наличия/отсутствия парафазий в речи (РАТ). Однако ни с грамматической сложностью, ни с беглостью речи ни один из методов либо критериев не демонстрирует значимых корреляций.
Критерий воспринимаемости речи (один из четырёх аспектов) так же, как и информативность, оказывается связан с качеством содержания; помимо прочего, все четыре аспекта демонстрируют значимые корреляции с локальной связностью. его корреляция с локальной связностью, и из РАТ - с информативностью, наличием парафазий и средним значением теста РАТ. Характер корреляций параметров связанности речи, её воспринимаемости и ясности схож: все три параметра демонстрируют корреляции с парафазиями и информативностью из шкал РАТ (p < .00075). Таблица всех корреляций представлена в Приложении В; корреляции, соответствующие установленному после введения поправки уровню значимости, выделены серым цветом. Интерпретацию полученных в данном разделе результатов смотрите в главе “Обсуждение”.
3. Обсуждение
Полученные результаты исследования в целом не противоречат общепринятым тезисам об устройстве макроструктуры дискурса; начнём интерпретировать результаты с самого начала, а именно - с сопоставления различий между группами (группой нормы и группой пациентов с афазией). В первую очередь, отметим, что средние результаты сравнения параметров из ТРС, то есть глубины дерева и количества ЭДЕ, не соответствуют первоначальной гипотезе о том, что для нормы более характерно усложнение конструкций, вызывающих “углубление” риторического дерева, а количество ЭДЕ непосредственно отражает сложность дискурса и успешность владения им. Если проверить эти показатели на наличие корреляций с каким-либо дополнительным критерием, например, с параметром беглости речи или грамматической сложности из РАТ (см. Приложение В с полной таблицей корреляций), то даже логическая связь “быстрая, сложная и беглая речь = большое количество ЭДЕ” статистически не подтверждается. Более того, при более подробном рассмотрении этому феномену можно найти довольно объективное объяснение, причём опять же связанное с теорией риторических структур. Так, на использованных данных в (Рудина, 2018) было выявлено преобладающее количество ассиметричных отношений типа Elaboration именно в группе пациентов с афазией, и зачастую из-за запинок, исправлений и неожиданного обрывания речи пациенты склонны развивать дискурс именно в сторону “навешивания” дополнительных, редактирующих данное предложений. Этот факт так же демонстрирует обилие отношений типа Repair (в любом из видов) у пациентов, и эти типы отношений так же являются ассиметричными. Более того, по косвенным данным, касающимся в большей степени выборки, нежели статистических особенностей групп людей без речевых нарушений, в данном случае участники из группы нормы были склонны быстрее закончить свой рассказ. Их нарративы были в целом короче (по количеству ЭДЕ, а также по длительности аудиозаписи), и в этом случае даже будучи довольно ёмкими, в показателях типа количества ЭДЕ или глубины риторического дерева их рассказы проигрывали. Что касается сильной корреляции параметров ЭДЕ и глубины деревьев между собой, то это объясняется самим принципом ТРС. Поскольку каждая ситуация на картинке финитна, и, вероятно, её описание симметричными отношениями ограничено, то при увеличении количества ЭДЕ на рассказ растёт количество дополняющей информации, раскрывающей риторическое дерево вглубь.
Стоит отдельно остановиться на таких параметрах, как глобальная и локальная связность. Вспомним, что в (Glosser & Deser, 1991) при сравнении пациентов с беглой афазией и группой нормы оба показателя связности хотя и были в среднем ниже (что соответствует полученным результатам настоящего исследования), они оставались в пределах нормы, то есть, статистически не отличались от показателей группы нормы. Этот результат отлично соответствовал на тот момент довольно распространённому мнению о том, что пациенты с беглой афазией склонны сохранять тот аспект организации речи, который минимально задействует микроуровень. В настоящем же исследовании, как видно из результатов сравнительного анализа между группами, именно по локальной связности группа афазии демонстрирует статистически значимый результат (или, говоря на языке статистики, результат с наименьшей вероятностью ошибки первого рода), тогда как по глобальной связности неслучайных различий не было отмечено. То есть, можно утверждать, что на локальном уровне связности может проявляться фактор, ухудшающий связность элементов между собой (локально). Объяснение этому феномену можно найти в природе самой локальной связности: как было подчёркнуто в (Glosser & Deser, 1991), когерентность может выражаться с помощью связующих средств, относящихся больше к компетенциям микроструктуры дискурса, - таких как кореференция и др., - и логично предположить, что зависимость макросвязности от таких факторов на локальном уровне выше, чем на глобальном. Следовательно, при нарушениях на микроуровне дискурса дефект будет влиять в первую очередь на связность высказываний между собой, нежели на релевантность нарратива в глобальном смысле. Стоит, однако, принимать во внимание возможность нарушений речевой цельности и без нарушений связанности (напр., Coelho & Flewellyn, 2003), однако возможность возникновения такого нарушения только на уровне локальной когерентности, игнорируя глобальную, вряд ли существует.
Несмотря на наличие значимых различий между результатами группы нормы и группы афазии по всем остальным критериям, стоит отметить, что разница в средней оценке, например, качества содержания истории в обеих группах высока. Такой результат вполне соотносится с тезисами из исходной работы (Ulatowska et al., 1981), а именно с относительной сохранностью общей организации рассказа и довольно чёткой сохранностью информации между частями нарратива у группы афазии. В этом отношении важно упомянуть шкалу четырёх аспектов дискурса, с которой у параметра качества содержания была установлена сильная корреляция. Природа корреляции между двумя методами довольно объяснима: как было представлено в (Linnik, 2017), шкала качества информации выдвигает минимальные требования к связности рассказа, а именно лишь то количество информации, которое необходимо для передачи некоторого сообщения; связность на таком уровне является необходимой для каждого из четырёх аспектов связности. Стоит также учесть субъективность оценивания в обоих методах: клиницисты оценивают дискурс, не прибегая к упрощённым и более объективным формам оценки - например, процентному соотношению достоверных и релевантных информационных единиц (напр., McNeil, Doyle, Fossett, Park, and Goda, 2001), - оставляя возможность оценки качества речи с точки зрения её субъективного восприятия другим человеком, без привязки к удобным дискретным структурам, поскольку до сих пор не доказано, что макроуровень дискурса относится к таковым или может быть достоверно проанализирован в таком виде (Linnik et al., 2015). Если сравнить, например, критерии связанности (Glosser & Deser, 1991) с критериями качества содержания (Ulatowska et al., 1981), то в первом случае оценка дискурса зависит от того, насколько каждое высказывание соответствует теме, тогда как во втором случае вопросы о релевантности и общем качестве дискурса относятся к нарративу целиком. Оценивание дискурса человеком в таком случае основано на восприятии речи “as is”: требуется определить, насколько со всей её организацией, возможными ошибками и несоответствиями - такими, какие они есть, - произведённый нарратив информативен и может быть верно воспринят другим человеком. Именно такой подход к цельности речи, а именно восприятие нарратива “постфактум” и оценивание его информативности, связанности частей, ясности (то есть, релевантности) и воспринимаемости и лежит в основе четырёх аспектов дискурса (Linnik, 2017). Видимо, этим и объясняется отсутствие корреляций между глобальной связностью дискурса и любым из четырёх аспектов связности по (Linnik, 2017): с позиции последнего метода, не каждый компонент речи обязан соответствовать топику на высоком уровне, то есть обладать высоким значением глобальной связности, чтобы речь в целом была воспринята как релевантная. Однако в таком случае возникает разумный вопрос об обоснованности корреляций между локальной связностью и каждым из четырёх аспектов дискурса, и этому феномену также можно найти объяснение.
Как было сказано ранее, на локальную связность в большой степени влияет связанность элементов определёнными смысловыми отношениями (англ. cohesion), выраженных лингвистически (напр., анафора), поскольку, как сказано в (Glosser & Deser, 1991), это “клей, соединяющий элементы для достижения связности”. С помощью связующих (англ. cohesive) элементов каждое отдельное высказывание связывается с остальными и достигается его тематическое единство с уже предоставленной информацией. И, так как каждое высказывание является лишь частью нарратива, и даже его соответствие теме (то есть, глобальная связность) при отсутствии связанности с другими высказываниями (локальная) не будет восприниматься цельно, то отсутствие локальной связности повлияет на конечное восприятие речи слушателем - или, в терминах (Linnik, 2017), на субъективное качество дискурса (см. выше). Более того, как было установлено, например, в (Capilouto et al., 2006), параметры связанности речи и др., кроме информативности, опираются полностью на способность говорящего устанавливать семантические и прагматические связи между элементами - что полностью повторяет характеристику локальной связности по (Glosser & Deser, 1991), несмотря на оценивание этих параметров субъективно, целиком, не составляя рейтинг для каждого высказывания. Таким образом, опираясь на схожие механизмы, оба метода получают коррелирующие между собой результаты.
Следующий аспект, который хотелось бы затронуть, -- это дифференциация между группами в результатах тестирования РАТ (напр., ср. средние 3.54 и 4.56 у афазии и нормы соответственно) и оценки четырех компонентов связности (ср. MPAW = 1.77 и MNorm = 2.78), статистически также подтвердившая значимые различия между группами нормы и афазии по каждому из параметров обоих тестирований. Так как для тестирования РАТ были отобраны самые информативные пробы, демонстрирующие более низкие результаты у группы афазии и безошибочность в группе нормы (Солоухина и др., 2017), на базе которых и были построены использованные в работе нарративы, то статистическое различие между группами нормы и афазии лишь ещё раз подтверждает надёжность использованных критериев. Аналогично, шкала аспектов последовательности дискурса оказалась чувствительна к различиям в дискурсе между группами нормы и пациентов с афазией, что также не противоречит результатам, представленным в (Linnik, 2017). В целом, результаты двух тестирований подтверждают выводы из фундаментальной для объекта исследования работы (Ulatowska et al., 1981), а именно более низкое качество нарративов у группы афазии, чем у группы нормы.
Что касается корреляции средних у РАТ и четырёх аспектов связности дискурса, то их можно попытаться объяснить через корреляции между отдельными критериями в этих методах. В первую очередь, информативность по шкале РАТ, коррелирующая со всеми критериями из четырёх аспектов, отражает не только объём переданной информации (полнота описания), как и во втором методе, но также оценивает информацию на предмет логических ошибок и их связи, что в тестировании по четырём аспектам покрывают соответственно критерии ясности и связанности речи. Субъективная оценка клиницистом логики и интерпретация им пересказа (поскольку необходимо оценить степень детализации и точность в передаче последовательности событий) придают этому параметру также компонент оценки из аспекта воспринимаемости дискурса. Таким образом, так как информативность по шкале РАТ является более широким понятием, то она включает в себя различные аспекты связности, что может быть объяснением корреляции между информативностью по РАТ и всеми четырьмя аспектами связности.
Наблюдается также корреляция парафазий из РАТ и связанности, ясности и восприятия речи. Поскольку парафазии - лингвистический показатель, если точнее, то показатель микроуровня дискурса, то стоит вспомнить результаты классификации с использованием случайных деревьев из (Linnik, 2017), где именно для последних трёх параметров (Connectivity, Understandability, Clarity) использование микроструктурных параметров в классификаторе позволило улучшить качество предсказаний. Поскольку важным показателем в отношении парафазий РАТ является не тип парафазий, а то, искажается смысл фразы от наличия парафазии или нет, то можно также соотнести обсуждаемый результат с тем, что аграмматичность элемента дискурса (например, высказывания), вызванная ошибкой на уровне слова, также способна вызвать разрыв дискурса, снижать беглость речи, а значит, порождать пробелы в нарративе, влияя на его связность. Таким образом, искажающие фразу парафазии заменяют её смысл на условный нуль, и фраза, которая должна была бы стать отправной точкой для следующей фразы, будто отсутствует. Локальная связность элементов теряется. Описанные корреляции критериев обеих шкал и их средних доказывают довольно успешную концептуальную связь их критериев: например, хоть корреляций с аспектами связности у беглости речи и грамматической сложности и не было установлено на новом принятом уровне значимости, но вклад этих микроструктурных параметров проявляется в корреляции между итоговым значением РАТ и четырёх макроуровневых критериев связности, - по описанным выше причинам, связанным с влиянием микронарушений на восприятие речи и её целостность.
В целом, интерпретация результатов исследования может быть сведена к следующим данным. К сожалению, параметры из ТРС оказались не чувствительны к имеющимся данным и группам людей, не были выявлены и корреляции других аспектов, представленных в исследовании, с этими параметрами. Возможно, результат мог быть точнее, если бы метод учитывал грамматическую сложность представленных ЭДЕ, процент ошибок или скорость речи (с помощью размеченных по времени ЭДЕ) - то есть, те микролингвистические критерии, которые учитывает мультиуровневая шкала РАТ (беглость речи, грамматическая сложность и парафазии). Что касается двух уровней связности, то методика - оценка связности для каждого высказывания отдельно - предсказуемо повлияла на результаты исследования. Если связность на локальном уровне страдает из-за ошибок на уровне слова или фразы, то в этом плане не меньше страдают и четыре аспекта дискурса: информативность, понимаемость, ясность и связанность. Глобальный же уровень связности, выражающийся в чётком соответствии каждого высказывания топику, не демонстрирует ни значимых различий, ни корреляций с другими методами (кроме локальной связности), и методология играет в этом случае огромную роль: вероятно, использование других методов, оценивающих релевантность дискурса и отклонения от заданной темы перцептивно, основываясь на переданном в результате прослушивания рассказа смысле, оказывается более уместным. Глобальную (ярко выраженную) нерелевантность и пропуск деталей способен отметить любой из упомянутых методов; кажется, что требование глобальной связности от каждой фразы не способно выявить различия между группой нормы и группой афазии, поскольку участники группы нормы так же способны отклоняться от темы, давать комментарии или вдаваться в детали, не являющиеся главными элементами в истории. Этот вывод не противоречит результатам из (Glosser & Deser, 1991), поскольку в исходной работе разница между группой нормы и группой афазии также не была отражена. Шкала качества содержания, требующая от речи релевантности и возможности её понять и осознать, предсказуемо оказывается сильно связана с показателем информативности РАТ и показателем “воспринимаемости” дискурса (один из четырёх аспектов связности). Из-за комбинации микролингвистических критериев в шкале РАТ (парафазии и грамматическая сложность), являющихся важными факторами, влияющими на макропоказатели (четыре критерия связности), а также из-за совпадений параметров, таких как информативность, связь шкалы РАТ и четырёх аспектов когерентности также нельзя назвать случайной.