Таблица 2. Критерии оценивания четырёх аспектов дискурса
|
Информативность - объём релевантной информации в рассказе. |
||
|
информативный |
3 необходимая информация сохранена 2 большая часть необходимой информации сохранена |
|
|
неинформативный |
1 некоторая важная информация сохранена; есть пропуски, влияющие на понимание пересказа 0 информация неполная, многое пропущено |
|
|
Воспринимаемость - отражает, как хорошо смысл, переданный говорящим, может быть воспринят и интерпретирован слушающем (не измерение информационного контента; хотя пропущенная информация может влиять на восприятие рассказа) |
||
|
понимаемый |
3 легко понять сюжет истории; я всё хорошо понял(а) 2 возможно понять сюжет в целом, но некоторые части немного неясны |
|
|
не понимаемый |
1 тяжело понять многое из рассказа; часто непонятно, о чём идёт речь 0 практически невозможно ничего понять из истории |
|
|
Связанность - оценивает отношения между последовательными элементами истории и правильной организации её частей в единое целое путём использования семантических и прагматических отношений |
||
|
связанный |
3 переходы между предложениями и крупными компонентами истории плавные 2 переходы между частями истории преимущественно плавные, хотя некоторые переходы между эпизодами или внутри них отсутствуют или слишком резкие |
|
|
несвязанный |
1 ход истории часто прерывается, большая часть переходов между предложениями и более крупными элементами отсутствует или слишком резка 0 телеграфичный переказ; присутствуют несвязные описания отдельных эпизодов; иногда невозможно определить, к одной ли истории относятся фразы |
|
|
Ясность - общая осмысленность дискурса. Достигается путём соответствия элементов истории общей теме и нарративной структуре. |
||
|
ясный |
3 рассказ хорошо структурирован; каждый эпизод правильно расположен, говорящий не отклоняется от темы слишком сильно рассказ хорошо структурирован; 2 есть отдельные комментарии или отклонения от основной сюжетной линии, но они не разрывают последовательность эпизодов |
|
|
неясный |
1 тяжело следить за ходом событий из-за частых отклонений/перепутанного порядка событий 0 невозможно следить за ходом событий из-за серьезных пропусков/запутанности |
2. Результаты
2.1 Сравнение результатов в рассказах Велосипед и Ограбление
Поскольку каждый метод был применён для каждого испытуемого дважды - для рассказов Велосипед и Ограбление - было необходимо доказать отсутствие значимых различий между историями в результатах анализа по каждому параметру. Так, для начала были проведены проверки на нормальность распределения результатов в двух группах - контрольной группе и группе пациентов с афазией. Оптимально мощным для выборки из 32 нарративов был принят критерий Шапиро-Уилкcа. Так, в группе афазии распределение по параметрам локальной и глобальной связности, а также итоговых значений оценки РАТ и четырёх аспектов дискурса было нормальным (p > .05, гипотеза H0 о ненормальности распределения отклоняется для обоих рассказов), поэтому для сравнения групп по этим параметрам был применён в дальнейшем двухсторонний t-критерий Стьюдента для двух независимых выборок. По остальным критериям как минимум для одного рассказа (Велосипед либо Ограбление) в группе афазии гипотеза распределение было ненормальным (p< .05), и для сравнения по этим параметрам был применён непараметрический U-критерий Манна-Уитни. В результате анализа ни по одному из параметров не было обнаружено значимых различий между рассказами группы пациентов с афазией.
Аналогично для контрольной группы нормы был применён тест Шапиро-Уилка на проверку распределения, в ходе которого была выявлена нормальность распределения для обоих рассказов по параметрам количества ЭДЕ и сводного результата РАТ, поэтому для сравнения рассказов по этим критериям в группе нормы был также применён двусторонний t-критерий для независимых выборок, а для всех остальных параметров (где хотя бы для одного рассказа нормальность распределения не была установлена) - непараметрический U-критерий Манна-Уитни. В группе нормы между рассказами также не было выявлено никакой статистически значимой разницы, уровень значимости = .05. Поэтому для дальнейших расчётов вместо двух значений (за оба рассказа) по каждому параметру оценивания для одного человека использовалось среднее значение оценки двух его рассказов. Таким образом, полная выборка состояла из 32 значений (равна количеству участников), по 16 значений в каждой группе испытуемых.
2.2 Средние значения по параметрам в двух группах
В целом, средние значения и локальной, и глобальной связности в группе пациентов с афазией оказались немного ниже средних значений в группе нормы. Однако остаётся неоспоримым факт довольно сильного сохранения (Minglob = 3.52; Minloc = 3.13) организации нарратива у пациентов с афазией и на локальном, и на глобальном уровне (Medianglob = 4.31; Medianloc = 4.21 у пациентов с афазией; ср. с соотв. 4.62 и 4.65 у группы нормы). Проверенные в рамках теории риторических структур показатели количества ЭДЕ и глубины риторических деревьев дали неожиданные результаты: в среднем глубина деревьев у группы нормы оказалась меньше, чем у афазии. Наоборот, средние значения качества содержания для группы нормы оказались выше, чем для группы афазии. Средние значения тестирования РАТ также показали более высокий результат в группе нормы; впрочем, по каждому из четырёх параметров тестирования результаты группы нормы в среднем также оказались значительно выше результатов группы афазии: как для параметра беглости речи, так и для оценки грамматической сложности, также для оценки парафазий в и информативности речи (см. Таблицу 3). Схожие результаты были получены как в оценке четырех аспектов дискурса в совокупности, так и при рассмотрении оценки по каждому из аспектов в отдельности: по приведённым в этом подходе (ср. информативность в тестировании РАТ) критериям информативности, понимаемости речи, связанности и ясности речи. В среднем, наиболее сильная дифференциация между группами (при первичном рассмотрении, до статистического анализа) наблюдается при тестировании РАТ и при оценке речи по четырём аспектам связности. Все средние значения приведены ниже в Таблице 3.
Таблица 3. Сравнение средних
|
Глубина дерева |
ЭДЕ |
Качество содержания |
Локальная связность |
Глобальная связность |
||
|
Афазия |
M = 3.28, SD = 1.08 |
M = 13.06, SD = 5.88 |
M = 2.5, SD = .47 |
M = 4.26, SD = .5 |
M = 4.29, SD = .5 |
|
|
Норма |
M = 2.56, SD = .75 |
M = 9.84, SD = 3.04 |
M = 2.85, SD = .13 |
M = 4.56, SD = .27 |
M = 4.67, SD = .21 |
|
|
Беглость речи |
Грам сложность |
Парафазии |
Информ |
Среднее РАТ |
||
|
Афазия |
M = 3.89, SD = .73 |
M = 3.72, SD = .55 |
M = 3.72, SD = .55 |
M = 3.4, SD = .84 |
M = 3.54, SD = .59 |
|
|
Норма |
M = 4.67, SD = .34 |
M = 4.52, SD = .39 |
M = 4.5, SD = .38 |
M = 4.55, SD = .38 |
M = 4.56, SD = .27 |
|
|
Информ |
Связанность |
Восприятие |
Ясность |
Среднее 4 аспекта |
||
|
Афазия |
M = 2.06, SD = .6 |
M = 1.53, SD = .67 |
M = 1.97, SD = .65 |
M = 1.5, SD = .84 |
M = 1.77, SD = .6 |
|
|
Норма |
M = 2.94, SD = .17 |
M = 2.47, SD = .56 |
M = 2.94, SD = .17 |
M = 2.78, SD = .32 |
M = 2.78, SD = .25 |
2.3 Сравнение результатов между группами
Для начала были проведены тесты на нормальность распределения, и распределение по критерию признавалось нормальным, если уровень значимости по критерию Шапиро-Уилкcа в обеих группах был ниже = .05. Исследовалась значимость следующих критериев: локальная и глобальная связность, качество содержания, среднее значение тестирования РАТ и каждый его параметр по отдельности, среднее значение оценивания по четырём аспектам дискурса и все четыре аспекта отдельно, а также глубина риторических деревьев и количество ЭДЕ в них. Как и для сопоставления рассказов, для выявления параметров, в которых проявляется статистически значимая разница между макроструктурой нарративов группы нормы и группы пациентов с афазией, в первую очередь была проведена проверка на нормальность распределения с помощью критерия Шапиро-Уилка, выбранного из-за сравнительно небольшой выборки (N = 32). Гипотеза о ненормальности распределения не подтвердилась (p > .05) в результатах оценивания локальной связности дискурса (p = .35 в группе пациентов с афазией и p = .79 в группе нормы) и в итоговом результате тестирования РАТ (p = .552 в группе афазии и p = .157 в группе нормы), поэтому для этих методов в дальнейшем использовался двусторонний t-критерий для двух независимых выборок, тогда как для сравнения групп в рамках других методов с ненормальным распределением использовался непараметрический U-критерий Манна-Уитни. Так, по результатам анализа гипотеза H0 об отсутствии значимых различий между группами афазии и нормы было обнаружено при сравнении практически всех рассмотренных параметров. Так, показатели только локальной связности в группе пациентов с афазией оказались значимо ниже, чем у группы нормы, в то время как на глобальном уровне статистически значимые различия не были установлены. В параметре оценки качества содержания рассказа нулевая гипотеза о незначимости различий (H0 принимается при p > .05) не подтвердилась. Для тестирования РАТ и суммарный итог по каждому параметру, и каждый критерий по отдельности выявили значимые различия (p < .05) между группой нормы и группой афазии. В случае с рейтингом по четырём аспектам речевой связности статистическая значимость также была доказана как для каждого из аспектов, так и для финального результата, включающего все четыре аспекта. И, наконец, ни по одному из двух критериев, связанных с теорией риторических структур, не было обнаружено статистически значимых различий: ни при сравнении количества ЭДЕ в группах афазии и нормы. Все описанные результаты статистического анализа приведены в Таблице 4.
Таблица 4. Статистический анализ между группами нормы и афазии
|
Глубина дерева |
ЭДЕ |
Качество содержания |
Локальная связность |
Глобальная связность |
|
|
U = 77.000, p > .05 |
U = 86.500, p > .05 |
U = 53.000, p = .004 |
t = -3.003, p = .007 |
U = 85.500, p > .05 |
|
Беглость речи |
Грам сложность |
Парафазии |
Информ |
Среднее РАТ |
|
|
U = 40.000, p = 0.001 |
U = 29.000, p = .00013 |
U = 15.500, p = .000015 |
U = 25.500, p = 000092 |
U = 19.000, p = .000036 |
|
|
Информ |
Связанность |
Восприятие |
Ясность |
Среднее 4 аспекта |
|
|
U = 22.000, p = .000017 |
U = 38.500, p = .001 |
U = 28.000, p = .00004 |
U = 22.500, p = .00004 |
U = 19.000, p = .000036 |
Различия между группами значимы, если p < .05; = .05
2.4 Корреляционный анализ используемых методов
Так как следующей, и последней, статистической задачей в работе является сравнение между собой не групп испытуемых, а методов, в соответствии с которыми группы испытуемых были оценены, четвёртая часть доклада о результатах посвящена парным корреляциям с каждым методом. В соответствии с доказанным в (Croux & Dehon, 2010) преимуществом коэффициента корреляции Кендалла над методом Спирмана, именно метод Кендалла и будет использован в настоящей работе для сравнения 7 параметров с мощностью выборки N = 32. Результаты корреляционного анализа представлены в Таблице 5. Расширенная таблица с корреляциями между всеми использованными методами приведена в Приложении В.
Таблица 5. Корреляция Кендалла () между методами оценки макроструктуры
|
Глобальная связность |
Локальная связность |
Качество содержания |
Шкала РАТ |
4 аспекта связности |
Глубина дерева |
ЭДЕ |
|||
|
1 |
1.000 |
.437** |
.400** |
.203 |
.305** |
-.391** |
-.380** |
||
|
p |
. |
.000 |
.003 |
.108 |
.018 |
.003 |
.003 |
||
|
2 |
.437** |
1.000 |
.350** |
.320* |
.603** |
-.354** |
-.173 |
||
|
p |
.000 |
. |
.008 |
.011 |
.000 |
.007 |
.171 |
||
|
3 |
.400** |
.350** |
1.000 |
.379** |
.497** |
-.181 |
-.148 |
||
|
p |
.003 |
.008 |
. |
.005 |
.000 |
.199 |
.272 |
||
|
4 |
.203 |
.320* |
.379** |
1.000 |
.498** |
-.101 |
.008 |
||
|
p |
.108 |
.011 |
.005 |
. |
.000 |
.446 |
.948 |
||
|
5 |
.305* |
.603** |
.497** |
.498** |
1.000 |
-.356 |
-.133 |
||
|
p |
.018 |
.000 |
.000 |
.000 |
. |
.009 |
.310 |
||
|
6 |
-.391** |
-.354** |
-.181 |
-.101 |
-.356** |
1.000 |
.578** |
||
|
p |
.003 |
.007 |
.199 |
.446 |
.009 |
. |
.000 |
||
|
7 |
-.380** |
-.173 |
-.148 |
.008 |
-.133 |
.578** |
1.000 |
||
|
p |
.003 |
.171 |
.272 |
.948 |
.310 |
.000 |
. |
* - корреляция значима на уровне .01 (двухсторонняя).
** - корреляция значима на уровне .05 (двухсторонняя).
Цифрами в столбцах обозначены методы: 1 - глобальная связность, 2 - локальная связность, 3 - качество содержания, 4 - шкала РАТ, 5 - четыре аспекта связности дискурса, 6 - глубина риторических деревьев, 7 - количество ЭДЕ.
Как видно из Таблицы 5, каждый из использованных методов коррелирует с каким-либо другим методом. Так, локальная и глобальная связность коррелируют с коэффициентом значимости корреляции p < .05. Шкала РАТ слабо коррелирует только с показателем локальной связности (p < .01), тогда как корреляции между РАТ и глобальной связностью не было установлено. Со шкалой качества содержания речи и четырьмя аспектами дискурса оба параметра связности демонстрируют сильную корреляцию на уровне 0.05 и сильную обратную корреляцию с параметром глубины риторического дерева (p < .05). С количеством ЭДЕ обратная корреляция установлена только у параметра глобальной связности (p < .05). Что касается параметра качества содержания, то его парные корреляции со всеми другими методами, кроме показателей ТРС (количество ЭДЕ и глубина деревьев), оказались сильными на уровне значимости .05. В целом, параметры теории риторических структур демонстрирует сильную парную корреляцию, однако, кроме описанных значимых корреляций с уровнем связности, никаких иных связей данных параметров с другими методами оценки макроструктуры дискурса не было установлено. Наконец, последнее, что необходимо отметить, - это сильную парную корреляцию между шкалой РАТ и шкалой четырёх аспектов связности речи (p < .05).
Из-за многочисленных выявленных корреляций требуется отредактировать результаты с целью снижения количества вероятных ложноположительных результатов (ошибки первого рода) путём уменьшения доверительного интервала, которым в результатах настоящей работы был принят = .05. Применим классическую поправку на множественные сравнения Бонферрони для k рассматриваемых гипотез (выявленных значимых корреляций на уровне 0.05), где k = 24. Таким образом, будет установлен новый, резко уменьшенный уровень значимости, отсеивающий спорные и менее значимые корреляции [pi=p/k=.05/24], равный p' = .00208. Среди приведённых в Таблице 5 значимых корреляций новому уровню значимости соответствуют только корреляции между двумя типами связности ( = .437, p = .00045), между четырьмя аспектами дискурса и локальной связностью ( = .603, p = .000003), между четырьмя аспектами дискурса и качеством контента ( = .497, p = .000275), между шкалой РАТ и четырьмя аспектами связности ( = .498, p = .000114), а также между глубиной риторический деревьев и количеством ЭДЕ в нарратива ( = .578, p = .000017). Все корреляции, соответствующие новому уровню значимости, выделены в таблице серым цветом.