Аннотация доклада А. С. Касьяна «Как оценивать вероятность родства между языками?» — 27 мая 2026 г. в 09:35:13.890
Аннотация доклада А. С. Касьяна «Как оценивать вероятность родства между языками?» В работе [Kassian et al., 2025] мы предложили новую процедуру для вероятностной оценки родства (или же старых контактов) между языками. Сравниваются лексические списки двух языков, в нашем случае это 110-словные списки Сводеша. Формальным алгоритмом они транскрибируются в транскрипции консонантных классов. Списки сопоставляются между собой несложным алгоритмом, который умеет выявлять фонетически сходные формы (грубое измерение расстояния Левенштейна). Далее к спискам применяется взвешенный перестановочный тест. От классического перестановочного теста, где все концепты имеют одну цену, он отличается весами концептов: совпадения в более устойчивых концептах стоят дороже, чем совпадения в неустойчивых. В теории таким тестом мы должны получить вероятность p нулевой гипотезы (вероятность, что фонетически схожие формы — это случайные созвучия). Однако, как показала группа контроля (сравнение языков, не родственных друг другу), получаемая оценка систематически оказывается заниженной (ошибка 1-го типа, при которой нулевая гипотеза необоснованно отвергается). О причинах такого сдвига будет отдельно сказано в докладе. Для коррекции сдвига мы разработали особую процедуру калибровки, которая позволяет получить адекватное значение вероятности нулевой гипотезы. Низкое значение p является эвристическим указанием, что схождения не случайны, а сопоставляемые языки – дальние родственники или же когда-то обменивались лексическими заимствованиями. В заключение будет сказано, что еще можно сделать в данном направлении.

