"Звуки и знаки" - читать интересную книгу автора (Кондратов Александр Михайлович)

Лингвистические часы

Проанализировав скорость изменения нескольких языков и языковых семей, Свадеш нашел, что она равна примерно восьмидесяти двум плюс-минус два процента за тысячелетие. То есть в языке за тысячу лет сохраняется около восьмидесяти процентов слов, входящих в ядро, в основную лексику языка…

Так ли это? Свадеш проанализировал древнеегипетский, китайский, романские языки. Если ход лингвистических часов объективен, как часов радиоуглеродных, то, стало быть, близкие результаты можно получить и на материале любых других языков мира. Однако когда ученые стали проверять эту «среднюю константу скорости», взяв другие языковые семьи, оказалось, что она не является всеобщей.

Вот несколько примеров. По мнению археологов и лингвистов, единый праславянский язык стал распадаться в конце VI века до н. э. Однако подсчеты, проведенные по методу Свадеша, дали совсем иную дату. Русский и чешский языки, оказывается, разошлись четыреста-пятьсот лет назад, чешский и польский — двести-четыреста лет назад. Всякому, кто хоть немного знает историю своей страны и братских славянских народов, ясно, что эти числа смехотворно малы (более тысячи лет назад чехи имели и свою государственность, и свое письмо, и свой язык!).

Поразительно неубедительную дату получили по методу лингвистических часов, когда сравнили два скандинавских языка — старонорвежский и исландский, чтобы определить время их расхождения. Известно, что к 930 году завершилось заселение Исландии, в основном выходцами из Норвегии. Между тем лингвистические часы показали не тысячу и даже не полтысячи лет, а всего шестьдесят три — сто девяносто четыре года. На самом деле уже в прошлом тысячелетии исландцы имели и свой язык и свою литературу.

Правда, неточность хода лингвистических часов в этом случае можно оправдать той уникальной консервативностью исландского языка, о которой мы уже говорили выше… Ну, а славянские языки? Или, как показали исследования востоковедов, скорость изменения армянского языка, языков Средней Азии и ряда других, не соответствующая формуле Свадеша? Под вопрос стал сам метод датирования с помощью словаря, динамики изменения слов, его составляющих. Или, быть может, дело не в самом методе, а в лексике, тех словах, которые мы берем за эталон?

Свадеш составил список из двухсот пятнадцати слов, потом сократил его до сотни. Но почему, собственно говоря, до ста? А может быть, надо расширить этот список до пятисот? Проверка показала, что разные слова имеют разную устойчивость. Русский язык — индоевропейский, числительное три звучит в нем так же, как звучало оно в языке древних хеттов, как звучит оно в священном языке Индии — санскрите, сходным образом звучит оно и в английском, немецком и других индоевропейских языках. А вот понятие «мальчик» меняло свой словесный ярлык по нескольку раз чуть ли не в истории каждого языка. В древней Руси говорили отрок, а потомки древнерусского языка — русский, украинский и белорусский — сменили это слово. Русские вместо отрока говорят мальчик, а украинцы и белорусы — хлопчик.

Вот почему современные лингвисты начинают проверять слова на их устойчивость в языке, степень сохранения того или иного слова в зависимости от понятия, которое оно обозначает. Более того, оказывается, что есть связь между частотой употребления слова и временем его возникновения в языке. Не так давно в нашей стране вышла книга «Математические методы в исторической лингвистике», авторы которой М. В. Арапов и М. М. Херц предложили математическую модель лингвистических часов, где работы Свадеша оказываются лишь частным случаем более общего метода.

По сравнению с методом Свадеша, «шаг вперед состоит здесь в том, что нет более необходимости требовать, чтобы скорость изменения словаря всегда была постоянной и им, ела одинаковое значение для различных языков, — пишут Арапов и Херц. — Таким образом, вместо списка слов, выражающих фиксированные, тщательно выбранные понятия, можно было бы взять случайно выбранный фрагмент словаря и проверять, имеют ли слова из него соответствия в родственном языке».

Формулы, найденные советскими учеными, показывают, что случайная выборка из словаря распадается точив так же, как и весь словарь. А это значит, что такая случайная выборка подходит для целей датирования не меньше, чем отобранная сложным методом сотня-другая слов. Иными словами, механизм лингвистических часов оказался и более прост, и более сложен, чем это представлялось его первооткрывателю Морису Свадешу.

Впрочем, такую простоту и одновременно сложность мы находим всякий раз, когда начинаем изучать язык с помощью статистики. Числа помогают лингвистам исследовать язык во всех его измерениях, начиная со слов и кончая субъективными ассоциациями, связанными со словами. Но за числами стоят, очевидно, какие-то закономерности, определяющие статистику.

Нельзя ли увидеть за фактами формулы? Вскрыть с помощью математики механизмы языка, порождающие все многообразие нашей речи?