Языковые сенсации
Протороманская версия Чешира: расшифровка, которую нельзя проверить
В 2019 году университетский пресс-релиз объявил, что рукопись прочитана за две недели. Через несколько дней релиз убрали. Разбираем не личности, а конструкцию: почему такая версия не проверяема в принципе.

В 2019 году эта история вышла далеко за пределы узкого круга: университетский пресс-релиз сообщил, что манускрипт Войнича прочитан, причём работа заняла около двух недель. Через несколько дней релиз с сайта убрали, а специалисты по романской филологии и по самой рукописи высказались резко отрицательно.
Мы разбираем не личности и не эмоции, а конструкцию версии: почему она устроена так, что её нельзя ни подтвердить, ни опровергнуть.
В чём состоит утверждение
Коротко: текст написан на «протороманском» - утраченном разговорном языке, предке итальянского, испанского, португальского и других; знаки читаются напрямую, никакого шифра нет; достаточно подобрать звуковые значения - и книга читается.
Звучит экономно. Проблема начинается на следующем шаге.
Свобода подстановки убивает проверяемость
В предъявленной системе один и тот же знак может передавать разные звуки, а выбор делается для каждого слова отдельно, исходя из того, что в этом месте кажется осмысленным.
Оценим, что это значит. Пусть у каждого знака есть хотя бы три допустимых чтения. Тогда слово из пяти знаков даёт около двухсот сорока комбинаций, и из этого набора почти всегда найдётся что-то, похожее на слово живого романского языка - особенно если сравнивать не с одним языком, а с семьёй и с реконструкцией.
Отсюда следствие, которое важнее любых частных придирок: такая система прочитает что угодно. Дайте ей случайный набор знаков той же длины - она выдаст не менее осмысленный текст. А значит, удачное чтение ничего не доказывает, и опровергнуть его тоже нечем.
Научная гипотеза обязана запрещать какие-то исходы. Эта не запрещает никаких.
Чего не хватает: предсказания
Как выглядела бы проверяемая версия того же класса? Примерно так:
- зафиксировать таблицу «знак - звук» до перевода и больше её не менять;
- предъявить чтение куска текста, которого не было в подгонке;
- показать, что грамматика получается регулярной: одни и те же окончания в одних и тех же позициях;
- предсказать что-то независимое - например, что на странице с определённым рисунком встретится
конкретное слово, - и проверить.
Ни один из этих шагов в работе не сделан. Именно поэтому специалисты говорят не «ошибка в деталях», а «это не проверяемое утверждение».
Что говорят наши измерения
Здесь мы можем добавить кое-что своё, и это не про вкусы.
Версия требует, чтобы текст читался напрямую: знак соответствует звуку, слово соответствует слову. Мы проверяли именно эту возможность - пытались восстановить ключ по внутренней статистике рукописи. Атака провалилась с показательным результатом: реальный текст оказался хуже случайного шума по восстановимости. Буквенная последовательность оригинала не выживает на уровне частей слова.
Это несовместимо с прямым чтением. Если бы под знаками стояли звуки языка, след языка проступал бы в статистике сочетаний - он не проступает.
Второе наблюдение - структура слова. Три четверти слов рукописи собираются по жёсткой схеме «приставка + корень + окончание» из очень небольшого набора элементов: около 56 корней покрывают 80 % текста. Для сравнения, в латыни на те же 80 % уходит около 640 корней. Естественный язык так не устроен - это отпечаток таблицы кодов, а не словаря живой речи.
Почему такие версии появляются регулярно
Это общая ловушка области. В рукописи около 37 тысяч слов, слоги любого языка комбинируются небольшим числом способов - и при таком объёме любой язык даст десятки красивых совпадений. Так рождались персидские, ивритские, санскритские, ацтекские чтения. Каждый автор искренне видит своё.
Единственная защита - порядок действий: сначала структура, потом смысл. Сначала измеримое предсказание, потом перевод. Если версия начинается с перевода, проверить её невозможно, каким бы убедительным ни выглядел получившийся текст.
Мы поэтому и не «прогоняли Чешира» через свой фильтр: прогонять можно гипотезу, которая делает предсказание. Здесь предсказания нет.
Расшифровки манускрипта Войнича не существует - ни нашей, ни чужой. Совпадение - не чтение.
Частые вопросы
Что заявил Джерард Чешир?
Что манускрипт Войнича написан на «протороманском» - утраченном разговорном предке романских языков, что письмо не содержит редких знаков и что текст читается напрямую, без ключа. Публикация вышла в 2019 году, университетский пресс-релиз о ней вскоре был отозван.
Почему специалисты это отвергли?
Главная претензия методическая: в предложенной системе один и тот же знак может читаться разными звуками, а выбор делается для каждого слова отдельно. При такой свободе можно получить осмысленную фразу почти из любого набора знаков, и проверить утверждение нечем.
Существует ли «протороманский» язык?
Как реконструкция народной латыни - да, специалисты работают с вульгарной латынью. Но единого письменного протороманского корпуса, на котором можно было бы проверить чтение, не существует; в версии Чешира он фактически конструируется по ходу перевода.
Ваши собственные измерения что говорят?
Что прямое чтение невозможно в принципе: мы пытались восстановить ключ по статистике самого текста, и реальный текст оказался хуже случайного шума. Буквенная последовательность оригинала не выживает на уровне частей слова, а значит, «читать напрямую» нечего.