Voynich StudiesБейнеке MS 408

Языковые сенсации

«Ключ найден: это итальянское вольгаре». Что показала числовая проверка ключа Каспари и Фаччини

Археолог из Института Макса Планка и независимый филолог прочитали звёздные метки как POLAR и TOARE и объявили язык рукописи итальянским. Мы восстановили их ключ по их же примерам и прогнали по всей рукописи против честных контролей.

Вердикт НЕ ПОДТВЕРЖДЕНА 04.08.2026

«Ключ найден: это итальянское вольгаре». Что показала числовая проверка ключа Каспари и Фаччини
Лист f68r. Beinecke Library, Yale (public domain)

В феврале 2025 года появился препринт с уверенным названием «A Key to the Voynich Manuscript» - «Ключ к манускрипту Войнича». Авторы - Джино Каспари, археолог с аффилиацией Института Макса Планка и Бернского университета, и Аньезе Фаччини, независимый исследователь. Их вывод: рукопись написана на итальянском вольгаре - народном языке, записанном средневековой стенографией поверх простого подстановочного шифра, и «ключ к дешифровке теперь доступен».

Заявка серьёзнее обычных «расшифровок» хотя бы упаковкой: препринт лежит в репозитории Общества Макса Планка, к нему приложена таблица-ключ и словарь на 400 с лишним слов. Поэтому мы сделали то, что делаем с каждой проверяемой гипотезой: восстановили метод авторов в точности и прогнали его через контроли, которые сохраняют все свободы метода.

Что утверждают авторы

Отправная точка - метки у звёзд в астрономическом разделе. Рядом с одной из звёзд авторы прочитали слово POLAR - Полярная звезда. От этого якоря они развернули алфавит: часть знаков Войнича объявлена латинскими буквами, часть - лигатурами, и с этим алфавитом они прочитали другие метки: TOARE (Телец у Плеяд), O'CETE (созвездие Кита), EXPE (Венера). Звёздные имена они сверяли по печатному Альмагесту 1528 года.

Дальше - главное допущение. Текст, по авторам, записан стенографией: писец опускал гласные и обрывал концы слов. Поэтому прочтение слова - это его «согласный скелет», в который читатель волен вставить гласные и дописать окончание. Так из последовательности знаков получается, например, p(er)d(e)n или t(a)n(to): в скобках - буквы, которых в рукописи нет.

Авторы честно называют ключ предварительным. Но заявляют: с ним «читается большинство слов рукописи», а язык уверенно определяется как итальянское вольгаре.

Их ключ можно проверить строго - и мы его восстановили

Авторы принципиально не пользуются машиночитаемыми транслитерациями (EVA), поэтому их таблица - это картинки знаков. Для числовой проверки мы восстановили ключ в EVA-нотации не по картинкам, а по их собственным адресным примерам: в статье приведены прочтения конкретных строк конкретных листов, и эти строки однозначно находятся в транслитерации.

Их прочтениеСлово в рукописи (EVA)Что это даёт ключу
torporedorchoryd=T, o=O, r=R, ch=P, y=E
p(er)d(e)nchkark=D, ar=N
i(n)ss=I
fiorshorsh=FI
o'c(e)falotchalt=C
d(e)folieckholsyлигатура ckh=DF
exf(a)moypchaiinp=X, aiin=(a)MO

Ключ восстановился полностью и внутренне консистентен: одна и та же буква выходит из разных примеров одинаковой. Дальше - три проверки. Правила зафиксированы заранее, до прогона.

Проверка первая: ключ против двухсот случайных ключей

Берём всю рукопись - около 33 тысяч слов основного текста. Декодируем каждое слово ключом авторов и спрашиваем: есть ли такое слово в итальянском языке их эпохи? Лексикон мы собрали из Данте и Боккаччо - авторы сами называют тосканских классиков лучшими совпадениями со своим словарём. Свободы метода сохранены полностью: разрешена вставка гласных, усечение конца, отделяемые артикль o' и частица qo - всё, чем пользуются сами авторы.

Затем то же самое делают 200 случайных ключей: те же знаки, те же свободы, но буквы переставлены случайно.

Результат: ключ авторов действительно лучше случайного - по строгому совпадению он читает 17.5% слов против 1.2% у типичного случайного ключа. Звучит как победа? Нет. Ключ авторов подобран вручную так, чтобы частые знаки стали частыми буквами, а выход походил на итальянский. Любой ключ, оптимизированный под язык, обгонит случайный - это свойство оптимизации, а не доказательство чтения. Настоящие вопросы - два других.

Проверка вторая: а читается ли бессмыслица?

Если «чтение большинства слов» - заслуга ключа, оно должно исчезать, когда исчезает язык. Мы взяли тот же итальянский лексикон и перемешали буквы внутри каждого слова: длины и частоты букв сохранились, сам язык - уничтожен.

На уровне правил самих авторов (вставка гласных плюс усечение) ключ «читает» по настоящему итальянскому лексикону 69.7% слов рукописи. По перемешанному псевдолексикону - 67.9%. Разница - меньше двух пунктов. «Чтение большинства слов» гарантировано свободой стенографии и не зависит от того, итальянский перед нами или анаграммный шум.

Проверка третья: а почему именно итальянский?

Главный вывод авторов - идентификация языка. Проверяется прямо: даём тому же ключу с теми же свободами лексикон другого языка той же эпохи - латынь (сельскохозяйственный трактат Катона и медицинский Antidotarium Nicolai), уравняв объёмы словарей.

По правилам самих авторов латынь читается ЛУЧШЕ итальянского: 90.3% против 65.8%. Метод, который «определил язык рукописи», не в состоянии отличить итальянский от латыни - и вообще предпочитает латынь.

Что остаётся от гипотезы

Сложим всё, что показала проверка, с тем, что известно о рукописи независимо от неё.

  • Даже со вставкой гласных не читается 62% слов рукописи - «большинство слов» достигается только на уровне правил, который одинаково хорошо читает бессмыслицу.
  • Среди самых частых «прочтений» ключа - формы вроде pue и dvte: это не итальянские слова, а мусор старой орфографии в лексиконе. Осмысленные прочтения - редкие островки, как и у всех подстановочных «дешифровок» до этого.
  • Условная энтропия текста Войнича ниже, чем у всех проверенных языков, а простая подстановка энтропию не меняет: итальянский текст под таким шифром остался бы статистически итальянским. Наши измерения указывают на другой класс механизма - многословный гомофонный шифр.
  • Слова Войнича устроены как жёсткая позиционная грамматика слотов - у настоящего языка со свободной стенографией такой структуры не бывает.
  • Референт звёздных имён - Альмагест 1528 года - на век позже радиоуглеродной датировки пергамента 1404-1438.

Вывод: чтение не подтверждено. Ключ Каспари и Фаччини - частотно выровненная таблица, оптимизированная под итальянский облик выхода. Её видимый успех воспроизводится на псевдоязыке и превосходится латынью при собственных правилах авторов.

Чему учит этот случай

Требование к любой будущей «дешифровке» формулируется из этой проверки в одну строку: покажите, что ваши правила чтения НЕ читают бессмыслицу. Пока свобода метода (вставка букв, усечения, анаграммы, выбор из вариантов) не измерена на контроле, который сохраняет эту свободу, но убивает язык, - количество «прочитанных слов» не значит ничего. Это уже третья гипотеза в нашем проекте, которая падает именно на таком контроле, - и первый случай, когда для проверки пришлось восстанавливать чужой ключ по якорным примерам. Все скрипты и данные проверки открыты в репликационном пакете проекта.

Частые вопросы

Каспари и Фаччини расшифровали манускрипт Войнича?

Нет. Их собственная формулировка осторожна - «предварительный ключ, который может потребовать существенных исправлений». Наша проверка показала, что заявленное «чтение большинства слов» воспроизводится и на бессмысленном псевдолексиконе, а латынь при их же правилах читается даже лучше итальянского. Чтение не подтверждено.

Но ведь их ключ даёт осмысленные итальянские слова - разве это случайность?

Не случайность, а свойство метода. Их стенография разрешает вставлять гласные в любые места и отбрасывать концы слов. При такой свободе почти любая таблица подстановки даёт «читаемые» слова. Мы измерили это прямо - лексикон с перемешанными буквами внутри слов читается их ключом почти так же часто, как настоящий итальянский.

Почему ссылка на Альмагест 1528 года - это проблема?

Пергамент манускрипта датирован радиоуглеродом 1404-1438 годами. Авторы сверяют звёздные имена по венецианскому изданию Альмагеста 1528 года - на сто лет позже рукописи. Для проверки имён XV века нужен источник XV века, иначе совпадение ничего не датирует.

Может ли манускрипт Войнича вообще быть простой подстановкой?

Против этого стоит измеримый факт - условная энтропия текста Войнича заметно ниже, чем у всех проверенных европейских языков. Простая замена букв энтропию языка не меняет, поэтому она не может превратить итальянский текст в текст со статистикой Войнича. Нужен более сложный механизм - данные указывают на многословный гомофонный шифр.

← Все гипотезы