Voynich Studies拜内克 MS 408

语言类说法

斯拉夫bukvitsa与梵语:为什么“一个字母就是一个词”行不通

两种流行的说法:伏尼契的每一个符号都是古斯拉夫字母表里的一个“字母词”;这套文字的构造像印度的元音附标文字。两者都可以靠简单的计数来检验,而两者都在计数上垮掉。

结论 已否定 26.07.2026

斯拉夫bukvitsa与梵语:为什么“一个字母就是一个词”行不通
第 f76r 页。耶鲁大学拜内克图书馆(public domain)

“每一个符号都是一整个词”这个想法非常顽固,而且它有一个诱人的依据:伏尼契手稿的词很短,文本 本身看上去很单调,就像是用现成的积木拼起来的。斯拉夫版本由此而来:摆在我们面前的是一套古老的 字母词字母表,即bukvitsa,其中每一个字母本身就承载意义,而这样的字母词一共有49个。与它并列的 是第二种说法,印度的说法:伏尼契的文字像元音附标文字那样构造,语言是梵语或与梵语相近的语言。

这两种说法都有一个方便的性质:不必读懂一个词就可以检验。只要数一数就够了。

检验一:符号有多少个

斯拉夫版本给出了一个确切的数字,即49个字母词。这是它的长处:数字是可以核对的。

在主要的伏尼契转写里,可以可靠区分的符号大约有32个。这个数目会随切分系统略有浮动,某些 罕见的连写既可以算作单独的符号,也可以算作组合,但在任何一种切分方案下都到不了49。这个差距 太大,不能归到有争议的个别情形上。

检验二:词长

这是主要的论证,而且它完全不需要任何理论。如果一个符号等于一个词,那么由一个符号构成的词就 必定是大量出现的现象,就像在任何一种由单个记号完整承载意义的文字里那样。

对全部文本作计数:

测量项伏尼契
平均词长4.47个字符
单符号词的比例3.75%
每个字符的熵3.86比特
覆盖80%文本所需的不同词数1351个类型

平均一个词有四个半符号长,而单字符的词占比不到百分之四。这是一种符号只是词的一部分、 而不是词本身的结构。“一个字母等于一个词”这个说法就在这个数字上垮掉,在这里任何翻译都救不了 它:含义可以争论,长度不能。

“与49吻合”是从哪里来的

我们自己的工作里有一个数字,有时会被搬进这场讨论:伏尼契文本的80%由大约56个语义核心来承担。 它看上去像49,诱惑很大。

这是一种错觉,原因如下。56这个数字是在剥离前缀和词尾之后得到的:我们把词分解为前缀、词根 和后缀,手稿中四分之三的词都是这样构成的,然后数了词根。词根不是字母。把56个词根同49个字母词 相比,就等于把俄语里词根的数目同西里尔字母表里字母的数目相比:这是不同性质的量,数字接近并 不说明什么。

顺带一提,伏尼契里词根的数目本身确实小得反常:作为对照,拉丁语要用大约640个核心才能覆盖同样 的80%文本,芬兰语要1357个,英语要225个。但这是支持封闭的代码表的论据,而不是支持“每个 字母都有含义的字母表”的论据。

检验三:元音附标文字与梵语

印度版本的检验方式不同。元音附标文字(abugida)是一种有特定构造的文字:辅音符号自身带有一个 固有的元音,其余的元音则通过上方和下方的记号连接到它上面。这样的文字会在统计中留下特定的 痕迹:某些类别的符号被牢牢地绑定在彼此的相对位置上。

我们做了相应的检验。痕迹没有出现:伏尼契的文字不是元音附标文字。 随之倒下的还有“用印度式 文字写成的梵语”这个说法,不是因为梵语是个糟糕的候选,而是因为这套文字的构造不同。

也请注意反过来的一面:伏尼契里确实有类似元音的符号。元音与辅音的交替像拉丁语那样起作用, 按照苏霍京的经典指标,伏尼契给出0.771,拉丁语为0.785,随机集合为0.598。也就是说,这段文本是 像语言的,但是以欧洲的方式,没有印度式的那套行上附加记号的机制。

为什么这一类说法会出现

这里正是该谈整个领域主要陷阱的地方。任何语言的音节都只能以有限的方式组合,而伏尼契文本约有 37千个词。在这样的体量下,任何语言都会给出几十处“认出来了”:看上去像词的组合、漂亮的 巧合、“就是它”的瞬间。波斯语、阿拉伯语、希伯来语和梵语的释读就是这样产生的,而它们全都极 可能是组合学的产物。

有一条规则可以让人免于这个陷阱:先结构,后含义。 如果一种说法要认领某一门语言,它就有 义务预言某种可测量的东西,比如符号的数目、词长、音节的构造、组合的统计,而这个预言必须在 任何翻译开始之前接受检验。斯拉夫版本和梵语版本通不过这道检验,并且请注意,为了确定这一点, 一个词也不必翻译。

还剩下什么

从斯拉夫版本里留下了一个我们也认同的正确观察:伏尼契文本确实是由重复的积木拼起来的,而且 这些积木数量不多。只是解释它们的不是“每个字母都有含义的字母表”,而是一张封闭的代码表: 大约18个前缀、五十来个词根、18个词尾,而手稿中74%的词都符合“前缀+词根+词尾”这个格式。

这是我们关于机制的主要结果:伏尼契手稿的密码是如何运作的。 它解释了短词和单调性,既不需要字母词也不需要梵语,而且与它们不同的是,它能重现手稿的那些数字。

伏尼契手稿的破译并不存在,我们也不宣称有破译:巧合不等于释读。

常见问题

伏尼契字母表里有多少个符号?

在主要的转写系统EVA里,大约有32个可以可靠区分的字符。确切的数目取决于切分系统,但在其中任何一种系统里都到不了49,也就是斯拉夫bukvitsa的数目。

一个伏尼契符号能代表一整个词吗?

不能。如果一个符号就是一个词,那么短词应当是常态,平均词长应当在一两个符号左右。实际上伏尼契的平均词长是4.47个字符,而只由一个符号构成的词只占3.75%。

什么是元音附标文字,为什么梵语的说法被否定?

元音附标文字是这样一种文字:辅音符号自带一个固有的元音,其余的元音则用上方和下方的附加符号标出。这类文字会在符号组合的统计中留下特有的痕迹。伏尼契没有这种痕迹:检验表明,这套文字不是元音附标文字。

那么人们常提到的与56个词根的吻合又该怎么说?

那是一种错觉。56这个数字是在剥离前缀和词尾之后得到的,它们是词根,不是字母。把它们同49个字母词相比,就像把俄语里词根的数目同西里尔字母表里字母的数目相比一样。

← 全部假说