当我们与语言模型对话时,我们在与什么对话?
这个题目非常有意义!其核心问题在于厘清语言模型的本质。
语言本身是人类发明的一种抽象思维工具,遵循着形式约束规则。尽管每个人使用语言的方式可能千差万别,但我们都遵循着相同的语法、句法和逻辑规则。
而语言模型本身,可以说是人类语言数据的“集大成者”。但这个“集大成”并非人人贡献均等,而是依据特定的算法,在概率分布中选取最大可能性的结果。因此,AI输出的语言风格,既不是最具个性化的表达,也不是简单的平均化产物,而是处于两者之间的某种“中间水平”。
正是这个处于中间水平的语言模型,成为了与我们对话的对象。当我们与语言模型交流时,我们实际上是在与这种基于概率的、折中的语言表征进行对话。