科技日报记者 张佳欣
你有没有过这样的阅读体验:有些句子一眼扫过便了然于胸,而另一些句子明明每个字都认得,却非得倒回去再读一遍,才能恍然大悟其含义。这种差异背后,藏着一个关于人类大脑如何处理语言的微妙谜题。美国纽约大学和马萨诸塞大学阿默斯特分校的科学家最近借助人工智能(AI),找到了部分答案,同时也发现,在阅读这件事上,人类与AI之间的差异远比想象中更大。
科学家发现,在阅读的最初瞬间,人类和当前主流的大型语言模型做着同样的事,即推断下一个词。比如看到“今天天气真……”大脑会不自觉地预判“好”“热”“冷”之类的词。这种能力帮我们快速识别每个词,让阅读理解平稳推进。AI语言模型同样依靠预测下一个词来处理语言。经过大量文本训练,它们学会根据上下文判断接下来最可能出现什么。
不过,仅仅通过推断还不够。阅读时,我们还需要把已经看到的字词放进整句话里,弄清楚上下文究竟是什么意思。恰恰是在这一步,人类和AI开始出现不同。
这种差异在一种特殊的句子中尤其明显。科学家把它称为“花园路径句”,这类句子是一类读着读着发现理解错了、需要回头重新分析的句子。句子本身符合语法,但开头的表述方式极易让读者产生错误的初步解读。
比如英文句子“The old man the boat”,刚看到“The old man”时,我们很容易把它理解成“那个老人”,并期待后面出现一个动作。可读到“the boat”时才会发现,原来的理解走偏了。这里的“old”指的是“老人们”,“man”则用作动词,意为“操作、驾驶”。“old”修饰的是暗含的“people”,意指“old people”,整句话的意思其实是“老人们驾驶这艘船”。遇到这类句子,读者往往要愣一下,然后目光不由自主地回跳,重新分析句法结构。

事实上,人类阅读时大约有20%的眼球运动是反向的,也就是把目光退回去重读。科学家利用眼动追踪技术观察了368名成年人的阅读过程,记录他们阅读和回读每个词所花费的时间,并将这些眼球运动与400多个AI语言模型的预测结果进行了比较。他们发现,AI预测下一个词的能力,可以解释人们为什么能快速认出眼前的词,但却无法解释人类为何会在“卡住”的时候通过倒回去看来完成理解。
更精确地说,AI覆盖的是阅读的第一步,即从视觉信息中识别单词。而它无法触及的是第二步,那就是将这个词融入句子更大的语境中,与前后内容进行整合。这一过程究竟是如何发生的,仍有待科学家进一步研究。
纽约大学语言学博士生威廉·蒂姆基说,仅靠词语的可预测性,远不足以解释人们在困难句子上花费的时间,大语言模型明显低估了人类阅读时经历的困难。
从这项研究来看,虽然AI已经越来越会“说人话”,但还没有完全弄明白人类究竟是怎么“读懂人话”的。这也许正是“AI为什么还取代不了人”的一个有趣解释。

网友评论