跳到主要内容
返回博客
AI

自动更正为什么会犯奇怪的错误?

4 分钟 阅读

学生在 Avanza STEM AI 工作坊讨论预测系统的工作原理
自动更正和 AI 有着相同的核心思路:两者都根据语言中的规律预测接下来应该出现什么。

自动更正有时候是真救命。你手快打成 "teh",它悄悄给你改回 "the"。漏了个字母,它替你兜住了,没人看得出来。

可它也有发疯的时候。你本来想写「我去带点零食」,它把其中一个词换成了完全不相干的东西。为什么?因为自动更正从头到尾都在猜词。它压根没懂你想说什么。

自动更正是预测工具

它盯着你敲下的字母,然后开始推理:拼写上离哪个词最近?上一个词后面通常跟什么?这个人平时爱打什么?整句话最可能是哪句?多数时候这套推理成立。不成立的那几次,就成了大家互相转发的截图。

计算机不像人一样理解词语

你懂一个词,是因为它连着现实。有人说「狗」,你脑子里立刻有毛、有叫声、有跑过来的画面,说不定还有一条你认识的狗。意思是从经历里长出来的。

自动更正没有经历。它不知道狗摸上去什么感觉,不知道一个玩笑好笑在哪,也不知道你朋友的名字为什么这么拼。它眼里只有字母、词和出现频率。所以它才会把一个本来正确的词改掉:它不是在纠正你,它只是觉得另一个词更常见。

人名和俚语会让自动更正困惑

人名是它最大的克星。朋友的名字拼得少见,你住的镇子、你的学校、你的球队不在手机词典里,它就可能把一个完全正确的名字「更正」成某个更普通的词。

而且人用语言本来就很野。孩子爱造词,朋友之间有黑话,家里人有专属外号。这些自动更正一个都不懂。你兴致勃勃打了个自创词,它可能给你换成某个无聊到家的东西。

为什么它有时会变得更好?

有没有发现手机慢慢学会了你常用的那些词?有些自动更正系统确实会跟着你的习惯调整。同一个名字你打过几十遍之后,它就不再动它了。

这就是机器学习在干活:它注意到你的规律,然后跟上。副作用也挺好笑的。某个错字你要是打顺手了,手机可能会认定那才是对的。

自动更正和 AI 有关联

自动更正和成熟的 AI 聊天机器人不是一个量级,但内核是同一件事:预测。自动更正预测一个词或一种拼法,聊天机器人预测整段回应、整个解释。两个都没有真的听懂语言。

人可以停下来问一句「等等,你什么意思?」,也能读出反讽、情绪和当时的场合。计算机只能从规律往回推,推错是常事。

试试这个

编一句怪句子,塞满自造词、名字和俚语,看自动更正动了哪几个地方。然后回头问自己:它凭什么挑那个词?是拼写像?是常见搭配?还是它以前见过?

工程师的思路差不多就是这样。不停在「这里坏了」,而是再追一句:它为什么会这样坏?

核心思想

自动更正闹笑话,是因为它预测的是语言规律,不是意思。它能修错字、省时间、跟着你学。它同样能把对的词改成错的。

它是工具,你才是编辑。按下发送之前,眼睛再走一遍。