幻觉是什么?
你用AI问过“第一个登上月球的人是谁?”它答阿姆斯特朗,没问题。但如果你问“第一个在火星上吃披萨的人是谁?”它会一本正经地编出一个名字、一段故事,甚至配上日期。你一看就知道是瞎扯,但它说出来的时候,那语气比新闻联播还笃定。
这就叫“幻觉”——在AI圈里,指的不是你吸毒产生的幻视,而是大模型在不知道自己不知道的时候,理直气壮地捏造出一段内容,而且听上去特别像那么回事。
为什么会这样?因为大模型本质上是个“文字接龙”机器。它不理解“真假”,只知道“统计上,这个词后面大概率接那个词”。如果你问的东西在它的训练数据里完全没有,或者信息模糊,它就启动“填字游戏”模式——拿它见过的类似片段东拼西凑,硬给你凑出一段顺溜的话。它自己根本不知道哪些是实锤、哪些是脑补。
这个毛病不是Bug,是Feature——因为它天生就是靠“概率”活着的,不是靠“知识图谱”或者“数据库”。所以,只要大模型还靠统计预测生成,幻觉就永远斩不断。
但幻觉也不是一无是处。写科幻小说、编段子、做头脑风暴,需要的就是这种“创造性地胡扯”。可一旦你拿它查事实、写法律文书、做医疗建议,幻觉就是定时炸弹。
怎么对付它?常见的办法有:限制上下文(别让它扯太远)、检索增强生成(RAG)(让它先查资料再说话)、人工事实核查(最笨但最稳)。归根结底,别把AI当百科,当它是嘴上跑火车的实习生就行。
评论