目录99 / 17

AI 为什么会?⑨ 为什么上传一个 PDF,AI 突然就懂了?

上一篇,我们调查了 Prompt。最后,我们发现,Prompt 并不是什么神奇的咒语。它只是帮助 AI 看到更多信息的一种方式,于是,一个新的问题来了,如果 Prompt 可以增加信息,那么,上传一本 PDF,为什么效果会更明显?

AI 为什么突然就知道一本它原来不知道的书?


调查现场

今天,我们做一个大家都试过的实验。打开 ChatGPT,不要上传任何文件。直接问:

帮我总结一下《员工手册》的第八章。

大概率,它回答不了,因为模型训练和当前 Context 里都没有你公司的内部手册。现在,上传这本员工手册,再问一次,它不仅可能回答,还能引用里面的具体内容。第一次体验到这里的时候,很多人的第一反应都是:

AI 学会了这本书。

我当时也是这么想的,后来我才发现,事情根本不是这样。


一、我们又把 AI 想成人了

为什么会觉得它“学会了”?因为人就是这样:读完一本书,这本书会进入你的知识体系。以后,即使书不在身边,你也能大概记住里面讲了什么。所以,我们很自然地认为,AI 看了一遍 PDF,也完成了同样的过程。后来,我发现,这两件事并不相同。

一次普通的文件问答,通常不是这样工作的。


二、想象一下开卷考试

有一天,我突然想到一个特别形象的比喻。上传 PDF,不像上课。更像:

开卷考试。

考试的时候,老师把一本书放在你的桌上,然后问:

第八章讲了什么?

你当然能回答,不是因为你刚刚学会了,而是因为

书就在你眼前。

如果老师把书收走,再问同样的问题,你可能又答不上来了。AI 很多时候也是这种状态:上传文件不会自动修改模型参数,系统只是让它在回答时能够读取文件内容。


三、可是,几百页的书怎么摆上桌?

开卷考试的比喻到这里还不够。如果书只有十页,整本摊开也许没问题;如果它有一千页,桌子根本放不下怎么办?

模型的 Context 有长度限制。很多系统不会每次把整本 PDF 原封不动塞进去,而是先解析、切成片段,再根据问题找出可能相关的部分。像是考试前多了一位图书管理员:你问问题,他先替你翻书,把最可能有用的几页送过来。

这带来一个经常被忽略的问题:如果文件解析错了,相关段落没找出来,或者表格和图片没有正确识别,即使答案明明写在 PDF 里,AI 仍然可能答错。

另外,新窗口能不能继续使用文件,取决于产品如何保存文件、项目和聊天,不能再用“新窗口答不上来”判断模型是否学习。

上传 PDF,通常没有改变模型参数。

改变的是系统多了一个可以直接读取或检索的信息来源。


四、这一点,比想象中重要得多

为什么我要花一整篇文章讲这件事?因为它会改变你理解 AI 应用的方式。企业知识库,法律助手,医疗助手,客服机器人,它们看起来都越来越专业,很多人以为,开发者重新训练了一个 AI,事实上,很多时候,根本没有重新训练。只是

回答问题之前,先把相关资料放到了 AI 面前,于是,它就像一个参加开卷考试的人,开始回答。


五、终于,我们可以介绍一个新名字了

刚才那位“先翻书,再递材料”的图书管理员,在工程里有一个名字。如果系统先从大量材料中检索相关片段,再把片段交给模型生成答案,行业里把这种做法叫:

RAG。

全称其实不重要,你甚至现在就可以忘掉,真正重要的是理解。RAG 并不是

教 AI 新知识。

更接近:

回答问题之前,先检索相关资料,再把资料交给模型生成答案。

所以,上传 PDF 不一定就等于 RAG。短文件可能直接放进 Context,长文件或知识库更常使用检索。RAG 的关键不是“有一本书”,而是中间多了一位先找资料的人。

你有没有发现,它和前几篇其实是一回事。模型仍然会使用训练形成的知识和能力;今天,我们只是额外多做了一步:

把原本 AI 看不到的信息,主动放到它眼前。

于是,它就"懂了"。


六、原来,我们一直在做同一件事

写到这里,我突然发现,前九篇其实一直在接近同一个问题。Prompt 会影响 Context,聊天记录会影响 Context,上传 PDF 让系统多了信息来源,RAG 则负责从信息源里挑出相关内容。这些技术并不完全相同,却都在解决一个共同问题:

真正做的事情,其实都只有一件。

让 AI 在回答之前,看到更合适的信息。


调查笔记 No.9

今天,我们推翻了第九个认知。

上传 PDF 后,AI 学会了这本书。

上传 PDF 通常不会修改模型参数,而是让系统多了一个可以直接读取或检索的信息源。

今天,我们还认识了一个新概念。

RAG。

不过,真正重要的不是这个名字,而是它背后的思想。

不是训练 AI。

而是给 AI 看。


当前掌握的线索

  • AI 的回答来自模型能力和当前 Context。
  • Prompt、聊天记录和文件会以不同方式影响 Context。
  • 上传 PDF 通常不会修改模型参数,但产品可能保存和索引文件。
  • RAG 的本质,是先检索相关资料,再让模型依据资料生成答案。

下一步调查

如果上传 PDF 可以做到,那么为什么 AI 还能记住我的偏好?为什么不同聊天之间,它开始认识我了?这一次,放到它眼前的,又是什么?下一篇,继续调查。

《AI 为什么会?⑩ AI 为什么开始认识你了?》