提问PDF,获取答案
上传PDF并用通俗语言提问:条款7究竟说了什么,样本量是多少,配置使用了哪个端口。AI会阅读文档并从中获取答案,然后指向答案来源的页面,以便您进行核对。无需滚动80页只为找到一行内容。
它专为回答您已有的问题而设计,而不是从头到尾阅读整个文件。您知道自己在找什么,它能帮助您找到。
它能读什么,不能读什么
这是决定它是否奏效的部分,而大多数PDF聊天页面都跳过了这一点。
AI从PDF的文本层中获取答案。一份正常的导出PDF(来自Word、Google Docs、LaTeX、网页打印)包含该文本,因此可以直接使用。扫描文档或保存为PDF的照片没有文本层,它只是文字的图像,模型无从读取。对于这类文件,请先运行OCR添加文本层,然后与结果进行聊天。
另外两个值得了解的诚实限制:
- 核实任何重要内容。 答案基于文档并引用页面,这正是为了让您能够确认它们。如果您询问PDF未涵盖的内容,语言模型仍然可能会猜测,因此在引用合同或实验室结果之前,请检查引用的页面。
- 超长PDF会被分块处理。 400页的手册会被分割以适应模型的上下文,因此,如果一个问题需要关联第12页和第380页的内容,可能会错过这种联系。提出一个集中的问题即可。
如何与PDF聊天
- 上传PDF。
- 像问人一样输入您的问题。
- 阅读答案并根据页面引用返回原文进行确认。
- 继续提问。后续问题基于同一文档,因此您可以深入挖掘而无需重新上传。
人们向PDF提问什么
- 研究人员和学生无需阅读全部30页即可从论文中提取方法、样本量和研究结果,然后询问它与他们已知的内容有何比较。
- 任何签署文件的人向合同或租赁协议询问重要问题,如通知期、续订条款、罚金,并获得精确的措辞。
- 工程师和IT人员查询200页手册或RFC,寻找他们所需的唯一设置或命令。
- 分析师询问财务报告或白皮书,获取特定表格中的数字。