PDFに質問して、答えを得る
PDFをアップロードし、条項7が実際に何を言っているのか、サンプルサイズはどれくらいだったか、設定はどのポートを使用しているかなど、平易な言葉で何でも質問してください。AIがドキュメントを読み込み、そこから回答し、その答えがどこから来たのかを示すページを指し示すので、確認できます。1行を見つけるために80ページをスクロールする必要はありません。
これは、ファイルを最初から最後まで読むためではなく、あなたがすでに持っている質問のために作られています。あなたが探しているものを知っていれば、これが見つけ出す手助けをします。
読み取れるものと読み取れないもの
ここが機能するかどうかを決定する部分であり、ほとんどのPDFチャットページではこの点がスキップされています。
AIはPDFのテキストレイヤーから回答します。通常の書き出しPDF(Word、Googleドキュメント、LaTeX、Web印刷など)にはそのテキストが含まれているため、すぐに機能します。スキャンされた文書やPDFとして保存された写真にはテキストレイヤーがありません。それは単なる単語の画像であり、モデルが読み取るものが何もありません。これらの場合は、まずOCRを実行してテキストレイヤーを追加し、その後で結果とチャットしてください。
知っておくべき、あと2つの正直な限界点:
- 重要なことはすべて確認してください。 回答はドキュメントに基づき、ページを引用しています。これはまさにあなたがそれを確認できるようにするためです。PDFがカバーしていないことを尋ねた場合、言語モデルは推測してしまう可能性があるので、契約書や検査結果を引用する前に、引用されたページを確認してください。
- 非常に長いPDFはチャンクに分割されます。 400ページの取扱説明書は、モデルのコンテキストに合わせるために分割されるため、12ページと380ページを結びつけるような質問は、その関連性を見落とす可能性があります。焦点を絞った質問をすれば問題ありません。
PDFとチャットする方法
- PDFをアップロードします。
- 人に尋ねるのと同じように質問を入力します。
- 回答を読み、ページの参照元を辿って確認します。
- 質問を続けてください。フォローアップは同じドキュメントに基づいて行われるため、再アップロードせずに深く掘り下げることができます。
人々がPDFに尋ねること
- 研究者や学生は、30ページすべてを読まずに論文から方法、サンプルサイズ、調査結果を抽出し、すでに知っていることと比較してどうかを尋ねます。
- 何かを署名する人は、契約書やリースについて、通知期間、更新条項、罰則など、重要な質問を投げかけ、正確な文言を返してもらいます。
- エンジニアやIT担当者は、200ページの取扱説明書やRFCから、必要な設定やコマンドを一つだけ問い合わせます。
- アナリストは、財務報告書やホワイトペーパーから特定の表の数値を尋ねます。
チャット、読む、分析?
3つの関連する機能があり、適切なものを選択することが役立ちます。チャットは、あなたがすでに持っている特定の質問向けです。AIにドキュメント全体を読みながら案内してほしい場合は、AI PDFリーダーがそのために作られています。あなたの質問に答えるのではなく、AIが独自に要約や主要な洞察を抽出してほしい場合は、AI PDFアナライザーがその役割を果たします。そして、PDFを聴けるオーディオに変換するには、PDF音声変換が読み上げます。