アップロードしたPDFに対してChatGPTが実際に行っていること
PDFを添付すると、その中の文字情報が抽出され、非常に長いテキストを貼り付けたのと同じような形で会話の文脈として渡されます。つまりChatGPTの回答の質は、そのPDFが実際に抽出可能な文字レイヤーを持っているかどうかに左右されます。文字レイヤーのないスキャンPDFの場合は先にOCR処理が必要になることもあれば、モデルの画像読み取り機能によって限定的にしか文字を認識できないこともあります。
大まかな要約依頼より具体的な質問のほうが良い回答を得られる理由
「これを要約して」という大まかな依頼は、文書全体を短い概要に圧縮する作業をモデルに強いるため、必然的に細部が失われます。一方、的を絞った追加質問をすれば、モデルは該当する箇所に集中して引用しながら答えられるため、1回の要約だけですべての詳細を引き出そうとするより、一般的に正確で役立つ回答が得られます。
よくある質問
選択できる文字のないスキャンPDFもChatGPTは読めますか?
ツールやPDFの状態によります。内蔵の画像認識機能で画像内の文字をある程度読み取れる場合もありますが、実際の文字レイヤーがある場合ほど安定した結果にはなりません。事前にPDFをOCR処理し、文字検索可能な状態にしてからアップロードするほうが、一般的に一貫した回答が得られます。
機密性の高いビジネス文書をChatGPTにアップロードしてもいいですか?
アップロードする前に、そのプラットフォームの現在のデータ利用・保持ポリシーを確認してください。ポリシーはサービスや時期によって異なります。特に機微な内容については、識別可能な情報を先に削除・伏せ字にするか、企業向けプランでデータの取り扱いが明示的に保証されている場合はそちらを利用することを検討してください。