PDFからエクセルへの変換を試みた際、文字が「???」や記号の羅列になってしまったり、取り込み自体がエラーで弾かれるケースがあります。現場取材で判明した代表的な3大原因とその解決策を整理しました。
1. 特殊フォントの「非埋め込み」による文字化け
作成元のPDFでフォントが正しく埋め込まれていない場合、Excel側が文字コードを判別できずに文字化けが発生します。この場合、一度ブラウザ(Google ChromeやMicrosoft Edge)でPDFを開き、「印刷」メニューから「PDFとして保存(Microsoft Print to PDF等)」を実行して再生成することで、文字情報が標準フォントコードに正規化され、正常に読み込めるケースが多々あります。
2. 紙をスキャンした「画像化PDF」の読み込み不全
複合機からスキャンしたPDFは、見た目は文書でも中身は単なる「写真(画像データ)」です。Excel標準のPDF取り込み機能はテキスト情報(ベクターデータ)を対象としているため、画像PDFからは表を抽出できません。この場合は、Adobe AcrobatのOCR機能やGoogleドライブの「Googleドキュメントで開く」機能を経由してテキストを認識させるステップが必要です。
3. パスワード保護・セキュリティ権限の制約
閲覧パスワードや印刷・編集の制限が掛けられたPDFは、インポート処理時に「アクセスが拒否されました」とエラーになります。正当な業務権限がある文書であれば、パスワードを解除した状態で保存し直してから取り込み作業を実施してください。