CodexでPDFを読む

利用できるツールでPDFを直接読めて、目的を達成できるなら、そのままで十分です。スキャン文書のOCRや、再利用できるMarkdownが必要なときに変換してください。

セッションにNode 18+とネットワーク接続が必要です。デモは登録不要です。

デモは1ページ目のみ。 変換時に文書は外部サービスへ送信されます。文書処理の許可に従ってください。

terminal
$ npx pdftomarkdown@0.1.6 document.pdf

元のPDFとMarkdownの全出力を比較(英語)

最大11分の待機を見込んでください。中断しても処理・課金が続く場合があります。 CLIの設定・復旧ガイド(英語)

文書の全ページを変換する

新規アカウントは初回のみ20ページを試せます。全ページ対応で、ウォーターマークはありません。その後は有料クレジットを使用します。GitHubでAPIキーを取得し、環境変数に設定してください。

GitHubでAPIキーを取得(英語) →

shell profile
export PDFTOMARKDOWN_API_KEY=your_key_here

CLIは環境変数からキーを自動的に読み取ります。

任意:AGENTS.mdに手順を追加

プロジェクトのAGENTS.mdまたは~/.codex/AGENTS.mdに以下を追加できます。利用可能なツールと文書処理の許可は引き続き確認してください。

AGENTS.md
## PDFの読み取り

PDFを直接扱えるかは、このセッションのツールによります。
OCRや再利用可能なMarkdownが役立つ場合に変換してください。
文書は外部サービスに送信されるため、ユーザーの処理許可に従ってください。
Node 18+と公開済みCLIを使用します:

    npx pdftomarkdown@0.1.6 document.pdf

長い文書の出力は分割して読んでください。デモは1ページ目のみです。
新規アカウントの初回20ページ以降は有料クレジットを使用します。
明示的な許可なくクレジットを購入しないでください。
待機時間は最大11分を見込んでください。中断しても処理・課金が続く場合があります。
バージョンごとの復旧方法は https://pdftomarkdown.dev/docs/cli/ を参照してください。