このページは機械翻訳されています。間違いを見つけましたか?改善にご協力ください。
Skip to content

PDF to Text ​

PDF ドキュメントから読み取り可能なプレーンテキストをすべて抽出してテキストファイルにします。

API Endpoint ​

POST /api/v1/tools/pdf/pdf-to-text

PDF ファイルを含む multipart フォームデータを受け付けます。

Parameters ​

このツールに設定可能なパラメータはありません。PDF をアップロードすると、そのテキストコンテンツが抽出されます。

Example Request ​

bash
curl -X POST http://localhost:1349/api/v1/tools/pdf/pdf-to-text \
  -H "Authorization: Bearer si_your-api-key" \
  -F "[email protected]"

Example Response ​

json
{
  "jobId": "a1b2c3d4-e5f6-7890-abcd-ef1234567890",
  "downloadUrl": "/api/v1/download/a1b2c3d4-e5f6-7890-abcd-ef1234567890/report.txt",
  "originalSize": 520000,
  "processedSize": 14300,
  "chars": 14300
}

Notes ​

  • 受け付ける入力形式: .pdf。
  • これは結果を直接返す高速(同期)ツールです。
  • レスポンスの chars フィールドは、抽出された文字数を示します。
  • 抽出されるのはデジタルに埋め込まれたテキストのみです。スキャンされたドキュメントや画像ベースの PDF には、代わりに PDF OCR ツールを使用してください。