リンク抽出
PDFからすべてのハイパーリンク(URL)をテキストリストとして抽出します。
ここにPDFをドロップするか、クリックして選択
PDFの上限: 100 MB
クリック可能なリンク(注釈)のみが検出されます。結果はページとURLを一覧化したテキストファイルです。
PDFからすべてのハイパーリンク(URL)をテキストリストとして抽出します。
ここにPDFをドロップするか、クリックして選択
PDFの上限: 100 MB
クリック可能なリンク(注釈)のみが検出されます。結果はページとURLを一覧化したテキストファイルです。
PDF はしばしば、外部への数十もの参照を隠しています。参考文献、出典、トラッキングページ、操作ボタンなどです。PDF からリンクを一度に抽出できれば、各ページを手作業で確認する手間が省け、ファイルが指し示すすべてを瞬時に概観できます。これは適切な監査の基礎です。報告書が実際に読者をどこへ導くのかが一目でわかります。
PDF のリンクを集めることは、再利用できる参照リストを作るときや、不要なドメインへ導く URL がないか確認するとき、あるいは別のプラットフォームへのコンテンツ移行を準備するときにも役立ちます。各アドレスを、それが載っているページとともにきれいに取り出すことで、静的なファイルが、検証やアーカイブに使えるデータへと変わります。
ツールは URL を持つクリック可能なリンク注釈を見つけます。各ハイパーリンクは、そのリンク先アドレスと、出現するページ番号とともに一覧化され、すべて確認やコピーがしやすいプレーンテキストの一覧としてエクスポートされます。制約について正直に言うと、本文中に単にテキストとして打たれただけで、クリック可能なリンクが付いていないアドレスは、リンク注釈ではないため含まれません。
さらに進めるには、metadata がファイルの目に見えない情報を明らかにし、extract-attachments が埋め込み添付を取り出し、extract-pages が関心のあるページを取り出します。pdfOutils ではプライバシーを最優先します。登録は不要で、ファイルは処理後に自動的に削除され、保存も再利用も一切されません。
アップロード
PDF ファイルをドロップエリアにアップロードします(またはドラッグ&ドロップします)。
設定
PDFからすべてのハイパーリンク(URL)をテキストリストとして抽出します。
ダウンロード
生成された文書をワンクリックでダウンロードします。ファイルは処理後に自動的に削除されます。