PDF ファイルから簡単にテキストを抽出

PDF ファイルから簡単にテキストを抽出

ExpertPDF PdfToText は既存の .NET アプリケーションに簡単に統合でき、コンバーターを実行するためにインストールは不要です。PDF ストリームまたは PDF ファイルからテキストを抽出し、元の PDF レイアウトを保持したままテキストを抽出できます。抽出するページ範囲を指定し、抽出したテキストを HTML 形式で保存して説明用のメタタグを追加することも可能です。パスワードで保護された PDF ドキュメントからテキストを抽出するなど、さまざまなことができます。

機能

  • .NET 開発ライブラリおよび C# サンプル
  • PDF ストリームまたは PDF ファイルからテキストを抽出
  • 元の PDF レイアウトを保持してテキストを抽出
  • PDF の読み取り順でテキストを抽出
  • 抽出するページ範囲を指定
  • 抽出したテキストを HTML 形式で保存し、説明用のメタタグを追加
  • PDF の説明からタイトル、キーワード、著者を HTML メタタグに追加
  • 抽出したテキスト内でページ区切りを特殊文字でマーク
  • パスワードで保護された PDF ドキュメントからテキストを抽出

Outside Software について

Outside Software Inc. は、信頼性が高く高品質な IT サービスを提供することを目的に作られたルーマニアのソフトウェア会社です。チームのメンバーは、完全な Web アプリケーションの開発、完全にスケーラブルなデータベースソリューション、複雑な Windows ベースのアプリケーション、優れた開発者向けコンポーネントやツールの開発において、長年の経験を持っています。