PDF ファイルから簡単にテキストを抽出

ExpertPDF PdfToText は既存の .NET アプリケーションに簡単に統合でき、コンバーターを実行するためにインストールは不要です。PDF ストリームまたは PDF ファイルからテキストを抽出し、元の PDF レイアウトを保持したままテキストを抽出できます。抽出するページ範囲を指定し、抽出したテキストを HTML 形式で保存して説明用のメタタグを追加することも可能です。パスワードで保護された PDF ドキュメントからテキストを抽出するなど、さまざまなことができます。
機能
- .NET 開発ライブラリおよび C# サンプル
- PDF ストリームまたは PDF ファイルからテキストを抽出
- 元の PDF レイアウトを保持してテキストを抽出
- PDF の読み取り順でテキストを抽出
- 抽出するページ範囲を指定
- 抽出したテキストを HTML 形式で保存し、説明用のメタタグを追加
- PDF の説明からタイトル、キーワード、著者を HTML メタタグに追加
- 抽出したテキスト内でページ区切りを特殊文字でマーク
- パスワードで保護された PDF ドキュメントからテキストを抽出
Outside Software について
Outside Software Inc. は、信頼性が高く高品質な IT サービスを提供することを目的に作られたルーマニアのソフトウェア会社です。チームのメンバーは、完全な Web アプリケーションの開発、完全にスケーラブルなデータベースソリューション、複雑な Windows ベースのアプリケーション、優れた開発者向けコンポーネントやツールの開発において、長年の経験を持っています。