スキャンしたPDFからテキストを抽出する

Aspose.PDF for .NET V26.6 は、別のOCRツールに依存せずにスキャンした文書を検索可能でアクセス可能なテキストに変換する機能を追加しました。

スキャンしたPDFからテキストを抽出する

Aspose.PDF for .NET は、開発者がPDFの生成、操作、変換機能をアプリケーションにシームレスに統合できるようにします。Adobe Acrobatへの依存をなくし、PDF文書を操作するためのプログラムインターフェースを提供することで、一からPDFを作成したり、既存のPDFを編集したり、画像や透かしなどの要素を追加したり、セキュリティ機能を管理したりすることが可能です。

Aspose.PDF for .NET V26.6 リリースでは、PDFテキスト認識のための統合光学文字認識(OCR)を導入し、開発者が同じAPIを通じてスキャンしたPDFや画像ベースの文書から直接テキストを抽出できるようになりました。この機能強化により、別個のOCRソリューションを統合・管理する必要がなくなり、ワークフローが簡素化され、開発の複雑さと展開の負担を軽減します。これまでアクセスできなかったコンテンツを検索可能、編集可能、データ抽出可能にすることで、文書のアクセシビリティが向上し、コンプライアンス要件をサポートし、より効果的な文書のインデックス作成とアーカイブを可能にします。大量のスキャン文書を処理する組織にとって、統合OCR機能は生産性を向上させ、一貫性のある効率的な文書処理体験を提供します。

V26.6の新機能の全リストは、リリースノートをご覧ください。

Aspose.PDF for .NETは、Developer Small Business、Developer OEM、Developer SDK、Site Small Business、Site OEM、Site SDKの各ライセンスで提供されており、多様なビジネスニーズに対応しています。ライセンスは永久的で、1年間のサポートとメンテナンスが含まれています。サブスクリプションの更新も可能です。詳細はAspose.PDF for .NETのライセンスページをご覧ください。

詳細はAspose.PDF製品ページでご確認ください。