從掃描的PDF中提取文字

Aspose.PDF for .NET V26.6 增加了無需依賴獨立OCR工具即可將掃描文件轉換為可搜尋、可存取文字的功能。

從掃描的PDF中提取文字

Aspose.PDF for .NET 使開發者能夠無縫整合PDF的生成、操作與轉換功能至其應用程式中。它透過提供操作PDF文件的程式介面,消除對Adobe Acrobat的依賴,支援從零建立PDF、編輯現有文件、添加圖片與浮水印等元素,並管理安全功能。

Aspose.PDF for .NET V26.6 版本引入整合的光學字符識別(OCR)用於PDF文字識別,允許開發者透過相同API直接從掃描的PDF與基於影像的文件中提取文字。此功能強化簡化了工作流程,無需整合及維護獨立OCR解決方案,降低開發複雜度與部署負擔。透過使先前無法存取的內容可搜尋、可編輯並支援資料提取,此功能有助於提升文件的可存取性,支援合規需求,並實現更有效的文件索引與歸檔。對於處理大量掃描文件的組織,整合OCR功能可提升生產力,同時提供更一致且順暢的文件處理體驗。

有關V26.6版本的完整新增功能列表,請參見我們的發行說明

Aspose.PDF for .NET 提供Developer Small Business、Developer OEM、Developer SDK、Site Small Business、Site OEM和Site SDK授權,滿足各種業務需求。授權為永久有效,包含1年支援與維護。亦提供訂閱續約。詳細資訊請參閱我們的Aspose.PDF for .NET授權頁面

了解更多資訊,請造訪我們的Aspose.PDF產品頁面