从扫描的PDF中提取文本
Aspose.PDF for .NET V26.6 增加了无需依赖独立OCR工具即可将扫描文档转换为可搜索、可访问文本的功能。

Aspose.PDF for .NET 使开发者能够无缝集成PDF的生成、操作和转换功能到他们的应用程序中。它通过提供操作PDF文档的编程接口,消除了对Adobe Acrobat的依赖,支持从零创建PDF、编辑现有PDF、添加图片和水印等元素,以及管理安全功能等操作。
Aspose.PDF for .NET V26.6 版本引入了集成的光学字符识别(OCR)用于PDF文本识别,允许开发者通过同一API直接从扫描的PDF和基于图像的文档中提取文本。这一增强简化了工作流程,无需集成和维护独立的OCR解决方案,降低了开发复杂度和部署负担。通过使之前无法访问的内容可搜索、可编辑并支持数据提取,该功能有助于提升文档的可访问性,支持合规性要求,并实现更有效的文档索引和归档。对于处理大量扫描文档的组织,集成OCR功能可提升生产力,同时提供更一致流畅的文档处理体验。
有关V26.6版本的完整新增功能列表,请参见我们的发布说明。
Aspose.PDF for .NET 提供Developer Small Business、Developer OEM、Developer SDK、Site Small Business、Site OEM和Site SDK许可证,满足各种业务需求。许可证为永久有效,包含1年的支持和维护。也提供订阅续订。详细信息请参阅我们的Aspose.PDF for .NET许可页面。
了解更多信息,请访问我们的Aspose.PDF产品页面。