使用 RESTful OCR API 從影像中讀取文字

PrizmDoc 13.25 提供光學字元辨識 API(OCR)附加元件,具備高精度辨識能力,非常適合影像或文件處理應用程式。

使用 RESTful OCR API 從影像中讀取文字

PrizmDoc Viewer 是一款基於 Web 的 HTML5 文件檢視器,可讓開發人員將強大的文件檢視與文件轉換功能嵌入到 Web 應用程式中。它支援多種文件格式,包括 PDF、Word、Excel、PowerPoint、AutoCAD 等。

PrizmDoc Viewer 13.25 提供可選的 RESTful API,可讓您使用光學字元辨識(OCR)從影像中讀取文字。該 API 與任何程式語言相容,讓您能輕鬆整合到自己的應用程式中,不論您鎖定哪個平台。它能在完整頁面與特定感興趣區域上執行高精度 OCR。

OCR API 可協助您快速且精確地將任何基於影像的文件轉換為可編輯的文字檔或可搜尋的 PDF。它相容於各種輸入格式,包括 JPEG、TIFF、PNG 和 BMP,並能自動偵測頁面方向,且能辨識不同頁面版面中的文字。它也能產生影像轉文字(image-over-text)PDF 輸出,提供可搜尋文字,並使文字內容與影像中的文字對齊。這讓您能將掃描文件或其他基於影像的檔案轉換為可搜尋的 PDF。

若要查看版本 13.25 的完整更新內容清單,請參閱我們的 release notes

如需更多資訊,請造訪我們的 PrizmDoc Viewer 產品頁面。

相關: