Text aus Bildern mit RESTful OCR-API lesen

PrizmDoc 13.25 bietet ein Add-on für eine Optische Zeichenerkennungs-API (OCR), das eine hohe Genauigkeit liefert – ideal für Apps zur Bild- oder Dokumentverarbeitung.

Text aus Bildern mit RESTful OCR-API lesen

PrizmDoc Viewer ist ein webbasiertes HTML5-Dokumentbetrachtungstool, das Entwicklern ermöglicht, leistungsstarke Dokumentansichts- und Dokumentkonvertierungsfunktionen in ihre Webanwendungen einzubinden. Es unterstützt eine Vielzahl von Dokumentformaten, darunter PDF, Word, Excel, PowerPoint, AutoCAD und mehr.

PrizmDoc Viewer 13.25 bietet eine optionale RESTful-API, mit der Sie Text aus Bildern mithilfe der Optischen Zeichenerkennung (OCR) auslesen können. Die API ist mit jeder Programmiersprache kompatibel und erleichtert die Integration in Ihre eigenen Anwendungen – unabhängig davon, für welche Plattform Sie entwickeln. Sie kann eine hochpräzise OCR sowohl für ganze Seiten als auch für bestimmte Bereiche mit Interesse durchführen.

Die OCR-API hilft Ihnen, jedes bildbasierte Dokument schnell und präzise in eine editierbare Textdatei oder ein durchsuchbares PDF umzuwandeln. Sie ist mit verschiedenen Eingabeformaten kompatibel, darunter JPEG, TIFF, PNG und BMP, und kann automatisch die Seitenausrichtung erkennen sowie Text in verschiedenen Seitenlayouts erkennen. Sie kann außerdem ein PDF im Format „Bild-über-Text“ erzeugen und dabei durchsuchbaren Text bereitstellen, der mit dem Text auf dem Bild übereinstimmt. So können Sie gescannte Dokumente oder andere bildbasierte Dateien in durchsuchbare PDFs umwandeln.

Um eine vollständige Liste der Neuerungen in Version 13.25 zu sehen, lesen Sie unsere Release Notes.

Weitere Informationen finden Sie auf unserer PrizmDoc Viewer Produktseite.

Verwandt: