C#을 사용해 PDF에서 텍스트를 프로그래밍 방식으로 추출하기
MESCIUS Document Solutions for PDF를 사용해 인덱싱, 검색 등을 위해 PDF에서 텍스트 추출을 자동화하세요.

Document Solutions for PDF (DsPdf)는 Adobe Acrobat에 대한 의존성 없이 .NET을 위한 고속·다기능 서버 측 PDF API 라이브러리입니다. DsPdf를 사용하면 개발자가 데스크톱 및 웹 애플리케이션 전반에서 스케일에 맞게 AcroForms를 포함한 PDF 문서를 프로그래밍 방식으로 생성, 조작, 가져오기/내보내기, 배포할 수 있습니다. .NET을 완벽하게 지원하므로 .NET, Mono, Xamarin.iOS, Xamarin.Android 앱 내에서 PDF를 직접 생성, 로드, 수정, 변환할 수 있습니다. 또한 데스크톱/웹 애플리케이션에서 사용자가 PDF 문서를 보고(선택적으로 편집)할 수 있도록 하는 빠른 JavaScript 기반 클라이언트 측 뷰어/에디터도 포함되어 있습니다.
이 블로그 게시물에서 MESCIUS 제품 마케팅 스페셜리스트 Mackenzie Albitz는 DsPdf를 사용해 다양한 시나리오에서 PDF의 텍스트를 구문 분석하고 추출함으로써 PDF 콘텐츠를 원활하게 여는 방법을 시연합니다. 여기에는 다음이 포함됩니다:
- PDF 파일에서 모든 텍스트 추출
- 특정 PDF 페이지에서 텍스트 추출
- PDF의 미리 정의된 영역에서 텍스트 추출
- PDF에서 글꼴 추출
샘플 코드가 포함되어 있으며, 시작에 도움이 되는 Quick Start Demo 및 완전한 샘플 애플리케이션 링크도 제공됩니다.
전체 블로그 읽기를 통해 PDF 콘텐츠를 여는 방법을 알아보세요.
Document Solutions for PDF는 개발자당 라이선스로 제공되며, 서로 다른 배포 요구에 맞춰 여러 라이선스 옵션을 선택할 수 있습니다. 동일 조직 내 여러 개발자를 위한 팀 라이선스도 제공됩니다. 자세한 내용은 Document Solutions for PDF 라이선싱 페이지를 참조하세요.
Document Solutions for PDF 제품 페이지에서 더 알아보세요.