텍스트 추출
문서를 넣는 방법은 뷰어와 같지만, 목적은 추출된 텍스트를 코드로 받아가는 것입니다.
onLoad(추출 완료) 뒤에 getResult()를 부르면 페이지별 텍스트가 옵니다. 화면이 필요 없으면 컨테이너를 숨겨도 됩니다.
실행 예제
<div id="extract" style="height:560px"></div>
<script src="https://dragdocs.com/embed/dragdocs.js"></script>
<script>
const extractor = DragDocs.extractor("#extract", {
clientId: "XXXX-XXXX-XXXX-XXXX-XXXX",
url: "/sample.pdf",
onLoad: async () => {
const result = await extractor.getResult();
// result.pages = [{ page: 1, content: "1페이지 텍스트" }, ...]
const text = result.pages.map((p) => p.content).join("\n\n");
await fetch("/api/index", { method: "POST", body: text }); // AI 검색 색인 등
},
onError: (e) => console.error(e.message),
});
</script>
옵션과 메서드
옵션(clientId · file · url · filename · mimeType · credentials)과 open()·destroy()는 뷰어와 같습니다. 추가로:
| 메서드 / 이벤트 | 설명 |
|---|---|
getResult() | { filename, complete, pages: [{ page, content }] }를 돌려주는 Promise. content는 페이지 텍스트. onLoad 전에 부르면 그때까지의 페이지와 complete: false |
onLoad | { filename } — 모든 페이지 추출 완료 |
새 창 폴백(Safari·Firefox)은 뷰어와 같은 조건입니다. 폴백 경로에서는 결과가 새 창 안에 표시되고 getResult()는 쓸 수 없습니다.
지원 형식
pdf · doc · docx · ppt · pptx · xls · xlsx · hwp · hwpx
다음: HTML 변환