원본 페이지마다 하나의 구역
HTML에 선택한 원본 페이지 표시가 있으므로 독자는 대응하는 PDF 페이지로 돌아갈 수 있습니다.
PDF 텍스트 레이어에서 간단한 HTML 문서를 만드세요.
파일을 여기에 끌어 놓거나 아래 버튼을 사용하세요.
최대 100 MB 합계 · 파일은 내 기기에 유지
여기에서 문서를 미리 보세요. 내용을 추가할 때는 배치 안내용이므로 저장된 출력물도 확인하세요.
선택 가능한 PDF 텍스트를 선택한 페이지마다 구역이 있는 간단한 HTML 문서로 내보내세요. 결과는 읽기 쉬운 텍스트 참고 자료나 웹 편집의 출발점으로 유용합니다.
이 도구는 추출한 문자를 이스케이프 처리하며 대화형 PDF 콘텐츠나 원래 CSS를 재현하지 않습니다. 결과는 PDF와 픽셀 단위로 일치하는 웹사이트 버전이 아니라 텍스트로 표현한 문서입니다.
HTML에 선택한 원본 페이지 표시가 있으므로 독자는 대응하는 PDF 페이지로 돌아갈 수 있습니다.
추출한 문자는 HTML에 맞게 이스케이프 처리됩니다. PDF 텍스트가 내장 HTML 코드로 실행되지 않습니다.
작업과 관련된 페이지만 선택해 더 작은 참고 문서를 만드세요.
다운로드한 파일은 HTML 텍스트 문서로 열립니다. 원본 글꼴, 이미지 또는 페이지 CSS를 재현하지 않습니다.
HTML을 사용하면 추출한 문구를 브라우저에서 편하게 보거나 웹 편집자에게 전달할 수 있습니다. 이 변환기는 페이지 표시가 있는 텍스트 구역을 만들며, 게시자가 제대로 된 웹페이지를 구성하는 동안 참고 자료로 유용합니다. 의미에 맞는 제목을 추론하거나, 표를 재현하거나, 완성된 접근성 지원 출판물을 제공하지는 않습니다. 변환 후에는 내용을 의미 있는 제목과 단락으로 재구성하고 읽기 순서를 확인하며 사용이 허용된 이미지를 따로 추가하세요. 고정된 시각적 미리 보기가 필요하면 페이지 렌더링을 사용하세요.
승인된 브로슈어 문구를 가져와 웹페이지 초안을 만드세요. 일반적인 페이지 구역을 의미 있는 제목으로 바꾸고 줄 바꿈으로 문장이 나뉘지 않았는지 확인하세요.
텍스트 중심의 PDF 절차서에서 브라우저로 읽을 수 있는 참고 자료를 만드세요. 팀 시스템에 올릴 검토된 글을 준비하는 동안 원본 페이지 참조를 유지하세요.
고정된 PDF 레이아웃과 간단한 HTML 텍스트 표현을 비교하세요. 사용할 수 있는 웹 버전을 만들려면 어떤 구조, 이미지 설명, 표 마크업을 수동으로 제공해야 하는지 파악하세요.
HTML 추출을 위해 텍스트 기반 PDF를 선택하세요.
스크린샷을 선택하면 확대할 수 있습니다.
원본 페이지를 설정하고 필요한 경우 다운로드 이름을 지정하세요.
스크린샷을 선택하면 확대할 수 있습니다.
HTML을 다운로드하고 페이지 표시가 있는 텍스트 구역을 확인하세요.
스크린샷을 선택하면 확대할 수 있습니다.
스크린샷은 무해한 예제 파일로 이 도구 모음을 사용하는 모습을 보여 줍니다. 실제 파일 이름, 페이지 수 및 설정은 다를 수 있습니다.
| 설정 | 예상되는 동작 |
|---|---|
| 지원하는 입력 형식 | |
| 처리 위치 | 사용자의 브라우저 |
| 파일 선택 | 입력 파일 1개 |
| 입력 크기 | 총 100 MB이며, 디코딩한 이미지와 페이지에는 픽셀 수 제한도 적용됩니다 |
| 페이지 선택 | 작업당 최대 200페이지를 선택할 수 있습니다. 페이지 입력란을 비워 두면 PDF가 200페이지 이하일 때만 모든 페이지를 의미합니다. 더 긴 문서는 범위를 나누어 처리하세요. |
이 내보내기는 기존 텍스트 레이어가 필요합니다. 스캔한 페이지의 문구가 생성된 HTML에 나타나려면 먼저 검증한 OCR이 필요합니다.
인쇄된 페이지 경계가 완전한 웹 구역을 나타내는 경우는 드뭅니다. 내보낸 문서를 편집할 때는 주제를 설명하는 제목 아래에 단락을 배치하고, 실제 표에는 적절한 행과 열 마크업을 부여하며, 중요한 도표에는 설명 텍스트를 제공하세요. 생성된 서식 유지 텍스트는 편집할 참고 자료이며 원본 문서가 이제 완성된 웹페이지가 되었다는 증거가 아닙니다. 원본 페이지 표시를 제거하기 전에 문구를 PDF와 대조하세요.
| 상황 | 해결 방법 |
|---|---|
| 페이지 디자인이 없습니다 | 이 작업은 PDF의 텍스트를 HTML로 내보내는 것이며 시각적 레이아웃을 재구성하는 작업이 아닙니다. |
| 스캔한 페이지에 내용이 없습니다 | 먼저 OCR 텍스트 레이어를 추가하고 확인하세요. |
| 문자가 HTML 코드처럼 보입니다 | 추출한 문서 내용이 실행되지 않도록 의도적으로 이스케이프 처리한 것입니다. |
“프로젝트 계획” 같은 인쇄된 제목은 내보내기의 pre 텍스트 안에 나타날 수 있습니다. 그것이 문서 제목임을 확인한 후 편집자는 <h1>프로젝트 계획</h1>으로 표시하고 이어지는 글을 p 요소에 배치할 수 있습니다. PDF 페이지가 끝나는 위치만 보지 말고 텍스트의 의미에 따라 구조를 선택하세요.
이 내보내기에는 이스케이프 처리한 추출 텍스트가 포함됩니다. 이미지, 작동하는 링크, 원래 페이지 스타일은 재구성하지 않습니다.
먼저 콘텐츠, 접근성, 서식을 검토하세요. 추출한 텍스트를 완성된 사이트로 취급하지 말고 적절한 웹 레이아웃을 추가하세요.
네. 다운로드한 파일을 텍스트 또는 HTML 편집기에서 여세요. 게시할 페이지에 사용하기 전에 추출된 문자를 검토하고 적절한 구조를 추가하세요.
다음으로 HTML을 PDF로 변환, PDF OCR 텍스트 인식, PDF를 텍스트로 변환을 이용하세요.