WORKLAZY TOOLS

PDF 워드·엑셀 변환

원하는 PDF 페이지를 OCR 기술을 이용해 DOCX, XLSX, TXT 파일로 변환하세요.

설치나 로그인 없이 브라우저에서 바로 사용하세요.

텍스트 PDF와 스캔 PDF의 차이

텍스트 PDF는 문자를 직접 선택할 수 있어 빠르고 정확하게 추출할 수 있습니다. 스캔 PDF는 페이지가 사진처럼 저장되어 있으므로 이미지에서 글자를 읽는 OCR 과정이 필요합니다.

자동 OCR은 페이지에서 읽을 수 있는 글자가 거의 없을 때만 한국어·영어 인식을 실행합니다. 도면이나 사진처럼 글자가 없는 페이지도 정상적인 빈 결과일 수 있습니다.

DOCX·XLSX 변환 범위

PDF는 보이는 위치를 중심으로 저장되고 원래의 문단, 표, 셀 구조가 사라진 경우가 많습니다. DOCX는 읽기 순서와 줄을 문단으로 재구성하고, XLSX는 같은 행에 놓인 글자의 간격을 이용해 셀을 추정합니다.

복잡한 표, 다단 문서, 세로쓰기, 각주, 수식, 원본 글꼴과 서식은 완전히 재현되지 않을 수 있습니다. 결과는 편집을 시작하기 위한 초안으로 보고 원문과 대조하는 것이 안전합니다.

OCR 인식 데이터와 개인정보

한국어·영어 OCR 기능과 필요한 언어 데이터는 Worklazy Tools와 같은 GitHub Pages 배포 경로에서 제공되며 외부 CDN이나 OCR 서버를 사용하지 않습니다. 사용자가 선택한 PDF 페이지와 인식 결과는 브라우저 밖으로 전송하지 않습니다.

오프라인에서 사이트를 처음 열거나 브라우저 캐시에 필요한 OCR 데이터가 없는 상태에서는 OCR을 시작할 수 없습니다. 캐시 삭제, 시크릿 모드 또는 브라우저 저장 공간 부족 상황에서는 사이트를 온라인으로 다시 연 뒤 시도해 주세요.

대용량 문서 처리

OCR은 페이지를 고해상도 이미지로 만든 뒤 한 장씩 인식하므로 일반 텍스트 추출보다 오래 걸립니다. 50페이지 이상 문서는 충분한 메모리와 전원을 확보하고 다른 무거운 탭을 닫는 것을 권장합니다.

진행률은 언어 모델 준비, 페이지 렌더링, 인식, 결과 파일 생성 단계를 합쳐 표시합니다. 모바일에서는 운영체제가 메모리 사용량이 큰 탭을 종료할 수 있어 긴 문서는 데스크톱 환경이 더 안정적입니다.

본문 글자를 고치는 작업과 페이지를 정리하는 작업은 어떻게 다른가요?

제출할 파일을 하나로 모으거나 필요한 페이지만 남기려면 페이지 편집을 사용하세요. 글자 내용을 다시 작성하는 기능이 아니라 페이지의 순서·구성과 방향을 정리하는 작업입니다.

페이지를 사진처럼 쓰려면 PDF→이미지, 여러 사진을 한 문서로 묶으려면 이미지→PDF를 고르세요. PDF의 글자를 편집 가능한 문서로 가져오려면 문서 변환, 스캔한 문서에 검색 가능한 글자를 더하려면 OCR을 사용합니다. 변환 후에는 원문과 결과를 함께 확인하세요.

예제 및 선택 도움

자주 사용하는 작업 예시: “제출 서류 3개를 하나로 합치기”→병합 기능, “계약서 중 2~4쪽만 저장하기”→분할/추출 기능, “페이지 전체를 PNG로 만들기”→이미지 변환, “스캔된 서류에서 단어 검색하기”→OCR 기능을 활용해 보세요.

자주 묻는 질문

파일이 서버로 업로드되나요?

아니요. 선택한 PDF·이미지와 생성 결과는 작업 서버로 업로드하지 않고 현재 브라우저에서 처리합니다. 다만 사이트와 광고, OCR 언어 모델을 내려받는 일반 네트워크 통신은 별도로 발생할 수 있습니다.

암호가 설정된 PDF도 처리할 수 있나요?

현재는 지원하지 않습니다. 보호를 우회하지 않으며, 권한이 있는 사용자가 암호 보호를 해제한 사본을 준비해야 합니다.

모바일에서도 사용할 수 있나요?

가능하지만 긴 PDF, 고해상도 이미지 변환과 대량 OCR은 메모리 제한 때문에 데스크톱 브라우저가 더 안정적입니다.

PDF를 Word나 Excel로 완벽하게 복원할 수 있나요?

PDF에 원래 문단과 표 구조가 남아 있지 않은 경우가 많아 완벽한 복원은 어렵습니다. 좌표와 글자 간격으로 구조를 추정한 편집용 초안을 제공합니다.