HWP를 브라우저에서 HTML 또는 텍스트로 변환
HWP 5.0과 HWPX에서 HTML 읽기 사본이나 UTF-8 순수 텍스트를 만듭니다. 문서 처리는 기기를 벗어나지 않으며, HTML은 지원되는 그림을 파일 안에 담고 TXT는 글과 문단 구분을 중심으로 기록합니다.
파일은 이 기기를 떠나지 않습니다.
여기에 파일을 놓으세요
받는 형식: .hwp, .hwpx. 여러 파일을 한 번에 놓아도 됩니다.
이 기기에서는 파일 하나당 200 MB까지 받습니다.
파일 (0)
아직 파일이 없습니다. 위에 끌어 놓거나 기기에서 선택하세요.
파일을 기다리는 중입니다.
변환이 끝나면 여기에 내려받기 버튼이 나타납니다.
변환 요약
변환이 끝나면 이 카드에 무엇을 감지했고 무엇을 출력에 기록했는지 표시됩니다.
레이아웃은 보존되지 않습니다. 문서는 한 단으로 흘려 쓰고, 머리말·꼬리말과 다단 구역은 넣지 않습니다.
사용 방법
- 원본을 추가한 뒤 서식이 있는 읽기 파일은 HTML, 글 추출이 목적이면 순수 텍스트를 선택합니다.
- 선택한 출력으로 변환하고 요약에서 표 표현 변화나 기록하지 못한 요소가 있는지 살펴봅니다.
- HTML은 브라우저, TXT는 텍스트 편집기로 열어 필요한 부분을 대조합니다. 인쇄가 필요하면 HTML을 연 브라우저의 인쇄 미리보기를 별도로 확인합니다.
무엇이 보존되나
HTML은 행과 열 병합을 가진 표, 인라인 스타일, 문서 끝의 주석 구역을 사용하며 문단 번호는 눈에 보이는 글자로 기록합니다. TXT에서는 서식이 사라집니다. 기본 표 옵션은 행을 탭 구분 줄로 쓰고, 옵션을 끄면 셀 내용을 차례로 줄에 나열합니다. 병합 행을 데이터로 가져오기 전에는 해석이 필요합니다. 머리말과 꼬리말은 두 출력의 범위에서 제외됩니다. 출력 파일 생성과 원본의 쪽 단위 재현은 서로 다른 확인 항목입니다.
| HWP 요소 | 이 출력에서 |
|---|---|
| 문단과 글자 | 구조와 서식을 그대로 기록 |
| 글자 모양 | 구조와 서식을 그대로 기록 |
| 표 | 구조와 서식을 그대로 기록 |
| 셀 병합 | 구조와 서식을 그대로 기록 |
| 글상자와 도형 | 서식을 단순화해 기록 |
| 이미지 | 서식을 단순화해 기록 |
| 각주 | 구조와 서식을 그대로 기록 |
| 미주 | 구조와 서식을 그대로 기록 |
| 머리말 | 출력에 포함하지 않고 안내만 표시 |
| 꼬리말 | 출력에 포함하지 않고 안내만 표시 |
| 번호와 글머리표 | 텍스트로만 보존 |
| 수식 | 텍스트로만 보존 |
| OLE 개체 | 자리 표시 문구로 대체 |
| 차트 | 자리 표시 문구로 대체 |
| 배포용 문서 | 출력에 포함하지 않고 안내만 표시 |
| 암호 문서 | 출력에 포함하지 않고 안내만 표시 |
이 안내는 도구가 처리하는 범위를 설명합니다. 결과를 사용하기 전에 출력 내용과 경고를 확인하세요.
포맷 설명
HTML 읽기 사본에는 문서 구조, 스타일, 지원되는 이미지가 한 파일에 들어갑니다. 그림이 담긴 폴더를 따로 옮기지 않아도 되는 대신, 이미지 바이트를 데이터 주소로 기록하므로 예상보다 용량이 클 수 있습니다. 인쇄용 스타일도 포함하지만 실제 종이 크기, 배율, 여백과 브라우저의 인쇄 방식에 따라 페이지가 달라집니다. TXT는 글꼴, 색, 표 테두리가 없는 UTF-8 텍스트입니다. 문단 구분과 탭은 검색이나 후속 정리에 도움이 되지만, 그림이나 표의 시각적 배치를 대신하지 않습니다. 파일 크기가 작다는 이유만으로 TXT를 고르기보다 이후에 읽을지, 인쇄할지, 데이터를 추출할지에 맞춰 선택하세요. 글자가 거의 없는 이미지 문서는 HTML에 그림이 보여도 TXT에는 읽을 문장이 거의 없을 수 있습니다.
자주 묻는 질문
- 이 페이지에서 PDF를 직접 내려받을 수 있나요?
- 제공하는 출력은 HTML과 TXT이며 PDF 파일을 직접 만들지는 않습니다. 생성한 HTML을 브라우저에서 열고 인쇄 대화상자에서 PDF 저장 대상을 선택할 수 있는지 확인하세요. 사용할 수 있는 저장 대상과 인쇄 설정은 기기에 따라 달라집니다. 넓은 표, 쪽 경계, 마지막 주석을 미리 본 다음 인쇄 결과를 판단하는 것이 필요합니다.
- HTML에 들어간 그림은 어디에 저장되나요?
- 지원되는 내장 그림은 HTML 안의 데이터 URI에 기록됩니다. 이 출력에는 별도의 그림 폴더가 필요하지 않습니다. 그러나 원본이 외부 그림을 가리키고 해당 바이트를 읽을 수 없다면 HTML 안에 넣는 과정만으로 그 그림을 복구할 수는 없습니다. 이미지 관련 안내가 있다면 어떤 도표가 필요한지 원본과 함께 확인하세요.
- TXT를 표 계산 프로그램에 바로 가져와도 되나요?
- 표를 탭 구분으로 쓰는 옵션을 켜면 단순한 표에서 탭이 구분자로 도움이 되지만, 결과 전체를 곧바로 완성된 데이터셋으로 볼 수는 없습니다. 병합 칸의 글은 한 번만 기록하고 덮인 칸은 생략하므로 행마다 필드 수가 달라질 수 있습니다. 먼저 일부 행을 가져와 제목, 숫자, 단위와 합계가 원하는 열에 놓이는지 검사한 후 계산 작업을 시작하세요.
- 문서 번호나 페이지 머리말이 빠진 이유는 무엇인가요?
- HTML과 TXT는 본문과 주석 중심의 결과이며 반복 머리말과 꼬리말을 포함하지 않습니다. 문서 번호가 그 위치에만 있다면 별도로 참고해야 합니다. 본문 끝에 있는 내용이 빠진 것과 머리말을 출력 범위에서 제외한 것은 다른 상황이므로, 필요한 정보가 원본 어느 영역에 있는지 확인하는 것이 우선입니다.
- HTML을 열면 원본 문서의 스크립트가 실행되나요?
- 이미터는 문서에서 임의의 HTML을 복사하는 대신 이스케이프한 글과 통제된 태그로 새 파일을 작성합니다. 출력에는 스크립트 태그나 외부 리소스를 불러오는 코드가 없습니다. 다만 본문 링크를 사용자가 누르면 다른 주소로 이동하는 별도 탐색이 될 수 있으므로, 문서를 연다는 동작과 링크를 따른다는 동작은 구분해야 합니다.
- 확장자를 바꿨는데도 문서 오류가 계속 나는 이유는요?
- 파일의 실제 내용을 확인하기 때문에 이름만 HWP나 HWPX로 바꿔도 내부 형식이 바뀌지 않습니다. 다운로드 오류로 안내 페이지가 저장됐을 수도 있고, 파일이 온전하지만 보호된 문서일 수도 있습니다. 불완전한 첨부 파일은 출처에서 다시 받고, 제한된 자료는 작성자에게 허용된 내보내기 파일을 요청하는 식으로 원인을 나눠 대응하세요.
HTML을 읽은 다음 인쇄 결과 확인하기
먼저 HTML을 충분한 화면 폭에서 열어 긴 표와 본문이 어떻게 이어지는지 읽어 보세요. 그다음 인쇄 대화상자를 열어 첫 페이지, 표가 있는 중간 페이지, 마지막 주석 구역을 살펴봅니다. 화면에서 잘 보이는 표도 종이 폭에 맞추는 과정에서 줄이 더 감기거나 다른 페이지로 넘어갈 수 있습니다. 용지 방향, 축소 비율, 여백을 바꾸면 미리보기의 페이지 수와 배치도 달라지므로 설정을 바꾼 뒤 다시 확인해야 합니다. 설명을 위한 합성 예로, 신청서의 표 아래에 서명란이 있다고 생각해 보겠습니다. 화면에서는 이어져 있던 서명란이 인쇄에서 다음 장으로 밀리면, 제출처가 원하는 양식과 다를 수 있습니다. 이때 인쇄 설정으로 해결할지 다른 문서 작업 방식을 쓸지 판단해야 합니다. 변환 결과에 인쇄 스타일이 있다는 사실만으로 제출 양식의 쪽 배치가 인증되는 것은 아닙니다. 인쇄물을 전달할 때는 숫자, 날짜, 단위뿐 아니라 표와 주석이 서로 떨어져도 뜻을 이해할 수 있는지 확인하는 것이 좋습니다.
탭 구분 텍스트를 표로 읽는 법
탭은 글자 사이의 구분자이며 원래 셀의 시각적 폭을 저장하는 장치가 아닙니다. 텍스트 편집기의 탭 간격 설정에 따라 같은 줄이 다르게 정렬돼 보일 수 있습니다. 따라서 화면에서 열이 반듯하게 보이는지만으로 표를 판단하지 말고, 각 행에 어떤 항목이 어떤 순서로 있는지 읽어야 합니다. 메모장에서 복사한 텍스트와 표 계산 프로그램에 가져온 결과가 다르면 구분자를 어떻게 해석했는지 먼저 확인하세요. 합성 경비표 예시에서는 항목명이 두 행에 걸쳐 병합되고 각 행에 다른 금액이 있다고 가정할 수 있습니다. TXT에는 항목명이 한 번만 남으므로, 빈 위치를 처리하지 않은 채 열을 지정하면 이름과 금액이 잘못 연결될 수 있습니다. 일부 행부터 시험하고 필드 수를 센 다음 어떤 항목을 반복할지 결정하세요. 원래 설명을 확인할 HTML 사본도 함께 두면 해석을 고칠 때 도움이 됩니다. 숫자를 자동 계산하는 작업에 넣을 경우에는 가져오기 직후 합계와 소수점 표기가 맞는지도 별도로 점검해야 합니다.
순수 텍스트에 남지 않는 정보 찾기
사진으로 붙인 안내문이나 스캔 페이지의 글씨는 파일 내부에서 이미지 픽셀입니다. TXT 출력은 그 픽셀을 문자로 인식하는 OCR을 수행하지 않습니다. 결과에서 제목을 검색할 수 없더라도 원본에 제목이 없는 것이 아니라 그림 속에 있을 가능성이 있습니다. 글이 거의 없는 문서라면 HTML을 먼저 살펴보고, 어떤 정보가 이미지에 들어 있는지 확인하는 순서가 도움이 됩니다. 도표의 의미가 본문에 전부 설명돼 있는지도 중요합니다. 본문이 그림을 보라는 안내만 담고 있다면 추출한 문장만으로 자료의 주장을 파악하기 어렵습니다. 수식은 원래 스크립트 형태의 텍스트로 남을 수 있고, 지원하지 않는 개체에는 자리 표시나 경고가 생길 수 있습니다. 필요한 내용이 이런 부분에 있다면 글 추출 결과를 전체 문서의 완전한 대체물로 쓰지 않아야 합니다. 사람이 이미지에서 읽어 추가한 설명은 원문에서 추출한 글과 구별해 적어 두면 나중에 근거를 대조할 때 혼동을 줄일 수 있습니다.
UTF-8 텍스트를 다시 여는 설정
TXT는 UTF-8로 작성됩니다. 다른 프로그램에서 파일을 열었을 때 한글이 읽을 수 없는 문자로 보이면 그 프로그램이 어떤 문자 인코딩으로 읽고 있는지 확인하세요. 글꼴이 없는 문제와 바이트를 잘못 해석한 문제는 증상이 비슷할 수 있으므로, 원본 파일을 임의로 덮어쓰기 전에 다른 읽기 설정으로 확인하는 것이 좋습니다. 현재 변환에서 CP949 텍스트 출력을 선택하는 기능은 제공하지 않습니다. 줄바꿈과 탭도 프로그램마다 표시 방식이 다릅니다. 긴 문장을 화면 폭에 맞춰 접어 보여 주는 기능은 실제 줄바꿈을 추가하는 것과 다르므로, 보이는 줄 수만 비교하면 결과를 잘못 판단할 수 있습니다. 데이터를 처리하는 프로그램에 전달하려면 실제 줄바꿈과 탭 문자를 기준으로 시험하세요. 파일을 저장하면서 자동으로 문자를 바꾸거나 공백을 정리하는 기능이 켜져 있다면 후속 저장 결과도 확인해야 합니다. 한글이 정상으로 돌아온 뒤에는 숫자와 특수 기호가 함께 맞는지 점검하고, 필요한 경우 변환 직후 파일을 기준 사본으로 남겨 두세요.
그림을 품은 한 파일의 장점과 한계
HTML에 이미지를 넣으면 글 파일과 그림 폴더가 따로 움직여 주소가 끊어지는 상황을 줄일 수 있습니다. 하지만 이미지가 많거나 원본 해상도가 높으면 파일이 커질 수 있고, 이를 여는 기기의 메모리와 처리 시간도 필요합니다. 압축된 원본 문서보다 HTML이 더 크다고 해서 그것만으로 실패라고 판단할 수는 없습니다. 데이터 주소로 기록하는 방식과 원본의 압축 방식이 다르기 때문입니다. 파일을 보관하기 전에 중요한 그림을 직접 살펴보세요. 선이 가늘거나 작은 글씨가 들어 있는 도표는 전체 페이지를 보는 것만으로 상태를 확인하기 어렵습니다. 필요한 부분을 확대해서 범례, 단위, 축 제목이 읽히는지 점검하는 편이 좋습니다. 원본에서 지원하지 않는 이미지 형식이나 외부 연결 그림이 사용됐다면 단일 파일이라는 장점만으로 해당 바이트를 복구할 수 없습니다. HTML의 이미지 표시와 변환 요약을 함께 보고, 의미가 빠진 곳이 있으면 다른 자료를 확보할지 판단하세요. 이미지를 따로 편집하려는 목적이라면 이 출력이 가장 편한 작업 형식인지도 다시 생각해 볼 수 있습니다.
읽기 순서가 중요한 문서 점검
두 단으로 작성한 보고서나 글상자가 여러 곳에 배치된 양식은 한 줄씩 읽을 때와 페이지 전체를 볼 때 전달 방식이 다릅니다. HTML로 이어 쓴 내용에서 제목과 설명, 표와 캡션이 적절하게 연결되는지 확인하세요. 시각적으로 옆에 놓였던 문장이 뒤쪽으로 이동하면 글 자체가 남아 있어도 처음 읽는 사람에게 관계가 불분명할 수 있습니다. 이러한 경우에는 원본의 배치를 보면서 어떤 순서가 자연스러운지 판단해야 합니다. 합성 안내 자료를 예로 들면, 왼쪽 단에는 지원 조건이 있고 오른쪽 글상자에는 예외가 적혀 있을 수 있습니다. 조건 문단만 읽고 끝내지 말고 예외 문구가 결과 어디에 놓였는지 찾아보세요. 본문 시작과 끝의 특징적인 문장을 검색하면 일부 구간이 남았는지 확인하는 데 도움이 되지만, 문서 전체의 논리를 검사하는 일까지 대신하지는 않습니다. 다른 사람에게 읽기 사본을 줄 때는 원래의 쪽 번호가 없어도 필요한 조항을 찾을 수 있는지 생각해 보세요. 중요한 인용에는 제목이나 조항 이름을 함께 적어 두는 방법도 있습니다.
저장한 사본과 원본의 역할 구분
읽기 쉽게 만든 HTML과 데이터 정리용 TXT는 원본과 목적이 다릅니다. 계약 문서, 서명 있는 양식, 제출용 첨부 자료라면 원본이 필요한 상황과 내용만 확인할 상황을 나누어 생각해야 합니다. 파일의 확장자를 바꿨다는 사실이 원본의 서명이나 진위를 새 형식으로 이전하지는 않습니다. 변환한 내용을 수정했다면 수정된 사본을 원본처럼 취급하지 않도록 자신의 보관 규칙에 맞는 이름과 위치를 정하세요. 예를 들어 문서 제목에 날짜가 있고 다운로드한 날짜도 따로 있다면, 두 날짜 중 무엇을 파일 이름에 넣을지 의미를 분명히 하는 것이 좋습니다. 변환기는 사용자가 어느 날짜를 기록 기준으로 삼아야 하는지 판단하지 않습니다. 추후 재확인이 필요하면 원본 파일명과 관련 절을 자신의 기록에 남겨 둘 수 있습니다. 삭제나 덮어쓰기는 읽기 사본이 준비됐다는 사실과 별개의 결정이며, 검토가 끝나기 전에 원본을 치울 이유는 없습니다. 자료를 다시 열었을 때 출처와 수정 여부를 알 수 있는지가 관리의 핵심입니다.
로컬 변환과 문서 링크 탐색 구별
문서를 선택한 뒤 변환하는 작업에서는 파일이 서버로 올라가지 않습니다. 내려받은 HTML에는 스크립트나 외부 리소스 로딩이 없지만, 본문에 포함된 웹 주소를 누르는 것은 사용자가 선택하는 새 탐색일 수 있습니다. 문서를 읽는 과정에서 보이는 주소가 믿을 만한지, 로그인이나 추가 다운로드를 요구하는지 직접 판단해야 합니다. 문서에 적혀 있다는 이유로 주소의 소유자나 내용을 이 도구가 보증하는 것은 아닙니다. 결과를 메일이나 저장 서비스로 보내는 행동도 변환과는 다른 단계입니다. 로컬 처리라는 특성은 생성된 사본의 공유 범위를 자동으로 정해 주지 않습니다. 전달 전에 개인정보나 내부 자료가 포함됐는지 확인하고, 필요한 범위에 맞게 준비한 다음 자신의 공유 도구를 사용하세요. 받는 사람이 사용할 환경을 알고 있다면 HTML 한 건을 시험해 보는 것도 도움이 됩니다. 특히 그림이 많은 사본은 전송 가능한 용량과 실제 열기 성능을 확인해야 하며, 여기서 파일이 생성됐다는 사실만으로 다른 서비스의 제한까지 통과하는 것은 아닙니다.
검사 수치를 자기 자료에 적용하는 방법
현재 텍스트 코퍼스 검사는 지원 샘플 41건에 대해 HTML 본문과 같은 문서 모델에서 만든 TXT를 대조합니다. 함께 검사하는 항목에는 HTML의 문법 형태와 반복 출력의 결정성도 있습니다. 이 수치는 새 변경이 기존 결과를 망가뜨렸는지 찾는 근거로 사용하지만, 모든 브라우저의 인쇄 결과나 모든 HWP 문서의 원래 배치를 확인했다는 뜻은 아닙니다. 검사 범위와 자신이 필요한 품질 기준을 나눠 이해하는 것이 중요합니다. 자신의 자료를 확인할 때에는 제출 목적이나 업무 목적에 맞는 항목을 먼저 고르세요. 공지문이라면 기한과 연락처, 통계표라면 단위와 주석, 신청서라면 입력란과 서명 위치가 중요할 수 있습니다. 결과 파일의 앞부분만 보고 판단하지 말고 핵심 표와 마지막 절도 확인하는 편이 좋습니다. 경고를 발견했다면 그 항목이 실제 내용 이해에 영향을 주는지 원본과 대조하세요. 동작 검사가 통과한 사본과 사람이 업무에 사용해도 된다고 확인한 사본은 다른 단계의 결과이므로, 필요한 검토를 마친 뒤 전달하거나 계산에 활용하세요.
다른 방법과 출력 선택
웹페이지 안에서 잠깐 읽기만 하면 뷰어를 사용할 수 있고, 가벼운 표식으로 글을 다시 구성하려면 마크다운을 검토할 수 있습니다. 여기서는 그림을 포함한 읽기 사본을 한 파일로 둘 때 HTML, 글만 뽑아 찾아보거나 정리할 때 TXT를 선택합니다. 출력의 목적이 다른 만큼 결과를 검사하는 기준도 각각 정하는 것이 좋습니다.