pdf문서를 word에서 열어 보니 한글이 깨져 나옵니다.

익명
2015-05-12T08:55:25+00:00

pdf문서를 office word에서 열어서 확인해볼려고 하니 다음과 같이 글씨가 깨져서 나옵니다.

word상에서 문제 해결 방법이 있는지 궁금합니다.

  1. word에서 열어본 문서

  1. pdf에서 열어본 문서
  2. pdf문서 속성
  3. pdf 포함 글씨체 목록

참고로 C# winform에서 워드를 열어서 pdf를 불러들인 후 내용을 얻어오는 작업을 하고 있었습니다. 

특정 문서들만 저런 현상이 나와서 문의를 합니다.

워드에서는 위와 같이 깨진 문자열이라도 나오지만

워드를 제외한 다른 라이브러리에서는 아예 공란이 나옵니다.

그리고 pdf뷰어에서는 ㅁㅁㅁㅁㅁ으로 글씨가 나옵니다.

해결방법을 알려주시면 감사하겠습니다.

Microsoft 365 및 Office | Word | 가정용 | Windows

잠긴 질문. 이 질문은 Microsoft 지원 커뮤니티에서 마이그레이션되었습니다. 질문이 도움이 되었는지 여부에 대해 응답할 수는 있지만, 메모나 회신을 추가하거나 질문을 따를 수는 없습니다.

댓글 0개 설명 없음

질문 작성자가 수락한 답변

익명
2015-05-13T00:33:58+00:00

안녕하십니까? SeongKwangJeong 님

Microsoft Community 사이트를 방문해 주셔서 감사합니다.

문의 하신 Word에서 PDF 문서 편집에 대해 안내를 드리겠습니다.

말씀해 주신 PDF 문서라면 굳이 Word 프로그램에서 수정하려는 이유가 따로 있는 것인가요?

PDF 문서라면 Adobe Acrobat 프로그램이나 PDF 전용 프로그램으로 수정하여 사용하는 것이 맞습니다. Word 프로그램에서도 호환성의 이유로 일부 PDF 문서들이 열릴 수는 있지만, PDF 개체 표현이라던지 PDF 문서의 버전/형식에 따라서 읽어들이지 못하는 문서들이 대부분입니다. 굳이 Word 프로그램이 아니라 PDF 프로그램에서 사용하시기 바랍니다.

추가적인 내용이 있다면 하단의 [응답] 버튼을 눌러 회신해주시기 바랍니다.

제시해 드린 답변이 도움이 되었기를 바랍니다.

응답이 문제 해결에 도움이 되었다면, 아래에 있는 답변으로 [표시] 버튼을 눌러 주시기 바랍니다. 이는 유사한 증상을 겪는 다른 사용자들에게 도움이 될 수 있습니다.

감사합니다.

이 대답이 도움이 되었나요?

2명이 이 답변이 도움이 된다고 생각했습니다.
댓글 0개 설명 없음

4 추가 답변

정렬 기준: 가장 유용함
  1. 익명
    2015-05-15T01:38:56+00:00

    직접 PDF문서 내부를 분석해서 프로그램으로 짜봤는데요

    PDF문자열 부분이 압축형태로 PDF의 폰트부분의 글씨목록중 key값의 목록들로 이루어져 있어요 

    근데 PDF의 폰트들 중에서 그림목록으로 되어져 있는게 있어요. 복사가 안되는 부분을 이루는 문자열들이 그림 글씨체의 key값에 해당하는 그림을 얻어와서 pdf뷰어가 뿌려주네요

    그래서 복사가 안되는거구요

    pdf를 분석하는 오픈소스 프로그램이랑 라이브러리들을 통해서 분석했어요.

    더 자세한 부분은 제 블로그에 정리 해두었어요

    http://blog.naver.com/ene12/220360096013

    이 대답이 도움이 되었나요?

    1명이 이 답변이 도움이 된다고 생각했습니다.
    댓글 0개 설명 없음
  2. 익명
    2015-05-15T04:40:03+00:00

    앞서 안내해 드린 내용처럼 개발이나 소스에 대한 분석이 필요하다면 MSDN에서 도움을 받아 보시기 바랍니다. (도움을 드릴 수 있는 프로그래밍적인 지식이 없기 때문에 해당 포럼에서는 어려울 것으로 예상이 됩니다.)

    감사합니다.

    이 대답이 도움이 되었나요?

    댓글 0개 설명 없음
  3. 익명
    2015-05-13T01:34:35+00:00

    말씀해 주신 내용(Microsoft.Office.Interop.Word.dll)이라면 "개발"에 대한 도움이 필요할 것으로 예상이 됩니다. (기본 기능이 아니라 새로운 기능을 만드는 것이라면)

    이런 문제의 경우 해당 포럼이 아니라 MSDN 개발자 포럼에 문의하여 도움을 받아 보시기 바랍니다.

    http://msdn.microsoft.com/ko-kr/office/

    http://social.msdn.microsoft.com/Forums/vstudio/ko-KR/home?forum=visualbasicko

    이 대답이 도움이 되었나요?

    댓글 0개 설명 없음
  4. 익명
    2015-05-13T01:00:25+00:00

    답변을 주셔서 감사합니다. 

    호환성의 문제일거라고 생각되어서  Adobe Acrobat 라든지

    저 문서를 제공한 업체에서 변환 시킨 PDF 뷰어 또는 외국, 국내 PDF 오픈소스 프로그램들에서 테스트를 해보았습니다.

    일단 질문한 목적은 단지 PDF를 워드로 열어서 수정이나 보기 위해서가 아니라

    C#을 이용한 프로그램에서 PDF의 내용을 얻어와 데이터를 가공하기 위한 목적입니다.

    그래서 Microsoft.Office.Interop.Word.dll를 이용해 PDF 문서를 워드로 열어서 내용을 얻어오는 작업을 하는 도중에 위와 같은 현상이 나타나 질문 합니다.

    다른 PDF문서들에서는 ㅁㅁㅁ로 나타날 뿐만 아니라 

    다른 오픈소스 프로그램을 디버깅해서 문서를 스트림으로 읽어와서 보았지만 내용이 빈 내용입니다.

    근데 word에서는 깨진 문자열이라도 나오는걸 보니 설정이나 얻어올 방법이 있을거라고 생각되어서 질문합니다.

    이 대답이 도움이 되었나요?

    댓글 0개 설명 없음