푸터 콘텐츠로 바로가기
.NET 도움말

C# BackgroundWorker (개발자를 위한 동작 방식)

Iron Software 팀에 의해 작성됨

pdf를 google doc 형식으로 변환하는 방법을 아는 것은 필요할 때 실시간으로 절약할 수 있는 스킬 중 하나입니다. google docs에서 pdf 파일을 열면 설치할 필요 없이 편집하고, 주석을 달고, 공유하고, 협업할 수 있는 문서로 변환됩니다. 변환 프로세스는 광학 문자 인식에 의존하며, 이는 pdf의 텍스트 레이어를 읽고 새 문서 내부에 편집 가능한 텍스트로 재생성합니다. 결과가 항상 완벽한 것은 아니지만, 대부분의 텍스트 중심 보고서, 편지, 양식에서는 충분히 유용합니다.

사람들이 가장 자주 마주치는 도전은 서식 손실입니다. pdf 내용을 google doc으로 변환할 때, 글꼴이 기본값으로 돌아가거나, 표가 깨진 표로 변환되거나, 단락이 제자리에서 벗어날 수 있습니다. PDF를 Google Docs로 변환할 때 서식 문제가 흔하며, 종종 글꼴이 기본값으로 돌아가고, 표 정렬이 잘못되고, 단락 간격이 불일치하는 결과를 초래합니다. 이유를 이해하면 특정 파일에 적합한 방법을 선택하고, 전용 도구가 필요할 때를 알 수 있습니다.

이 가이드에서는 작업을 수행하기 위한 네 가지 방법을 다룹니다: 신속한 브라우저 내 변환을 위해 google drive에 직접 업로드, 온라인에서 공유된 파일을 열 수 있는 pdf 링크 사용, 웹에서 사용할 수 있는 무료 변환 도구 사용, Word 문서를 중간 단계로 변환. 여러 파일에 걸쳐 스케일의 작업을 처리해야 하는 개발자에게는, IronPDF는 프로그래밍 방식으로 모든 pdf 파일에서 텍스트와 콘텐츠를 추출할 수 있는 .NET 라이브러리입니다.

방법 1: Google Drive에 업로드하고 Google Doc으로 열기

이것은 가장 직접적인 경로이며, 완전히 브라우저 내에서 작동합니다. Google Drive는 내장된 광학 문자 인식 (OCR) 소프트웨어를 사용하여 pdf 파일을 편집 가능한 google doc으로 변환할 수 있습니다. 이는 플랫폼이 제공하는 가장 유용한 내장 기능 중 하나입니다. 타사 앱이나 변환 도구가 필요하지 않습니다.

단계별 간단한 프로세스는 다음과 같습니다:

  1. Google Drive를 열고 google 계정에 로그인합니다.
  2. 새로 만들기를 클릭한 다음 파일 업로드를 클릭하거나 pdf를 드라이브 창에 직접 드래그 앤 드롭합니다.
  3. 파일 업로드가 완료될 때까지 기다립니다. 원본 pdf는 드라이브에 그대로 유지됩니다.
  4. 업로드가 완료되면 드라이브에서 파일을 오른쪽 클릭하고 'Google Docs로 열기'를 선택합니다.
  5. Google Drive는 변환 후 원본 PDF는 그대로 두고 새 google doc 복사본을 생성합니다. 이는 원본 파일이 안전하다는 것을 의미합니다. 전 세계의 전문가들은 마스터 복사본을 손대지 않는 이 동작에 의존합니다.
  6. 변환된 google doc은 새 탭에서 열리며 편집할 준비가 되어 있습니다.

변환이 Google Drive에서 작동하려면 pdf 파일이 2MB 이하이어야 합니다. 파일이 이 제한을 초과하는 경우 업로드 전에 파일을 나누거나 압축하는 것을 고려하세요.

텍스트 중심 PDF는 높은 정확도로 변환됩니다, 그러나 복잡한 그래픽은 변환 중에 원본 형식을 잃을 수 있습니다. 이미지는 변환 중에 유지되지만 다른 페이지나 섹션으로 이동할 수 있으므로, 편집을 시작하기 전에 출력을 신중히 검토하세요.

이 방법을 사용하여 pdf를 google doc으로 완전히 변환할 수 있으며, 편지, 보고서 및 간단한 양식과 같은 기본 텍스트 PDF에 적합한 옵션입니다.

How To Turn Pdf Into Google Doc 1 related to 방법 1: Google Drive에 업로드하고 Google Doc으로 열기

방법 2: 공유 링크에서 PDF 열기

누군가가 파일 첨부 대신 pdf 링크를 보냈다면, 파일을 기기에 먼저 다운로드하지 않고도 google docs로 가져올 수 있습니다.

다음 단계를 따르세요:

  1. 공유 링크를 사용하여 브라우저에서 PDF를 엽니다.
  2. Google Drive의 PDF 뷰어 내부에서 열리면, 페이지 상단의 Google Docs로 열기 버튼을 찾으세요.
  3. 클릭하면 변환 프로세스가 자동으로 시작됩니다.
  4. 링크가 Adobe Acrobat 뷰어 또는 다른 브라우저 플러그인 내부에서 파일을 열면, 먼저 기기에 파일을 다운로드한 다음 Drive에 업로드하여 문서로 열 수 있는 방법 1을 따르세요.
  5. 브라우저의 PDF 뷰어에서 파일 > Google Drive에 저장으로 이동하여 파일을 직접 Drive로 보내 수동 다운로드 단계를 건너뛸 수도 있습니다.
  6. 드라이브에 도착하면 파일을 오른쪽 클릭하고, Google Docs로 열기를 선택한 다음 변환 버튼을 눌러 진행합니다.

변환 결과를 향상시키기 위해, 업로드 전에 PDF가 고대비 텍스트와 깨끗한 형식을 포함해야 합니다. 공유된 파일이 텍스트 기반 PDF가 아닌 스캔한 이미지인 경우, OCR 엔진은 더 많은 작업이 필요하며 정확도가 낮아질 수 있습니다.

How To Turn Pdf Into Google Doc 2 related to 방법 2: 공유 링크에서 PDF 열기

방법 3: 온라인 무료 변환 도구 사용

Google Drive가 충분히 깨끗한 결과를 내지 않는 경우, 다른 앱 및 온라인 변환기가 테이블, 이미지 및 사용자 지정 글꼴이 포함된 파일에 대해 더 나은 작업을 수행하는 경우가 많습니다. pdf를 google docs로 변환하는 데 추가 제어를 제공하는 여러 무료 pdf 변환기 웹사이트가 있습니다.

인기 있는 무료 변환 도구로는 Smallpdf, ILovePDF 및 PDF2Doc이 있습니다. 일반적인 프로세스는 다음과 같이 작동합니다:

  1. 선택한 변환기 웹사이트를 엽니다.
  2. 업로드 버튼을 사용하여 pdf 파일을 업로드하거나, 페이지의 드롭 영역에 드래그 앤 드롭합니다.
  3. 일부 도구는 기기에서 업로드하지 않고도 URL을 사용하여 pdf에 직접 연결할 수 있습니다.
  4. 도구는 파일을 워드 문서 (.docx) 또는 Google Doc 형식으로 직접 변환합니다.
  5. 도구가 완료되면 변환된 파일을 다운로드하세요.
  6. .docx 파일을 받은 경우, Google Drive를 열고 변환된 워드 파일을 업로드한 다음 오른쪽 클릭하여 Google Doc으로 엽니다.
  7. 거기서 파일을 doc 형식으로 드라이브에 저장할 수 있습니다.

서드파티 도구를 사용할 때 보안에 주의하세요. 민감한 파일은 외부 서버에 업로드하지 마세요. 비밀 문서의 경우, 방법 1 또는 이 가이드에서 후술된 개발자 접근 방식이 더 안전한 옵션입니다.

이 도구들은 일반적으로 깨끗한 문서에서는 단락, 요소 및 전체 레이아웃을 잘 보존합니다. 변환 중 서식 문제를 최소화하려면 깨끗하고 잘 구조화된 PDF로 시작하고 복잡한 디자인이나 다중 열 레이아웃을 피하는 것이 좋습니다.

방법 4: 워드 문서를 통해 변환

Microsoft Word에 액세스할 수 있을 때, 또는 콘텐츠를 Google Docs로 가져오기 전에 중간 단계로 변환된 워드 파일이 필요할 때 이 방법이 유용한 해결책입니다. 복잡한 레이아웃 파일의 경우, 직접 pdf에서 google doc으로 변환하는 것보다 더 깨끗한 결과를 생성할 수 있습니다.

  1. Adobe Acrobat Reader 또는 Microsoft Word에서 직접 pdf를 엽니다. Word 2013 이상 버전은 PDF 파일을 열고 자동으로 변환할 수 있습니다.
  2. Word는 pdf를 편집 가능한 워드 문서로 변환합니다. 출력을 검토하고 이 단계에서 명백한 서식 문제를 수정하세요.
  3. .docx 파일로 기기에 저장하거나 나중에 쉽게 액세스할 수 있도록 dropbox에 저장하세요.
  4. Google drive을 열고 .docx 파일을 업로드합니다.
  5. 업로드된 파일을 오른쪽 클릭하고 Google Docs로 열기를 선택합니다. Drive는 워드 파일을 Google Doc으로 자동으로 변환합니다.
  6. 이제 공유하고 협업할 준비가 된 완전히 편집 가능한 변환된 google doc을 보유하고 있습니다.

전용 PDF 편집기를 사용하여 Google Docs로 변환하는 대신 수정하면 레이아웃을 변경하지 않으므로 서식 문제를 피하는 데 도움이 될 수 있습니다. 그러나 콘텐츠를 실시간 협업을 위해 Google Docs에 가져오는 것이 목표라면, Word를 통해 이 2단계 방법이 PDF에서 바로 가져오는 것보다 더 깨끗한 결과를 낳는 경우가 많습니다.

일반적인 문제 및 문제 해결

변환 후 글꼴이 잘못 보입니다. 이는 예상된 동작입니다. 변환 엔진은 PDF 글꼴을 가장 가까운 google docs 등가물과 매핑하며, 이는 거의 동일하지 않습니다. 변환된 google doc을 연 후 모든 텍스트를 선택하고 (Ctrl+A) 툴바에서 일관된 글꼴을 적용하여 일관된 모양을 복원하세요.

테이블이 깨졌거나 위치가 잘못되었습니다. 깨진 테이블은 pdf에서 google docs로의 변환에서 가장 흔한 불만 중 하나입니다. 테이블이 실제 테이블 구조가 아니라 선으로 생성된 경우, OCR 엔진은 이를 일반 텍스트로 읽을 수 있습니다. 변환 후 깨진 레이아웃을 삭제하고 Google Docs의 삽입 메뉴를 사용하여 테이블을 다시 만들고 텍스트 값을 다시 붙여넣으세요. 테이블 구조가 설정되면 열 너비와 셀 스타일을 자유롭게 수정할 수 있습니다.

이미지가 없거나 잘못된 위치에 있습니다. 이미지는 변환 중에 유지되지만 다른 페이지나 섹션으로 이동할 수 있습니다. 변환된 google doc의 각 페이지를 확인하고 이미지를 원래 위치로 드래그하세요. jpg 또는 다른 임베디드 이미지가 완전히 사라지는 경우, 원본 pdf로 돌아가 이미지를 수동으로 추출한 다음 삽입 > 이미지로 doc에 다시 삽입하세요.

파일이 너무 커서 업로드할 수 없습니다. 변환이 Google Drive에서 작동하려면 pdf 파일이 2MB 이하이어야 합니다. 더 큰 파일을 이 제한 이하로 가져오기 위해 Smallpdf와 같은 PDF 압축 도구 또는 Adobe의 온라인 압축기를 사용하여 파일 업로드를 다시 시도하세요.

OCR이 깨진 텍스트를 반환합니다. 출력이 무작위 문자처럼 보인다면, 원본 pdf가 텍스트 기반 파일이 아닌 스캔된 이미지일 수 있습니다. 이 경우, 광학 문자 인식이 모든 작업을 수행하며 품질은 전적으로 스캔 해상도에 달려 있습니다. 더 나은 결과를 얻기 위해, 더 높은 해상도의 스캔 버전을 업로드하거나 Adobe Acrobat과 같은 전용 OCR 앱을 사용하세요. 이는 Google Drive보다 더 강력한 OCR 엔진을 가지고 있습니다.

변환 시간이 오래 걸립니다. 대형 파일의 경우, Drive가 과부하 중이거나 파일이 이미지가 많은 경우 몇 시간이 걸릴 수 있습니다. 몇 시간 후에도 완료되지 않았으면 다운로드 및 재업로드를 시도하거나 대안 솔루션으로 온라인 무료 변환 도구 중 하나를 시도하세요.

보안을 유지하며 편집해야 합니다. 문서에 민감한 데이터가 포함되어 있으면, 타사 서버에 업로드하면 보안 문제가 발생할 수 있습니다. 그 경우, 완전히 자체 인프라에서 파일을 처리하는 Microsoft Word 또는 .NET 라이브러리와 같은 로컬 도구를 사용하세요. 전용 PDF 편집기를 사용하면 PDF를 Google Doc으로 변환하는 것보다 더 빠르고 정확할 수 있습니다. 이는 변환 중에 종종 발생하는 레이아웃 문제를 피할 수 있습니다.

빠른 참고: PDF에서 Google Doc로의 방법 비교

방법 최적 대상 서식 보존 속도 비용
Google Drive 업로드 간단한 텍스트 PDF 보통 빠름 무료
PDF 링크에서 열기 공유 파일, 다운로드 없음 보통 빠름 무료
온라인 변환 도구 복잡한 레이아웃, 테이블 더 나은 중간 무료 / 유료
Word 문서를 경유 복잡한 서식, 오피스 사용자 최고 느린 Word 필요

개발자용: IronPDF로 프로그래밍 방식으로 PDF 콘텐츠 추출하기

브라우저를 통해 pdf를 google doc으로 변환하는 것은 일회성 작업에 적합하지만, 워크플로가 수백 개의 파일을 자동으로 처리하는 것을 수반하는 경우 수동 변환 작업은 실용적이지 않습니다. IronPDF는 브라우저나 수동 단계 없이 PDF 콘텐츠에 대한 전체 프로그래밍 제어를 제공하는 C# .NET 라이브러리입니다.

IronPDF를 사용하면 몇 줄의 코드로 pdf 파일에서 모든 편집 가능한 텍스트를 추출할 수 있습니다. 이 라이브러리는 모든 PDF의 텍스트 레이어를 직접 읽어, 다운스트림 문서 파이프라인, 데이터베이스 또는 API에 콘텐츠를 공급하기에 이상적입니다. 스캔된 PDF의 경우, IronPDF와 IronOCR를 결합하면 완전한 광학 문자 인식 지원을 추가로 제공하여 이미지 기반 파일을 동일하게 처리합니다.

아래 예제는 PDF 보고서를 로드하고, 전체 문서에서 모든 텍스트를 추출하고, 페이지별 처리가 필요한 경우 페이지별로 텍스트를 추출합니다:

using IronPdf;

// Load the PDF file
PdfDocument pdf = PdfDocument.FromFile("sample_report.pdf");

// Extract all text from the entire document
string allText = pdf.ExtractAllText();
Console.WriteLine("Full document text:");
Console.WriteLine(allText);

// Extract text page by page for granular processing
for (int i = 0; i < pdf.PageCount; i++)
{
    string pageText = pdf.ExtractTextFromPage(i);
    Console.WriteLine($"--- Page {i + 1} ---");
    Console.WriteLine(pageText);
}

// Extract all images from the PDF
var images = pdf.ExtractAllImages();
Console.WriteLine($"Images found: {images.Count()}");
using IronPdf;

// Load the PDF file
PdfDocument pdf = PdfDocument.FromFile("sample_report.pdf");

// Extract all text from the entire document
string allText = pdf.ExtractAllText();
Console.WriteLine("Full document text:");
Console.WriteLine(allText);

// Extract text page by page for granular processing
for (int i = 0; i < pdf.PageCount; i++)
{
    string pageText = pdf.ExtractTextFromPage(i);
    Console.WriteLine($"--- Page {i + 1} ---");
    Console.WriteLine(pageText);
}

// Extract all images from the PDF
var images = pdf.ExtractAllImages();
Console.WriteLine($"Images found: {images.Count()}");
Imports IronPdf

' Load the PDF file
Dim pdf As PdfDocument = PdfDocument.FromFile("sample_report.pdf")

' Extract all text from the entire document
Dim allText As String = pdf.ExtractAllText()
Console.WriteLine("Full document text:")
Console.WriteLine(allText)

' Extract text page by page for granular processing
For i As Integer = 0 To pdf.PageCount - 1
    Dim pageText As String = pdf.ExtractTextFromPage(i)
    Console.WriteLine($"--- Page {i + 1} ---")
    Console.WriteLine(pageText)
Next

' Extract all images from the PDF
Dim images = pdf.ExtractAllImages()
Console.WriteLine($"Images found: {images.Count()}")
$vbLabelText   $csharpLabel

NuGet을 통해 Visual Studio에 IronPDF를 설치:


PM> Install-Package IronPdf

무료 체험을 시작하여 자신의 프로젝트에서 전체 기능 세트를 탐색하세요. 신용 카드가 필요하지 않습니다.

추가 읽기:

마무리

적절한 방법을 선택하는 것은 pdf의 내용과 그것을 가지고 무엇을 하려는지에 달려 있습니다. 이 가이드의 방법은 간단한 브라우저 업로드부터 전체의 출력을 제어할 수 있는 워드 문서를 거치는 다단계 경로까지, 일상적인 작업에서 마주하게 될 가장 일반적인 시나리오를 다룹니다. 간단한 보고서나 편지의 경우 Google Drive 파일 업로드 경로를 통해 1분 이내에 편집 가능한 문서로 이동할 수 있습니다. 복잡한 테이블, 이미지 또는 특이한 글꼴이 있는 파일의 경우, 워드 문서를 거치거나 온라인 변환 도구를 사용하는 것이 더 깨끗한 출력을 생성하는 경향이 있습니다. 2MB 제한을 염두에 두고, 서식 문제를 피하기 위해 깨끗하고 잘 구조화된 파일로 시작하고, 다른 사람과 공유하기 전에 변환된 google doc을 항상 검토하세요.

작업이 단일 파일을 넘어가거나, 브라우저에서 편집하는 것 외에 응용 프로그램에 처리된 콘텐츠를 게시해야 할 때 IronPDF는 .NET 개발자에게 프로그래밍 방식으로 PDF 콘텐츠를 추출하고 작업할 수 있는 빠르고 신뢰할 수 있는 방법을 제공합니다. 무료 체험을 다운로드하여 수동 변환 프로세스를 얼마나 자동화할 수 있는지 확인하세요.

Curtis Chau
기술 문서 작성자

커티스 차우는 칼턴 대학교에서 컴퓨터 과학 학사 학위를 취득했으며, Node.js, TypeScript, JavaScript, React를 전문으로 하는 프론트엔드 개발자입니다. 직관적이고 미적으로 뛰어난 사용자 인터페이스를 만드는 데 열정을 가진 그는 최신 프레임워크를 활용하고, 잘 구성되고 시각적으로 매력적인 매뉴얼을 제작하는 것을 즐깁니다.

커티스는 개발 분야 외에도 사물 인터넷(IoT)에 깊은 관심을 가지고 있으며, 하드웨어와 소프트웨어를 통합하는 혁신적인 방법을 연구합니다. 여가 시간에는 게임을 즐기거나 디스코드 봇을 만들면서 기술에 대한 애정과 창의성을 결합합니다.

아이언 서포트 팀

저희는 주 5일, 24시간 온라인으로 운영합니다.
채팅
이메일
전화해