HTML 및 원격 PDF 문서 처리 - n8n 워크플로우

n8n 노드와 CustomJS API를 활용하여 HTML 콘텐츠를 PDF로 변환하고, 로컬 및 원격 PDF 문서에서 텍스트를 정확하게 추출하는 강력한 n8n 워크플로우입니다.

워크플로우 미리보기

자동화할 준비가 되셨나요?

이 n8n 워크플로우 템플릿을 다운로드하고 즉시 사용을 시작하세요.

추천 대상

문서 생성 및 텍스트 추출을 처리해야 하는 자동화 전문가
고급 PDF 처리 n8n 템플릿을 찾는 개발자
특정 n8n 노드 사용 예시를 확인하려는 CustomJS API 사용자
n8n 자동화 내에서 PDF 문서의 정적 정보를 구문 분석할 안정적인 방법을 모색하는 모든 사용자

개요

비즈니스 자동화에서 PDF 문서를 처리하는 것은 매우 일반적인 요구 사항이지만, 종종 전문 도구가 필요합니다. 이 포괄적인 n8n 워크플로우는 두 가지 일반적인 문제를 해결합니다. 바로 임의의 HTML 콘텐츠를 휴대용 PDF 문서로 변환하는 것과, 새로 생성된 PDF 및 외부에 호스팅된 기존 파일(URL을 통해)에서 유용한 텍스트 데이터를 추출하는 것입니다. 이 n8n 템플릿은 원활한 문서 처리를 위해 전문화된 n8n 노드 기능(CustomJS PDF Toolkit)을 활용합니다. 이 n8n 워크플로우를 사용하면 문서 보관, 웹 콘텐츠 캡처, 복잡한 PDF 형식의 데이터 수집과 같은 프로세스를 간소화할 수 있는 기능을 갖추게 됩니다.

작동 방식

이 n8n 워크플로우는 간단한 수동 트리거로 시작하여, 사용자가 '워크플로우 테스트'를 클릭하여 프로세스를 쉽게 시작할 수 있도록 합니다. 핵심 로직은 즉시 두 개의 뚜렷한 병렬 경로로 분기되어 전문화된 PDF n8n 노드의 다양한 사용 사례를 시연합니다.


  1. 경로 1: 동적 HTML 변환 및 추출

플로우는 'HTML to PDF' n8n 노드로 이동하여 정적 HTML 입력(

Hello World

)을 받아 PDF 바이너리 객체로 변환합니다. 이는 CustomJS API 자격 증명을 사용합니다.
결과로 생성된 PDF 바이너리는 첫 번째 'Convert PDF into Text' n8n 노드로 전달됩니다. 이 노드는 파일 바이너리를 직접 처리하여 텍스트를 추출하며, HTML이 성공적으로 변환되어 n8n 워크플로우에서 읽을 수 있게 되었음을 확인합니다.


  1. 경로 2: 원격 PDF URL 추출

병렬 경로는 'Code' n8n 노드로 시작합니다. 이 노드는 n8n 워크플로우에 필요한 외부 PDF 데이터 소스를 시뮬레이션하기 위해 원격 PDF URL 입력을 정의하는 데 사용됩니다.
그런 다음 데이터(URL 경로)가 'Convert PDF into Text1' n8n 노드로 전송됩니다. 이 강력한 n8n 노드는 제공된 URL에서 PDF를 검색하도록 구성되어 있어 파일을 수동으로 다운로드할 필요가 없습니다. 그런 다음 원격 문서에서 직접 텍스트 추출을 수행합니다.

설치 가이드

이 n8n 워크플로우 템플릿을 설치하고 잠재력을 최대한 활용하려면 다음 단계를 따르십시오.


  1. Custom N8N 노드 설치: 이 n8n 워크플로우는 타사 패키지에 의존합니다. 먼저 n8n 인스턴스에 @custom-js/n8n-nodes-pdf-toolkit 패키지를 설치해야 합니다.

  2. n8n 워크플로우 가져오기: 제공된 JSON 데이터를 복사합니다. n8n 인터페이스에서 'Workflows'로 이동하여 'New'를 클릭하고 'Import from JSON'을 선택합니다.

  3. 자격 증명 설정: 'HTML to PDF' 및 'Convert PDF into Text' n8n 노드 인스턴스 모두 'CustomJS API' 자격 증명이 필요합니다. 적절한 API 키 및 서비스 세부 정보로 연결이 설정되었는지 확인하십시오. 이러한 자격 증명이 없으면 n8n 워크플로우가 실패합니다.

  4. n8n 트리거 테스트: 'When clicking ‘Test workflow’' n8n 트리거 노드를 클릭하고 워크플로우를 한 번 실행하여 두 병렬 추출 경로가 성공적으로 실행되고 추출된 텍스트 데이터를 반환하는지 확인하십시오.

노드 상세 정보

'When clicking ‘Test workflow’ (수동 트리거): 이 데모 n8n 워크플로우의 초기 n8n 트리거 지점입니다. 두 문서 처리 경로를 동시에 시작합니다.
HTML to PDF: CustomJS API를 사용하여 HTML 코드 문자열(

Hello World

)을 PDF 파일 바이너리로 변환하는 전문 n8n 노드이며, 이후 다운스트림 n8n 노드에서 사용할 수 있게 됩니다.
Convert PDF into Text: PdfToText n8n 노드의 이 인스턴스는 이전 'HTML to PDF' 단계의 바이너리 출력을 받아 모든 일반 텍스트 콘텐츠를 추출하도록 구성됩니다. 이 n8n 워크플로우 내에서 생성된 내부 데이터를 처리합니다.
Code: 이 n8n 노드는 외부 PDF 문서의 URL 경로가 포함된 JSON 페이로드를 생성하는 동적 입력 생성기 역할을 합니다. 후속 n8n 노드에 필요한 입력을 준비합니다.

  • Convert PDF into Text1: PdfToText n8n 노드의 이 두 번째 인스턴스는 'url' 리소스를 사용하도록 구성됩니다. 지정된 경로(={{ $json.path }})에 있는 PDF 파일을 동적으로 가져와 원격 소스에서 직접 텍스트 정보를 추출합니다. 이는 n8n 워크플로우 설계의 유연성을 보여줍니다.

관련 n8n 워크플로우

무료

노드: 4 노드
업데이트됨: 12월 26 2025
모두 보기
작성자

추천*