메인 콘텐츠로 건너뛰기
Renamed.to logorenamed.to
PDF Split API

다음을 사용해 PDF를 분할하세요 자연어 지시

일반 영어로 분할 방법을 AI에 알려주세요. AI가 문서 내용을 읽고 경계를 감지하며 각 파일의 이름을 지정합니다. 이는 페이지 기반 분할기로는 할 수 없는 작업입니다.

  • AI 기반 경계 감지 - 사용자 지정 지시 포함
  • 3가지 분할 모드 - smart, 고정 간격, 북마크
  • 일괄 처리 - 한 번의 요청으로 여러 PDF 처리
  • 자동 이름 지정 - 내용에 따라 분할 파일 이름 지정

파일 몇 개만 분할하면 되나요? 무료 웹 도구 사용

지시: "새 인보이스 헤더나 'Page 1 of X'가 보이면 분할하세요. 각 공급업체의 문서는 별도로 분리되어야 합니다."

입력

mixed_invoices_q4.pdf47페이지

포함된 PDF: 5개 공급업체의 인보이스 12개, 날짜 혼합, 다양한 페이지 수

AI 출력

2025-01-15_AcmeCorp_Invoice_001.pdf3페이지

reason: "새 인보이스 감지 - Acme Corp 헤더"

2025-01-14_GlobeTech_Invoice_002.pdf2페이지

reason: "새 공급업체 레터헤드 - GlobeTech Inc"

...및 추가 문서 10개

AI 분할이 페이지 기반 도구보다 나은 이유

페이지 기반 분할기는 페이지를 셉니다. AI는 내용을 읽고 경계를 이해합니다.

페이지 기반 / 수동 분할

입력:

mixed_invoices.pdf (47 pages)

분할 기준:

5페이지

출력:

split_1.pdf, split_2.pdf, ... (잘못된 경계)

  • 문서가 실제로 시작/종료되는 위치를 감지할 수 없음
  • 인보이스를 중간에서 자르고 공급업체 문서를 섞음
  • 일반적인 파일명(split_1, split_2...)
  • 문서 내용을 이해할 수 없음
사용자 지정 지시가 포함된 AI

입력:

mixed_invoices.pdf (47 pages)

지시:

"새 인보이스 헤더나 공급업체 레터헤드가 보이면 분할"

출력:

2025-01-15_AcmeCorp_Invoice_001.pdf (3 pages)

  • 내용에서 실제 문서 경계를 감지함
  • 자연어 지시를 따름
  • 추출된 내용을 바탕으로 파일 이름을 자동 지정함
  • 각 분할이 수행된 이유를 설명함

빠른 시작

엔드포인트는 두 가지입니다. 파일을 직접 업로드하거나 URL을 전달하면 저희가 가져옵니다. 경계를 AI가 감지하는 방법을 지정하려면 mode=smart with instructions 를 사용하세요.

POST /api/v1/pdf-split - multipart 파일 업로드

Shell
curl -X POST https://www.renamed.to/api/v1/pdf-split \  -H "Authorization: Bearer YOUR_API_TOKEN" \  -F "file=@mixed_documents.pdf" \  -F "mode=smart" \  -F 'instructions=Split when you detect a new document.Look for: invoice headers, "Page 1 of X", or new letterhead.Keep cover letters with their attachments.'

POST /api/v1/pdf-split/from-url - JSON 본문, 서버가 파일을 가져옴

Shell
curl -X POST https://www.renamed.to/api/v1/pdf-split/from-url \  -H "Authorization: Bearer YOUR_API_TOKEN" \  -H "Content-Type: application/json" \  -d '{    "url": "https://example.com/scanned-stack.pdf",    "mode": "smart",    "instructions": "Separate by patient name.\nEach patient'"'"'s records should be one file.\nInclude all pages until you see a new patient header."  }'

SDK

타입 안전성과 오류 처리를 포함한 더 나은 개발자 경험을 위해 공식 SDK를 사용하세요.

TypeScript SDK 예제

TypeScript
import { RenamedClient } from '@renamed/sdk'const client = new RenamedClient({ apiKey: process.env.RENAMED_API_KEY })// AI reads the bundle, detects boundaries, names each splitconst job = await client.pdfSplit('./mixed_invoices.pdf', {  mode: 'smart',  instructions: `Split when you detect a new invoice.Look for: company letterhead, "Invoice #", or "Page 1 of X".Each vendor's invoice should be separate.`})// Poll for completionconst result = await job.waitForCompletion()console.log(result.splits)// => [{ filename: "2025-01-15_AcmeCorp_Invoice_001.pdf", reason: "New invoice detected - Acme Corp header" }, ...]

응답

JSON
{  "jobId": "abc123",  "status": "completed",  "progress": 100,  "results": {    "results": [{      "originalFilename": "mixed_documents.pdf",      "splits": [{        "filename": "2025-01-15_AcmeCorp_Invoice_001.pdf",        "downloadUrl": "https://...",        "expiresAt": "2025-01-16T12:00:00Z",        "pages": 3,        "reason": "New invoice detected - Acme Corp header"      },      {        "filename": "2025-01-14_GlobeTech_Invoice_002.pdf",        "downloadUrl": "https://...",        "expiresAt": "2025-01-16T12:00:00Z",        "pages": 2,        "reason": "New vendor letterhead - GlobeTech Inc"      }]    }]  },  "creditsUsed": 2}

GitHub의 SDK: github.com/renamed-to/renamed-sdk

인증

모든 API 요청은 Authorization 헤더의 Bearer token을 통한 인증이 필요합니다.

API Token(권장)

다음에서 API 토큰을 생성하세요: 설정 → API 토큰. 토큰 접두사는 rt_ 이며 계정에 대한 전체 액세스를 제공합니다.

Authorization: Bearer rt_abc123def456...

OAuth 2.0

사용자를 대신해 인증하는 앱의 경우 OAuth 2.0을 사용하세요. OAuth 흐름이 완료되면 동일한 방식으로 작동하는 액세스 토큰을 받습니다:

Authorization: Bearer <oauth_access_token>

OAuth 클라이언트 등록 및 흐름 세부 정보는 API documentation 을(를) 참조하세요.

API 파라미터

분할 동작을 제어하기 위한 주요 파라미터입니다.

파라미터유형필수값 / 참고
fileFile예*단일 파일 업로드. *다음 중 하나 이상이 file 또는 files[] 필수입니다.
files[]File[]예*일괄 처리를 위한 여러 파일.
modestring아니요기본값: smart.값: smart | every-n-pages | by-bookmarks
instructionsstring아니요 smart 모드에서만 사용됩니다. 경계 감지를 위한 자연어 지시입니다. 최대 5,000자.
pagesPerSplitintegermode=인 경우 예:every-n-pages분할당 페이지 수입니다. 범위: 1-1000.

URL 엔드포인트(/api/v1/pdf-split/from-url)

위와 동일한 파라미터를 사용하지만 file/files[]대신 url (string) 또는 urls (string[])를 사용합니다.

지시로 할 수 있는 작업

AI는 자연어를 해석하고 직접 구현하려면 사용자 지정 코드가 필요한 복잡한 경계 감지를 적용합니다.

경계 감지
"'Page 1 of X' 또는 새 회사 레터헤드가 보이면 분할"
문서 그룹화
"커버 레터와 해당 첨부 문서는 함께 유지하세요. 부록을 본문 문서에서 분리하지 마세요."
엔터티 기반 분할
"환자 이름별로 분리 - 각 환자의 기록은 하나의 파일이어야 함"
헤더 감지
"각 PURCHASE ORDER는 새 문서를 시작합니다. Invoice 헤더도 새 문서를 나타냅니다."

분할 모드

사용 사례에 맞는 모드를 선택하세요. Smart 모드가 기본값입니다.

smart기본값

AI가 문서 경계를 자동으로 감지합니다. 필요에 따라 instructions 를 제공해 경계 감지를 안내할 수 있습니다.

every-n-pages

고정 간격으로 분할합니다. pagesPerSplit 파라미터가 필요합니다(1-1000).

by-bookmarks

PDF 북마크 경계에서 분할합니다. 원본 PDF에 북마크가 있어야 합니다.

운영 환경용으로 설계됨

제한

  • 파일 크기: 최대 100MB
  • 형식: PDF만
  • 지시: 최대 5,000자
  • 분할당 페이지 수: 1-1,000 (every-n-pages 모드용)
  • 처리 시간: 일반적으로 30초-2분

일반적인 오류

  • 400 no_files 제공된 파일이 없음
  • 400 invalid_file_type PDF가 아님
  • 400 file_too_large 100MB 초과
  • 401 unauthorized API 키가 없거나 유효하지 않음
  • 402 insufficient_credits 크레딧 부족
  • 404 not_found 작업을 찾을 수 없음

보안: 모든 요청은 TLS를 통해 전송됩니다. /from-url 엔드포인트는 localhost 및 비공개 IP 범위를 차단합니다.

요금

3페이지당 1크레딧 (올림). 이후 1,000 credits당 $9입니다.

  • 가입 시 무료 크레딧 50 제공
  • 크레딧은 12개월 동안 유효
  • 30일 환불 보장
요금 세부 정보 보기

시작하기

PDF Split API를 워크플로에 통합하는 4단계입니다.

1

API 토큰 받기

대시보드에서 API 토큰을 생성하세요. 가입 시 무료 크레딧 50을 받습니다.

2

PDF 업로드 또는 URL 제공

/api/v1/pdf-split (파일 업로드) 또는 /api/v1/pdf-split/from-url (URL)로 제출하세요. smart 모드용 instructions 를 포함하세요.

3

상태 엔드포인트 폴링

초기 응답에는 statusUrl가 포함됩니다. /api/v1/pdf-split/status/{jobId} 가 될 때까지 status=completed를 폴링하세요.

4

분할된 파일 다운로드

각 분할에는 downloadUrl가 포함됩니다. URL은 24시간 후 만료됩니다. reason 필드는 각 경계가 감지된 이유를 설명합니다.

FAQ

AI 경계 감지는 어떻게 작동하나요?
"smart" 모드에서는 AI가 문서 내용을 분석해 한 문서가 끝나고 다른 문서가 시작되는 지점을 식별합니다. 레터헤드, 문서 유형, 공급업체, "Page 1 of X" 패턴, 구조적 요소의 변화를 감지합니다. 자연어 지시로 이를 안내할 수 있습니다.
instructions 파라미터에는 무엇을 넣을 수 있나요?
경계를 감지하는 방법을 설명하는 자연어를 입력합니다. 예: "새 인보이스 헤더나 Page 1 of X가 보이면 분할", "각 문서는 커버 레터로 시작하고 그 뒤에 첨부 문서가 따라옴", "환자 이름별로 분리 - 각 환자의 기록은 하나의 파일이어야 함".
처리에는 얼마나 걸리나요?
대부분의 작업은 파일 크기와 페이지 수에 따라 30초에서 2분 안에 완료됩니다. API는 비동기식이므로 작업을 제출한 뒤 완료될 때까지 폴링합니다.
최대 파일 크기는 얼마인가요?
최대 100MB의 PDF 파일을 지원합니다. 엄격한 페이지 제한은 없지만, 매우 큰 문서는 처리 시간이 더 오래 걸릴 수 있습니다.
분할된 파일은 어떻게 이름이 지정되나요?
smart 모드에서는 AI가 문서 내용을 바탕으로 설명적인 파일명을 생성하며 날짜, 공급업체, 문서 유형 및 기타 엔터티를 추출합니다. 각 분할에는 경계가 감지된 이유를 설명하는 "reason" 필드도 포함됩니다.
기존 PDF 분할기와는 무엇이 다른가요?
기존 분할기는 페이지 번호나 북마크를 기준으로 작동합니다. 이 API는 문서 내용을 읽고 의미를 이해하며 자연어 지시를 적용합니다. 공급업체, 환자, 문서 유형 또는 기타 의미 기반 경계로 분할할 수 있으며, 이는 페이지 기반 도구로는 불가능합니다.