다음을 사용해 PDF를 분할하세요 자연어 지시
일반 영어로 분할 방법을 AI에 알려주세요. AI가 문서 내용을 읽고 경계를 감지하며 각 파일의 이름을 지정합니다. 이는 페이지 기반 분할기로는 할 수 없는 작업입니다.
- AI 기반 경계 감지 - 사용자 지정 지시 포함
- 3가지 분할 모드 - smart, 고정 간격, 북마크
- 일괄 처리 - 한 번의 요청으로 여러 PDF 처리
- 자동 이름 지정 - 내용에 따라 분할 파일 이름 지정
파일 몇 개만 분할하면 되나요? 무료 웹 도구 사용
지시: "새 인보이스 헤더나 'Page 1 of X'가 보이면 분할하세요. 각 공급업체의 문서는 별도로 분리되어야 합니다."
입력
포함된 PDF: 5개 공급업체의 인보이스 12개, 날짜 혼합, 다양한 페이지 수
AI 출력
reason: "새 인보이스 감지 - Acme Corp 헤더"
reason: "새 공급업체 레터헤드 - GlobeTech Inc"
AI 분할이 페이지 기반 도구보다 나은 이유
페이지 기반 분할기는 페이지를 셉니다. AI는 내용을 읽고 경계를 이해합니다.
입력:
mixed_invoices.pdf (47 pages)
분할 기준:
5페이지
출력:
split_1.pdf, split_2.pdf, ... (잘못된 경계)
- 문서가 실제로 시작/종료되는 위치를 감지할 수 없음
- 인보이스를 중간에서 자르고 공급업체 문서를 섞음
- 일반적인 파일명(split_1, split_2...)
- 문서 내용을 이해할 수 없음
입력:
mixed_invoices.pdf (47 pages)
지시:
"새 인보이스 헤더나 공급업체 레터헤드가 보이면 분할"
출력:
2025-01-15_AcmeCorp_Invoice_001.pdf (3 pages)
- 내용에서 실제 문서 경계를 감지함
- 자연어 지시를 따름
- 추출된 내용을 바탕으로 파일 이름을 자동 지정함
- 각 분할이 수행된 이유를 설명함
빠른 시작
엔드포인트는 두 가지입니다. 파일을 직접 업로드하거나 URL을 전달하면 저희가 가져옵니다. 경계를 AI가 감지하는 방법을 지정하려면 mode=smart with instructions 를 사용하세요.
POST /api/v1/pdf-split - multipart 파일 업로드
curl -X POST https://www.renamed.to/api/v1/pdf-split \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -F "file=@mixed_documents.pdf" \ -F "mode=smart" \ -F 'instructions=Split when you detect a new document.Look for: invoice headers, "Page 1 of X", or new letterhead.Keep cover letters with their attachments.'POST /api/v1/pdf-split/from-url - JSON 본문, 서버가 파일을 가져옴
curl -X POST https://www.renamed.to/api/v1/pdf-split/from-url \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -H "Content-Type: application/json" \ -d '{ "url": "https://example.com/scanned-stack.pdf", "mode": "smart", "instructions": "Separate by patient name.\nEach patient'"'"'s records should be one file.\nInclude all pages until you see a new patient header." }'SDK
타입 안전성과 오류 처리를 포함한 더 나은 개발자 경험을 위해 공식 SDK를 사용하세요.
TypeScript SDK 예제
import { RenamedClient } from '@renamed/sdk'const client = new RenamedClient({ apiKey: process.env.RENAMED_API_KEY })// AI reads the bundle, detects boundaries, names each splitconst job = await client.pdfSplit('./mixed_invoices.pdf', { mode: 'smart', instructions: `Split when you detect a new invoice.Look for: company letterhead, "Invoice #", or "Page 1 of X".Each vendor's invoice should be separate.`})// Poll for completionconst result = await job.waitForCompletion()console.log(result.splits)// => [{ filename: "2025-01-15_AcmeCorp_Invoice_001.pdf", reason: "New invoice detected - Acme Corp header" }, ...]응답
{ "jobId": "abc123", "status": "completed", "progress": 100, "results": { "results": [{ "originalFilename": "mixed_documents.pdf", "splits": [{ "filename": "2025-01-15_AcmeCorp_Invoice_001.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 3, "reason": "New invoice detected - Acme Corp header" }, { "filename": "2025-01-14_GlobeTech_Invoice_002.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 2, "reason": "New vendor letterhead - GlobeTech Inc" }] }] }, "creditsUsed": 2}GitHub의 SDK: github.com/renamed-to/renamed-sdk
인증
모든 API 요청은 Authorization 헤더의 Bearer token을 통한 인증이 필요합니다.
API Token(권장)
다음에서 API 토큰을 생성하세요: 설정 → API 토큰. 토큰 접두사는 rt_ 이며 계정에 대한 전체 액세스를 제공합니다.
Authorization: Bearer rt_abc123def456...OAuth 2.0
사용자를 대신해 인증하는 앱의 경우 OAuth 2.0을 사용하세요. OAuth 흐름이 완료되면 동일한 방식으로 작동하는 액세스 토큰을 받습니다:
Authorization: Bearer <oauth_access_token>OAuth 클라이언트 등록 및 흐름 세부 정보는 API documentation 을(를) 참조하세요.
API 파라미터
분할 동작을 제어하기 위한 주요 파라미터입니다.
| 파라미터 | 유형 | 필수 | 값 / 참고 |
|---|---|---|---|
file | File | 예* | 단일 파일 업로드. *다음 중 하나 이상이 file 또는 files[] 필수입니다. |
files[] | File[] | 예* | 일괄 처리를 위한 여러 파일. |
mode | string | 아니요 | 기본값: smart.값: smart | every-n-pages | by-bookmarks |
instructions | string | 아니요 | smart 모드에서만 사용됩니다. 경계 감지를 위한 자연어 지시입니다. 최대 5,000자. |
pagesPerSplit | integer | mode=인 경우 예: | 분할당 페이지 수입니다. 범위: 1-1000. |
URL 엔드포인트(/api/v1/pdf-split/from-url)
위와 동일한 파라미터를 사용하지만 file/files[]대신 url (string) 또는 urls (string[])를 사용합니다.
지시로 할 수 있는 작업
AI는 자연어를 해석하고 직접 구현하려면 사용자 지정 코드가 필요한 복잡한 경계 감지를 적용합니다.
- 경계 감지
"'Page 1 of X' 또는 새 회사 레터헤드가 보이면 분할"- 문서 그룹화
"커버 레터와 해당 첨부 문서는 함께 유지하세요. 부록을 본문 문서에서 분리하지 마세요."- 엔터티 기반 분할
"환자 이름별로 분리 - 각 환자의 기록은 하나의 파일이어야 함"- 헤더 감지
"각 PURCHASE ORDER는 새 문서를 시작합니다. Invoice 헤더도 새 문서를 나타냅니다."
분할 모드
사용 사례에 맞는 모드를 선택하세요. Smart 모드가 기본값입니다.
smart기본값AI가 문서 경계를 자동으로 감지합니다. 필요에 따라 instructions 를 제공해 경계 감지를 안내할 수 있습니다.
every-n-pages고정 간격으로 분할합니다. pagesPerSplit 파라미터가 필요합니다(1-1000).
by-bookmarksPDF 북마크 경계에서 분할합니다. 원본 PDF에 북마크가 있어야 합니다.
운영 환경용으로 설계됨
제한
- 파일 크기: 최대 100MB
- 형식: PDF만
- 지시: 최대 5,000자
- 분할당 페이지 수: 1-1,000 (every-n-pages 모드용)
- 처리 시간: 일반적으로 30초-2분
일반적인 오류
400 no_files제공된 파일이 없음400 invalid_file_typePDF가 아님400 file_too_large100MB 초과401 unauthorizedAPI 키가 없거나 유효하지 않음402 insufficient_credits크레딧 부족404 not_found작업을 찾을 수 없음
보안: 모든 요청은 TLS를 통해 전송됩니다. /from-url 엔드포인트는 localhost 및 비공개 IP 범위를 차단합니다.
요금
3페이지당 1크레딧 (올림). 이후 1,000 credits당 $9입니다.
- 가입 시 무료 크레딧 50 제공
- 크레딧은 12개월 동안 유효
- 30일 환불 보장
시작하기
PDF Split API를 워크플로에 통합하는 4단계입니다.
PDF 업로드 또는 URL 제공
/api/v1/pdf-split (파일 업로드) 또는 /api/v1/pdf-split/from-url (URL)로 제출하세요. smart 모드용 instructions 를 포함하세요.
상태 엔드포인트 폴링
초기 응답에는 statusUrl가 포함됩니다. /api/v1/pdf-split/status/{jobId} 가 될 때까지 status=completed를 폴링하세요.
FAQ
- AI 경계 감지는 어떻게 작동하나요?
- "smart" 모드에서는 AI가 문서 내용을 분석해 한 문서가 끝나고 다른 문서가 시작되는 지점을 식별합니다. 레터헤드, 문서 유형, 공급업체, "Page 1 of X" 패턴, 구조적 요소의 변화를 감지합니다. 자연어 지시로 이를 안내할 수 있습니다.
- instructions 파라미터에는 무엇을 넣을 수 있나요?
- 경계를 감지하는 방법을 설명하는 자연어를 입력합니다. 예: "새 인보이스 헤더나 Page 1 of X가 보이면 분할", "각 문서는 커버 레터로 시작하고 그 뒤에 첨부 문서가 따라옴", "환자 이름별로 분리 - 각 환자의 기록은 하나의 파일이어야 함".
- 처리에는 얼마나 걸리나요?
- 대부분의 작업은 파일 크기와 페이지 수에 따라 30초에서 2분 안에 완료됩니다. API는 비동기식이므로 작업을 제출한 뒤 완료될 때까지 폴링합니다.
- 최대 파일 크기는 얼마인가요?
- 최대 100MB의 PDF 파일을 지원합니다. 엄격한 페이지 제한은 없지만, 매우 큰 문서는 처리 시간이 더 오래 걸릴 수 있습니다.
- 분할된 파일은 어떻게 이름이 지정되나요?
- smart 모드에서는 AI가 문서 내용을 바탕으로 설명적인 파일명을 생성하며 날짜, 공급업체, 문서 유형 및 기타 엔터티를 추출합니다. 각 분할에는 경계가 감지된 이유를 설명하는 "reason" 필드도 포함됩니다.
- 기존 PDF 분할기와는 무엇이 다른가요?
- 기존 분할기는 페이지 번호나 북마크를 기준으로 작동합니다. 이 API는 문서 내용을 읽고 의미를 이해하며 자연어 지시를 적용합니다. 공급업체, 환자, 문서 유형 또는 기타 의미 기반 경계로 분할할 수 있으며, 이는 페이지 기반 도구로는 불가능합니다.