Przejdź do głównej treści
Renamed.to logorenamed.to
PDF Split API

Dziel PDF-y za pomocą instrukcji w języku naturalnym

Proszę powiedzieć AI zwykłym językiem, jak podzielić plik. Odczytuje treść dokumentu, wykrywa granice i nadaje nazwę każdemu plikowi — rzeczy, których narzędzia oparte na stronach nigdy nie zrobią.

  • Wykrywanie granic przez AI - z własnymi instrukcjami
  • 3 tryby podziału - smart, stałe interwały, zakładki
  • Przetwarzanie wsadowe - wiele PDF-ów w jednym żądaniu
  • Automatyczne nazewnictwo - nazwy plików według treści

Trzeba tylko podzielić kilka plików? Użyj bezpłatnego narzędzia webowego

Państwa instrukcja: "Podziel, gdy zobaczysz nowy nagłówek faktury lub 'Strona 1 z X'. Dokumenty każdego dostawcy powinny być oddzielone."

Wejście

mixed_invoices_q4.pdf47 stron

PDF zawierający: 12 faktur od 5 dostawców, różne daty, różna liczba stron

Wynik AI

2025-01-15_AcmeCorp_Invoice_001.pdf3 strony

reason: "Wykryto nową fakturę - nagłówek Acme Corp"

2025-01-14_GlobeTech_Invoice_002.pdf2 strony

reason: "Nowy papier firmowy dostawcy - GlobeTech Inc"

...i 10 kolejnych dokumentów

Dlaczego podział przez AI przewyższa narzędzia oparte na stronach

Narzędzia oparte na stronach liczą strony. AI odczytuje treść i rozumie granice.

Podział oparty na stronach / ręczny

Wejście:

mixed_invoices.pdf (47 pages)

Dziel co:

5 stron

Wynik:

split_1.pdf, split_2.pdf, ... (wrong boundaries)

  • Nie wykrywa, gdzie dokumenty faktycznie się zaczynają/kończą
  • Dzieli faktury na pół, miesza dostawców
  • Ogólne nazwy plików (split_1, split_2...)
  • Nie rozumie treści dokumentu
AI z własnymi instrukcjami

Wejście:

mixed_invoices.pdf (47 pages)

Instrukcja:

"Podziel, gdy zobaczysz nowy nagłówek faktury lub nowy nagłówek firmowy dostawcy"

Wynik:

2025-01-15_AcmeCorp_Invoice_001.pdf (3 pages)

  • Wykrywa rzeczywiste granice dokumentów na podstawie treści
  • Postępuje zgodnie z Państwa instrukcjami w języku naturalnym
  • Automatycznie nadaje nazwy plikom na podstawie wyodrębnionej treści
  • Wyjaśnia, dlaczego wykonano każdy podział

Szybki start

Dwa endpointy: można przesłać plik bezpośrednio albo podać URL, a my go pobierzemy. Użyj mode=smart with instructions aby wskazać AI, jak wykrywać granice.

POST /api/v1/pdf-split - przesyłanie pliku multipart

Shell
curl -X POST https://www.renamed.to/api/v1/pdf-split \  -H "Authorization: Bearer YOUR_API_TOKEN" \  -F "file=@mixed_documents.pdf" \  -F "mode=smart" \  -F 'instructions=Split when you detect a new document.Look for: invoice headers, "Page 1 of X", or new letterhead.Keep cover letters with their attachments.'

POST /api/v1/pdf-split/from-url - treść JSON, serwer pobiera plik

Shell
curl -X POST https://www.renamed.to/api/v1/pdf-split/from-url \  -H "Authorization: Bearer YOUR_API_TOKEN" \  -H "Content-Type: application/json" \  -d '{    "url": "https://example.com/scanned-stack.pdf",    "mode": "smart",    "instructions": "Separate by patient name.\nEach patient'"'"'s records should be one file.\nInclude all pages until you see a new patient header."  }'

SDK

Proszę używać naszych oficjalnych SDK, aby uzyskać lepsze środowisko programistyczne z bezpieczeństwem typów i obsługą błędów.

SDK TypeScript

TypeScript
import { RenamedClient } from '@renamed/sdk'const client = new RenamedClient({ apiKey: process.env.RENAMED_API_KEY })// AI reads the bundle, detects boundaries, names each splitconst job = await client.pdfSplit('./mixed_invoices.pdf', {  mode: 'smart',  instructions: `Split when you detect a new invoice.Look for: company letterhead, "Invoice #", or "Page 1 of X".Each vendor's invoice should be separate.`})// Poll for completionconst result = await job.waitForCompletion()console.log(result.splits)// => [{ filename: "2025-01-15_AcmeCorp_Invoice_001.pdf", reason: "New invoice detected - Acme Corp header" }, ...]

Odpowiedź

JSON
{  "jobId": "abc123",  "status": "completed",  "progress": 100,  "results": {    "results": [{      "originalFilename": "mixed_documents.pdf",      "splits": [{        "filename": "2025-01-15_AcmeCorp_Invoice_001.pdf",        "downloadUrl": "https://...",        "expiresAt": "2025-01-16T12:00:00Z",        "pages": 3,        "reason": "New invoice detected - Acme Corp header"      },      {        "filename": "2025-01-14_GlobeTech_Invoice_002.pdf",        "downloadUrl": "https://...",        "expiresAt": "2025-01-16T12:00:00Z",        "pages": 2,        "reason": "New vendor letterhead - GlobeTech Inc"      }]    }]  },  "creditsUsed": 2}

SDK na GitHub: github.com/renamed-to/renamed-sdk

Uwierzytelnianie

Wszystkie żądania API wymagają uwierzytelniania za pomocą tokenu Bearer w nagłówku Authorization .

Token API (zalecane)

Tokeny API można wygenerować w Ustawienia → Tokeny API. Tokeny mają prefiks rt_ i zapewniają pełny dostęp do konta.

Authorization: Bearer rt_abc123def456...

OAuth 2.0

W przypadku aplikacji uwierzytelniających w imieniu użytkowników należy użyć OAuth 2.0. Po zakończeniu przepływu OAuth otrzymują Państwo token dostępu, który działa tak samo:

Authorization: Bearer <oauth_access_token>

Zobacz dokumentację API aby poznać szczegóły rejestracji klienta OAuth i przebiegu procesu.

Parametry API

Kluczowe parametry sterujące sposobem podziału.

ParametrTypWymaganeWartości / Uwagi
fileFileTak*Przesłanie pojedynczego pliku. *Wymagany jest co najmniej jeden z file lub files[] .
files[]File[]Tak*Wiele plików do przetwarzania wsadowego.
modestringNieDomyślnie: smart.Wartości: smart | every-n-pages | by-bookmarks
instructionsstringNieTylko dla trybu smart . Instrukcje w języku naturalnym do wykrywania granic. Maks. 5,000 znaków.
pagesPerSplitintegerTak, jeśli mode=every-n-pagesLiczba stron na podział. Zakres: 1-1000.

Endpoint URL (/api/v1/pdf-split/from-url)

Te same parametry co powyżej, ale zamiast file/files[]należy użyć url (string) lub urls (string[]).

Co mogą zrobić Państwa instrukcje

AI interpretuje język naturalny i stosuje złożone wykrywanie granic, którego zbudowanie samodzielnie wymagałoby własnego kodu.

Wykrywanie granic
"Split when you see 'Page 1 of X' or a new company letterhead"
Grupowanie dokumentów
"Keep cover letters with their attachments. Don't split appendices from main documents."
Podział według encji
"Separate by patient name - each patient's records should be one file"
Wykrywanie nagłówków
"Each PURCHASE ORDER starts a new document. Invoice headers also indicate new documents."

Tryby podziału

Proszę wybrać tryb odpowiedni do zastosowania. Tryb smart jest domyślny.

smartdomyślny

AI automatycznie wykrywa granice dokumentów. Opcjonalnie można podać instructions aby ukierunkować wykrywanie granic.

every-n-pages

Dzieli w stałych odstępach. Wymaga parametru pagesPerSplit (1-1000).

by-bookmarks

Dzieli na granicach zakładek PDF. Wymaga, aby źródłowy PDF zawierał zakładki.

Zaprojektowane do środowisk produkcyjnych

Limity

  • Rozmiar pliku: maks. 100MB
  • Formaty: tylko PDF
  • Instrukcje: maks. 5,000 znaków
  • Strony na podział: 1-1,000 (dla trybu every-n-pages)
  • Przetwarzanie: typowo 30s-2min

Typowe błędy

  • 400 no_files Nie podano plików
  • 400 invalid_file_type To nie jest PDF
  • 400 file_too_large Przekracza 100MB
  • 401 unauthorized Brak klucza API lub jest nieprawidłowy
  • 402 insufficient_credits Niewystarczająca liczba kredytów
  • 404 not_found Nie znaleziono zadania

Bezpieczeństwo: Wszystkie żądania przez TLS. Endpoint /from-url blokuje localhost i prywatne zakresy IP.

Cennik

1 kredyt za 3 strony (zaokrąglane w górę). Następnie $9 za 1,000 kredytów.

  • 50 bezpłatnych kredytów po rejestracji
  • Kredyty są ważne przez 12 miesięcy
  • 30-dniowa gwarancja zwrotu pieniędzy
Zobacz szczegóły cennika

Pierwsze kroki

Cztery kroki, aby zintegrować PDF Split API z Państwa przepływem pracy.

1

Pobierz token API

Wygeneruj token API w panelu. Po rejestracji otrzymują Państwo 50 bezpłatnych kredytów.

2

Prześlij PDF lub podaj URL

Wyślij do /api/v1/pdf-split (przesyłanie pliku) lub /api/v1/pdf-split/from-url (URL). Dołącz instructions dla trybu smart.

3

Odpytuj endpoint statusu

Początkowa odpowiedź zawiera statusUrl. Odpytuj /api/v1/pdf-split/status/{jobId} aż do status=completed.

4

Pobierz podzielone pliki

Każdy podział zawiera downloadUrl. URL wygasają po 24 godzinach. Pole reason wyjaśnia, dlaczego wykryto każdą granicę.

FAQ

Jak działa wykrywanie granic przez AI?
W trybie "smart" AI analizuje treść dokumentu, aby określić, gdzie kończy się jeden dokument, a zaczyna drugi. Wykrywa zmiany w nagłówkach firmowych, typie dokumentu, dostawcy, wzorcach "Page 1 of X" oraz elementach strukturalnych. Można ją ukierunkować instrukcjami w języku naturalnym.
Co mogę umieścić w parametrze instructions?
Opis w języku naturalnym określający sposób wykrywania granic. Przykłady: "Split when you see a new invoice header or Page 1 of X", "Each document starts with a cover letter followed by attachments", "Separate by patient name - each patient's records should be one file".
Jak długo trwa przetwarzanie?
Większość zadań kończy się w 30 sekund do 2 minut, w zależności od rozmiaru pliku i liczby stron. API działa asynchronicznie — przesyłają Państwo zadanie i odpytują o zakończenie.
Jaki jest maksymalny rozmiar pliku?
Pliki PDF do 100MB. Nie ma sztywnego limitu stron, ale przetwarzanie bardzo dużych dokumentów może trwać dłużej.
Jak nazywane są podzielone pliki?
W trybie smart AI generuje opisowe nazwy plików na podstawie treści dokumentu — wyodrębnia daty, dostawców, typy dokumentów i inne encje. Każdy podział zawiera też pole "reason" wyjaśniające, dlaczego wykryto granicę.
Czym to się różni od tradycyjnych narzędzi do dzielenia PDF?
Tradycyjne narzędzia działają na numerach stron lub zakładkach. To API odczytuje treść dokumentu, rozumie znaczenie i stosuje Państwa instrukcje w języku naturalnym. Może dzielić według dostawcy, pacjenta, typu dokumentu lub dowolnej granicy semantycznej — rzeczy niemożliwych w narzędziach opartych na stronach.