Dziel PDF-y za pomocą instrukcji w języku naturalnym
Proszę powiedzieć AI zwykłym językiem, jak podzielić plik. Odczytuje treść dokumentu, wykrywa granice i nadaje nazwę każdemu plikowi — rzeczy, których narzędzia oparte na stronach nigdy nie zrobią.
- Wykrywanie granic przez AI - z własnymi instrukcjami
- 3 tryby podziału - smart, stałe interwały, zakładki
- Przetwarzanie wsadowe - wiele PDF-ów w jednym żądaniu
- Automatyczne nazewnictwo - nazwy plików według treści
Trzeba tylko podzielić kilka plików? Użyj bezpłatnego narzędzia webowego
Państwa instrukcja: "Podziel, gdy zobaczysz nowy nagłówek faktury lub 'Strona 1 z X'. Dokumenty każdego dostawcy powinny być oddzielone."
Wejście
PDF zawierający: 12 faktur od 5 dostawców, różne daty, różna liczba stron
Wynik AI
reason: "Wykryto nową fakturę - nagłówek Acme Corp"
reason: "Nowy papier firmowy dostawcy - GlobeTech Inc"
Dlaczego podział przez AI przewyższa narzędzia oparte na stronach
Narzędzia oparte na stronach liczą strony. AI odczytuje treść i rozumie granice.
Wejście:
mixed_invoices.pdf (47 pages)
Dziel co:
5 stron
Wynik:
split_1.pdf, split_2.pdf, ... (wrong boundaries)
- Nie wykrywa, gdzie dokumenty faktycznie się zaczynają/kończą
- Dzieli faktury na pół, miesza dostawców
- Ogólne nazwy plików (split_1, split_2...)
- Nie rozumie treści dokumentu
Wejście:
mixed_invoices.pdf (47 pages)
Instrukcja:
"Podziel, gdy zobaczysz nowy nagłówek faktury lub nowy nagłówek firmowy dostawcy"
Wynik:
2025-01-15_AcmeCorp_Invoice_001.pdf (3 pages)
- Wykrywa rzeczywiste granice dokumentów na podstawie treści
- Postępuje zgodnie z Państwa instrukcjami w języku naturalnym
- Automatycznie nadaje nazwy plikom na podstawie wyodrębnionej treści
- Wyjaśnia, dlaczego wykonano każdy podział
Szybki start
Dwa endpointy: można przesłać plik bezpośrednio albo podać URL, a my go pobierzemy. Użyj mode=smart with instructions aby wskazać AI, jak wykrywać granice.
POST /api/v1/pdf-split - przesyłanie pliku multipart
curl -X POST https://www.renamed.to/api/v1/pdf-split \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -F "file=@mixed_documents.pdf" \ -F "mode=smart" \ -F 'instructions=Split when you detect a new document.Look for: invoice headers, "Page 1 of X", or new letterhead.Keep cover letters with their attachments.'POST /api/v1/pdf-split/from-url - treść JSON, serwer pobiera plik
curl -X POST https://www.renamed.to/api/v1/pdf-split/from-url \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -H "Content-Type: application/json" \ -d '{ "url": "https://example.com/scanned-stack.pdf", "mode": "smart", "instructions": "Separate by patient name.\nEach patient'"'"'s records should be one file.\nInclude all pages until you see a new patient header." }'SDK
Proszę używać naszych oficjalnych SDK, aby uzyskać lepsze środowisko programistyczne z bezpieczeństwem typów i obsługą błędów.
SDK TypeScript
import { RenamedClient } from '@renamed/sdk'const client = new RenamedClient({ apiKey: process.env.RENAMED_API_KEY })// AI reads the bundle, detects boundaries, names each splitconst job = await client.pdfSplit('./mixed_invoices.pdf', { mode: 'smart', instructions: `Split when you detect a new invoice.Look for: company letterhead, "Invoice #", or "Page 1 of X".Each vendor's invoice should be separate.`})// Poll for completionconst result = await job.waitForCompletion()console.log(result.splits)// => [{ filename: "2025-01-15_AcmeCorp_Invoice_001.pdf", reason: "New invoice detected - Acme Corp header" }, ...]Odpowiedź
{ "jobId": "abc123", "status": "completed", "progress": 100, "results": { "results": [{ "originalFilename": "mixed_documents.pdf", "splits": [{ "filename": "2025-01-15_AcmeCorp_Invoice_001.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 3, "reason": "New invoice detected - Acme Corp header" }, { "filename": "2025-01-14_GlobeTech_Invoice_002.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 2, "reason": "New vendor letterhead - GlobeTech Inc" }] }] }, "creditsUsed": 2}SDK na GitHub: github.com/renamed-to/renamed-sdk
Uwierzytelnianie
Wszystkie żądania API wymagają uwierzytelniania za pomocą tokenu Bearer w nagłówku Authorization .
Token API (zalecane)
Tokeny API można wygenerować w Ustawienia → Tokeny API. Tokeny mają prefiks rt_ i zapewniają pełny dostęp do konta.
Authorization: Bearer rt_abc123def456...OAuth 2.0
W przypadku aplikacji uwierzytelniających w imieniu użytkowników należy użyć OAuth 2.0. Po zakończeniu przepływu OAuth otrzymują Państwo token dostępu, który działa tak samo:
Authorization: Bearer <oauth_access_token>Zobacz dokumentację API aby poznać szczegóły rejestracji klienta OAuth i przebiegu procesu.
Parametry API
Kluczowe parametry sterujące sposobem podziału.
| Parametr | Typ | Wymagane | Wartości / Uwagi |
|---|---|---|---|
file | File | Tak* | Przesłanie pojedynczego pliku. *Wymagany jest co najmniej jeden z file lub files[] . |
files[] | File[] | Tak* | Wiele plików do przetwarzania wsadowego. |
mode | string | Nie | Domyślnie: smart.Wartości: smart | every-n-pages | by-bookmarks |
instructions | string | Nie | Tylko dla trybu smart . Instrukcje w języku naturalnym do wykrywania granic. Maks. 5,000 znaków. |
pagesPerSplit | integer | Tak, jeśli mode= | Liczba stron na podział. Zakres: 1-1000. |
Endpoint URL (/api/v1/pdf-split/from-url)
Te same parametry co powyżej, ale zamiast file/files[]należy użyć url (string) lub urls (string[]).
Co mogą zrobić Państwa instrukcje
AI interpretuje język naturalny i stosuje złożone wykrywanie granic, którego zbudowanie samodzielnie wymagałoby własnego kodu.
- Wykrywanie granic
"Split when you see 'Page 1 of X' or a new company letterhead"- Grupowanie dokumentów
"Keep cover letters with their attachments. Don't split appendices from main documents."- Podział według encji
"Separate by patient name - each patient's records should be one file"- Wykrywanie nagłówków
"Each PURCHASE ORDER starts a new document. Invoice headers also indicate new documents."
Tryby podziału
Proszę wybrać tryb odpowiedni do zastosowania. Tryb smart jest domyślny.
smartdomyślnyAI automatycznie wykrywa granice dokumentów. Opcjonalnie można podać instructions aby ukierunkować wykrywanie granic.
every-n-pagesDzieli w stałych odstępach. Wymaga parametru pagesPerSplit (1-1000).
by-bookmarksDzieli na granicach zakładek PDF. Wymaga, aby źródłowy PDF zawierał zakładki.
Zaprojektowane do środowisk produkcyjnych
Limity
- Rozmiar pliku: maks. 100MB
- Formaty: tylko PDF
- Instrukcje: maks. 5,000 znaków
- Strony na podział: 1-1,000 (dla trybu every-n-pages)
- Przetwarzanie: typowo 30s-2min
Typowe błędy
400 no_filesNie podano plików400 invalid_file_typeTo nie jest PDF400 file_too_largePrzekracza 100MB401 unauthorizedBrak klucza API lub jest nieprawidłowy402 insufficient_creditsNiewystarczająca liczba kredytów404 not_foundNie znaleziono zadania
Bezpieczeństwo: Wszystkie żądania przez TLS. Endpoint /from-url blokuje localhost i prywatne zakresy IP.
Cennik
1 kredyt za 3 strony (zaokrąglane w górę). Następnie $9 za 1,000 kredytów.
- 50 bezpłatnych kredytów po rejestracji
- Kredyty są ważne przez 12 miesięcy
- 30-dniowa gwarancja zwrotu pieniędzy
Pierwsze kroki
Cztery kroki, aby zintegrować PDF Split API z Państwa przepływem pracy.
Pobierz token API
Wygeneruj token API w panelu. Po rejestracji otrzymują Państwo 50 bezpłatnych kredytów.
Prześlij PDF lub podaj URL
Wyślij do /api/v1/pdf-split (przesyłanie pliku) lub /api/v1/pdf-split/from-url (URL). Dołącz instructions dla trybu smart.
Odpytuj endpoint statusu
Początkowa odpowiedź zawiera statusUrl. Odpytuj /api/v1/pdf-split/status/{jobId} aż do status=completed.
Pobierz podzielone pliki
Każdy podział zawiera downloadUrl. URL wygasają po 24 godzinach. Pole reason wyjaśnia, dlaczego wykryto każdą granicę.
FAQ
- Jak działa wykrywanie granic przez AI?
- W trybie "smart" AI analizuje treść dokumentu, aby określić, gdzie kończy się jeden dokument, a zaczyna drugi. Wykrywa zmiany w nagłówkach firmowych, typie dokumentu, dostawcy, wzorcach "Page 1 of X" oraz elementach strukturalnych. Można ją ukierunkować instrukcjami w języku naturalnym.
- Co mogę umieścić w parametrze instructions?
- Opis w języku naturalnym określający sposób wykrywania granic. Przykłady: "Split when you see a new invoice header or Page 1 of X", "Each document starts with a cover letter followed by attachments", "Separate by patient name - each patient's records should be one file".
- Jak długo trwa przetwarzanie?
- Większość zadań kończy się w 30 sekund do 2 minut, w zależności od rozmiaru pliku i liczby stron. API działa asynchronicznie — przesyłają Państwo zadanie i odpytują o zakończenie.
- Jaki jest maksymalny rozmiar pliku?
- Pliki PDF do 100MB. Nie ma sztywnego limitu stron, ale przetwarzanie bardzo dużych dokumentów może trwać dłużej.
- Jak nazywane są podzielone pliki?
- W trybie smart AI generuje opisowe nazwy plików na podstawie treści dokumentu — wyodrębnia daty, dostawców, typy dokumentów i inne encje. Każdy podział zawiera też pole "reason" wyjaśniające, dlaczego wykryto granicę.
- Czym to się różni od tradycyjnych narzędzi do dzielenia PDF?
- Tradycyjne narzędzia działają na numerach stron lub zakładkach. To API odczytuje treść dokumentu, rozumie znaczenie i stosuje Państwa instrukcje w języku naturalnym. Może dzielić według dostawcy, pacjenta, typu dokumentu lub dowolnej granicy semantycznej — rzeczy niemożliwych w narzędziach opartych na stronach.