Vai al contenuto principale
Renamed.to logorenamed.to
PDF Split API

Suddivida i PDF con Istruzioni in linguaggio naturale

Dica all’AI come suddividere in inglese semplice. Legge il contenuto del documento, rileva i confini e assegna un nome a ogni file: cose che gli splitter basati sulle pagine non potrebbero mai fare.

  • Rilevamento dei confini con AI - con istruzioni personalizzate
  • 3 modalità di suddivisione - smart, intervalli fissi, segnalibri
  • Elaborazione in batch - più PDF in una richiesta
  • Denominazione automatica - file suddivisi nominati in base al contenuto

Deve solo suddividere alcuni file? Usi lo strumento web gratuito

La Sua istruzione: "Dividi quando vedi una nuova intestazione di fattura o 'Pagina 1 di X'. I documenti di ogni fornitore devono essere separati."

Input

mixed_invoices_q4.pdf47 pagine

PDF contenente: 12 fatture di 5 fornitori, date miste, conteggi di pagina variabili

Output AI

2025-01-15_AcmeCorp_Invoice_001.pdf3 pagine

reason: "Nuova fattura rilevata - intestazione Acme Corp"

2025-01-14_GlobeTech_Invoice_002.pdf2 pagine

reason: "Nuova carta intestata fornitore - GlobeTech Inc"

...e altri 10 documenti

Perché la suddivisione con AI supera gli strumenti basati sulle pagine

Gli splitter basati sulle pagine contano le pagine. L’AI legge il contenuto e comprende i confini.

Suddivisione manuale / basata sulle pagine

Input:

mixed_invoices.pdf (47 pagine)

Suddividi ogni:

5 pagine

Output:

split_1.pdf, split_2.pdf, ... (confini errati)

  • Non può rilevare dove i documenti iniziano/finiscono davvero
  • Taglia le fatture a metà, mescola i fornitori
  • Nomi file generici (split_1, split_2...)
  • Non può comprendere il contenuto del documento
AI con istruzioni personalizzate

Input:

mixed_invoices.pdf (47 pagine)

Istruzione:

"Dividi quando vedi una nuova intestazione di fattura o una nuova carta intestata del fornitore"

Output:

2025-01-15_AcmeCorp_Invoice_001.pdf (3 pagine)

  • Rileva i confini reali dei documenti dal contenuto
  • Segue le Sue istruzioni in linguaggio naturale
  • Assegna automaticamente nomi ai file in base al contenuto estratto
  • Spiega perché è stata effettuata ogni suddivisione

Guida rapida

Due endpoint: carichi direttamente un file oppure passi un URL e lo recupereremo noi. Usi mode=smart with instructions per dire all’AI come rilevare i confini.

POST /api/v1/pdf-split - caricamento file multipart

Shell
curl -X POST https://www.renamed.to/api/v1/pdf-split \  -H "Authorization: Bearer YOUR_API_TOKEN" \  -F "file=@mixed_documents.pdf" \  -F "mode=smart" \  -F 'instructions=Split when you detect a new document.Look for: invoice headers, "Page 1 of X", or new letterhead.Keep cover letters with their attachments.'

POST /api/v1/pdf-split/from-url - body JSON, il server recupera il file

Shell
curl -X POST https://www.renamed.to/api/v1/pdf-split/from-url \  -H "Authorization: Bearer YOUR_API_TOKEN" \  -H "Content-Type: application/json" \  -d '{    "url": "https://example.com/scanned-stack.pdf",    "mode": "smart",    "instructions": "Separate by patient name.\nEach patient'"'"'s records should be one file.\nInclude all pages until you see a new patient header."  }'

SDK

Usi i nostri SDK ufficiali per un’esperienza sviluppatore migliore con type safety e gestione degli errori.

SDK TypeScript

TypeScript
import { RenamedClient } from '@renamed/sdk'const client = new RenamedClient({ apiKey: process.env.RENAMED_API_KEY })// AI reads the bundle, detects boundaries, names each splitconst job = await client.pdfSplit('./mixed_invoices.pdf', {  mode: 'smart',  instructions: `Split when you detect a new invoice.Look for: company letterhead, "Invoice #", or "Page 1 of X".Each vendor's invoice should be separate.`})// Poll for completionconst result = await job.waitForCompletion()console.log(result.splits)// => [{ filename: "2025-01-15_AcmeCorp_Invoice_001.pdf", reason: "New invoice detected - Acme Corp header" }, ...]

Risposta

JSON
{  "jobId": "abc123",  "status": "completed",  "progress": 100,  "results": {    "results": [{      "originalFilename": "mixed_documents.pdf",      "splits": [{        "filename": "2025-01-15_AcmeCorp_Invoice_001.pdf",        "downloadUrl": "https://...",        "expiresAt": "2025-01-16T12:00:00Z",        "pages": 3,        "reason": "New invoice detected - Acme Corp header"      },      {        "filename": "2025-01-14_GlobeTech_Invoice_002.pdf",        "downloadUrl": "https://...",        "expiresAt": "2025-01-16T12:00:00Z",        "pages": 2,        "reason": "New vendor letterhead - GlobeTech Inc"      }]    }]  },  "creditsUsed": 2}

SDK su GitHub: github.com/renamed-to/renamed-sdk

Autenticazione

Tutte le richieste API richiedono autenticazione tramite token Bearer nell’header Authorization .

API Token (consigliato)

Generi i token API da Impostazioni → Token API. I token hanno il prefisso rt_ e forniscono accesso completo al Suo account.

Authorization: Bearer rt_abc123def456...

OAuth 2.0

Per le app che eseguono l’autenticazione per conto degli utenti, usi OAuth 2.0. Al termine del flusso OAuth, riceverà un access token che funziona allo stesso modo:

Authorization: Bearer <oauth_access_token>

Veda la documentazione API per la registrazione del client OAuth e i dettagli del flusso.

Parametri API

Parametri chiave per controllare il comportamento della suddivisione.

ParametroTipoObbligatorioValori / Note
fileFileSì*Caricamento di un singolo file. *Almeno uno tra file o files[] obbligatorio.
files[]File[]Sì*Più file per l’elaborazione in batch.
modestringNoPredefinito: smart.Valori: smart | every-n-pages | by-bookmarks
instructionsstringNoSolo per la modalità smart . Istruzioni in linguaggio naturale per il rilevamento dei confini. Massimo 5,000 caratteri.
pagesPerSplitintegerSì se mode=every-n-pagesNumero di pagine per suddivisione. Intervallo: 1-1000.

Endpoint URL (/api/v1/pdf-split/from-url)

Stessi parametri sopra, ma invece di file/files[], usi url (string) o urls (string[]).

Cosa possono fare le Sue istruzioni

L’AI interpreta il linguaggio naturale e applica un rilevamento dei confini complesso che richiederebbe codice personalizzato per essere realizzato da zero.

Rilevamento dei confini
"Split when you see 'Page 1 of X' or a new company letterhead"
Raggruppamento documenti
"Keep cover letters with their attachments. Don't split appendices from main documents."
Suddivisione basata su entità
"Separate by patient name - each patient's records should be one file"
Rilevamento intestazioni
"Each PURCHASE ORDER starts a new document. Invoice headers also indicate new documents."

Modalità di suddivisione

Scelga la modalità più adatta al Suo caso d’uso. La modalità smart è quella predefinita.

smartpredefinita

L’AI rileva automaticamente i confini dei documenti. Facoltativamente, fornisca instructions per guidare il rilevamento dei confini.

every-n-pages

Suddivide a intervalli fissi. Richiede il parametro pagesPerSplit (1-1000).

by-bookmarks

Suddivide ai confini dei segnalibri PDF. Richiede che il PDF di origine abbia segnalibri.

Progettato per la produzione

Limiti

  • Dimensione file: max 100 MB
  • Formati: Solo PDF
  • Istruzioni: 5,000 caratteri max
  • Pagine per suddivisione: 1-1,000 (per la modalità every-n-pages)
  • Elaborazione: 30s-2min tipico

Errori comuni

  • 400 no_files Nessun file fornito
  • 400 invalid_file_type Non è un PDF
  • 400 file_too_large Supera 100MB
  • 401 unauthorized API key mancante o non valida
  • 402 insufficient_credits Crediti insufficienti
  • 404 not_found Processo non trovato

Sicurezza: Tutte le richieste avvengono tramite TLS. L’endpoint /from-url blocca localhost e gli intervalli IP privati.

Prezzi

1 credito ogni 3 pagine (arrotondato per eccesso). Poi $9 per 1,000 crediti.

  • 50 crediti gratuiti alla registrazione
  • Crediti validi per 12 mesi
  • Garanzia di rimborso di 30 giorni
Veda i dettagli dei prezzi

Come iniziare

Quattro passaggi per integrare la PDF Split API nel Suo flusso di lavoro.

1

Ottenga il Suo API token

Generi un API token dalla Sua dashboard. Riceve 50 crediti gratuiti alla registrazione.

2

Carichi il PDF o fornisca un URL

Invii a /api/v1/pdf-split (caricamento file) o /api/v1/pdf-split/from-url (URL). Includa le Sue instructions per la modalità smart.

3

Interroghi l’endpoint di stato

La risposta iniziale include un statusUrl. Interroghi /api/v1/pdf-split/status/{jobId} fino a status=completed.

4

Scarichi i file suddivisi

Ogni suddivisione include un downloadUrl. Gli URL scadono in 24 ore. Il campo reason spiega perché è stato rilevato ciascun confine.

FAQ

Come funziona il rilevamento dei confini con AI?
In modalità "smart", l’AI analizza il contenuto del documento per identificare dove finisce un documento e ne inizia un altro. Rileva cambiamenti nell’intestazione, nel tipo di documento, nel fornitore, nei pattern "Page 1 of X" e negli elementi strutturali. Può guidarla con istruzioni in linguaggio naturale.
Cosa posso inserire nel parametro instructions?
Linguaggio naturale che descrive come rilevare i confini. Esempi: "Split when you see a new invoice header or Page 1 of X", "Each document starts with a cover letter followed by attachments", "Separate by patient name - each patient's records should be one file".
Quanto tempo richiede l’elaborazione?
La maggior parte dei processi si completa in 30 secondi o 2 minuti a seconda della dimensione del file e del numero di pagine. L’API è asincrona: invia un processo e verifica periodicamente il completamento.
Qual è la dimensione massima del file?
File PDF fino a 100MB. Non esiste un limite rigido di pagine, ma i documenti molto grandi possono richiedere più tempo per l’elaborazione.
Come vengono nominati i file suddivisi?
In modalità smart, l’AI genera nomi file descrittivi in base al contenuto del documento, estraendo date, fornitori, tipi di documento e altre entità. Ogni suddivisione include anche un campo "reason" che spiega perché è stato rilevato il confine.
In cosa è diverso dai tradizionali splitter PDF?
Gli splitter tradizionali lavorano su numeri di pagina o segnalibri. Questa API legge il contenuto del documento, ne comprende il significato e applica le Sue istruzioni in linguaggio naturale. Può suddividere per fornitore, paziente, tipo di documento o qualsiasi confine semantico: cose impossibili con strumenti basati sulle pagine.