Suddivida i PDF con Istruzioni in linguaggio naturale
Dica all’AI come suddividere in inglese semplice. Legge il contenuto del documento, rileva i confini e assegna un nome a ogni file: cose che gli splitter basati sulle pagine non potrebbero mai fare.
- Rilevamento dei confini con AI - con istruzioni personalizzate
- 3 modalità di suddivisione - smart, intervalli fissi, segnalibri
- Elaborazione in batch - più PDF in una richiesta
- Denominazione automatica - file suddivisi nominati in base al contenuto
Deve solo suddividere alcuni file? Usi lo strumento web gratuito
La Sua istruzione: "Dividi quando vedi una nuova intestazione di fattura o 'Pagina 1 di X'. I documenti di ogni fornitore devono essere separati."
Input
PDF contenente: 12 fatture di 5 fornitori, date miste, conteggi di pagina variabili
Output AI
reason: "Nuova fattura rilevata - intestazione Acme Corp"
reason: "Nuova carta intestata fornitore - GlobeTech Inc"
Perché la suddivisione con AI supera gli strumenti basati sulle pagine
Gli splitter basati sulle pagine contano le pagine. L’AI legge il contenuto e comprende i confini.
Input:
mixed_invoices.pdf (47 pagine)
Suddividi ogni:
5 pagine
Output:
split_1.pdf, split_2.pdf, ... (confini errati)
- Non può rilevare dove i documenti iniziano/finiscono davvero
- Taglia le fatture a metà, mescola i fornitori
- Nomi file generici (split_1, split_2...)
- Non può comprendere il contenuto del documento
Input:
mixed_invoices.pdf (47 pagine)
Istruzione:
"Dividi quando vedi una nuova intestazione di fattura o una nuova carta intestata del fornitore"
Output:
2025-01-15_AcmeCorp_Invoice_001.pdf (3 pagine)
- Rileva i confini reali dei documenti dal contenuto
- Segue le Sue istruzioni in linguaggio naturale
- Assegna automaticamente nomi ai file in base al contenuto estratto
- Spiega perché è stata effettuata ogni suddivisione
Guida rapida
Due endpoint: carichi direttamente un file oppure passi un URL e lo recupereremo noi. Usi mode=smart with instructions per dire all’AI come rilevare i confini.
POST /api/v1/pdf-split - caricamento file multipart
curl -X POST https://www.renamed.to/api/v1/pdf-split \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -F "file=@mixed_documents.pdf" \ -F "mode=smart" \ -F 'instructions=Split when you detect a new document.Look for: invoice headers, "Page 1 of X", or new letterhead.Keep cover letters with their attachments.'POST /api/v1/pdf-split/from-url - body JSON, il server recupera il file
curl -X POST https://www.renamed.to/api/v1/pdf-split/from-url \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -H "Content-Type: application/json" \ -d '{ "url": "https://example.com/scanned-stack.pdf", "mode": "smart", "instructions": "Separate by patient name.\nEach patient'"'"'s records should be one file.\nInclude all pages until you see a new patient header." }'SDK
Usi i nostri SDK ufficiali per un’esperienza sviluppatore migliore con type safety e gestione degli errori.
SDK TypeScript
import { RenamedClient } from '@renamed/sdk'const client = new RenamedClient({ apiKey: process.env.RENAMED_API_KEY })// AI reads the bundle, detects boundaries, names each splitconst job = await client.pdfSplit('./mixed_invoices.pdf', { mode: 'smart', instructions: `Split when you detect a new invoice.Look for: company letterhead, "Invoice #", or "Page 1 of X".Each vendor's invoice should be separate.`})// Poll for completionconst result = await job.waitForCompletion()console.log(result.splits)// => [{ filename: "2025-01-15_AcmeCorp_Invoice_001.pdf", reason: "New invoice detected - Acme Corp header" }, ...]Risposta
{ "jobId": "abc123", "status": "completed", "progress": 100, "results": { "results": [{ "originalFilename": "mixed_documents.pdf", "splits": [{ "filename": "2025-01-15_AcmeCorp_Invoice_001.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 3, "reason": "New invoice detected - Acme Corp header" }, { "filename": "2025-01-14_GlobeTech_Invoice_002.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 2, "reason": "New vendor letterhead - GlobeTech Inc" }] }] }, "creditsUsed": 2}SDK su GitHub: github.com/renamed-to/renamed-sdk
Autenticazione
Tutte le richieste API richiedono autenticazione tramite token Bearer nell’header Authorization .
API Token (consigliato)
Generi i token API da Impostazioni → Token API. I token hanno il prefisso rt_ e forniscono accesso completo al Suo account.
Authorization: Bearer rt_abc123def456...OAuth 2.0
Per le app che eseguono l’autenticazione per conto degli utenti, usi OAuth 2.0. Al termine del flusso OAuth, riceverà un access token che funziona allo stesso modo:
Authorization: Bearer <oauth_access_token>Veda la documentazione API per la registrazione del client OAuth e i dettagli del flusso.
Parametri API
Parametri chiave per controllare il comportamento della suddivisione.
| Parametro | Tipo | Obbligatorio | Valori / Note |
|---|---|---|---|
file | File | Sì* | Caricamento di un singolo file. *Almeno uno tra file o files[] obbligatorio. |
files[] | File[] | Sì* | Più file per l’elaborazione in batch. |
mode | string | No | Predefinito: smart.Valori: smart | every-n-pages | by-bookmarks |
instructions | string | No | Solo per la modalità smart . Istruzioni in linguaggio naturale per il rilevamento dei confini. Massimo 5,000 caratteri. |
pagesPerSplit | integer | Sì se mode= | Numero di pagine per suddivisione. Intervallo: 1-1000. |
Endpoint URL (/api/v1/pdf-split/from-url)
Stessi parametri sopra, ma invece di file/files[], usi url (string) o urls (string[]).
Cosa possono fare le Sue istruzioni
L’AI interpreta il linguaggio naturale e applica un rilevamento dei confini complesso che richiederebbe codice personalizzato per essere realizzato da zero.
- Rilevamento dei confini
"Split when you see 'Page 1 of X' or a new company letterhead"- Raggruppamento documenti
"Keep cover letters with their attachments. Don't split appendices from main documents."- Suddivisione basata su entità
"Separate by patient name - each patient's records should be one file"- Rilevamento intestazioni
"Each PURCHASE ORDER starts a new document. Invoice headers also indicate new documents."
Modalità di suddivisione
Scelga la modalità più adatta al Suo caso d’uso. La modalità smart è quella predefinita.
smartpredefinitaL’AI rileva automaticamente i confini dei documenti. Facoltativamente, fornisca instructions per guidare il rilevamento dei confini.
every-n-pagesSuddivide a intervalli fissi. Richiede il parametro pagesPerSplit (1-1000).
by-bookmarksSuddivide ai confini dei segnalibri PDF. Richiede che il PDF di origine abbia segnalibri.
Progettato per la produzione
Limiti
- Dimensione file: max 100 MB
- Formati: Solo PDF
- Istruzioni: 5,000 caratteri max
- Pagine per suddivisione: 1-1,000 (per la modalità every-n-pages)
- Elaborazione: 30s-2min tipico
Errori comuni
400 no_filesNessun file fornito400 invalid_file_typeNon è un PDF400 file_too_largeSupera 100MB401 unauthorizedAPI key mancante o non valida402 insufficient_creditsCrediti insufficienti404 not_foundProcesso non trovato
Sicurezza: Tutte le richieste avvengono tramite TLS. L’endpoint /from-url blocca localhost e gli intervalli IP privati.
Prezzi
1 credito ogni 3 pagine (arrotondato per eccesso). Poi $9 per 1,000 crediti.
- 50 crediti gratuiti alla registrazione
- Crediti validi per 12 mesi
- Garanzia di rimborso di 30 giorni
Come iniziare
Quattro passaggi per integrare la PDF Split API nel Suo flusso di lavoro.
Ottenga il Suo API token
Generi un API token dalla Sua dashboard. Riceve 50 crediti gratuiti alla registrazione.
Carichi il PDF o fornisca un URL
Invii a /api/v1/pdf-split (caricamento file) o /api/v1/pdf-split/from-url (URL). Includa le Sue instructions per la modalità smart.
Interroghi l’endpoint di stato
La risposta iniziale include un statusUrl. Interroghi /api/v1/pdf-split/status/{jobId} fino a status=completed.
Scarichi i file suddivisi
Ogni suddivisione include un downloadUrl. Gli URL scadono in 24 ore. Il campo reason spiega perché è stato rilevato ciascun confine.
FAQ
- Come funziona il rilevamento dei confini con AI?
- In modalità "smart", l’AI analizza il contenuto del documento per identificare dove finisce un documento e ne inizia un altro. Rileva cambiamenti nell’intestazione, nel tipo di documento, nel fornitore, nei pattern "Page 1 of X" e negli elementi strutturali. Può guidarla con istruzioni in linguaggio naturale.
- Cosa posso inserire nel parametro instructions?
- Linguaggio naturale che descrive come rilevare i confini. Esempi: "Split when you see a new invoice header or Page 1 of X", "Each document starts with a cover letter followed by attachments", "Separate by patient name - each patient's records should be one file".
- Quanto tempo richiede l’elaborazione?
- La maggior parte dei processi si completa in 30 secondi o 2 minuti a seconda della dimensione del file e del numero di pagine. L’API è asincrona: invia un processo e verifica periodicamente il completamento.
- Qual è la dimensione massima del file?
- File PDF fino a 100MB. Non esiste un limite rigido di pagine, ma i documenti molto grandi possono richiedere più tempo per l’elaborazione.
- Come vengono nominati i file suddivisi?
- In modalità smart, l’AI genera nomi file descrittivi in base al contenuto del documento, estraendo date, fornitori, tipi di documento e altre entità. Ogni suddivisione include anche un campo "reason" che spiega perché è stato rilevato il confine.
- In cosa è diverso dai tradizionali splitter PDF?
- Gli splitter tradizionali lavorano su numeri di pagina o segnalibri. Questa API legge il contenuto del documento, ne comprende il significato e applica le Sue istruzioni in linguaggio naturale. Può suddividere per fornitore, paziente, tipo di documento o qualsiasi confine semantico: cose impossibili con strumenti basati sulle pagine.