Séparez des PDF avec des instructions en langage naturel
Dites à l’IA comment séparer en anglais courant. Elle lit le contenu du document, détecte les limites et nomme chaque fichier - des choses que les séparateurs basés sur les pages ne pourraient jamais faire.
- Détection des limites par IA - avec instructions personnalisées
- 3 modes de séparation - smart, intervalles fixes, signets
- Traitement par lot - plusieurs PDF dans une seule requête
- Nommage automatique - fichiers séparés nommés selon le contenu
Vous avez juste besoin de séparer quelques fichiers ? Utiliser l'outil web gratuit
Votre instruction : "Divise le document quand tu vois un nouvel en-tête de facture ou 'Page 1 sur X'. Les documents de chaque fournisseur doivent être séparés."
Entrée
PDF contenant : 12 factures de 5 fournisseurs, dates mélangées, nombres de pages variables
Sortie IA
reason: "Nouvelle facture détectée - en-tête Acme Corp"
reason: "Nouveau papier à en-tête fournisseur - GlobeTech Inc"
Pourquoi la séparation par IA est meilleure que les outils basés sur les pages
Les séparateurs basés sur les pages comptent les pages. L’IA lit le contenu et comprend les limites.
Entrée :
mixed_invoices.pdf (47 pages)
Séparer toutes les :
5 pages
Sortie :
split_1.pdf, split_2.pdf, ... (limites incorrectes)
- Ne peut pas détecter où les documents commencent/se terminent réellement
- Coupe les factures en deux, mélange les fournisseurs
- Noms de fichiers génériques (split_1, split_2...)
- Ne peut pas comprendre le contenu du document
Entrée :
mixed_invoices.pdf (47 pages)
Instruction :
"Divise quand tu vois un nouvel en-tête de facture ou un nouveau papier à en-tête de fournisseur"
Sortie :
2025-01-15_AcmeCorp_Invoice_001.pdf (3 pages)
- Détecte les limites réelles des documents à partir du contenu
- Suit vos instructions en langage naturel
- Nomme automatiquement les fichiers selon le contenu extrait
- Explique pourquoi chaque séparation a été effectuée
Démarrage rapide
Deux endpoints : téléchargez un fichier directement, ou passez une URL et nous le récupérerons. Utilisez mode=smart with instructions pour indiquer à l’IA comment détecter les limites.
POST /api/v1/pdf-split - téléversement de fichier multipart
curl -X POST https://www.renamed.to/api/v1/pdf-split \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -F "file=@mixed_documents.pdf" \ -F "mode=smart" \ -F 'instructions=Split when you detect a new document.Look for: invoice headers, "Page 1 of X", or new letterhead.Keep cover letters with their attachments.'POST /api/v1/pdf-split/from-url - corps JSON, le serveur récupère le fichier
curl -X POST https://www.renamed.to/api/v1/pdf-split/from-url \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -H "Content-Type: application/json" \ -d '{ "url": "https://example.com/scanned-stack.pdf", "mode": "smart", "instructions": "Separate by patient name.\nEach patient'"'"'s records should be one file.\nInclude all pages until you see a new patient header." }'SDK
Utilisez nos SDK officiels pour une meilleure expérience développeur avec sûreté de type et gestion des erreurs.
SDK TypeScript
import { RenamedClient } from '@renamed/sdk'const client = new RenamedClient({ apiKey: process.env.RENAMED_API_KEY })// AI reads the bundle, detects boundaries, names each splitconst job = await client.pdfSplit('./mixed_invoices.pdf', { mode: 'smart', instructions: `Split when you detect a new invoice.Look for: company letterhead, "Invoice #", or "Page 1 of X".Each vendor's invoice should be separate.`})// Poll for completionconst result = await job.waitForCompletion()console.log(result.splits)// => [{ filename: "2025-01-15_AcmeCorp_Invoice_001.pdf", reason: "New invoice detected - Acme Corp header" }, ...]Réponse
{ "jobId": "abc123", "status": "completed", "progress": 100, "results": { "results": [{ "originalFilename": "mixed_documents.pdf", "splits": [{ "filename": "2025-01-15_AcmeCorp_Invoice_001.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 3, "reason": "New invoice detected - Acme Corp header" }, { "filename": "2025-01-14_GlobeTech_Invoice_002.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 2, "reason": "New vendor letterhead - GlobeTech Inc" }] }] }, "creditsUsed": 2}SDK sur GitHub : github.com/renamed-to/renamed-sdk
Authentification
Toutes les requêtes API nécessitent une authentification via un token Bearer dans l’en-tête Authorization .
Token API (recommandé)
Générez des tokens API depuis Paramètres → Jetons API. Les tokens sont préfixés par rt_ et fournissent un accès complet à votre compte.
Authorization: Bearer rt_abc123def456...OAuth 2.0
Pour les applications qui s’authentifient au nom des utilisateurs, utilisez OAuth 2.0. Une fois le flux OAuth terminé, vous recevez un token d’accès qui fonctionne de la même manière :
Authorization: Bearer <oauth_access_token>Voir la documentation de l'API pour l’enregistrement du client OAuth et les détails du flux.
Paramètres de l'API
Paramètres clés pour contrôler le comportement de séparation.
| Paramètre | Type | Obligatoire | Valeurs / Notes |
|---|---|---|---|
file | File | Oui* | Téléversement d’un seul fichier. *Au moins un de file ou files[] est requis. |
files[] | File[] | Oui* | Plusieurs fichiers pour le traitement par lot. |
mode | string | Non | Par défaut : smart.Valeurs : smart | every-n-pages | by-bookmarks |
instructions | string | Non | Pour le mode smart uniquement. Instructions en langage naturel pour la détection des limites. Max 5,000 caractères. |
pagesPerSplit | integer | Oui si mode= | Nombre de pages par séparation. Plage : 1-1000. |
Endpoint URL (/api/v1/pdf-split/from-url)
Mêmes paramètres que ci-dessus, mais au lieu de file/files[], utilisez url (string) ou urls (string[]).
Ce que vos instructions peuvent faire
L’IA interprète le langage naturel et applique une détection complexe des limites qui nécessiterait du code personnalisé si vous la développiez vous-même.
- Détection des limites
"Split when you see 'Page 1 of X' or a new company letterhead"- Regroupement de documents
"Keep cover letters with their attachments. Don't split appendices from main documents."- Séparation basée sur les entités
"Separate by patient name - each patient's records should be one file"- Détection des en-têtes
"Each PURCHASE ORDER starts a new document. Invoice headers also indicate new documents."
Modes de séparation
Choisissez le mode adapté à votre cas d’usage. Le mode smart est le mode par défaut.
smartpar défautL’IA détecte automatiquement les limites des documents. Vous pouvez éventuellement fournir instructions pour guider la détection des limites.
every-n-pagesSépare à intervalles fixes. Nécessite le paramètre pagesPerSplit (1-1000).
by-bookmarksSépare aux limites des signets PDF. Nécessite que le PDF source comporte des signets.
Conçu pour la production
Limites
- Taille du fichier : 100 Mo max.
- Formats : PDF uniquement
- Instructions : 5,000 caractères max
- Pages par séparation : 1-1,000 (pour le mode every-n-pages)
- Traitement : 30s-2min typique
Erreurs courantes
400 no_filesAucun fichier fourni400 invalid_file_typeN'est pas un PDF400 file_too_largeDépasse 100MB401 unauthorizedClé API manquante ou invalide402 insufficient_creditsCrédits insuffisants404 not_foundTâche introuvable
Sécurité : Toutes les requêtes passent par TLS. L’endpoint /from-url bloque localhost et les plages IP privées.
Tarification
1 crédit pour 3 pages (arrondi au supérieur). Puis $9 pour 1,000 crédits.
- 50 crédits gratuits à l'inscription
- Crédits valables pendant 12 mois
- Garantie de remboursement de 30 jours
Premiers pas
Quatre étapes pour intégrer l’API de séparation PDF dans votre workflow.
Obtenez votre token API
Générez un token API depuis votre tableau de bord. Vous obtenez 50 crédits gratuits à l’inscription.
Téléversez un PDF ou fournissez une URL
Soumettez à /api/v1/pdf-split (téléversement de fichier) ou /api/v1/pdf-split/from-url (URL). Incluez vos instructions pour le mode smart.
Interrogez l'endpoint de statut
La réponse initiale inclut un statusUrl. Interrogez /api/v1/pdf-split/status/{jobId} jusqu’à status=completed.
Téléchargez les fichiers séparés
Chaque séparation inclut un downloadUrl. Les URL expirent au bout de 24 heures. Le champ reason explique pourquoi chaque limite a été détectée.
FAQ
- Comment fonctionne la détection des limites par IA ?
- En mode "smart", l’IA analyse le contenu du document pour identifier où un document se termine et où un autre commence. Elle détecte les changements d’en-tête, de type de document, de fournisseur, les motifs "Page 1 of X" et les éléments structurels. Vous pouvez l’orienter avec des instructions en langage naturel.
- Que puis-je mettre dans le paramètre instructions ?
- Du langage naturel décrivant comment détecter les limites. Exemples : "Split when you see a new invoice header or Page 1 of X", "Each document starts with a cover letter followed by attachments", "Separate by patient name - each patient's records should be one file".
- Combien de temps prend le traitement ?
- La plupart des traitements se terminent en 30 secondes à 2 minutes selon la taille du fichier et le nombre de pages. L’API est asynchrone - vous soumettez une tâche et interrogez son état jusqu’à la fin.
- Quelle est la taille maximale de fichier ?
- Fichiers PDF jusqu’à 100MB. Il n’y a pas de limite stricte de pages, mais les très gros documents peuvent prendre plus de temps à traiter.
- Comment les fichiers séparés sont-ils nommés ?
- En mode smart, l’IA génère des noms de fichiers descriptifs à partir du contenu du document - en extrayant des dates, des fournisseurs, des types de document et d’autres entités. Chaque séparation inclut aussi un champ "reason" expliquant pourquoi la limite a été détectée.
- En quoi est-ce différent des séparateurs PDF traditionnels ?
- Les séparateurs traditionnels fonctionnent avec des numéros de page ou des signets. Cette API lit le contenu du document, en comprend le sens et applique vos instructions en langage naturel. Elle peut séparer par fournisseur, patient, type de document ou toute autre limite sémantique - des choses impossibles avec des outils basés sur les pages.