Aller au contenu principal
Renamed.to logorenamed.to
API de séparation PDF

Séparez des PDF avec des instructions en langage naturel

Dites à l’IA comment séparer en anglais courant. Elle lit le contenu du document, détecte les limites et nomme chaque fichier - des choses que les séparateurs basés sur les pages ne pourraient jamais faire.

  • Détection des limites par IA - avec instructions personnalisées
  • 3 modes de séparation - smart, intervalles fixes, signets
  • Traitement par lot - plusieurs PDF dans une seule requête
  • Nommage automatique - fichiers séparés nommés selon le contenu

Vous avez juste besoin de séparer quelques fichiers ? Utiliser l'outil web gratuit

Votre instruction : "Divise le document quand tu vois un nouvel en-tête de facture ou 'Page 1 sur X'. Les documents de chaque fournisseur doivent être séparés."

Entrée

mixed_invoices_q4.pdf47 pages

PDF contenant : 12 factures de 5 fournisseurs, dates mélangées, nombres de pages variables

Sortie IA

2025-01-15_AcmeCorp_Invoice_001.pdf3 pages

reason: "Nouvelle facture détectée - en-tête Acme Corp"

2025-01-14_GlobeTech_Invoice_002.pdf2 pages

reason: "Nouveau papier à en-tête fournisseur - GlobeTech Inc"

...et 10 documents supplémentaires

Pourquoi la séparation par IA est meilleure que les outils basés sur les pages

Les séparateurs basés sur les pages comptent les pages. L’IA lit le contenu et comprend les limites.

Séparation manuelle / basée sur les pages

Entrée :

mixed_invoices.pdf (47 pages)

Séparer toutes les :

5 pages

Sortie :

split_1.pdf, split_2.pdf, ... (limites incorrectes)

  • Ne peut pas détecter où les documents commencent/se terminent réellement
  • Coupe les factures en deux, mélange les fournisseurs
  • Noms de fichiers génériques (split_1, split_2...)
  • Ne peut pas comprendre le contenu du document
IA avec instructions personnalisées

Entrée :

mixed_invoices.pdf (47 pages)

Instruction :

"Divise quand tu vois un nouvel en-tête de facture ou un nouveau papier à en-tête de fournisseur"

Sortie :

2025-01-15_AcmeCorp_Invoice_001.pdf (3 pages)

  • Détecte les limites réelles des documents à partir du contenu
  • Suit vos instructions en langage naturel
  • Nomme automatiquement les fichiers selon le contenu extrait
  • Explique pourquoi chaque séparation a été effectuée

Démarrage rapide

Deux endpoints : téléchargez un fichier directement, ou passez une URL et nous le récupérerons. Utilisez mode=smart with instructions pour indiquer à l’IA comment détecter les limites.

POST /api/v1/pdf-split - téléversement de fichier multipart

Shell
curl -X POST https://www.renamed.to/api/v1/pdf-split \  -H "Authorization: Bearer YOUR_API_TOKEN" \  -F "file=@mixed_documents.pdf" \  -F "mode=smart" \  -F 'instructions=Split when you detect a new document.Look for: invoice headers, "Page 1 of X", or new letterhead.Keep cover letters with their attachments.'

POST /api/v1/pdf-split/from-url - corps JSON, le serveur récupère le fichier

Shell
curl -X POST https://www.renamed.to/api/v1/pdf-split/from-url \  -H "Authorization: Bearer YOUR_API_TOKEN" \  -H "Content-Type: application/json" \  -d '{    "url": "https://example.com/scanned-stack.pdf",    "mode": "smart",    "instructions": "Separate by patient name.\nEach patient'"'"'s records should be one file.\nInclude all pages until you see a new patient header."  }'

SDK

Utilisez nos SDK officiels pour une meilleure expérience développeur avec sûreté de type et gestion des erreurs.

SDK TypeScript

TypeScript
import { RenamedClient } from '@renamed/sdk'const client = new RenamedClient({ apiKey: process.env.RENAMED_API_KEY })// AI reads the bundle, detects boundaries, names each splitconst job = await client.pdfSplit('./mixed_invoices.pdf', {  mode: 'smart',  instructions: `Split when you detect a new invoice.Look for: company letterhead, "Invoice #", or "Page 1 of X".Each vendor's invoice should be separate.`})// Poll for completionconst result = await job.waitForCompletion()console.log(result.splits)// => [{ filename: "2025-01-15_AcmeCorp_Invoice_001.pdf", reason: "New invoice detected - Acme Corp header" }, ...]

Réponse

JSON
{  "jobId": "abc123",  "status": "completed",  "progress": 100,  "results": {    "results": [{      "originalFilename": "mixed_documents.pdf",      "splits": [{        "filename": "2025-01-15_AcmeCorp_Invoice_001.pdf",        "downloadUrl": "https://...",        "expiresAt": "2025-01-16T12:00:00Z",        "pages": 3,        "reason": "New invoice detected - Acme Corp header"      },      {        "filename": "2025-01-14_GlobeTech_Invoice_002.pdf",        "downloadUrl": "https://...",        "expiresAt": "2025-01-16T12:00:00Z",        "pages": 2,        "reason": "New vendor letterhead - GlobeTech Inc"      }]    }]  },  "creditsUsed": 2}

SDK sur GitHub : github.com/renamed-to/renamed-sdk

Authentification

Toutes les requêtes API nécessitent une authentification via un token Bearer dans l’en-tête Authorization .

Token API (recommandé)

Générez des tokens API depuis Paramètres → Jetons API. Les tokens sont préfixés par rt_ et fournissent un accès complet à votre compte.

Authorization: Bearer rt_abc123def456...

OAuth 2.0

Pour les applications qui s’authentifient au nom des utilisateurs, utilisez OAuth 2.0. Une fois le flux OAuth terminé, vous recevez un token d’accès qui fonctionne de la même manière :

Authorization: Bearer <oauth_access_token>

Voir la documentation de l'API pour l’enregistrement du client OAuth et les détails du flux.

Paramètres de l'API

Paramètres clés pour contrôler le comportement de séparation.

ParamètreTypeObligatoireValeurs / Notes
fileFileOui*Téléversement d’un seul fichier. *Au moins un de file ou files[] est requis.
files[]File[]Oui*Plusieurs fichiers pour le traitement par lot.
modestringNonPar défaut : smart.Valeurs : smart | every-n-pages | by-bookmarks
instructionsstringNonPour le mode smart uniquement. Instructions en langage naturel pour la détection des limites. Max 5,000 caractères.
pagesPerSplitintegerOui si mode=every-n-pagesNombre de pages par séparation. Plage : 1-1000.

Endpoint URL (/api/v1/pdf-split/from-url)

Mêmes paramètres que ci-dessus, mais au lieu de file/files[], utilisez url (string) ou urls (string[]).

Ce que vos instructions peuvent faire

L’IA interprète le langage naturel et applique une détection complexe des limites qui nécessiterait du code personnalisé si vous la développiez vous-même.

Détection des limites
"Split when you see 'Page 1 of X' or a new company letterhead"
Regroupement de documents
"Keep cover letters with their attachments. Don't split appendices from main documents."
Séparation basée sur les entités
"Separate by patient name - each patient's records should be one file"
Détection des en-têtes
"Each PURCHASE ORDER starts a new document. Invoice headers also indicate new documents."

Modes de séparation

Choisissez le mode adapté à votre cas d’usage. Le mode smart est le mode par défaut.

smartpar défaut

L’IA détecte automatiquement les limites des documents. Vous pouvez éventuellement fournir instructions pour guider la détection des limites.

every-n-pages

Sépare à intervalles fixes. Nécessite le paramètre pagesPerSplit (1-1000).

by-bookmarks

Sépare aux limites des signets PDF. Nécessite que le PDF source comporte des signets.

Conçu pour la production

Limites

  • Taille du fichier : 100 Mo max.
  • Formats : PDF uniquement
  • Instructions : 5,000 caractères max
  • Pages par séparation : 1-1,000 (pour le mode every-n-pages)
  • Traitement : 30s-2min typique

Erreurs courantes

  • 400 no_files Aucun fichier fourni
  • 400 invalid_file_type N'est pas un PDF
  • 400 file_too_large Dépasse 100MB
  • 401 unauthorized Clé API manquante ou invalide
  • 402 insufficient_credits Crédits insuffisants
  • 404 not_found Tâche introuvable

Sécurité : Toutes les requêtes passent par TLS. L’endpoint /from-url bloque localhost et les plages IP privées.

Tarification

1 crédit pour 3 pages (arrondi au supérieur). Puis $9 pour 1,000 crédits.

  • 50 crédits gratuits à l'inscription
  • Crédits valables pendant 12 mois
  • Garantie de remboursement de 30 jours
Voir les détails tarifaires

Premiers pas

Quatre étapes pour intégrer l’API de séparation PDF dans votre workflow.

1

Obtenez votre token API

Générez un token API depuis votre tableau de bord. Vous obtenez 50 crédits gratuits à l’inscription.

2

Téléversez un PDF ou fournissez une URL

Soumettez à /api/v1/pdf-split (téléversement de fichier) ou /api/v1/pdf-split/from-url (URL). Incluez vos instructions pour le mode smart.

3

Interrogez l'endpoint de statut

La réponse initiale inclut un statusUrl. Interrogez /api/v1/pdf-split/status/{jobId} jusqu’à status=completed.

4

Téléchargez les fichiers séparés

Chaque séparation inclut un downloadUrl. Les URL expirent au bout de 24 heures. Le champ reason explique pourquoi chaque limite a été détectée.

FAQ

Comment fonctionne la détection des limites par IA ?
En mode "smart", l’IA analyse le contenu du document pour identifier où un document se termine et où un autre commence. Elle détecte les changements d’en-tête, de type de document, de fournisseur, les motifs "Page 1 of X" et les éléments structurels. Vous pouvez l’orienter avec des instructions en langage naturel.
Que puis-je mettre dans le paramètre instructions ?
Du langage naturel décrivant comment détecter les limites. Exemples : "Split when you see a new invoice header or Page 1 of X", "Each document starts with a cover letter followed by attachments", "Separate by patient name - each patient's records should be one file".
Combien de temps prend le traitement ?
La plupart des traitements se terminent en 30 secondes à 2 minutes selon la taille du fichier et le nombre de pages. L’API est asynchrone - vous soumettez une tâche et interrogez son état jusqu’à la fin.
Quelle est la taille maximale de fichier ?
Fichiers PDF jusqu’à 100MB. Il n’y a pas de limite stricte de pages, mais les très gros documents peuvent prendre plus de temps à traiter.
Comment les fichiers séparés sont-ils nommés ?
En mode smart, l’IA génère des noms de fichiers descriptifs à partir du contenu du document - en extrayant des dates, des fournisseurs, des types de document et d’autres entités. Chaque séparation inclut aussi un champ "reason" expliquant pourquoi la limite a été détectée.
En quoi est-ce différent des séparateurs PDF traditionnels ?
Les séparateurs traditionnels fonctionnent avec des numéros de page ou des signets. Cette API lit le contenu du document, en comprend le sens et applique vos instructions en langage naturel. Elle peut séparer par fournisseur, patient, type de document ou toute autre limite sémantique - des choses impossibles avec des outils basés sur les pages.