Divida PDF con Instrucciones en lenguaje natural
Dígale a la AI cómo dividir en inglés sencillo. Lee el contenido del documento, detecta límites y nombra cada archivo: cosas que los divisores basados en páginas nunca podrían hacer.
- Detección de límites impulsada por AI - con instrucciones personalizadas
- 3 modos de división - smart, intervalos fijos, marcadores
- Procesamiento por lotes - varios PDF en una solicitud
- Asignación automática de nombres - archivos divididos nombrados por contenido
¿Solo necesita dividir algunos archivos? Usar la herramienta web gratuita
Su instrucción: "Divide cuando veas un nuevo encabezado de factura o 'Página 1 de X'. Los documentos de cada proveedor deben estar separados."
Entrada
PDF que contiene: 12 facturas de 5 proveedores, fechas mezcladas, cantidades variables de páginas
Salida de AI
reason: "Nueva factura detectada - encabezado de Acme Corp"
reason: "Nuevo membrete de proveedor - GlobeTech Inc"
Por qué la división con AI supera a las herramientas basadas en páginas
Los divisores basados en páginas cuentan páginas. La AI lee el contenido y entiende los límites.
Entrada:
mixed_invoices.pdf (47 pages)
Dividir cada:
5 páginas
Salida:
split_1.pdf, split_2.pdf, ... (límites incorrectos)
- No puede detectar dónde empiezan o terminan realmente los documentos
- Corta facturas por la mitad, mezcla proveedores
- Nombres de archivo genéricos (split_1, split_2...)
- No puede entender el contenido del documento
Entrada:
mixed_invoices.pdf (47 pages)
Instrucción:
"Divide cuando veas un nuevo encabezado de factura o membrete de proveedor"
Salida:
2025-01-15_AcmeCorp_Invoice_001.pdf (3 pages)
- Detecta límites reales de documentos a partir del contenido
- Sigue sus instrucciones en lenguaje natural
- Nombra archivos automáticamente según el contenido extraído
- Explica por qué se hizo cada división
Inicio rápido
Dos endpoints: cargue un archivo directamente o pase una URL y lo obtendremos. Use mode=smart with instructions para indicarle a la AI cómo detectar límites.
POST /api/v1/pdf-split - carga de archivo multipart
curl -X POST https://www.renamed.to/api/v1/pdf-split \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -F "file=@mixed_documents.pdf" \ -F "mode=smart" \ -F 'instructions=Split when you detect a new document.Look for: invoice headers, "Page 1 of X", or new letterhead.Keep cover letters with their attachments.'POST /api/v1/pdf-split/from-url - cuerpo JSON, el servidor obtiene el archivo
curl -X POST https://www.renamed.to/api/v1/pdf-split/from-url \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -H "Content-Type: application/json" \ -d '{ "url": "https://example.com/scanned-stack.pdf", "mode": "smart", "instructions": "Separate by patient name.\nEach patient'"'"'s records should be one file.\nInclude all pages until you see a new patient header." }'SDKs
Use nuestros SDKs oficiales para una mejor experiencia de desarrollo con seguridad de tipos y manejo de errores.
SDK de TypeScript
import { RenamedClient } from '@renamed/sdk'const client = new RenamedClient({ apiKey: process.env.RENAMED_API_KEY })// AI reads the bundle, detects boundaries, names each splitconst job = await client.pdfSplit('./mixed_invoices.pdf', { mode: 'smart', instructions: `Split when you detect a new invoice.Look for: company letterhead, "Invoice #", or "Page 1 of X".Each vendor's invoice should be separate.`})// Poll for completionconst result = await job.waitForCompletion()console.log(result.splits)// => [{ filename: "2025-01-15_AcmeCorp_Invoice_001.pdf", reason: "New invoice detected - Acme Corp header" }, ...]Respuesta
{ "jobId": "abc123", "status": "completed", "progress": 100, "results": { "results": [{ "originalFilename": "mixed_documents.pdf", "splits": [{ "filename": "2025-01-15_AcmeCorp_Invoice_001.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 3, "reason": "New invoice detected - Acme Corp header" }, { "filename": "2025-01-14_GlobeTech_Invoice_002.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 2, "reason": "New vendor letterhead - GlobeTech Inc" }] }] }, "creditsUsed": 2}SDKs en GitHub: github.com/renamed-to/renamed-sdk
Autenticación
Todas las solicitudes de API requieren autenticación mediante token Bearer en el encabezado Authorization .
Token de API (recomendado)
Genere tokens de API desde Configuración → Tokens de API. Los tokens tienen el prefijo rt_ y proporcionan acceso completo a su cuenta.
Authorization: Bearer rt_abc123def456...OAuth 2.0
Para aplicaciones que autentican en nombre de los usuarios, use OAuth 2.0. Cuando se completa el flujo de OAuth, usted recibe un token de acceso que funciona de la misma manera:
Authorization: Bearer <oauth_access_token>Consulte la documentación de API para el registro del cliente OAuth y los detalles del flujo.
Parámetros de API
Parámetros clave para controlar el comportamiento de la división.
| Parámetro | Tipo | Obligatorio | Valores / Notas |
|---|---|---|---|
file | File | Sí* | Carga de un solo archivo. *Se requiere al menos uno de file o files[] . |
files[] | File[] | Sí* | Varios archivos para procesamiento por lotes. |
mode | string | No | Predeterminado: smart.Valores: smart | every-n-pages | by-bookmarks |
instructions | string | No | Solo para el modo smart . Instrucciones en lenguaje natural para la detección de límites. Máximo 5,000 caracteres. |
pagesPerSplit | integer | Sí si mode= | Número de páginas por división. Rango: 1-1000. |
Endpoint de URL (/api/v1/pdf-split/from-url)
Los mismos parámetros de arriba, pero en lugar de file/files[], use url (string) o urls (string[]).
Lo que sus instrucciones pueden hacer
La AI interpreta el lenguaje natural y aplica una detección de límites compleja que requeriría código personalizado si la desarrollara usted mismo.
- Detección de límites
"Split when you see 'Page 1 of X' or a new company letterhead"- Agrupación de documentos
"Keep cover letters with their attachments. Don't split appendices from main documents."- División basada en entidades
"Separate by patient name - each patient's records should be one file"- Detección de encabezados
"Each PURCHASE ORDER starts a new document. Invoice headers also indicate new documents."
Modos de división
Elija el modo que se ajuste a su caso de uso. El modo smart es el predeterminado.
smartpredeterminadoLa AI detecta los límites del documento automáticamente. Opcionalmente, proporcione instructions para orientar la detección de límites.
every-n-pagesDivida en intervalos fijos. Requiere el parámetro pagesPerSplit (1-1000).
by-bookmarksDivida en los límites de los marcadores del PDF. Requiere que el PDF de origen tenga marcadores.
Diseñado para producción
Límites
- Tamaño de archivo: máx. 100 MB
- Formatos: Solo PDF
- Instrucciones: 5,000 caracteres máx.
- Páginas por división: 1-1,000 (para el modo every-n-pages)
- Procesamiento: 30s-2min típico
Errores comunes
400 no_filesNo se proporcionaron archivos400 invalid_file_typeNo es un PDF400 file_too_largeSupera 100MB401 unauthorizedClave de API ausente o no válida402 insufficient_creditsNo hay suficientes créditos404 not_foundTrabajo no encontrado
Seguridad: Todas las solicitudes a través de TLS. El endpoint /from-url bloquea localhost y los rangos de IP privadas.
Precios
1 crédito por 3 páginas (redondeado hacia arriba). Luego $9 por 1,000 créditos.
- 50 créditos gratis al registrarse
- Créditos válidos por 12 meses
- Garantía de devolución de dinero de 30 días
Primeros pasos
Cuatro pasos para integrar la API de división de PDF en su flujo de trabajo.
Obtenga su token de API
Genere un token de API desde su panel. Usted obtiene 50 créditos gratis al registrarse.
Cargue un PDF o proporcione una URL
Envíe a /api/v1/pdf-split (carga de archivo) o /api/v1/pdf-split/from-url (URL). Incluya sus instructions para el modo smart.
Consulte el endpoint de estado
La respuesta inicial incluye un statusUrl. Consulte /api/v1/pdf-split/status/{jobId} hasta que status=completed.
Descargue los archivos divididos
Cada división incluye una downloadUrl. Las URL vencen en 24 horas. El campo reason explica por qué se detectó cada límite.
Preguntas frecuentes
- ¿Cómo funciona la detección de límites con AI?
- En el modo "smart", la AI analiza el contenido del documento para identificar dónde termina un documento y comienza otro. Detecta cambios en el membrete, tipo de documento, proveedor, patrones de "Page 1 of X" y elementos estructurales. Puede orientarla con instrucciones en lenguaje natural.
- ¿Qué puedo poner en el parámetro instructions?
- Lenguaje natural que describe cómo detectar límites. Ejemplos: "Split when you see a new invoice header or Page 1 of X", "Each document starts with a cover letter followed by attachments", "Separate by patient name - each patient's records should be one file".
- ¿Cuánto tarda el procesamiento?
- La mayoría de los trabajos se completan en 30 segundos a 2 minutos según el tamaño del archivo y la cantidad de páginas. La API es async: usted envía un trabajo y consulta hasta que se complete.
- ¿Cuál es el tamaño máximo de archivo?
- Archivos PDF de hasta 100MB. No hay un límite estricto de páginas, pero los documentos muy grandes pueden tardar más en procesarse.
- ¿Cómo se nombran los archivos divididos?
- En modo smart, la AI genera nombres de archivo descriptivos según el contenido del documento: extrae fechas, proveedores, tipos de documento y otras entidades. Cada división también incluye un campo "reason" que explica por qué se detectó el límite.
- ¿En qué se diferencia de los divisores de PDF tradicionales?
- Los divisores tradicionales trabajan con números de página o marcadores. Esta API lee el contenido del documento, entiende el significado y aplica sus instrucciones en lenguaje natural. Puede dividir por proveedor, paciente, tipo de documento o cualquier límite semántico: cosas imposibles con herramientas basadas en páginas.