Divida PDFs com Instruções em Linguagem Natural
Diga à AI como dividir em inglês simples. Ela lê o conteúdo do documento, detecta limites e nomeia cada arquivo - coisas que divisores baseados em páginas nunca poderiam fazer.
- Detecção de limites com AI - com instruções personalizadas
- 3 modos de divisão - smart, intervalos fixos, favoritos
- Processamento em lote - vários PDFs em uma solicitação
- Nomeação automática - arquivos divididos nomeados por conteúdo
Só precisa dividir alguns arquivos? Usar a ferramenta web gratuita
Sua instrução: "Divida quando vir um novo cabeçalho de fatura ou 'Page 1 of X'. Os documentos de cada fornecedor devem ficar separados."
Entrada
PDF contendo: 12 faturas de 5 fornecedores, datas mistas, quantidades de páginas variadas
Saída da AI
reason: "Nova fatura detectada - cabeçalho Acme Corp"
reason: "Novo timbre de fornecedor - GlobeTech Inc"
Por que a divisão com AI supera as ferramentas baseadas em páginas
Divisores baseados em páginas contam páginas. A AI lê o conteúdo e entende os limites.
Entrada:
mixed_invoices.pdf (47 pages)
Dividir a cada:
5 páginas
Saída:
split_1.pdf, split_2.pdf, ... (limites errados)
- Não consegue detectar onde os documentos realmente começam/terminam
- Corta faturas pela metade, mistura fornecedores
- Nomes de arquivo genéricos (split_1, split_2...)
- Não consegue entender o conteúdo do documento
Entrada:
mixed_invoices.pdf (47 pages)
Instrução:
"Divida quando vir novo cabeçalho de fatura ou timbre do fornecedor"
Saída:
2025-01-15_AcmeCorp_Invoice_001.pdf (3 pages)
- Detecta os limites reais do documento a partir do conteúdo
- Segue suas instruções em linguagem natural
- Nomeia arquivos automaticamente com base no conteúdo extraído
- Explica por que cada divisão foi feita
Início rápido
Dois endpoints: envie um arquivo diretamente ou passe uma URL e nós o buscaremos. Use mode=smart with instructions para dizer à AI como detectar limites.
POST /api/v1/pdf-split - upload de arquivo multipart
curl -X POST https://www.renamed.to/api/v1/pdf-split \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -F "file=@mixed_documents.pdf" \ -F "mode=smart" \ -F 'instructions=Split when you detect a new document.Look for: invoice headers, "Page 1 of X", or new letterhead.Keep cover letters with their attachments.'POST /api/v1/pdf-split/from-url - corpo JSON, o servidor busca o arquivo
curl -X POST https://www.renamed.to/api/v1/pdf-split/from-url \ -H "Authorization: Bearer YOUR_API_TOKEN" \ -H "Content-Type: application/json" \ -d '{ "url": "https://example.com/scanned-stack.pdf", "mode": "smart", "instructions": "Separate by patient name.\nEach patient'"'"'s records should be one file.\nInclude all pages until you see a new patient header." }'SDKs
Use nossos SDKs oficiais para uma melhor experiência de desenvolvedor com segurança de tipos e tratamento de erros.
SDK TypeScript
import { RenamedClient } from '@renamed/sdk'const client = new RenamedClient({ apiKey: process.env.RENAMED_API_KEY })// AI reads the bundle, detects boundaries, names each splitconst job = await client.pdfSplit('./mixed_invoices.pdf', { mode: 'smart', instructions: `Split when you detect a new invoice.Look for: company letterhead, "Invoice #", or "Page 1 of X".Each vendor's invoice should be separate.`})// Poll for completionconst result = await job.waitForCompletion()console.log(result.splits)// => [{ filename: "2025-01-15_AcmeCorp_Invoice_001.pdf", reason: "New invoice detected - Acme Corp header" }, ...]Resposta
{ "jobId": "abc123", "status": "completed", "progress": 100, "results": { "results": [{ "originalFilename": "mixed_documents.pdf", "splits": [{ "filename": "2025-01-15_AcmeCorp_Invoice_001.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 3, "reason": "New invoice detected - Acme Corp header" }, { "filename": "2025-01-14_GlobeTech_Invoice_002.pdf", "downloadUrl": "https://...", "expiresAt": "2025-01-16T12:00:00Z", "pages": 2, "reason": "New vendor letterhead - GlobeTech Inc" }] }] }, "creditsUsed": 2}SDKs no GitHub: github.com/renamed-to/renamed-sdk
Autenticação
Todas as solicitações da API exigem autenticação via token Bearer no cabeçalho Authorization .
Token de API (recomendado)
Gere tokens de API em Configurações → Tokens de API. Os tokens têm o prefixo rt_ e fornecem acesso completo à sua conta.
Authorization: Bearer rt_abc123def456...OAuth 2.0
Para aplicativos que autenticam em nome dos usuários, use OAuth 2.0. Após a conclusão do fluxo OAuth, você recebe um token de acesso que funciona da mesma forma:
Authorization: Bearer <oauth_access_token>Consulte a documentação da API para registro do cliente OAuth e detalhes do fluxo.
Parâmetros da API
Principais parâmetros para controlar o comportamento da divisão.
| Parâmetro | Tipo | Obrigatório | Valores / Observações |
|---|---|---|---|
file | File | Sim* | Upload de arquivo único. *Pelo menos um entre file ou files[] é obrigatório. |
files[] | File[] | Sim* | Vários arquivos para processamento em lote. |
mode | string | Não | Padrão: smart.Valores: smart | every-n-pages | by-bookmarks |
instructions | string | Não | Somente para o modo smart . Instruções em linguagem natural para detecção de limites. Máx. 5.000 caracteres. |
pagesPerSplit | integer | Sim se mode= | Número de páginas por divisão. Intervalo: 1-1000. |
Endpoint de URL (/api/v1/pdf-split/from-url)
Os mesmos parâmetros acima, mas em vez de file/files[], use url (string) ou urls (string[]).
O que suas instruções podem fazer
A AI interpreta linguagem natural e aplica detecção de limites complexa que exigiria código personalizado para você mesmo criar.
- Detecção de limites
"Divida quando vir 'Page 1 of X' ou um novo timbre da empresa"- Agrupamento de documentos
"Mantenha cartas de apresentação com seus anexos. Não separe apêndices dos documentos principais."- Divisão baseada em entidades
"Separe por nome do paciente - os registros de cada paciente devem ficar em um arquivo"- Detecção de cabeçalhos
"Cada PURCHASE ORDER inicia um novo documento. Cabeçalhos de fatura também indicam novos documentos."
Modos de divisão
Escolha o modo que se adapta ao seu caso de uso. O modo smart é o padrão.
smartpadrãoA AI detecta automaticamente os limites dos documentos. Opcionalmente, forneça instructions para orientar a detecção de limites.
every-n-pagesDivida em intervalos fixos. Requer o parâmetro pagesPerSplit (1-1000).
by-bookmarksDivida nos limites dos favoritos do PDF. Exige que o PDF de origem tenha favoritos.
Feito para produção
Limites
- Tamanho do arquivo: 100MB máx
- Formatos: Somente PDF
- Instruções: 5.000 caracteres máx
- Páginas por divisão: 1-1,000 (para o modo every-n-pages)
- Processamento: 30s-2min típico
Erros comuns
400 no_filesNenhum arquivo fornecido400 invalid_file_typeNão é um PDF400 file_too_largeExcede 100MB401 unauthorizedChave de API ausente ou inválida402 insufficient_creditsCréditos insuficientes404 not_foundTrabalho não encontrado
Segurança: Todas as solicitações via TLS. O endpoint /from-url bloqueia localhost e faixas de IP privadas.
Preços
1 crédito a cada 3 páginas (arredondado para cima). Depois $9 por 1,000 créditos.
- 50 créditos grátis no cadastro
- Créditos válidos por 12 meses
- Garantia de reembolso de 30 dias
Como começar
Quatro etapas para integrar a API de Divisão de PDF ao seu fluxo de trabalho.
Obtenha seu token de API
Gere um token de API no seu painel. Você recebe 50 créditos grátis no cadastro.
Envie o PDF ou forneça a URL
Envie para /api/v1/pdf-split (upload de arquivo) ou /api/v1/pdf-split/from-url (URL). Inclua suas instructions para o modo smart.
Consulte o endpoint de status
A resposta inicial inclui um statusUrl. Consulte /api/v1/pdf-split/status/{jobId} até status=completed.
Baixe os arquivos divididos
Cada divisão inclui uma downloadUrl. As URLs expiram em 24 horas. O campo reason explica por que cada limite foi detectado.
FAQ
- Como funciona a detecção de limites com AI?
- No modo "smart", a AI analisa o conteúdo do documento para identificar onde um documento termina e outro começa. Ela detecta mudanças em timbre, tipo de documento, fornecedor, padrões "Page 1 of X" e elementos estruturais. Você pode orientá-la com instruções em linguagem natural.
- O que posso colocar no parâmetro instructions?
- Linguagem natural descrevendo como detectar limites. Exemplos: "Divida quando vir um novo cabeçalho de fatura ou Page 1 of X", "Cada documento começa com uma carta de apresentação seguida de anexos", "Separe por nome do paciente - os registros de cada paciente devem ficar em um arquivo".
- Quanto tempo o processamento leva?
- A maioria dos trabalhos é concluída em 30 segundos a 2 minutos, dependendo do tamanho do arquivo e da quantidade de páginas. A API é assíncrona - você envia um trabalho e consulta até a conclusão.
- Qual é o tamanho máximo do arquivo?
- Arquivos PDF de até 100MB. Não há um limite rígido de páginas, mas documentos muito grandes podem levar mais tempo para processar.
- Como os arquivos divididos são nomeados?
- No modo smart, a AI gera nomes de arquivo descritivos com base no conteúdo do documento - extraindo datas, fornecedores, tipos de documento e outras entidades. Cada divisão também inclui um campo "reason" explicando por que o limite foi detectado.
- Como isso difere dos divisores de PDF tradicionais?
- Divisores tradicionais funcionam com números de página ou favoritos. Esta API lê o conteúdo do documento, entende o significado e aplica suas instruções em linguagem natural. Ela pode dividir por fornecedor, paciente, tipo de documento ou qualquer limite semântico - coisas impossíveis com ferramentas baseadas em páginas.